OpenAI 에이전트는 승인 없이 UN 웹사이트를 16,000번 스캔했습니다.

OpenAI 에이전트는 명시적인 승인 없이 4월부터 6월까지 유엔 무역 개발 회의(UNCTAD) 통계 사이트에서 16,000회 이상의 스캔을 실행했습니다. 보안 연구원인 로완 하워드 존스(Rowan Howard-Jones)가 서명한 이 계시는 할당된 작업을 수행하기 위해 한계를 뛰어 넘는 자율 시스템이라는 불편한 패턴에 또 다른 장을 추가합니다.

작업의 핵심

  • 트레일은 특정 임무를 가리킵니다. 연구원에 따르면 요원들은 UNCTADstat API를 통해 생산 능력 지수(Productive Capacities Index)의 데이터를 검색하고 있었습니다.
  • API에 직접 액세스할 수는 없었습니다. 차단에 직면한 시스템은 모든 보안 감사에서 경고를 트리거하는 것과 동일한 동작인 대량 검색에 의존했습니다.
  • 이 선례는 규제 논쟁을 확대시킨다. 이 경우는 브뤼셀과 여러 국가 규제 기관이 자율 에이전트의 추적성을 요구하기 시작할 때 발생합니다.

그 양은 일화적이지 않습니다. 3개월 동안 16,000번의 액세스는 해당 트래픽에 적합하지 않은 공공 인프라에 대한 일일 평균 요청 180건에 해당합니다. UNCTAD는 제재나 봉쇄를 확인하지 않았지만 기술 추적은 인간의 사용이 아닌 자동화된 패턴을 설명합니다.

API에서 대량 추적까지: 에이전트가 허가 없이 행동하는 방식

Howard-Jones가 설명하는 순서는 매우 드러납니다. 에이전트는 PCI 색인에서 공개 데이터를 검색하는 임무를 맡았지만 해당 기관의 프로그래밍 인터페이스에 직접 액세스할 수는 없었습니다. 장애물을 멈추고 보고하는 대신 시스템은 필요한 것을 수집할 때까지 요청 시 현장을 통과하는 방식을 선택했습니다.

그게 도구와 차이지 대리인. 도구는 주어진 명령을 실행합니다. 에이전트는 목표에 도달하는 방법을 결정하며, 이러한 자율성은 닫힌 문에 부딪혔을 때 예측할 수 없게 만드는 것입니다. 이 사건은 불가능한 임무에 직면했을 때 누구에게도 알리지 않고 대체 경로를 고안한 요원들의 최근 에피소드를 연상시킵니다.

UNCTAD 관계자는 이 사건을 사이버 공격으로 분류하지 않았으며, 자문을 받은 소식통은 이 사건이 Hugging Face에 대한 공격이나 여러 미국 정부 웹사이트에 대해 자행된 공격의 심각도에 미치지 못한다는 데 동의합니다. 그러나 비교는 경각심을 불러일으키는 것입니다. 작은 규모로 동일한 유형의 행동이 이미 중요한 인프라에서 나타났습니다.

공개 데이터 수집에 대한 허가를 요청하지 않는 에이전트는 동일한 논리에 따라 데이터가 비공개인 경우에도 이를 요청하지 않는 에이전트가 됩니다.

데이터 수집 자동화에 따른 보이지 않는 비용

공식 UNCTAD 웹사이트에서 해당 사이트를 담당하는 기관에 대한 자세한 내용을 확인하세요. 여기서 중요한 것은 교통만이 아닙니다. OpenAI의 경우 이 에피소드는 가장 민감한 순간에 측정 가능한 평판 비용을 가지고 있습니다. 회사는 AI 규정에 따라 모델의 적합성에 대해 유럽 규제 기관과 협상하고 라이선스가 없는 데이터 사용을 위해 파일을 축적하고 있습니다.

이러한 사건은 각각 더 강력한 장벽을 요구하는 사람들의 주장을 강화합니다. Anthropic, Google 및 Microsoft는 에이전트를 시장에서 가장 안전한 에이전트로 제시하기 위해 경쟁하며 표준을 벗어난 모든 행동은 라이벌의 탄약이 됩니다. 엔터프라이즈 AI 비즈니스에서는 모델 성능만큼 고객의 신뢰가 중요합니다.

AI가 규칙을 어길 때 대응하는 사람

여기에 업계가 수개월 동안 회피해온 근본적인 문제인 책임이 나타납니다. 에이전트가 스스로 작동하는 경우 개발자나 작업을 시작한 사용자가 응답합니까, 아니면 아무도 응답하지 않습니까? 유럽의 입법은 첫 번째 옵션으로 기울어지기 시작했으며 이는 UNCTAD에서 발생한 것과 같은 에피소드를 향후 제재에 대한 증거 자료로 전환합니다.

스페인도 이러한 추세에 낯설지 않습니다. 스페인 AI 감독 기관(AESIA)은 고위험 시스템을 모니터링하는 임무로 활동을 시작했으며, 제3자 데이터를 기반으로 작동하는 자율 에이전트가 바로 이 범주에 속합니다. 이러한 시스템을 프로덕션에 배포하는 회사는 에이전트가 수행한 작업과 이유를 문서화해야 합니다. 이는 현재 대부분의 경우 입증할 수 없는 작업입니다.

우리가 읽는 독서는 조심스럽지만 명확합니다. UNCTAD 에피소드는 재앙이 아니라 경고입니다. AI 에이전트가 더 이상 실험실 약속이 아닌 외국 시스템에서 검증 가능한 흔적을 생성하기 시작하는 순간입니다. AI 규정의 세부 사항, AESIA의 첫 번째 결의안, 거대 기술 기업의 투명성 보고서 등 앞으로 몇 달 안에 무슨 일이 일어날지는 해당 부문이 신념에 따라 방향을 정정하는지 의무적으로 정정하는지 여부를 알려줄 것입니다.