OpenAI 해킹: Anthropic의 Claude는 GitHub에서 개인 코드를 훔치는 데 사용됩니다.

OpenAI 해킹은 직접적인 라이벌 모델을 사용하여 실행되었습니다. Ars Technica에 따르면 소규모 사이버 보안 연구원 그룹은 Anthropic의 도구인 Claude를 사용하여 회사 직원의 ChatGPT 계정에 액세스하고 개인 소프트웨어 정보를 읽고 코드 변경을 제안했습니다. 모델의 크랙으로 인해 항목이 발생한 것이 아니라 기업 계정과 관련된 권한으로 인해 항목이 발생했습니다.

미묘한 차이가 중요합니다. 우리는 교육 인프라에 대한 공격이 아니라 개인 소프트웨어 정보에 대한 액세스 및 수정 제안 기능에 대해 이야기하고 있습니다. 이는 이미 인증된 세션에서 권한이 상속된 작업자의 ID에 연결된 코드 저장소를 가리킵니다. 해당 사건은 피해를 입은 회사가 아닌 경쟁 공급업체에 알려졌습니다.. 이 이야기는 파일 사본이 있었는지, OpenAI가 내부 조사를 시작했는지 여부를 명확히 밝히지 않습니다.

작업의 핵심

  • 벡터는 모델이 아닌 구슬이었습니다.. 연구원들은 GPT 또는 Claude의 보호 장치를 위반하지 않았습니다. 그들은 작업자 세션에 들어가 거기에서 개인 소프트웨어에 액세스했습니다.
  • 해당 작업은 유료 감사였습니다.. 그들은 보안 전문가를 위해 설계된 Anthropic 도구를 사용하여 작업했으며, 공격자가 결함을 악용하기 전에 결함을 찾아내는 프로그램 내에서 작업 비용을 청구했습니다.
  • 기업 비즈니스에 타격이 가해짐. OpenAI는 대규모 계정에 신뢰를 판매하며 가장 직접적인 경쟁자가 발견에 서명합니다.

구멍은 모델에 있는 것이 아니라 직원의 계정에 있습니다.

더욱이 그 작전은 그 기원부터 합법적이었다. 연구원들은 보안 전문가를 위해 설계된 Anthropic 도구에 대한 액세스 권한을 얻었으며 취약점 사냥 프로그램 내 작업에 대한 대가를 받았습니다. 이는 해당 분야의 일반적인 메커니즘입니다. 공격자가 버그를 악용하기 전에 버그를 발견한 사람에게 돈이 지급됩니다. 이 경우 차이점은 감사인과 피감사인의 신원입니다.

그만큼 버그 현상금 이는 대규모 AI 연구소의 고정 보안 지출 항목이 되었습니다. 발견당 비용을 지불하고 게시하기 전에 기밀 유지에 서명합니다.해당 부문의 범위는 중요도에 따라 4자리에서 6자리까지입니다. 여기서는 액세스 권한 부여, 유급 작업 및 적시에 발견 보고라는 프로토콜을 따랐습니다. 침입이 아니라 감사입니다.

OpenAI의 문제는 기술적인 것이 아니라 시장입니다. 귀하의 비즈니스 고객은 컴퓨팅 성능보다 신뢰를 얻습니다.. 모델을 생산에 통합하는 모든 유럽 은행은 보안 설문지를 통과하고 기술 공급업체를 감사해야 합니다. 이는 2025년 1월부터 DORA 규정에 따라 서명된 문서로 변경된 의무입니다.

AI 연구소는 데모에서 실패해도 괜찮습니다. 당신이 감당할 수 없는 것은 기업 고객이 서명한 보안 보고서를 통과하지 못하는 것입니다.

경쟁의 아이러니는 무시하기 어렵습니다. 이 보고서는 OpenAI와 Anthropic 간의 비즈니스 계약을 위한 싸움이 진행 중인 가운데 나온 것입니다. 두 회사는 동일한 예산과 동일한 보안 스토리를 위해 싸우고 있습니다. 한 도구가 다른 도구를 감사하는 역할을 한다는 사실은 그 결과를 단순한 기술 문서가 아닌 상업적 주장으로 전환시킵니다. 안전 이야기도 판매됩니다.

Anthropic은 OpenAI를 공개하는 감사자를 무장시킵니다.

Anthropic은 이 에피소드를 승리로 표현하지 않았으며 아마도 그렇지 않을 것입니다. 보안 전문가를 위한 도구는 사전 신원 확인과 엄격한 사용 규칙을 갖춘 상용 제품입니다. 그 가치는 전체 생태계가 이를 중립으로 간주하는지 여부에 따라 달라집니다.. 특정 경쟁자를 겨냥한 무기로 인식되면 그 존재 이유를 상당 부분 상실하게 된다.

헤드라인에 혼합되는 경향이 있는 두 가지 항목인 ‘해킹’과 ‘유료 감사’를 분리하는 것이 편리합니다. 두 번째는 광범위한 관행이며 특정 부문에서는 계약에 의해 의무화됩니다. 첫 번째는 의도와 허가의 부재에 관한 것입니다. 여기에 버그 검색 권한이 있었습니다.해당 권한의 정확한 범위는 모니터링해야 할 범위입니다. 한 회사의 코드가 다른 회사의 생태계 내에 존재할 때 발생하는 일입니다.

스페인에서는 대부분의 보상 프로그램이 미국보다 훨씬 낮은 금액을 지불하며, 해당 용량의 대부분은 사이버 보안 분야에서 IBEX 35의 대명사인 Telefónica Tech 또는 Indra와 같은 제공업체에 집중되어 있습니다. INCIBE는 기업과 시민의 사건에 대한 대응을 조정합니다. Indra는 다른 누구도 가지 않는 곳에 장비가 있다는 약속을 바탕으로 사업을 구축했습니다. AI 실험실에 적용된 동일한 약속은 더 이상 서비스가 아니며 평판 위험이 됩니다.

기업의 신뢰, OpenAI의 가장 취약한 자산

유럽의 규제 체계는 압력을 가중시킵니다. 범용 모델에 대한 의무는 2025년 중반부터 시행되었으며, 2026년 8월부터는 부록 III의 고위험 시스템에 대한 요구 사항도 적용됩니다. AI법은 공급망에서 사고가 어떻게 관리되는지에 대한 문서화를 요구합니다.단, 기업 계정의 보안을 인증하지는 않습니다. 개인 코드에 대한 부적절한 접근은 바로 이 상자에 속합니다.

OpenAI의 경우 실제 테스트는 다음 보안 보고서와 다음 기업 클라이언트 감사에서 이루어질 것입니다. 거기서 우리는 에피소드가 보상 프로그램에 대한 일화로 남아 있는지, 아니면 누가 누가 시청하는지에 대한 토론의 또 다른 장으로 남아 있는지 알게 될 것입니다. 이 사설에서 우리는 간단한 아이디어를 따릅니다. 오늘날 AI 연구소의 개인 코드는 많은 특허보다 더 가치가 있으며, 이를 보호하는 사람은 경쟁업체가 이를 감사하도록 허용해서는 안 됩니다.