Anthropic은 AI 개발 속도를 늦추고 AI 모델을 외부 감사자에게 공개하여 기술 경쟁에 부담을 줄 것을 제안합니다.
작업의 핵심
- 최초의 일방적인 외부 감사 계약. 회사는 업계가 표준에 동의할 때까지 기다리지 않고 보안 관행을 확인하기 위해 METR과 같은 평가자에게 액세스 권한을 부여할 것입니다.
- 모델 학습 속도를 늦추세요. Dario Amodei는 규제 기관과 기업이 다음 세대보다 먼저 안전 장치를 구축할 수 있도록 국경의 속도를 설정할 것을 제안합니다.
- 완전한 규제 투쟁의 움직임. 이는 유럽이 AI법을 시행하고 미국이 프론티어 모델에 대한 연방 감독을 논의하는 가운데 나온 것입니다.
AI의 경계에 한계를 두려는 노력
Anthropic의 CEO인 Dario Amodei는 보안 장치를 구축하고 규제 기관이 모델을 평가할 시간을 주기 위해 교육 및 개발 속도를 늦추는 등 경계선을 따라잡을 것을 요구하는 에세이를 발표했습니다. The Verge에 따르면 관리자는 3단계 계획을 제안합니다.
첫 번째 단계는 모델 안전 전문 기관인 METR과 같은 외부 테스터에 대한 폭넓은 접근 권한을 부여하는 것입니다. Anthropic은 이 임무를 일방적으로 맡는다. 회사는 업계가 표준에 동의할 때까지 기다리지 않습니다..
두 번째 단계에는 부문별 합의가 포함됩니다. 세 번째는 정부의 개입을 지적한다. Amodei는 특정 감사가 아닌 ‘보안 관행 및 약속 준수’에 대해 이야기합니다.
이 제안은 규제 투쟁 중에 나왔습니다. 유럽은 AI법을 전개하고 미국은 프런티어 모델에 대한 구체적인 연방 감독을 논의합니다. 그러한 맥락에서 이번 결정은 Anthropic을 독특한 위치에 놓았습니다.
그가 제안하는 리듬은 모든 사람을 만족시키지 못할 것입니다. 경기둔화는 자본확충 논리와 충돌 그 분야를 장악하고 있는 거죠.
외부 감사자에게 모델을 공개하기로 한 결정은 양보가 아닙니다. 이는 한계에 대해 아직 합의하지 않은 부문에서의 시장 지위입니다.
Anthropic의 경쟁사, 외부 감사 직면
METR에 모델을 공개하면 경쟁 변수가 도입됩니다. OpenAI, Google, Meta는 평가자와 자체 동맹을 유지하고 있지만 어느 누구도 단방향 움직임으로 그렇게 강력하게 액세스 권한을 부여한 적이 없습니다.
투자자들에게 문제는 타이밍 중 하나입니다. Anthropic이 경계를 늦추면 속도를 늦추지 않는 사람들에게 이점이 있습니까? 부문을 맴돌고 있는 질문이다.
Amodei는 세계적인 모라토리엄을 요구하지 않습니다. 평가할 수 있는 리듬을 요청하세요. 그 차이는 미묘하지만 시장에서는 그것이 전부입니다.
아모데이의 반전 뒤에는 무엇이 있을까?
이번 결정에는 보안을 넘어서는 비즈니스적 의미가 담겨 있습니다. Anthropic은 자발적인 표준을 선도하고자 합니다. 규제 당국이 의무적인 조치를 취하기 전에.
유럽연합에서는 AI법이 이미 범용 모델에 대한 규제 틀을 마련하고 있다. 미국 회사에는 관련 스페인 자회사가 없지만 브뤼셀을 테스트 베드로 보고 있습니다. 거기에는 다른 시장에서도 복제될 계산 임계값과 감사 의무가 정의되어 있습니다.
상업적인 위험이 있습니다. 그렇습니다. 평판 포지셔닝도 마찬가지입니다. 경쟁사가 속도를 늦추지 않으면 Anthropic은 각 모델 세대의 성능이 가장 중요한 지표로 남아 있는 시장에서 점유율을 잃을 수도 있습니다.
이 사설에서 우리는 Amodei의 운동이 자선 활동이 아니라는 것을 이해합니다. 보안을 경쟁 우위로 전환하겠다는 약속입니다..
업계의 다음 대규모 자발적 감사 협약은 이것이 전환점인지 일시적인 예외인지 알려줄 것입니다.
