저작권 인공 지능: OpenAI, Google 및 Meta의 미래를 놓고 백악관과 DOJ가 충돌합니다.

워싱턴 인공지능이 미국인의 작업으로부터 무료로 학습할 수 있는지 여부는 아직 명확하지 않습니다. 그 법무부 (DOJ, 영어로 약어)는 이번 주에 사법 보고서를 제출했습니다. 공정한 사용 — 소유자의 허가 없이 작품의 특정 사용을 허용하는 합법적인 사용 — 거의 뉘앙스나 예외 없이.

정권 내부 충돌

문서에 따르면, 거대 기술 기업이 대규모 언어 모델을 통제하는 것은 공익에 부합하지 않습니다.대규모 언어 모델 LLM(영어 약어로 LLM)은 라이센스 장벽을 통해 결국 기존 미디어에 대한 보조금으로 기능하게 됩니다. DOJ는 보호된 텍스트로 LLM을 교육하는 것이 불법이라고 간주하는 해석을 거부할 것을 요청합니다.

그만큼 백악관 그러나 덜 강력한 입장을 유지합니다. 지난 3월 발표된 인공지능 프레임워크에서 행정부는 그러한 훈련이 저작권을 위반하는지 여부에 대한 의문이 여전히 열려 있음을 인정했습니다. 법무부는 법무부 차관의 X 메시지를 참고했다. 스탠리 E. 우드워드 주니어9월 2일자로 대통령이 다음과 같이 강조했습니다. 도널드 트럼프 AI의 영역이 ‘모든 미국인의 국가 안보, 번영, 경제적 이동성에 중요’하다고 간주합니다.

글은 다음과 같이 주장한다. 오픈AI 모델을 훈련하기 위해 작품을 복사하지만 다시 출판하기 위해 복사하지는 않습니다. DOJ는 사본의 목적이 ‘복사된 저작물의 목적과 종류가 다르다’고 주장합니다. 시스템은 어휘, 구문 및 지식의 통계적 패턴을 학습하지만 원래의 표현 내용을 재현하지는 않습니다. 공정 사용 원칙은 이러한 방어의 핵심입니다.

논쟁은 이론적인 것이 아니다. 뉴욕 타임즈 고소당하다 오픈AI 2023년에는 훈련을 위해 채팅GPT 수백만 개의 신문 기사를 게재하고 회사가 자신의 스타일을 모방한 반응을 생성했다고 비난했습니다. 마이크로소프트 사건에 포함되었기 때문에 부조종사 소송에 따르면 이는 정보의 문자 그대로의 단편을 재생산한 것입니다. 인류학창시자 클로드또한 대량 구매된 수백만 권의 도서를 스캔한 후 파기한 혐의도 받았습니다.

법원 결정에 따라 디지털화된 지식을 무상으로 사용할 수 있는지, 아니면 창작자가 교육에 사용된 각 작품에 대해 비용을 청구할 수 있는지 여부가 결정됩니다.

에반 스와츠트라우버기술 정책 전문가이자 전 연방통신위원회(Federal Communications Commission) 고문이었던 는 DOJ의 의견에 동의하지 않습니다. ‘행정부는 소송의 복잡성을 인식하고 법원이 결정해야 한다고 말했습니다. 반면 DOJ는 공격적인 입장을 취했습니다. 거의 모든 교육은 공정 사용이고 라이선스는 부정적입니다.’라고 그는 설명합니다. Swarztrauber는 소규모 창작자들에게는 자신의 권리를 방어할 수 있는 New York Times의 자원이 없다고 경고합니다.

OpenAI, Google 및 Meta의 위험은 무엇입니까?

합법적인 사용을 통합하는 판결은 훈련 모델을 더 저렴하게 만들고 이미 대량의 말뭉치를 축적하고 있는 대규모 실험실의 이점을 통합할 것입니다. Google 그리고 목표 그들은 같은 관심으로 사건을 관찰한다. 오픈AI: 그들의 언어 모델은 인터넷, 서적, 뉴스의 텍스트로 훈련되었으며 라이센스 의무가 있으면 경쟁사의 진입 비용이 증가합니다.

동시에, 출판사의 패배는 언론 매체와 출판사가 라이선스 계약을 협상할 수 있는 능력을 감소시킬 것입니다. 스페인 출판 시장도 빼놓을 수 없습니다. 대규모 미국 그룹도 스페인어 콘텐츠로 스스로 훈련합니다. 편집자 및 저자 스페인 그들이 뉴욕 소송을 계속하는 이유는 연방 법원이 확립한 원칙 때문입니다. 뉴욕 사실상 글로벌 협상에 영향을 미칠 것이다.

전례는 주의를 요한다. 2015년 대법원은 도서 디지털화 사업을 인정한 판결을 유보했다. Google 도서 공정 사용으로 간주되지만 해당 사례는 생성 모델의 교육이 아닌 제한된 조각의 게시에 중점을 두었습니다. 차이점은 매우 중요합니다. LLM은 인용하기 위해 복사하는 것이 아니라 배우고 창조하기 위해 복사합니다.

워싱턴 로직

행정부를 위해 지우다우선순위는 외국의 적에 대한 기술 주권입니다. 그만큼 백악관 DOJ는 전략적 진단을 공유합니다. 인공 지능의 숙련도는 국가 안보 자산으로 간주되며 훈련 속도를 늦추는 모든 장벽은 경쟁 우위로 간주됩니다. 두 행위자를 구분하는 것은 이를 보장해야 하는 법적 원칙의 범위입니다.

워싱턴 라이센스 장벽을 의심스럽게 봅니다. DOJ는 다음과 같이 직설적으로 말합니다. 교육에 사례별로 허가가 필요한 경우 예산이 큰 실험실에서만 해당 액세스 권한을 부여할 수 있습니다. 반면 백악관은 판사가 혁신과 지적재산권 사이의 균형을 결정하는 것을 선호합니다. 이는 행정부와 법무부의 전형적인 구분입니다. 연방 정부가 법정에서 항상 한 목소리로 말하는 것은 아닙니다.

다음에 대한 영향 스페인 간접적이지만 구체적입니다. 공정 사용에 유리한 원칙은 스페인어로 된 AI 도구 개발을 더 저렴하게 만들고 모델을 통합하려는 기술 및 출판 회사의 비용을 절감합니다. 그 대가로 스페인 창작자와 미디어는 미국 플랫폼에 비해 협상 능력을 상실합니다. 훈련의 지적재산권은 유럽 법원보다 미국 법원에서 더 빨리 해결될 것입니다. 유럽연합 집행위원회는 이미 모델의 투명성을 규제하고 있습니다. AI법그러나 교육의 저작권 세부정보는 아직 해결되지 않았습니다. 브뤼셀.

다음 중요한 창구는 해당 소송을 조사하는 연방 판사의 결정입니다. 뉴욕 타임즈 ~에 맞서 오픈AI아직 확실한 날짜는 없습니다. 법원이 DOJ의 주장을 채택할 경우 유럽 출판사는 연구실과 라이선스 재협상에 어려움을 겪게 될 것입니다. 이를 거부하면 스트리밍 업계의 라이선스 결제를 연상시키는 콘텐츠 협상 단계가 시작된다.

사건 파일

  • 사례: 법무부는 보호 대상 저작물을 사용하여 언어 모델을 훈련하는 소송에서 법원에 브리핑을 제출하고 공정 사용 원칙을 옹호하면서 백악관의 보다 신중한 틀과 충돌했습니다.
  • 주요 데이터: DOJ는 LLM 교육이 저작권을 침해하지 않는다고 주장합니다. New York Times는 2023년에 OpenAI를 고소했습니다. Anthropic과 Microsoft는 유사한 관행으로 선정되었습니다. Google Books 선례(2015)는 특정 합법적인 사용을 검증했습니다.
  • 스페인의 경우: 이 결정에 따라 스페인어로 모델을 훈련하는 비용과 스페인어 제작자 및 편집자가 콘텐츠에 대한 라이선스를 청구할 수 있는 능력이 결정됩니다.