모델 816건 · 국산 131 · 가격 654 추적 중
창작과 저작권

MS·OpenAI 내부문서 “AI 학습은 전례없는 절도”

Nieman Lab·2026-09-18영문 원문주요

요약

뉴욕타임스 등 언론사들이 OpenAI·Microsoft를 상대로 낸 소송에서 그동안 봉인됐던 내부 문건이 공개됐다. Microsoft 응용과학 담당 이사 Brent Hecht는 대규모 언어모델의 콘텐츠 학습을 "전례없는 규모의 절도"라 표현했고, 다른 내부 문서는 "LLM은 자신의 공급망을 파괴하는 제품"이라며 "doom loop"라는 표현까지 사용했다. OpenAI의 ChatGPT 총괄 Nick Turley는 언론사가 "존재적 위협"에 직면했으며 자사 제품이 "대체적"이라고 인정했고, 공동창업자 Greg Brockman은 뉴욕타임스 기사 문장을 잘 예측한다고 언급했으며 페이월 우회 방법을 전달받고 "좋다"고 답한 사실도 드러났다. Microsoft 측은 해당 발언이 개인 의견일 뿐 회사 입장이 아니라고 반박했다.

큐레이터 노트

원문에 없는 맥락입니다

AI 기업들은 대외적으로 학습이 저작권법상 '공정 이용'에 해당한다고 주장해 왔는데, 이번 문건은 내부적으로는 언론사에 대한 위협과 무보상 문제를 스스로 인지하고 있었음을 보여준다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

9월 17일 TechCrunch 보도로 마이크로소프트 임원이 AI 스크래핑을 '역사상 최대 노동 절도'라 부른 내부 문건이 처음 공개됐는데, 이번 보도는 같은 소송(뉴욕타임스 대 OpenAI·마이크로소프트)에서 봉인 해제된 문건을 더 확장해 OpenAI 측 인사들의 발언까지 드러낸 것이다.

짚어야 할 점

  • OpenAI·마이크로소프트는 대외적으로 학습이 '공정 이용'이라 주장해 왔는데, 내부 문건은 절도·존재적 위협 같은 표현을 스스로 썼다는 점에서 공개 입장과 내부 인식 사이의 간극을 보여준다.
  • Greg Brockman이 페이월 우회 방법을 전달받고 '좋다'고 답했다는 대목은, 단순한 우려 표명을 넘어 실제 침해 방법을 인지하고 승인했을 가능성을 시사한다.
  • 마이크로소프트가 해당 발언을 '개인 의견일 뿐 회사 입장이 아니다'라고 선을 그은 것 자체가, 이 문건이 소송에서 얼마나 불리하게 작용할 수 있는지를 방증한다.

아직 확인되지 않은 것

  • 이런 내부 발언이 실제 저작권 침해 소송의 법적 판단(공정 이용 여부)에 어떤 영향을 미칠지는 확인되지 않았다.
  • Brockman이 '좋다'고 답한 페이월 우회 방법이 실제 제품이나 학습 데이터 수집에 적용됐는지는 나오지 않았다.
  • 마이크로소프트가 주장하는 '개인 의견'이라는 설명이 문서상 다른 임원들의 유사 발언과 배치되는지, 즉 회사 차원의 인식이었는지는 이번 보도만으로는 판단할 근거가 없다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

Anthropic, 호주에 저작권 콘텐츠 '옵트아웃' 학습 허용 요청
The Guardian AI · 2026-10-01

Claude 개발사 Anthropic이 호주 앨버니지 정부에 자사 등 빅테크가 호주 저작권 콘텐츠로 AI를 학습시킬 수 있도록 '옵트아웃' 방식의 조건부 승인을 검토해달라고 요청했다. 이는 포괄적 저작권 면제 확보가 어렵다는 점을 인정한 데 따른 것이다. 반면 공영방송 ABC와 SBS는…

메타·오픈AI, 'AI 다마고치'로 전용기기 시장 노크
The Verge AI · 2026-09-30

메타와 오픈AI가 앞으로 1년간 전용 AI 하드웨어 기기를 선보이며, 귀여운 소프트웨어 에이전트로 시장 반응을 먼저 시험하는 전략을 택했다. 오픈AI는 전 애플 디자이너 조니 아이브와 협업 중이다. 앞서 나온 프렌드(Friend), 휴메인 AI 핀 같은 전용 AI 기기는 반발과 혼란만 …

AI로 목소리 복제, 도쿄 법원 “성우 권리 침해” 판결
The Guardian AI · 2026-09-30

도쿄지방법원은 애니메이션 '주술회전'의 케이토 나나미 목소리로 유명한 성우 츠다 켄지로가 자신의 목소리를 AI로 복제해 영상에 사용한 틱톡 계정을 상대로 낸 소송에서 원고 승소 판결을 내렸다. 법원은 수요일 목소리도 퍼블리시티권과 동일한 법적 보호를 받아야 한다고 밝혔다. 이는 목소리에…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
학습
학습은 모델이 데이터를 반복적으로 살펴보며 예측 오차를 줄이는 방향으로 내부 파라미터를 조정해 나가는 과정을 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

Nieman Lab 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →