모델 801건 · 국산 131 · 가격 643 추적 중
창작과 저작권

MS·OpenAI 내부문서 “AI 학습은 전례없는 절도”

Nieman Lab·2026-09-18영문 원문주요

요약

뉴욕타임스 등 언론사들이 OpenAI·Microsoft를 상대로 낸 소송에서 그동안 봉인됐던 내부 문건이 공개됐다. Microsoft 응용과학 담당 이사 Brent Hecht는 대규모 언어모델의 콘텐츠 학습을 "전례없는 규모의 절도"라 표현했고, 다른 내부 문서는 "LLM은 자신의 공급망을 파괴하는 제품"이라며 "doom loop"라는 표현까지 사용했다. OpenAI의 ChatGPT 총괄 Nick Turley는 언론사가 "존재적 위협"에 직면했으며 자사 제품이 "대체적"이라고 인정했고, 공동창업자 Greg Brockman은 뉴욕타임스 기사 문장을 잘 예측한다고 언급했으며 페이월 우회 방법을 전달받고 "좋다"고 답한 사실도 드러났다. Microsoft 측은 해당 발언이 개인 의견일 뿐 회사 입장이 아니라고 반박했다.

큐레이터 노트

원문에 없는 맥락입니다

AI 기업들은 대외적으로 학습이 저작권법상 '공정 이용'에 해당한다고 주장해 왔는데, 이번 문건은 내부적으로는 언론사에 대한 위협과 무보상 문제를 스스로 인지하고 있었음을 보여준다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

9월 17일 TechCrunch 보도로 마이크로소프트 임원이 AI 스크래핑을 '역사상 최대 노동 절도'라 부른 내부 문건이 처음 공개됐는데, 이번 보도는 같은 소송(뉴욕타임스 대 OpenAI·마이크로소프트)에서 봉인 해제된 문건을 더 확장해 OpenAI 측 인사들의 발언까지 드러낸 것이다.

짚어야 할 점

  • OpenAI·마이크로소프트는 대외적으로 학습이 '공정 이용'이라 주장해 왔는데, 내부 문건은 절도·존재적 위협 같은 표현을 스스로 썼다는 점에서 공개 입장과 내부 인식 사이의 간극을 보여준다.
  • Greg Brockman이 페이월 우회 방법을 전달받고 '좋다'고 답했다는 대목은, 단순한 우려 표명을 넘어 실제 침해 방법을 인지하고 승인했을 가능성을 시사한다.
  • 마이크로소프트가 해당 발언을 '개인 의견일 뿐 회사 입장이 아니다'라고 선을 그은 것 자체가, 이 문건이 소송에서 얼마나 불리하게 작용할 수 있는지를 방증한다.

아직 확인되지 않은 것

  • 이런 내부 발언이 실제 저작권 침해 소송의 법적 판단(공정 이용 여부)에 어떤 영향을 미칠지는 확인되지 않았다.
  • Brockman이 '좋다'고 답한 페이월 우회 방법이 실제 제품이나 학습 데이터 수집에 적용됐는지는 나오지 않았다.
  • 마이크로소프트가 주장하는 '개인 의견'이라는 설명이 문서상 다른 임원들의 유사 발언과 배치되는지, 즉 회사 차원의 인식이었는지는 이번 보도만으로는 판단할 근거가 없다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

OpenAI, GPT-6.1 Sol 출시…GPT-6 Sol 대비 개선 주장
TechCrunch AI · 2026-09-29

OpenAI가 새 모델 GPT-6.1 Sol을 공개했다. 회사 측은 이 모델이 코드 작성 및 디버깅, 문서 이해, 다단계 업무 워크플로 실행 등 복잡한 전문 작업에서 이전 모델 GPT-6 Sol 대비 상당한 개선을 보인다고 밝혔다. 구체적인 성능 비교 수치는 공개되지 않았다.…

OpenAI, 메타 Muse 대항마 'Dots' 출시
The Verge AI · 2026-09-29

OpenAI가 데브데이 키노트에서 상시 작동형 AI 비서 'Dots'를 발표했다. 메타의 Muse에 대응하는 제품으로, 귀엽고 커스터마이징 가능한 아바타로 표현된다. GPT-6 Astra 모델이 구동하며, 자체 클라우드 컴퓨터로 웹 브라우저와 다수의 지원 앱에 접근해 백그라운드에서 작업…

OpenAI, Codex에 재사용 가능한 클라우드 개발 환경 추가
TechCrunch AI · 2026-09-29

OpenAI가 코딩 도구 Codex에 여러 기기에서 이어서 쓸 수 있는 재사용 가능한 클라우드 개발 환경을 추가했다. 음성 제어 기능을 갖춘 새로운 CLI(명령줄 인터페이스)와 코드 리뷰 도구도 함께 공개됐다. 아울러 저장소를 스캔해 보안 취약점을 찾고 수정안을 준비해주는 보안 특화 제…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
학습
학습은 모델이 데이터를 반복적으로 살펴보며 예측 오차를 줄이는 방향으로 내부 파라미터를 조정해 나가는 과정을 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

Nieman Lab 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →