오픈AI·MS, 웹 파괴 '악순환' 내부에서 알았다
요약
뉴욕타임스가 오픈AI와 마이크로소프트를 상대로 제기한 소송에서 봉인 해제된 법원 문서가 공개됐다. 문서에 따르면 두 회사의 내부 자료는 자사 서비스가 웹에 피해를 주는 '도리를 잃은 순환(doom loop)'을 만들고 있다고 경고했다. 또한 AI 모델 학습을 위한 데이터 스크래핑을 '인류 역사상 가장 큰 노동 절도'라 표현했고, '공정 이용(fair use) 개념을 완전히 조롱하는 것'이라고 적었다. 눈에 띄는 발언 다수는 마이크로소프트의 응용과학 담당 디렉터 브렌트 헤흐트에게서 나온 것으로, 마이크로소프트는 이 발언과 거리를 두려 했으며 대변인 알렉스 하우렉이 더버지에 관련 입장을 밝혔다.
큐레이터 노트
원문에 없는 맥락입니다
깊이 읽기
이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다
이 일이 어디서 왔나
이 문서는 뉴욕타임스가 오픈AI와 마이크로소프트를 상대로 낸 저작권 소송 과정에서 봉인 해제된 것으로, 두 회사가 자사 서비스의 웹 생태계 훼손을 스스로 인지하고 기록해 뒀다는 점을 보여준다. 같은 시기 오픈AI는 아스트라 포 로처럼 방대한 법률 판례 자료를 활용하는 서비스를 새로 내놓고 챗GPT의 MS 워드 통합도 전 요금제로 넓히는 등, 데이터 활용을 전제로 한 제품 확장을 이어가고 있다. 겉으로 드러난 사업 확대와 내부 문건에 담긴 우려가 같은 시기에 동시에 노출된 셈이다.
짚어야 할 점
- 마이크로소프트가 헤흐트 발언과 거리를 두려 했다는 점에서, 이 문서가 회사 공식 입장인지 개인 의견인지를 둘러싼 다툼이 소송에서 이어질 가능성이 있다.
- 오픈AI가 법률 자료 기반 서비스(아스트라 포 로)를 확장하는 시점에 데이터 수집 관행에 대한 내부 경고가 드러나면서, 데이터 출처 문제에 대한 관심이 더 커질 수 있다.
- 같은 시기 클로드를 이용한 외부 연구진에게 오픈AI 내부 코드 저장소가 뚫린 사실도 함께 알려지면서, 오픈AI를 둘러싼 데이터·보안 신뢰 문제가 겹쳐 제기되는 모습이다.
아직 확인되지 않은 것
- '도리를 잃은 순환'이 구체적으로 어떤 방식으로 웹에 피해를 준다고 진단했는지 세부 내용은 공개되지 않았다.
- 오픈AI 측이 이번 문서 내용에 대해 직접 어떤 입장을 밝혔는지, 마이크로소프트 대변인의 구체적 발언 내용은 무엇인지 확인되지 않았다.
- 이 문서가 실제 소송의 공정 이용 판단이나 결과에 어떤 영향을 미칠지는 알 수 없다.
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
오픈AI는 자사 AI 모델의 핵심인 '보호된 추론'을 대규모로 빼내려던 조직적 시도를 적발해 차단했다고 밝혔다. 이번 활동의 핵심 조직이 중국의 문샷 AI와 연결돼 있다고 주장했다. 공격은 7월1일 처음 포착됐으며, 7월24~25일에는 4000개 넘는 계정에서 특정 추출 패턴을 활용한 …
미국 연방거래위원회(FTC)가 앤트로픽, 오픈AI, AI 안전 평가기관 METR 등을 대상으로 AI 에이전트의 안전성과 소비자 피해 가능성에 대한 조사에 착수했다. 로이터와 월스트리트저널에 따르면 FTC 고위 관계자는 9월 30일(현지시간) 해당 기업들에 공식 정보 제출을 요구하고 경영…
오픈AI가 데브데이 2026에서 반복적인 판단 작업을 처리하는 '디시전스 API'를 공개했다. 이 API는 대화형 AI처럼 긴 답변을 생성하는 대신 개발자가 미리 정해놓은 선택지 중 하나를 골라주는 방식으로 동작하며, 'GPT-6 루나' 모델을 기반으로 한다. 오픈AI는 이 API를 자…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-17MS 임원 "AI 스크래핑은 역사상 최대 노동 절도" 발언 공개TechCrunch AI
- 2026-09-19술레이만 "오픈AI 셀프 프롬프트 인젝션 심각"AI타임스
- 2026-09-18MS·OpenAI 내부문서 “AI 학습은 전례없는 절도”Nieman Lab
- 2026-09-14AI 거물들 “개발 속도 늦추자” 합의…죄수의 딜레마 봉착AI타임스
- 2026-09-04MS, 신규 음성 인식 모델 'MAI-트랜스크라이브-2' 공개AI타임스
- 2026-09-01MS·오픈AI 서비스 동시 장애, 클라우드 인프라 연관성 주목AI타임스
이 글에 나온 말
- 학습
- 학습은 모델이 데이터를 반복적으로 살펴보며 예측 오차를 줄이는 방향으로 내부 파라미터를 조정해 나가는 과정을 말한다.
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
- OpenAI, 안전 논란과 규제 압박 확산기사 14건
- MS "AI는 인간에 종속돼야" 행동강령 발표기사 13건
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- Anthropic, 호주에 저작권 콘텐츠 '옵트아웃' 학습 허용 요청The Guardian AI · 2026-10-01
- 美 항소법원, 톰슨로이터 AI 저작권 승소 확정Nieman Lab · 2026-09-30
- 구글 제로 시대, 언론사들 독자 참여 전략 다시 짠다Nieman Lab · 2026-09-30
- 구글, AI 검색 기여도 따라 퍼블리셔에 대가 지급 시험The Verge AI · 2026-09-30
- AI로 목소리 복제, 도쿄 법원 “성우 권리 침해” 판결The Guardian AI · 2026-09-30
- 구글, AI 답변 기여도 따라 출판사 100여곳에 비용 지급AI타임스 · 2026-09-30