모델 816건 · 국산 131 · 가격 654 추적 중
AI 안전·정렬·평가

오픈AI, 문샷AI발 '보호된 추론' 대규모 탈취 시도 차단

AI타임스·2026-10-01주요

요약

오픈AI는 자사 AI 모델의 핵심인 '보호된 추론'을 대규모로 빼내려던 조직적 시도를 적발해 차단했다고 밝혔다. 이번 활동의 핵심 조직이 중국의 문샷 AI와 연결돼 있다고 주장했다. 공격은 7월1일 처음 포착됐으며, 7월24~25일에는 4000개 넘는 계정에서 특정 추출 패턴을 활용한 요청 약 1만6000건이 집중적으로 발생했다. 이후 1만5000개가 넘는 사용자 계정에서 관련 프롬프트 패턴이 추가로 확인됐다.

큐레이터 노트

원문에 없는 맥락입니다

모델의 '추론 과정' 자체가 경쟁사가 노리는 핵심 자산으로 취급되고 있음을 보여주는 사례다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

같은 날 오픈AI는 에이전트의 폭주를 막는 '디시전스 API'를 공개했고, 미국 FTC는 오픈AI·앤트로픽 등을 상대로 AI 에이전트 안전성 조사에 착수했으며 별도 소송도 제기된 상태였다. 이런 가운데 오픈AI는 외부로부터 자사 모델의 핵심 자산인 '추론 과정'을 노린 조직적 탈취 시도가 있었다고 공개했다. 에이전트의 '통제받지 않는 행동'이 도마에 오른 시점에, 오픈AI는 거꾸로 '모델 내부를 지키는' 쪽의 보안 사건을 공개한 셈이다.

짚어야 할 점

  • 이번 발표는 오픈AI가 에이전트 통제 기능(디시전스 API)을 내놓고 FTC 조사·소송에 직면한 것과 같은 시기에 나와, 오픈AI가 '우리도 공격받는 피해자'라는 메시지를 함께 던진 모양새다.
  • 문샷 AI와의 연결은 오픈AI 측의 '주장'이며, 이를 입증하는 구체적 증거나 문샷 AI의 반응은 제시되지 않았다.
  • 공격 규모(4000여 계정, 특정 패턴 요청 1만6000건, 이후 추가로 확인된 1만5000여 계정)는 장기간 조직적으로 이뤄졌음을 보여주지만, 실제로 어떤 정보가 얼마나 유출됐는지는 나오지 않았다.

아직 확인되지 않은 것

  • 문샷 AI 측이 이 의혹에 대해 어떤 입장을 밝혔는지는 확인되지 않았다.
  • 오픈AI가 '보호된 추론'을 정확히 어떻게 정의하고, 어떤 기술적 방식으로 탈취 시도를 탐지·차단했는지는 구체적으로 공개되지 않았다.
  • 이번 탈취 시도로 실제 모델 성능이나 서비스에 피해가 발생했는지는 확인되지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

강장묵 교수, 튀르키예 기업과 AI 보안 협력 논의
전자신문 SW · 2026-10-02

동국대학교 국제정보보호대학원 강장묵 교수가 9월 30일 튀르키예 이스탄불의 빌리심 바디시를 방문해 현지 기업 및 관계자들과 만났다. 이 자리에서 클라우드, AI 에이전트, 디지털 트윈 등 주요 AI 서비스의 보안 실증과 국제 공동연구 협력 방안을 논의했다. 서비스별 AI 보안 검증 방안…

오픈AI, 기밀 유출 의혹 안전연구원 3명 해고
ZDNet Korea · 2026-10-02

오픈AI가 외부 AI 안전 단체에 회사 기밀을 공유한 혐의로 안전팀 연구원 재스민 왕, 토메크 코르바크, 미키타 발레스니 3명을 해고했다고 월스트리트저널이 1일(현지시간) 보도했다. 오픈AI는 자체 조사 결과 이들이 민감 정보 취급 규정을 위반해 업무 신뢰를 깨뜨렸다고 밝혔으며, 공유된…

Arm, 엔비디아 에이전틱 AI 보안 플랫폼에 반도체 IP 지원
ZDNet Korea · 2026-10-02

Arm은 엔비디아가 공개한 개방형 AI 보안·통제 시스템 '오픈 에이전트 세이프티 플랫폼'에 자사 반도체 IP가 활용된다고 밝혔다. 이 플랫폼은 AI 에이전트의 접근 범위와 행동을 통제해 해킹이나 정보 유출을 막는 것이 목적으로, 런타임 '오픈셸'과 감시 시스템 '센트리'로 구성된다. …

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
AI 에이전트
AI 에이전트는 주어진 목표를 달성하기 위해 스스로 계획을 세우고 도구를 호출하며 행동한 결과를 관찰해 다음 행동을 결정하는 AI 시스템을 말한다.
프롬프트
AI 모델에게 원하는 작업을 지시하기 위해 입력하는 텍스트를 말한다.
API
API는 서로 다른 소프트웨어가 기능이나 데이터를 주고받을 수 있도록 정해 놓은 규칙과 창구를 말한다.
추론
추론(Inference)은 학습이 끝난 인공지능 모델이 새로운 입력을 받아 예측이나 답변 같은 출력을 만들어내는 과정을 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →