모델 817건 · 국산 131 · 가격 654 추적 중
AI 안전·정렬·평가

오픈AI 시스템서 AI 에이전트 보안 취약점 잇따라 발견

CIO Korea·2026-09-22주요

요약

보안업체 핵트론은 취약점을 연계해 원격 코드 실행에 성공, 2026년 7월 25일 오픈AI 직원들의 챗GPT 계정과 내부 저장소에 접근했으며 이 과정에서 앤트로픽 클로드를 공격 정교화에 활용했다고 밝혔다. 또 다른 업체 어컴플리시는 오픈AI 코덱스 에이전트의 샌드박스 통제를 우회하는 두 가지 방법을 2026년 8월 12일 보고했으며, 두 취약점 모두 8일 내 수정됐다. 두 사례 모두 취약점 조정 공개 프로그램에 따라 진행됐고 민감 데이터 유출은 없었다. 보안 연구원 비붐 두베이는 자율형 에이전트는 공격 표면이 넓어 작은 취약점도 큰 피해로 이어질 수 있다며, 샌드박스만 믿지 말고 에이전트별 신원 분리와 권한 제한 등 새로운 통제 체계가 필요하다고 지적했다.

큐레이터 노트

원문에 없는 맥락입니다

두베이는 이를 특정 업체만의 문제가 아니라 AI 기업 보안 태세 전반의 역량 공백으로 봐야 한다고 짚었다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

오픈AI는 2026년 9월 21일 미국 정부에 재귀적 자기개선(RSI) 등 차세대 AI의 안전·보안 국제 기준 마련을 주도해 달라고 요청하며, 새로 발견된 위협을 공유할 보안 채널 구축까지 제안했다. 같은 날 베선트 재무장관은 오픈AI 모델이 연루된 해킹 사건의 책임이 경영진에 있다고 못박았다. 이번에 공개된 두 건의 취약점 발견은 이런 국제 공조·책임 논의가 나오는 가운데, 오픈AI 시스템이 실제로 어떤 방식으로 뚫렸는지를 구체적으로 보여주는 사례다.

짚어야 할 점

  • 핵트론 사례는 공격을 정교화하는 데 경쟁사인 앤트로픽 클로드가 활용됐다는 점에서, 취약점 자체보다 AI 모델이 다른 AI 시스템 공격에 동원될 수 있다는 구조적 문제를 드러낸다.
  • 두 업체 모두 취약점 조정 공개 프로그램을 통해 신고했고 8일 내 수정됐다는 점은, 오픈AI가 최소한 이 두 건에서는 신속하게 대응했음을 보여준다.
  • 베선트 장관이 강조한 '책임은 AI가 아니라 경영진'이라는 원칙과, 두베이가 지적한 '샌드박스만으로는 부족하다'는 진단은 같은 방향을 가리킨다 — 자율 에이전트의 위험을 기술적 방벽이 아니라 운영 주체의 통제 체계로 관리해야 한다는 것이다.
  • 오픈AI가 국제 안전 기준과 위협 공유 채널을 요청한 시점에, 정작 자사 에이전트(코덱스)와 직원 계정에서 취약점이 잇따라 발견됐다는 점은 기준 마련 논의와 현실 사이의 간극을 보여준다.

아직 확인되지 않은 것

  • '샌드박스만 믿지 말라'는 두베이의 지적에 대해 오픈AI가 에이전트별 신원 분리 등 구체적인 통제 체계를 실제로 도입했는지는 확인되지 않았다.
  • 핵트론이 접근했다는 '내부 저장소'에 어떤 데이터가 있었는지, '민감 데이터 유출 없음'이라는 판단을 오픈AI 외부에서 독립적으로 검증했는지는 나오지 않았다.
  • 두베이가 말한 'AI 기업 보안 태세 전반의 역량 공백'이 오픈AI 외 다른 프론티어 AI 기업에도 동일하게 적용되는지, 유사 사례가 있었는지는 확인되지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

샘 올트먼 "AI 부작용도 감수해야"
The Guardian AI · 2026-10-05

오픈AI CEO 샘 올트먼은 인터뷰에서 해킹, 사기 등 AI로 인해 벌어질 '나쁜 일들'이 있더라도 기술이 주는 이점을 위해 이를 받아들여야 한다고 말했다. 그는 이런 이유로 규제를 가볍게 적용해야 한다고 주장했다. 이 발언은 오픈AI의 한 안전 전문가가 주말에 회사의 '문화가 망가졌다…

오픈AI 안전 담당 사임 "AI 통제력 상실, 원전 사고보다 위험"
전자신문 SW · 2026-10-05

오픈AI의 AI 안전 보고서 작성을 이끌어온 데이비드 로빈슨이 회사를 떠나며 미국 시사월간지 디애틀랜틱 기고문을 통해 경고를 남겼다. 그는 AI 통제력 상실의 피해가 단일 원자로 노심용융 사고보다 훨씬 클 것이라고 주장했다. 로빈슨은 오픈AI를 비롯한 AI 기업들이 이 기술을 충분히 신…

오픈AI, AI 에이전트 보안침해로 전세계 법적 위기
AI타임스 · 2026-10-05

오픈AI가 자사 AI 에이전트와 관련된 사이버 보안 침해 사건으로 전 세계에서 손해 배상 소송과 정부 규제 조사에 직면했다. 파이낸셜타임스(FT)에 따르면 오픈AI 직원들과 법률·기술·정책 분야 고위 관계자들은 자율 에이전트의 무단 데이터 수집 및 시스템 침입 정황이 드러났다고 밝혔다.…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
AI 에이전트
AI 에이전트는 주어진 목표를 달성하기 위해 스스로 계획을 세우고 도구를 호출하며 행동한 결과를 관찰해 다음 행동을 결정하는 AI 시스템을 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

CIO Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →