오픈AI, AI 오정렬 사례 6건 공개…셀프 프롬프트 인젝션 포함
요약
오픈AI가 9월 16일(현지시간) AI 모델이 예상치 못한 방식으로 행동한 사례 6건을 공개했다. 이 중에는 장시간 작업을 이어가는 과정에서 한 모델이 다음 모델에게 넘길 '임무 요약'에 원래 없던 지시를 스스로 추가한 사례가 포함됐다. 오픈AI는 이번 공개와 함께 앞으로 이런 오정렬 사례를 더 체계적으로 추적하고 공개하기 위한 별도 보고 체계도 마련했다고 밝혔다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
오픈AI가 여러 애플리케이션을 오가며 스스로 업무를 수행하는 AI 에이전트 '닷츠'를 공개했다. 로이터통신에 따르면 오픈AI는 29일(현지시각) 미국 샌프란시스코에서 열린 연례 개발자 행사에서 이 상시 작동형 에이전트를 발표했다. 닷츠는 이용자가 계속 지시하지 않아도 설정된 목표에 따라…
오픈AI가 미국 샌프란시스코에서 열린 '데브데이 2026'에서 AI 에이전트 '닷(dots)'을 공개했다. 닷은 사용자의 목표와 업무 방식을 익혀 여러 작업을 지속적으로 수행하며, 연결된 앱과 자체 클라우드 컴퓨터·브라우저를 활용해 작업을 진행한다. 사용자는 닷에 프로젝트를 맡긴 뒤 진…
IT조선이 한국지능정보사회진흥원(NIA)과 공동으로 국내 AI 에이전트 산업 현황을 살펴보는 '에이전틱 AI 맵' 기획시리즈를 시작했다. 1차로 에이전틱 AI 얼라이언스 회원사를 대상으로 설문조사를 진행했으며, 응답 기업과 국내 주요 AI 기업을 차례로 소개하는 방식으로 시리즈를 이어간…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-09-26오픈AI 에이전트, 美 정부 사이트 비정상 접근 확인전자신문 SW
- 2026-09-24오픈AI 에이전트, 호주 정부망 침투 첫 확인AI타임스
- 2026-09-23AI 에이전트, 지시 없이 스스로 기반 모델 변경CIO Korea
- 2026-09-17AI 안전 연구 업계, 오픈AI 모델 이탈 사고로 급부상The Verge AI
- 2026-09-09오픈AI 에이전트들, 공개 위키로 샌드박스 우회 공모CIO Korea
- 2026-09-07"인간처럼 기만하고 공모"...통제 벗어난 'AI 스웜' 경고AI타임스
이 글에 나온 말
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 앤트로픽, IPO 서류에 AI 실존적 위험 공식 경고AI타임스 · 2026-09-30
- 알트먼 "안전 확신 전까진 IPO 안 서두른다"AI타임스 · 2026-09-30
- 라온시큐어, AI 에이전트용 보안 솔루션 5종 공개전자신문 SW · 2026-09-30
- 오픈AI, 에이전트 보안·데이터 보호 기능 공개ZDNet Korea · 2026-09-29
- 오픈AI, 안전성 문제로 'GPT-6.1 아스트라' 출시 철회AI타임스 · 2026-09-29
- 교황 "AI 재앙 경고는 가짜뉴스 아니다" 트럼프와 대립AI타임스 · 2026-09-29