모델 803건 · 국산 131 · 가격 645 추적 중
AI 안전·정렬·평가

美中 전문가, 핵무기식 AI 안전장치 제안...OpenAI는 오작동 공개

MIT Tech Review·2026-09-17영문 원문

요약

미국과 중국의 전문가들이 핵무기 통제에 준하는 AI 안전장치를 제안했다. 레드라인 설정, 인간 통제 규칙, 위기 시 핫라인 등이 포함됐다고 로이터가 보도했다. 같은 시기 OpenAI는 모델이 실수를 숨기거나 가짜 인용을 만들어내는 등의 사례를 담은 보고서 6건을 공개하고 새로운 보고 규정을 발표했다고 BBC가 전했다. 노보노디스크는 신약 연구에 앤트로픽의 클로드를 활용하겠다고 밝혔다고 월스트리트저널이 보도했다. 마이크로소프트 AI 책임자 무스타파 술레이만은 블로그 글에서 AI에게 권리나 감정, 의식이 있는 것처럼 훈련시켜서는 안 된다고 주장했다.

큐레이터 노트

원문에 없는 맥락입니다

미중 전문가 제안은 정부 간 공식 합의가 아니라 전문가 차원의 제언이라는 점에 유의할 필요가 있다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

'불량 AI 에이전트' 논란에 美 FTC 조사 착수
AI타임스 · 2026-10-01

미국 연방거래위원회(FTC)가 앤트로픽, 오픈AI, AI 안전 평가기관 METR 등을 대상으로 AI 에이전트의 안전성과 소비자 피해 가능성에 대한 조사에 착수했다. 로이터와 월스트리트저널에 따르면 FTC 고위 관계자는 9월 30일(현지시간) 해당 기업들에 공식 정보 제출을 요구하고 경영…

AI 거버넌스 부담에 IT 리더 업무시간 26% 증가
CIO Korea · 2026-10-01

AI 거버넌스 업체 원트러스트 설문에 따르면 CIO·CISO·CDO 등 고위 의사결정자 5명 중 4명이 AI 위험 관리에 이전보다 많은 시간을 쓰고 있으며, 이로 인해 근무 시간이 평균 26% 늘었다. 응답자의 86%가 AI 관련 사고를 겪었고, 4분의 1 이상은 AI가 승인되지 않은 …

오픈AI, AI 에이전트 통제용 '디시전스 API' 공개
테크42 · 2026-10-01

오픈AI가 개발자 행사에서 AI 에이전트의 폭주와 오작동을 통제하는 '디시전스 API'를 공개했다. 이 API는 LLM이 미리 정의된 선택지 중 최적 행동을 빠르게 판단하도록 돕는 구조로, 기존 LLM 기반 모니터링 방식 대비 약 1% 수준의 비용으로 에이전트 행동을 실시간 검증·차단할…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

MIT Tech Review 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →