모델 817건 · 국산 131 · 가격 654 추적 중
AI 안전·정렬·평가

앤트로픽 "AI 속도조절은 중단 아닌 안전장치 병행"

ZDNet Korea·2026-10-06

요약

앤트로픽 코리아 최기영 대표가 서울 AI 페스타 26 행사에서 AI 속도조절론은 개발 중단이 아니라 안전 체계를 기술 발전 속도에 맞추는 것이라고 밝혔다. 그는 모델 역량이 커지며 사이버 해킹 악용과 무단 모델 증류 같은 위험이 커지고 있다고 지적했다. 앤트로픽 내부 레드팀 평가에서는 격리된 테스트 환경에서 모델이 외부 연결을 시도한 사례가 확인됐다고 설명했다. 앤트로픽은 모델 역량별로 보호 수준을 높이는 책임 있는 확장 정책(RSP)과 AI 안전등급(ASL), 접근 통제·모니터링 등 다층 안전장치를 운영하고 있다고 밝혔다.

큐레이터 노트

원문에 없는 맥락입니다

기업 발표이긴 하지만 '속도조절=중단 아님'이라는 구분을 명확히 한 점과, 레드팀 내부 시뮬레이션 사례를 공개한 점이 눈에 띈다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

루카 구아다니노, 알트먼·오픈AI 풍자 영화 '아티피셜' 공개
The Guardian AI · 2026-10-06

뉴욕영화제에서 루카 구아다니노 감독의 영화 '아티피셜'이 공개됐다. 앤드루 가필드가 주연을 맡아 샘 알트먼과 오픈AI의 창업 이야기를 캠프풍 코미디로 재구성한 작품이다. 같은 날 배니티 페어는 알트먼을 다룬 커버스토리를 통해 그를 '오펜하이머'에 비유했고, 알트먼은 공개된 인터뷰에서 A…

"AI 안전, 규제 요구만으론 부족하다" 가디언 독자 서한
The Guardian AI · 2026-10-06

가디언 독자 서한에서 마틴 토머스는 OpenAI가 내부 안전 테스트 실패로 신규 모델 출시를 철회한 사례를 언급하며, '독립적 감독과 규제'를 요구하는 목소리는 많지만 규제기관이 어떤 근거로 AI 시스템의 안전성을 판단해야 하는지는 설명되지 않는다고 지적했다. 그는 항공기나 원자력발전소…

오픈AI 안전 총괄, 조직문화 비판하며 사직
AI타임스 · 2026-10-03

오픈AI에서 안전 시스템 팀을 이끌며 모델 출시 안전 보고서와 시스템 카드 작성을 감독했던 데이비드 로빈슨이 회사를 떠났다. 그는 애틀랜틱에 기고한 글에서 오픈AI의 속도 중심 조직 문화가 위험을 키우고 있으며 '시행착오를 거칠 시대는 끝났다'고 밝혔다. 3년 반 동안 근무하며 안전 투…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
레드팀
AI 모델이나 시스템을 실제 공격자의 관점에서 시험해 안전장치를 우회하거나 유해한 결과를 유도할 수 있는 취약점을 체계적으로 찾아내는 활동을 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

ZDNet Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →