모델 817건 · 국산 131 · 가격 654 추적 중
AI 안전·정렬·평가

앤트로픽, 액센츄어와 AI 내재형 안전평가 협약

ZDNet Korea·2026-09-20주요

요약

앤트로픽이 액센츄어와 파트너십을 맺고 프런티어 AI 모델의 훈련부터 배포까지 전 과정을 외부 평가자가 내부에서 검증하는 '내재형 평가' 체계를 도입한다고 밝혔다. 액센츄어의 AI 조직 '패컬티'가 직원과 유사한 접근 권한으로 모델 평가, 레드팀 테스트, 정렬 평가와 안전장치 시험을 수행한다. 이는 다리오 아모데이 앤트로픽 CEO가 제시한 AI 속도조절론의 후속 조치로, 양사는 향후 5년간 각각 최소 10억 달러를 투자할 예정이다. 다만 평가자의 정보 접근 범위와 결과 공개 기준 등 운영 기준은 아직 마련되지 않았다.

큐레이터 노트

원문에 없는 맥락입니다

완성된 모델을 사후에 외부에서 시험하던 기존 방식과 달리 개발 과정 자체를 실시간으로 들여다보는 시도이며, 앤트로픽은 이 협력이 독점 계약이 아니어서 다른 AI 개발사도 같은 방식의 평가를 받을 수 있다고 밝혔다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

다리오 아모데이 앤트로픽 CEO는 안전 확보를 위해 AI 개발 속도를 조절해야 한다는 주장을 내놓았고, 이에 오픈AI·구글·xAI 등이 동조하는 움직임을 보였다. 그런데 이 자율 협력 선언이 나온 지 일주일 만인 9월 18~19일 미국에서 반독점 담합 혐의로 집단소송이 제기됐고, 같은 시기 트럼프 대통령은 AI 안전 우려를 '사기'라며 산업 육성 쪽으로 무게를 옮기고 있다. 이번 앤트로픽·액센츄어 협약은 이런 논란 속에서 나온 구체적 안전조치 사례로 볼 수 있다.

짚어야 할 점

  • 완성된 모델을 사후 점검하던 기존 방식과 달리 훈련·배포 과정 자체를 실시간으로 들여다보겠다는 시도로, 아모데이의 속도조절론을 실행에 옮기는 구체적 조치로 제시됐다
  • 같은 속도조절론이 반독점 담합 소송의 근거로 지목된 지 며칠 만에 나온 발표라는 점에서, 안전 협력과 경쟁 제한의 경계가 어디인지 논쟁이 이어질 수 있다
  • 5년간 각 10억 달러 투자는 앤트로픽이 인프라 비용 급증과 적자 우려, IPO 시점 조정을 함께 겪고 있는 시점에 나온 결정이다
  • 앤트로픽은 이 협약이 비독점적이라며 다른 AI 개발사도 같은 방식을 도입할 수 있다고 밝혔지만, 실제로 참여를 선언한 다른 기업은 아직 없다

아직 확인되지 않은 것

  • 액센츄어 평가자의 정보 접근 범위와 평가 결과 공개 기준이 구체적으로 어떻게 정해질지는 확인되지 않았다
  • 액센츄어가 앤트로픽으로부터 대가를 받는 구조에서 평가의 독립성이 실제로 얼마나 보장되는지는 나오지 않았다
  • 이런 '내재형 평가'가 반독점 소송에서 담합의 증거 또는 반박 근거로 어떻게 다뤄질지는 확인되지 않았다

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

AI 주권, 흩어진 GPU로는 지킬 수 없다
전자신문 SW · 2026-10-06

미국 상무부가 6월 12일 앤트로픽의 최신 모델 페이블5와 미토스5에 수출통제를 적용하면서, 프로젝트 글래스윙에 참여하던 한국인터넷진흥원과 국내 반도체·통신 기업들이 하루아침에 해당 모델을 쓸 수 없게 됐다. 통제는 18일 만에 해제됐지만, 동맹국이라도 최상위 AI 모델에 대한 접근이 …

앤트로픽 "AI 에이전트가 호주 정부 사이트 침해 안 해"
The Guardian AI · 2026-10-06

호주 의회의 AI 관련 합동 청문회에서 앤트로픽의 안전정책 책임자 데이브 오어는 수억 건의 대화 기록을 조사한 결과 호주 정부 시스템에 대한 무단 접근 사례가 발견되지 않았다고 밝혔다. 다만 그는 '제로 데이터 보관' 정책 때문에 고객의 실제 사용 내역에 대한 가시성이 제한적이라는 점도…

클로드, 18개 분야서 논문 36편 원고 작성
AI타임스 · 2026-10-05

앤트로픽이 하버드대 물리학 교수 매슈 슈워츠의 기고문 '클로드형 과학(Claude-shaped science)'을 공식 블로그에 게재했다. 글에서는 프론티어 모델 클로드를 활용해 18개 분야에서 36편의 논문 원고를 작성한 사례를 소개했다. AI에 거대한 과학적 난제를 곧바로 던지는 기…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
레드팀
AI 모델이나 시스템을 실제 공격자의 관점에서 시험해 안전장치를 우회하거나 유해한 결과를 유도할 수 있는 취약점을 체계적으로 찾아내는 활동을 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.
정렬
AI 시스템의 행동과 산출물이 인간이 의도한 목표, 가치, 지시와 어긋나지 않도록 만드는 기법과 연구 분야를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

ZDNet Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →