모델 816건 · 국산 131 · 가격 654 추적 중
AI 안전·정렬·평가

앤트로픽, 액센추어를 AI 안전평가기관으로 선정

AI타임스·2026-09-19주요

요약

앤트로픽이 최첨단 AI 모델의 안전성을 검증할 첫 번째 내부 상주형(임베디드) 평가 기관으로 기술 컨설팅 기업 액센추어를 선정했다고 9월18일(현지시간) 발표했다. 이는 다리오 아모데이 앤트로픽 CEO가 제시한 AI 개발 속도 조절안을 실행하는 첫 단계다. 액센추어는 2026년 1월 인수한 AI 전문기업 패컬티의 인력을 앤트로픽 사내에 파견해 평가단을 구성할 예정이다. 다만 평가 자금을 앤트로픽이 직접 지급하는 방식이어서 평가 기구의 객관성과 독립성을 둘러싼 우려가 이어지고 있다.

큐레이터 노트

원문에 없는 맥락입니다

평가 대상 기업이 평가자의 비용을 직접 대는 구조는 이해상충 우려를 낳기 때문에, 이번 방식이 업계 안전평가 체계의 신뢰성 논쟁으로 이어질 수 있다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

다리오 아모데이 앤트로픽 CEO는 9월18일 TechCrunch 보도를 통해 독립 평가 기관 활용과 업계 공조를 뼈대로 한 'AI 개발 속도 조절' 방안을 제시한 바 있다. 이번 액센추어 선정은 그 제안이 나온 지 하루 만에 이뤄진 첫 실행 단계다. 같은 시기 앤트로픽은 클로드의 자기개선 관여 지표 공개, 클로드 코드 프로젝트 출시 등 기술·투명성 행보를 이어가는 한편, 클로드가 오픈AI 내부 시스템 침입에 악용된 사건도 함께 보도되고 있다.

짚어야 할 점

  • 액센추어가 2026년 1월 인수한 AI 전문기업 패컬티 인력이 실제 평가단을 구성한다는 점에서, 평가의 전문성이 인수합병으로 조달된 인력에 의존하는 구조라는 점을 봐야 한다.
  • 평가 비용을 피평가 기업인 앤트로픽이 직접 부담하는 방식은 아모데이가 강조한 '독립적 평가'라는 취지와 배치될 소지가 있다.
  • 앤트로픽이 매출 급증과 적자 전환 우려가 동시에 제기되는 IPO 국면에서 안전평가 체계를 발표했다는 시점도 함께 고려할 부분이다.
  • 클로드가 오픈AI 코드 저장소 침입에 쓰인 사건이 부각된 직후 나온 발표라, 안전성 신뢰 회복 차원의 조치인지도 짚어볼 지점이다.

아직 확인되지 않은 것

  • 액센추어의 평가 결과가 외부에 공개되는지, 앤트로픽이 이를 모델 출시 결정에 어떻게 반영하는지는 확인되지 않았다.
  • 평가단의 규모, 구체적 평가 기준, 앤트로픽으로부터의 실질적 독립성을 보장할 장치가 있는지는 나오지 않았다.
  • 다른 프런티어 AI 기업들이 이 방식을 따르거나 아모데이가 제안한 '민주주의 국가 AI 랩 공조'에 동참할지는 확인되지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

브로드컴, 앤트로픽에 420억달러 대출하고 AI칩 공급
IT조선 · 2026-10-02

로이터통신은 앤트로픽의 기업공개(IPO) 투자설명서를 인용해 브로드컴이 앤트로픽의 인프라 구축과 칩 대여를 지원하기 위해 최대 420억달러를 대출해 주기로 합의했다고 1일(현지시각) 보도했다. 브로드컴은 이와 함께 앤트로픽에 대한 AI 칩 공급도 확대한다. 양사 협력은 연산 공급, 장비…

앤트로픽 "LLM·로봇 결합시 업무 81% 자동화 가능"
전자신문 SW · 2026-10-01

앤트로픽이 9월 30일(현지시간) 공개한 '로봇은 어떤 일을 할 수 있나' 보고서에서, 거대언어모델(LLM)과 로봇을 함께 활용하면 미국 노동시장 전체 업무의 81%까지 AI로 자동화할 수 있다는 분석을 내놓았다. LLM만으로 자동화 가능한 업무는 전체 근로시간의 50% 수준으로 추산됐…

앤트로픽 "中 GLM-5.3 공격력 클로드급, 안전장치는 취약"
ZDNet Korea · 2026-10-01

앤트로픽이 중국 Z.ai의 오픈웨이트 모델 GLM-5.3의 사이버 공격 능력과 안전성을 시험한 보고서를 공개했다. 사이버 익스플로잇 과제 410건 중 GLM-5.3은 50건, 앤트로픽의 클로드 미토스 프리뷰는 56건을 성공시켜 공격 능력 격차는 크지 않았다. 반면 간단한 기법만으로 GL…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →