모델 803건 · 국산 131 · 가격 645 추적 중
파운데이션 모델·LLM

오픈AI·앤트로픽·xAI, 하루 사이 신모델 공개

ZDNet Korea·2026-09-23주요

요약

오픈AI가 'GPT-6 솔·루나'를, 앤트로픽이 '클로드 오퍼스 5.5'를 22일 공개했고 하루 앞서 스페이스XAI는 '그록 4.7'을 선보였다. 앤트로픽은 외부 기관 평가와 행동 감사로 안전 검증을 강화했고, 오픈AI는 상위 모델에서 확보한 기술을 더 저렴한 제품으로 옮겼으며, 스페이스XAI는 장시간 작업 수행과 자기 검증 능력을 키웠다. 독립 평가기관 아티피셜 애널리시스의 종합 성능 지표(AAII)에서는 오퍼스 5.5가 앞섰다. 세 회사 수장 모두 AI 개발 속도조절 필요성에는 공감을 나타냈지만, 실제 안전 검증 방식과 적용 강도는 회사마다 차이가 있었다.

큐레이터 노트

원문에 없는 맥락입니다

같은 시기 출시했지만 앤트로픽만 외부 기관의 사전 평가 사실을 공개해, '속도조절' 발언과 실제 검증 절차 사이 온도차가 회사별로 드러난다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

오픈AI는 9월 22일 모델 개발 초기 단계부터 외부 독립기관의 안전성 검증을 받겠다고 별도로 밝혔고, 같은 날 알트먼과 아모데이 등은 9월 23일 유엔 안보리 AI 안전 브리핑에 참석할 예정이었다. 앤트로픽은 기업공개(IPO)를 앞두고 있으며, 이번 오퍼스 5.5는 앤트로픽이 AI 개발 속도조절을 제안한 이후 내놓은 첫 모델이라는 점도 앞선 보도에서 확인된다.

짚어야 할 점

  • 오픈AI가 이번 신모델 발표와 별도로 학습 단계부터 외부 검증 권한을 확대한다고 밝힌 시점이 겹쳐, 가격 인하 경쟁과 안전 검증 강화가 동시에 진행되고 있다는 점을 함께 봐야 한다.
  • 앤트로픽의 오퍼스 5.5는 속도조절 제안 이후 첫 출시작이자 IPO를 앞둔 시점에 나온 모델이라는 맥락이 있어, 안전성 강조가 상장 전 이미지 관리와도 맞물려 있을 가능성이 있다.
  • 같은 날 알트먼과 아모데이가 유엔 안보리 브리핑에 참석하는 일정과 신모델 공개가 겹친 점도 눈여겨볼 대목이다.

아직 확인되지 않은 것

  • 오픈AI가 밝힌 '학습 단계 외부 검증 확대'가 이번 GPT-6 솔·루나 개발에도 실제 적용됐는지는 확인되지 않았다.
  • 앤트로픽이 공개했다는 외부 기관의 사전 평가가 구체적으로 어떤 절차와 범위로 이뤄졌는지는 나오지 않았다.
  • 오픈AI와 스페이스XAI가 언급한 '속도조절 공감'이 실제 안전 검증 절차로 어떻게 구현됐는지에 대한 구체적 자료는 제시되지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

'불량 AI 에이전트' 논란에 美 FTC 조사 착수
AI타임스 · 2026-10-01

미국 연방거래위원회(FTC)가 앤트로픽, 오픈AI, AI 안전 평가기관 METR 등을 대상으로 AI 에이전트의 안전성과 소비자 피해 가능성에 대한 조사에 착수했다. 로이터와 월스트리트저널에 따르면 FTC 고위 관계자는 9월 30일(현지시간) 해당 기업들에 공식 정보 제출을 요구하고 경영…

오픈AI, 에이전트용 '디시전스 API' 공개
AI타임스 · 2026-10-01

오픈AI가 데브데이 2026에서 반복적인 판단 작업을 처리하는 '디시전스 API'를 공개했다. 이 API는 대화형 AI처럼 긴 답변을 생성하는 대신 개발자가 미리 정해놓은 선택지 중 하나를 골라주는 방식으로 동작하며, 'GPT-6 루나' 모델을 기반으로 한다. 오픈AI는 이 API를 자…

오픈AI "에이전트가 업무 수행, 엔지니어는 지휘·검증으로"
바이라인네트워크 · 2026-10-01

오픈AI의 리처드 호 하드웨어 총괄 부사장이 삼성 AI 포럼 2026에서 AI 에이전트의 업무 활용 성과를 발표했다. 에이전트는 수학 난제 해결, 소프트웨어 개발, 반도체 설계 등 업무를 수행하고 있으며, 그 결과 인간 엔지니어의 역할은 목표 설정과 결과 검증, 에이전트 관리로 옮겨가고…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

ZDNet Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →