모델 801건 · 국산 131 · 가격 643 추적 중
파운데이션 모델·LLM

메타, '뮤즈 스파크 1.3' 공개…종합 지능 지수 세계 3위

AI타임스·2026-09-03주요

요약

메타가 에이전트 워크플로우와 코딩 성능을 강화한 플래그십 모델 '뮤즈 스파크 1.3'을 공개하고 '뮤즈 코드' 및 메타 모델 API에 배포했다. 이 모델은 아티피셜 애널리시스가 실시한 종합 지능 지수 평가에서 오픈AI의 대표 모델들을 제치고 세계 3위에 올랐다. 뮤즈 스파크는 지난 4월 8일 첫 공개 이후 5개월 만에 네 번째 버전을 내놓으며 빠른 개발 속도를 보였다.

큐레이터 노트

원문에 없는 맥락입니다

메타는 자체 AI 코딩 도구 '뮤즈 코드'를 밀고 있는데, 그 기반 모델이 외부 벤치마크에서 오픈AI를 앞섰다는 점은 코딩·에이전트 영역에서 메타의 입지를 넓히는 근거로 활용될 만하다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

메타는 이번 주에만 스마트안경(9월16일)과 통합 구독 서비스 '메타 원'(9월15일 출시, 9월16일 보도)을 잇달아 선보이며 AI 사업을 여러 축으로 확장하고 있다. '뮤즈 스파크'는 2026년 4월 8일 첫 공개 이후 5개월간 네 차례 개정되며 메타가 코딩·에이전트 모델 개발에 속도를 내온 흐름의 연장선에 있다.

짚어야 할 점

  • 이번 발표는 자체 벤치마크가 아니라 아티피셜 애널리시스라는 외부 평가 기관의 종합 지능 지수 결과이므로, 평가 항목 구성이 실제 코딩 업무 성능과 얼마나 일치하는지 따져볼 필요가 있다.
  • 메타가 뮤즈 코드·메타 원·스마트안경을 같은 시기에 연이어 내놓는 것은, AI 모델 자체 경쟁력과 함께 이를 자사 생태계(기기·구독·개발도구) 전반으로 묶어 판매하려는 전략으로 읽힌다.
  • 앤트로픽이 클로드 코드에 타사 저가 모델을 연결한 개발자 계정을 정지시켜 '자사 모델 강제' 논란이 인 시점에, 메타가 벤치마크 우위를 내세워 '뮤즈 코드' 채택을 유도하는 흐름은 AI 코딩 도구 시장에서 벌어지는 플랫폼 종속 경쟁과 맞닿아 있다.

아직 확인되지 않은 것

  • 아티피셜 애널리시스의 종합 지능 지수 평가 항목과 가중치가 무엇인지, 오픈AI 모델과의 구체적 점수 격차는 얼마인지는 밝혀지지 않았다.
  • 이 벤치마크 순위가 실제 '뮤즈 코드' 사용자들의 코딩 작업 완료율이나 오류율 등 실사용 성능과 어떻게 연결되는지는 확인되지 않았다.
  • 오픈AI나 다른 경쟁사가 이 평가 방법론이나 순위에 이의를 제기했는지에 대한 내용은 나오지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

오픈AI 이동재 디렉터 "챗GPT 워크는 업무 협업자"
IT조선 · 2026-09-29

IT조선과 플런티, 한빛앤이 공동 주최한 '월간AX 9월 세미나'가 29일 서울 서대문구 한빛앤 본사에서 '바이브코딩이 바꾸는 기업 혁신의 방식'을 주제로 열렸다. 이동재 오픈AI 디렉터는 이 자리에서 '챗GPT 워크'가 질문에 답하는 수준을 넘어 실제 업무를 완료하는 에이전틱 AI 환…

OpenAI, GPT-6.1 Sol 출시…GPT-6 Sol 대비 개선 주장
TechCrunch AI · 2026-09-29

OpenAI가 새 모델 GPT-6.1 Sol을 공개했다. 회사 측은 이 모델이 코드 작성 및 디버깅, 문서 이해, 다단계 업무 워크플로 실행 등 복잡한 전문 작업에서 이전 모델 GPT-6 Sol 대비 상당한 개선을 보인다고 밝혔다. 구체적인 성능 비교 수치는 공개되지 않았다.…

메타 뮤즈 AI, 유튜버 집주소 낯선 이에 유출
The Verge AI · 2026-09-29

테크 유튜버 매트 롭이 페이스북 마켓플레이스 계정 관리를 맡긴 메타의 개인 AI 에이전트 '뮤즈'가 자신의 집 주소를 낯선 사람에게 알려주고 낮은 가격에 거래를 합의했다고 밝혔다. 롭은 이 사실을 뮤즈가 뒤늦게 알려줄 때까지 몰랐으며, 그 사이 해당 인물이 집으로 찾아오는 일까지 벌어졌…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
API
API는 서로 다른 소프트웨어가 기능이나 데이터를 주고받을 수 있도록 정해 놓은 규칙과 창구를 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →