모델 801건 · 국산 131 · 가격 643 추적 중
파운데이션 모델·LLM

xAI 그록 4.6, 아마존 베드록에 출시

AWS ML Blog·2026-09-21영문 원문

요약

xAI의 그록(Grok) 4.6이 2026년 8월 18일 아마존 베드록에서 이용 가능해졌다. xAI가 베드록에 제공한 두 번째 모델로, 기존 bedrock-mantle에 더해 bedrock-runtime 엔드포인트와 Converse API(스트리밍 포함)를 새로 지원하며, 추론 강도를 낮음·중간·높음·xhigh 네 단계로 설정할 수 있다. xAI는 장기 실행 에이전트, 코딩, 지식노동 작업에 초점을 맞춰 훈련했다고 밝혔으며, 2026년 8월 12일 발표한 자체 벤치마크에서 GDPVal-AA v2, AA-Briefcase 등 다수 평가 결과를 공개했다. 이 중 일부 지표는 xAI 자체 측정이 아니라 독립 평가기관인 Artificial Analysis가 산출한 것이다.

큐레이터 노트

원문에 없는 맥락입니다

bedrock-runtime과 Converse API 지원으로 OpenAI 호환 클라이언트 없이도 AWS SDK와 표준 베드록 제어 체계로 그록 4.6에 접근할 수 있게 됐다는 점이 이번 확장의 실질적 변화다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

그록 4.6은 xAI가 아마존 베드록에 올린 두 번째 모델로, 기존에는 bedrock-mantle 엔드포인트로만 접근할 수 있었다. 이번에 bedrock-runtime과 Converse API가 추가되면서 AWS SDK와 표준 베드록 제어 체계로 그록에 접근하는 길이 열렸다. 벤치마크 결과는 2026년 8월 12일 xAI가 별도로 발표한 내용을 기반으로 한다.

짚어야 할 점

  • bedrock-runtime·Converse API 지원은 단순 신모델 추가가 아니라, OpenAI 호환 클라이언트를 거치지 않고도 AWS 생태계 안에서 그록을 다른 베드록 모델과 동일한 방식으로 호출·운용할 수 있게 됐다는 점이 핵심이다.
  • 공개된 벤치마크 중 일부는 xAI 자체 측정이 아니라 독립 평가기관 Artificial Analysis가 산출한 수치라는 점이 명시돼, 자체 발표 벤치마크에 대한 신뢰도 보완 장치로 언급됐다.
  • 추론 강도를 낮음부터 xhigh까지 네 단계로 나눈 것은 장기 실행 에이전트·코딩·지식노동 작업을 겨냥한 설계라는 xAI의 설명과 맞물려, 작업 난이도에 따라 비용과 응답 속도를 조절하려는 의도로 읽힌다.

아직 확인되지 않은 것

  • GDPVal-AA v2, AA-Briefcase 외에 공개된 벤치마크 항목 중 어디까지가 Artificial Analysis 측정이고 어디까지가 xAI 자체 측정인지 구체적으로 구분되지 않았다.
  • 베드록에서의 가격 정책, 지원 리전, 기존 bedrock-mantle 대비 성능·지연 차이는 확인되지 않았다.
  • 추론 강도 네 단계가 실제 과제 수행 품질이나 비용에 어떤 차이를 만드는지에 대한 독립적인 검증 자료는 나오지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

OpenAI, 메타 Muse 대항마 'Dots' 출시
The Verge AI · 2026-09-29

OpenAI가 데브데이 키노트에서 상시 작동형 AI 비서 'Dots'를 발표했다. 메타의 Muse에 대응하는 제품으로, 귀엽고 커스터마이징 가능한 아바타로 표현된다. GPT-6 Astra 모델이 구동하며, 자체 클라우드 컴퓨터로 웹 브라우저와 다수의 지원 앱에 접근해 백그라운드에서 작업…

소비자용 에이전트 인스팅트, 한 달 만에 몸값 4배
AI타임스 · 2026-09-29

AI 에이전트 스타트업 인스팅트가 10억달러 규모의 시리즈 C 투자를 유치해 기업가치 100억달러를 기록했다고 28일(현지시간) 발표했다. 이는 한 달 전 평가받은 25억달러에서 네 배 뛴 수치다. 이번 투자에는 세쿼이아 캐피털, 벤치마크 캐피털, 코튜 등이 참여했다. 2025년 설립된…

마누스, 차세대 에이전트 '마누스 2.0'과 '큐' 출시
AI타임스 · 2026-09-29

마누스가 9월 28일 차세대 다목적 AI 에이전트 '마누스 2.0'과 개인용 에이전트 생성·배포 앱 '큐(Cue)'를 출시했다. 이번 발표는 단순 모델 업그레이드가 아니라 새로운 에이전트 아키텍처와 제품군을 선보이는 대규모 개편이라고 밝혔다. 마누스 2.0은 작업 속도와 자율성 향상에 …

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
벤치마크
AI 모델의 성능을 정량적으로 측정하고 서로 비교할 수 있도록 표준화한 평가용 문제 집합과 채점 기준을 말한다.
스트리밍
모델이 응답 전체를 다 만들 때까지 기다리지 않고, 생성되는 토큰을 그때그때 순서대로 전송하는 응답 방식을 말한다.
API
API는 서로 다른 소프트웨어가 기능이나 데이터를 주고받을 수 있도록 정해 놓은 규칙과 창구를 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AWS ML Blog 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →