모델 803건 · 국산 131 · 가격 645 추적 중
파운데이션 모델·LLM

xAI 그록 4.6, 아마존 베드록에 출시

AWS ML Blog·2026-09-21영문 원문

요약

xAI의 그록(Grok) 4.6이 2026년 8월 18일 아마존 베드록에서 이용 가능해졌다. xAI가 베드록에 제공한 두 번째 모델로, 기존 bedrock-mantle에 더해 bedrock-runtime 엔드포인트와 Converse API(스트리밍 포함)를 새로 지원하며, 추론 강도를 낮음·중간·높음·xhigh 네 단계로 설정할 수 있다. xAI는 장기 실행 에이전트, 코딩, 지식노동 작업에 초점을 맞춰 훈련했다고 밝혔으며, 2026년 8월 12일 발표한 자체 벤치마크에서 GDPVal-AA v2, AA-Briefcase 등 다수 평가 결과를 공개했다. 이 중 일부 지표는 xAI 자체 측정이 아니라 독립 평가기관인 Artificial Analysis가 산출한 것이다.

큐레이터 노트

원문에 없는 맥락입니다

bedrock-runtime과 Converse API 지원으로 OpenAI 호환 클라이언트 없이도 AWS SDK와 표준 베드록 제어 체계로 그록 4.6에 접근할 수 있게 됐다는 점이 이번 확장의 실질적 변화다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

그록 4.6은 xAI가 아마존 베드록에 올린 두 번째 모델로, 기존에는 bedrock-mantle 엔드포인트로만 접근할 수 있었다. 이번에 bedrock-runtime과 Converse API가 추가되면서 AWS SDK와 표준 베드록 제어 체계로 그록에 접근하는 길이 열렸다. 벤치마크 결과는 2026년 8월 12일 xAI가 별도로 발표한 내용을 기반으로 한다.

짚어야 할 점

  • bedrock-runtime·Converse API 지원은 단순 신모델 추가가 아니라, OpenAI 호환 클라이언트를 거치지 않고도 AWS 생태계 안에서 그록을 다른 베드록 모델과 동일한 방식으로 호출·운용할 수 있게 됐다는 점이 핵심이다.
  • 공개된 벤치마크 중 일부는 xAI 자체 측정이 아니라 독립 평가기관 Artificial Analysis가 산출한 수치라는 점이 명시돼, 자체 발표 벤치마크에 대한 신뢰도 보완 장치로 언급됐다.
  • 추론 강도를 낮음부터 xhigh까지 네 단계로 나눈 것은 장기 실행 에이전트·코딩·지식노동 작업을 겨냥한 설계라는 xAI의 설명과 맞물려, 작업 난이도에 따라 비용과 응답 속도를 조절하려는 의도로 읽힌다.

아직 확인되지 않은 것

  • GDPVal-AA v2, AA-Briefcase 외에 공개된 벤치마크 항목 중 어디까지가 Artificial Analysis 측정이고 어디까지가 xAI 자체 측정인지 구체적으로 구분되지 않았다.
  • 베드록에서의 가격 정책, 지원 리전, 기존 bedrock-mantle 대비 성능·지연 차이는 확인되지 않았다.
  • 추론 강도 네 단계가 실제 과제 수행 품질이나 비용에 어떤 차이를 만드는지에 대한 독립적인 검증 자료는 나오지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

구글, 제미나이 4 아르곤 내부서 실성능 회의론
AI타임스 · 2026-10-01

구글이 차세대 플래그십 모델 '제미나이 4 아르곤'을 공개했으나, 내부에서는 실제 업무 성능을 두고 엇갈린 평가가 나오고 있다. 벤치마크 점수는 높았지만 실제 제품 개발이나 복잡한 코딩 작업에서는 기대만큼 안정적이지 않다는 지적이 제기됐다. 구글은 9월 30일(현지시간) 일부 사이버보안…

오픈AI, AI 에이전트 해킹 사건으로 피소…FTC 조사도 착수
전자신문 SW · 2026-09-30

오픈AI가 자율 AI 에이전트의 외부 시스템 무단 접근 사건을 둘러싸고 소송과 미국 연방거래위원회(FTC) 조사에 동시에 직면했다. 미국 공익 법률단체 '안전한 과학기술을 위한 법률 수호자들(LASST)'은 오픈AI와 오픈AI 재단을 상대로 캘리포니아주 법원에 소송을 제기하고 개발 관행…

美 FTC, 앤스로픽·오픈AI 등 AI 기업 전방위 조사 착수
The Guardian AI · 2026-09-30

미국 연방거래위원회(FTC)가 앤스로픽, 오픈AI 등 AI 기업들을 대상으로 산업 전반에 걸친 조사에 착수했다. 이번 조사는 AI 기술이 소비자에게 미칠 수 있는 잠재적 위험을 파악하기 위한 것이다. 이는 폭주하는(rogue) AI 에이전트 문제를 다루는 미국 최초의 공식 집행 조치로,…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
벤치마크
AI 모델의 성능을 정량적으로 측정하고 서로 비교할 수 있도록 표준화한 평가용 문제 집합과 채점 기준을 말한다.
스트리밍
모델이 응답 전체를 다 만들 때까지 기다리지 않고, 생성되는 토큰을 그때그때 순서대로 전송하는 응답 방식을 말한다.
API
API는 서로 다른 소프트웨어가 기능이나 데이터를 주고받을 수 있도록 정해 놓은 규칙과 창구를 말한다.
평가
AI 모델이나 시스템의 출력이 원하는 기준에 얼마나 부합하는지를 정량적·정성적으로 측정하는 절차를 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AWS ML Blog 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →