모델 801건 · 국산 131 · 가격 643 추적 중
MLOps·개발도구

AWS, Qwen3.8-2.4T-A95B SageMaker HyperPod 배포 가이드 공개

AWS ML Blog·2026-09-09영문 원문

요약

알리바바 Qwen 팀이 8월 12일 공개한 오픈 웨이트 모델 Qwen3.8-2.4T-A95B를 Amazon SageMaker HyperPod와 vLLM으로 배포하는 방법을 AWS ML 블로그가 소개했다. 이 모델은 선형 어텐션과 완전 어텐션을 결합한 하이브리드 구조와 세분화된 MoE(전문가 혼합) 아키텍처를 사용하며, reasoning_effort 파라미터로 추론 깊이를 조절하고 도구 호출, 네이티브 추측 디코딩(MTP)을 지원한다. AWS는 NVIDIA B300 Blackwell Ultra GPU 기반 인스턴스에서 NVFP4 양자화를 적용해 단일 노드에 모델을 올리는 과정과 SageMaker HyperPod의 Inference Operator, 오토스케일링, 장애 복구 기능을 다뤘다. 벤더(Qwen 팀) 자체 벤치마크에 따르면 연구 워크플로우, 지시 이행, 터미널 기반 코딩 작업에서 강점을 보였다고 밝혔다.

큐레이터 노트

원문에 없는 맥락입니다

언급된 벤치마크 결과는 Qwen 팀의 자체 발표이며 독립 검증 여부는 확인되지 않았다. AWS는 이를 트릴리언 파라미터급 오픈 모델을 자체 인프라에 배포하는 시리즈의 두 번째 사례로 소개했다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

비드래프트, 자기개선 AI로 리더보드 5관왕
AI타임스 · 2026-09-28

국내 스타트업 비드래프트는 자사 추론 모델 '다윈-180B-RSI'가 허깅페이스 공인 벤치마크 5개 리더보드에서 모두 1위를 차지했다고 9월 28일 밝혔다. 이 모델은 사람의 개입 없이 모델 스스로 풀이를 검증하고 재학습하는 '재귀적 자기개선(RSI)' 기술을 핵심으로 한다. 회사 측은…

스텝펀, 차세대 MoE 모델 '스텝 5 프리뷰' 공개
AI타임스 · 2026-09-21

중국 스텝펀이 에이전트 작업, 코딩, 전문 지식 업무, 금융 분석에 특화한 차세대 플래그십 모델 '스텝 5 프리뷰'를 9월 20일(현지시간) 공개했다. 희소 전문가 혼합(MoE) 구조를 적용해 높은 지능 수준을 유지하면서도 작업 비용을 낮추는 것을 목표로 개발됐다고 밝혔다. 시각적 멀티…

텐센트, 'Hy4 프리뷰' 오픈소스 공개...기업용 시장 겨냥
AI타임스 · 2026-08-29

텐센트가 8월 28일 차세대 모델 'Hy4 프리뷰'를 오픈소스로 공개했다. 대규모 전문가 혼합(MoE) 구조를 채택해 코딩, 사무 작업, 과학 연구 등 실제 생산성 작업에서의 성능을 강조했다. 이번 발표는 단순한 기술 경쟁을 넘어 기업용 생산성 생태계를 선점하려는 비즈니스 전략으로 해석…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
추측 디코딩
작은 초안 모델이 다음에 올 토큰 여러 개를 먼저 예측하면, 크고 정확한 목표 모델이 이를 한 번의 순전파로 검증해 채택하거나 기각함으로써 생성 속도를 높이는 디코딩 기법을 말한다.
전문가 혼합
전문가 혼합(MoE)은 여러 개의 전문가 서브네트워크 중 입력에 따라 일부만 선택적으로 활성화해 연산하는 신경망 구조를 말한다.
오픈 웨이트
오픈 웨이트란 모델의 학습이 끝난 파라미터(가중치)를 누구나 내려받아 직접 실행하거나 추가 학습에 쓸 수 있도록 공개하는 방식을 말한다.
파라미터
모델이 학습 과정에서 값을 스스로 조정해 나가는 내부 수치로, 입력을 출력으로 변환하는 계산 방식을 결정하는 요소를 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AWS ML Blog 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →