모델 801건 · 국산 131 · 가격 643 추적 중
AI 인프라·반도체

AWS, EKS·EFA·DeepEP로 MoE 강화학습 처리량 40% 향상

AWS ML Blog·2026-09-25영문 원문

요약

AWS는 믹스처 오브 엑스퍼트(MoE) 모델을 RLHF나 GRPO로 대규모 강화학습 후속 학습할 때 나타나는 통신 병목 문제를 다뤘다. Amazon EKS와 Elastic Fabric Adapter(EFA), DeepEP를 결합해 전문가 병렬화(Expert Parallelism)의 동적 올투올 토큰 라우팅 통신을 최적화하는 아키텍처를 제시했으며, AWS는 이 구성으로 처리량이 40% 향상됐다고 밝혔다. 대규모 비동기 RL 학습에서는 롤아웃 생성과 정책 학습 간 속도 불균형, 가속기의 컴퓨트·메모리·네트워크 대역폭 부담, 단일 인스턴스를 넘어설 때 노드 내 NVLink에서 노드 간 저대역폭 링크로 통신이 옮겨가는 문제가 동시에 발생한다고 설명했다.

큐레이터 노트

원문에 없는 맥락입니다

MoE 모델은 추론 비용을 낮추기 위해 희소성을 키우지만, 그 결과 학습 단계의 병목이 연산이 아닌 전문가 병렬화 통신으로 옮겨간다는 점을 보여주는 사례다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

비드래프트, 자기개선 AI로 리더보드 5관왕
AI타임스 · 2026-09-28

국내 스타트업 비드래프트는 자사 추론 모델 '다윈-180B-RSI'가 허깅페이스 공인 벤치마크 5개 리더보드에서 모두 1위를 차지했다고 9월 28일 밝혔다. 이 모델은 사람의 개입 없이 모델 스스로 풀이를 검증하고 재학습하는 '재귀적 자기개선(RSI)' 기술을 핵심으로 한다. 회사 측은…

손가락으로 걷는 자율 로봇 손 개발
ZDNet Korea · 2026-09-26

스위스 ETH 취리히 소프트 로보틱스 연구진이 손가락을 다리처럼 사용해 스스로 이동하는 로봇 손을 개발했다고 IT매체 기즈모도가 보도했다. 5개 손가락과 20개 관절을 갖춘 인간 오른손 형태로 제작됐으며, 배터리·센서·컴퓨팅 하드웨어가 담긴 온보드 모듈을 탑재해 외부 자원 없이 자율 동…

스텝펀, 차세대 MoE 모델 '스텝 5 프리뷰' 공개
AI타임스 · 2026-09-21

중국 스텝펀이 에이전트 작업, 코딩, 전문 지식 업무, 금융 분석에 특화한 차세대 플래그십 모델 '스텝 5 프리뷰'를 9월 20일(현지시간) 공개했다. 희소 전문가 혼합(MoE) 구조를 적용해 높은 지능 수준을 유지하면서도 작업 비용을 낮추는 것을 목표로 개발됐다고 밝혔다. 시각적 멀티…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
처리량
처리량은 시스템이 일정 시간 동안 처리할 수 있는 요청 수나 생성 토큰 수를 나타내는 지표를 말한다.
학습
학습은 모델이 데이터를 반복적으로 살펴보며 예측 오차를 줄이는 방향으로 내부 파라미터를 조정해 나가는 과정을 말한다.
토큰
언어 모델이 텍스트를 처리할 때 사용하는 최소 단위로, 단어나 단어의 일부, 문장 부호 등을 가리키는 말이다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AWS ML Blog 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →