AWS, EKS·EFA·DeepEP로 MoE 강화학습 처리량 40% 향상
요약
AWS는 믹스처 오브 엑스퍼트(MoE) 모델을 RLHF나 GRPO로 대규모 강화학습 후속 학습할 때 나타나는 통신 병목 문제를 다뤘다. Amazon EKS와 Elastic Fabric Adapter(EFA), DeepEP를 결합해 전문가 병렬화(Expert Parallelism)의 동적 올투올 토큰 라우팅 통신을 최적화하는 아키텍처를 제시했으며, AWS는 이 구성으로 처리량이 40% 향상됐다고 밝혔다. 대규모 비동기 RL 학습에서는 롤아웃 생성과 정책 학습 간 속도 불균형, 가속기의 컴퓨트·메모리·네트워크 대역폭 부담, 단일 인스턴스를 넘어설 때 노드 내 NVLink에서 노드 간 저대역폭 링크로 통신이 옮겨가는 문제가 동시에 발생한다고 설명했다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
로보파티가 2026년 9월 28일 IROS 2026에서 완전 오픈소스 이족보행 휴머노이드 로봇 RP1을 공개했다. RP1은 2026년 1월 출시된 오픈소스 프로젝트 RPO와 자체 개발 Romomo 액추에이터, 개방형 플랫폼 PartyOS를 기반으로 한다. PartyOS에는 사전 정의된 …
업스테이지가 경량언어모델(SLM) '솔라 미니 4'를 공개했다. 전문가혼합(MoE) 구조를 적용해 적은 연산량으로 고성능·고효율을 구현한 것이 특징이다. 동급 규모의 활성 매개변수를 쓰는 소형 모델 가운데 최고 수준의 성능을 기록했다고 밝혔다. 글로벌 AI 평가기관 아티피셜 애널리시스의…
노타는 멀티모달 AI 모델의 성능 저하를 최소화하면서 GPU 메모리 사용량을 줄이는 '모달리티 인지 전문가 프루닝' 연구 논문이 NeurIPS 2026 메인트랙에 채택됐다고 밝혔다. 이 기술은 MoE 기반 멀티모달 모델에서 전문가 모듈을 제거할 때 언어와 이미지 이해 능력을 함께 고려해…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-10-01AWS, NeMo 에이전트 툴킷에 S3 Vectors로 메모리 구현AWS ML Blog
- 2026-10-01업스테이지, 소형 LLM '솔라 미니 4' 공개…비용·속도 개선ZDNet Korea
- 2026-09-29엔젤로보틱스, 연구용 웨어러블 로봇 '파이엑스원' 공개ZDNet Korea
- 2026-09-28비드래프트, 자기개선 AI로 리더보드 5관왕AI타임스
- 2026-09-26손가락으로 걷는 자율 로봇 손 개발ZDNet Korea
이 글에 나온 말
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
- GPU 늘리기 경쟁, 커지는 효율 논란기사 13건
- 마이크론 역대 최대 실적, 메모리값 폭등 여파기사 13건
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 엑시나, 메모리 중심 컴퓨팅으로 AI 비용 절감 추진전자신문 SW · 2026-10-05
- 과기정통부, 기지국을 피지컬AI 거점으로 전환하는 기술개발 추진전자신문 SW · 2026-10-05
- AI 데이터센터 냉각 전쟁, 삼성 M&A·LG 자체기술ZDNet Korea · 2026-10-05
- 6G 코어망 AI 통합 방식 두고 3GPP서 표준화 갈등ZDNet Korea · 2026-10-04
- 로봇·드론 확산에 통신망 '업링크' 중요성 커진다ZDNet Korea · 2026-10-04
- 머스크, 옵티머스 생산 위해 AI칩 메모리 축소IT조선 · 2026-10-04