모델 803건 · 국산 131 · 가격 645 추적 중
에너지와 환경

NVIDIA, AI 데이터센터 전력 효율 높이는 DSX 공개

NVIDIA Blog·2026-09-15영문 원문주요

요약

NVIDIA는 AI 데이터센터의 전력 활용을 최적화하는 소프트웨어 스위트 DSX를 AI Infra Summit에서 소개했다. 파트너사 Emerald AI의 Conductor 플랫폼은 실리콘밸리파워의 전력망 신호에 따라 자동으로 AI 팩토리의 전력 소비를 4메가와트에서 3메가와트로 낮추면서도 우선순위가 높은 작업은 중단 없이 유지했으며, 이런 수요반응 신호에 200회 넘게 성공적으로 대응했다. 클라우드 업체 Lambda는 DSX MaxLPS를 검증한 결과, 동일한 전력 예산 안에서 19개 노드를 가동해 16개 노드를 전력 최대로 가동했을 때보다 클러스터 전체 토큰 처리량이 24% 늘고 와트당 성능은 23% 개선됐다고 밝혔다. NVIDIA는 자체 전망을 통해 DSX MaxLPS가 차세대 Vera Rubin NVL72 AI 팩토리에서 동일 전력 예산 내 GPU 용량을 최대 40%까지 늘릴 수 있을 것으로 추정했다.

큐레이터 노트

원문에 없는 맥락입니다

전력이 GPU 확장의 핵심 제약으로 떠오르면서, 칩 성능 자체보다 메가와트당 처리량을 끌어올리는 소프트웨어 최적화가 AI 인프라 경쟁의 새로운 축이 되고 있음을 보여주는 사례다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

이 발표는 산타클라라에서 열린 AI 인프라 서밋에서 나온 여러 발표 중 하나로, NVIDIA는 같은 자리에서 베라 루빈 시스템과 DSX 플랫폼을 함께 소개했다. 같은 행사에서 아마존 산하 Annapurna Labs의 NVHBM 커스텀 메모리, d-Matrix의 NVLink Fusion 통합, Pinterest의 Blackwell·Dynamo 기반 비주얼 검색 도입 등도 함께 공개돼, DSX는 전력 효율이라는 하나의 축을 겨냥한 발표였다.

짚어야 할 점

  • Lambda와 Emerald AI 사례 모두 특정 파트너사가 직접 검증하거나 시연한 결과이며, NVIDIA가 자체적으로 발표한 수치라는 점을 감안해 볼 필요가 있다.
  • 40% 용량 증대는 아직 출시되지 않은 차세대 Vera Rubin NVL72 기준의 NVIDIA 자체 전망치로, 실측이 아닌 추정값이다.
  • 이번 발표가 메모리(NVHBM), 상호연결(NVLink Fusion), 추론 소프트웨어(Dynamo) 등 같은 행사에서 나온 다른 하드웨어·소프트웨어 협력 발표들과 함께 전력·용량 확장이라는 공통 문제의식을 보여준다.

아직 확인되지 않은 것

  • Emerald AI의 수요반응 전력 조절이 실제 데이터센터 운영 비용이나 서비스 가격에 어떤 영향을 주는지는 확인되지 않았다.
  • Lambda의 24% 처리량 증가와 23% 와트당 성능 개선이 다른 클러스터 구성이나 워크로드에서도 재현되는지는 나오지 않았다.
  • DSX MaxLPS가 실제 상용 배포까지 이어지는 시점이나 비용 구조에 대한 자료는 제시되지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

한미 대미투자 1호 가스발전소 확정…원전·LNG도 논의
ZDNet Korea · 2026-09-30

한미 양국이 한미 전략투자 1호 프로젝트로 미국 텍사스주에 AI 데이터센터용 가스복합화력발전소(프로젝트 스타)를 건설하기로 확정했다. 발전소는 인근 데이터센터에 직접 전력을 공급하며, 2029년 1단계 상업운전을 시작해 2032년 전체 가동을 목표로 한다. 양국은 이와 별도로 미국 내 …

컴팔, OCP 서밋서 NVIDIA AI 팩토리 인프라 공개
ZDNet Korea · 2026-09-30

컴팔 일렉트로닉스가 OCP 글로벌 서밋 2026에서 차세대 AI 팩토리 인프라를 선보였다. 발표에는 800VDC 전력 아키텍처와 메가와트급 전력 인프라, 첨단 액체 냉각 기술이 포함됐다. 컴팔은 전력, 냉각, 랙 통합을 개별 시스템이 아닌 상호 연결된 요소로 설계해 NVIDIA 가속 컴…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
처리량
처리량은 시스템이 일정 시간 동안 처리할 수 있는 요청 수나 생성 토큰 수를 나타내는 지표를 말한다.
토큰
언어 모델이 텍스트를 처리할 때 사용하는 최소 단위로, 단어나 단어의 일부, 문장 부호 등을 가리키는 말이다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

NVIDIA Blog 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →