모델 801건 · 국산 131 · 가격 643 추적 중
AI 인프라·반도체

화웨이, AI 추론용 OceanStor M900 스토리지 공개

ZDNet Korea·2026-09-18

요약

화웨이가 상하이에서 열린 화웨이 커넥트 2026 기조연설에서 초대형 데이터센터의 AI 추론을 가속하기 위한 OceanStor M900 Context Memory Storage를 공개했다. 이 제품은 SuperPoD에 완전 공유형 메모리 공간을 제공해 온칩 메모리와 DRAM의 용량 한계를 SSD까지 확장한 다계층 KV 캐시로 보완한다. UnifiedBus 네트워크 기반 원홉 연결 구조로 프로토콜 변환과 CPU 포워딩 과정을 없애 액세스 지연 시간을 줄이고 토큰 처리량을 높였다고 화웨이는 설명했다. 또한 KV 캐시 수명주기를 예측해 데이터를 스토리지 미디어에 분산 배치하는 적응형 스토리지 기술로 SSD 내구성을 높여 장기 운영 비용을 낮춘다는 설명이다.

큐레이터 노트

원문에 없는 맥락입니다

AI 에이전트의 멀티턴 추론이 늘면서 발생하는 KV 캐시 급증 문제를 컴퓨팅이 아닌 스토리지 계층에서 해결하려는 접근이라는 점이 눈에 띈다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

AIDC 전용요금제 로드맵 부재…국감서 질타 예고
전자신문 SW · 2026-09-29

정부가 2035년까지 18.4GW 규모의 AI데이터센터(AIDC)를 확충한다는 계획을 내놨지만 전용 전기요금제의 구체적 로드맵은 아직 나오지 않았다. 29일 국회 과방위 조경태 국민의힘 의원은 전기요금이 kWh당 1원만 달라져도 1GW 규모 시설의 연간 비용이 최대 87억6000만원 차…

AI를 비용 아닌 자산으로 만드는 법
MIT Tech Review · 2026-09-29

MIT 테크놀로지 리뷰에 게재된 HPE 후원 콘텐츠는 기업의 AI 활용이 실험 단계를 넘어 상시 가동되는 워크로드 포트폴리오로 옮겨가고 있다고 설명한다. 딜로이트의 2026 기업 AI 현황 보고서를 인용해, 2025년 직원의 AI 접근률이 5% 늘었고 AI 프로젝트의 40% 이상을 실제…

삼성, KKR 산하 AI 인프라 기업 헬릭스에 10억 달러 투자
블로터 · 2026-09-29

KKR과 헬릭스 디지털 인프라스트럭처는 삼성으로부터 10억 달러 투자를 약정했다고 29일 밝혔다. 이는 KKR과 쿠웨이트투자청, 엔비디아, 비스트라 등 창립 투자자들이 헬릭스 출범 당시 약정한 자본에 이은 후속 투자다. 헬릭스는 AI 수요 대응을 위해 데이터센터, 전력, 네트워크 등 인…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
지연 시간
요청을 보낸 시점부터 응답을 받기까지 걸리는 시간을 말한다.
KV 캐시
트랜스포머 기반 언어 모델이 토큰을 하나씩 생성할 때 이미 계산한 어텐션의 키(Key)와 값(Value) 벡터를 저장해 두었다가 다음 토큰 생성 시 재사용함으로써 중복 계산을 없애는 추론 최적화 기법을 말한다.
처리량
처리량은 시스템이 일정 시간 동안 처리할 수 있는 요청 수나 생성 토큰 수를 나타내는 지표를 말한다.
추론
추론(Inference)은 학습이 끝난 인공지능 모델이 새로운 입력을 받아 예측이나 답변 같은 출력을 만들어내는 과정을 말한다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

ZDNet Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →