래블업 신정규 대표 “GPU는 몇 장이 아니라 얼마나 뽑아쓰느냐가 중요”
요약
래블업은 GPU·NPU 클러스터에서 AI 학습·추론을 배치·관리하는 소프트웨어 Backend.AI를 개발하는 기업으로, 분할 GPU 기술과 자체 AI 전용 오케스트레이터 ‘소코반’을 통해 GPU 자원 활용률을 높인다. 신정규 대표는 업스테이지 컨소시엄과 함께 B200 GPU 504장 클러스터로 ‘Solar Open 100B’ 학습을, 이후 H100·B200 등 약 1000장 규모 클러스터로 ‘Solar Open 2 250B’ 학습을 지원했다고 밝혔다. 그는 엔비디아 외에 AMD·인텔 GPU와 리벨리온·퓨리오사AI 등 국산 NPU도 통합 관리해 특정 하드웨어 종속을 줄이는 전략을 취한다고 설명했다. Backend.AI는 오픈소스 커뮤니티 에디션과 GPU 수량 기반 구독형 엔터프라이즈 버전으로 제공된다.
큐레이터 노트
원문에 없는 맥락입니다
깊이 읽기
이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다
이 일이 어디서 왔나
래블업은 9월 29일 'lab | up > /conf/6' 컨퍼런스에서 'AI 팩토리'와 1인 1에이전트 인프라 비전을 발표한 데 이어, 이번 인터뷰에서 GPU 자원 활용률을 높이는 소프트웨어 전략을 구체적으로 밝혔다. 같은 시기 LG유플러스도 옵트에이아이와 손잡고 모델 경량화로 GPU·전력 사용량을 줄이는 '토큰 최적화' 기술을 공동 개발한다고 발표했고, NVIDIA는 생산성·내구성·범용성이 AI 팩토리 수익성을 좌우한다는 분석을 내놨다. GPU 확보 자체보다 이를 어떻게 운용하느냐로 업계의 관심이 옮겨가는 흐름 속에 이 기사가 놓여 있다.
짚어야 할 점
- 래블업의 '효율적 활용률' 메시지는 NVIDIA가 말한 처리량·비용 효율 중심의 '생산성' 개념, LG유플러스·옵트에이아이의 토큰 최적화와 같은 맥락으로, 하드웨어 확보 경쟁이 치열해질수록 소프트웨어 계층의 중요성이 커지는 흐름을 보여준다.
- 엔비디아 GPU 외에 AMD·인텔, 리벨리온·퓨리오사AI 국산 NPU까지 통합 관리한다는 전략은 특정 공급사 종속 위험을 낮추려는 시도로, GPU 공급 부족이나 가격 변동에 대한 업계의 대응 방식 중 하나로 읽힌다.
- Solar Open 100B·250B 학습에 활용됐다는 B200·H100 클러스터 규모는 업스테이지 컨소시엄과의 협업 성과로 제시된 수치이며, 같은 시기 AWS의 데이터센터 투자 확대 및 지역 반발 보도와 맞물려 '인프라 확장'과 '효율화' 두 갈래 전략이 동시에 진행되고 있음을 시사한다.
아직 확인되지 않은 것
- Backend.AI의 분할 GPU 기술과 소코반 오케스트레이터가 실제로 GPU 활용률을 얼마나 끌어올리는지 구체적 수치나 제3자 검증 자료는 제시되지 않았다.
- Solar Open 100B·250B 학습 성과(모델 성능, 학습 기간 등)에 대한 세부 내용은 확인되지 않았다.
- Backend.AI 엔터프라이즈 버전의 실제 고객 수나 매출 규모, 국산 NPU 통합이 상용 환경에서 어느 정도 안정적으로 작동하는지에 대한 자료는 나오지 않았다.
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
AWS가 데이터센터 건설을 둘러싼 지역 주민들의 반발과 정치권 압박에 대응해 5년간 10억달러(약 1조3500억원) 이상을 지역사회에 추가 투자하겠다고 발표했다. 아울러 지자체와 맺던 비밀유지계약(NDA)도 완전히 폐지하기로 했다. 맷 가먼 AWS CEO는 2일 기고문을 통해 국가 차원…
아마존웹서비스(AWS) CEO 맷 가먼이 3,000단어가 넘는 블로그를 통해 지역사회의 데이터센터 반대 움직임에 우려를 표했다. 그는 일자리, 전력 수요, 환경에 대한 질문은 중요하지만 소셜미디어와 24시간 뉴스 환경에서 잘못된 정보와 거짓말도 빠르게 퍼지고 있다고 주장했다. 가먼은 미…
LG유플러스가 AI 모델 최적화 전문기업 옵트에이아이와 협력해 모델 경량화를 통한 '토큰 최적화' 기술 확보에 나선다. 옵트에이아이가 모델 경량화 연구·개발을, LG유플러스가 기술 검증과 적용을 맡는다. 양사는 '엑사원' 기반 경량화를 통해 신경망처리장치(NPU)에서 구동 가능하도록 구…
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-10-02LG U+, 옵트에이아이와 토큰 최적화 기술 공동 개발IT조선
- 2026-10-01정부 지원 GPU 70%가 가동률 50% 미만…관리 공백 지적ZDNet Korea
- 2026-09-29CTO들 "AI 경쟁력, 모델 아닌 추론 최적화가 좌우"ZDNet Korea
- 2026-09-22국내 AI 기업들, 코스닥 IPO 잇달아 추진ZDNet Korea
- 2026-09-21이노그리드, AI모델 대신 GPU 운영 소프트웨어에 집중블로터
- 2026-09-21모레, 이기종 GPU·NPU 아우르는 '토큰 팩토리 OS'전자신문 SW
이 글에 나온 말
이 분야 브리핑
여러 매체가 함께 다룬 사안을 한 번에
- 마이크론 역대 최대 실적, 메모리값 폭등 여파기사 13건
- HBM 이후 AI 메모리 지도가 넓어진다기사 14건
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 머스크, 테라팹 반도체 생산 TSMC와 협력 논의 확인AI타임스 · 2026-10-04
- 삼성전자 3분기 영업익 100조 전망, DS·DX 희비블로터 · 2026-10-04
- 아마존, 엔비디아 AI칩 '매각 후 재임차' 검토IT조선 · 2026-10-04
- 엔비디아, 'DGX 스파크' 64GB 메모리 모델 출시ZDNet Korea · 2026-10-04
- ITU, '디지털 생명선'으로 통신 인프라 재조명전자신문 SW · 2026-10-04
- 마이크론 호실적에 삼성·SK하이닉스 3분기 실적 기대감 ↑ZDNet Korea · 2026-10-03