모델 819건 · 국산 131 · 가격 656 추적 중
MLOps·개발도구

래블업, GPU 관리에 AI 토큰 비용 통합 관리 추가

ZDNet Korea·2026-10-07

요약

래블업이 서울 코엑스 'AI 페스타 26'에서 AI 인프라 관리 플랫폼 '백엔드닷AI'와 AI 모델 통합 운영 서비스 '컨티넘'을 소개했다. 백엔드닷AI는 기업·연구기관이 보유한 GPU와 AI 가속기를 여러 사용자에게 나눠주는 플랫폼이며, 컨티넘은 여러 AI 모델을 연결해 요청을 적절한 모델로 분배하고 모델별 토큰 사용량과 비용을 확인하도록 돕는 서비스다. 부스에서는 소형 AI 모델을 외부 네트워크와 분리된 로컬 환경에서 구동하며 사용량을 집계하는 시연도 진행했다. 래블업은 현재 120여 고객사를 확보하고 있다.

큐레이터 노트

원문에 없는 맥락입니다

GPU 자원 배분에 집중했던 기존 영역에서, 여러 모델을 섞어 쓸 때 발생하는 비용 추적과 요청 분배까지 관리 범위를 넓힌 사례다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

래블업, 1인 1에이전트 인프라 비전 발표
AI타임스 · 2026-10-01

래블업이 9월 29일 서울 코엑스에서 연례 기술 컨퍼런스 'lab | up > /conf/6'을 열고 'AI 팩토리' 비전과 1인 1에이전트 시대 실현을 위한 인프라 전략을 발표했다. 2015년 설립된 래블업은 GPU 가상화와 MLOps 기술로 모델 학습·배포를 지원해왔다. 2024년 …

래블업 신정규 대표 “GPU는 몇 장이 아니라 얼마나 뽑아쓰느냐가 중요”
테크42 · 2026-10-01

래블업은 GPU·NPU 클러스터에서 AI 학습·추론을 배치·관리하는 소프트웨어 Backend.AI를 개발하는 기업으로, 분할 GPU 기술과 자체 AI 전용 오케스트레이터 ‘소코반’을 통해 GPU 자원 활용률을 높인다. 신정규 대표는 업스테이지 컨소시엄과 함께 B200 GPU 504장 클…

래블업, AI 인프라 컨퍼런스 '/conf/6' 9월 개최
AI타임스 · 2026-09-09

AI 인프라 관리 기업 래블업이 9월 29일 서울 코엑스에서 연례 기술 컨퍼런스 'lab | up > /conf/6'를 개최한다. 올해로 6회째인 이번 행사는 래블업의 AI 인프라 기술과 연구개발 성과를 공유하고 업계 관계자·개발자들과 기술 과제 및 해결 방안을 논의하는 자리다. 202…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
토큰
언어 모델이 텍스트를 처리할 때 사용하는 최소 단위로, 단어나 단어의 일부, 문장 부호 등을 가리키는 말이다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

ZDNet Korea 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →