모델 801건 · 국산 131 · 가격 643 추적 중
AI 인프라·반도체

리벨리온 NPU, SKT AI 서비스 4종에 확대 적용

IT조선·2026-09-21

요약

리벨리온의 NPU가 SK텔레콤의 상용 AI 서비스 4개 핵심 기능에 적용됐다. 기존 에이닷 통화요약에 이어 에이닷 음성합성(스트리밍 TTS), AI 고객센터(AICC), 미끼문자 탐지 서비스 '스캠뱅가드'까지 적용 범위가 확대됐다. SKT 서비스에서 리벨리온 NPU가 처리하는 토큰 수는 하루 40억개에 달한다고 회사 측은 밝혔다.

큐레이터 노트

원문에 없는 맥락입니다

다수 사용자가 쓰는 상용 서비스로 적용처가 넓어졌다는 점에서 국산 NPU의 실제 운영 안정성을 보여주는 사례로 볼 수 있다.

깊이 읽기

이 기사 한 건이 아니라, 같은 사안을 다룬 이 사이트의 기록을 근거로 정리했습니다

이 일이 어디서 왔나

SK텔레콤은 인프라 전담법인부터 자체 모델, 대국민 서비스까지 잇는 AI 풀스택 체계를 구축했다고 밝힌 바 있는데(전자신문, 9월21일), 이번 리벨리온 NPU 확대 적용은 그 풀스택 중 인프라 계층의 구체적 사례에 해당한다. 국산 반도체의 실사용 확대는 망고부스트의 DPU 국산화 시도(9월19일), 네이버클라우드의 국방 소버린 AI 사업(9월18일)과 함께 통신·클라우드 업계 전반에서 나타나는 AI 인프라 자립 흐름과 맞닿아 있다.

짚어야 할 점

  • 리벨리온 NPU가 통화요약 한 기능에서 음성합성·AICC·스캠뱅가드까지 4개 기능으로 넓어진 것은, SKT가 밝힌 AI 풀스택 전략(전자신문, 9월21일)이 실제 상용 서비스 운영으로 이어지고 있다는 신호로 볼 수 있다.
  • 하루 40억개 토큰 처리라는 수치는 회사 측 발표로, SKT 전체 AI 트래픽에서 이 NPU가 차지하는 비중이나 GPU와의 역할 분담 구조는 이 기사만으로는 드러나지 않는다.
  • 망고부스트의 DPU, 네이버클라우드의 국방 소버린 AI와 마찬가지로, 국산 반도체·인프라가 실서비스에 투입되는 사례가 늘고 있다는 점에서 이번 건은 '국산 AI 인프라 자립' 흐름의 한 조각으로 읽힌다.

아직 확인되지 않은 것

  • 리벨리온 NPU가 SKT 전체 AI 인프라(GPU 포함)에서 차지하는 처리량 비중이나 향후 확대 계획은 확인되지 않았다.
  • 토큰 처리량 외에 지연시간, 비용 절감 효과, 장애 이력 등 운영 안정성을 뒷받침할 구체적 성능 지표는 공개되지 않았다.
  • 이번 발표가 SKT와 리벨리온 양측 중 어느 쪽 주도로 나온 것인지, 제3자의 독립적 검증이 있었는지는 나오지 않았다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

GPU 사각지대 메우는 K반도체, AI페스타서 공개
ZDNet Korea · 2026-09-29

초거대 AI 모델 확산으로 GPU 중심 인프라가 전력 소비, 도입 비용, 데이터 전송 병목 등 구조적 한계에 부딪히면서, 10월 6일부터 서울 코엑스에서 열리는 AI페스타에서 국내 반도체·인프라 스타트업 5곳이 대안 기술을 선보인다. 딥엑스와 모빌린트는 클라우드 연결 없이 기기 자체에서…

네이버, 이재명 멕시코 순방 동행…AI 협력 모색
ZDNet Korea · 2026-09-29

네이버 경영진이 이재명 대통령의 멕시코 순방에 동행해 현지 정부 부처 및 기업 관계자들과 연이어 회동하며 AI 협력 방안을 논의했다. 최수연 대표는 멕시코 경제부·과학인문기술혁신부 장관 등을 만나 공공AX 역량과 소버린AI 전략, 엔비디아·브룩필드와 구축 중인 AI 팩토리 사업을 소개했…

SKT·삼성전자·하나금융, 금융권 첫 5G 스마트오피스 구축
AI타임스 · 2026-09-28

SK텔레콤은 하나금융그룹, 삼성전자와 함께 금융권 최초로 5G 특화망 기반 스마트 오피스를 구축했다고 28일 밝혔다. 인천 청라로 이달부터 단계적으로 이전 중인 하나금융그룹 헤드쿼터의 10개 관계사, 임직원 3000여명이 대상이다. 16개 층에 5G 특화망을 적용해 좌석과 유선 연결 제…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
스트리밍
모델이 응답 전체를 다 만들 때까지 기다리지 않고, 생성되는 토큰을 그때그때 순서대로 전송하는 응답 방식을 말한다.
NPU
신경망 연산에 특화된 전용 반도체로, 행렬 곱셈과 병렬 연산을 하드웨어 수준에서 가속해 CPU나 GPU보다 낮은 전력으로 딥러닝 추론을 처리하는 프로세서를 말한다.
토큰
언어 모델이 텍스트를 처리할 때 사용하는 최소 단위로, 단어나 단어의 일부, 문장 부호 등을 가리키는 말이다.

이 분야 브리핑

여러 매체가 함께 다룬 사안을 한 번에

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

IT조선 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →