모델 803건 · 국산 131 · 가격 645 추적 중
멀티모달

리퀴드 AI, 추측적 디코딩으로 VLM 추론 가속

AI타임스·2026-09-28

요약

리퀴드 AI가 소형 초안 모델이 먼저 여러 토큰을 예측하고 대형 모델이 이를 한꺼번에 검증하는 '추측적 디코딩' 기법을 비전-언어 모델(VLM)에 적용한 '디스파크(DSpark)'를 공개했다. 기존에 텍스트 생성 위주로 쓰이던 추측적 디코딩을 시각 정보 처리가 결합된 멀티모달 영역으로 확장해 추론 속도를 높였다는 점이 특징이다. 리퀴드 AI는 9월 24일(현지시간) 'LFM2.5-VL-3B' 모델을 위한 실험용 초안 모델 'LFM2.5-VL-3B-디스파크'를 공개했다.

큐레이터 노트

원문에 없는 맥락입니다

기존 대형 모델 자체를 수정하지 않고 별도의 초안 모델을 덧붙이는 방식이어서, 추측적 디코딩이 텍스트뿐 아니라 이미지 입력을 다루는 모델에도 적용될 수 있음을 보여주는 사례다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

ETRI, AI·피지컬AI 등 5대 분야에 3년 집중투자
ZDNet Korea · 2026-09-30

박세웅 ETRI 원장이 취임 4개월 기자간담회에서 국가임무 중심 연구기관으로의 전환을 선언했다. 임무형 연구 비중을 현재 22%에서 2030년까지 90% 수준으로 끌어올리고, AI·피지컬 AI·입체통신·공간결합·AI디지털전환(ADX) 5대 분야에 역량을 집중한다. AI 분야에서는 멀티모…

퀄컴·리퀴드AI, 기기 넘나드는 에이전틱 AI 맥락 공유 공개
IT조선 · 2026-09-25

퀄컴과 리퀴드 AI는 9월 23일(현지시각) 미국 하와이 마우이에서 열린 스냅드래곤 서밋 2026에서 '리퀴드 컨텍스트 온 스냅드래곤'을 공개했다. 이는 스마트폰과 PC, 웨어러블, 자동차 등 여러 디바이스 간 사용자 맥락을 공유해 AI 에이전트가 선제적으로 작업을 수행할 수 있게 하는…

영상·음성·음악까지…콘텐츠 제작 바꾸는 특화 AI
IT조선 · 2026-09-24

유튜브, 인스타그램, 틱톡 등에서 AI로 만든 그래픽과 내레이션이 들어간 영상, AI가 제작한 음악을 흔히 볼 수 있게 됐다. 카페나 음식점에서도 저작권료 부담을 줄이기 위해 AI 음악을 트는 경우가 늘고 있다. 챗GPT나 클로드처럼 언어 중심의 범용 AI만으로는 이런 영상·음성·음악 …

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
멀티모달
텍스트뿐 아니라 이미지, 음성, 영상 등 여러 종류의 데이터를 함께 이해하거나 생성할 수 있는 AI 모델의 특성을 말한다.
추론
추론(Inference)은 학습이 끝난 인공지능 모델이 새로운 입력을 받아 예측이나 답변 같은 출력을 만들어내는 과정을 말한다.
토큰
언어 모델이 텍스트를 처리할 때 사용하는 최소 단위로, 단어나 단어의 일부, 문장 부호 등을 가리키는 말이다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →