모델 822건 · 국산 131 · 가격 659 추적 중
파운데이션 모델·LLM

딥시크, 경량 모델 'V4.1 플래시' 출시...KV 캐시 대폭 축소

AI타임스·2026-09-11

요약

딥시크가 장기 실행 AI 에이전트의 병목으로 꼽히는 메모리 사용량을 줄인 경량 모델 '딥시크 V4.1 플래시'를 공개했다. 초대형 컨텍스트 창을 지원하면서도 KV 캐시 사용량을 전작 대비 약 4분의 1 수준으로 낮춘 것이 핵심이다. 딥시크는 10일(현지시간) 새로운 아키텍처 제품군 중 가장 작은 모델로 이를 출시했다고 밝혔다. 오는 14일부터는 기존 '딥시크 V4 프로' API 요청이 V4.1 플래시로 자동 라우팅된다.

큐레이터 노트

원문에 없는 맥락입니다

장기 실행 에이전트는 대화가 길어질수록 메모리 비용이 누적되는데, KV 캐시 축소는 이런 운영 부담을 줄이는 방향의 기술적 개선에 해당한다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

AI 에이전트 결제, '내 승인' 어떻게 증명할까
ZDNet Korea · 2026-10-08

AI 에이전트가 호텔 예약부터 결제까지 대행하는 시대가 되면서, AI가 수행한 거래가 언제 어떤 근거로 이용자 본인의 거래가 되는지에 대한 법적 의문이 제기된다. 법무법인 태평양 AI팀은 메타의 자율형 에이전트 '뮤즈' 등을 예로 들며 위임 범위 설정, 재승인 임계치, 감사 추적 기록,…

지란지교소프트 CAIO "AX는 'AI 직원' 만드는 일"
ZDNet Korea · 2026-10-08

지란지교소프트 박종천 CAIO는 8일 서울 코엑스 AI페스타26 부대행사에서 AI 전환은 시간을 줄이는 자동화가 아니라 스스로 판단하고 필요할 때만 사람을 부르는 'AI 직원'을 만드는 일이라고 말했다. 그는 개인의 AI 활용이 회사 성과로 이어지지 않는 이유로 회사 지식이 개인 PC와…

팀뷰어, AI로 엔드포인트 보안 사전 대응 제안
ZDNet Korea · 2026-10-08

팀뷰어 김도연 상무가 서울 코엑스 'AI 페스타 26' 부대행사 'AIR 쇼케이스'에서 AI 기반 엔드포인트 관리 방법론을 제안했다. 솔루션 간 충돌, 미승인 AI 에이전트 사용, 보안 패치 누락 등으로 발생하는 보안 허점을 지적하며 문제 발생 후 대응하는 방식에서 사전에 예측하고 조치…

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
AI 에이전트
AI 에이전트는 주어진 목표를 달성하기 위해 스스로 계획을 세우고 도구를 호출하며 행동한 결과를 관찰해 다음 행동을 결정하는 AI 시스템을 말한다.
KV 캐시
트랜스포머 기반 언어 모델이 토큰을 하나씩 생성할 때 이미 계산한 어텐션의 키(Key)와 값(Value) 벡터를 저장해 두었다가 다음 토큰 생성 시 재사용함으로써 중복 계산을 없애는 추론 최적화 기법을 말한다.
API
API는 서로 다른 소프트웨어가 기능이나 데이터를 주고받을 수 있도록 정해 놓은 규칙과 창구를 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →