모델 828건 · 국산 131 · 가격 665 추적 중
파운데이션 모델·LLM

딥시크, 경량 모델 'V4.1 플래시' 출시...KV 캐시 대폭 축소

AI타임스·2026-09-11

요약

딥시크가 장기 실행 AI 에이전트의 병목으로 꼽히는 메모리 사용량을 줄인 경량 모델 '딥시크 V4.1 플래시'를 공개했다. 초대형 컨텍스트 창을 지원하면서도 KV 캐시 사용량을 전작 대비 약 4분의 1 수준으로 낮춘 것이 핵심이다. 딥시크는 10일(현지시간) 새로운 아키텍처 제품군 중 가장 작은 모델로 이를 출시했다고 밝혔다. 오는 14일부터는 기존 '딥시크 V4 프로' API 요청이 V4.1 플래시로 자동 라우팅된다.

큐레이터 노트

원문에 없는 맥락입니다

장기 실행 에이전트는 대화가 길어질수록 메모리 비용이 누적되는데, KV 캐시 축소는 이런 운영 부담을 줄이는 방향의 기술적 개선에 해당한다.

다른 매체는 이렇게 썼다

같은 사안을 다룬 다른 곳의 보도입니다

메일·예약·쇼핑까지…개인 AI 비서 시대 열린다
IT조선 · 2026-10-08

미국 레딧에는 메타의 개인용 AI 에이전트 '뮤즈'를 활용해 유료 구독을 대신 해지하고 환급을 받거나, 등기우편 발송이 필요한 멤버십 해지 요청서를 작성해 온라인으로 보낸 경험담이 올라왔다. AI가 질문에 답하는 챗봇 수준을 넘어 메일, 예약, 쇼핑 등 현실 세계의 업무를 대신 처리하는…

AWS AgentCore, AI 에이전트 소액 자율결제 지원
AWS ML Blog · 2026-10-08

AWS는 Amazon Bedrock AgentCore의 결제 기능을 통해 AI 에이전트가 모델 추론 등 서비스 이용 비용을 요청 단위로 자동 결제하도록 지원한다고 밝혔다. Incarna는 이 기능을 이용해 x402 프로토콜 기반의 추론 라우터 BlockRun에 건별로 비용을 지불하는 구…

구글, 앱 넘나드는 '통합' 제미나이 업무 에이전트 출시
The Verge AI · 2026-10-08

구글이 목요일 'Gemini at Work' 행사에서 여러 앱과 기기를 넘나들며 백그라운드로 작업하는 '범용' 제미나이 AI 에이전트를 발표했다. 이 도구는 Gemini Enterprise 앱 내에서 제공되며, 사용자는 하나의 인터페이스에서 에이전트와 대화하고 작업을 지시할 수 있다. …

이 사안의 흐름

같은 주제를 다룬 이 사이트의 기록 — 최신순

이 글에 나온 말

용어집 전체 →
AI 에이전트
AI 에이전트는 주어진 목표를 달성하기 위해 스스로 계획을 세우고 도구를 호출하며 행동한 결과를 관찰해 다음 행동을 결정하는 AI 시스템을 말한다.
KV 캐시
트랜스포머 기반 언어 모델이 토큰을 하나씩 생성할 때 이미 계산한 어텐션의 키(Key)와 값(Value) 벡터를 저장해 두었다가 다음 토큰 생성 시 재사용함으로써 중복 계산을 없애는 추론 최적화 기법을 말한다.
API
API는 서로 다른 소프트웨어가 기능이나 데이터를 주고받을 수 있도록 정해 놓은 규칙과 창구를 말한다.

이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.

AI타임스 원문 전체 보기 →

같은 분야의 다른 소식

전체 뉴스 →