딥시크, 경량 모델 'V4.1 플래시' 출시...KV 캐시 대폭 축소
요약
딥시크가 장기 실행 AI 에이전트의 병목으로 꼽히는 메모리 사용량을 줄인 경량 모델 '딥시크 V4.1 플래시'를 공개했다. 초대형 컨텍스트 창을 지원하면서도 KV 캐시 사용량을 전작 대비 약 4분의 1 수준으로 낮춘 것이 핵심이다. 딥시크는 10일(현지시간) 새로운 아키텍처 제품군 중 가장 작은 모델로 이를 출시했다고 밝혔다. 오는 14일부터는 기존 '딥시크 V4 프로' API 요청이 V4.1 플래시로 자동 라우팅된다.
큐레이터 노트
원문에 없는 맥락입니다
다른 매체는 이렇게 썼다
같은 사안을 다룬 다른 곳의 보도입니다
미국 레딧에는 메타의 개인용 AI 에이전트 '뮤즈'를 활용해 유료 구독을 대신 해지하고 환급을 받거나, 등기우편 발송이 필요한 멤버십 해지 요청서를 작성해 온라인으로 보낸 경험담이 올라왔다. AI가 질문에 답하는 챗봇 수준을 넘어 메일, 예약, 쇼핑 등 현실 세계의 업무를 대신 처리하는…
AWS는 Amazon Bedrock AgentCore의 결제 기능을 통해 AI 에이전트가 모델 추론 등 서비스 이용 비용을 요청 단위로 자동 결제하도록 지원한다고 밝혔다. Incarna는 이 기능을 이용해 x402 프로토콜 기반의 추론 라우터 BlockRun에 건별로 비용을 지불하는 구…
구글이 목요일 'Gemini at Work' 행사에서 여러 앱과 기기를 넘나들며 백그라운드로 작업하는 '범용' 제미나이 AI 에이전트를 발표했다. 이 도구는 Gemini Enterprise 앱 내에서 제공되며, 사용자는 하나의 인터페이스에서 에이전트와 대화하고 작업을 지시할 수 있다. …
이 사안의 흐름
같은 주제를 다룬 이 사이트의 기록 — 최신순
- 2026-10-07디노티시아, VDPU로 AI 데이터 검색 병목 해소 추진ZDNet Korea
- 2026-09-24딥시크, 에이전트 학습용 인프라 'DSec' 공개AI타임스
- 2026-09-24딥시크, AI 에이전트 훈련용 샌드박스 시스템 공개IT조선
- 2026-09-09딥시크, 백엔드 엔지니어 150명 대규모 채용AI타임스
- 2026-10-086만8000명 모인 AI 페스타, K-AI 존재감 알렸다ZDNet Korea
이 글에 나온 말
이 페이지는 원문을 요약·재서술하고 이 사이트가 쌓은 기록을 덧붙인 큐레이션입니다. 원문 본문은 싣지 않으며, 수치와 표기는 원문 기준을 유지했습니다.
같은 분야의 다른 소식
- 오픈AI, 맞춤형 화면 생성 GPT-6 챗GPT 전체 적용AI타임스 · 2026-10-08
- 오픈AI, GPT-6 출시…챗GPT에 인텔리전트 UI 도입ZDNet Korea · 2026-10-08
- 챗GPT GPT-6, 질문별 맞춤 화면 '인텔리전트 UI' 도입전자신문 SW · 2026-10-07
- 앤트로픽, 소형 모델 '클로드 하이쿠 5.5' 공개AI타임스 · 2026-10-07
- 미스트랄, 1조 매개변수 모델 '르 총크' 공개바이라인네트워크 · 2026-10-07
- 투모로로보틱스, 로봇 AI '하빌리스 브레인 0' 공개전자신문 SW · 2026-10-07