2026-09-10 06:09:53
DeepSeek 今日推出 V4.1 Flash 模型,将 KV 缓存需求降至此前版本的 1/4
据格隆汇消息,DeepSeek 于今日(9月10日)正式推出全新的 V4.1 Flash 模型。作为该公司新架构系列中规模最小的模型,V4.1 Flash 具备原生多模态视觉理解能力。与上一代相比,该模型大幅缩减了 KV Cache 缓冲区的大小,将 HBM(高带宽内存)需求降至四分之一,并将 SSD 需求降至八分之一,从而显著降低基于 Agent 的任务推理成本,因为缓存命中是此类任务的主要成本构成之一。