DeepSeek发布最小尺寸多模态模型,内存占用锐减四分之三

9月10日,DeepSeek正式发布其全新模型系列中的最小规格产品——DeepSeek V4.1 Flash,该模型首次集成原生多模态视觉理解功能,标志着公司在轻量化与多功能融合方面取得关键进展。

缓存架构革新,显存与存储需求同步压降

新一代模型在核心缓存机制上实现突破,相较于前代,KV Cache容量缩减至原有水平的四分之一,对高带宽内存(HBM)的需求下降至1/4,同时对固态硬盘(SSD)的依赖减少至1/8,有效缓解了大规模推理场景下的资源瓶颈。

Agent任务成本显著优化,部署效率大幅提升

在智能体(Agent)应用场景中,缓存命中率直接影响运行开销。此次对KV Cache的深度压缩,使得相关任务的缓存调用成本大幅降低,为长期运行的自动化代理系统提供了更具经济性的部署方案。