DeepSeek V4.1 Flash正式发布,较前代减少对HBM和SSD的需求

智能应用 2026-09-11 16:19

DeepSeek V4.1 Flash模型近日正式发布,是DeepSeek全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。DeepSeek V4.1 Flash为552B参数的MoE模型,且大幅减少了KV Cache缓存的大小。与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。

简讯快报

更多