【DeepSeek V4.1 Flash 模型正式发布】财联社 9 月 10 日电,DeepSeek 正式发布 DeepSeek V4.1 Flash 模型。这是公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。据介绍,新一代模型大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。在 Agent 使用场景中,缓存命中的费用往往占比较高,对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。
财联社-深度
16分钟前
DeepSeek V4.1 Flash 模型正式发布
相关标签