关于ZAKER Skills 合作
手机中国 1小时前

DeepSeek V4.1-Flash 代理与编码速度超越 GPT-5.6 Sol

【CNMO 科技消息】DeepSeek 近日发布新一代 AI 模型 V4.1-Flash。按照官方介绍,V4.1-Flash 虽然总参数规模和激活参数均低于 V4-Pro,但在性能、推理速度和成本控制方面表现更突出,尤其在智能体和编程相关任务上,部分基准测试成绩超过 V4-Pro 以及 GPT-5.6 Sol 等部分前沿模型。

DeepSeek

CNMO 科技注意到,V4.1-Flash 采用专家混合架构,总参数为 5520 亿,输入阶段激活参数为 80 亿,输出阶段为 160 亿。相比之下,上一代 V4-Flash 总参数为 2840 亿,V4-Pro 总参数则达到 1.6 万亿。该模型的一项重点改进是大幅压缩 KV 缓存,缓存占用降至每个 token 约 890 字节,同时输出速度达到每秒约 214.4 个 token,首个 token 响应时间为 1.13 秒。独立评测机构 AA 给出了 " 速度显著较快 " 的评价。

在性能方面,DeepSeek 称,V4.1-Flash 在高推理强度设置下,于终端操作、代码修复和自动化任务等测试中领先于 GPT 5.6 Sol 和 Claude Opus 5。不过在更广泛的高难度通用推理任务中,该模型成绩相对一般。AA 数据显示,V4.1-Flash 的综合智能指数为 40 分,高于多数同类开源权重模型中位水平,但仍低于头部前沿模型。需要注意的是,AA 近期升级了评测体系,整体评分标准明显收紧,不少高分模型的分数也出现下调。

价格方面,AA 数据显示,V4.1-Flash 每 100 万输入 token 价格为 0.3 美元,每 100 万输出 token 价格为 1.2 美元,综合成本约 0.184 美元,低于同档模型中位数。若命中缓存,价格可进一步降至每 100 万 token 0.006 美元。AA 同时指出,该模型回答偏长,评测中输出 token 总量明显高于同类模型,可能对实际使用中的时间和费用带来影响。

技术层面,V4.1-Flash 引入名为 CED 的新结构,将 40 层 Transformer 拆分为 20 层因果编码器和 20 层解码器,减少传统交叉注意力带来的重复计算,并结合 CSA2、FP4 量化等方法压缩缓存与内存占用。

整体来看,DeepSeek 此次更新重点放在智能体执行、代码能力和部署成本优化上。

相关阅读

最新评论

没有更多评论了

觉得文章不错,微信扫描分享好友

扫码分享

热门推荐

查看更多内容

企业资讯

查看更多内容