查看: 6|回复: 0

DeepSeek V4.1 Flash 发布:性能超越 V4 Pro,KV Cache 暴降且价格下调

[复制链接]
发表于 3 小时前 来自手机 | 显示全部楼层 |阅读模式
深度求索(DeepSeek)于9月10日正式推出了全新的 DeepSeek-V4.1-Flash 模型。作为一款主打高性价比、高推理速度和超低成本的轻量级模型,它不仅在设计上采用了全新的架构,在多项核心评测和实际开发场景中,性能更是直接超越了自家的旗舰模型 V4 Pro。

核心亮点:552B 参数与全新 MoE 结构

DeepSeek-V4.1-Flash 是一个 552B 参数的混合专家(MoE)模型,采用了全新的因果编码器-解码器(Causal-Encoder-Decoder)结构。其最大特点是输入和输出不对称:输入激活仅为 8B,输出激活为 16B。这种设计让它在推理速度上有了质的飞跃,同时大幅降低了推理成本。

性能跑分:全面超越 V4 Pro

根据多方测试数据,V4.1 Flash 在代码生成、系统操作和智能体(Agent)任务上表现极为亮眼:

代码能力:在 Codeforces 评测中拿到了 3471 分,超越了 V4 Pro 的 3348 分。

工程与实践:在 DeepSWE v1.1(代码修复)中取得了 74.2 的高分,在 Terminal-Bench 3.0 中也达到了 30.0 分,均处于行业第一梯队,甚至优于部分超大杯模型。

多模态支持:模型原生支持多模态视觉理解,无需额外外挂组件。

极致的成本优化:KV Cache 大幅压缩

对于开发者而言,V4.1 Flash 最硬核的技术突破在于对 KV Cache 的极致压缩。

它的 Global KV Cache 每 Token 占用降低到了 890 Bytes。

相比上一代 V4 Flash,显存(HBM)需求减少到了 1/4,SSD 存储需求减少到了 1/8。

这意味着在 Agent 开发等高度依赖缓存的场景中,运行成本被大幅度压缩。

API 价格下调:闲时最低 0.02 元

得益于底层架构的优化,DeepSeek 同步下调了该模型的 API 调用价格,并继续实行峰谷定价策略:

空闲时段(含周末及工作日非高峰期):缓存命中输入低至 0.02 元/百万 Tokens,未命中为 1.0 元,输出为 4.0 元。

高峰时段:缓存命中输入为 0.04 元/百万 Tokens,未命中为 2.0 元,输出为 8.0 元。

行业动态

目前,腾讯(WorkBuddy、CodeBuddy)和 OpenCode 等官方合作伙伴已经全量接入 DeepSeek-V4.1-Flash。此外,官方宣布将从9月14日起,有序下线旧的 V4 Pro 模型,相关请求将自动路由至性能更强、成本更低的 V4.1 Flash。对于有 API 接入需求的开发者来说,这绝对是一个降低成本、提升体验的好消息。

scaled_1000148562.webp
scaled_1000148561.webp
万狸温馨提示:理性消费
1.数码选品:先定用途,再比参数,拒绝 “加点钱更好” 的超支诱惑。
2.购车决策:看平台生命周期,算长期使用成本,刚需比潮流更重要。
3.重点提醒:多查真实评价,少信首发噱头,买得对远比买得新划算。
4.交流准则:聊产品讲实际体验,不抬杠不诋毁品牌,友善分享。
5.氛围维护:遇到分歧先理性沟通,不贴“粉黑”标签,温馨交流。
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注QQ群
手机版|小黑屋|万狸社区-免费活跃数码论坛,手机/电脑/汽车+旅游美食游戏兴趣社区

相关侵权、举报、投诉及建议等,请发 E-mail:572109352@qq.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|桂ICP备16003785号

在本版发帖
客服QQ:572109352
QQ客服返回顶部