返回快讯列表
大模型前沿

DeepSeek-V4-Flash 正式版上线:Agent 能力“突变”,价格仅为顶尖模型零头

DeepSeek 7 月 31 日发布 V4-Flash 正式版公测,九项智能体与代码基准全面超过 V4-Pro 预览版,参数仅为其六分之一,8 月 2 日登录国家超算互联网。

DeepSeek 于 7 月 31 日在 API 文档更新中低调发布 V4-Flash 正式版(V4-Flash-0731)公测。据 21 世纪经济报道,该模型结构与预览版一致,仅重新做了后训练,但代码与智能体能力实现“突变式”提升:官方披露其在九项智能体与代码基准上全部超过自家 1.6 万亿参数的 V4-Pro 预览版,其中 DeepSWE 基准分差达 41.6 分,ALE 基准与 Claude Opus 4.8 仅差半分,而总参数只有 Pro 版的六分之一。

定价是另一个引爆点:V4-Flash 正式版每百万 token 输入(缓存未命中/命中)与输出分别为 0.14、0.0028、0.28 美元,较 Claude Opus 4.8 便宜数十至上百倍。8 月 2 日,国家超算互联网宣布 V4-Flash 正式版上线,面向企业与开发者开放 API 调用及模型文件。DeepSeek-V4-Pro 正式版预计将尽快发布。

选型视角:V4-Flash 证明“重工程优化”路线正在与“堆参数”路线分庭抗礼。对智能体与代码类应用,它的性价比意味着可以在成本约束下大幅扩大调用量;但需注意正式版仍处于公测阶段,生产环境建议先小流量灰度并保留回退方案。

更多快讯