DeepSeek 于 7 月 31 日发布其经济型模型 V4 Flash 的重大更新“0731”,据 Artificial Analysis 智能指数,新版得分 50 分,较 4 月发布的上一版提升 10 分,仅比 OpenAI 的 GPT-5.6 Luna 低 1 分,而单任务成本低约 60%。这一差距在 OpenAI 已降价 80% 的背景下依然显著,主要得益于 DeepSeek 高达 98% 的缓存折扣,远超行业标准的 90%。此外,新版模型 token 使用量较前代减少 12%。
在性能方面,V4 Flash“0731”在所有测试类别上均优于前代,尤其在代理任务上提升最大。在 GDPval 基准(用于测试模型处理复杂真实办公任务的能力)上,其得分从 1,189 Elo 升至 1,559 Elo,同时幻觉发生率有所下降。模型架构保持不变:总参数量 2840 亿,激活参数 130 亿,上下文窗口为 100 万 token。模型权重已在 Hugging Face 上以 MIT 许可发布。
这一更新使 DeepSeek 在性价比上占据领先地位,Artificial Analysis 指数显示其在价格性能比上位居榜首。对于 AI 产业投资者而言,这标志着模型层竞争加剧,低成本高性能模型的快速迭代可能压缩高端模型的溢价空间,同时推动推理算力需求增长。DeepSeek 的开源策略也可能吸引更多开发者采用,进一步影响市场格局。