据模型评测机构Artificial Analysis的数据,中国AI公司深度求索(DeepSeek)于7月31日发布的新旗舰模型DeepSeek-V4-Flash,在运行成本上显著低于同类产品。该模型每百万输入词元(token)收费0.14美元,每百万输出词元收费0.28美元,平均每次测试成本仅为0.03美元。相比之下,月之暗面(Moonshot AI)的Kimi K3为0.86美元,OpenAI的GPT-5.6 Sol为1.86美元,Anthropic的Claude Fable 5则高达3.15美元。DeepSeek-V4-Flash的成本甚至比Claude Fable 5便宜逾百倍。值得注意的是,这一比较不仅考虑标价,还评估了模型实际完成任务所需处理的数据量,因此更能反映真实价值——标榜低成本的模型若需更多步骤才能产出答案,实际成本可能依然很高。
在性能方面,Artificial Analysis的“智慧指数”评测中,DeepSeek-V4-Flash获得满分100分中的50分,该指数涵盖编码、推理和职场模拟等九项基准测试。这一分数与谷歌的Gemini 3.6 Flash持平,仅比Meta的Muse Spark 1.1和智谱AI的GLM-5.2低1分。不过,Kimi K3取得57分,而Claude Opus 5、Claude Fable 5以及GPT-5.6均比DeepSeek-V4-Flash高出至少9分,显示其在性能上仍有差距。
DeepSeek此次发布被视为其“极低成本AI解决方案”的最新尝试,旨在重振市场声势。据路透社报道,消息人士透露DeepSeek已开始筹备首次公开募股(IPO)。此外,该公司还计划推出功能更强大的DeepSeek-V4-Pro版本,但尚未公布发布日期。
从产业角度看,DeepSeek的低成本策略可能对AI模型市场产生深远影响。一方面,它加剧了价格竞争,迫使其他厂商重新考虑定价;另一方面,低成本模型可能降低AI应用的门槛,推动更广泛的行业采用。然而,性能上的差距意味着DeepSeek仍需在能力上追赶头部模型,其IPO进展也将成为市场关注的焦点。