據模型評測機構Artificial Analysis的資料,中國AI公司深度求索(DeepSeek)於7月31日釋出的新旗艦模型DeepSeek-V4-Flash,在執行成本上顯著低於同類產品。該模型每百萬輸入詞元(token)收費0.14美元,每百萬輸出詞元收費0.28美元,平均每次測試成本僅為0.03美元。相比之下,月之暗面(Moonshot AI)的Kimi K3為0.86美元,OpenAI的GPT-5.6 Sol為1.86美元,Anthropic的Claude Fable 5則高達3.15美元。DeepSeek-V4-Flash的成本甚至比Claude Fable 5便宜逾百倍。值得注意的是,這一比較不僅考慮標價,還評估了模型實際完成任務所需處理的資料量,因此更能反映真實價值——標榜低成本的模型若需更多步驟才能產出答案,實際成本可能依然很高。
在效能方面,Artificial Analysis的“智慧指數”評測中,DeepSeek-V4-Flash獲得滿分100分中的50分,該指數涵蓋編碼、推理和職場模擬等九項基準測試。這一分數與谷歌的Gemini 3.6 Flash持平,僅比Meta的Muse Spark 1.1和智譜AI的GLM-5.2低1分。不過,Kimi K3取得57分,而Claude Opus 5、Claude Fable 5以及GPT-5.6均比DeepSeek-V4-Flash高出至少9分,顯示其在效能上仍有差距。
DeepSeek此次釋出被視為其“極低成本AI解決方案”的最新嘗試,旨在重振市場聲勢。據路透社報道,訊息人士透露DeepSeek已開始籌備首次公開募股(IPO)。此外,該公司還計劃推出功能更強大的DeepSeek-V4-Pro版本,但尚未公佈釋出日期。
從產業角度看,DeepSeek的低成本策略可能對AI模型市場產生深遠影響。一方面,它加劇了價格競爭,迫使其他廠商重新考慮定價;另一方面,低成本模型可能降低AI應用的門檻,推動更廣泛的行業採用。然而,效能上的差距意味著DeepSeek仍需在能力上追趕頭部模型,其IPO進展也將成為市場關注的焦點。