DeepSeek 於 7 月 31 日釋出其經濟型模型 V4 Flash 的重大更新“0731”,據 Artificial Analysis 智慧指數,新版得分 50 分,較 4 月釋出的上一版提升 10 分,僅比 OpenAI 的 GPT-5.6 Luna 低 1 分,而單任務成本低約 60%。這一差距在 OpenAI 已降價 80% 的背景下依然顯著,主要得益於 DeepSeek 高達 98% 的緩存摺扣,遠超行業標準的 90%。此外,新版模型 token 使用量較前代減少 12%。

在效能方面,V4 Flash“0731”在所有測試類別上均優於前代,尤其在代理任務上提升最大。在 GDPval 基準(用於測試模型處理複雜真實辦公任務的能力)上,其得分從 1,189 Elo 升至 1,559 Elo,同時幻覺發生率有所下降。模型架構保持不變:總引數量 2840 億,啟用引數 130 億,上下文視窗為 100 萬 token。模型權重已在 Hugging Face 上以 MIT 許可釋出。

這一更新使 DeepSeek 在價效比上佔據領先地位,Artificial Analysis 指數顯示其在價格效能比上位居榜首。對於 AI 產業投資者而言,這標誌著模型層競爭加劇,低成本高效能模型的快速迭代可能壓縮高階模型的溢價空間,同時推動推理算力需求增長。DeepSeek 的開源策略也可能吸引更多開發者採用,進一步影響市場格局。