估值達156億美元的法律AI獨角獸Harvey,正因算力與呼叫成本失控而調整技術路線。據知情人士透露,Harvey在3月更新AI智慧體後客戶使用量激增,但毛利率從年初的約50%急劇下滑至6月的-50%。面對成本失衡,Harvey選擇加入越來越多軟體企業的行列,轉向開放權重模型生態,其中包括中國開源模型方案。

Harvey總裁兼聯合創始人Gabe Pereyra坦言,直到去年年底,AI應用的效能主要取決於底層模型,而訓練基礎模型極其昂貴,通常由最大的AI實驗室負責,因此像Harvey這樣的公司必須花大價錢購買最好的基礎模型。然而,飛漲的底層API呼叫開銷正將應用層企業逼入牆角。Harvey表示,今年以來其平台的Token消耗量呈幾何級暴漲20倍。團隊高層深知,如果繼續無休止地依賴OpenAIAnthropic的高價模型,公司遲早會被成本拖垮。

今年8月,Harvey推出首款自研模型,其底層由中國大模型開發商月之暗面Kimi K3驅動。據介紹,該模型在效能上逼近Anthropic旗下的頂配方案,而綜合成本僅為其一小部分。據接近該專案的內部人士稱,得益於新模型上線以及對整體AI呼叫架構的精細化重構,Harvey的毛利率現已成功重回正值。

這一轉向並非孤例。醫療科技初創公司Abridge最近宣佈,正在基於輝達的開源架構構建一款適用於臨床環境的定製基礎模型。AI智慧客服獨角獸Decagon透露,目前已有80%的諮詢通過其自有模型處理。在金融科技領域,RampRogo等企業也破天荒試水自主訓練模型;程式設計賽道中,剛被SpaceX收入囊中的Cursor,以及估值高達480億美元Cognition,更是在早期便率先推出了定製化模型。

Ramp聯合執行長Karim Atiyeh表示,雖然此前模型構建對Ramp來說成本過高,但該公司在6月完成7.5億美元融資後,正考慮開展相關工作,因為開放權重模型的效能已大幅提升。他直言,一年前這完全說不通,但現在開始變得很有道理了。面對持續走高的算力支出,正在籌備新一輪融資的Atiyeh警告,如果一家公司到現在還不去思考算力成本、不著手做定向最佳化,那完全是在拿未來冒險。

舊金山早期風投機構Basis Set創始人兼管理合夥人Lan Xuezhao斷言,如果不通過微調專屬模型來最佳化單位成本,從本質上講商業模式就算不上高效。她補充道,如果公司不致力於構建供自身使用的模型,將難以獲得融資。據悉,紅杉資本和General Catalyst等頭部風投機構目前也在力挺這一技術轉向。該路徑不僅為企業卸下沉重的成本包袱,更將核心技術控制權從OpenAI和Anthropic手中奪了回來。

與此同時,Anthropic和OpenAI也在更加積極地進軍初創企業領域。今年兩家公司都在大力招聘,釋出外掛,並在法律、金融和醫療保健等行業推出試點專案。在Anthropic辦公室最近舉辦的一次投資者論壇上,與會者討論了自主構建模型的初創企業日益興起這一現象。據一位知情人士透露,Anthropic在一張關於如何把握價值曲線的幻燈片中提到了Rogo和醫療健康初創公司OpenEvidence等企業,還提到了Harvey在人工智慧領域的內部工作,並提醒道,這家初創公司仍需要依賴Anthropic最先進的模型之一——Claude的Opus——來處理最棘手的任務。

儘管如此,一些初創公司仍擔心,如果這些AI巨頭切斷其訪問許可權,會發生什麼情況。就在SpaceX完成對Cursor的收購僅一週後,OpenAI便宣佈暫停這家程式設計初創公司對其模型的訪問許可權,理由是馬斯克旗下的公司過去曾多次違反OpenAI的服務條款。

相比之下,開放權重模型提供了一種替代方案。OpenAI和Anthropic的封閉式模型將其內部引數嚴加保密,而開放權重模型則會公開這些引數,供外部開發者下載並進行修改,這一過程被稱為後訓練。據兩位知情人士透露,有些公司——如Kimi K3的開發商月之暗面,甚至會派出自己的工程師,幫助客戶將現成的模型微調為定製化的內部模型。

從昔日的寄生巨頭到如今的自立門戶,Harvey等矽谷初創的集體倒戈不僅是應對算力成本危機的自救之舉,更標誌著生成式AI商業格局的深刻裂變。隨著開源生態與自研方案逐漸抹平頂尖模型的技術鴻溝,應用層企業正在重新掌握議價權與生存命脈。對即將邁入二級市場的OpenAI與Anthropic而言,如何在維持高昂研發支出的同時守住商業客戶壁壘,將成為其IPO前夕必須作答的關鍵命題。