6月30日,美團正式釋出並宣佈開源新一代基礎大模型LongCat-2.0(中文名“龍貓2.0”),總引數量達到1.6萬億。這是國內首個基於5萬張國產AI晶片叢集完成預訓練及推理全流程的大型語言模型,標誌著國產算力在超大規模模型訓練上的工程化突破。
LongCat-2.0此前曾以“Owl Alpha”為代號在OpenRouter等平台進行灰度測試。在技術架構上,該模型在超過5萬張國產AI晶片叢集上完成了30萬億Token的預訓練,主要採用了稀疏注意力與動態啟用機制。推理階段單次Token平均啟用引數約480億,這種設計旨在處理常規指令時減少高能耗計算節點的呼叫,從而壓降單次互動的視訊記憶體佔用和推理成本。
在模型能力側,LongCat-2.0被明確設定為側重智慧體工作負載。它從零開始預訓練,原生支援1M超長上下文,架構設計使其在真實的Agentic Coding任務中能更高效地完成程式碼理解、生成與執行。在主流Agent與程式碼生成評測中,其主要優勢指向自動化工作流和程式碼理解。目前,該模型已相容Claude Code、OpenClaw等主流開發工具介面,表明美團試圖在長文本和程式碼生成維度尋找更確定的落地場景。
此次釋出背後,是美團自2023年起推進的國產算力適配戰略。在海外高階GPU獲取受限的市場環境下,5萬卡國產叢集成功支撐萬億模型從零預訓練,驗證了底層的運算元適配、通訊庫異常處理與流水線排程能力已達到商用標準。萬卡以上級別叢集的核心壁壘在於節點協同與系統糾錯,能在該規模上完成全流程訓練,意味著國產硬體在超大規模AI訓練中的工程可用性得到實證。對企業而言,擺脫對單一海外硬體供應商的依賴,可在未來的資本支出結構和算力採購上獲得一定的成本調控空間。
在新模型釋出前,美團近期在內部成立了AI Transformation部門,反映出其對大模型的預期正從技術探索轉向業務流的實質改造。將側重智慧體和程式碼能力的LongCat-2.0置入實際業務鏈條,預期的影響路徑主要集中於兩點:其一,內部研發端的結構性降本,通過接入各類開發工具,模型衍生的AI程式碼助手與SQL資料分析智慧體可直接縮減後端開發與資料查詢的人力與時間消耗;其二,業務流的自動化排程,美團主營的同城物流與本地生活業務涉及高頻的商戶與騎手互動,1M超長上下文結合原生的工具呼叫能力,可用於處理多維度的排程指令分發與自動化客訴流轉,嘗試進一步攤薄單均履約成本。
整體來看,LongCat-2.0的釋出是一次基於現有國產算力底座和業務需求的工程化交付。在行業算力投入持續擴大的週期內,美團試圖通過架構調整壓降推理成本,並以智慧體編碼作為切口推進內部提效。該模型後續的財務表現,仍需考察其在美團高併發真實業務中,能否兌現預期的開發降本與運營增效指標。