字節跳動創始人張一鳴罕見打破沉默,為大模型研發定下新基調。據《The Information》8月5日報道,在7月舉行的Seed全員會上,張一鳴明確要求,即使Seed暫時落後,也不能依賴蒸餾其他公司的前沿模型來提升能力。這一表態正值中國大模型競爭白熱化之際,被視為位元組在AI戰略上的一次重要轉向。
蒸餾,即讓自家模型學習更強模型的輸出,是快速縮小差距的常用手段。張一鳴主動堵上這條捷徑,意味著位元組選擇了一條更艱難但更自主的路線。據參會員工透露,張一鳴表示,為了實現長遠目標,願意犧牲一些短期利益。他還提到,不希望Seed習慣站在別人鋪好的路上,因為蒸餾雖能幫助團隊接近已有目標,卻難以指引下一個目標的方向。
8月6日,字節跳動CEO梁汝波在年中全員會上回應了外界猜測。他承認,位元組的大語言模型目前確實落後,與海外領先模型的差距還在擴大。但對於“外部壓力迫使位元組堅持自研”的解釋,梁汝波直接以“瞎猜”回應,強調真正的原因是希望團隊學會延遲滿足,把基本功打牢。
張一鳴的禁令不僅針對美國模型。據國內媒體報道,位元組內部對利用其他開源模型進行蒸餾同樣嚴格限制,甚至通過API檢測等方式加強管控。這顯示出位元組在自研路線上的決心。
與此同時,位元組在AI領域的投入持續加碼。8月7日,《金融時報》披露,位元組正在預訓練一個引數規模最高可能達到10萬億的新模型,超過Kimi K3的三倍。專案仍處早期,最終規模未定,但動作之大已引發關注。
位元組的AI業務已形成多線佈局。影片模型Seedance是當前優勢領域,7月31日釋出的Seedance 2.5可一次生成30秒影片,並支援最多50個素材參考,已開始應用於工業、汽車和機器人場景。豆包則在使用者端表現強勁,QuestMobile資料顯示,截至2026年3月,豆包月活達3.45億,超過千問(1.66億)和DeepSeek(1.27億)之和。豆包大模型日均Token呼叫量從2024年5月的1200億增長至2026年6月的180萬億,兩年多增長1500倍。今年6月,豆包開始試水付費訂閱,月費68元至500元不等。
然而,張一鳴真正關注的是更底層的能力。梁汝波在年中會上指出,大語言模型與海外領先模型的差距在擴大,位元組選擇繼續加碼。在Coding和世界模型兩個方向,位元組也在加速佈局。Coding能力直接影響Agent的上限,但位元組目前尚未形成領先優勢,正推動內部業務更多使用Seed模型以建立“使用-反饋-訓練”的飛輪。世界模型方面,位元組2025年才小範圍組建團隊,2026年目標是對標Google Genie 3,但內部評測顯示綜合性能距離全球領先水平還有約10%的差距。
張一鳴的決策背後,是位元組對AI長期主義的重新定位。從2012年今日頭條的推薦引擎,到如今的大模型前沿,位元組曾靠“大力出奇跡”後來居上。但面對AI最前沿的未知問題,張一鳴希望位元組能自己寫下答案,而非跟隨他人。為此,位元組已開始調整組織機制,例如2025年初引入原Google DeepMind研究副總裁吳永輝負責Seed基礎研究,並啟動Seed Edge計劃,為長期課題提供單獨算力支援,取消季度OKR和半年考核。吳永輝還推動資訊共享,鼓勵研究員發表論文,這些變化都在為Seed增加耐心。
張一鳴的這次定調,不僅關乎位元組自身的技術路線,也可能影響中國大模型產業的競爭格局。在蒸餾與自研之間,位元組選擇了後者,這或許預示著行業從快速追趕轉向深耕基礎的階段。