7月21日,月之暗面Kimi在北京辦公區舉行媒體交流活動,企業業務負責人黃震昕首次就備受關注的K3大模型及公司後續商業規劃進行全面回應。就在四天前,Kimi官宣釋出全新開源大模型K3,總引數達2.8萬億,具備100萬Token上下文視窗。該模型在測試中綜合智慧水平僅次於Claude Fable 5和GPT-5.6 Sol,馬斯克留言稱“令人印象深刻”,多家外媒和研究機構將其稱為“DeepSeek2.0時刻”。
黃震昕明確表示,K3效能躍升來自底層原創架構創新,並重點介紹了三項自研技術。第一項是MoonClip二階最佳化器,由Kimi首次應用於大模型訓練。黃震昕表示,當前全球可用訓練資料基本見底,這項技術能讓20T訓練資料跑出40T的效果,同等效能下訓練成本、算力功耗直接減半。第二項是KimiLinearTension線性注意力機制,解決了傳統線性注意力處理超長任務時效能衰減的痛點,使得上下文視窗擴大十倍,訓練成本僅同步擴大十倍。第三項是AttentionResiduals(注意力殘差),最佳化多層網路間資訊傳遞,讓2.8萬億超大引數模型在穩定訓練的同時推理效率提升25%。對於馬斯克稱Grok4.5有望超越K3的表態,黃震昕笑稱“拭目以待”。
在回應模型幻覺問題時,黃震昕坦言模型幻覺目前無法完全避免,但“幻覺本質是模型創造力的同源產物”。他表示,模型越強,幻覺比例越低,“K3已是幻覺很少的模型”。他介紹了基於AgentSwarm架構的解決方案:系統會安排三個Agent分別撰寫內容,再由一個專門的“事實校驗員”子Agent逐項校驗資料。但他也承認,幻覺只能降低、無法杜絕,因為從機制來看,模型的幻覺來源也是其創造力來源。
針對K3上線後因算力需求逼近峰值而暫停新會員開放的決定,黃震昕還原了決策時的兩難:放開新使用者註冊會傷害存量付費老使用者體驗;優先保障付費客戶則需限制新註冊。公司選擇了後者。“寧可暫時放棄新增收入,也要守住付費客戶的使用體驗底線。這是公司的價值觀。”他說道。對於後續何時重新開放新會員註冊,他表示公司正通過模型效能最佳化和算力供給儘快解決問題,但目前尚未有明確時間表。
在開源與閉源路線之爭上,黃震昕表示開源與閉源並非對立關係,二者與模型質量高低並無繫結關係。他進一步強調,開源模型本身也意味著商業回報上的低價。“我們擺脫了‘開源模型就是要做便宜的、低價的’這樣的印象。我們在全球市場上真正做出了SOTA級別的模型,定價不是朝便宜去定的。K3在全球範圍內供不應求。”他透露,Kimi自K2起持續堅持開源路線,這一路線未來不會改變,核心底層技術與論文均對外公開。
商業化策略方面,黃震昕透露Kimi現階段不提供私有化部署服務,商業模式對標海外成熟頭部AI企業,核心發力打磨模型基礎能力。收入結構中API業務佔比最高,約70%,主要來自資料平台類客戶。此前截至6月中旬,月之暗面ARR(年度經常性收入)突破3億美元,這是繼今年3月突破1億美元、5月突破2億美元后的又一重要節點。黃震昕同時透露了Kimi長期的產品“審美”取向:不佈局娛樂、文生圖、文生影片賽道,長期聚焦程式設計、金融、法律、科學研究等高難度生產力場景。對於引數規模是否持續增長,他給出肯定回答:“大模型引數規模會持續向上拓展,不會止步於當前2.8萬億規模。”