知名AI學者代季峰創立的大模型公司Naive.AI,在成立僅7個多月後釋出了首個開源模型Naive-N0.5-Flash。該模型專為編碼和AI研發場景構建,總引數量為309B,原生支援100萬上下文,AI最佳化推理速度最高可達2000個token/s。值得注意的是,其研發過程由AI模型直接參與——AI負責寫程式碼、執行實驗、監控進度、分析結果並不斷迭代。

據The Information報道,Naive.AI今年以來已完成三輪融資,總融資額達4億美元(約合人民幣27億元),投後估值飆升至14.2億美元(約合人民幣95億元)。投資方陣容包括騰訊、紅杉中國、IDG資本及經緯創投等頭部機構。在正式釋出模型之前,這家公司對外僅展示了一行標語的官網,卻已獲得資本熱捧。

代季峰的履歷橫跨學界與產業界。他於2009年和2014年在清華大學自動化系先後獲得工學學士和博士學位,2022年全職加入清華大學電子工程系擔任副教授。2014年至2019年,他在微軟亞洲研究院視覺組擔任首席研究員、研究經理;2019年至2022年,在商湯科技研究院擔任執行研究總監。MSRA和商湯科技幾乎串起了一部微縮的中國AI創業史——曠視科技、商湯科技、MiniMax、Momenta等公司的創始團隊均與這兩家機構有淵源。

事實上,這已是代季峰的二次創業。2025年,他曾與盛大網路創始人陳天橋聯合成立AI模型公司MiroMind,主攻輕量級小模型,繞開了扎堆預訓練、比拼算力規模的傳統賽道。今年1月末,代季峰離開MiroMind,計劃帶領中國區部分團隊成員獨立成立新公司並尋求融資,Naive.AI正是這一計劃的落點。從產品路線看,Naive.AI延續了MiroMind時期輕巧務實的方向。技術報告顯示,Naive-N0.5-Flash基於開源的小米MiMo-V2.5基礎模型,同時將全域性注意力層替換為DeepSeek稀疏注意力。

Naive.AI很難不讓人聯想到前阿里千問負責人林俊暘創立的p7k。今年初,林俊暘離開千問團隊,8月官宣創業專案p7k,專注研究「數字世界與物理世界中下一代智慧體」。p7k的首輪融資由高榕創投與紅杉中國共同領投,騰訊與上海未來產業基金參投,估值達到約20億美元(約合人民幣134億元)。兩家公司都是大廠離職創業,都繞開了巨頭割據的傳統大模型賽道,主攻應用場景更細分的AI產品,且在產品尚未正式問世前就已收穫紅杉中國、騰訊等頭部機構的資金,估值接近甚至超過百億元。

這種「零產品、先押注」的模式,在矽谷已有先例。OpenAI和Anthropic在成立初期都是純技術信仰驅動,前者2015年成立時定位為非營利AI實驗室,直到2022年才推出ChatGPT;後者2021年成立時立身於AI模型安全研究,兩年後才推出對標GPT的Claude。如今兩家估值都已近萬億美元。據矽谷風投機構Radical Ventures統計,2024年以來,超過40家NeoLab已累計融資逾400億美元。

不過,中美NeoLab的發展畫風存在明顯差異。矽谷專案融資規模更為豪橫:由前OpenAI CTO米拉·穆拉蒂創立的Thinking Machines,成立時種子輪融資高達20億美元,估值120億美元;由前OpenAI首席科學家伊利亞·蘇茨克維創立的Safe Superintelligence(SSI),種子輪融資額為10億美元,估值50億美元。而國內頭部NeoLab專案Naive.AI和p7k,估值與矽谷明星專案仍差幾個身位。今年國內獲得融資的兩家NeoLab——Mind Lab與逆矩陣,融資金額則分別是近5000萬美元與超億美元。

更重要的差別在於務實程度。SSI明確將開發安全的超級智慧作為唯一目標,拒絕傳統AI產品開發路線;Thinking Machines成立18個月後才推出第一款自研開源大模型Inkling。而國內的NeoLab更像是場景更加細分的AI創業公司,產品形態明確,商業化前置。林俊暘在官宣p7k時已明確產品形態是Agent;2025年10月成立的Mind Lab,今年7月已釋出模型產品Macaron V1並同步開始商業化;代季峰的Naive.AI也在公司成立7個多月後釋出了首個開源大模型。這延續了中美AI發展風格的一貫差異——美國更強調基礎模型本身的創新和引數規模拓展,中國則更聚焦產業效率提升與場景落地。對Naive.AI與p7k而言,「實用性」或許將是未來要面對的關鍵考驗指標。