IBM於8月26日釋出Granite 4.2系列語言模型,提供3B、8B和30B三種引數規模,均基於約15萬億token從頭訓練,支援最高512,000 token的上下文視窗。該系列模型可在“思考”與“非思考”模式間切換,以控制每個任務的計算量,並設有“低功耗”模式,用於處理簡單查詢時節省資源。所有模型均採用Apache 2.0許可,已在Hugging Face、Ollama、GitHub等平台開放下載。
Granite 4.2系列的一大亮點是8B和30B版本引入了IBM所稱的“agentic RL”訓練方法。通過這種強化學習,模型在真實沙盒環境中自主學會使用工具、編寫並執行程式碼以及搜尋網頁,從而具備原生的智慧體能力。所有模型均支援OpenAI格式的工具呼叫,並可運行於vLLM或SGLang推理框架。IBM公佈的基準測試結果顯示,30B模型在智慧體任務和工具使用測試中表現領先。
與此同時,IBM還發布了Granite Speech 5.0 Turbo CTC語音模型,引數量僅為4.7億,據稱速度是此前Open ASR排行榜領先者的兩倍,每秒可轉錄三小時音訊。這些語音模型同樣採用Apache 2.0許可。
此次釋出正值開源大模型競爭白熱化之際。Meta的Llama系列、Mistral等均以開放權重策略爭奪開發者社群,而IBM Granite系列憑藉寬鬆的Apache 2.0許可(允許商用和修改)和內建智慧體能力,意在吸引企業使用者和AI應用開發者。對於AI產業而言,Granite 4.2的“agentic RL”訓練和工具呼叫支援,可能降低開發者構建自主智慧體應用的門檻,並推動模型在程式碼生成、自動化工作流等場景的落地。
不過,Granite系列在社群影響力和生態豐富度上仍與Llama等主流開源模型存在差距。IBM能否憑藉其在企業服務領域的積累和開放許可策略,在開源社群中佔據一席之地,尚待觀察。對於投資者而言,IBM在AI模型層的持續投入,反映了傳統IT巨頭向AI軟體和服務轉型的決心,其開源策略也可能影響企業AI市場的競爭格局。