IBM于8月26日发布Granite 4.2系列语言模型,提供3B、8B和30B三种参数规模,均基于约15万亿token从头训练,支持最高512,000 token上下文窗口。该系列模型可在“思考”与“非思考”模式间切换,以控制每个任务的计算量,并设有“低功耗”模式,用于处理简单查询时节省资源。所有模型均采用Apache 2.0许可,已在Hugging Face、Ollama、GitHub等平台开放下载。

Granite 4.2系列的一大亮点是8B和30B版本引入了IBM所称的“agentic RL”训练方法。通过这种强化学习,模型在真实沙盒环境中自主学会使用工具、编写并运行代码以及搜索网页,从而具备原生的智能体能力。所有模型均支持OpenAI格式的工具调用,并可运行于vLLMSGLang推理框架。IBM公布的基准测试结果显示,30B模型在智能体任务和工具使用测试中表现领先。

与此同时,IBM还发布了Granite Speech 5.0 Turbo CTC语音模型,参数量仅为4.7亿,据称速度是此前Open ASR排行榜领先者的两倍,每秒可转录三小时音频。这些语音模型同样采用Apache 2.0许可。

此次发布正值开源大模型竞争白热化之际。Meta的Llama系列、Mistral等均以开放权重策略争夺开发者社区,而IBM Granite系列凭借宽松的Apache 2.0许可(允许商用和修改)和内置智能体能力,意在吸引企业用户和AI应用开发者。对于AI产业而言,Granite 4.2的“agentic RL”训练和工具调用支持,可能降低开发者构建自主智能体应用的门槛,并推动模型在代码生成、自动化工作流等场景的落地。

不过,Granite系列在社区影响力和生态丰富度上仍与Llama等主流开源模型存在差距。IBM能否凭借其在企业服务领域的积累和开放许可策略,在开源社区中占据一席之地,尚待观察。对于投资者而言,IBM在AI模型层的持续投入,反映了传统IT巨头向AI软件和服务转型的决心,其开源策略也可能影响企业AI市场的竞争格局。