IBM与AI云平台Together AI于2026年8月11日宣布达成一项为期多年的合作协议,总金额达2.4亿美元。根据协议,IBM将在其IBM Cloud上部署一个基于NVIDIA HGX B300系统的大型集群,预计于2027年第一季度上线,专门用于支持Together AI的开源模型推理服务。这是IBM Cloud上首个专为推理场景构建的大规模集群,并采用NVIDIA Spectrum-X以太网网络。NVIDIA表示,该集群相比前代产品可提供30倍的AI工厂输出能力。

Together AI是一家成立于2022年的AI云服务商,主打“AI原生云”,提供推理、训练、微调智能体工作流等能力。该公司近期完成了8亿美元的C轮融资,估值达到83亿美元,资金将用于扩展其AI原生云。Together AI透露,其推理产品目前每月处理400万亿个token,显示出强劲的增长势头。此次与IBM合作,旨在借助IBM的企业级云能力,提升推理性能和token经济性,帮助企业在扩展AI部署时降低成本。

Together AI首席执行官Vipul Ved Prakash表示,企业既想要前沿模型的性能,又不愿接受闭源模型的高昂价格,这要求底层基础设施必须快速且可靠。他认为,与IBM和NVIDIA的合作将使其能够更快地为更多企业提供生产级推理服务,推动开源AI成为企业的首选。IBM Cloud总经理Alan Peacock则指出,企业正竞相大规模采用智能体AI,IBM与NVIDIA的合作旨在提供可扩展、经济且企业级的AI基础设施。NVIDIA负责HPC和AI基础设施解决方案的高级总监Dion Harris将AI工厂比作电力、电信一样的基础设施,强调此次部署将帮助企业在实时AI服务中实现所需的性能、效率和规模。

此次合作是IBM与NVIDIA长期协作的最新进展。双方此前已在GPU原生数据分析、非结构化数据提取、本地与云端基础设施以及咨询服务等方面取得进展,旨在帮助企业规模化落地AI。通过结合IBM Cloud的混合云环境、NVIDIA GPU与Spectrum-X网络,以及Together AI的推理平台,企业可望获得一个可靠的基础来构建、部署和扩展AI系统。

对于AI产业观察者而言,这笔交易值得关注的点在于:它反映了推理算力需求的快速增长,以及云厂商与AI平台之间合作模式的深化。Together AI选择IBM而非其他云巨头,可能基于对GPU供应速度和成本效益的考量。同时,开源模型的商业化路径正在通过此类合作变得更加清晰。不过,该集群要到2027年才能上线,实际效果仍需时间验证。