AI 云服务商 QumulusAI 于 2026 年 7 月 24 日宣布,已与一家专注于生成式 AI 应用的推理平台提供商签署了一份为期两年的协议,价值超过 3200 万美元,将为其供应基于 英伟达 Blackwell B300 的 GPU 算力。该协议包含续约选项,预计容量将于 2026 年秋季 上线。
这家未公开名称的客户运营着一个为生成式 AI 应用提供快速、可扩展基础设施的平台,服务于运行图像、视频及其他生成式模型的开发者和企业。在这些场景中,速度和可靠性直接决定用户体验。根据协议,QumulusAI 将提供 专用 GPU 集群,确保客户在需求增长时获得稳定、高性能的算力支持。
QumulusAI 首席执行官 Mike Maniscalco 表示,生成式媒体工作负载对推理基础设施构成巨大压力——图像和视频的推理计算密集,且用户体验高度依赖响应速度。他指出,这笔交易反映了公司观察到的趋势:推理客户越来越倾向于寻求可依赖的专用承诺容量,而 QumulusAI 的商业模式正是为此设计,能够快速部署这类容量。
为支持此类大规模生成式媒体工作负载,通常需要持续的专用算力,而非偶发的抢占式现货容量。这种需求动态正体现在像本次协议这样的多年期承诺中。QumulusAI 将利用其在美国的数据中心设施提供容量。该公司采用需求驱动的部署模式,在分布式托管和自建设施网络中寻找可用电力资源,从而将 GPU 容量上线时间从通常的数年缩短至数月。
这笔超过 3200 万美元的两年期协议已计入 QumulusAI 的订单簿。该公司定位为分布式 AI 云平台,通过推理优先、需求驱动的部署模式,在多个数据中心站点间提供高性能 GPU 算力,旨在帮助 AI 团队和企业以更快的速度、更高的灵活性和可控性扩展生产级 AI 工作负载。其模式被视为对传统集中式超大规模云容量限制的一种替代方案。
此次交易也进一步印证了英伟达 Blackwell B300 在推理市场的需求增长。随着生成式 AI 应用从训练转向大规模部署,推理算力正成为新的瓶颈,而长期专用合同的增多表明,云服务商和终端用户正在为这一阶段提前锁定资源。