CrusoePerplexity于2026年9月15日宣布达成一项多年期合作,Perplexity将把其AI工作负载整体迁移到Crusoe Cloud上运行。根据协议,Perplexity将在同一平台上完成完整的模型生命周期:一方面利用Crusoe提供的、搭载英伟达GB300 NVL72的专属集群训练前沿模型,并配合英伟达InfiniBand网络方案;另一方面通过Crusoe的托管推理(Managed Inference)服务,把这些模型投入生产环境对外提供服务。

这项合作的一个特别之处在于双向性。除了Perplexity采购算力,Crusoe也将为自身1800名员工引入Perplexity Enterprise Pro与Max,用于网页与内部知识检索、多步骤研究、数据分析以及调用前沿AI模型。也就是说,两家公司既是算力供需关系,也互为产品客户。

Crusoe联合创始人兼CEO Chase Lochmiller表示,动作最快的AI公司需要能覆盖整个模型生命周期、并随业务增长而扩展的基础设施,Perplexity正在构建人们获取答案的未来,Crusoe希望从“第一个电子到最后一个token”都参与其中。Perplexity联合创始人兼CEO Aravind Srinivas则强调,在Perplexity的规模上运行AI,每一毫秒延迟都会被用户直接感知,Crusoe的架构正是围绕高吞吐、低延迟推理这一约束设计的。

英伟达方面,其HPC与AI基础设施解决方案高级总监Dion Harris表示,现代AI需要从研究到部署的统一计算架构,基于GB300 NVL72与InfiniBand的Crusoe Cloud,能让Perplexity以智能体AI所需的速度和效率完成前沿模型的训练、微调与生产部署。

从产业背景看,Crusoe的定位是所谓“AI工厂”公司,强调以能源为先:通过获取大规模电力资源、建设面向AI优化的数据中心,再叠加云平台对外输出算力。这种“能源—数据中心—云”垂直整合模式,与单纯出租GPU的云厂商形成差异,也呼应了当前AI基础设施竞争向电力与机房环节延伸的趋势。

Perplexity方面,公司成立于2022年,最初以AI答案引擎切入搜索,如今定位为AI智能体平台,旗舰产品为Perplexity Computer,一个跨工具、文件、芯片与设备的模型无关智能体编排器。据其披露,Perplexity每月在全球回答超过15亿个问题。对这样一家面向海量实时请求的产品公司而言,推理延迟与吞吐直接决定用户体验,把训练与推理放在同一平台,理论上可以减少模型迭代到上线之间的摩擦。

对关注AI产业链的读者来说,这条消息有几层含义。其一,前沿模型公司正在把训练和推理的算力采购集中到少数具备垂直整合能力的供应商,云服务的竞争点从“有没有GPU”转向“能否覆盖全生命周期并控制成本”。其二,GB300 NVL72这类新一代机架级系统被明确写入合作协议,说明新一代算力平台的商用落地正在推进,对上游芯片、网络与数据中心电力供应链都是需求信号。其三,Crusoe以能源为起点的模式若被更多模型公司接受,可能进一步抬高AI数据中心选址与电力获取在产业竞争中的权重。

需要注意的是,该消息以新闻稿形式发布,属于企业对外披露的合作信息,具体合同金额、算力规模与部署时间表均未公布,实际执行节奏仍有待观察。