VAST Data 于 7 月 24 日宣布与 AMD 扩大技术合作,旨在帮助 AI 云服务商和企业构建并运营大规模高性能 AI 工厂。此次合作的核心是将 VAST 的 AI 操作系统与 AMD 的 6 代 EPYC 处理器Instinct GPU 以及 Pensando Pollara 400 AI 网卡 深度整合,以支持可扩展的训练、推理和智能体工作负载。

随着行业从模型训练转向大规模推理和智能体应用,基础设施需求正在发生根本性变化。VAST Data 全球技术联盟副总裁 John Mao 表示,推理本质上是一个数据问题,成功取决于如何高效地将数据、内存、上下文和计算资源作为统一系统进行管理。为此,VAST 的 DASE 架构 提供了多租户隔离、多协议访问和统一全局命名空间,以简化分布式环境中的数据访问,并提高硬件利用率。

合作的具体内容包括:VAST 将采用 6 代 AMD EPYC 处理器 为其新一代 CBox 和 EBox 平台提供算力,该处理器支持 PCIe Gen-6,可提供两倍于上一代的 I/O 带宽,从而提升文件与对象存储性能。此外,VAST、AMD 与网络公司 DriveNets 共同开发了 AI 基础设施参考架构,该架构结合了 AMD Helios 机架级 AI 基础设施、VAST AI OS 和 DriveNets AI Fabric 网络,为模型训练、推理、强化学习和 KV 缓存工作负载提供部署指南。

在性能优化方面,VAST 与 AMD 扩展了生态合作,与 TensorMesh 和 EmbeddedLLM 等软件创新者合作,加速面向智能体应用的推理架构部署。早期测试显示,在 AMD Instinct MI355X GPU 上,通过 VAST 进行 KV 缓存卸载,在高并发智能体工作负载下,首 Token 延迟降低了 9 倍Token 吞吐量提升了 9.7 倍。这些优化对于实现低延迟、低成本和节能的推理部署至关重要。

合作还涉及自动化的 KV 缓存生命周期管理,利用 VAST 的数据生命周期策略自动过期和删除包含敏感信息的缓存数据,以帮助企业满足合规要求。AMD Pensando Pollara 400 AI 网卡 则为 GPU 与 VAST 存储集群之间的高速数据路径提供支持,通过 NFS over TCP 和 RDMA 协议高效传输数据。

VAST 表示,这些整合方案已在多家领先的 AI 云服务商中得到部署,为全球客户提供基于 AMD 技术的 AI 服务。此次合作反映了 AI 基础设施正从单纯追求算力转向更注重系统级效率和数据管理能力,以适应推理和智能体时代的新需求。