英伟达于2026年8月24日发布Scale-In网络基础设施,作为其AI网络架构的第五大支柱,旨在为智能体AI工厂提供加速、安全且统一的南北向访问。该架构由BlueField-4 DPU、DOCA软件和Spectrum-X以太网共同驱动,将网络、存储与安全功能从主机CPU卸载,以应对多太比特级带宽下的数据流处理需求。
传统云基础设施为可预测的通用工作负载设计,而智能体AI工厂需连接多样化用户、智能体、应用、数据源与存储系统,每台服务器需处理多太比特级带宽,因此专用DPU处理成为必需。Scale-In将南北向网络演进为AI工厂的协调基础设施域,通过BlueField-4提供主机无关的加速与卸载,DOCA提供统一编程与运维模型,Spectrum-X以太网提供高性能连接,确保安全、数据访问与运维不成为AI计算扩展的瓶颈。
Scale-In是英伟达AI网络五大支柱之一,其余包括:Scale-Up(NVLink连接GPU)、Scale-Out(Spectrum-X与Quantum InfiniBand连接服务器)、Scale-Across(Spectrum-XGS连接分布式AI工厂)、Context Memory(CMX提供共享KV缓存存储)。Scale-In专注于加速AI计算周边的访问、安全、数据移动与基础设施运维,与CMX互补,后者提供pod级共享KV缓存以提升推理效率。
BlueField-4支持高达800 Gb/s的吞吐量,将策略执行、存储访问、安全与遥测等基础设施服务从主机CPU卸载,实现租户隔离、运行时威胁检测、高效存储虚拟化与全局可观测性。这些功能随AI工作负载与数据需求扩展,确保共享AI基础设施的安全与高效。英伟达表示,Scale-In使运营商能对AI工厂的访问、数据移动、安全、配置与可观测性进行一致控制,满足智能体AI时代对基础设施的更高要求。
该架构的推出反映了AI工厂对基础设施加速与协同设计的迫切需求,传统软件定义网络与弹性已不足以支撑大规模智能体交互。Scale-In通过将基础设施功能整合为统一域,为AI工厂的规模化部署提供了更可靠的性能保障,对依赖大规模加速计算与数据访问的AI产业链上下游企业具有重要参考价值。