NVIDIA與微軟正在讓個人AI代理成為 Windows PC 的原生能力。雙方在最新的開發者日上公佈了一套端到端工具,使創作者和開發者能夠在搭載RTX GPU的Windows裝置上構建、最佳化並執行AI代理,無需依賴雲端 API。

這套工具鏈的核心是將微軟的ONNX Runtime、DirectML後端與NVIDIA的CUDA和TensorRT加速深度整合。開發者既可以使用微軟的AI Toolkit將來自Hugging Face或Azure的模型轉換為針對RTX GPU最佳化的格式,也可以通過NVIDIA NIM微服務快速部署本地化代理。在量化、剪枝等技術的加持下,即使是130億引數級別的大模型也能流暢執行在消費級顯示卡上。目前,包括主流的程式碼生成、影片編輯、內容總結等代理場景均已得到演示支援。

此前,微軟已推出Copilot+PC的概念,而此次與NVIDIA的合作進一步將其具象化為可動手構建的開發生態。微軟方面明確表示,相關能力將在未來整合到面向使用者的Copilot+PC體驗中,意味著最終消費者也會在系統層面直接呼叫這些高度個性化的AI代理。

對AI產業而言,這標誌著模型部署正從“雲端單中心”向“雲-端混合”加速裂變。在黃仁勳提出的“五層蛋糕”框架中,這一事件同時撥動了晶片層應用層的齒輪:本地推理將放大對消費級GPU和高效能NPU的持續需求,讓RTX 40系列或未來晶片的“邊緣算力”敘事更紮實;也催生出大量原生Windows AI應用,可能重複智慧手機系統催生APP生態的路徑。對微軟來說,這是強化Windows在AI時代作業系統的地位;對NVIDIA,則是將資料中心外的每一塊RTX顯示卡變成其軟體生態的延伸。開發工具的平民化,正把AI代理從實驗室拽進每個人的工作列。