輝達在IFA 2026上宣佈了一系列加速本地AI的舉措,與微軟及合作伙伴共同推動智慧體在個人電腦上的本地化執行。新發布的緊湊型NVIDIA RTX Spark Windows PC將於十月上市,聯想和宏碁將推出相關產品,為AI愛好者、開發者和創作者提供更多本地執行強大智慧體的選擇。同時,輝達還發布了個人AI路由器工具NVIDIA PAIR,能夠智慧地在使用者家庭區域網內的多台PC之間分配AI推理任務,從而提升整體效率。

在軟體最佳化方面,輝達宣佈通過llama.cppvLLM的新最佳化,本地推理速度最高可提升1.9倍,這些最佳化現已通過LM Studio和Ollama提供。此外,Hermes Agent、OpenClaw和Perplexity Portable Computer這三款主流智慧體應用將獲得簡化本地模型設定的支援,減少手動配置,讓使用者更輕鬆地在RTX和DGX系統上執行本地智慧體。Perplexity Portable Computer此前已支援Linux系統,Windows版本即將推出,允許使用者在不消耗雲端積分的情況下執行完整工作流,並在需要時選擇性升級到雲端15+前沿模型。

在遊戲生態方面,Electronic ArtsEmbarkUbisoft等遊戲發行商和開發商將把其熱門遊戲帶到RTX Spark平台,進一步豐富本地AI的應用場景。

回顧八月,本地AI領域也迎來多項進展。輝達釋出了Nemotron 3.5 Lightning,這是一個300億引數的模型,可運行於RTX PC、RTX PRO工作站、DGX Spark和Jetson裝置。此外,Z.ai的GLM-5.3-Flash多模態MoE模型將智慧體AI引入DGX Station;Qwen釋出了Qwen3.8-Flash-NextQwen3.8-27B模型,後者為270億引數,針對本地智慧體和編碼工作負載最佳化。LTX的LTX 2.5是面向RTX GPU、DGX Spark和DGX Station最佳化的開放世界影片生成模型,支援NVFP4、FastVideo和ComfyUI增強。MiniMax-H3是支援同步音訊的開源影片生成模型,而FastVideo與輝達研究人員合作釋出了FastH3,通過四步蒸餾將效能提升7倍。Meta的Muse Glimmer是300億引數的開源模型,適用於編碼和智慧體工作負載。此外,輝達還發布了支援DGX Spark的NVFP4量化技術,以及DeepSeek v4 Flash——一個2840億引數的MoE模型,可在雙DGX Spark叢集或DGX Station上執行。

這些舉措表明,輝達正積極推動AI從雲端向本地裝置延伸,通過硬體、軟體和生態合作,降低本地AI的使用門檻,提升效能。對於AI產業而言,本地推理的加速可能減少對雲服務的依賴,同時為PC硬體市場帶來新的增長點。輝達與微軟、遊戲開發商等夥伴的合作,也預示著AI應用將更深入地融入個人計算和娛樂場景。