評分 6/10星塵智慧釋出非同步線上強化學習框架SmoothRL星塵智慧釋出SmoothRL,實現非同步線上強化學習,適配大模型推理。來源:量子位 QbitAI·2026-09-04 17:19 北京·#模型#應用字號AAAA訂閱《讀懂AI時代》每早 8 點一封,昨天 AI 圈大事一次讀完。免費。郵箱地址訂閱本條暫無中文擴充套件報道,可點選下方按鈕直達原文。閱讀原文 · 量子位 QbitAI ↗延伸閱讀相關深度報道系列 · 模型深度四巨頭呼籲 AI 減速,特朗普說「別殺金鵝」:實驗室要的不是剎車,是逼所有人一起踩的人系列 · 模型深度黃仁勳說 AGI 已經到來,OpenAI 首席科學家卻喊減速:AGI 到底走到了哪一步系列 · 基礎設施深度一百萬 token 賣不到 1 美元了:用量漲 47%,收上來的錢只漲 7%相關每日新聞OpenAI 一次性放出近 400 項數學成果,數學家稱需數年消化2026-10-10Anthropic為Claude託管代理新增動態工作流,可並行排程最多1000個子代理2026-10-10ServiceNow與Palantir估值差四倍:AI增速能否支撐溢價2026-10-10Kimi與DeepSeek推進上市,中國開源模型面臨雙線競爭2026-10-09阿里通義釋出 Qwen-Image-2.1-Turbo 加速版影像生成模型2026-10-09