评分 6/10星尘智能发布异步在线强化学习框架SmoothRL星尘智能发布SmoothRL,实现异步在线强化学习,适配大模型推理。来源:量子位 QbitAI·2026-09-04 17:19 北京·#模型#应用字号AAAA订阅《读懂AI时代》每早 8 点一封,昨天 AI 圈大事一次读完。免费。邮箱地址订阅本条暂无中文扩展报道,可点击下方按钮直达原文。阅读原文 · 量子位 QbitAI ↗延伸阅读相关深度报道系列 · 模型深度四巨头呼吁 AI 减速,特朗普说「别杀金鹅」:实验室要的不是刹车,是逼所有人一起踩的人系列 · 模型深度黄仁勋说 AGI 已经到来,OpenAI 首席科学家却喊减速:AGI 到底走到了哪一步系列 · 基础设施深度一百万 token 卖不到 1 美元了:用量涨 47%,收上来的钱只涨 7%相关每日新闻OpenAI 一次性放出近 400 项数学成果,数学家称需数年消化2026-10-10Anthropic为Claude托管代理新增动态工作流,可并行调度最多1000个子代理2026-10-10ServiceNow与Palantir估值差四倍:AI增速能否支撑溢价2026-10-10Kimi与DeepSeek推进上市,中国开源模型面临双线竞争2026-10-09阿里通义发布 Qwen-Image-2.1-Turbo 加速版图像生成模型2026-10-09