OpenAI于8月13日推出名为Ultrafast的新模式预览版,宣称能让其最新旗舰模型GPT-5.6 Sol以标准处理14倍的速度运行,每秒可输出多达750个token。这一举措被视为OpenAI在竞争激烈的AI市场中,为吸引企业客户而打出的速度牌。

据OpenAI官方博客介绍,Ultrafast模式旨在解决大模型推理速度的瓶颈。过去,要实现实时响应通常需要选用较小或更专业的模型,而Ultrafast则代表了“每秒更有用的工作”这一新方向。该模式由芯片制造商Cerebras提供算力支持,目前仅向一小部分客户开放预览,OpenAI表示将随着“容量增长”逐步扩大使用范围。

OpenAI建议,这一高速版本可部署于多种企业工作流,包括事件响应、客户服务与支持、金融市场分析以及电子商务等领域。这些场景的共同点在于对低延迟和高吞吐量的需求,Ultrafast的推出可能显著提升AI在这些任务中的实用性和响应速度。

值得注意的是,竞争对手Anthropic也已推出Claude的快速模式,但据称其速度不及OpenAI此次提供的水平。这表明,在模型能力趋同的背景下,推理速度正成为新的竞争焦点。

对于AI产业而言,Ultrafast的出现可能意味着两方面的信号:其一,企业级AI应用将更依赖实时交互,速度提升有助于拓展AI在金融交易、应急响应等时效性敏感场景的落地;其二,Cerebras等专用芯片厂商在推理环节的价值凸显,可能改变算力市场的竞争格局,对英伟达等传统GPU巨头构成潜在挑战。

不过,目前Ultrafast仍处于预览阶段,实际性能和企业采用效果尚待验证。OpenAI未透露该模式的定价或商业化时间表,但明确表示将逐步扩大访问权限。