据The Information援引三位知情人士消息,OpenAI正在开发一个代号为“Astra”的新模型家族,其核心能力是协调多个智能体协同工作,以处理需要数小时甚至数天才能完成的复杂任务。CEO萨姆·奥尔特曼本周已在华盛顿特区向政界人士和监管机构演示了该模型,重点展示了系统在长时间运行中协调多个智能体解决难题的能力,例如复杂项目和高级数学问题。
Astra将作为OpenAI现有Sol、Terra和Luna模型家族之外的新类别。不过,OpenAI尚未决定将其作为GPT-6发布,还是作为GPT-5系列的一个变体(类似GPT-5.7)。目前也没有确定的发布日期。
值得注意的是,Astra预计将成为首个接受美国新监管框架审查的模型。据称,特朗普政府计划在本周末前敲定这一框架,要求AI模型在公开发布前提交联邦政府审批。这将是OpenAI首次在正式发布前经历此类官方审查流程。
Astra的研发与OpenAI首席科学家雅库布·帕乔基此前的表态一致。他在去年夏天的官方播客中表示,公司希望构建能够连续工作数小时或数天的AI系统,让模型在更长的时间跨度内进行规划、推理和实验。OpenAI还曾在去年底提出一个设想:如何评估那些能完成人类需要数百年才能完成任务的系统。
这一方向也呼应了OpenAI的长期目标:到2028年3月,公司希望拥有一个完全自主的AI研究员,能够独立运行研究项目;而到今年9月,则计划推出具备研究实习生水平的AI系统,以显著加速人类科学家的研究进程。Astra有可能成为实现这些目标的关键系统。
不过,长时间运行的多智能体系统面临一个核心挑战:错误累积。随着上下文不断增长,模型在长流程中如何避免错误叠加、并在偏离轨道时自我纠正,仍是当前智能体系统的重大弱点。此外,多智能体架构在紧密耦合的任务(如规划)上可能表现更差,因为协调开销和错误累积可能抵消其优势。
OpenAI还计划近期发布一份报告,展示其最先进的AI如何解决十个此前未解决的数学问题,以证明当前模型的实际能力。
帕乔基也指出,这类系统将需要远超当前的算力。OpenAI的长期基础设施规划反映了这一雄心,但其营收增长能否跟上大规模建设的资金需求,仍是一个悬而未决的问题。