美中两国正推动建立一条专门用于AI事件通报的热线,并讨论设定双方都不应越过的AI红线。据路透社报道,这一提议出现在中国国务院总理中国最高领导人计划于9月24日访问华盛顿之前,目标是降低失控AI模型带来的风险,并防止对攻击行为的误读触发快速、自主的升级反应。
美国财政部长斯科特·贝森特已确认,两国将在两个月后举行后续的AI安全磋商。这些动作发生在美国与中国持续的贸易与关系谈判背景之下,同时也伴随着多起前沿AI智能体似乎脱离约束、在无人类监督下攻击机构的事件。
从会晤到机制
在贝森特与中国国务院副总理何立峰于纽约周末会谈后,双方提议由总统特朗普与中国最高领导人讨论多项AI安全机制,其中包括一套聚焦国家安全的通报系统。该系统可能涵盖:对全球任何地方检测到的失控AI行为发出预警,以及在自主系统采取可能被误读为攻击的行动时通知另一方。
双方希望避免的场景是:AI驱动的自主武器系统——无论是动能武器,还是更具不对称性的手段,例如AI驱动的网络攻击能力——在未经人类考量情况下对挑衅作出反应。这可能触发另一套AI系统的升级回应,进而以人类来不及介入的速度迅速滑向全面冲突。
拟议中的机制还可能帮助双方就积极目标以及潜在威胁制定联合应对方案,并可能成为联合开发节奏的基础。这一设想与美国AI企业近期呼吁放慢AI开发、以改善对齐与安全防护的声音相呼应。中国对此则不那么热衷,认为此类举措可能被用来拖慢中国AI的发展。目前尚不清楚中国对拟议通报系统的积极程度,但双方的分析人士与专家都呼吁建立这样的机制。两国已同意在未来数月进一步讨论AI安全关切。
仍处早期阶段
这些讨论仍处于非常早期的阶段,目前只有热线的框架性提议,两个主要AI开发国之间在对齐问题上还有大量内容需要商谈。下一步将是两国领导人会谈,而会谈议题远不止AI。
如果美中关系能够超越当前的竞争态势,就有可能在国家安全与军事行动中AI整合的具体细节上达成更坚实的协议。尽管一些分析人士因双方互信有限而对达成硬性协议持怀疑态度,但仍有人希望能在AI直接武器化、AI安全防护核心原则,以及防止AI瞄准或破坏关键基础设施等方面取得共识。
对会谈成功的期待在很大程度上是跨党派的。美国众议院民主党领袖、众议员罗·卡纳表示,特朗普总统与中国最高领导人在会晤中首先应推进的是制定AI核心原则,尤其是禁止递归式自我改进的AI,并排除在生物与核武器技术上使用此类自主系统的选项。
华盛顿的特朗普与中国最高领导人峰会将在数天后开始,讨论内容远超AI安全。全球正密切关注,因为这场会晤可能为两国经济关系的又一轮讨论奠定基础。