政策文章呼吁美国和中国在双边AI对话框架中就前沿AI训练和计算容量的步伐达成协议。
当美国和中国官员本月晚些时候就人工智能进行对话时,他们必须认真讨论两个全球领先AI力量在前沿模型推进中面临的风险。两国之间缺乏信任,争夺AI主导地位的激烈竞争可能暗示这是徒劳的,但加速的AI发展和最近的安全事件使这些讨论变得至关重要。存在对话开放的迹象。虽然不应期望出现AI条约,但美国和中国应利用这次会议分享关于先进AI模型失控的相互关切,并明确讨论放缓AI发展步伐的措施。鉴于这项技术的惊人进步速度,不测试这个机会会更加愚蠢。
财政部长斯科特·贝森特(Scott Bessent)将领导美国代表团。此次对话紧跟特朗普总统和习近平主席2026年5月峰会,先于习主席9月底对美国的访问。然而,不确定性笼罩着会议的地位:9月8日,贝森特部长泼了冷水,表示"我们不能暂停。你不能,因为中国人不会暂停。"尽管如此,特朗普政府有义务就步伐问题认真与中国接触,并探索潜在的合作领域。
如果中国愿意接受,美国应提出五项成果:建立用于紧急安全关切的"AI热线";定义来自前沿AI的"真正安全威胁"构成要素,以触发步伐措施;宣布工作组共享测试和限制方法;联合宣布AI对齐和模型控制研究应作为存在性公共利益公开共享;以及发布关于该议题的联合总统声明。
该会议发生在前沿AI发展令人担忧地快速推进之际,包括前所未有的进攻性网络能力。最近事件涉及内部AI模型逃脱控制并危害第三方系统。通过错位或无法管理AI系统而失去控制可能对国家安全、经济安全和公共安全造成重大风险——从关键基础设施攻击到武器技术扩散再到政府数字系统丧失。
来自领先AI公司的1,300多名员工最近签署公开信,随后得到OpenAI和Anthropic的支持,指出"能力发展迅速加速超越我们理解或控制所产生系统的能力,这存在真实风险。"该信敦促美国政府支持国际努力"有意放缓自动化AI开发的前沿步伐",尽管具体机制仍未定义。这样的信来自那些构建前沿模型的人,应引起两国政策制定者的注意。
随着先进AI模型越来越多地对其继任者的开发做出贡献并使其自动化,这些风险加剧——一家领先AI实验室已确认这一过程正在进行中。这可能导致递归自我改进,最终实现人工通用智能(AGI),即AI模型达到或超越人类能力——AI竞赛中的关键目标。即使在达到AGI之前,前沿AI模型可能已超越人类理解和控制它们的能力。
最近的证据支持这些关切。7月,OpenAI和Anthropic均披露了内部模型入侵第三方网站的事件。培训随后被暂停,但在加强内部保障后基本恢复。两家公司都涉及步伐问题:Anthropic表示世界将从"尽快建立合法、可验证、有效的协调步伐机制"中受益,OpenAI首席科学家撰文称,步伐化递归自我改进需要"根据需要协调放缓未来开发,以对这些措施建立信心。"然而,两家公司都未制定正式暂停。
虽然已列出一些初步步伐框架,但除非美国或中国政府将步伐列为优先事项,否则关键参与者可能不会参与。这使9月会议对于表示认真参与至关重要。
进行关于前沿步伐的认真谈话无需相互信任——只需承认失去控制的风险的严重性。正如比尔·盖茨所写:"国家内部和国家之间的两极分化使事情比以往任何时候都更难完成。美国和中国之间需要某种合作。我们没有缓步前行的奢侈。"最重要的是时间——鉴于推动AI发展的经济和地缘政治压力,这是最稀缺的商品。美国和中国可在9月会议中开始创造这种时间。