曾预测人类因失控人工智能而灭绝的分析师团队,如今提出了一个出人意料的拯救方案。这份名为《AI 2040:A计划》的文件由AI未来项目(AI Futures Project)发布,该项目由前OpenAI研究员丹尼尔·科科塔伊洛创立。

科科塔伊洛于2024年4月因在人工智能安全问题上存在原则性分歧而离开OpenAI。2025年,他成立了自己的分析中心。他此前的报告《AI 2027》描绘了一幅阴暗图景:美中两国在超级智能领域的军备竞赛,导致人类灭绝概率高达10%至30%。如今,专家们提出了一系列具体措施,他们认为这些措施能从根本上降低这些风险。

如何运作

“A计划”的核心是华盛顿与北京之间的一项国际协议,该协议必须在2029年前达成。据称,若无此协议,人工智能开发的全面自动化将在2030年实现。相反,各国应同意逐步发展神经网络,仅将其控制在人类顶尖专家水平。到2035年,将强制暂停竞赛,以保持人类对系统的控制。直到2040年,限制才会解除,人工智能才能达到超级智能水平。

该计划基于四项原则:

  • 为安全研究争取时间;
  • 所有人工智能开发完全透明;
  • 在不同公司和国家之间分配计算能力;
  • 保持过程的可逆性。

为确保信任,建议使用太空验证:大型数据中心可通过卫星观测到。第一步是公开芯片采购声明。随后引入由传感器监控的临时训练暂停。在信任得到确认后,限制将被解除,但完全透明仍将保留。

该计划最激进的部分是类似于核威慑逻辑的遏制机制。建议将中国的新数据中心建在加拿大,而美国的设施则建在蒙古。若协议破裂,接收国将试图夺取这些设施,而所有者则会将其摧毁,以免落入敌手。

经济与社会影响

根据计算,全球计算能力将从2026年的2000万H100等效单位增长到2034年的600亿。在2030年代的某些时期,美国实际GDP年增长率可能高达50%。然而,自动化将导致就业率灾难性下降:从2027年的62%降至2040年的12%。为此,建议通过“公民红利”来补偿——即从计算和机器人许可的国家收入中向公民发放补贴。预测令人震惊:2032年每人4.5万美元,2035年达到100万美元,2039年达到1000万美元。

替代情景

专家们还模拟了其他四种发展路径:

  • B计划:美国组建联盟向中国施压,甚至发动网络攻击。结局是失控或战争。
  • C计划:尝试谈判,但在公司压力下迅速取消暂停。风险是超级智能所有者形成永久寡头统治。
  • D计划:最低限度监管与竞赛。风险包括失控、权力集中和第三次世界大战。
  • S计划:完全无限期停止。主要危险是协议必然破裂,竞赛在混乱中重启。

我的分析:“A计划”无疑是对许多人选择忽视的问题进行系统性解决的雄心勃勃尝试。然而,其实施需要前所未有的全球信任与协调水平,这在当前地缘政治环境下极不可能实现。“计算能力相互确保摧毁”机制是一个有趣但令人不安的核武器类比,它更多地凸显了平衡的脆弱性,而非提供可靠解决方案。市场可能会忽视这些预测,但对于严肃的投资者和监管机构而言,这是关于潜在风险深度的重大信号。