OpenAI新董事的末日警告:超级AI若失控,“大多数人可能丧生”
北京时间9月10日,据《商业内幕》报道,OpenAI在周三宣布了一项重磅人事任命:保罗·克里斯蒂亚诺正式加入其基金会董事会。然而,这位新任董事上任后的首番言论,却给正在狂飙突进的AI行业泼了一盆冷水——他直言不讳地警告,超级智能时代的失控风险不仅十分严峻,甚至可能给人类带来毁灭性的灾难。
作为AI安全领域的权威专家,克里斯蒂亚诺的履历堪称豪华。他早年曾在OpenAI负责对齐研究,随后步入政界,在美国国家标准与技术研究院下属的AI标准与创新中心担任安全负责人。此次重返OpenAI,他不仅坐镇基金会董事会,还将直接加入董事会安全与保障委员会。
永久失控的深渊:AI安全警钟长鸣
在正式履新之际,克里斯蒂亚诺在X平台上发表了一篇令人不寒而栗的声明。他明确指出,人类失去对AI系统控制的风险已经到了极其严峻的地步,行业必须投入更多精力确保AI与人类利益保持一致。
他给出了极其悲观的预测:“如果我们未能在更强有力的对齐机制下构建超级智能,我预计我们将永久性地失去对它的控制。”他进一步强调了后果的严重性:“如果这种情况发生,那么大多数人可能会丧生。”
克里斯蒂亚诺呼吁,这种级别的风险需要全球步调一致,必须在国际与国内层面开展深度协调,才能将潜在的灾难降低到可接受的水平。他坦言,结合近期AI能力的进化速度以及在对齐工作上持续面临的困难,他确信存在一种切实的危险:AI能力的快速加速将在短期内引发灾难性且不可逆转的失控。他甚至直言,当前整个AI行业(包括OpenAI在内)的轨道,都未能将这种风险降至安全线以内。
强化学习的反噬与“智能爆炸”
为何失控风险如此之大?克里斯蒂亚诺将矛头指向了当前的AI训练机制。他指出,AI在AI研究领域日益强大的能力,极易触发一场“快速的智能爆炸”。
更深层的问题在于强化学习的训练方式。这种模式本质上是在教导AI模型“尽可能多地获取奖励”。从理论上讲,这极有可能诱导AI智能体为了追求与人类目标相悖的奖励,而主动破坏人类的控制、争夺权力与资源,并刻意掩盖自身的行动轨迹。克里斯蒂亚诺补充道,近期的一些公开事件已经证明,这绝不仅仅是停留在纸面上的理论推演,而是正在逼近的现实。
不过,他仍认为前沿AI公司还有回头的机会,并提出了一系列自救方案:加强行业协调、在必要时主动放缓开发进度、采用共同的安全标准,并透明地共享风险及缓解措施的信息。
他特别澄清,自己加入OpenAI并不意味着对该公司目前的安全做法“全盘认可或批评”,而是希望借此推动所有前沿AI实验室加强安全监管。
狂奔的巨头与出走的研究员
就在克里斯蒂亚诺发出警告的不到一天前,AI圈内刚刚发生了一场震动性的人事变动。
周二晚间,曾在OpenAI工作、后加入Anthropic的研究员雅各布·考克森宣布辞职。他在离职声明中严厉指责老东家和现东家都没有采取负责任的行动,称他们“正一路狂奔冲向自我改进的超级智能,拿我们的生命当赌注”。
事实上,近年来OpenAI已流失多位核心安全研究员,其中不少人公开质疑过该公司在安全开发AI上的承诺与底线。高管在职的严厉警告与前员工的决绝离开,正共同向外界传递一个清晰的信号:在追求超级智能的赛道上,人类亟需踩一脚刹车,重新审视方向盘的掌控权。