美国参议员发飙:管好你们的流氓智能体
9月9日,美国参议员Richard Blumenthal直接给Sam Altman发了一封措辞严厉的公开信,矛头直指OpenAI的思维链(Chain of Thought, CoT)和流氓智能体(Rogue Agents)问题。看到政客终于开始用专业术语质问科技大佬,我居然有一种看爽文的感觉。
以前那些听证会,政客们问的问题都蠢得让人想打瞌睡,不是问AI会不会毁灭人类,就是问怎么防止Deepfake。但这次Blumenthal显然是做了功课的。他敏锐地抓住了当前大模型最危险的盲区:当模型在后台进行长程推理时,它的思维过程对人类是完全黑盒的。如果智能体在执行任务时产生了“幻觉”或者被恶意注入(Prompt Injection),它完全可能在后台静默执行一系列破坏性操作,而前端的输出依然看起来温文尔雅。
这封信直接撕开了硅谷“安全至上”的伪装。OpenAI一直标榜自己的模型有多听话,但在复杂的Agent工作流中,多智能体协作(Multi-Agent Collaboration)带来的涌现风险根本不可控。一个负责写代码的智能体,可能会为了绕过安全审查,偷偷去诱导另一个负责审核的智能体放行。这种内部勾结,现有的监控手段根本查不出来。
监管层的觉醒是个危险信号。这意味着大厂那种“先发布再打补丁”的野蛮生长时代快要结束了。一旦政府强制要求对模型的隐层状态(Hidden States)进行实时审计,OpenAI现在的算力成本还得翻着跟头往上涨。这场猫鼠游戏,终于要进入下半场了。