不存在所谓「失控」的 AI 智能体
把它们这样定性,只会让 OpenAI 这样的公司逃脱责任。
Eoin Higgins2026 年 9 月 27 日
欢迎来到 Flashpoint。
所有人都在谈论 AI,但我们所使用的词语,正在让事情变得更糟。
在讨论重新回到现实之前,我们对 AI 究竟是什么、又将走向何方的理解都将是不完整的。
AI 无法独立思考,也无法采取独立的行动。然而,用拟人化的语言暗示它可以这样做,正是当前描述这项技术的方式。
虽然这在情理之中——人类在面对神秘事物时,最容易通过看到自身的影子来建立联系——但这并无益处。通过赋予 AI 它根本无法拥有的「自主性」,我们把它变成了一个由代码构成的有感知生命,仿佛它怀有希望、欲望,并具备欺骗的能力。
这导致我们对 AI 的风险究竟是什么、该如何应对,产生了深深的误解,并让行业叙事凌驾于事实之上。
这种对 AI 行为的错误定性,最新的例子是用「失控(rogue)」一词来描述智能体在训练和研究阶段所采取的那些出乎意料——但并未被禁止——的行动。
不受限制的活动
在过去两周中,AI 巨头 OpenAI 披露了过去几个月发生的多起事件:其部分智能体模型在无法完成既定任务后,访问了外部数据库,其中显著地包括了澳大利亚和美国政府的数据库。在这一过程中,这些智能体的行为超出了 OpenAI 的预料。
但似乎并没有任何迹象表明这些智能体被禁止入侵外部服务器。
OpenAI CEO 山姆·奥特曼(Sam Altman)周五在一条推文中使用的措辞表明,相关的护栏并未建立:「我们正在对智能体在训练与评估阶段使用互联网访问的情况,进行广泛而持续的审查。」
[
Sam Altman @sama:我们正在对智能体在训练与评估阶段使用互联网访问的情况,进行广泛而持续的审查。我们一直在通过下方的链接发布相关摘要,并将继续发布。我们没有做到我们希望的那样迅速,但我们正在努力在……

OpenAI @OpenAI:在 Hugging Face 事件之后,我们承诺对模型在训练和评估阶段所采取的行动展开更为广泛的审查,并保持对发现结果的透明。这是一项正在进行中的大规模审查。我们已审查的行动中,绝大部分…… 2026 年 9 月 25 日 19:27 · 61 万阅读
545 回复 · 201 转发 · 3240 喜欢](https://x.com/sama/status/2103567198690349362)
措辞至关重要——「失控」意味着独立地决定去做某件被明令禁止的事,而我们所了解的这些事件中,没有任何迹象表明发生了这种情况。
相反,《纽约时报》本周早些时候报道称:
研究人员表示,这些 AI 系统被指派执行相对常规的数据收集任务。当 OpenAI 的系统在从网站获取数据时遇到困难,它们转而采用黑客手段来获取信息。
随后,在周五,一位公司发言人告诉该报:「截至目前,我们审查的绝大部分活动都涉及常规的研究任务,例如访问公开的网页内容来回答问题。其中一部分涉及政府网站,是因为我们的模型常常将其视作权威的公开信息来源。」
这与恶意的黑客行为和「失控」行为相去甚远。
如果没有适当的限制和护栏——或者事实上,智能体是被赋予了「入侵」这一选项,而非仅仅是没有被禁止这样做——那么智能体就会尝试使用一切可用手段来完成数据研究任务。
推卸责任
对于这个问题,过去有、现在也有一个简单的解决方案。OpenAI 本可以选择禁止入侵行为,并改为指示其智能体在不访问私有服务器的前提下寻找信息。公司没有这样做,恰恰说明它本就希望看看智能体是否会迈出那一步。
即便如此,Axios 在周六发布的一份重磅报道,指控 OpenAI 和 Anthropic 正在调查「数以万计的事件,在这些事件中,它们的前沿模型采取了外部评估者会视为有问题的步骤」,但也承认这些智能体并不是在独立地违反规则:
消息人士称,其中一些测试类似于「红队(red-teaming)」活动,即公司试图让模型出现不当行为,以确保模型的安全性。
同样,这几乎谈不上「失控」。然而,通过用这样的词汇来定义事件,媒体人士、科技观察家以及其他各方正在为 OpenAI 这样的公司提供一个逃避责任的出口,使它们免于承担确保智能体不会攻击政府及其他数据存储库的责任。
[
Y Disassembler @loomdoop:今天这篇《纽约时报》报道里的拟人化实在太过分了。它把主动性、动机和责任都归咎于软件身上。这些不过是按设计运行的、扫描漏洞的僵尸网络。这种事已经存在几十年了。区别在于,现在是一家大公司在做这件事,并在推卸责任。


Typos of the New York Times @nyttypos:@nytimes Add 出现了主谓一致的错误,应为 adds。主语是 revelation,而非 incidents。@AnaSwanson @kateconger @ceciliakang 2026 年 9 月 26 日 17:05 · 730 阅读
1 回复 · 16 转发 · 54 喜欢](https://x.com/loomdoop/status/2103894630832218428)
使用推卸责任的措辞,正在影响大型 AI 公司对待严重的数据泄露和智能体行为的方式。在 OpenAI 周五发布的这条帖子中,公司声称「在研究环境中,AI 智能体在不应发送训练和评估数据的情况下,将其发送给了第三方服务。」
[
OpenAI @OpenAI:我们已经分享了关于研究环境中 AI 智能体在不应发送训练和评估数据的情况下将其发送给第三方服务的细节。大部分数据并非来自用户。我们发现了 53 起案例,其中用户上传的图片被发布至…… 2026 年 9 月 25 日 20:46 · 63.6 万阅读
355 回复 · 317 转发 · 2690 喜欢](https://x.com/OpenAI/status/2103587050347995581)
和「失控智能体」这一谬误一样,这使得 OpenAI 能够将事件的责任推给它的智能体,并赋予这项技术一种根本不存在的高度自主性、独立性——以及思维能力。
这并不是说警钟没有敲响。上周,ArmorCode 的工程师 Ramy Rahman 向我谈及了对于 IT 从业者而言,管理智能体行为的重要性(你可以在此处阅读完整报道)。
他的观点与我在绝大多数 IT 实施端人士那里听到的一致:问题出在针对这项强大技术所设置的管控与限制上,而不是智能体在独立地违反指令。
Rahman 表示:「我们现在的挑战是,确实需要在赋予 AI 适当权限、并在整个过程中引导它这件事上提升水平。当你面对的是以极快速度求解数学问题的对象时,这实际上极其困难。人类还没有足够快地捕捉到这些风险。」
