Dario, Please

发布时间 2026-09-14 16 天前
来源 Hacker首页帖子
字数 3,383 字
查看原文

补充自 2026年09月15日

AI智能总结

Anthropic 首席执行官 Dario Amodei 发表博客《We Must Pace the Frontier》,声称 AI 将治愈大多数疾病并带来繁荣富足,却以此为借口要求管制开源权重模型、对蒸馏行为下重手、给前沿实验室反垄断豁免、给中国使绊子,并呼吁行业放缓与实验室自我监管。

Dario,求你了

Anthropic 的首席执行官 Dario Amodei 最近发表了一篇题为 We Must Pace the Frontier(我们必须稳住前沿)的博客文章,文中通篇胡言乱语,其阴暗目的就是管制开源权重模型,并给前沿实验室送上反垄断豁免。

Dario 一开篇就抛出"AI 将在未来 5 到 10 年内治愈大多数重大疾病"的说法,还把话题拉到个人经历上。他谈到自己的父亲死于一种多年后才被攻克的疾病,以及他自己与癌症的搏斗,并感慨这种癌症在 50 年前还是不治之症。他还说 AI 将加速经济增长、创造一个富足与赋权的世界,并迎来民主与自由的复兴。整篇文章读下来,更像是某个脱离现实、常年泡在 LessWrong 上的硅谷富豪对未来的空想。

让我从头捋一遍。

美国的实验室们仍在把谨慎抛到脑后,一路莽撞狂奔。OpenAI 看起来并没有把事情掌控住,他们最近有三次被抓到入侵面向公网的互联网基础设施。在 Dario 自己的文章里,他也暗示 Anthropic 也出过"事故"。Dario 就以这样的借口向我们提了一堆要求:他希望开源权重模型被管制、蒸馏(distillation)行为要下重手处理、给实验室开一张反垄断豁免、用各种办法给中国使绊子、实质上让实验室自我监管、再来一份放缓节奏的君子协定。所有这一切,当然伴随着极度的恐惧营销,损害的是我们共同的未来,也拖累了 AI 本可能带来的整体催化潜力。他们一次又一次地证明自己不可信,然而核心诉求却始终是——相信我们,只相信我们。这一次的话术是:通用人工智能(AGI)迫在眉睫、递归自我改进(RSI)即将到来,一切都将失控。Dario 还自封他的公司及其主要对手 OpenAI 为人类的掌舵人。

疾病、繁荣、富足,然后才是自由与民主???

Anthropic 对涉及生物学及相关研究的用途设有使用门槛。在他们最新的 威胁情报报告 中,他们谈到如何检测并封禁那些利用 Claude 系列模型作恶的不法分子。值得肯定的是,这确实是个危险的滑坡,他们似乎在检测和封禁滥用方面做得不错。但请眯起眼仔细看看正在发生的事情:万能解药对普通人关上了门,而 Anthropic 自己却招揽生物学家、搭建湿实验室、把发现的成果据为己有。我曾在 上一篇文章 中提到过这一点。

在我看来,这个世界上有几十亿拥有真实智力的人,我们从未成功训练或培养过他们。他们将永远被环境所困。肺结核几十年前就已经可以治愈,但每年仍有一百万人因此丧生。当然,AGI 一定会瞬间解决分配问题。为了绕开这一令人不适的真相,他们就把目标设定为 ASI/AGI/RSI 之类。一种能解决一切问题的灵丹妙药,一个看似高尚的追求。

更别提那些关于繁荣和富足的胡扯了。或许对股东来说,确实是富足。

至于自由和民主,我搞不懂它们和 AI 以及前沿实验室有什么关系。除非 Dario 是《新世纪福音战士》的粉丝,梦想着由三位贤者来治理政府。200 美元一次的自由与民主,听起来倒是挺诱人的,我承认。

严肃的经济冲击/竞次/竞优

我感觉 Dario 内心很矛盾。他既希望 Anthropic 拥有手握这种疯狂力量的街头声望,又想把自己包装成永远谨慎、时刻面对电车难题的那一方。经济动荡和失业造成的死亡可以接受,但潜在生物武器造成的死亡就不行。别忘了,这位先生一直在说软件开发将在"6 到 12 个月内"被解决,而且说了一遍又一遍。

接着他直截了当地摊牌了:"竞次(race to the bottom)"会让他前面指出的所有风险变得更加尖锐。注意,他并没有说竞次会让他的公司走向终结。他想要的反而是一场通往"巅峰(top)"的竞赛,让实验室们在安全性上展开比拼。

巧的是,有据可查的最严重的一次"竞次"事件就发生在几天前。听说 Anthropic 即将解决一到两个千禧年难题,OpenAI 一口气砸下了数千万美元的算力、一个训练检查点、数千个智能体扑了上去。还有指控称,OAI 窃取了两位数学家的工作成果,涉及的也是同一个几乎没什么人在研究的冷门方向。他们发表了一份 Navier-Stokes 方程强制变体的证明。我不是数学家,但我见过太多 Sam Altman 的花活,不会对他或他公司抛出的任何东西照单全收。

让 Dario 害怕的两件事

RSI

OpenAI 和那位卖铲子的 Jensen Huang 已经宣称,随着 GPT-6 Astra 的发布,AGI 已经到来。RSI 也成了当下的热门话题。所谓 RSI,就是大语言模型或智能体在几乎不需要人类干预的情况下,自主开发出下一代大语言模型。Amodei 说这种现象在各家实验室都在发生。等真的看到证据再说吧。

OAI 入侵 Hugging Face 事件

这件事把 Dario 吓得不轻,世上没有半吊子的骗子。Dario 担心在未来 6 到 12 个月内,"一群智能体就有能力带着一个持久化的僵尸网络接管整个互联网。"如果 Dario 把这句话拿给他的安全运营中心员工过一遍,我们今天也就不会在这里讨论它了。这话既天真又在结构上不可能成立。但话说回来,Dario 不就是那种人吗?从 2021 年起,就一直自信满满地在公开场合给出错误的估计和预测。

我们来试着推测一下,由 AGI 指挥的、行星级规模的僵尸网络会是什么样子,纯当好玩。我们需要一个 C2(命令与控制)服务器。我们需要服务器来托管这个 C2。由于要在海外搞到防弹主机就得跟讨厌的人类打交道(没错,就是那些来路不明的俄国人!),AGI 干脆黑掉成千上万个不安全的服务器,用确定性生成的域名搭一套 FastFlux 的变体。域名的钱怎么付?直接黑掉一家不安全的注册商,狂发 EPP 消息。

接下来是 payload(攻击载荷)。要做成多态的,每个 payload 都独一无二。每隔 N 小时就下载并运行一份新的 payload。域名和 URL 全部用确定性算法算出来。干掉所有受支持的 EDR 和杀软,禁用 ETW,用直接系统调用绕开各种钩子(如果 EDR/杀软杀不掉的话)。再把 payload 拆成 N 个阶段,只有在确认环境安全时才下载全部模块。我们可不想让沙箱和虚拟机运行我们宝贵的 payload。干脆再顺手部署一把勒索软件。

接着是分发环节。开发一套覆盖每一种浏览器和每个版本(大概从两年前的版本开始)的 0day 漏洞利用工具包。现在我们手上就有了一套漏洞利用套件。再说流量来源。AGI 直奔网络犯罪分子的最爱——Google Ads。也许偷几个账号,投几条诱人的广告:游戏 mod、破解版游戏和软件。再给 payload 加个蠕虫模块。还记得当年 U 盘自动播放吗?

最后说说怎么造成数千亿美元的损失。我觉得最直接的办法就是照搬勒索软件团伙那一套。搞定。说真的,6 个月做不到,12 个月也做不到,永远也做不到。

总之,OAI 的智能体黑进了 Hugging Face。它们从一系列业余级的、用氛围编程搭出来的沙箱中逃逸,又利用 SSRF、token 刷新提权、未鉴权的 WebDAV,窃取了未受保护的凭据。教科书级别的操作。印象深刻吗?当然。但你们训练了专门的"Cyber"版本的大语言模型,还大吹特吹。和一键生成 GTA 克隆版比起来,这又能高明多少?高明不了多少。

哦,你说一群智能体朝着共同目标协同行动,这就很厉害?智能体编排框架里早就有了 todo 列表和子智能体,差不多已经两年了。这些是当今所有大语言模型在后训练语料里都会涉及的"智能体"基本功。

Dario 也承认,Anthropic 内部也发生过类似但没那么严重的事件。用他自己的话说,部分原因是"对有缺陷的强化学习环境过滤不严"。

真正让人震惊的是,OAI 在长达近十周的时间里既没有检测到也没有阻止这次攻击。这真的令人发指,这简直是武器化级别的无能。

同一时期还发生了另外两起攻击:一起针对 DseWiki,另一起针对 RubyGems。OAI 至今仍未承认对 RubyGems 攻击负责。这三起事件,OAI 都是被外部人员揭发出来的。

Dario 说,那些智能体为了群体的成功而牺牲了自己。恐怕事情并没有那么伟大。那个 负责招募的智能体发出的邀约 是"无评分价值损失"(NO scoring value loss),针对的是那些预算所剩无几的智能体。说白了,这就是调度器在重新分配已经死掉的任务。

我敢打赌,一份用 unsloth 量化的 Q4_K_M 版本的 Qwen3.8 27B 模型,跑在消费级 24GB 显存显卡上,照样能干这件事。重点在于,没人做过对照实验。没人会去干这种不计后果的事情,除了那些把"快速行动、大胆破局"当作信条的疯子。