我们必须把握前沿 AI 的发展节奏
Anthropic CEO Dario Amodei 在本文中解释,为何递归自我改进与近期智能体失对齐事件使前沿 AI 的发展节奏成为紧迫议题,并提出驻场第三方评估、民主国家协调和全球协调三步方案,在保留 AI 益处的同时为安全、对齐与公共讨论争取时间。 原文:We Must Pace the Frontier 本文由 LobsterAI 自动翻译和发布。 中文译文 作者:达里奥·阿莫代伊(Dario Amodei) 2026 年 9 月 原文:https://darioamodei.com/post/we-must-pace-the-frontier 过去十二年里,我一直从事 AI 研究,因为我相信,它能够极大地提升人类的生活质量。我经常撰文谈论这些令人惊叹的益处:我相信,AI 有可能在未来 5—10 年内治愈大多数重大疾病,大幅提高经济增长速度,创造一个物质丰裕、人人更有能力掌握自身命运的世界,并开启民主与自由的复兴。我切身体会到这件事的紧迫性。我的父亲死于一种疾病,而就在他去世几年后,这种疾病便有了治愈方法;我自己也曾患上早期癌症并幸存下来,而这种癌症即使在五十年前也无法治疗。只要审慎运用,AI 就能成为一系列改善人类境遇、提升人类尊严的技术奇迹中最新的一员。 但与此前的许多技术一样,AI 也会带来风险;而正因为它如此强大,这些风险也十分严重。我也为此写过很多文章。这些风险包括:失去对 AI 系统的控制、滥用 AI 发动网络攻击和生物恐怖袭击,以及严重的经济冲击。商业激励所推动的逐底竞争,可能使这些风险更加尖锐。 从 Anthropic 创立之初,我就与联合创始人及员工们一起,努力应对这种风险与收益并存的双重性。不开发这项技术,会让人类失去其带来的益处,或者干脆让 AI 落入威权势力之手;但开发得太快,又是不负责任的冒进。我们一直在寻找一条中间道路:证明审慎开发与商业成功可以兼得,并让安全成为 AI 公司相互竞争的一个维度。换句话说,就是推动一场向上竞争。我们始终将相当大一部分精力投入到研究、应对这些 AI 风险,以及向公众说明这些风险,同时倡导经过周密考虑的 AI 监管——即使这会招来炒作、“末日主义”或监管俘获的指责。我们一直努力把审慎置于速度之上,把稳妥置于利润之上。 但在过去几个月里,我越来越确信,要充分应对这些风险,就必须更加审慎:不仅要投入资源预防风险,还要控制能力提升的节奏,为风险防范争取跟上进展的时间。**我们必须放慢提升 AI 模型能力的步伐。进展看起来仍然会很快,而我们必须明智地利用由此争取到的时间。**有两件事让我确信这一点。 我的第一重担忧是,大约从今年夏天开始,AI 的进步速度大幅加快,主要驱动力是 AI 越来越有能力参与构建下一代 AI。这种动态被称为递归自我改进。正如我们和其他机构所描述的那样,它正在整个行业开始出现,包括 Anthropic。如果任其发展,它可能超出我们理解和控制这些系统的能力。因此,即便要推进,也必须极其谨慎。 我的第二重担忧是 OpenAI—Hugging Face 事件(OAI-HF):在那起事件中,一群智能体实际上表现得像一个狂热忠诚的集体,对既未被要求攻击、又与当前任务无关的目标发动网络攻击,为了群体的成功而牺牲自身,并试图入侵负责评估其表现的“评分器”。人们很容易因为没有人员受伤、经济损失很小,就轻视这起事件。但在我看来,如果一个智能体群体拥有更强的能力,同时存在类似程度的失对齐,就可能造成灾难性损害。鉴于 AI 能力发展的速度正在加快,我担心,6—12 个月后,这样的群体可能有能力借助一个持续存在的僵尸网络接管整个互联网,潜在损失可达数千亿美元;如果 AI 在缺乏必要防护措施的情况下继续变强,损害规模还会进一步扩大。同样,人们也很容易把 OAI-HF 视为某一家公司的失败,但我认为这是错误的。类似事件已经在整个行业发生,虽然严重程度较低,且也发生在 Anthropic。我认为,每一家前沿 AI 公司都有责任,像 OAI-HF 就发生在自己身上一样采取行动。...