Altman 站队 Dario:当两大 AI 巨头都说该踩刹车了
周六早上刷到一条多少有点魔幻的消息:Anthropic 的 CEO Dario Amodei 发了一篇长文,标题就叫《We Must Pace the Frontier》,直译过来是“我们必须给前沿降速”。而 OpenAI 那边的回应来得很快,Sam Altman 在 X 上公开说自己同意 Dario 的观点,行业确实需要为先进 AI 能力的发展设定节奏,这个话题近几周甚至成了 OpenAI 内部的主要讨论议题,他还承诺让独立评估者拿到员工级的访问权限,OpenAI 也会照做,很快会有更多消息分享。要知道这两位是全球 AI 竞赛里咬得最紧的对手,如今在同一个问题上站到了同一侧,这个画面放在三年前是没人敢想的。
Dario 这次没有停留在喊口号。他给出的方案里最实的一条,是邀请 METR 这样的第三方机构派员常驻公司内部,配上工牌、办公桌和笔记本,权限大体相当于内部风险评估团队,专门验证安全承诺有没有兑现、事故有没有被瞒报,Anthropic 已经单方面承诺执行,他说得也很坦率,这做法是照着银行里常驻监管员的模样描出来的。再往上,他呼吁民主国家的领先 AI 公司协调共同的安全标准,由美国政府出面提供反垄断上的狭窄豁免;最外一层则是尝试跟中国这样的国家谈一个最低限度的共识,比如禁止用 AI 制造生物武器,谈不拢也要谈。他反复强调降速不是停摆,哪怕只争取到一到两年时间用来做对齐研究,也能把严重事故的概率压低一大截。
有意思的是,应者并不孤单。OpenAI 的首席科学家 Jakub Pachocki 本月初就发过博文,直言还没有哪家公司把对齐和监控解决到可以全速狂奔的程度;连 Elon Musk 都在 X 上丢下一句“Dario 是对的”;再往前数,七月底有超过一千名 AI 公司员工联名请愿,呼吁建立国际机制来管控前沿模型,而 Anthropic 研究员 Jacob Coxon 本周的辞职风波,更是把公司内部的安全焦虑直接推上了台面。当然质疑声也没有停过,有评论认为这类提案本质上是监管俘获,头部公司把标准抬得越高,后来者要跨的门槛就越厚,这话说得刻薄,但未必没有几分道理。
把时间线拉长看,这场降速共识更像是被现实逼出来的补课。2023 年那份暂停训练的公开信刷屏时,大多数人把它当热闹看,签了名的各位该加速还是加速,因为那时的模型还困在聊天框里,慢下来确实没什么意义;可如今智能体已经能自己操作网页、接管表格,AI 构建下一代 AI 的能力肉眼可见地在变强,能力曲线和安全步调之间的缺口只会越拉越大。宣言和算力预算从来是两回事,下一轮融资报表和下一版旗舰模型落地的时候,“慢一点”究竟是转弯还是又一次重演,答案自然会浮出水面。