9 月 12 日,Anthropic 首席执行官达里奥·阿莫迪发表长文,呼吁人工智能行业主动放缓模型能力提升速度,为安全研究争取时间窗口。阿莫迪在文中提出由第三方嵌入式评估、行业内部协调以及全球协调三个层次组成的安全框架,并建议在前沿模型发布前引入独立评估员机制。
阿莫迪指出,随着递归式自我改进(RSI)技术加速发展,叠加近期出现的 AI 智能体网络攻击等安全事件,若各实验室继续以当前速度推进能力迭代,可能在未来 6 至 12 个月内带来大规模风险。此前 OpenAI 首席科学家雅库布·帕乔基也曾公开表示,目前没有任何一家 AI 实验室的对齐与监控能力足以支撑无节制的快速扩张。
值得关注的是,OpenAI 首席执行官山姆·奥尔特曼随后转发了阿莫迪的观点,并表示 OpenAI 也将引入拥有员工级权限的独立评估员。马斯克则罕见地回应称阿莫迪说得对。三家头部 AI 实验室负责人罕见地在安全问题上形成共识,但涉及商业竞争与全球协调,相关承诺能否真正落地仍面临挑战。
【AICOR 点评】前沿 AI 实验室开始公开讨论减速并建立第三方评估机制,标志着模型能力提升与安全验证之间的张力已到了不可忽视的程度。但减速呼吁与商业竞争之间存在根本矛盾:谁能减速、谁先减速、如何验证对方是否真的减速,都是难以回答的问题。对中国企业而言,这一讨论提示我们在追赶前沿能力的同时,必须同步建立独立的对齐评估能力,而非仅依赖海外厂商的自我约束。
版权声明 本文由 AI 辅助整理,基于公开报道转写,信息版权归原作者及原媒体所有;内容仅作行业信息分享,不构成任何投资或商业建议。
如涉版权问题,请联系 AICOR(400-601-8080 / 微信 aicor-ai),我们将在收到通知后及时处理。