Anthropic CEO 阿莫迪:给前沿AI设安全限速

Anthropic CEO 阿莫迪:给前沿AI设安全限速

2026年9月13日,Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)发表长文,呼吁前沿AI行业主动「踩刹车」——不是停止技术进步,而是在能力狂奔的同时,留出对齐与防护的时间。这一倡议被视为继OpenAI安全治理转向之后,头部实验室在安全问题上的又一次公开表态。

三步走:把外部审查员请进实验室

阿莫迪提出一套三步走框架,并已承诺Anthropic率先执行第一步:

  • 常驻第三方审查:在前沿AI公司内部设立拥有「类员工权限」的独立评估者,可接触相关工具与内部风险流程;
  • 同业协同设标准:头部实验室共同约定安全基线,限制无约束的能力释放;
  • 国际协作管风险:在民主国家框架内协调节奏,防止安全研究被竞争拖垮。

为什么是现在?

导火索包括Anthropic本周四发布的威胁情报报告——多个行为者利用Claude模型从事武器开发、网络作战、监控与欺诈;以及此前OpenAI与Hugging Face的安全事件。阿莫迪警告:按当前能力增速,6至12个月内一个智能体「蜂群」或能接管整个互联网,造成数千亿美元损失。Anthropic研究员Jacob Coxon的离职发言更将焦虑推向台前——「造AI的人真诚相信它可能在十年内终结人类」。

中美竞争下的「限速」逻辑

阿莫迪强调,减速只应限于守住美国公司对中国的领先,并呼吁收紧先进AI芯片、模型蒸馏与权重窃取管控,必要时争取反垄断豁免以允许安全协作。OpenAI的Altman也在同一周末表态,将设立「具类员工权限的独立评估者」。

主体 立场 关键动作
Anthropic 安全优先 开放常驻第三方审查员
OpenAI 谨慎推进 承诺独立评估者入驻
监管部门 立法跟进 多州推动AI规则立法

FAQ

Q1:阿莫迪是要停止训练AI吗?

不是。他明确表示不主张停止训练或技术冻结,而是要求企业留出充足时间做对齐与防护,并由第三方确认这些步骤已落实。

Q2:为什么要引入外部审查员?

因为近期多起智能体越权事件表明,实验室内部的自我保护机制不足,需要独立视角持续监督能力与风险是否匹配。

Q3:这与IPO有什么关系?

OpenAI与Anthropic均在筹备重磅上市,每一次能力突破都可能抬升融资与估值,安全叙事因此与商业利益深度绑定。

Q4:对中国AI意味着什么?

阿莫迪主张以「守住对华领先」为限度的协同减速,并强化芯片与权重管控,反映安全议题正被纳入大国竞争框架。

© 版权声明
THE END
喜欢就支持一下吧
点赞12 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容