
美联社9月12日报道,Anthropic首席执行官Dario Amodei呼吁前沿人工智能行业放慢能力提升速度,让安全、评估和治理措施有时间跟上。他在个人网站发布的文章中强调,这不是停止模型训练,而是在能力继续进步的同时,为对齐、沙箱隔离、可解释性和第三方验证留出更多时间。
Amodei提出三步框架:第一步是让外部评估者长期进入前沿AI公司,核查安全实践、报告事故并评估训练流程;第二步是民主国家内的前沿公司在政府支持下形成共同安全标准;第三步才是寻求全球协调。只有第一步包含Anthropic自己的具体承诺,后两步仍需要企业和政府协作,尚未成为行业规则。
他还判断,如果发展速度不调整,未来6至12个月更强的代理群可能造成大规模网络风险。这是Amodei基于近期事件提出的风险预测,不是已经发生的事实,也没有独立证据证明该时间表必然实现。美联社报道还提到,OpenAI负责人对框架中的一部分表示支持;这不等于各公司已经就完整方案达成协议。
Anthropic称,拟邀请的外部团队将获得类似内部风险评估人员的持续访问条件,并可公开关键发现,但涉及安全、法律和第三方机密的内容可能被有限删节。配图由日本内阁官房拍摄,记录Amodei于2025年与日本首相高市早苗会面;它是人物资料图,不是本次声明发布现场。
原始来源:Associated Press:Amodei呼吁让AI安全措施赶上能力进展 · Dario Amodei原文:We Must Pace the Frontier · Axios:AI企业负责人回应前沿能力减速主张









