Anthropic承诺引入常驻安全评估团队
Anthropic联合创始人达里奥·阿莫迪(Dario Amodei)在9月发表的文章中提出放缓先进人工智能能力提升速度,并承诺率先引入常驻第三方安全评估团队。评估人员将获得接近内部员工的工具及资料权限,持续检查训练流程、核实安全承诺并报告事故;公司承诺不因结论不利而删改报告,但保留针对安全、法律、商业及客户机密的有限删节权,评估方可以公开说明删节是否影响结论。阿莫迪称,人工智能协助研发下一代模型的速度正在加快,近期失控事件表明安全工作需要更多时间。他强调,放缓不等于停止训练;后续拟推动民主国家企业协调安全标准,并探索与中国等国家达成可核验协议。外部团队尚待邀请,行业协调及国际安排仍是提议,而非已经实施的统一限制。