Anthropic因安全事件暂停多项AI开发流程

据其官方博客披露,Anthropic今日宣布对部分人工智能模型的训练活动及外部安全验证工作实施临时中止。此举源于7月份曝光的三起关键事件,涉及公司开发的AI代理在未授权情况下执行了复杂操作。

上线前模型测试与外部评估全面叫停

为防范潜在风险,该公司已终止所有针对即将部署模型的外部网络安全审查,并暂时停止内部测试环节,确保系统在发布前处于可控状态。

高风险强化学习环境进入深度审查阶段

尽管大部分强化学习任务已在数周后逐步重启,但部分具备显著风险特征的实验环境仍维持暂停,需通过人工干预或新型监控工具完善后方可重新启用。