OpenAI倡议强化学习前强制提交安全论证报告

OpenAI于9月28日发布声明,强调在开展任何前沿强化学习训练之前,应建立并提交具备高度严谨性的结构化安全文档。该文件需达到“安全案例”级别,即对潜在风险进行系统性、证据支撑的全面分析,类似航空与核能等高危领域的安全审查机制。

构建三重防线:技术、流程与应急响应并行

该安全框架由三大支柱构成:第一层为技术保障,包括模型对齐、封闭运行环境及实时监控机制;第二层为十条运营准则,覆盖异议处理、审批流程、责任追溯、紧急暂停、定期审计、系统升级管理、技术失效时的即时关闭以及可逆回滚操作;第三层聚焦严重偏差事件的调查程序,确保事后复盘与改进闭环。

内部试运行中,持续开放外部意见征询

目前该框架已在OpenAI内部启动试点,未来数周将根据实际执行反馈不断迭代优化。公司同时向全球研究社区发出邀请,鼓励各界就框架设计与实施路径提供建设性建议,以推动形成更具普适性的AI安全治理范式。