OpenAI推进对齐失败透明化:构建新型披露机制

据金十消息,9月5日,OpenAI表示,随着人工智能模型能力持续跃升,亟需扩大对对齐偏差事件的公开范围。公司指出,当前行业尚无统一标准用于报告模型在训练、评估及实际部署过程中发生的性能偏离问题。

制定标准化披露体系,填补行业空白

为应对这一挑战,OpenAI正着手设计一套系统性框架,旨在规范失配事件的识别、记录与对外通报流程,并计划在未来数周内正式对外发布相关草案。