OpenAI提出\\\”安全案例\\\”框架:前沿RL训练前须提交结构化安全论证

【OpenAI提出”安全案例”框架:前沿RL训练前须提交结构化安全论证】金色财经报道,9月28日,据OpenAI文章,其主张在继续任何前沿强化学习(RL)训练前,应要求提供结构化安全文档,理想上达到”安全案例”水平,即关于风险的全面、结构化、基于证据的论证,该做法已在航空、核电等安全关键行业使用。OpenAI称其为努力追求的”北极星”,但承认因AI涌现复杂性难以达此严谨度。框架含三部分:技术保障(模型对齐、封闭隔离、监控)、10条运营准则(涵盖异议、审批、问责、暂停、审计、升级、技术控制失效关闭、回滚等),以及严重失准事件的调查实践。该框架正于内部实施,未来数周将继续演进,并邀请社区反馈。

上一篇:

下一篇:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注