【OpenAI提出”安全案例”框架:前沿RL训练前须提交结构化安全论证】金色财经报道,9月28日,据OpenAI文章,其主张在继续任何前沿强化学习(RL)训练前,应要求提供结构化安全文档,理想上达到”安全案例”水平,即关于风险的全面、结构化、基于证据的论证,该做法已在航空、核电等安全关键行业使用。OpenAI称其为努力追求的”北极星”,但承认因AI涌现复杂性难以达此严谨度。框架含三部分:技术保障(模型对齐、封闭隔离、监控)、10条运营准则(涵盖异议、审批、问责、暂停、审计、升级、技术控制失效关闭、回滚等),以及严重失准事件的调查实践。该框架正于内部实施,未来数周将继续演进,并邀请社区反馈。
原文链接:https://openai.com/index/towards-safety-cases-for-frontier-ai-training/
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。

