跳到正文
原文
OpenAI:官网动态(RSS · 排除企业/客户案例)·· 10 天前AI 评分55

OpenAI 提出前沿 AI 训练安全案例框架的初步准则

Towards safety cases for frontier AI training

AI 导读

OpenAI 发布安全文档框架提案,主张前沿强化学习训练在开跑前应准备结构化的安全案例。文中给出三类初步准则,包括对齐训练与遏制监控等技术保障、异议与审批等运营流程,以及错位事故的调查与公开披露做法,并表示这些实践正在 OpenAI 内部实施且欢迎社区反馈。

整理与数据来源:AIHOT

来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · openai.com