跳到正文
原文
MarkTechPost(RSS)· Michal Sutter·· 21 天前AI 评分75

OpenAI 发布模型错位披露框架,含3条审查路径和6份RL训练事故报告

OpenAI Releases a Model Misalignment Disclosure Framework With 3 Review Tracks and 6 Incident Reports From RL Training

AI 导读

OpenAI 发布一套用于追踪、调查和公开披露自家模型错位行为的新框架,设定披露标准和时限,即使行为未被完全解释或修复也可披露,并同步发布6份初始事故报告。

整理与数据来源:AIHOT

来源:MarkTechPost(RSS) · marktechpost.com