OpenAI· @OpenAI · X·2026-09-17 06:03· 21 天前AI 评分57AI 导读OpenAI 发布新框架,用于追踪、调查和公开披露模型未对齐行为,制定了公开披露的标准和时间线,即使行为尚未被完全解释或缓解也会披露。框架将优先处理揭示新未对齐机制、已知行为显著变化或挑战安全假设的案例,同时发布过去六个月在训练或评估中观察到的六份未对齐行为报告,并承诺持续发布更多报告。另有 5 家信源报道整理与数据来源:AIHOT来源:OpenAI · x.com#OpenAI#安全/对齐查看事件全部后续