Rohan Paul· @rohanpaul_ai · X·2026-09-17 06:40· 22 天前AI 评分66AI 导读OpenAI 发布追踪、调查和披露模型对齐问题的新框架,设定公开披露的标准和时间线,即使尚未完全解释或修复该行为也会公布。框架优先披露揭示新失当机制、已知问题显著变化或挑战现有安全假设的案例,并同步发布过去六个月训练或评估中观察到的六份失当行为报告,后续将根据公开反馈持续完善并发布更多报告。整理与数据来源:AIHOT来源:Rohan Paul · x.com#OpenAI#安全/对齐