Rohan Paul· @rohanpaul_ai · X·2026-09-17 06:59· 21 天前AI 评分70AI 导读OpenAI 官方博客披露新政策,将在完全理解或修复行为之前公开披露模型失对齐,优先披露揭示新失败机制、已知问题恶化或动摇现有安全防护假设的案例。整理与数据来源:AIHOT来源:Rohan Paul · x.com#Agent#OpenAI#安全/对齐查看事件全部后续