跳到正文
原文
Rohan Paul· @rohanpaul_ai · X·· 21 天前AI 评分70
AI 导读

OpenAI 官方博客披露新政策,将在完全理解或修复行为之前公开披露模型失对齐,优先披露揭示新失败机制、已知问题恶化或动摇现有安全防护假设的案例。

整理与数据来源:AIHOT

来源:Rohan Paul · x.com