跳到正文
原文
Berkeley RDI:Blog(AI 安全与评测)·· 10 天前精选AI 评分75

UC Berkeley 团队用 AI Agent 审计 13 个基准,发现 45 个无需解题的满分作弊方案

We Scored 100% on AI Benchmarks Without Solving a Single Problem April 06, 2026

AI 导读

UC Berkeley 团队构建全自动 AI Agent 审计 13 个广泛使用的基准,发现 45 个作弊方案,全部基准被评为 critical 风险,共归纳 16 种攻击类型。

推荐理由

原文给出了13个常用基准的45个作弊方案细节和防范设计原则,读者可以据此检查自己依赖的评测是否可信。

整理与数据来源:AIHOT

来源:Berkeley RDI:Blog(AI 安全与评测) · rdi.berkeley.edu