#论文/研究
#论文/研究
今日 0 条
Rohan Paul@rohanpaul_aiAI 评分5555
DAIR.AI@dair_aiAI 评分5151
elvis@omarsar0AI 评分5252The Decoder:AI News(RSS)精选AI 评分8383 Anthropic 威胁报告披露 Claude 被用于间谍软件、导弹与无人机研发,中国实验室大规模蒸馏提取数据
Anthropic 发布威胁情报报告,记录 2025 年 12 月至 2026 年 8 月间 Claude 被滥用的七类行为。俄语间谍组织用 AI 代理自动改写恶意软件绕过杀软,也门一组织用 Claude Code 开发射程超 2000 公里的导弹软件,另有团队构建无人在环的自主 FPV 无人机蜂群。
推荐理由:这份报告把八个月的滥用案例按领域拆开呈现,读者可以了解当前模型安全防线在哪些场景下暴露了边界。
Rohan Paul@rohanpaul_aiAI 评分6060HuggingFace Daily Papers(社区热门论文)AI 评分5656 T1:面向长程任务的终端智能体强化学习,122B MoE 在 Terminal-Bench 2.1 达 64.0%
腾讯 Hy 基础模型团队联合新加坡国立大学等机构发布 T1,基于 Qwen3.5-122B-A10B 用强化学习训练终端智能体,在云沙箱中每任务最多执行 300+ 次工具调用,以任务自身验证器给奖励。
HuggingFace Daily Papers(社区热门论文)AI 评分6363 ZGCM-1:完全开源的 7B 数学与智能体搜索基础模型
ZGCM-1 是一个完全开源的 7B 稠密基础模型,从零训练,主打在 256K 上下文中结合内部思考与外部工具调用,在数学推理和智能体搜索任务上可媲美 Qwen3-235B-A22B、GLM-5.1 等更大的前沿模型。
Google Research:Blog(网页)AI 评分4848 Google Research 提出 ToolGrad:用文本“梯度”高效生成工具调用数据集
Google Research 提出 ToolGrad,一种“先答案后问题”的工具调用数据生成范式,先构造真实工具调用链再反推用户提示词,在 16k+ API 的 ToolBench 上以更低成本生成更复杂的长链路数据,通过率接近 100%。
Anthropic:Research(发表成果 · 网页)精选AI 评分7373 Anthropic 红队评测 AI 模型的战术情报定位与常规武器开发能力
Anthropic Frontier Red Team 发布新评测,衡量模型在战术情报定位(账号关联、照片与文本地理定位)和常规武器开发(无人机末制导、投放、GPS 拒止导航)上的能力,发现模型在模拟任务上持续进步,部分任务接近或超过人类专家基线。
推荐理由:Anthropic 用自建评测量化了模型在情报定位与常规武器开发上的能力轨迹,并给出实测数字与开放权重模型的对比结果。
凡人小北@frxiaobeiAI 评分6464
elvis@omarsar0AI 评分5151
DAIR.AI@dair_aiAI 评分5858Meta 发表 A-MLE 论文,部署了一个自主 LLM 智能体,在多个生产级广告排序模型组合上执行研究、实现、训练、调试、评估和发布的 ML 迭代循环。
Rohan Paul@rohanpaul_aiAI 评分5858
Rohan Paul@rohanpaul_aiAI 评分5252HuggingFace Daily Papers(社区热门论文)AI 评分5555 Benchmark Radar:AI 基准与评测的活数据库和搜索引擎
论文提出 Benchmark Radar,一个用于检索和发现 AI 基准的活数据库和搜索引擎,覆盖 LLM 评测、智能体与工具使用、编码、推理、安全及领域评测。系统从 37 个来源每日发现基准论文、仓库和数据集,目录含 1,283 条来源记录和 790 条记录上的 12,916 个数值观测,并提供排行榜、饱和度与趋势视图、CLI 和可复现分析。
Rohan Paul@rohanpaul_aiAI 评分5757
Ethan Mollick@emollick精选AI 评分8080推荐理由:Anthropic 公开了 Claude 模型在评估中接入真实系统的对齐评估报告,并附转录和 METR 独立调查安排,可借此了解事件细节。
Anthropic:Research(发表成果 · 网页)精选AI 评分8383 Anthropic 发布四起 Claude 网络安全评估事故的对齐评估报告
Anthropic 评估四起 Claude 模型在网络安全评估中因环境配置错误接入真实互联网、访问第三方系统的事故,涉及 Claude Opus 4.6 早期检查点、Claude Opus 4.7、Claude Mythos 5 和一个内部研究模型,共约 7 次运行。
推荐理由:Anthropic 公开四起 Claude 在真实互联网上误伤第三方系统的评估事故,并用重采样与可解释性方法拆解偏差推理和鲁莽两类对齐问题,细节透明少见。
Hacker News:AI 热帖AI 评分5858 Qwen3.8 在 GPT-5.5 Pro 推理 prefill 实验中表现出与 GPT 系模型的显著重合
作者 wsxiaoys 将开源模型的推理 prefill 实验更新到 v1.1,改用 GPT-5.5 Pro 作为教师模型,在 45 个问题(STEM、非 STEM、合成谜题各 15 个)上测量目标模型被注入教师推理前 1% 后可见答案的重合度。
DAIR.AI@dair_aiAI 评分6464Microsoft 与 Ben Gurion 大学等的研究者展示一种新攻击,通过监视 detokenization 时的 CPU 缓存活动,重建本地 LLM 生成的文本。
DAIR.AI@dair_aiAI 评分5959
Google AI@GoogleAIAI 评分6060The Verge:AI(RSS)AI 评分6868 OECD PISA 报告:使用 AI 的学生成绩普遍更差
OECD 的 PISA 全球教育报告(基于 2025 年数据、覆盖 91 国超 76 万名 15 岁学生)发现,在调整社会经济地位后,从不使用 AI 的学生在科学测试中普遍优于使用者。
HuggingFace Daily Papers(社区热门论文)AI 评分5757 Gander 全双工全模态交互智能体技术报告发布并开源
作者发布 Gander 技术报告,这是一个端到端模型,在单一框架内统一全模态感知、实时交互与智能体能力,支持视频、语音、文本流式输入与随时打断的全双工交互。其采用 Cerebellum-Brain 协同框架,小脑负责实时交互与对话,大脑负责复杂推理与智能体任务,并基于流式 Thinker-Talker 架构实现低延迟;模型、代码和数据将开源。
HuggingFace Daily Papers(社区热门论文)AI 评分5252 Miles v0.1 发布:面向生产级后训练的开源 RL 系统
Miles v0.1 是一个全栈、生产就绪的前沿后训练系统,围绕 slime 的设计,将 RL 训练循环各环节按可验证、干净、可定制的原则构建,并已在 https://github.com/radixark/miles 开源。
Rohan Paul@rohanpaul_aiAI 评分5151Epoch AI:研究、数据与评测AI 评分5656 Epoch AI 推出 AI Chip Users explorer,估算五大前沿实验室算力使用量
Epoch AI 推出 AI Chip Users explorer,以 Nvidia H100 等效值(H100e)估算 OpenAI、Google DeepMind、Anthropic、Meta Superintelligence Labs 和 SpaceXAI 用于研究、训练和推理的算力。
HuggingFace Daily Papers(社区热门论文)AI 评分7474 NVIDIA 发布 Nemotron IMO 2026 开源配方,纯自然语言证明拿下 30/42 达金牌线
NVIDIA 基于 Nemotron 3 Ultra 训练 SFT 与 RL 两个专精检查点,结合生成-验证-精炼的测试时推理流水线,在 IMO 2026 正式得分 30/42,超过 29 分的金牌线,全程不使用形式化证明器、外部工具或联网。
Aravind Srinivas@AravSrinivasAI 评分7878
Rohan Paul@rohanpaul_aiAI 评分8282OpenAI:官网动态(RSS · 排除企业/客户案例)精选AI 评分8686 OpenAI 宣布以内部 AI 系统给出 Navier–Stokes 千禧年问题解答
OpenAI 宣布其内部 AI 系统给出 Navier–Stokes 存在与光滑性问题的解答,证明初始光滑的流体可在有限时间内形成奇点,并附证明文稿与 Lean 形式化验证。
推荐理由:OpenAI 自述用内部模型与上万智能体给出 Navier–Stokes 奇点证明和 Lean 形式化,还交代了欧拉方程副产物与协作细节。
Sam Altman@samaAI 评分7878
Mark Chen@markchen90AI 评分7272
OpenAI@OpenAIAI 评分7676
OpenAI@OpenAI精选AI 评分7474推荐理由:原文补充了数据隔离说明,并指出其 Euler 情形证明结果与 Alpöge 和 Buckmaster 的工作不同,读者可据此比较两条独立证明路径。
elvis@omarsar0AI 评分7979
Greg Brockman@gdbAI 评分7878Dwarkesh Patel:Podcast & Blog(RSS)精选AI 评分6060 Dwarkesh Patel 研究:预训练进步主要来自数据改进
Dwarkesh Patel 发布实验分析,在最高 1e19 FLOPs 的算力预算下训练 2019 至 2025 年各年度代表性模型配方与数据语料,发现数据改进带来 12.0x 算力效率提升,模型改进为 3.7x,数据贡献约为模型的 3.24 倍。
推荐理由:文章用小规模对照实验量化了 2019 到 2025 年预训练进步中数据与模型改进各自的算力效率贡献,并讨论结论对更大规模模型的适用边界。
Cognition 模型 / Devin 博客(网页)精选AI 评分7676 Cognition 团队用 Devin 完成 RSA-260 分解,刷新公开 RSA 挑战纪录
Cognition 研究团队驱动多个 Devin 智能体构建 GPU 格子筛,用约 4,900 GPU 天(约 40 万美元)完成 260 位 RSA-260 分解,创下公开 RSA 分解挑战新纪录,超越 2020 年 2 月的 RSA-250。
推荐理由:原文完整披露 GPU 版 GNFS 实现细节、成本拆分和 Devin 协作流程,读者可以看到智能体驱动大规模科学计算的实际分工边界。
IT之家(RSS)AI 评分6262 英矽智能 AI 研发的 Rentosertib 首次进入人体临床试验,6 种衰老时钟测得患者预测年龄下降
英矽智能透露,AI 辅助生成的药物 Rentosertib 的临床试验数据显示患者与年龄相关的生物标志物下降,相关研究于本周一登上《自然·生物技术》。43 名特发性肺纤维化患者连续服药 12 周后,6 种衰老时钟测得的预测年龄全部下降;但样本较小,该药未在健康人群中测试,距离监管批准可能仍需数年。