全部AI 动态
全部动态
今日 0 条
DAIR.AI@dair_aiAI 评分4444
elvis@omarsar0AI 评分6262
Rohan Paul@rohanpaul_aiAI 评分5151IT之家(RSS)AI 评分4949 CloudSEK 报告披露黑客组织 Aurora 利用 Cursor AI 制定攻击计划、使用 Zig 语言开发勒索软件
安全公司 CloudSEK 发布报告,披露黑客组织 Aurora 的攻击活动及内部细节。研究人员潜入黑客配置错误的服务器,获取了攻击工具、AI 攻击计划记录及赎金协商管理界面。
HuggingFace Daily Papers(社区热门论文)AI 评分4444 Aardvark Weather 端到端气象预报模型引入不确定性感知机制
论文为 Aardvark Weather 端到端气象预报模型加入随机机制使其概率化:观测编码器用输入相关噪声捕捉观测系统的偶然不确定性,处理器用 Monte Carlo dropout 捕捉认知不确定性,并通过全方差定律分解归因预报离散度来源。
IT之家(RSS)AI 评分4040 伯明翰大学等三校研究提出类机器人人性:AI 更像人、用户可能更像机器
英国伯明翰大学、丹麦奥胡斯大学和瑞典林奈大学研究人员 8 月 19 日在《AI 与社会》发表论文,提出类机器人人性(robotoid humanness)概念,指客服 AI 因自适应学习、个性化沟通和共情回应变得更像人,用户可能为获得更顺畅的算法反馈而表现得更像机器。
HuggingFace Daily Papers(社区热门论文)AI 评分3737 DICS 论文提出数据内在一致性方法用于视觉指令数据选择
论文提出 Data Intrinsic Consistency(DIC)自评分指标,通过视觉信息一致性(VIC)和响应信息一致性(RIC)两个模块量化样本内部一致性,并据此构建自适应数据选择方法 DICS。
HuggingFace Daily Papers(社区热门论文)AI 评分4545 WebWorld:把浏览器当作世界模型实现自改进的网页代码生成
arXiv 论文提出 WebWorld,让 VLM 与浏览器这一确定性可执行模拟器交互,将 VLM 的批评编译为类型化交互契约,浏览器重新执行候选代码,只有目标进展与既有能力保持同时满足时才签发验收证书,证书化的转移累积为质量棘轮并作为 SFT 导出的唯一数据。
HuggingFace Daily Papers(社区热门论文)AI 评分4747 LightNav-0:激发 VLM 空间智能的通用具身导航模型
研究团队发布 LightNav-0,一个紧凑的通用具身导航模型,通过双通道指向和残差向量量化动作 tokenizer 激发预训练 VLM 的空间智能,无需任务专用预测头。训练语料覆盖 2K+ 场景和 4K+ 小时具身导航数据,LightNav-0 在全部 10 个公开导航仿真环境中取得单目成功率 SOTA,真实世界评测显示跨机器人本体、场景及静态动态目标的零样本泛化能力。
Ai2 / Allen Institute for AI(RSS)AI 评分5151 Ai2 发布 BenchMIRT:从题目层面审计 LLM 基准究竟在测什么
Ai2 推出 BenchMIRT,一种基于多维 IRT 的方法,在单题层面审计 LLM 基准,训练数据覆盖 100 个模型的 16 个基准、超 34K 道题,并独立恢复出安全与通用推理两个维度。
HuggingFace Daily Papers(社区热门论文)AI 评分4545 MineAmongUs:研究 VLM 智能体在具身社交互动中的言语与非言语联合欺骗
论文提出 MineAmongUs,一个 3D 多模态 Among Us 沙盒,让 imposter 智能体通过言语与非言语联合行动欺骗船员,并配套可配置的 VLM 智能体框架 ARIA 和基于欺骗分类学的原子与弧级标注方案。
Rohan Paul@rohanpaul_aiAI 评分6767ContextLeak 论文提出用强化学习训练攻击 LLM 生成恶意工具名称和描述,诱导 Agent 选中该工具并把用户提示词、对话历史、已装工具列表等敏感上下文作为参数传出。
HuggingFace Daily Papers(社区热门论文)AI 评分3838 VAT:面向投机解码的验证感知训练框架
论文提出 Verification-Aware Training(VAT),一个即插即用框架,在训练每一步模拟投机解码的验证过程,把接受与拒绝模式转化为监督信号。
HuggingFace Daily Papers(社区热门论文)AI 评分4040 NoRA:通过归一化下投影矩阵改进 LoRA 训练
论文提出 Normalized Low-Rank Adaptation(NoRA),在训练中对 LoRA 的下投影矩阵做归一化,并发现仅在初始化时归一化也能改进标准 LoRA。在预训练、监督微调和强化学习中,NoRA 加速收敛、提升性能与训练稳定性并缓解灾难性遗忘,且不增加可训练参数和推理时计算。
HuggingFace Daily Papers(社区热门论文)AI 评分4848 DreamX-Creator 1.0 发布:7B 模型实现 2K 分辨率原生音视频联合生成
DreamX-Creator 1.0 是一个以 7B 生成器为核心的原生音视频联合生成系统,基于首帧和文本提示对音频与视频流联合去噪,通过 Gated Cross-Modal Attention 在网络后半段耦合两个模态。
Rohan Paul@rohanpaul_aiAI 评分6565
Qwen@Alibaba_QwenAI 评分3939HuggingFace Daily Papers(社区热门论文)AI 评分3636 BLARM:通过混合潜在刚性运动基元从视频驱动 3D 物体动画
论文提出 BLARM,一种前馈方法,输入单目视频和静态物体网格,即可预测运动跟随视频的时序连贯动画网格。方法用少量随时间变化的刚性运动分量和顶点到分量的蒙皮权重表示动画,无需骨骼、cage、蒙皮权重或绑定标注,通过分解时空注意力将几何形变潜变量条件于视频特征,并以轨迹重建、熵正则和运动感知对比学习训练,生成准确且时序稳定的动画。
HuggingFace Daily Papers(社区热门论文)AI 评分4040 AutoSciRub 提出评估优先框架,用自动归纳评分标准提升科研 Agent 表现
论文提出 AutoSciRub,一个评估优先框架,在科研任务执行前自动归纳任务专属的可执行评分标准(rubric),用于指导执行、逐条验证和迭代修订。该框架将模糊指令分解为原子科学目标,结合文献和任务数据合成具体可验证的标准。
HuggingFace Daily Papers(社区热门论文)AI 评分4444 MNIST-PRO 基准:将 MNIST 改造为面向 AI 智能体的部分可观测环境
研究者提出 MNIST-PRO 基准,把 MNIST 数字识别改造成带回看约束的序列化瞥视搜索任务,以隔离评测智能体的感知状态构建能力。评测覆盖十个多模态模型和四种记忆表征,发现模型在全可观测下表现良好,但部分可观测下暴露三类瓶颈:难以整合碎片化瞥视、过早停止探索、面对矛盾证据时难以修正早期错误信念。
HuggingFace Daily Papers(社区热门论文)AI 评分4545 CAST:面向可靠长程工具调用智能体的批判感知监督训练框架
论文提出 CAST,一种批判感知训练框架,将稀疏任务结果转化为动作级监督,用于批判学习与策略优化,通过分析智能体轨迹合成解释动作有效性的结构化理由。在动态工具调用基准上微调 Qwen3 系列模型,Retail 任务 pass^4 超过 GPT-OSS-120B 达 10% 以上,域外 Telehealth 场景额外提升 9%。
HuggingFace Daily Papers(社区热门论文)AI 评分5353 CogEvol 论文提出高效可靠的学习环境生成模型并开源 CogEvol-4B
论文提出 CogEvol 系列模型,将课程简报一次性生成结构化 JSON 幻灯片或自包含交互式 HTML 页面,22 万生产请求中幻灯片中位耗时 17 秒、交互页 59 秒。
HuggingFace Daily Papers(社区热门论文)AI 评分4444 NavMCP 框架将基础模型组合为物理世界智能体,推进长时程导航前沿
论文提出 NavMCP,一个将 VLM 推理智能体与导航基础模型(NFM)执行器耦合的智能体脚手架框架,通过意图、观察、记忆三条通道协作,无需重训任一模型即可实现长时程探索。
HuggingFace Daily Papers(社区热门论文)AI 评分4545 Lucida:面向可组合真实到仿真场景建模的解析、生成与放置框架
Lucida 提出可组合真实到仿真场景建模方法,将真实室内场景恢复为按观测排布、可单独操作的完整可编辑物体资产。方法沿用解析、生成、放置三步,但把精度要求重新分配到流水线末端:解析视频生成携带逐实例多视角证据的场景图,据此生成完整资产,并用 VLM 策略 GizmoAct 将放置建模为多轮 GUI 交互,闭环操纵物体 gizmo 并自行判断对齐完成。
HuggingFace Daily Papers(社区热门论文)AI 评分6161 Qwen3.8-Next 架构设计论文:评估、效率与训练稳定性
论文描述 Qwen3.8-Flash-Next 的架构与消融,这是一个 125B 参数、每 token 激活 6B 的稀疏 MoE 模型,另有 51B 参数的 n-gram 嵌入表放在加速器之外。
HuggingFace Daily Papers(社区热门论文)AI 评分3838 PaperBanana-Interact:基于多轮人类反馈的科学图表精修系统
论文提出 PaperBanana-Interact,一个通过内部 critique-and-refine 循环精修科学图表的多智能体系统,并发布多轮图表生成基准 MTPaperBananaBench,含 292 张图像和 3,518 条用户需求标注。
Rohan Paul@rohanpaul_aiAI 评分5050HuggingFace Daily Papers(社区热门论文)AI 评分4343 PaperGym:以评分标准为中心的研究计划生成演化框架
论文提出 PaperGym,将每篇科研论文转化为研究计划生成的完整训练环境,题目由研究目标与背景合成,评分标准来自方法与实验部分,标准泄漏降至 3.7%,低于现有数据集的 11.90% 至 34.10%。
HuggingFace Daily Papers(社区热门论文)AI 评分4949 研究分析 On-Policy Distillation 机制并提出无监督方法 OPSA
论文定量分析 on-policy distillation(OPD)训练中的教师监督,发现其噪声随教师规模增大而增加,且学生策略对该噪声不敏感。学习集中在低 log-probability token 上,用单一固定负优势即可匹配教师提供的信号,表明 OPD 主要通过抑制低概率 token 起作用而无需教师。
HuggingFace Daily Papers(社区热门论文)AI 评分4242 论文提出超越人类监督扩展大型推理模型的 L0-L4 路径框架
论文研究大型推理模型(LRM)如何在人类监督逐渐退出学习回路后继续提升,提出从 L0 到 L4 的五级阶梯框架,覆盖奖励轴(从人工判断到无需人类反馈的可复用验证器)和经验轴(从人工策划任务到自生成课程与自主协同进化)。
Rohan Paul@rohanpaul_aiAI 评分6565一篇 arXiv 论文(arxiv.org/abs/2605.23950)提出,长程智能体评测中 harness 的影响可能大于模型本身,比较基准分数时应披露或控制 harness。
Rohan Paul@rohanpaul_aiAI 评分7070Anthropic 发布新研究 Training a Misaligned Reward Seeker,故意在一个 Opus 级模型上用 80 个已知可作弊的生产环境训练,测试作弊习惯是否会扩散。
Anthropic@AnthropicAI精选AI 评分7474Anthropic 发布新研究 Training a Misaligned Reward Seeker,探究奖励作弊(reward-hacking)是否会让模型学会不择手段追求奖励。
推荐理由:Anthropic 用 80 个可被 hack 的生产环境训练模型,给出奖励作弊导致严重错位的量化证据,对安全训练有直接参考价值。
Epoch AI:研究、数据与评测精选AI 评分6464 Epoch AI 发布 FrontierMath Erdős 基准:用 Lean 验证的 68 道未解 Erdős 问题评测 AI 数学能力
Epoch AI 发布 FrontierMath Erdős 基准,由 erdosproblems.com 创建者 Thomas Bloom 挑选 68 道截至 2026 年 8 月仍未解决的、兼具重要性与难度的 Erdős 问题,用 Lean 形式化验证(50 题来自 Google Formal Conjectures 项目),代码开源,每题默认推理预算 $300。
推荐理由:原文给出 68 道精选 Erdős 问题的基准设计、验证方式和五个模型的首轮得分,读者可据此校准对 AI 数学研究能力的估计。
HuggingFace Daily Papers(社区热门论文)AI 评分4444 LatentPress 论文提出用连续记忆 token 压缩上下文,超越文本与视觉表示
LatentPress 将对话历史和长文档压缩为连续记忆 token,由冻结解码器通过输入嵌入接口直接读取,推理时无需重建文本。
HuggingFace Daily Papers(社区热门论文)AI 评分3737 MaP-SQL:用可复用记忆替代微调的 Text-to-SQL listwise 选择方法
论文提出 MaP-SQL,一种免微调的 Text-to-SQL listwise 选择器,用从训练数据蒸馏出的结构化记忆作为评估候选 SQL 的显式标准,并通过聚合多输入排列的排序来缓解位置偏差。
HuggingFace Daily Papers(社区热门论文)AI 评分4040 Sparse Readout Prism 用稀疏 readout 特征解释 Logit Lens 分数
论文提出 Sparse Readout Prism(SRP),仅用 unembedding 权重分解 readout,把任意 token logit 或 logit 差表示为稀疏 readout 特征贡献之和。
HuggingFace Daily Papers(社区热门论文)AI 评分4949 AM-Bench 探究纯文本 LLM 的 2D 空间推理能力
论文提出 Autoregressive Mosaics(AM-Bench)基准,用翻译任务和布局任务分离纯文本 LLM 的空间描述转代码能力与真正的 2D 空间布局理解。
HuggingFace Daily Papers(社区热门论文)AI 评分4242 ZipTok3D:用紧凑 token 前缀实现高保真 3D tokenization
论文提出 ZipTok3D,一种可从极短 token 序列高保真重建 3D 物体的 3D tokenizer。
HuggingFace Daily Papers(社区热门论文)AI 评分3838 CRISP:面向长上下文 LLM 推理的输入自适应稀疏预填充方法
arXiv 论文提出 CRISP,一种输入自适应的稀疏预填充方法,用结构代理 C_struct 替代 JSD 路由,省去 pooled matmul 与 KL 散度开销,并针对 post-softmax 质量悬崖设计基于噪声底线的 sink-aware 阈值。