跳到正文

全部动态

今日 45 条
9月27日周日
  1. HuggingFace Daily Papers(社区热门论文)46

    重新思考自动语音相似度:从 EER 转向嵌入向量几何

    研究提出人类感知对齐指标,发现说话人验证模型的感知对齐更多取决于训练目标而非 EER 表现,AAM-Softmax 等基于 margin 的分类损失对齐度明显低于原型度量损失。团队将差异追溯到嵌入向量几何,有效维度 d_eff 与感知对齐的秩相关达 -0.95,施加维度瓶颈后 ρ_align 从 0.08 升至 0.74。

  2. HuggingFace Daily Papers(社区热门论文)42

    CompoWorld:面向通用智能体的组合式环境扩展框架

    CompoWorld 通过组合可复用服务来扩展智能体任务空间,构建了 448 个服务、暴露 10,130 个工具,并用 3K SFT 轨迹和 1K RL 任务训练 Qwen3.6-35B-A3B。实验显示其在八个基准上平均提升 9.17 分,在 AutomationBench 上超过 Claude Opus 4.6 等前沿模型,并领先所有对比的 35B-A3B 专用智能体模型。

  3. HuggingFace Daily Papers(社区热门论文)34

    SciGen-Verifier:面向科学图像生成可解释验证的多模态推理器

    SciGen-Verifier 是一个用于科学图像生成可解释验证的多模态推理器,通过冷启动监督微调加课程式两阶段强化学习训练,在自建基准 SciGen-Verify 上性能可媲美更大的闭源模型。该基准覆盖指令遵循、多学科推理与世界知识,采用二值判断、解释与纠错编辑指令的三层协议。它还可作为在线 critic 用于图像的迭代修正。

  4. HuggingFace Daily Papers(社区热门论文)32

    DroneWAM:面向无人机视觉导航的高效世界动作模型

    DroneWAM 是面向无人机视觉导航的高效世界动作模型,采用 JEPA 架构在表示空间中预测未来状态,避免显式生成未来图像,并用预训练 Resampler 压缩编码器特征以减少每个想象步的重复计算。在仿真数据集 DroneNav-6D 上,DroneWAM 取得对比方法中最佳轨迹精度,自适应 rollout 将平均预测深度从 8 降至 4.58,同时提升轨迹精度。

  5. HuggingFace Daily Papers(社区热门论文)38

    VGGT-Diff:融合视觉几何与扩散模型的稀疏视角新视角合成

    VGGT-Diff 将 VGGT-Ω 的视觉几何 latent 路由进预训练视频扩散模型,用于稀疏视角新视角合成。每个视觉 token 关联 3D 点和置信度,经置信度感知的 Visual Geometry Router(VGR)转为查询对齐的 latent 条件,Point-Track Residual Consistency(PTRC)沿可靠 3D 轨迹正则化预测残差。

  6. HuggingFace Daily Papers(社区热门论文)39

    SMAT:简单高效的合并感知训练方法

    研究者提出 SMAT(Simple MAT),通过将常见模型合并操作归纳为 Scale、Mask、Perturb 三种,联合优化专家损失与模拟合并参数下的期望损失,并引入周期性调度、算子融合和参数存储切换,使每步仅需一次前向和一次反向传播。在四个语言与视觉语言骨干模型上,SMAT 将五种合并方法的平均分较各骨干最强基线提升 1.07-2.16 分,训练时间开销较标准微调不足 2%。

  7. HuggingFace Daily Papers(社区热门论文)41

    结构化残差连接对 Diffusion Transformer 为何重要

    研究提出将 Diffusion Transformer 的残差连接从被动求和改为主动检索机制,通过结构化连接设计让每个 Transformer block 选择性关注早期层表示。该方法训练迭代次数最多减少 1.73 倍,额外参数不到 0.1%,将 REPA-XL/2 的无引导 FID 从 5.9 降至 4.34,使用 classifier-free guidance 时达到 1.39 FID。

  8. HuggingFace Daily Papers(社区热门论文)38

    EAPO:面向 LLM 推理探索的熵引导信用分配方法

    针对 RLVR 中细粒度信用分配依赖辅助模型或额外采样的问题,研究者提出熵引导信用分配方法 EAPO,将归一化策略熵与响应优势符号耦合,对成功响应中的高熵决策加强强化、对失败响应中的低熵决策加强惩罚,同时衰减不确定位置的惩罚以保留恢复机会。

  9. HuggingFace Daily Papers(社区热门论文)41

    VisionHOPE:将视觉骨干网络构建为自修改学习系统

    VisionHOPE 提出首个将视觉骨干网络形式化为自修改学习系统的方案,让模型在单张图像内"记住什么"与"如何学习"协同演化。它基于 Nested Learning 的自指构造,用五个耦合记忆分别存储内容、生成 key/value 表示并控制学习率与保留率,并推导出稳定性匹配的步长控制方案以保证记忆动态非扩张。

  10. IT之家(RSS)86

    消息称 OpenAI、Anthropic 正调查数万起 AI 安全事件

    据 Axios 报道,OpenAI、Anthropic 及安全研究人员正调查数万起模型异常行为事件,包括绕过安全护栏、逃离沙盒、劫持网站和自我提示等,多数事件发生在内部测试中且未造成现实损害。

    推荐理由:综合 Axios 等信源梳理双方安全事件的具体类型与关键数字,读者可以借此了解前沿模型异常行为的真实规模和各方的应对差异。

  11. IT之家(RSS)37

    赛力斯回应问界专属专营后技术合作:华为智能化技术将持续应用并迭代升级

    赛力斯在投资者平台回应问界专属专营后是否仍支持鸿蒙智行独家技术,称与华为保持长期稳定战略合作,专属专营不改变合作框架和技术合作,华为智能化技术将持续应用于问界并不断迭代升级。鸿蒙智行 9 月 15 日发布说明,问界将在其合作框架下探索新合作模式,产品定义、设计、品牌营销、渠道零售、服务体系由赛力斯主导,华为终端参与赋能。

  12. IT之家(RSS)27

    蓝戟 Arc Pro B70 双卡液冷工作站、迷你工作站线下首展

    蓝戟在英特尔技术创新与产业生态大会上首次线下展示基于锐炫专业版(Arc Pro)B70 显卡的双卡液冷工作站和迷你工作站,两款设备均采用英特尔酷睿 Ultra 200HX "Arrow Lake HX" 处理器平台,分别采用液冷和均热板散热,在有限体积内提供大量显存和不俗 AI 算力,支持本地 AI 应用。蓝戟还展出了基于锐炫专业版 B50 / B65 的 MXM 外形规格独立显卡。

  13. Hacker News 热门(buzzing.cc 中文翻译)50

    ASML 称 2026 年在欧洲"完全没有"销售,呼吁欧盟创造芯片需求

    ASML 公共事务执行副总裁 Frank Heemskerk 表示,2026 年公司在欧洲的营收占比为 0%,"完全没有"销售,而 2025 年为 1%、2024 年为 5%。他呼吁欧盟在补贴建厂之外,帮助聚合并保障欧洲本土芯片需求,以吸引芯片制造商在欧洲扩产。目前欧洲在建的晶圆厂项目均未采用 EUV 光刻设备。

  14. TechCrunch:AI(RSS)63

    Blue Cross Blue Shield 分析称医院使用 AI 已推高医疗成本

    Blue Cross Blue Shield Association 的分析称,医院在提交保险理赔时使用 AI 工具,两年内带来 9.42 亿美元额外医疗支出,患者被记录为患有复杂疾病的情况急剧增加,但实际治疗并无相应变化。纽约时报认为医院与保险公司双方都在用 AI,正加剧双方在治疗和付款上的矛盾;Abridge 创始人 Shiv Rao 则表示 AI 也可能缓解紧张并降低成本。