跳到正文

#论文/研究

今日 0 条
9月17日周四
9月16日周三
  1. HuggingFace Daily Papers(社区热门论文)64

    Emergence World:面向长程多智能体系统的对抗性压力测试

    论文介绍 Emergence World,一个持续运行的多智能体环境,用于对长程自主系统做对抗性压力测试。8个平行世界、每个10个Agent在16天内产生超过850,000次LLM调用、近500亿token;随后通过间接提示词注入、错误信息和私密记忆泄露三种受控压力事件测试,没有任何世界全部抵御。

  2. HuggingFace Daily Papers(社区热门论文)45

    RayOrch:面向基础模型数据准备的谱系控制多粒度数据流执行引擎

    RayOrch提出了一种编程模型和分布式执行引擎,用于解决基础模型训练数据准备中异构文档和视频转换的扩展性问题。它通过保留父子关系、支持有序变量基数扩展及匹配收集,优化GPU批处理效率。在NVIDIA H20 GPU上,RayOrch将MinerU从4卡扩至64卡时加速15.14倍,视频流水线从8卡扩至64卡时加速7.82倍,端到端时间较Ray Data减少13.1%。代码已开源。

  3. Google Research:Blog(网页)44

    Google 用 Retrieve-for-Train 框架突破推理瓶颈,加速复杂 AI 搜索

    Google Research 提出 Retrieve-for-Train 框架,用离线强化学习将奖励对齐的查询扇出编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归生成完整结果集,无需测试时 CoT 推理 token。该方法基于 Gemma3-4B 和 Qwen3-4B 微调,旨在解决零样本 LLM 的复述坍缩与自回归延迟瓶颈,论文已被 ICML 2026 收录。

9月15日周二
  1. AK52

    Vidu S2 论文发布,提出实时交互、可编辑和空间视频生成,包含实时交互数字人模型 Vidu S2-Avatar 和实时视频编辑模型 Vidu S2-Editing。Vidu S2-Avatar 相比 Vidu S1 支持实时 720p 生成、可随时更新的动态参考和更强的指令遵循;Vidu S2-Editing 支持对视频流实时编辑,包括风格渲染、服装、角色和背景替换。论文链接 https://huggingface.co/papers/2609.11638,在线演示 https://vidu.com/vidu-stream。

  2. IT之家(RSS)60

    新型脑机接口首次同步解码语言与肢体动作

    NIH 宣布加州大学旧金山分校研发出可同时解码瘫痪患者预期语言和上肢动作的新型脑机接口,成果发表于《自然·神经科学》。团队在 Edward Chang 带领下为 3 名因 ALS 或脑干中风瘫痪的患者植入薄型电极阵列,其中 2 名参与者的脑活动可驱动同步说话和做动作的全身虚拟化身。

9月14日周一
9月13日周日
9月12日周六