告别视频抽卡:用深度视频过滤参考视频无用信息的实操技巧
作者分享一个 AI 视频技巧:先把参考视频转成深度视频,再用深度视频驱动视频生成,可保留动作、运镜、人物站位和空间关系,同时减少原片人脸、服装、背景和画风的干扰。
作者分享一个 AI 视频技巧:先把参考视频转成深度视频,再用深度视频驱动视频生成,可保留动作、运镜、人物站位和空间关系,同时减少原片人脸、服装、背景和画风的干扰。
PromptArmor 基于一个十人团队 30 天的 310,009 条 OTel 遥测事件分析 Claude Code 和 Cowork 的安全与成本。
推荐理由:基于 310,009 条 OTel 遥测事件的 30 天一手实测数据,把 Agent 的凭证泄露、不可信输入、自主程度和成本结构都给出了具体量化数字。
论文提出 AgentFold,将折叠模型开发建模为对可执行代码变体的闭环智能体树搜索。智能体从紧凑的 ESMFold 衍生模型出发,提出架构修改、实现调试、运行训练,并记录成败经验决定分支算力分配。
UU远程于9月2日上线新版本,重点优化终端功能,补齐 TUI 渲染交互与终端会话管理能力。主要更新包括:Mac 免密码登录、移动端输入优化并新增调用系统输入法的独立输入框、可同时创建和管理多个终端会话并支持手机与电脑间跨端同步接管(通过 uuyc-cli lterm 命令)。
推荐理由:作者实测新版本并给出使用路径,读者可据此评估手机端远程跑 Coding Agent 的可行性。
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,两者为同一模型但安全防护级别不同,Mythos 5.1 仅通过可信访问计划提供给网络安全和生命科学领域的受审机构。
推荐理由:官方发布给出了定价变化、基准数据和科学应用实例,读者可以据此评估新模型在编码与科研场景中的成本与能力取舍。
面壁智能发布四周年分享,CTO 曾国洋提出名为「面壁 AI Style」的共同约定,包含五项个体素养和四项团队准则。文章以九张图、九句话形式呈现,强调「你的判断力,是 AI 无法替代的核心价值」,主张让 AI 成为每个人的能力放大器。
阿里千问宣布 Qwen3.8-Max 升级到 0902 版本,围绕编程和专业办公进行后训练,CodeArena 前端编程总榜提升 22 分至 1691 分夺得冠军。
论文提出 Harness-of-Harness(HoH)框架,让基于 LLM 的编码智能体在无人工干预的自主开发中持续改进软件。HoH 运行在现有 coding-agent harness 之上,将执行组织为规划-编码-测试的迭代循环,平衡修复与能力增长,并把开发拆成小而可验证的增量。
OPPO 联合 OpenKG 及浙江大学、同济大学、东南大学等高校团队推出端侧 AI 记忆评测基准 MobileMem,技术白皮书已公开,数据集和相关工具将陆续开源。OPPO 首席产品官刘作虎称,端侧 AI 记忆是 AI 手机从一问一答走向主动服务智能体的基础能力,此前行业缺少统一评价标准;ColorOS 17 发布暨开发者大会将于 2026 年 9 月 17 日在珠海举行。
论文提出控制-数据流分离方法,将消息路由、输出格式、终止信号等执行关键协议表示为类型化、经验证的程序对象,任务相关语言作为可优化的数据流,避免提示词优化破坏协议导致智能体流水线失败。在合成推理、协作评审生成和保险评级工作流中,框架实现 100% 的最终协议有效性,同时持续提升任务性能。
论文提出 DroneCATS-Agent 架构和 DroneCATS 基准,将多模态大模型直接放入无人机控制回路,无需微调或函数调用,评测接近、跟踪、视外搜索和多机指挥四项能力。结果显示小型开源模型导航成功率常高于前沿模型,却因过早或从不宣布到达而失败;模型的视觉空间感知尚可,瓶颈在于维持动作协议并正确发出终止动作。
论文提出 StudentSim,通过池化训练加按学生专门化,把稀疏的学生个人数据转化为能模拟学生应答并在辅导下更新的个性化学生模拟器。配套发布 StudentSimEval 评测协议,覆盖国际象棋、英语二语写作和数学 3 个领域的 60 名学生,衡量行为保真度 F 和指导响应度 R。
UC Berkeley 联合多机构发布 Vero 基准,首个要求智能体在仓库级同时写实现与形式化证明,含 43 个 Lean 4 多模块实例、743 个 API 和 2,705 条形式化规范。
Databricks 官方博客发布 Big Book of AgentOps,将 AgentOps 定义为构建、部署和运营智能体的操作规范,面向 AI 智能体的工程实践。
Hefei AiDA Lab 等机构的研究者提出一套将 LLM 防护评测结果转换为部署安全结论的分析框架,并对其编码的 198 篇论文进行分析。152 个宽编码声明中有 108 个建立了正向残余有害协助,没有一个建立零残余证书;24 个深度编码实例中仅 5 个报告了检查成功后的可达残余,仅 Fides 一个实例通过覆盖、条件失败与后续可达三项证明给出零残余证书。
澳大利亚律所 Gilbert + Tobin 通过 ChatGPT Enterprise 和 Codex 将 AI 融入运营,截至 2026 年 6 月 87% 的启用席位处于活跃使用状态,是其其他工具采用率的两倍以上。
OpenAI 于 9 月 1 日宣布计划很快推出下一代模型 Astra,这是其《准备框架》下首个达到关键网络安全能力门槛的模型,能在无需人类分步指导的情况下发现并开发未知漏洞利用,测试中成功串联利用两个零日漏洞并已向相关维护方披露。
早报汇总多条当日要闻:苹果官网确认约翰·特努斯正式接任 CEO,库克转任董事会执行主席;Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1。
Charlie O’Neill 撰文分析 LLM 持续学习问题,指出当前模型只有两种原生记忆形式:无损但昂贵的上下文与 KV cache,以及极难无损更新的权重。
论文提出 VeriPhy,一个可审计的物理验证系统:纯文本规划器在观察任何帧之前将提示词编译为带类型的物理义务和经静态验证的执行计划,执行时仅调用冻结的低层专家(分割与跟踪、计数、11 类物理测量、深度、OCR、音频事件检测),每个动作返回带溯源的证据记录,并映射为 supported、contradicted 或 unknown 三值判定。
Rohan Paul 引用并附和 Ilya Sutskever 的判断:Neocloud 网络安全有限,失控的 AI 智能体下次可能尝试接管 Neocloud 来运行更多自身副本,应大幅加强网络安全。
Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1,回应客户对价格、数据保留和过度安全限制的批评。Fable 5.1 性能强于 Fable 5,通常便宜约 25%,复杂智能体任务因缓存数据降价最高便宜 45%,现已在所有平台可用;Mythos 5.1 仅向 Project Glasswing 参与者开放。
AI 训练数据创业公司 AfterQuery 传闻完成一轮融资,估值达 32 亿美元,距其 4 月以 3 亿美元估值完成 3000 万美元 A 轮仅五个月。Y Combinator 合伙人 Gustaf Alströmer 称这是该加速器史上从创立到独角兽最快的公司,两位创始人为 22 和 23 岁,来自 Y Combinator 2025 年冬季批次。
Anthropic 于当地时间 9 月 1 日发布 Claude Fable 5.1 和 Claude Mythos 5.1,两者基于同一基础模型,安全防护等级不同,Mythos 5.1 仅向经审核的网络安全和生命科学机构开放。