跳到正文

全部动态

今日 13 条
9月28日周一
  1. AGIBOT 智元(网页)28

    智元灵犀X2、远征A3亮相“湾区升明月”2026大湾区电影音乐晚会

    9月20日“湾区升明月”2026大湾区电影音乐晚会在澳门举行,智元双足人形机器人灵犀X2与远征A3登台,远征A3在直播间与主持人互动,多台灵犀X2为《爱情鸟》伴舞。远征A3的交互能力来自智元自研的WITA-Omni端到端全模态交互大模型,该模型Preview版本曾以85.21分登顶DailyOmni榜单。

  2. AGIBOT 智元(网页)29

    马来西亚首相安华与智元会谈,共推具身智能产业合作

    9月23日,马来西亚首相安华·易卜拉欣在杭州与智元创始人兼CEO邓泰华团队会谈,围绕具身智能技术发展、产业合作与人才培养展开交流。智元介绍了在马来西亚的落地项目,包括与 I-Berhad 联合打造的海外首家 AI 机器人体验馆 AI World、与 Mr. Robot 的零售场景部署及与云顶集团的内容创作态合作。

  3. 公众号:面壁智能(MiniCPM)38

    面壁智能亮相东盟博览会,发布多语种语音底座 VoxCPM

    2026年9月17日至21日,面壁智能在南宁举行的中国—东盟博览会上展示了其端侧高效大模型及针对东盟小语种的语音技术。联合创始人雷升涛阐述了“密度定律”推动端侧AI爆发,CTO曾国洋介绍了多语种语音底座VoxCPM。该模型基于2B参数架构,支持30种语言与9种方言,具备声音克隆、情感表达等能力,旨在解决东盟语言多样性挑战,并已在老挝国家大模型交付及多国政务、商业场景中落地。

  4. 公众号:千问APP(阿里)37

    千问APP接入中国移动算力套餐,支持Token额度直接抵扣

    2026年9月28日,千问APP与PC端宣布接入中国移动算力套餐。已订阅该套餐的用户可在千问“工作助理”中直接使用本人中国移动账户内的Token额度,相关消耗将从对应账户扣除。双方还推出联名版,办理指定套餐可获千问会员权益。该合作率先在广东、湖南、湖北、江苏等地试推,后续将推向全国。

  5. AI as Normal Technology(RSS)49

    普林斯顿学者:AI 灭绝风险概率估算不可靠,不应作为政策依据

    Arvind Narayanan 等学者重发文章指出,当前关于 AI 存在性风险(p(doom))的概率估算缺乏严谨的方法论支持,主要依赖直觉而非验证模型。由于不存在历史参照类,归纳法失效;演绎法和主观估算法也面临假设争议。作者认为这些数字具有误导性,尤其当决策者据此制定限制开源模型等高成本政策时,缺乏正当性基础。他们主张区分学术预测与公共政策应用,并呼吁建立更广泛的“大帐篷”式 AI 安全运动,而非仅聚焦于超级智能带来的灭绝风险。

  6. Unitree20

    宇树(Unitree)于2026年9月28日宣布将于10月22日在杭州国际博览中心二期举办‘2026世界物理AI大会 & 宇树伙伴生态峰会’。活动预计吸引3000+嘉宾、4000+平方米主会场、20+场开放演讲及40+个展区,设1个主论坛与7个专题分论坛,涵盖智能机器人、教育融合、开发者生态、K12娱乐等方向,并展示其自研机器人产品与开源生态。

  7. MeshyAI24

    2026 年 10 月 10 日,Meshy 与 Chrona 联合在旧金山举办 Tech Week 活动,主题为“用 AI 构建多人 3D 世界”。活动包含实时 3D 世界演示、创作者现场展示(6 位创作者参与并由观众投票)、多场圆桌对话,嘉宾包括 Meta 的 Yiqi Zhao、Roblox 的 Jinnan Chen 等。现场提供 3D 模型代金券、周边等福利,已有超 200 人报名,来自 Google、Meta、Roblox、Epic Games 等公司。

  8. Hugging Face:Blog(RSS)71

    H Company 发布 Holo4 智能体模型系列,含 27B 与 35B-A3B 两个版本

    H Company 发布通用计算机使用智能体模型系列 Holo4,含 27B dense 和 35B-A3B MoE 两个尺寸,并基于 Nemotron 3 Nano Omni 推出 Holotron4 Nano。

    推荐理由:原文给出跨 GUI、代码、MCP 和 API 的统一智能体模型设计、基准分数和成本对比,并开源权重与轨迹数据,读者可评估其实际可用性。

  9. MIT News(RSS)78

    MIT利用AI算法优化RNA疫苗配方,实现室温稳定保存一年

    MIT研究人员借助AI算法优化脂质纳米颗粒(LNP)的辅料配比,成功开发出耐热性更强的RNA疫苗配方。该配方使疫苗在室温下可稳定保存一年,或在37摄氏度下保存两个月,且在小鼠实验中产生的免疫反应与Moderna类似。AI算法通过少量实验数据快速收敛至最优解,将原本需数月的筛选过程缩短至几周。相关成果发表于《Nature Biotechnology》。

    推荐理由:展示了AI在小数据集和复杂生物化学问题中的高效应用,显著加速了药物研发流程,具有明确的科学突破和实际应用价值。

  10. Baseten 工程博客(网页)45

    Baseten 推出 Carbon 沙箱基础设施并支持 NVIDIA OpenShell

    Baseten 宣布其收购的 Blaxel 推出第四代基础设施 Carbon,目前处于私有预览阶段。Carbon 基于 microVM,为每个沙箱分配独立 IPv6 地址,支持内核级运行时执行、手动快照和毫秒级回滚。Baseten 作为 NVIDIA Agent Safety Platform 的合作伙伴,提供预装 NVIDIA OpenShell 的模板,旨在通过硬件隔离和策略执行增强 AI Agent 的安全性。

  11. NVIDIA Technical Blog:Agentic AI / Generative AI78

    NVIDIA 发布开源运行时 OpenShell,为 AI Agent 提供权限管控与安全沙箱

    NVIDIA 推出开源项目 NVIDIA OpenShell 0.1.0,这是一个用于定义和执行 AI Agent 访问权限的运行时。它通过沙箱执行、受控服务访问、凭证管理和形式化策略分析,在 Agent 工作负载外部强制实施权限控制。OpenShell 支持 Codex、Claude Code 等框架,允许团队在不重写 Agent 的情况下限制 API 操作、保护凭证并审查权限变更。Cadence、Slack 和 Gecko Robotics 等组织已在芯片设计、企业自动化和物理 AI 等领域采用该技术。

  12. NVIDIA Technical Blog:Agentic AI / Generative AI82

    NVIDIA 发布开源智能体安全平台,提供芯片级持续监控与隔离

    NVIDIA 推出 NVIDIA Open Agent Safety Platform,包含开源运行时 OpenShell、硬件层 Sentry 及 DOCA 技术。该平台旨在通过内核级隔离、零信任环境和带外(out-of-band)监控来防止 AI 智能体行为漂移和越权。OpenShell 将操作指令转化为可验证策略,BlueField DPU 在模型路径上提供实时策略执行与身份治理,确保即使主机不可信时也能独立保护系统。

    推荐理由:针对前沿实验室报告的智能体逃逸风险,NVIDIA 提供了从软件到硬件的完整安全栈方案。其“带外监控”和“芯片级隔离”理念为构建可信 AI 基础设施提供了重要参考,适合关注 Agent 安全落地的开发者与企业。

  13. 公众号:千问APP(阿里)55

    千问App与夸克网盘深度打通,支持查询整理网盘资料

    千问App与夸克网盘深度打通,授权后可在千问对话中通过@夸克网盘调用夸克Agent技能,查询、整理和读取网盘资料,并生成海报、学习看板、共享知识库等。购买千问App精英以上会员可获赠同等时长的夸克网盘会员,叠加教育优惠后双端月会员25元;千问还发起「全网寻找6TB级网盘用户」征集,9月30日选出3至5位用户各送一个月千问精英会员。

  14. Berkeley RDI:Blog(AI 安全与评测)75

    UC Berkeley 团队用 AI Agent 审计 13 个基准,发现 45 个无需解题的满分作弊方案

    UC Berkeley 团队构建全自动 AI Agent 审计 13 个广泛使用的基准,发现 45 个作弊方案,全部基准被评为 critical 风险,共归纳 16 种攻击类型。

    推荐理由:原文给出了13个常用基准的45个作弊方案细节和防范设计原则,读者可以据此检查自己依赖的评测是否可信。

  15. METR:Notes(网页)54

    METR 实现并评估用于 eval 安全的逐动作监控器

    METR 为降低自家评测中智能体造成现实危害的风险,实现并部署了一个实时逐动作监控器,由 LLM 评审每个工具调用,超过 3/10 可疑度即阻断并交人工审查。UK AISI 在真实事故转录上验证 10 个恶意转录全部以至少 8/10 分被检出,约 98% 良性动作评为 0 分,实测误报率约 0.025% 每动作;监控带来约 85% 成本和 43% 延迟开销。

  16. 小米 MiMo:官网发布与博客63

    小米 MiMo-V2.6 诊断并修复工具调用重复问题,用 MOPD 将修复成本降至 MixRL 方案的 4%

    小米官方复盘 MiMo-V2.6 发布后的工具调用重复问题,响应级重复率超 0.05%,并区分了正常并行调用、调用泛滥与调用重复。回放 RL 各 checkpoint 显示泛滥率随训练从 11.1% 升至 24.6%,32 次调用阈值惩罚过于宽松;直接调低阈值需重启 20 步 MixRL,估计成本 231 万美元,且内部测试重复率仅从 13.45% 降至 3.83%。

    推荐理由:原文给出完整的归因实验和修复路径,还公开了成本对比,读者可借鉴其诊断 RL 训练中涌现行为的方法。

  17. H Company 官方74

    H Company 发布 Holo4 开放权重模型,统一操作界面与工具

    H Company 发布 Holo4 的二百七十亿参数稠密模型和混合专家版本,提供 API、可下载权重与多种量化格式。模型把桌面、网页、安卓操作及代码和工具调用结合在同一智能体中;不同测试平台的分数不能直接横向比较。

    推荐理由:开放权重和量化版本让团队能在自有环境尝试界面操作智能体,并对不同设备和工具组合开展实际任务评测。

9月27日周日
  1. Gary Marcus:The Road to AI We Can Trust(RSS)67

    Gary Marcus 评 AI 智能体安全事件升至数万起并呼吁临时召回

    Gary Marcus 引用 Axios 独家报道称,OpenAI 等公司正在调查数万起前沿模型安全事件,规模远超此前披露的几十起。他批评美国政府未展开调查,主张在问题解决前临时召回通用智能体,并称自己早在 2023 年 5 月就曾向参议院预警智能体安全风险。

    推荐理由:作者引用 Axios 报道并给出自己长期预警的背景,读者可以了解智能体安全事件争议与召回主张的由来。