Preferred Networks 将出展 CEATEC2026,展示 PLaMo 与自律搬运机器人
Preferred Networks(PFN)将于 2026 年 10 月 13 日至 16 日在幕张展览馆出展 CEATEC2026,展位为 Xパーク・ホール5 的 5H206。
Preferred Networks(PFN)将于 2026 年 10 月 13 日至 16 日在幕张展览馆出展 CEATEC2026,展位为 Xパーク・ホール5 的 5H206。
推荐理由:官方宣布被 AMD 收购,并给出靠近硬件做空间智能的理由,可帮助读者理解这起交易的战略意图。
AMD 宣布以约 82 亿美元全股票交易收购 World Labs,双方已签署最终协议。交易完成后,李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向苏姿丰汇报;预计今年底交割,仍需监管批准,不能视作已经完成。
推荐理由:协议披露了世界模型团队与芯片平台整合的金额、路径和交割条件,为判断空间智能研发与算力布局的关系提供了新信息。
9月20日“湾区升明月”2026大湾区电影音乐晚会在澳门举行,智元双足人形机器人灵犀X2与远征A3登台,远征A3在直播间与主持人互动,多台灵犀X2为《爱情鸟》伴舞。远征A3的交互能力来自智元自研的WITA-Omni端到端全模态交互大模型,该模型Preview版本曾以85.21分登顶DailyOmni榜单。
智元(AGIBOT)与长隆集团合作的全球首个大规模具身智能主题乐园于2026年9月24日在横琴长隆飞船乐园开园,超300台智元全系机器人在100余个交互体验点常态化上岗,覆盖文娱商演、科普研学、导览导购等七大核心场景。
9月23日,马来西亚首相安华·易卜拉欣在杭州与智元创始人兼CEO邓泰华团队会谈,围绕具身智能技术发展、产业合作与人才培养展开交流。智元介绍了在马来西亚的落地项目,包括与 I-Berhad 联合打造的海外首家 AI 机器人体验馆 AI World、与 Mr. Robot 的零售场景部署及与云顶集团的内容创作态合作。
Black Forest Labs 发布 FLUX 3 Action,一个 7B 参数、开放权重的世界动作模型。官方称可将 FLUX 的视觉智能转化为动作能力,用于机器人、模拟器或游戏。
Hugging Face 发布 NVIDIA 物理仿真系列第二篇教程,讲解如何将 SO-101 机械臂的 MuJoCo 场景迁移到基于 NVIDIA Warp 的 MuJoCo Warp(MJWarp),扩展到最多 2048 个并行 GPU 环境并测量聚合吞吐量。
微软研究院发布关于物理AI机器人推理基础设施的研究。通过系统评估移动操作任务,发现将推理从机载GPU卸载至边缘或云端,能解决机载算力限制模型规模、导致响应延迟(最高383%)及精度下降的问题。实验显示,卸载推理不仅提升了任务成功率,还通过替换高功耗机载GPU为轻量硬件(如树莓派),使机器人电池寿命延长高达160%。此外,微软推出了基于Kubernetes的Physical AI Toolchain工具集,支持自动化容器化与分布式推理部署。
生数科技发布面向机器人灵巧操作的世界模型 Motus2,将行动、预测、评估三种能力统一进同一个共享参数模型,形成生成动作、预测未来、评估结果、更新策略的闭环,并加入轻量触觉专家模块。
Skild AI 发布 S1 机器人基础模型,通过 in-context learning 从单段视频演示理解并执行未见过的新任务,无需更新权重或任务专属后训练。
智元发布AGILE2.0感控一体模型,实现视觉感知、环境理解、全身运动控制与上下肢协同操作的端到端闭环耦合。通过短片《杂技BOT》展示灵犀X2钻火圈、跳长绳、踩球走、协作搬箱子等视觉驱动动态任务,其中踩球走为双足人形机器人自主实现。模型面向动态扰动、人机共存、多机协同等复杂场景,降低现实环境中的定制化开发代价,支持部署态规模化落地。
宇树全面开源 UnifoLM-WLA-1.0 具身基础模型,官方称在全球开源模型中于多个基准取得新 SOTA 结果。单一模型可协调桌面与全身移动操作,支持跨任务和跨末端执行器泛化,实现单模型全身协调。
智元发布原生世界—动作模型GE-Act 2.0,所有参数从随机初始化在具身操作数据上从头训练,不针对评测任务微调或示范。
Runway 宣布巴黎研究实验室 Kinetix 团队加入公司,借此加速机器人研究投入并扩大商业化部署。官方同时开放巴黎及全球的职位招聘,详情见其发布链接。
9月3日,京东旗下附身智能品牌JoyInside上榜2026年《财富》中国最佳设计榜。JoyInside实现从被动响应到主动服务的升级,通过自然对话或模糊指令操控全屋设备,已与近200家品牌达成技术合作,覆盖智能家居、厨房家电、健康医疗、智能玩具等品类;今年618期间搭载JoyInside的AI家电家居新品开门红52小时成交额环比增长200%。
清华大学-美团数智生活联合研究中心学术论坛将于2026年9月21日13:30-17:30举行,主题为「物理世界的AI与大模型:挑战、路径与实践」,采用线上直播加清华线下形式,线下报名9月17日24:00截止,仅面向清华师生及其他高校教师和优秀在校生开放。
百度智能云具身智能前沿讲堂上,清华大学AIR助理教授赵昊与百度智能云AI计算首席科学家王雁鹏等对谈世界模型规模化问题。赵昊提出以3D/4D Token为核心的世界模型路线,认为世界模型不等于视频生成,需表达空间结构、光学属性和速度、加速度等动态信息;其OmniNWM通过动作编码与相机参数解耦,实现200帧稳定生成,并与精锋医疗、极智嘉分别合作手术预演和仓库机器人场景。
Qwen 团队发布 Qwen-Drive-1.0,称其为首个在预训练阶段统一 3D 感知与视觉问答、并延伸到运动规划的自动驾驶视觉语言基础模型,基于原生多模态 Qwen3.5-4B 且不改动预训练架构。
Apple Machine Learning Research 发布 REFACTOR-VLA 研究,针对 OpenVLA、π0、RT-2、RDT-1B 等当前视觉-语言-动作(VLA)模型生成原始动作的“单体式”结构,提出以无监督方式学习类型化运动程序库的方法。
2026京东全球科技探索者大会将于9月9日在北京北人亦创国际会展中心召开。京东集团将在会上发布物理AI全景战略,行业大咖与技术专家将探讨技术前沿与产业实践。
昆仑万维在中国证券报主办的2026科技创新与产业高质量发展大会上获颁2025年度新质企业金牛奖(人工智能)。公司2026年上半年营收53.59亿元,同比增长43.55%,归母净利润10.88亿元,同比增长227.17%;AI短剧平台单月流水超6500万美元,FreeReels位列出海短剧APP下载量第一。
Google DeepMind 发布 Gemini Robotics ER 2,定位为机器人的高层大脑,可理解物理世界、规划多步任务,并把动作执行交给底层 VLA 模型,同时支持调用 Google Search 等工具。
推荐理由:官方给出 ER 2 相对 ER 1.6 的能力升级与开放入口,读者可据此判断机器人在视频理解与多机协作上的进展。
Google DeepMind 发布 Gemini Robotics 2,由 Gemini Robotics 2、Gemini Robotics ER 2 和 Gemini Robotics On-Device 2 三款模型组成,首次实现对人形机器人从脚到指尖的全身控制,并支持双手与夹爪的精细操作和多机器人协作。
推荐理由:官方给出三款模型的定位与开放入口,可据此判断机器人全身控制与端侧适配的进展。
Google DeepMind 推出为期三个月的 Robotics 加速器,从欧洲选出 15 家机器人初创公司,提供技术指导并开放其 AI 技术栈与 Gemini 机器人模型。入选公司覆盖物流、制造、医疗、气候与导航等领域,包括挪威 3D-Components、法国 Bubble Robotics、英国 Touchlab 等。
Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其面向机器人推理的模型升级版,重点增强空间推理与多视角理解,并新增仪表读数能力,可读取圆形压力表、液位指示器和数字读数。
推荐理由:官方给出与上一代及 Gemini 3.0 Flash 的对比,并首次开放仪表读数能力,可据此判断机器人在巡检场景的落地边界。