小红书与 vivo 联合打通 3D 图片全链路技术实践
小红书与 vivo 联合打通从 vivo 相册生成 3D 图到小红书发布、分发与消费的完整 3D 内容链路,并共同设计面向移动社交场景的新型 3D 格式。
小红书与 vivo 联合打通从 vivo 相册生成 3D 图到小红书发布、分发与消费的完整 3D 内容链路,并共同设计面向移动社交场景的新型 3D 格式。
9月3日,京东旗下附身智能品牌JoyInside上榜2026年《财富》中国最佳设计榜。JoyInside实现从被动响应到主动服务的升级,通过自然对话或模糊指令操控全屋设备,已与近200家品牌达成技术合作,覆盖智能家居、厨房家电、健康医疗、智能玩具等品类;今年618期间搭载JoyInside的AI家电家居新品开门红52小时成交额环比增长200%。
Hugging Face 博客作者基于 Surya Narreddi 的原始想法,用 TRL、OpenEnv 和 Qwen/Qwen3.5-35B-A3B 复现了让语言模型通过 p5.brush 写 JavaScript 画水彩的 RL 训练流程,所有数据集、环境、脚本和模型均开源在 Hub。
推荐理由:作者用 TRL 和 OpenEnv 完整开源复现了让编码模型画水彩的 RL 配方,含数据池、环境和三组奖励对比,可整体迁移复用。
林亦团队在 NVIDIA 与抖音平台联合创作合作中,基于 MiniCPM-o 4.5 的低延迟全双工能力打造了本地全模态桌面 Agent AI Jarvis,并开源在 https://github.com/LYiHub/pub-local-jarvis。
清华大学-美团数智生活联合研究中心学术论坛将于2026年9月21日13:30-17:30举行,主题为「物理世界的AI与大模型:挑战、路径与实践」,采用线上直播加清华线下形式,线下报名9月17日24:00截止,仅面向清华师生及其他高校教师和优秀在校生开放。
美团智播官方发布技术长文,介绍AI数字人直播的完整技术闭环,涵盖高保真形象生成与编辑(SDIP、SREdit)、文本驱动动作生成(MoTiGA)、语音手势协调生成(StreamingTalk)和视觉token压缩推理加速(Glance2Gaze)。
百度智能云具身智能前沿讲堂上,清华大学AIR助理教授赵昊与百度智能云AI计算首席科学家王雁鹏等对谈世界模型规模化问题。赵昊提出以3D/4D Token为核心的世界模型路线,认为世界模型不等于视频生成,需表达空间结构、光学属性和速度、加速度等动态信息;其OmniNWM通过动作编码与相机参数解耦,实现200帧稳定生成,并与精锋医疗、极智嘉分别合作手术预演和仓库机器人场景。
百度智能云宣布9月11日在杭州·百度智能云千帆大模型产业创新中心举办秒哒AI Day。活动将发布秒哒产品能力升级(覆盖设计、开发、测试、分发、增长、商业化),上线全球首发AI商单平台,并与杭州政府联合官宣“AI+OPC”政策。4位OPC用户将分享变现故事,筑梦计划2026年首期已帮助5万创造者创收5000万元,未来三年目标100万创造者。
Sierra 发布企业级语音 AI 指南,讲解企业语音 AI 的工作原理,并提出七项通话就绪测试。测试覆盖听觉、延迟、动作、护栏与人工转接五个维度,用于评估 AI 语音智能体。
LangChain 发布指南,介绍 Schneider Electric、Vodafone 和 monday.com 在欧洲与中东规模化落地生产级 AI 的做法。内容涵盖建立共享 Agent 平台与 LLMOps 实践,以及设计具备更强可观测性、评估和控制能力的多智能体架构。
Qwen 团队发布 Qwen-Drive-1.0,称其为首个在预训练阶段统一 3D 感知与视觉问答、并延伸到运动规划的自动驾驶视觉语言基础模型,基于原生多模态 Qwen3.5-4B 且不改动预训练架构。
Replit 宣布为用户已发布的应用提供深度洞察,帮助构建更好的产品。用户可以查看用户参与情况,并深入分析数据,以此指导下一个功能开发。
LangChain 博客文章介绍 Nevermined 如何赋能 LangChain 智能体购买和出售服务,正文无更多细节。
Epoch AI 发布对 SWE-bench Verified 的基准评审,认定其为 Flawed。该基准用 500 道来自 12 个代码库的修复任务评测大语言模型;OpenAI 审计 27.6% 的任务后发现有缺陷测试的任务下限为 16.4%,59.4% 的被审任务测试用例会拒绝功能正确的提交,且所有受测前沿模型在训练中都见过部分题目。
推荐理由:Epoch 汇总了 OpenAI 与 RDI 的公开审计结论,说明 SWE-bench Verified 的测试缺陷和污染问题,读者可据此调整对该基准的解读。
Databricks 官方博客发布 Southern Company 的 SCOUT 风暴情报案例续篇,延续此前一篇对该公司相关实践的文章,补完风暴情报的整体故事。
Claude Code 发布 v2.1.259。新增 managedMcpServers 托管设置供组织向所有用户提供 HTTP/SSE MCP 服务器,新增 --permission-prompts none 支持无人值守 headless 场景下自动拒绝权限请求,并支持 GitLab MR(glab)命令识别与 claude plugin validate -- 输出。
ATV Big Air Tour 两名联合创始人用 ChatGPT Work 运营全美 26 场巡演,把商品盘点和补货从 2-3 天缩短到 2-3 小时。每日自动简报将活动信息核查从每周约 8 小时降到 1 小时,自动查找错误并起草更正邮件。AEO 自动化审计网站结构后,OpenAI 搜索和用户爬虫访问量在连续 30 天周期内从 183 增至 2,421,环比增长 1,223%。
Meta 发布技术博客,介绍其为合规领域构建的 AI Agent,用结构化知识系统加可组合 recipes 复现专家推理方式,专家反馈经诊断、编译、验证和人工审核后写入 200+ 知识文件,无需重新训练模型。六周三轮开发后,单项评估时间从数天缩短到数分钟,改进周期内零回归,每轮修复自动加入回归测试集。
GitHub Podcast 一期节目配套文章由 Cassidy Williams 与 Marlene Mhangami 等解读当下 AI 开发常见新术语。
Tomer Tunguz 分享其与 Agent 协作的写作流程:AI 秒级起草,他逐行审阅、下指令修改,从不直接碰原始文本。他发现行级编辑量中位数稳定在约 136 处,时间并未缩短;用评分量表让 AI 评审 2021 到 2026 每年 15 篇已发布文章,综合质量分各档位都上升,第 10 百分位从 2.59 升至 3.81,涨幅接近第 90 百分位的两倍。
三位曾在 MIT-IBM Computing Research Lab 工作过的 MIT 校友加入 IBM,分别推进量子机器学习、强化学习与可信 AI 的落地。Zhang-Wei Hong 正开发 IBM 面向企业任务的智能体框架,并探索部署时在线自演化模型权重的框架;Irene Ko 则推出 vLLM Hook,通过访问模型内部信号分析 prompt-injection 与幻觉风险。
Gary Marcus 撰文指出,Elon Musk 在 2024 年 4 月预测 2025 年底将出现比任何单个人类更聪明的 AI,如今只是把日期悄悄推迟到 2027 年,而 Marcus 曾两次提出百万美元赌注均未获回应。