跳到正文

全部动态

今日 13 条
9月3日周四
  1. 公众号:京东JoyAI30

    京东JoyInside上榜2026年《财富》中国最佳设计榜,构建AI Home生态

    9月3日,京东旗下附身智能品牌JoyInside上榜2026年《财富》中国最佳设计榜。JoyInside实现从被动响应到主动服务的升级,通过自然对话或模糊指令操控全屋设备,已与近200家品牌达成技术合作,覆盖智能家居、厨房家电、健康医疗、智能玩具等品类;今年618期间搭载JoyInside的AI家电家居新品开门红52小时成交额环比增长200%。

  2. Hugging Face:Blog(RSS)63

    用 TRL 和 OpenEnv 训练编码模型画水彩:Hugging Face 全流程开源复现

    Hugging Face 博客作者基于 Surya Narreddi 的原始想法,用 TRL、OpenEnv 和 Qwen/Qwen3.5-35B-A3B 复现了让语言模型通过 p5.brush 写 JavaScript 画水彩的 RL 训练流程,所有数据集、环境、脚本和模型均开源在 Hub。

    推荐理由:作者用 TRL 和 OpenEnv 完整开源复现了让编码模型画水彩的 RL 配方,含数据池、环境和三组奖励对比,可整体迁移复用。

  3. 公众号:百度智能云(文心)35

    赵昊与百度百舸团队对谈:世界模型如何走向规模化训练

    百度智能云具身智能前沿讲堂上,清华大学AIR助理教授赵昊与百度智能云AI计算首席科学家王雁鹏等对谈世界模型规模化问题。赵昊提出以3D/4D Token为核心的世界模型路线,认为世界模型不等于视频生成,需表达空间结构、光学属性和速度、加速度等动态信息;其OmniNWM通过动作编码与相机参数解耦,实现200帧稳定生成,并与精锋医疗、极智嘉分别合作手术预演和仓库机器人场景。

  4. 公众号:百度智能云(文心)22

    百度秒哒AI Day定于9月11日杭州举办,将发布AI商单平台

    百度智能云宣布9月11日在杭州·百度智能云千帆大模型产业创新中心举办秒哒AI Day。活动将发布秒哒产品能力升级(覆盖设计、开发、测试、分发、增长、商业化),上线全球首发AI商单平台,并与杭州政府联合官宣“AI+OPC”政策。4位OPC用户将分享变现故事,筑梦计划2026年首期已帮助5万创造者创收5000万元,未来三年目标100万创造者。

  5. Artificial Analysis70

    Artificial Analysis 评测显示,阿里巴巴 Wan 3.0 在视频编辑带音频榜单首次登顶第一,文生视频带音频位列第二,图生视频带音频排名第五。该模型为一体化视频生成与编辑模型,支持最长 30 秒 1080p 原生音频输出,可接受文本、图片、视频、音频、文档和网页作为创作参考,并支持指令式编辑画面、剧情、对话和声音。

  6. Epoch AI:研究、数据与评测69

    Epoch AI 评测 SWE-bench Verified:审计发现超两成题目存在评分问题

    Epoch AI 发布对 SWE-bench Verified 的基准评审,认定其为 Flawed。该基准用 500 道来自 12 个代码库的修复任务评测大语言模型;OpenAI 审计 27.6% 的任务后发现有缺陷测试的任务下限为 16.4%,59.4% 的被审任务测试用例会拒绝功能正确的提交,且所有受测前沿模型在训练中都见过部分题目。

    推荐理由:Epoch 汇总了 OpenAI 与 RDI 的公开审计结论,说明 SWE-bench Verified 的测试缺陷和污染问题,读者可据此调整对该基准的解读。

  7. OpenAI:官网动态(RSS · 排除企业/客户案例)38

    ATV Big Air Tour 用 ChatGPT Work 把 3 天工作量压缩到 3 小时

    ATV Big Air Tour 两名联合创始人用 ChatGPT Work 运营全美 26 场巡演,把商品盘点和补货从 2-3 天缩短到 2-3 小时。每日自动简报将活动信息核查从每周约 8 小时降到 1 小时,自动查找错误并起草更正邮件。AEO 自动化审计网站结构后,OpenAI 搜索和用户爬虫访问量在连续 30 天周期内从 183 增至 2,421,环比增长 1,223%。

  8. Meta Engineering Blog(RSS)53

    Meta 构建“组织第二大脑”AI Agent,从专家反馈中沉淀机构知识

    Meta 发布技术博客,介绍其为合规领域构建的 AI Agent,用结构化知识系统加可组合 recipes 复现专家推理方式,专家反馈经诊断、编译、验证和人工审核后写入 200+ 知识文件,无需重新训练模型。六周三轮开发后,单项评估时间从数天缩短到数分钟,改进周期内零回归,每轮修复自动加入回归测试集。

  9. Tomer Tunguz 博客(VC 分析)57

    Tomer Tunguz:AI 生产力不是减少工作量,而是抬高产出上限

    Tomer Tunguz 分享其与 Agent 协作的写作流程:AI 秒级起草,他逐行审阅、下指令修改,从不直接碰原始文本。他发现行级编辑量中位数稳定在约 136 处,时间并未缩短;用评分量表让 AI 评审 2021 到 2026 每年 15 篇已发布文章,综合质量分各档位都上升,第 10 百分位从 2.59 升至 3.81,涨幅接近第 90 百分位的两倍。

  10. MIT News(RSS)

    从 MIT 到 IBM:三位研究者如何加速 AI 与量子落地

    三位曾在 MIT-IBM Computing Research Lab 工作过的 MIT 校友加入 IBM,分别推进量子机器学习、强化学习与可信 AI 的落地。Zhang-Wei Hong 正开发 IBM 面向企业任务的智能体框架,并探索部署时在线自演化模型权重的框架;Irene Ko 则推出 vLLM Hook,通过访问模型内部信号分析 prompt-injection 与幻觉风险。