跳到正文

全部动态

今日 1 条
9月16日周三
  1. PixVerse20

    作品真的太棒了!💗 [引用 @haremasoundwork]:全新动画 MV《BEYOND》已发布。这是使用 PixVerse 制作的 3 分半影像作品。穿越海上都市,穿过回归自然的废墟,驶向更远方。描绘了一个科幻与奇幻交汇的世界。这部故事想表达的是——不是因为不害怕才前进,而是即使害怕也要前进。即使知道前方等待的是什么,只要是自己的选择就会走下去。这份心情都倾注在了《BEYOND》中。希望大家能喜欢到最后。 BEYOND | Official Animated Music Video Music & Produced by Harema Soundworks Directed & Created by Jii Zhang Powered by @PixVerse #BEYOND #PixVerse #AnimatedMusicVideo YouTube ▶︎ https://youtu.be/muO3COe958g

  2. Mistral AI:News(网页)78

    Mistral AI 与 Mozilla 合作,为 Firefox 智能窗口提供模型支持

    2026年9月16日,Mistral AI 宣布与 Mozilla 达成合作,其模型将驱动 Firefox 的 AI 浏览助手“Smart Window”(测试版)。该功能帮助用户处理复杂搜索、记忆浏览内容并基于标签页获取信息。初期覆盖法国和北美用户,英德随后跟进。双方强调开源、隐私保护(默认不保存对话、零数据保留)及针对区域语言和文化语境优化的能力,旨在打破单一公司垄断,赋予用户对 AI 交互的控制权。

  3. 蚂蚁 inclusionAI:GitHub 新仓库63

    蚂蚁 inclusionAI 开源 Realtime-Venus 全双工交互系统

    蚂蚁集团 Venus 团队与清华大学在 GitHub 开源 Realtime-Venus,一个支持全双工对话与异步任务委托的实时交互系统。系统包含三个组件:Realtime-Venus-Omni(9B,流式音视频对话与主动交互)、Realtime-Venus-Audio(9B,语音交互与音频理解)以及负责后台任务执行并将结果返回同一对话的 Harness 运行时。

    推荐理由:蚂蚁和清华开源了全双工对话加异步委托任务的系统,含 9B 的 Omni 与 Audio 两个模型和 Harness 运行时,可直接下载推理或跑浏览器 demo。

  4. Preferred Networks:AI 研究与产品54

    三菱重工与Preferred Networks签订资本业务提携协议,出资总额100亿日元

    三菱重工与Preferred Networks(PFN)于2026年8月31日签订资本业务提携协议。三菱重工将通过第三者配额增资向PFN出资总额100亿日元。双方此前已于2026年6月宣布在基础设施和国家安全等关键任务领域共同开发机器与系统的智能化、自主化AI技术,本次协议将构建中长期更强固的合作体制,加速共同研发与社会落地。

  5. 公众号:百度智能云(文心)25

    百度搭子生态平台开放入驻:连接器、技能、专家套件、硬件四大能力,永不抽佣

    百度搭子生态平台开放入驻,面向能力提供者开放连接器、技能、专家套件、硬件四类能力,并承诺永不抽佣。该平台让行业洞察、专业方法、数据能力与智能硬件进入生态,被 AI 按需调用,硬件侧提供标准化 API 一键唤起搭子分身。拥有行业经验、专业能力、数据资源或智能硬件的伙伴可扫码申请入驻。

  6. MIT News(RSS)25

    MIT 政治学者 Naoki Egami 研究如何准确测量社会现象

    MIT 政治学副教授 Naoki Egami 专攻研究方法论,重点研究社会科学中的"外部有效性",即特定研究结论能否推广到其他情境。他还在 ChatGPT 引发 AI 热潮之前就开始审视 AI 工具引入研究后带来的误差,并探索如何系统识别和校正这些误差。Egami 于 2025 年以终身教职加入 MIT 政治学系,同时是 IDSS 统计与数据科学中心的教员。

  7. 公众号:京东JoyAI37

    京东JDD圆桌热议人机共生:未来住宅或需为机器人留出空间

    京东全球科技探索者大会(JDD)上一场跨界圆桌讨论了机器人进入工厂与家庭后的人机共生问题,极佳视界创始人黄冠预计未来新房和小区或许需要为机器人设置充电、维修和使用工具的专门区域。京东JoyInside产品经理刘皓琰介绍,搭载JoyInside的AI毛绒玩具已让部分孩子将其视作伙伴,JoyInside正探索让AI从被动响应走向主动服务。

  8. OpenRouter:Announcements(RSS)73

    DeepSeek V4 哪些型号支持图像输入?OpenRouter 逐款梳理与调用指南

    OpenRouter 梳理其目录中的 DeepSeek V4 系列图像输入支持情况:V4.1 Flash 原生读图(2026年9月10日上线,$0.15/$0.60 每百万 token)。

    推荐理由:原文逐一列出 DeepSeek V4 各型号是否支持图像输入、价格和调用方式,并给出文本-only 型号配视觉模型的两段式替代方案。

  9. Tomer Tunguz 博客(VC 分析)61

    Vercel 将 inbound 销售团队从 10 人压缩至 1.25 人,AI 销售开发智能体年成本仅数千美元

    Vercel COO Jeanne DeWitt Grosser 在 The Information 访谈中表示,公司 inbound 销售开发已实现 90% 自动化,团队从 10 人压缩至 1.25 人。

    推荐理由:Vercel COO 给出自家 inbound 销售自动化的人员压缩、年度基础设施成本和 32x ROI 数字,是可直接参考的一手落地案例。

  10. LlamaIndex:产品、工程与评测54

    LlamaIndex:为什么更好的抽取模型并不能缩小你的文档复核队列

    LlamaIndex 发文分析 OCR 文档处理中准确率与自动化率的关系,指出路由门控而非读取能力决定直通处理率。文中算例显示 20 个字段的发票在 97% 每字段准确率下仅约 54% 文档全对,94% 准确率但带每字段置信度的 Pipeline B 可自动放行 92% 文档,而 97% 准确但无信号的 Pipeline A 直通率为 0。

  11. Google Research:Blog(网页)44

    Google 用 Retrieve-for-Train 框架突破推理瓶颈,加速复杂 AI 搜索

    Google Research 提出 Retrieve-for-Train 框架,用离线强化学习将奖励对齐的查询扇出编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归生成完整结果集,无需测试时 CoT 推理 token。该方法基于 Gemma3-4B 和 Qwen3-4B 微调,旨在解决零样本 LLM 的复述坍缩与自回归延迟瓶颈,论文已被 ICML 2026 收录。