今天,我们宣布与 @mozilla 达成合作,为使用 AI 浏览网页的用户带来隐私、控制权和选择权。🦊🐈 https://mistral.ai/news/mistral-x-mozilla
全部AI 动态
全部动态
今日 1 条
Mistral AI@MistralAIAI 评分4040
PixVerse@PixVerseAI 评分2020
MeshyAI@MeshyAIAI 评分5656Meshy 宣布 Ultra 4K 正式上线,称其为首个达到 4K 几何分辨率的 AI 3D 建模功能,生成细节为其历史最丰富水平。附演示视频展示生成效果。
Mistral AI:News(网页)AI 评分7878 Mistral AI 与 Mozilla 合作,为 Firefox 智能窗口提供模型支持
2026年9月16日,Mistral AI 宣布与 Mozilla 达成合作,其模型将驱动 Firefox 的 AI 浏览助手“Smart Window”(测试版)。该功能帮助用户处理复杂搜索、记忆浏览内容并基于标签页获取信息。初期覆盖法国和北美用户,英德随后跟进。双方强调开源、隐私保护(默认不保存对话、零数据保留)及针对区域语言和文化语境优化的能力,旨在打破单一公司垄断,赋予用户对 AI 交互的控制权。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分6161 蚂蚁 inclusionAI 开源全双工音视频交互模型 Realtime-Venus
蚂蚁集团 inclusionAI 在 Hugging Face 发布 Realtime-Venus,包含 Realtime-Venus-Omni 和 Realtime-Venus-Audio 两个 9B 检查点,基于 MiniCPM-o 4.5 / Omni-Flow 架构,语言骨干为 Qwen3-8B。
蚂蚁 inclusionAI:GitHub 新仓库精选AI 评分6363 蚂蚁 inclusionAI 开源 Realtime-Venus 全双工交互系统
蚂蚁集团 Venus 团队与清华大学在 GitHub 开源 Realtime-Venus,一个支持全双工对话与异步任务委托的实时交互系统。系统包含三个组件:Realtime-Venus-Omni(9B,流式音视频对话与主动交互)、Realtime-Venus-Audio(9B,语音交互与音频理解)以及负责后台任务执行并将结果返回同一对话的 Harness 运行时。
推荐理由:蚂蚁和清华开源了全双工对话加异步委托任务的系统,含 9B 的 Omni 与 Audio 两个模型和 Harness 运行时,可直接下载推理或跑浏览器 demo。
Preferred Networks:AI 研究与产品AI 评分5454 三菱重工与Preferred Networks签订资本业务提携协议,出资总额100亿日元
三菱重工与Preferred Networks(PFN)于2026年8月31日签订资本业务提携协议。三菱重工将通过第三者配额增资向PFN出资总额100亿日元。双方此前已于2026年6月宣布在基础设施和国家安全等关键任务领域共同开发机器与系统的智能化、自主化AI技术,本次协议将构建中长期更强固的合作体制,加速共同研发与社会落地。
NVIDIA Blog(RSS)AI 评分4545 曼彻斯特大学用 NVIDIA Earth-2 预测全英空气污染
曼彻斯特大学团队基于 NVIDIA Earth-2 的生成式框架训练出覆盖全英国的空气污染模型,在 Isambard-AI 上仅用两天完成训练,分辨率达 2-3 平方公里。
公众号:百度智能云(文心)AI 评分2525 百度搭子生态平台开放入驻:连接器、技能、专家套件、硬件四大能力,永不抽佣
百度搭子生态平台开放入驻,面向能力提供者开放连接器、技能、专家套件、硬件四类能力,并承诺永不抽佣。该平台让行业洞察、专业方法、数据能力与智能硬件进入生态,被 AI 按需调用,硬件侧提供标准化 API 一键唤起搭子分身。拥有行业经验、专业能力、数据资源或智能硬件的伙伴可扫码申请入驻。
Huawei Cloud@HuaweiCloud1AI 评分1313MIT News(RSS)AI 评分2525 MIT 政治学者 Naoki Egami 研究如何准确测量社会现象
MIT 政治学副教授 Naoki Egami 专攻研究方法论,重点研究社会科学中的"外部有效性",即特定研究结论能否推广到其他情境。他还在 ChatGPT 引发 AI 热潮之前就开始审视 AI 工具引入研究后带来的误差,并探索如何系统识别和校正这些误差。Egami 于 2025 年以终身教职加入 MIT 政治学系,同时是 IDSS 统计与数据科学中心的教员。
vLLM 官方博客(RSS)AI 评分4343 vLLM x Novita AI:面向 Kimi K2.x 的 INT4 MoE 算子 Chord,H200 最高 1.3x、B300 最高 2.15x
Novita AI 开源了面向 Kimi K2.x 服务形态的 W4A16 MoE CUDA 算子 Chord,支持 BF16 激活、INT4 权重与 group-32 scale,其 indexed 路径兼容 Humming 导入根,可通过 --quantization humming 在兼容的 vLLM 版本上启用。
公众号:火山引擎AI 评分6565 豆包大模型2.1 Pro更新至0915版本:多模态Coding与Agent交付能力升级
火山引擎宣布 Doubao-Seed-2.1-pro 更新至0915版本,API 已全量上线火山方舟,豆包 app 和 TRAE 同步接入。
Tripo@tripoaiAI 评分5858
Tripo@tripoaiAI 评分2222Tripo x GPT-6 Astra 工作流。 看看我们的社区在构建什么 ↓ https://x.com/i/article/2099773857783750656
公众号:腾讯元宝AI 评分2626 腾讯元宝携手 WorkBuddy 走进校园,推出 AI 录音笔实时转写与科研搜索功能
腾讯元宝携手 WorkBuddy 走进各大校园,推出面向学生的新学期 AI 搭子功能。其 AI 录音笔支持课堂实时转写、边录边拍,录音笔记可一键同步至 WorkBuddy 和腾讯文档。科研场景下提供可溯源的精准 AI 搜索,专家模式可自动生成论文摘要和指定文件格式。
公众号:京东JoyAIAI 评分3737 京东JDD圆桌热议人机共生:未来住宅或需为机器人留出空间
京东全球科技探索者大会(JDD)上一场跨界圆桌讨论了机器人进入工厂与家庭后的人机共生问题,极佳视界创始人黄冠预计未来新房和小区或许需要为机器人设置充电、维修和使用工具的专门区域。京东JoyInside产品经理刘皓琰介绍,搭载JoyInside的AI毛绒玩具已让部分孩子将其视作伙伴,JoyInside正探索让AI从被动响应走向主动服务。
Tripo@tripoaiAI 评分3131
Hao AI Lab@haoailabAI 评分6060
Kling AI@Kling_aiAI 评分1212OpenRouter:Announcements(RSS)精选AI 评分7373 DeepSeek V4 哪些型号支持图像输入?OpenRouter 逐款梳理与调用指南
OpenRouter 梳理其目录中的 DeepSeek V4 系列图像输入支持情况:V4.1 Flash 原生读图(2026年9月10日上线,$0.15/$0.60 每百万 token)。
推荐理由:原文逐一列出 DeepSeek V4 各型号是否支持图像输入、价格和调用方式,并给出文本-only 型号配视觉模型的两段式替代方案。
Luma@LumaLabsAIAI 评分4040拍完照是不是总有人问你要背面视角?我们也是。 Camera Angles 把一张照片变成一整组拍摄。选好你的角度,就能从每个角度拿回同一个主体,细节完好无损。 为你那些希望当初拍了的镜头而生。
NVIDIA Blog(RSS)AI 评分4848 黄仁勋亮相 Dreamforce:Salesforce 首个 CRM 推理模型 Koa 基于 NVIDIA Nemotron 3 Super 打造
Salesforce 发布首个 CRM 推理模型 Koa,基于 NVIDIA Nemotron 3 Super 后训练而成,训练数据来自近三十年企业 CRM 部署的专有合成数据集。
Tomer Tunguz 博客(VC 分析)精选AI 评分6161 Vercel 将 inbound 销售团队从 10 人压缩至 1.25 人,AI 销售开发智能体年成本仅数千美元
Vercel COO Jeanne DeWitt Grosser 在 The Information 访谈中表示,公司 inbound 销售开发已实现 90% 自动化,团队从 10 人压缩至 1.25 人。
推荐理由:Vercel COO 给出自家 inbound 销售自动化的人员压缩、年度基础设施成本和 32x ROI 数字,是可直接参考的一手落地案例。
Krea@krea_aiAI 评分5555
ClaudeDevs@ClaudeDevsAI 评分2020我们通过 Claude for Startups 与许多早期团队合作。在 Frontier Day 上,我们问了几位创始人,现在用 Claude 构建一家公司是什么样子:
LlamaIndex:产品、工程与评测AI 评分5454 LlamaIndex:为什么更好的抽取模型并不能缩小你的文档复核队列
LlamaIndex 发文分析 OCR 文档处理中准确率与自动化率的关系,指出路由门控而非读取能力决定直通处理率。文中算例显示 20 个字段的发票在 97% 每字段准确率下仅约 54% 文档全对,94% 准确率但带每字段置信度的 Pipeline B 可自动放行 92% 文档,而 97% 准确但无信号的 Pipeline A 直通率为 0。
PixVerse@PixVerseAI 评分1818
Artificial Analysis@ArtificialAnlysAI 评分6767
Hao AI Lab@haoailabAI 评分4949
Cohere@cohereAI 评分3131卡特尔现在正打着 AI 安全的旗号推动反垄断豁免。 这不是建立有韧性的全球 AI 生态的方式。 来听我们的 CEO @aidangomez 在 @CNBC 上的更多分享
Arena.ai@arena精选AI 评分6969推荐理由:榜单给出四款新模型在图像生成网站任务上的排名和每百万 token 价格,可据此比较性能与成本差异。
Claude Code:GitHub Releases(RSS)AI 评分3636 Claude Code v2.1.273 发布:新增网关请求头与远程会话分叉
Claude Code v2.1.273 新增 x-claude-code-request-class 等 5 个 LLM 网关请求头,需用 CLAUDE_CODE_GATEWAY_HINT_HEADERS=1 开启,并支持从 Claude app 分叉 --remote-control 会话在本地后台运行。
Perplexity@perplexity_aiAI 评分3939
OpenAI Developers@OpenAIDevsAI 评分2828
OpenRouter@OpenRouterAI 评分3030新功能:支持地理围栏请求的供应商会显示美国/欧洲标记 🇺🇸🇪🇺 https://openrouter.ai/docs/guides/features/in-region-routing
vLLM 官方博客(RSS)AI 评分5555 vLLM 如何用 GB300 NVL72 为 Kimi K3 训练最快的 DSpark 投机解码模型
vLLM 团队扩展 Speculators 训练库,为 2.8T 参数的 Kimi K3 训练出 DSpark 投机解码 draft 模型,将数学推理单流交互速度从约 110 提升至约 435 tok/s/user,并发负载下输出吞吐最高提升约 3.5 倍。
Google Research:Blog(网页)AI 评分4444 Google 用 Retrieve-for-Train 框架突破推理瓶颈,加速复杂 AI 搜索
Google Research 提出 Retrieve-for-Train 框架,用离线强化学习将奖励对齐的查询扇出编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归生成完整结果集,无需测试时 CoT 推理 token。该方法基于 Gemma3-4B 和 Qwen3-4B 微调,旨在解决零样本 LLM 的复述坍缩与自回归延迟瓶颈,论文已被 ICML 2026 收录。
OpenAI Developers@OpenAIDevsAI 评分5050GPT-5.5 将继续通过 OpenAI API Platform 以及使用 API key 认证的 Codex 会话提供。
Modal 官方工程博客(RSS)AI 评分4444 Modal 产品更新:Sandbox Sidecars 公测、Kimi K3 等新模型支持与仪表盘改版
Modal 8 月更新为 Kimi K3、Qwen3.8-2.4T-A95B、GLM-5.3 和 GLM-5.3-Flash 四款开源权重模型提供 day-zero 支持,其中 Kimi K3 为 2.8T 参数多模态模型,支持 1M-token 上下文窗口,在智能体负载下达到 460 tokens/秒。