#产品更新
#产品更新
今日 8 条
World Labs@theworldlabsAI 评分1919Google Developers Blog(RSS)精选AI 评分6060 Antigravity SDK 支持本地模型,首发 Gemma 4 26B A4B 配合 LiteRT
Google 宣布 Antigravity SDK 支持本地工作流,首发支持通过 Google AI Edge 的 LiteRT 运行 Gemma 4 26B A4B,可完全离线获得智能体辅助能力,建议机器配备超过 24GB VRAM 或统一内存。
推荐理由:官方给出完整的本地模型接入步骤和混合编排示例,开发者可以直接照此把智能体工作流搬到离线环境。
Google DeepMind:Blog(RSS)AI 评分5454 Google DeepMind 为 Private AI Compute 增加安全的服务端持久记忆
Google DeepMind 宣布将为 Private AI Compute 平台引入私密的服务端持久记忆,使 AI 助手能跨设备长期保留上下文。数据密封在云端专用加密存储中,解密密钥仅保存在用户设备上,请求通过端到端加密通道在隔离的安全飞区中临时解密处理,即使 Google 也无法访问。
Google DeepMind精选AI 评分6464 Gemini Live Avatar 上线企业入口,生成同步说话的视频形象
谷歌将实时视频形象加入 Gemini 3.8 Live,企业可构建带口型、表情和语音同步的对话角色,并在后台调用工具。服务支持多语言和预设形象;从参考图片定制形象需要企业白名单,音视频输出带有 SynthID 水印。
推荐理由:实时形象与工具调用结合,让企业对话界面可以表达表情和口型,公开的准入条件便于评估实际接入范围。
Google AI@GoogleAIAI 评分6262vLLM 官方博客(RSS)精选AI 评分7474 vLLM 发布 vllm-metal v0.28.0:在 Apple Silicon 上支持并发推理服务
vLLM 官方发布 vllm-metal v0.28.0,把 vLLM 的 V1 调度器、paged KV cache 和 OpenAI 兼容服务器带到 Apple Silicon,由 MLX 和 Metal 执行模型,版本号与上游 vLLM 对齐。
推荐理由:官方首次发布 vllm-metal,用 packed varlen attention 和 paged KV 解决 Mac 上并发请求的服务问题,并给出可复现的并发基准数据。
Baseten 工程博客(网页)AI 评分5656 NVIDIA Nemotron 3 Diarization 上线 Baseten,实时说话人分离低至每音频小时一美分
Baseten 发布对 NVIDIA Nemotron 3 Diarization 的托管支持,这是一个约 100M 参数的流式说话人分离模型,单一 checkpoint 可在 0.32 到 30.4 秒间配置四种算法延迟。
Google DeepMind@GoogleDeepMindAI 评分5757Hugging Face:Blog(RSS)AI 评分5959 NVIDIA 发布开源 100M 参数说话人分离模型 Nemotron 3 Diarization,登顶 VoiceArena Diarization-Bench
NVIDIA 发布开源权重、100M 参数的 Nemotron 3 Diarization 说话人分离模型,支持最多八名说话人,在 VoiceArena Diarization-Bench 12 个系统中以 14.72% DER 排名第一,比第二名低约 24% 相对值。
OpenAI:官网动态(RSS · 排除企业/客户案例)精选AI 评分6767 OpenAI 向乌克兰政府开放 Daybreak 网络防御计划
OpenAI 宣布向乌克兰政府开放其 Daybreak 计划,支持民用基础设施的网络防御,与乌克兰数字化转型部合作提供识别软件漏洞、开发和测试修复的工具。乌克兰 CERT-UA 在 2025 年处理了近 6,000 起网络事件;此前法国、德国、波兰等欧洲防御方已使用其网络模型,其中 CERT Polska 借此发现第三方路由软件中的 6 个漏洞,厂商已发布修复。
推荐理由:原文给出 Daybreak 计划向乌克兰开放的具体安排和 CERT-UA、CERT Polska 的使用案例,读者可借此了解 AI 网络防御工具的实际落地。
Qwen@Alibaba_QwenAI 评分6565Qwen 发布 Qwen Intelligence,推出三款移动端智能体:Mobile Planner Agent 规划与编排复杂任务,在 MobilePA-Bench。
Tencent Hy@TencentHunyuanAI 评分5757
Tencent Hy@TencentHunyuanAI 评分5656OpenAI NewsAI 评分4242 ChatGPT Ads 扩展至东南亚和台湾
ChatGPT Ads 宣布扩展至东南亚和台湾,使符合条件的商家可在超过 60 个国家和地区触达用户。
Grok@grokAI 评分4747汽车过去只是把你送到公司。现在它能在路上帮你做一部分工作。 现在你可以在特斯拉里使用 Grok Bot 和 Connectors。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分6363 OpenAI 为 GPT-6 推出改进的提示词缓存系统与诊断工具
OpenAI 为 GPT-6 系列推出改进的提示词缓存系统,默认提高缓存命中率,对 30 分钟窗口内复用的合格共享前缀提供最高 90% 的缓存输入 token 折扣。
Perplexity@perplexity_aiAI 评分6464
Arena.ai@arenaAI 评分7474
StepFun@StepFun_aiAI 评分5959Google Developers Blog(RSS)AI 评分5757 Google Colab 纳入 Google AI 订阅计划
Google 宣布 Google AI 订阅用户即日起可获 Colab 高级权益,包括优先使用更快的加速器和更强的机型。Google AI Ultra 订阅还解锁后台不间断执行和 Premium GPU,长训练任务无需保持浏览器标签页打开,权益将在未来几周内向 Colab 支持国家/地区的订阅用户推出,原 Colab 订阅不受影响且可与 Google AI 订阅权益叠加。
Perplexity@perplexity_aiAI 评分6262Claude Code:GitHub Releases(RSS)精选AI 评分6868 Claude Code v2.1.280 发布,新增 Claude Opus 5.5 为默认 Opus 模型
Claude Code 发布 v2.1.280,新增 Claude Opus 5.5(claude-opus-5-5)为默认 Opus 模型,支持 1M 上下文,价格为 $4/$20 per Mtok、缓存读取 $0.20/Mtok;同时将 Pro 和 Team Standard 计划的默认模型从 Sonnet 改为 Opus。
推荐理由:官方更新日志详列了新增 Opus 5.5 默认模型、价格与大量修复,开发者可据此判断是否升级及对现有工作流的影响。
Databricks:Blog(RSS)AI 评分5959 Databricks Genie One MCP 正式发布,让任意 AI Agent 访问受治理的业务数据
Databricks 宣布 Genie One MCP 服务器正式向所有用户开放,让任意 Agent 通过统一接口获取 Genie One 的结构化与非结构化数据、洞察和答案,并以 Genie Ontology 作为受治理的业务上下文基础。
Databricks:Blog(RSS)AI 评分5252 Databricks 发布 Genie One MCP,为任意 AI 智能体提供受治理的业务上下文
Databricks 正式发布(GA)Genie One MCP,将 Genie Ontology 中的已批准指标定义、数据关系、来源权威性和权限控制接入 ChatGPT、Claude、Microsoft Copilot、Claude Code 等 MCP 兼容助手。
StepFun@StepFun_aiAI 评分5757
Unsloth AI@UnslothAIAI 评分6565
OpenRouter@OpenRouterAI 评分5454
LlamaIndex:产品、工程与评测精选AI 评分6666 LiteParse 9 月更新:PDFium 提速 20-25%,新增视觉定位与 is-complex 路由 API
LlamaIndex 发布 LiteParse 2.14.6 更新,通过对自维护 PDFium fork 做内存分配优化(内置 mimalloc)等手段,将文本提取耗时降低 20-25%,平均 2.76ms/页,markdown 渲染 3.94ms/页。
推荐理由:原文给出速度、表格准确率等实测对比数据和新增 API,读者可据此评估是否替换现有 PDF 解析方案。
Tencent Hy@TencentHunyuanAI 评分5151Apple:Newsroom(RSS)精选AI 评分6565 Apple 新款 Mac mini(M6/M5 Pro)与 Mac Studio(M5 Max/M5 Ultra)今日开售
Apple 宣布新款 Mac mini 和 Mac Studio 于 9 月 22 日开售。Mac mini 搭载 M6 和 M5 Pro,AI 性能最高提升 4 倍。
推荐理由:官方发布文给出了完整芯片规格、AI 性能倍数和定价,读者可据此评估新桌面机对本地 AI 工作流的适配度。
OpenRouter:Announcements(RSS)精选AI 评分7070 OpenRouter 推出 Batch API,批量推理可享半价
OpenRouter 发布 Batch API,异步批量请求由供应商在 24 小时窗口内完成,通常按正常 per-token 价格的 50% 或更低收费,目前已支持 70 多个模型。
推荐理由:公告给出折扣幅度、70+ 模型覆盖和 beta 期 230k+ 批次的实测完成时间,还提示了提交时段对速度的影响。
Kimi.ai@Kimi_MoonshotAI 评分6464
Kimi.ai@Kimi_Moonshot精选AI 评分6969推荐理由:官方原文给出了产品入口、侧边栏能力和把重复操作存为 skill 的做法,读者可据此评估是否纳入自己的浏览器工作流。
Hugging Face:Blog(RSS)精选AI 评分7373 transformers 支持直接加载 GGUF 量化模型,本地推理性能接近 llama.cpp
Hugging Face 宣布 transformers 支持直接运行 GGUF 量化模型,通过 from_pretrained 传入 gguf_file 即可加载 Hub 上的 GGUF checkpoint,并复用 ggml 的 Metal 内核。
推荐理由:官方宣布 transformers 直接加载 GGUF,给出在 Apple Silicon 上接近 llama.cpp 的实测吞吐和加载方法,可帮助本地推理用户选择工作流。
公众号:千问APP(阿里)AI 评分5858 千问发布三款 AI 硬件:AI 眼镜 N1、N1 Pro 与耳夹式耳机开启预约
千问在云栖大会首次展示三款新一代 AI 硬件,并已在千问官方旗舰店开启线上预约,10月13日现货发售。千问AI眼镜 N1 配备 5000 万像素传感器、支持第一视角拍摄;N1 Pro 支持眼动追踪与虹膜支付;耳夹式耳机采用 Bose 调音并内置 AI 助理,支持面对面翻译、AI 听记和语音办事。
Claude:YouTube(RSS)AI 评分5353 Claude 将 Cowork 与聊天整合为一
Claude 官方视频宣布 Cowork 与聊天功能合并,统一为一个 Claude。
Grok@grokAI 评分3030
ViggleAI@ViggleAIAI 评分5252Fireworks AI(网页)精选AI 评分6161 Fireworks AI 推出 Specialized Intelligence Index 领域基准索引
Fireworks AI 推出 Specialized Intelligence Index(SII),汇集开放、闭源与专用模型在真实工作任务基准上的表现,首批覆盖医疗、法律、网络安全、金融、客服、生产力和软件七个领域。
推荐理由:Fireworks 联合多家行业实践方推出领域基准索引,不做跨领域综合排名,读者可按成本和时长自行权衡模型选择。
Claude:YouTube(RSS)AI 评分5353 Claude 宣布 Cowork 与聊天合并为同一个 Claude
Claude 官方发布短视频宣布 Cowork 和聊天功能现已合并为同一个 Claude。视频无正文文本,仅能从标题确认这一功能合并事实。