#模型发布
#模型发布
今日 2 条
ClaudeDevs@ClaudeDevsAI 评分4949
Claude@claudeaiAI 评分5151Anthropic 官方宣布推出 Claude Fable 5.1 和 Claude Mythos 5.1 两款新模型。官方称它们是编码和知识工作领域最先进的模型。
Claude Platform:开发者版本说明(RSS)精选AI 评分7272 Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1
Anthropic 发布 Claude Fable 5.1(claude-fable-5-1),面向长时间运行的智能体编码、知识工作与研究,Claude Mythos 5.1 面向 Project Glasswing 参与者。
推荐理由:官方版本说明给出定价、缓存和 API 兼容性变化,开发者可据此评估迁移成本与新特性用法。
Artificial Analysis@ArtificialAnlysAI 评分6161
AI at Meta@AIatMetaAI 评分6262
World Labs@theworldlabsAI 评分4848推出 Atlas: 全球首个多模态世界模型,可生成图像和视频帧,具备像素级精准的相机控制,并在 3D 中重建它们。 建模世界,移动相机,模拟空间与时间。
Google DeepMind精选AI 评分8080 Gemini 3.8 Flash 发布,网络安全版本限定防御团队使用
谷歌推出 Gemini 3.8 Flash,升级编码、推理和长程智能体任务,并接入开发平台及部分付费消费入口。另一个 Flash Cyber 版本只向获准的防御团队开放;普通版本的优惠价格有截止日期,更高推理强度也可能增加用量。
推荐理由:通用版本与安全专用版本采用不同开放范围,团队可以同时比较日常任务能力、推理成本和受控访问条件。
Artificial Analysis 完整文章(网页)精选AI 评分6666 Google 发布 Gemini 3.8 Flash,四个月内第四款 Flash 模型
Google DeepMind 发布 Gemini 3.8 Flash,在 Artificial Analysis Intelligence Index 上以 high 推理得分 59,较 Gemini 3.7 Flash 提升 3 分。
推荐理由:评测方一手数据给出了智能指数、单任务成本和速度的具体变化,可帮助读者判断该模型在实际任务中的性价比。
Artificial Analysis 完整文章(网页)精选AI 评分7474 Meta 发布 Muse Spark 1.3,Artificial Analysis 指数达 61/62 分逼近前沿
Meta 发布 Muse Spark 1.3,是其五个月内第四个 Muse Spark 版本。xhigh 版在 Artificial Analysis Intelligence Index 得 61 分。
推荐理由:独立评测方给出与同档模型的分数和单任务成本对比,读者可据此判断该模型在智能与成本上的位置。
OpenRouter@OpenRouterAI 评分5757蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5252 蚂蚁 inclusionAI 发布 Ling-3.0-flash 原生混合推理模型
蚂蚁 inclusionAI 发布下一代原生混合推理模型 Ling-3.0-flash,总参数 124B、激活参数 5.1B,约为前代 1T 级旗舰 Ring-2.6-1T 的 12.4% 和 8.1%,在关键基准上持平或超越前代。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4545 蚂蚁 inclusionAI 发布 Ling-3.0-flash-singprobe 流式安全探针
蚂蚁 inclusionAI 在 Hugging Face 发布 Ling-3.0-flash-singprobe,一个基于 Ling-3.0-flash 的流式安全护栏探针,复用基座模型隐藏状态在每个 token 上输出意图、不安全性和幻觉风险共 10 类评分,探针参数仅 5.18M,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4545 蚂蚁 inclusionAI 发布 Ling-3.0-tiny-singprobe 流式安全探针
蚂蚁 inclusionAI 在 Hugging Face 发布 SingProbe,一个基于 Ling-3.0-tiny 的流式安全探针,仅 3.22M 参数,复用基座模型隐藏状态在每个 token 上输出 8 类意图、不安全响应和幻觉风险评分,解码开销低于 0.5%。
Tencent Hy@TencentHunyuanAI 评分6767上海人工智能实验室 InternLM:原创项目精选AI 评分6363 上海AI实验室发布 InternLumina-U2:16B-A1B 多码本扩散统一多模态模型
上海AI实验室发布 InternLumina-U2,一个 16B 参数(激活 1B)的 MoE 扩散语言模型,用 8 码本全离散视觉表示统一覆盖文本问答、文生图、图像理解与编辑、视频及 3D 理解。
推荐理由:原文给出多码本全离散统一架构的设计细节、基准分数和双硬件适配说明,读者可以了解统一理解与生成模型的一条新路线。
Google Research:Blog(网页)AI 评分5555 Google Research 发布 TimesFM-3:330M 参数零样本多变量时序预测基础模型
Google Research 发布 TimesFM-3,一款原生支持多变量时序预测的零样本基础模型,参数量 330M,在超过 1 万亿时间点的真实与合成语料上预训练。
Runway:News(网页)精选AI 评分6767 Runway 发布 Interface World Models 首个模型 Solaris,实时逐帧生成可交互界面
Runway 发布 Solaris,称其为新模型家族 Interface World Models 的第一个模型,由世界模型实时逐帧生成界面并对点击、拖拽等交互作出响应,无需代码等中间表示。
推荐理由:官方完整披露了模型机制、用户研究和局限,读者可以据此理解去除中间表示后界面生成与智能体训练的路径。
Microsoft Research@MSFTResearchAI 评分2929Meta 官方精选AI 评分7070 Muse Voice Transcribe 发布,实时转写支持多说话人与语言切换
Muse Voice Transcribe 提供流式语音识别、说话人区分和端点检测,已用于 Meta AI、Muse Code 并通过模型 API 提供。模型训练覆盖七十多种语言,其中二十五种经过深入验证;支持语言切换不代表所有语言质量完全相同。
推荐理由:实时转写同时输出说话人和语言变化,为会议及编程助手保留对话结构,便于后续检索和任务处理。
Microsoft Research 博客(RSS)AI 评分7272 微软研究院发布高效病理基础模型 GigaPath-Flash 与 GigaTIME-Flash
微软研究院推出 GigaPath-Flash 和 GigaTIME-Flash,旨在通过蒸馏技术大幅降低计算成本以支持大规模病理研究。GigaPath-Flash 将十亿参数模型压缩至 22M 参数,在保持竞争力的同时实现约 50 倍的算力节省;GigaTIME-Flash 则提升了空间蛋白质组学预测效率并改善了泛化能力。两款模型均以 Apache 2.0 协议开源,专为科研设计而非临床诊断,使研究人员能在单 GPU 上处理百万级切片数据。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini Omni 1.1 Flash
Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者带来场景延长、首尾帧插值、360p 快速草稿和最高 4K 放大等生成视频控制能力。
推荐理由:官方给出场景延长、首尾帧插值与 4K 放大等具体能力与开放入口,可据此判断生成视频工作流的变化。
Google DeepMind精选AI 评分7171 Google 发布 Gemini 3.5 Transcribe 语音转文字模型
Google 发布 Gemini 3.5 Transcribe,称其为目前最精确的语音转文字模型,可将原始音频直接转为准确、格式化文本。据 Artificial Analysis 测量,流式场景平均词错误率 4.0%,非流式 2.6%;相比上一代 Chirp 3,最终转写时间改善 70%,FLEURS 基准上流式 WER 为 5.50%、非流式为 5.04%。
推荐理由:Gemini 3.5 Transcribe 的 WER、延迟与多语言数据,可用来判断实时语音转写当前的能力水位。
Google DeepMind精选AI 评分7878 Google 发布 Gemini 3.7 Flash,面向编码与智能体并降价一半
Google DeepMind 发布 Gemini 3.7 Flash,定位为面向编码与智能体的最强主力模型,距 Gemini 3.6 Flash 发布仅三周。
推荐理由:官方给出与 3.6 Flash 的多项基准对比和半价定价,可据此判断编码与智能体场景的成本变化。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 SL2T 手语转文本模型,落地 Gboard 与 Live Transcribe
Google DeepMind 发布多语言手语转文本模型 SL2T,在 Gboard 和 Live Transcribe 中为 Pixel 11 提供手语听写功能,首发支持美国手语(ASL)转英文。
推荐理由:Google DeepMind 发布多语言手语转文本模型 SL2T,并首次落地 Gboard 与 Live Transcribe,可了解其数据规模与隐私设计。
Microsoft ResearchAI 评分4040 Microsoft Research 推出 CARE-X:面向临床放射学的胸部 X 光 VLM
Microsoft Research 发布研究模型 CARE-X,一个面向胸部 X 光多种临床解读任务的统一视觉语言模型,结合生成式与结构化预测,并用强化学习(DAPO)在多任务设置下奖励临床正确性。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 WeatherNext 气旋预报模型并开源
Google DeepMind 在 Nature 发表论文,称 WeatherNext AI 模型在预测气旋路径、强度和风场结构上达到 SOTA,平均为预报员多争取一天预警时间,三天预报精度相当于此前模型的两天水平。
推荐理由:原文给出气旋预报多出一天预警时间的实测结果与开源入口,读者可据此判断气象 AI 的可用边界。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini Robotics ER 2 具身推理模型
Google DeepMind 发布 Gemini Robotics ER 2,定位为机器人的高层大脑,可理解物理世界、规划多步任务,并把动作执行交给底层 VLA 模型,同时支持调用 Google Search 等工具。
推荐理由:官方给出 ER 2 相对 ER 1.6 的能力升级与开放入口,读者可据此判断机器人在视频理解与多机协作上的进展。
Google DeepMindAI 评分5858 Google DeepMind 在 Flow Music 发布音乐生成模型 Lyria 3.5
Google DeepMind 发布音乐生成模型 Lyria 3.5,并当天在 Google Flow Music 上线。新版本在旋律结构、歌词质量与提示词遵循、人声表现力与发音上均有提升,同时让用户更易控制输出的节奏与时长。
Google DeepMind精选AI 评分7474 Google DeepMind 发布 Gemini Robotics 2,实现机器人全身控制
Google DeepMind 发布 Gemini Robotics 2,由 Gemini Robotics 2、Gemini Robotics ER 2 和 Gemini Robotics On-Device 2 三款模型组成,首次实现对人形机器人从脚到指尖的全身控制,并支持双手与夹爪的精细操作和多机器人协作。
推荐理由:官方给出三款模型的定位与开放入口,可据此判断机器人全身控制与端侧适配的进展。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和面向代码安全的 3.5 Flash Cyber 三款模型。
推荐理由:官方给出三款 Flash 新模型的 token 效率、价格与基准对比,可据此判断智能体工作流的成本变化。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini 3.5 Flash Cyber 网络安全模型
Google DeepMind 发布 Gemini 3.5 Flash Cyber,这是基于 3.5 Flash 微调的轻量网络安全模型,用于快速发现、验证和修补漏洞,在 CyberGym 等基准上以多次调用取得接近更大模型的成绩。
推荐理由:Google 把轻量 Flash 微调成专用安全模型,并给出 CyberGym 与 Chrome 流水线的实测对比,可看专用小模型在漏洞挖掘上的取舍。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Nano Banana 2 Lite 与 Gemini Omni Flash
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash 两款模型。
推荐理由:两款新模型给出了延迟、单价与可用入口,读者可据此判断图像与视频生成链路的成本变化。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 DiffusionGemma:文本生成提速 4 倍
Google DeepMind 发布实验性开源模型 DiffusionGemma,采用文本扩散方式并行生成整块文本,在专用 GPU 上推理速度最高提升 4 倍。
推荐理由:Google DeepMind 开源文本扩散模型,给出 4x 推理加速与本地部署的硬件门槛,可据此判断速度优先场景的取舍。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Gemini 3.5 Live Translate 实时语音翻译模型
Google DeepMind 发布音频模型 Gemini 3.5 Live Translate,可自动检测 70+ 语言并生成保留说话人语调、节奏和音高的近实时语音翻译,全程仅落后说话人数秒。
推荐理由:Gemini 3.5 Live Translate 支持 70+ 语言连续语音翻译,并同步开放 API、Meet 与 Translate 入口,可据此判断实时翻译的落地节奏。
Google DeepMind精选AI 评分7878 Google DeepMind 发布 Gemma 4 12B:统一无编码器多模态模型
Google DeepMind 发布 Gemma 4 12B,一款面向笔记本本地运行的多模态模型,采用无编码器统一架构,视觉和音频输入直接进入 LLM 主干。该模型在标准基准上性能接近 26B MoE 模型,内存占用不到其一半,可在 16GB 显存或统一内存的设备上运行,并首次在中型模型中支持原生音频输入。
推荐理由:Gemma 4 12B 用无编码器架构把视觉和音频直接接入 LLM,读者可据此判断本地多模态智能体的硬件门槛。
Google DeepMind精选AI 评分8282 Google DeepMind 发布 Gemini Omni Flash,支持对话式视频编辑
Google DeepMind 发布 Omni 家族首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本输入生成高质量视频,并通过自然语言多轮编辑视频。
推荐理由:Gemini Omni Flash 把对话式视频编辑和多模态输入整合进 Gemini 应用与 YouTube Shorts,可据此判断生成视频工作流的变化。
Google DeepMind精选AI 评分8888 Google DeepMind 发布 Gemini 3.5 Flash,主打智能体与编码
Google DeepMind 发布 Gemini 3.5 系列首个模型 3.5 Flash,定位面向智能体与编码的前沿性能,即日起通过 Gemini app、Google Search 的 AI Mode、Google Antigravity、Gemini API、Android Studio 及 Gemini Enterprise 等渠道开放。
推荐理由:Gemini 3.5 Flash 的基准成绩、速度与开放渠道一并给出,可据此判断智能体与编码任务的成本变化。
Google DeepMind精选AI 评分7171 Google DeepMind 发布 Gemini 3.1 Flash TTS 语音模型
Google DeepMind 发布 Gemini 3.1 Flash TTS 文本转语音模型,在 Artificial Analysis TTS 榜单上取得 1,211 Elo 分数,并支持 70 多种语言和原生多说话人对话。
推荐理由:官方给出 Gemini 3.1 Flash TTS 的 Elo 分数、音频标签控制方式和多平台开放入口,可据此判断语音生成的可控性变化。
Google DeepMind精选AI 评分6666 Google DeepMind 发布 Gemini Robotics-ER 1.6,新增仪表读数能力
Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其面向机器人推理的模型升级版,重点增强空间推理与多视角理解,并新增仪表读数能力,可读取圆形压力表、液位指示器和数字读数。
推荐理由:官方给出与上一代及 Gemini 3.0 Flash 的对比,并首次开放仪表读数能力,可据此判断机器人在巡检场景的落地边界。