#模型发布
#模型发布
今日 2 条
ClaudeDevs@ClaudeDevsAI 评分7777
Anthropic@AnthropicAIAI 评分7272Anthropic:Newsroom(网页)精选AI 评分9191 Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,官方称多数工作表现与 Claude Fable 5.1 相当,运行成本较 Opus 5 降低 40%,输入和输出 token 定价为每百万 $4 和 $20,输出速度快 30% 以上。
推荐理由:官方公告同时给出基准分数、完整定价表和防护措施细节,读者可以据此比较它相对 Opus 5 的成本与能力变化。
Claude@claudeaiAI 评分7070
Arena.ai@arenaAI 评分7272
Tencent Hy@TencentHunyuanAI 评分5858
StepFun@StepFun_aiAI 评分6363
Tencent Hy@TencentHunyuanAI 评分5555公众号:腾讯混元AI 评分6666 腾讯混元发布 Hy Image3.5 preview 专业生图模型
腾讯混元发布混元图像 3.5 预览版(Hy Image3.5 preview),官方称综合能力较 Hy Image3.0 提升约 30%,内部数百名设计师 GSB 盲测中与 Seedream 5.0 pro 持平,略优于 Nano-Banana Pro 和 Qwen-Image-3.0 Pro。
腾讯混元:Research(API)精选AI 评分6060 腾讯混元发布 Hy Image3.5 preview 图像生成模型
腾讯混元发布 Hy Image3.5 preview,支持文生图与图生图、最多 5 张参考图、多轮编辑和最高 2K 分辨率输出,经上百名专业设计师 GSB 盲测对上一代胜率综合提升 30% 以上。
推荐理由:原文给出了文本渲染、编辑一致性与定价等具体能力细节,以及多家腾讯内部产品的实测反馈,便于评估适用场景。
Xiaomi MiMo@XiaomiMiMoAI 评分5858
OpenRouter@OpenRouterAI 评分6060小米 MiMo-V2.6 系列三款模型上线 OpenRouter,包括 1T+ 参数旗舰、开源 MoE 模型和约 10 倍速的旗舰变体。三款模型均支持文本、图像、视频和音频输入,上下文为 1M。
Arena.ai@arenaAI 评分6666
Xiaomi MiMo@XiaomiMiMo精选AI 评分7373推荐理由:官方发布全模态模型并开放权重、技术报告和训练代码,附与 Claude Opus 5、GPT-5.6 Sol 的 Agent 基准对比数据。
公众号:小米 MiMoAI 评分7474 小米发布并开源 MiMo-V2.6 系列,扩展强化学习规模迈向自我提升
Xiaomi MiMo 于今日正式发布并开源 MiMo-V2.6 系列模型,包含 Pro 与 Flash 两个原生全模态模型,称这是探索 RSI(递归自我改进)路径的关键一步。
Artificial Analysis@ArtificialAnlysAI 评分6666
Arena.ai@arenaAI 评分5454
Arena.ai@arenaAI 评分6464
OpenRouter@OpenRouterAI 评分6363Microsoft Research 博客(RSS)AI 评分5252 Microsoft Research 发布开源逆合成模型 RetroChimera 并登上 Nature
Microsoft Research 在 Nature 发表逆合成预测模型 RetroChimera,结合基于 Transformer 的 R-SMILES 2 和图神经网络模型 NeuralLoc,用 learning-to-rank 集成两者互补预测。
xAI:News(网页)精选AI 评分7474 xAI 发布 Grok 4.7,主打编码与知识工作
xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。
推荐理由:官方给出了完整定价、速度和多项基准对比,读者可以据此把 Grok 4.7 放进现有模型选型里横向比较。
Qwen@Alibaba_QwenAI 评分7070
Qwen@Alibaba_QwenAI 评分6363
Qwen@Alibaba_QwenAI 评分6060Qwen:Blog Retrieval(API)精选AI 评分7272 Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像
Qwen 团队开源 Qwen-Image-2.1,将文生图与图像编辑统一到一个模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/独立蒙版指定局部编辑,通过混合粒度注意力架构和 KV cache 复用提升推理效率,同时改进文字渲染、人像光照与人物产品保真度,并覆盖全景图、信息图和分镜等任务。
推荐理由:官方详解了 7B 统一图像模型的透明图像生成、10 图参考编辑与推理优化,读者可据此评估在设计等场景的可用性。
StepFun@StepFun_aiAI 评分6060公众号:阶跃星辰(Step)精选AI 评分6666 阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重
阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。
推荐理由:官方完整公布架构参数、基准成绩和权重开放时间,读者可据此评估其在开源主力模型中的成本能力位置。
Qwen@Alibaba_QwenAI 评分5757
Artificial Analysis@ArtificialAnlysAI 评分5555
Qwen:Blog Retrieval(API)精选AI 评分6969 Qwen 发布 Qwen3.8-LiveTranslate 实时同传模型,LAAL 降至 2.3 秒
Qwen 发布 Qwen3.8-LiveTranslate,采用 Interleave 架构与 Hybrid-MoE Thinker–Talker 设计重构实时同声传译,平均滞后(LAAL)从上一代的 2.8 秒降至 2.3 秒。
推荐理由:官方给出了架构设计、LAAL 从 2.8 秒到 2.3 秒的数字和多语言评测结果,读者可以据此评估其实时翻译能力的实际变化。
公众号:智谱(GLM)AI 评分6262 智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s
智谱正式推出 GLM-5.3-FlashX,在 GLM-5.3-Flash 基础上加大对 Infra 侧投入与推理优化,速度最高 200 tokens/s,算力基于 10 万张国产芯片。该模型此前曾以 Ox Alpha 之名面向开发者,官方称其长期保持同尺寸最强智能水平并具备高性价比,API 已上线,Model Key:GLM-5.3-FlashX。
Qwen@Alibaba_QwenAI 评分7373通义千问发布 Qwen3.8-Omni-Flash,是 Qwen 首个以智能体能力为核心构建的全模态模型,支持原生音视频理解、推理和工具调用。
Qwen:Blog Retrieval(API)精选AI 评分7878 Qwen 发布原生全模态模型 Qwen3.8-Omni-Flash,主打音视频智能体任务交付
Qwen 发布下一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频和视频输入及 1M token 上下文窗口,29 项评测平均分较 Qwen3.5-Omni-Plus 提升超过 25%,音频输入每小时价格下降超过 98%,音视频输入每小时价格下降超过 93%。
推荐理由:官方发布同时开放 API 和开源插件与运行时,读者可以据此评估音视频智能体在剪辑、会议、实时交互等工作流中的落地方式。
SenseTime@SenseTime_AIAI 评分5757
SenseTime@SenseTime_AIAI 评分5353蚂蚁 inclusionAI:GitHub 新仓库AI 评分5656 蚂蚁 inclusionAI 开源 Ming-Image-0.1-Design 系列设计图像生成模型
蚂蚁 inclusionAI 在 GitHub 开源 Ming-Image-0.1-Design 系列,包含两个 6B 参数模型:Ming-Image-0.1-Design 生成 UI、信息图、海报等文字丰富的完整视觉设计,Ming-Image-0.1-Design-Layer 将平面设计图分解为可独立编辑的透明图层。
公众号:面壁智能(MiniCPM)AI 评分6565 外部团队基于 MiniCPM-o 4.5 开源全模态交互智能体 Gander,让 Agent 边干活边对话
浙江大学等高校的外部研究者以 MiniCPM-o 4.5 为基座后训练,开源了端到端全模态交互智能体 Gander,论文、数据、代码和模型全部开放。
Google AI:DEV 作者专属(RSS)AI 评分7070 Google 发布 Gemini 3.8 Live 与 3.5 Transcribe 实时语音模型
Google 在 Gemini API 和 Google AI Studio 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 语音模型,支持异步函数调用、视觉上下文、97+ 语言和可配置思考,Extended Thinking 版位列 Artificial Analysis 语音到语音榜单第一。
NVIDIA Blog(RSS)AI 评分5151 NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐最高达 GB300 NVL72 的 3.7 倍
NVIDIA Vera Rubin NVL72 首次提交 MLPerf Inference v6.1 preview 结果,Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,DeepSeek-R1 上最高 2.5 倍。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分6161 蚂蚁 inclusionAI 开源全双工音视频交互模型 Realtime-Venus
蚂蚁集团 inclusionAI 在 Hugging Face 发布 Realtime-Venus,包含 Realtime-Venus-Omni 和 Realtime-Venus-Audio 两个 9B 检查点,基于 MiniCPM-o 4.5 / Omni-Flow 架构,语言骨干为 Qwen3-8B。