#模型发布
#模型发布
今日 2 条
StepFun@StepFun_aiAI 评分6464
ViggleAI@ViggleAIAI 评分5151Google DeepMind:Blog(RSS)精选AI 评分7070 Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking
Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个近实时语音对话模型,主打语音智能体和复杂任务执行。
推荐理由:原文给出两个语音对话模型的定位分工和多项基准数字,读者可以据此评估其推理、成本与工具调用能力。
Google AI@GoogleAIAI 评分6464Google AI 发布迄今最先进的 Gemini 音频模型 Gemini 3.8 Live 与 3.8 Live Extended Thinking。
公众号:生数科技(Vidu·视频)精选AI 评分6767 生数科技发布 Vidu S2:含 Avatar 与 Editing 双模型,探索空间视频
生数科技正式发布 Vidu S2,包含面向数字角色实时交互的 Vidu S2-Avatar 和面向视频流实时编辑的 Vidu S2-Editing,并探索面向 VR 头显的实时空间视频生成与编辑。
推荐理由:官方发布 Vidu S2 双模型,给出实时交互、编辑与空间视频的技术路线和评测数字,读者可对照判断其流式生成思路。
公众号:阶跃星辰(Step)精选AI 评分6666 阶跃星辰发布 StepAudio 3 系列语音大模型,多款在 Artificial Analysis 榜单全球第一
阶跃星辰发布 StepAudio 3 系列,包含 Realtime、ASR、TTS、Gen 和 Music 五款模型,已在阶跃星辰开放平台上线。
推荐理由:官方完整介绍了五款模型的能力与榜单成绩,可帮助读者了解语音模型在实时交互、理解和创作上的进展。
Fireworks AI(网页)精选AI 评分7272 Fireworks 上线 DeepSeek-V4.1-Flash,DeepSWE 达 GPT-6 Astra 水准、成本仅 1/15
Fireworks 发布 DeepSeek-V4.1-Flash,在 DeepSWE 上取得 74.34% pass@1、每任务 $0.43,与 GPT-6 Astra 同一精度区间但成本仅 1/15。
推荐理由:官方以多基准实测给出 DeepSeek-V4.1-Flash 与闭源模型的成本质量对比和架构细节,可帮助开发者做选型与成本权衡。
SiliconFlow@SiliconFlowAI精选AI 评分6666推荐理由:原文给出了参数规模、上下文长度、开源协议和定价,读者可据此评估它能否接入现有编码与 Agent 工具链。
公众号:小红书技术(dots.llm)精选AI 评分6868 小红书 AllSpark 开源 Search Agent 模型 Iris,35B 与 397B 版本同量级成绩领先
小红书 AllSpark 团队发布并开源 Search Agent 模型 Iris,权重和评测代码已公开,数据与训练配方将陆续公布。
推荐理由:原文给出了数据构造、SFT-RL 训练和统一评测的完整思路,读者可以据此理解 Search Agent 的训练难点与可迁移方法。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5252 蚂蚁 inclusionAI 发布 SingProbe 流式护栏探针,基于 Qwen3.5-4B
蚂蚁 inclusionAI 发布 SingProbe,一个基于 Qwen/Qwen3.5-4B 的轻量探针,复用基座模型隐藏状态在生成时逐 token 输出查询意图、回复不安全性和幻觉风险三类评分,仅 5.18M 参数,解码开销低于 0.5%。
MiniMax (official)@MiniMax_AIAI 评分6262
MiniMax (official)@MiniMax_AIAI 评分6161MiniMax 盘点其开源视频生成模型 MiniMax H3 的社区生态进展,该模型支持原生立体声音频和多模态参考控制。
OpenAI Developers@OpenAIDevsAI 评分7070Suno:Blog(网页)精选AI 评分6868 Suno 发布 v6 音乐模型,推出 v6、v6-wild、v6-mini 三个版本
Suno 发布新一代音乐模型 v6,与 Warner Music Group、BMG、Believe 等行业伙伴合作开发,后续将全面替换旧模型。v6 分为三个版本:旗舰 v6 和探索向的 v6-wild 面向 Pro 与 Premier 订阅用户,更快的 v6-mini 向所有人开放。
推荐理由:官方发布新一代音乐模型,给出三个版本的定位差异和编辑、混音、采样等具体新能力,可帮助创作者判断如何选择和使用。
公众号:生数科技(Vidu·视频)AI 评分5555 生数科技发布 Motus2:面向灵巧操作的自进化通用世界模型
生数科技发布面向机器人灵巧操作的世界模型 Motus2,将行动、预测、评估三种能力统一进同一个共享参数模型,形成生成动作、预测未来、评估结果、更新策略的闭环,并加入轻量触觉专家模块。
Baseten 工程博客(网页)精选AI 评分7676 DeepSeek 发布开源模型 DeepSeek-V4.1-Flash,优化编码智能体 prefill 效率
DeepSeek 本周在 HuggingFace 开源 DeepSeek-V4.1-Flash 权重,模型总参数 552B,prefill 激活 8B、decode 激活 16B,支持 1M token 上下文和文本加图像输入,已上线 Baseten Model APIs。
推荐理由:文章解释了 CED 架构如何把 prefill 降到 8B 激活参数并压缩 KV cache,读者能理解它为何更适配编码智能体的高 prefill 负载。
Artificial Analysis@ArtificialAnlysAI 评分6464
Artificial Analysis@ArtificialAnlysAI 评分7878NVIDIA Blog(RSS)AI 评分5454 Skild AI 发布 S1 机器人基础模型,可从单段视频学习新任务
Skild AI 发布 S1 机器人基础模型,通过 in-context learning 从单段视频演示理解并执行未见过的新任务,无需更新权重或任务专属后训练。
WorkBuddy@WorkBuddy_AI精选AI 评分7070推荐理由:WorkBuddy 官宣上线 DeepSeek V4.1-Flash 并给出两周免费入口,引用内容还说明了 V4-Pro 的退役与迁移安排。
AGIBOT 智元(网页)AI 评分5656 智元发布AGILE2.0感控一体模型,灵犀X2完成踩球走等视觉驱动任务
智元发布AGILE2.0感控一体模型,实现视觉感知、环境理解、全身运动控制与上下肢协同操作的端到端闭环耦合。通过短片《杂技BOT》展示灵犀X2钻火圈、跳长绳、踩球走、协作搬箱子等视觉驱动动态任务,其中踩球走为双足人形机器人自主实现。模型面向动态扰动、人机共存、多机协同等复杂场景,降低现实环境中的定制化开发代价,支持部署态规模化落地。
OpenBMB@OpenBMBAI 评分6161面壁智能转发用户实测,MiniCPM5-2B 已可在 Android 上通过 llama.cpp 加载 GGUF 完成推理,全程数据不离开手机。
SiliconFlow@SiliconFlowAIAI 评分6767IBM Research:AIAI 评分5454 IBM 与 NASA 开源月球基础模型 NASA-IBM Lunar Foundation Model
IBM 与 NASA 开源 NASA-IBM Lunar Foundation Model,整合美日多次探月任务的多模态、多分辨率观测数据。
Tencent Hy@TencentHunyuanAI 评分5959
OpenBMB@OpenBMBAI 评分5757
Unitree@UnitreeRoboticsAI 评分5555宇树全面开源 UnifoLM-WLA-1.0 具身基础模型,官方称在全球开源模型中于多个基准取得新 SOTA 结果。单一模型可协调桌面与全身移动操作,支持跨任务和跨末端执行器泛化,实现单模型全身协调。
OpenBMB@OpenBMBAI 评分6161公众号:面壁智能(MiniCPM)AI 评分5454 面壁智能 MiniCPM5-2B 登顶 Hugging Face Trending,开放权重与训练数据
面壁智能 MiniCPM5-2B 登顶 Hugging Face Trending,在 AA Intelligence Index V4.1.1 评测中位居全球 4B 以下开放权重模型首位,34 项基准平均得分 53.9。
DeepSeek:API 更新日志精选AI 评分8080 DeepSeek 发布 V4.1-Flash,API 价格同步下调
DeepSeek 发布 DeepSeek-V4.1-Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力,评测包括 GPQA Diamond 90.9、HLE 36.8、Codeforces Rating 3471、Terminal-Bench 2.1 90.6 等。
推荐理由:官方发布附带完整评测数字和 API 切换细节,读者可据此判断新模型能力水平及旧模型下线对现有调用和计费的影响。
公众号:DeepSeek(深度求索)AI 评分8686 DeepSeek 发布 V4.1 Flash:552B MoE 多模态模型,同步开源并下调 API 定价
DeepSeek 正式发布 V4.1 Flash,全新 Causal-Encoder-Decoder 结构的 552B 参数 MoE 模型,输入激活 8B、输出激活 16B,具备原生多模态视觉理解,基准测试超越包括 DeepSeek V4 Pro 在内的旗舰模型。
Suno@suno精选AI 评分6666Suno 发布 v6 模型,可将图片、视频和语音备忘录转化为音乐,并对已创建的歌曲进行精确修改。同时提供 v6-wild 版本供探索更多可能性,官方附有 2 分钟以内的功能演示视频。
推荐理由:官方宣布 v6 上线并给出多模态输入与歌曲精修能力,可据此了解音乐生成模型的最新变化。
OpenAI:官网动态(RSS · 排除企业/客户案例)AI 评分8282 OpenAI 发布 GPT-6 Astra,面向专业工作场景
OpenAI 发布 GPT-6 Astra,已在 ChatGPT Work、Codex 和 API 提供,定价为每百万输入 token $10、输出 token $50。
Ant Ling@AntLingAGIAI 评分5151蚂蚁百灵发布 Ling-3.0-flash-VL,并与 Day-0 合作伙伴 Novita 同步上线,限时免费 14 天。
Ant Ling@AntLingAGIAI 评分5252DeepSeek 官方精选AI 评分8282 DeepSeek V4.1 Flash 发布,视觉理解进入默认 Flash API
DeepSeek 发布 V4.1 Flash,在新架构下加入原生视觉理解,并通过 deepseek-flash 接口提供。旧版 V4 Flash 与视觉实验版已退役,原名称暂时指向新版;公告还宣布下调 API 价格。本次发布没有提供可核实的权重开放信息。
推荐理由:原生视觉进入默认 Flash 接口,同时发生旧模型映射调整,使用方需要重新检查模型选择与多模态任务表现。
Cohere 产品与研究博客(网页)精选AI 评分6666 Cohere 发布开源权重翻译模型 North Small Translate,WMT26 得分 83.60 超越 DeepL 与 Google Translate
Cohere 发布机器翻译模型 North Small Translate,为 MoE 架构,总参数 218B、激活 25B,支持 50+ 语言,WMT26 全语言得分为 83.60,高于 DeepL NextGen 的 81.37 和 Google Translate 的 68.20,Agentic 版本达 84.36。
推荐理由:官方公布了 WMT26 各语言和分区域得分、吞吐与单任务成本数据,读者可据此评估其相对 DeepL 和开源模型的位置。
Cognition 模型 / Devin 博客(网页)精选AI 评分7070 Cognition 发布 SWE-2 编码模型,以更低成本逼近前沿
Cognition 发布最先进编码模型 SWE-2,基于 2.8T 参数的 Kimi K33 后训练,在 FrontierCode 1.1 Main 取得 50.0%,仅比 Fable 5.1 低不到一分且便宜 64%。
推荐理由:官方详细公开了 SWE-2 的训练方法与成本惩罚公式,读者可以借此理解如何用 RL 推移整条成本性能前沿。
Fireworks AI(网页)AI 评分5454 Genspark 与 Fireworks Lab 将 MiniMax M3 后训练为 Gen-1 Slides,以约 1/17 成本比肩 Opus 5
Genspark 与 Fireworks Lab 合作,通过 RL 后训练将开源多模态模型 MiniMax M3 打造成 Gen-1 Slides,可端到端规划、撰写并自查幻灯片。
Hugging Face:Blog(RSS)AI 评分5656 IBM 发布 Granite Time Series PatchTST-FM-r2,采用 Apache 2.0 与 OpenMDW 1.0 双许可
IBM 发布 Granite Time Series PatchTST-FM-r2,约 385M 参数,支持最长 8,192 上下文、99 分位数概率预测和缺失值插补。