DeepSeek V4.1 Flash 中间版本开启内测,采用新模型结构并原生支持多模态
DeepSeek 今日在官方交流群通知 DeepSeek V4.1 Flash 中间版本开启内测,采用新模型结构,原生多模态支持,能力更强、速度更快、成本更低。
DeepSeek 今日在官方交流群通知 DeepSeek V4.1 Flash 中间版本开启内测,采用新模型结构,原生多模态支持,能力更强、速度更快、成本更低。
OpenBMB 发布 MiniCPM5 端侧模型,采用 Apache 2.0 协议,1B 与 2B 版本支持 128K 上下文、编码、推理和智能体工具调用。
9 月 8 日,面壁智能联合 OpenBMB 开源 2B 端侧基座模型 MiniCPM5-2B,支持工具调用、深度搜索、代码生成。
微信 AI 于 9 月 4 日宣布开源通用多模态嵌入模型 WeMM-Embedding,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档及任意交错的多模态输入。
OpenBMB 发布 MiniCPM5 系列第二个 checkpoint MiniCPM5-2B,2.52B 稠密模型,原生 131,072 token 上下文,Apache 2.0 权重,采用标准 LlamaForCausalLM 架构,可通过 vLLM、SGLang、llama.cpp、Ollama 等主流引擎直接运行。
阿里巴巴 Qwen 团队发布 Qwen-Drive 1.0,基于 Qwen3.5-4B,在语言模型上叠加 3D 环境感知和路径规划两个模块,用同一模型同时服务驾驶系统和座舱助手。
宇树科技宣布 UnifoLM-X2-1.0 实现世界模型实时驱动全自主人形机器人格斗,并公布实拍画面。官方称该模型突破瞬时规划、决策和动态交互执行等瓶颈,实现高动态、强交互的实时未来预测与规划,不再依赖预设程序或人工遥控。此前宇树人形机器人已在 2025 年进博会等场合多次公开格斗表演。
科大讯飞 9 月 7 日正式发布星火 Spark X2.5 多语言文本生成模型,基于全国产平台训练,采用 MoE 框架,参数为 293B-A30B,支持 256K 上下文。模型全面提升代码和智能体能力,覆盖 200 余种语言,已在讯飞星辰 MaaS 平台上线,输入定价 1.6 元/百万 Token(缓存命中 0.24 元),输出 6 元/百万 Token。
MBZUAI 旗下前沿实验室 IFM(Institute of Foundation Models)于上周发布 K2 Horizon 系列模型,共六款:375B-A23B、36B-A4B、32B、7B、3.7B 和 0.9B,均采用 Apache 2.0 许可证。一同发布的还有预训练语料等配套资源。IFM 是 MBZUAI 于 2025 年 5 月成立的前沿实验室。
H Company 发布 NeoMME 系列多模态编码器,包含 260M 和 800M 两个双向 Transformer 模型,用单一塔处理多语言文本和 32×32 图像块,去掉了独立视觉塔和因果解码器,以离散掩码扩散方式预训练。
Google 在 Gemini app 和 API 中发布 Lyria 3.5 音乐生成模型,官方称其人声表现力和编曲丰富度超过前代。用户可在 app 中选择流派、风格、人声或纯器乐,生成长短曲目,还提供背景音乐和个性化生日歌模板。
阿里千问本周开源 Qwen-Drive-1.0-4B,一款基于 Qwen3.5-4B 构建的自动驾驶视觉语言基础模型,官方称其为首个面向自动驾驶的视觉语言基础模型。
蚂蚁 inclusionAI 在 Hugging Face 发布 LLaDA-UI,一个基于 MoE 的块扩散视觉语言 GUI 智能体,总参数约 16.7B,语言骨干为 LLaDA2.0-mini-base。
蚂蚁 inclusionAI 在 Hugging Face 发布 LLaDA2.2-mini,这是 LLaDA2 系列的轻量级智能体扩散语言模型,总参数 16B、推理仅激活 1.4B。
OpenAI 发布新模型 GPT-6 Astra,距 GPT-5 系列约一年、GPT-5.6 升级约两个月。OpenAI 总裁布罗克曼在媒体电话会议上称“欢迎来到 AGI 时代”,并表示未来人们回看可能认为 AGI 从这个模型开始。
OpenAI 通过 ChatGPT Work 和 Codex 向 Pro、Enterprise、Business Premium 计划用户开放 GPT-6 Astra,并通过 API、Microsoft Azure 和 AWS Bedrock 提供。
推荐理由:原文整理了 GPT-6 Astra 各订阅档位的具体额度数字和与 GPT-5.6 Sol 的用量对比,便于读者评估升级成本。
微软于 9 月 4 日发布自研图像生成模型 MAI-Image-2.6-Flash,并通过 Microsoft Foundry 开放公开预览。该模型与旗舰版 MAI-Image-2.6 共享文生图和图像编辑核心能力,重点优化速度与成本;微软 AI 负责人 Mustafa Suleyman 称其生图速度是 GPT Image 2 的 2 倍,GPU 效率提高 72%。
小米发布通用表格数据基础大模型 Xiaomi-TabLDM,以单一预训练模型和统一默认配置直接适配不同表格数据集,完成分类与回归预测,模型权重与代码已开源。模型基于结构因果模型生成的合成数据预训练,架构引入双流特征分组、轻量级注意力残差和稀疏混合专家,并探索 Test-Time Scaling。
OpenAI 发布新一代模型 GPT-6 Astra,称其在计算机使用、软件工程、科学和网络安全等方向达到 SOTA。
推荐理由:官方发布给出多项评测数字、定价和可用渠道,读者可以据此比较它相对前代和竞品的能力与成本变化。
OpenAI 于 9 月 3 日上线 GPT-6 Astra,称其在电脑使用、浏览、软件工程、科学和专业工作方面达到最先进性能。因企业安全客户先于 Pro 订阅者获得访问权限引发高价 Pro 用户不满,CEO 奥尔特曼 9 月 4 日在 X 平台致歉,并提出补偿机制:从 9 月 4 日起付费用户每缺少一天 Astra 访问即获得一次额度重置。
推荐理由:原文梳理了 GPT-6 Astra 发布混乱的经过、用户不满与补偿机制,可借此了解大模型分阶段发布中的次序争议。
OpenAI 于 2026 年 9 月 4 日发布的旗舰模型 GPT-6 Astra 已上线 OpenRouter,输入 $10/1M、输出 $50/1M,上下文窗口 1,050,000 token,最高 128,000 completion tokens。
匿名模型 Omen Alpha 于 9 月 4 日上线 OpenCode Go 订阅计划,月费 10 美元并单独提供 100 美元用量额度,仅限订阅用户使用。
OpenAI 宣布 GPT-6 Astra 面向 ChatGPT Work 和 Codex 中的 Pro、Enterprise 及 Business Premium 用户开放,并已上线 API,Plus 和 Business 用户还需数日。
Anthropic 于 9 月 4 日宣布,Claude 在基本自主运行 11 天后,完成费马大定理首个端到端、经计算机检查的 Lean 形式化证明。
推荐理由:原文确认 GPT-6 Astra 的用户覆盖范围扩大到 Plus 和 Business,读者可以据此判断自己的可用入口和时间点。
OpenAI Developers 宣布 GPT-6 已发布,并将为开发者、技术创始人和产品建设者举办 GPT-6 黑客松:旧金山场为 9 月 8 日,纽约场为 9 月 10 日。