#模型发布
#模型发布
今日 6 条
-Zho-@ZHO_ZHO_ZHOAI 评分6666The Decoder:AI News(RSS)AI 评分8787 OpenAI 发布 GPT-6 Astra,并首次将其列为 Preparedness Framework 下关键级网络安全模型
OpenAI 发布其最强模型 GPT-6 Astra,总裁 Greg Brockman 称其可能已接近 AGI,并以 Welcome to the AGI era 结束发布。
Rohan Paul@rohanpaul_aiAI 评分8080OpenAI 发布 GPT-6 Astra,首先向经过审核的 Daybreak 网络安全客户开放,Plus、Pro、Business、Enterprise、API 和 AWS 将在未来数日内跟进。
The Verge:AI(RSS)AI 评分8383 OpenAI 发布 GPT-6 Astra,称已进入 AGI 时代
OpenAI 发布下一代的旗舰模型 GPT-6 Astra,称其为能力上的世代跃升,Greg Brockman 表示现在可能已进入 AGI 时代。
MarkTechPost(RSS)AI 评分7373 Meta AI 发布 Muse Spark 1.3,工具调用减少约 20%、token 消耗减少约 25%
Meta Superintelligence Labs 发布 Muse Spark 1.3,面向长程智能体与编码任务,已在 Muse Code 和 Meta Model API 上线,权重闭源不可自托管,上下文窗口为 1M token。
🚨 AI News | TestingCatalog@testingcatalogAI 评分8282OpenAI 发布 GPT-6 Astra,初期仅向 Daybreak Access 计划中的组织开放,未来几天将陆续推送给所有 Plus、Pro、Business 和 Enterprise 用户。
Hacker News 热门(buzzing.cc 中文翻译)精选AI 评分7878 IFM 发布 K2 Horizon 六款开源模型,覆盖 0.9B 到 375B-A23B 并开放完整训练生命周期
IFM 发布 K2 Horizon 模型系列,共六个模型:375B-A23B、36B-A4B、32B、7B、3.7B 和 0.9B,均以 Apache 2.0 开源,其中 0.9B、3.7B 和 7B 宣称在其规模上达到 SOTA,36B-A4B 采用新提出的稀疏注意力架构 MoVA。
推荐理由:原文在发布模型之外还放出从预训练到智能体后训练的全流程产物,研究者可以据此复现和改造整套训练方法。
TechCrunch:AI(RSS)精选AI 评分8181 OpenAI 发布新模型 Astra,主打计算机与浏览器操作但因 opaque recurrence 引发争议
OpenAI 发布最新模型 Astra,称其为迄今最强大模型,主打计算机和浏览器操作,先面向 Daybreak 网络安全计划客户开放,随后一周内覆盖 Pro、Plus、Enterprise、Business 付费账户及 API。
推荐理由:原文梳理了 Astra 的能力主张、发布节奏,以及 opaque recurrence 引发的可监控性争议,信息较为完整。
Rohan Paul@rohanpaul_aiAI 评分2727Apodex_AI 发布 Apodex 1.1,围绕“完成且可检查的工作”而非漂亮回答来训练模型,可从原始文件、数据集、代码等出发,选择方法、运行代码、保持任务状态、从故障恢复并产出可验证的结果。
Runway@runwaymlAI 评分6363
Ant Ling@AntLingAGIAI 评分4545蚂蚁百灵宣布开源金融增强模型 Ling-3.0-flash-Fin,面向真实金融工作流,并同时开源由专家构建的金融搜索智能体基准 FinFIRST。两项发布共同目标是让金融 AI 更易获取、更可验证。
TechCrunch:AI(RSS)AI 评分6666 Google DeepMind 发布 WeatherNext 3 天气预报模型
Google DeepMind 与 Google Research 发布新 AI 天气预报模型 WeatherNext 3,将在搜索、Google Maps 和 Gemini 中提供天气信息,并开放给云端用户和研究者。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4242 蚂蚁 Ling 3.0 flash Fin 发布,首个金融增强模型,124B 总参数 5.1B 激活
蚂蚁集团发布 Ling 3.0 flash Fin,作为 Ant Ling 系列首个金融增强模型,基于 Ling 3.0 flash 用高质量金融数据继续训练,总参数 124B、激活参数 5.1B、上下文窗口 256K。
IT之家(RSS)AI 评分5151 沙特 HUMAIN 发布前沿阿语模型 humain-m3,由 MiniMax 受托开发
沙特 PIF 旗下 AI 企业 HUMAIN 公布前沿阿拉伯语模型 humain-m3,由 MiniMax 受托开发。该模型基于 MiniMax-M3 构建,进行了 T 级阿拉伯语原生文本 Token 规模的预训练,在 7 个公开阿拉伯语基准测试中取得参测前沿模型的最高平均分。模型已在 HUMAIN Node 平台以研究和评估预览版本提供,后续将发布开放权重版本。
IT之家(RSS)AI 评分5656 谷歌 DeepMind 发布 WeatherNext 3:分辨率最高 5 公里的 AI 天气预报模型
谷歌 DeepMind 和 Google Research 发布 WeatherNext 3,称其为最先进、最准确的全球气象模型。模型基于原始卫星数据和稀疏气象站观测训练,可每小时生成一次预报,地表关键变量分辨率达 5 公里,并新增针对可再生能源的 100 米高度风速、云量和太阳辐射预测。即日起为谷歌搜索、Gemini 应用、谷歌地图、地图平台气象 API 和 Earth Engine 提供支持。
Microsoft AI:官方博客(网页)精选AI 评分6464 Microsoft AI 发布语音识别模型 MAI-Transcribe-2
Microsoft AI 发布转录模型 MAI-Transcribe-2,称其在 FLEURS 基准 60 种语言上平均词错率 5.2% 排名第一,并占据 Artificial Analysis 准确率-延迟 Pareto 前沿。
推荐理由:官方给出具体基准排名、对比速度倍数和定价,读者可以据此评估它对现有语音转写方案的可替换性。
🚨 AI News | TestingCatalog@testingcatalogAI 评分2020
Google DeepMind@GoogleDeepMindAI 评分3636Google DeepMind:Blog(RSS)精选AI 评分7070 Google DeepMind 发布 WeatherNext 3 全球天气 AI 模型, hourly 更新且分辨率较上一代提升约 5 倍
Google DeepMind 与 Google Research 发布 WeatherNext 3,称其为迄今最先进的全球天气 AI 模型,经 Brightband 独立实时评估。
推荐理由:原文给出分辨率、卫星数据接入和降水精度的具体数字,并说明在 Google 产品和 Cloud 中的获取方式,读者可评估其实际用途。
Artificial Analysis@ArtificialAnlysAI 评分5656
Mustafa Suleyman@mustafasuleymanAI 评分4949The Decoder:AI News(RSS)AI 评分5353 Claude Fable 5.1 解开 1653 年 Cyphral Distich 数谜
Claude Fable 5.1 在 44 分钟内无人工干预地解开了 1653 年 Sir Thomas Urquhart 发表的 Cyphral Distich 数谜。
Artificial Analysis@ArtificialAnlysAI 评分6161Hugging Face:Blog(RSS)AI 评分5454 NeoMME 发布 260M 与 800M 多语言多模态编码器,权重以 Apache 2.0 开源
H Company 团队发布 NeoMME,含 260M 和 800M 两个尺寸的多语言多模态编码器,用单个双向 Transformer 从零处理文本 token 和 32×32 图像 patch,不使用预训练视觉塔或因果语言模型,训练采用掩码离散扩散目标,每个模型处理约 5240 亿 packed token。
🚨 AI News | TestingCatalog@testingcatalogAI 评分6969Institute of Foundation Models(IFM)发布开源模型族 K2 Horizon,包含 0.9B 至 375B 参数的六个基础模型,全部以 Apache 2.0 许可开源。
MiniMax (official)@MiniMax_AIAI 评分3838The Decoder:AI News(RSS)AI 评分7070 Meta 发布 Muse Spark 1.3,智能体任务提升明显且以低价切入
Meta 发布 Muse Spark 1.3,xhigh 档已可用,更强的 max 档目前为有限合作伙伴预览。
Dongxi 东锡 NLP@dongxi_nlpAI 评分5757Qwen:Blog Retrieval(API)AI 评分4545 Qwen 发布 Qwen-Drive-1.0:面向自动驾驶的视觉语言基础模型
Qwen 团队发布 Qwen-Drive-1.0,称其为首个在预训练阶段统一 3D 感知与视觉问答、并延伸到运动规划的自动驾驶视觉语言基础模型,基于原生多模态 Qwen3.5-4B 且不改动预训练架构。
🚨 AI News | TestingCatalog@testingcatalogAI 评分2525TestingCatalog 称 GPT-6-Astra 模型 slug 已出现在 OpenAI API 上,推测若明天发布将是重要一周,并猜测可能先上线路由功能。
IT之家(RSS)AI 评分5757 西班牙公司 Multiverse Computing 推出 Quasar 438B 模型,1M 词元上下文
西班牙 AI 公司 Multiverse Computing 推出 4,380 亿参数的推理模型 Quasar 438B,在 Artificial Analysis Intelligence Index v4.1.1 得分 43,为参与比较的欧洲模型中最高。
IT之家(RSS)AI 评分6666 Meta 发布 Muse Spark 1.3,主打编码与长周期智能体任务
Meta 于 2026 年 9 月 2 日发布 AI 模型 Muse Spark 1.3,专为延长智能体工作流与增强编码能力设计,Meta 首席 AI 官 Alexandr Wang 称其编码能力超越 GPT-5.6 Sol、与 Claude Fable 5.1 持平。
Dongxi 东锡 NLP@dongxi_nlpAI 评分4545Gemini 3.8 发布,作者称其表现非常亮眼。作者认为 Gemini 似乎在复制去年 2.5 Pro 到 3 的节奏,夏天后发力,到年底用 ultra 年票打折绑定用户,之后再拉半年。
Artificial Analysis@ArtificialAnlysAI 评分6969The Verge:AI(RSS)AI 评分7373 Google 发布 Gemini 3.8 Flash,推理更努力但 token 用量可能更高
Google 发布 Gemini 3.8 Flash,称其比 3.7 Flash 在复杂任务上执行更多推理步骤并迭代调用工具,定价维持每百万输入 token $0.75、输出 $3.75,但警告模型可能消耗更多 token 导致实际成本上升。
Rohan Paul@rohanpaul_aiAI 评分6666
OpenRouter@OpenRouterAI 评分3737
AI at Meta@AIatMetaAI 评分4242
🚨 AI News | TestingCatalog@testingcatalogAI 评分6060Meta 官方宣布 Muse Spark 1.3 发布,已在 Meta 模型 API 和 Muse Code 上推出,官方称这是其在编码和智能体工作上的最大跃升,价格极低。
OpenAI Developers@OpenAIDevsAI 评分2323