跳到正文

#模型发布

今日 6 条
9月5日周六
  1. Microsoft AI:官方博客(网页)63

    Microsoft 发布 MAI-Image-2.6 与 MAI-Image-2.6-Flash 图像模型

    Microsoft 于 9 月 4 日发布 MAI-Image-2.6,称其为迄今最强的图像模型,并面向开发者上线 Microsoft Foundry,同时推出面向低延迟、高吞吐场景的 MAI-Image-2.6-Flash。

    推荐理由:原文给出排名、速度和效率数字,并说明两个版本分别面向精度与吞吐的不同场景,便于开发者按工作流选型。

9月4日周五
  1. IT之家(RSS)62

    微信开源多模态嵌入模型 WeMM-Embedding,含 2B/4B/9B 三个版本

    微信 AI 宣布开源通用多模态嵌入模型 WeMM-Embedding,含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档及交错多模态输入。模型基于 Qwen3.5 多模态架构,WeMM-Embedding-9B 在 MMEB-v2 榜单以 80.6 分位列第一;该模型已大规模部署于视频号、直播、公众号、电商与朋友圈的推荐与搜索系统,日调用量达 10 亿量级。

  2. Greg Brockman72

    Greg Brockman 转发 @arcprize 的评测称 OpenAI 的 GPT-6 Astra 在 ARC-AGI-3 上取得 SOTA,他称该基准已饱和。Astra 标准 harness 得分 63%,经新的 Provider Adapter harness 达 99%,在 96% 的 ARC-AGI-3 关卡上超越人类表现;排行榜图还显示更高推理层级通常成本更低,因为 Astra 用更少动作通关,减少模型调用和 token 数。

    推荐理由:转发 ARC Prize 对 GPT-6 Astra 的评测数据,标准与 Provider Adapter 两种 harness 分差大,可据此了解 harness 对得分的影响。

  3. OpenAI:官网动态(RSS · 排除企业/客户案例)81

    OpenAI 发布 GPT-6 Astra 并公布安全概览,称其网络安全能力达到 Preparedness Framework 的 Critical 级

    OpenAI 发布 GPT-6 Astra,称这是其部署过的最强模型,也是首个在其 Preparedness Framework 下达到网络安全能力 Critical 级的模型,可在无人逐步引导的情况下发现未知安全漏洞并开发利用方式。

    推荐理由:OpenAI 官方发布的安全评估,给出模型在网络安全能力、对齐和可监测性上的具体发现,读者可借此了解前沿模型安全实践的最新变化。