跳到正文

全部动态

今日 6 条
9月10日周四
  1. DeepSeek 官方82

    DeepSeek V4.1 Flash 发布,视觉理解进入默认 Flash API

    DeepSeek 发布 V4.1 Flash,在新架构下加入原生视觉理解,并通过 deepseek-flash 接口提供。旧版 V4 Flash 与视觉实验版已退役,原名称暂时指向新版;公告还宣布下调 API 价格。本次发布没有提供可核实的权重开放信息。

    推荐理由:原生视觉进入默认 Flash 接口,同时发生旧模型映射调整,使用方需要重新检查模型选择与多模态任务表现。

  2. Cohere 产品与研究博客(网页)66

    Cohere 发布开源权重翻译模型 North Small Translate,WMT26 得分 83.60 超越 DeepL 与 Google Translate

    Cohere 发布机器翻译模型 North Small Translate,为 MoE 架构,总参数 218B、激活 25B,支持 50+ 语言,WMT26 全语言得分为 83.60,高于 DeepL NextGen 的 81.37 和 Google Translate 的 68.20,Agentic 版本达 84.36。

    推荐理由:官方公布了 WMT26 各语言和分区域得分、吞吐与单任务成本数据,读者可据此评估其相对 DeepL 和开源模型的位置。

9月9日周三
  1. IT之家(RSS)66

    Suno 发布 v6 系列 AI 音乐模型,含 v6、v6-wild 和 v6-mini 三款

    Suno 推出 v6 系列 AI 音乐模型,包含 v6、v6-wild 和 v6-mini 三款,并与华纳音乐、BMG 等唱片公司达成合作。v6 主打旗舰,v6-wild 面向实验性音乐,仅 v6-mini 向免费用户开放,另两款需 Pro 或 Premier 订阅。生成速度更快,几秒即可出音乐,支持自然语言编辑歌曲片段、从多个音频源生成混音、单独提取采样,并可从音频或图片等多模态输入生成歌曲。

  2. OpenAI:官网动态(RSS · 排除企业/客户案例)79

    OpenAI 发布 ChatGPT Images 2.5 图像模型

    OpenAI 发布 ChatGPT Images 2.5 图像模型,生成延迟比 Images 2.0 降低最多 50%,细节、编辑精度、参考照片保真度和多轮编辑一致性均有提升。

    推荐理由:官方原文给出与 Images 2.0 的具体对比数据、新功能入口和 API 双模型分工,读者可以据此评估是否迁移现有图像工作流。

9月8日周二