#模型发布
#模型发布
今日 6 条
Arena.ai@arenaAI 评分5454
Andrew Milich@milichabAI 评分6565MarkTechPost(RSS)AI 评分6969 阿里通义千问发布 Qwen-Image-2.1:7B 开源权重图像生成与编辑模型
阿里 Qwen 团队发布 Qwen-Image-2.1,将文生图与图像编辑统一到一个 7B 单流 DiT 模型中,搭配 8B Qwen3-VL 编码器,支持原生 RGBA 透明输出和最多 10 张参考图编辑。
Arena.ai@arenaAI 评分6464
lauren@potetoAI 评分5555
OpenRouter@OpenRouterAI 评分6363
Michael Truell@mntruellAI 评分5656Microsoft Research 博客(RSS)AI 评分5252 Microsoft Research 发布开源逆合成模型 RetroChimera 并登上 Nature
Microsoft Research 在 Nature 发表逆合成预测模型 RetroChimera,结合基于 Transformer 的 R-SMILES 2 和图神经网络模型 NeuralLoc,用 learning-to-rank 集成两者互补预测。
xAI:News(网页)精选AI 评分7474 xAI 发布 Grok 4.7,主打编码与知识工作
xAI 发布 Grok 4.7,定位为其最强编码与知识工作模型,定价 $2/百万输入 token、$6/百万输出 token,与 Grok 4.6 同价同速,另有速度和价格加倍的快速变体。
推荐理由:官方给出了完整定价、速度和多项基准对比,读者可以据此把 Grok 4.7 放进现有模型选型里横向比较。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分5858 Kev:基于 Qwen3.5 的开源小型决策模型家族发布
Kev 发布了一组基于 Qwen3.5 的小型决策模型,包含 0.8B、4B 和 9B 三个规格,采用 rank-16 LoRA 加 pointer head 架构,支持在同一请求中处理 yes/no、多选和打分问题并返回概率。
MarkTechPost(RSS)AI 评分7171 阶跃星辰发布 Step 5 Preview:600B 总参 27B 激活的 MoE 模型,支持 1M 上下文
StepFun 发布面向智能体工作的新旗舰模型 Step 5 Preview,为稀疏 MoE 架构,总参数约 600B、每 token 激活约 27B,支持 1M token 上下文和文本、图像、视频输入,API 定价为每 1M 输入 token $1.00、输出 $2.70。
Qwen@Alibaba_QwenAI 评分7070The Decoder:AI News(RSS)AI 评分7070 阿里 Qwen 团队发布开源权重图像生成模型 Qwen-Image-2.1,仅 7B 参数
阿里 Qwen 团队发布开源权重图像生成与编辑模型 Qwen-Image-2.1,视觉生成部分仅 7B 参数,团队称在其自建基准上超过多数闭源模型,独立基准尚待验证,可在 RTX 3090 等消费级 GPU 上运行。
The Decoder:AI News(RSS)AI 评分6060 腾讯 Gander 模型实现边聊天边后台执行复杂任务
腾讯混元语音团队联合多所高校发布 Gander 模型,用"小脑"负责实时对话、可替换的"大脑"处理后台智能体任务(测试中用 GPT-5.6 家族模型),可同时处理语音、图像和文本并随时被打断。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分6969 阶跃星辰发布 Step 5 Preview:600B 参数 MoE 旗舰模型,10 月 15 日开放权重
阶跃星辰(StepFun)发布旗舰模型 Step 5 Preview,主打智能体工作,采用稀疏 MoE 架构,总参数 600B、每 token 激活 27B,支持 1M token 上下文窗口和视觉输入。
Qwen@Alibaba_QwenAI 评分6363IT之家(RSS)AI 评分6868 阿里千问开源 Qwen-Image-2.1 图像模型,支持透明图像与最多 10 张参考图
阿里千问开源图像模型 Qwen-Image-2.1,将文生图与图像编辑整合在同一模型中,视觉生成部分仅 7B 参数,原生支持透明图像的生成与编辑。更新亮点包括轻量结构与推理优化、支持最多 10 张参考图的局部编辑与人像商品保真,以及文字排版和人物光影表现提升,模型已上架 GitHub、HuggingFace 和 ModelScope。
Qwen@Alibaba_QwenAI 评分6060Qwen:Blog Retrieval(API)精选AI 评分7272 Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像
Qwen 团队开源 Qwen-Image-2.1,将文生图与图像编辑统一到一个模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/独立蒙版指定局部编辑,通过混合粒度注意力架构和 KV cache 复用提升推理效率,同时改进文字渲染、人像光照与人物产品保真度,并覆盖全景图、信息图和分镜等任务。
推荐理由:官方详解了 7B 统一图像模型的透明图像生成、10 图参考编辑与推理优化,读者可据此评估在设计等场景的可用性。
🚨 AI News | TestingCatalog@testingcatalogAI 评分6868MarkTechPost(RSS)AI 评分6363 阿里通义Qwen团队发布Qwen3.8-LiveTranslate,实时翻译平均延迟降至2.3秒、支持60种语言
通义千问(Qwen)发布实时同声传译模型Qwen3.8-LiveTranslate,采用新的Interleave架构,平均滞后(LAAL)从2.8秒降至2.3秒,约降低18%。
StepFun@StepFun_aiAI 评分6060IT之家(RSS)AI 评分5656 阶跃星辰发布旗舰模型 Step 5 Preview,AA 指数 44 分跻身全球开源模型前三,10 月 15 日开源
阶跃星辰发布旗舰模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识和金融场景,将于 10 月 15 日开源完整权重。
IT之家(RSS)AI 评分6262 中电信发布星辰大模型 Xing4.0-29B-A4B,基于昇腾超节点训练并开源
中电信人工智能科技于 9 月 17 日发布星辰大模型 Xing4.0-29B-A4B,总参数 29B、激活参数 4B,据称是国内首个基于昇腾 Atlas 900 A3 SuperPoD 液冷超节点与昇思 MindSpore 框架完成训练的百亿参数大模型。
公众号:阶跃星辰(Step)精选AI 评分6666 阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重
阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。
推荐理由:官方完整公布架构参数、基准成绩和权重开放时间,读者可据此评估其在开源主力模型中的成本能力位置。
The Decoder:AI News(RSS)AI 评分6969 Qwen3.8-Omni-Flash 发布,价格低于 Gemini Flash 且多模态基准相当
Qwen 发布首个面向 AI 智能体的多模态模型 Qwen3.8-Omni-Flash,可联合处理音频和视频并自主使用工具,上下文窗口达 100 万 token。
IT之家(RSS)AI 评分6464 中国电信开源全栈国产轻量级智能体大模型 Xing4.0-29B-A4B
中国电信于 9 月 17 日发布并开源新一代星辰大模型 Xing4.0-29B-A4B,总参数量 29B、激活参数 4B,原生支持 256K 上下文、可扩展至 512K,官方称是国内首个基于国产算力与国产框架完成训练的百亿参数大模型。
IT之家(RSS)AI 评分6060 SpaceXAI 发布 Grok Voice Transcribe 2.0 语音转文本模型,错误率降低约一半且价格不变
当地时间 9 月 18 日,SpaceXAI 发布 Grok Voice Transcribe 2.0 语音转文本模型,在价格不变的前提下错误率降低约一半。该模型基于 Grok Voice 底层音频基础模型构建,在 Artificial Analysis 全部 32 款流式模型中准确率居首;官方四个内部数据集评测均超越 1.0 版本。
Qwen@Alibaba_QwenAI 评分5757IT之家(RSS)AI 评分6363 阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,支持原文译文同帧同出
阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,基于 Hybrid MoE 的 Thinker–Talker 双模块设计,以 Interleave 架构重构实时同传,字均延迟(LAAL)从 2.8 秒降至 2.3 秒。
🚨 AI News | TestingCatalog@testingcatalogAI 评分5353
Artificial Analysis@ArtificialAnlysAI 评分5555MarkTechPost(RSS)AI 评分5959 Jina AI 发布 jina-ocr-v1:3.4B MoE 文档解析模型,内置投机解码面向低预算 GPU
Jina AI 发布端到端视觉文档解析模型 jina-ocr-v1,总参数 3.4B,每 token 激活约 570M,可将 PDF、扫描件、表格和发票一次转成 Markdown。
TechCrunch:AI(RSS)AI 评分6868 OpenAI前研究员创办的TypeSafe发布非LLM新模型Jev,输出校准概率而非文本
OpenAI前研究员、RLHF共同发明人Almeida创办的TypeSafe AI发布基于transformer的新模型Jev,它不输出文本而是产生概率形式的校准决策。
MarkTechPost(RSS)AI 评分6666 PrismML 发布 Ternary Bonsai 2 27B:5.93 GB 三值权重模型保留 Qwen3.8 27B 98.2% 的性能
PrismML 发布 Ternary Bonsai 2 27B,将 Qwen3.8 27B 转为三值权重,模型仅 5.93 GB(FP16 为 53.80 GB),Apache 2.0 开源,官方称在 20 个基准上保留母模型 98.2% 的平均分,支持文本与图像输入和 262K token 上下文。
Qwen:Blog Retrieval(API)精选AI 评分6969 Qwen 发布 Qwen3.8-LiveTranslate 实时同传模型,LAAL 降至 2.3 秒
Qwen 发布 Qwen3.8-LiveTranslate,采用 Interleave 架构与 Hybrid-MoE Thinker–Talker 设计重构实时同声传译,平均滞后(LAAL)从上一代的 2.8 秒降至 2.3 秒。
推荐理由:官方给出了架构设计、LAAL 从 2.8 秒到 2.3 秒的数字和多语言评测结果,读者可以据此评估其实时翻译能力的实际变化。
MarkTechPost(RSS)AI 评分7575 阿里 Qwen 发布 Qwen3.8-Omni-Flash:1M 上下文的全模态智能体模型
阿里 Qwen 团队发布 Qwen3.8-Omni-Flash,称其为首款围绕智能体能力构建的全模态模型,接受文本、图像、音频和视频输入并返回文本,上下文窗口为 1M tokens。
IT之家(RSS)AI 评分7474 阿里达摩院开源医疗影像 AI 模型 DAMO RADAR,可一次识别超 146 种病症并登上《科学》
阿里达摩院与浙江大学医学院附属第一医院等机构研发的通用医疗影像 AI 模型 DAMO RADAR 登上《科学》并正式开源,面向腹部增强 CT 诊断,评估覆盖 146 种病症、18 个器官,近 4 万次真实世界检查中 AUC 达 0.913。
🚨 AI News | TestingCatalog@testingcatalogAI 评分6161IT之家(RSS)AI 评分6161 PrismML 发布三值量化 Bonsai 2 27B,以不到 1/9 内存保留 Qwen3.8 27B 98.2% 性能
PrismML 宣布推出三值量化版本的 Bonsai 2 27B,基础模型升级至 Qwen3.8 27B,以不到 1/9 的内存占用在综合基准测试中达到基础模型 98.2% 的分数,整体表现好于 Qwen3.6 27B。