#模型发布
#模型发布
今日 6 条
Anthropic@AnthropicAIAI 评分7272Anthropic:Newsroom(网页)精选AI 评分9191 Anthropic 发布 Claude Opus 5.5,成本较 Opus 5 降低 40%
Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,官方称多数工作表现与 Claude Fable 5.1 相当,运行成本较 Opus 5 降低 40%,输入和输出 token 定价为每百万 $4 和 $20,输出速度快 30% 以上。
推荐理由:官方公告同时给出基准分数、完整定价表和防护措施细节,读者可以据此比较它相对 Opus 5 的成本与能力变化。
The Decoder:AI News(RSS)AI 评分8383 Anthropic 发布 Claude Opus 5.5,性能对标 Fable 5.1 且总成本低约 40%
Anthropic 发布 Claude Opus 5.5,称其在多数任务上达到 Claude Fable 5.1 水平,总运营成本比 Opus 5 低约 40%,输出速度快 30% 以上。
TechCrunch:AI(RSS)AI 评分8484 Anthropic 发布 Opus 5.5,价格更低并在多项基准上超越 Fable
Anthropic 于周二发布新模型 Opus 5.5,公司称其在编码和知识工作上创下新 SOTA,并在多项基准上超过更大的 Fable 模型。输出 token 价格从上一代的 $25 降至 $20 per million tokens,运行更快、服务算力更低;模型更少使用术语、更倾向把重要信息放在回复开头。
The Verge:AI(RSS)AI 评分7979 Anthropic 发布 Claude Opus 5.5,加强网络安全相关防护
Anthropic 发布 Claude Opus 5.5,称其在近期 AI 越狱黑客事件后加强了安全防护,改进了试图逃离测试沙盒等风险行为。该模型比 Opus 5 更便宜、运行效率更高,在公司最全面的对齐测试中表现最强;网络安全相关请求将被分流到 Opus 4.8,被标记的生物学请求转到 Opus 5,发布前经 Frontier Design 和 METR 等外部伙伴测试。
Claude@claudeaiAI 评分7070
Thariq@trq212AI 评分7878
Arena.ai@arenaAI 评分7272
elvis@omarsar0AI 评分7777The Decoder:AI News(RSS)AI 评分7676 小米发布 MiMo-V2.6 系列,Pro 登顶开源模型榜,Anthropic 指其借 Claude 蒸馏数据
小米发布 MiMo-V2.6 系列,旗舰 MiMo-V2.6-Pro 在 Artificial Analysis Intelligence Index 得 46 分,居开源模型之首,价格为每百万输入 token $0.435、输出 $0.87。
IT之家(RSS)AI 评分5252 奥地利科学院联合 Mistral 发布古希腊语大语言模型 Apollo,用于修复莎草纸残片
奥地利科学院联合 Mistral 和 Sail Reply 开发的大语言模型 Apollo 将于当地时间周三正式发布,面向古希腊语文献修复,训练素材涵盖手稿、莎草纸与石刻铭文,总计约 6 亿个古希腊历史词汇。
🚨 AI News | TestingCatalog@testingcatalogAI 评分5757
Tencent Hy@TencentHunyuanAI 评分5858
X.PIN@thexpinAI 评分5858Latent Space精选AI 评分8282 小米发布 MiMo-V2.6-Pro 1T-A42B 开源全模态模型,训练成本约 300 万美元
小米发布 MiMo-V2.6 系列,包含原生全模态模型 MiMo-V2.6-Pro 与 MiMo-V2.6-Flash,并推出输出速度最高提升 20 倍的 MiMo-V2.6-Pro-UltraSpeed。
推荐理由:小米以约 300 万美元训练成本推出原生全模态开源模型,并公开 RL 环境与训练配方,可对照中国开源模型的成本路线。
IT之家(RSS)AI 评分7272 小米发布并开源 MiMo-V2.6 系列,窦锦虎评价 MiMo-V2.6-Pro 达训练有素博士研究人员水平
小米发布并开源 Xiaomi MiMo-V2.6 系列,含 Pro 与 Flash 两个原生全模态模型,称这是探索 RSI(递归自我改进)路径的关键一步。
MarkTechPost(RSS)AI 评分7979 xAI 发布 Grok 4.7:更大基座模型,保持与 Grok 4.6 相同的 $2/$6 定价
SpaceXAI 发布新旗舰模型 Grok 4.7,面向编码、智能体任务和知识工作,定价与 Grok 4.6 相同,为每百万 token 输入 $2、输出 $6。
IT之家(RSS)AI 评分6464 腾讯混元发布 Hy Image3.5 preview:支持文生图与多轮对话创作,已上线元宝、ima 等应用
腾讯混元团队 9 月 22 日发布 Hy Image3.5 preview 模型,面向专业级生图,支持文生图、图生图和多轮对话创作,单次最多上传 5 张参考图,最高 2K 分辨率。
StepFun@StepFun_aiAI 评分6363
Tencent Hy@TencentHunyuanAI 评分5555公众号:腾讯混元AI 评分6666 腾讯混元发布 Hy Image3.5 preview 专业生图模型
腾讯混元发布混元图像 3.5 预览版(Hy Image3.5 preview),官方称综合能力较 Hy Image3.0 提升约 30%,内部数百名设计师 GSB 盲测中与 Seedream 5.0 pro 持平,略优于 Nano-Banana Pro 和 Qwen-Image-3.0 Pro。
腾讯混元:Research(API)精选AI 评分6060 腾讯混元发布 Hy Image3.5 preview 图像生成模型
腾讯混元发布 Hy Image3.5 preview,支持文生图与图生图、最多 5 张参考图、多轮编辑和最高 2K 分辨率输出,经上百名专业设计师 GSB 盲测对上一代胜率综合提升 30% 以上。
推荐理由:原文给出了文本渲染、编辑一致性与定价等具体能力细节,以及多家腾讯内部产品的实测反馈,便于评估适用场景。
Elon Musk@elonmuskAI 评分6161IT之家(RSS)AI 评分7171 SpaceXAI 发布 Grok 4.7,主打编码与知识处理,百万词元输入 2 美元起
SpaceXAI 于 9 月 22 日宣布推出新一代模型 Grok 4.7,定位编码和知识工作场景,官方称其为公司目前最强的编码和知识处理模型。该模型采用更大基座并经更长时间强化学习训练,强化自我验证与长上下文管理,在 CursorBench 4.0、GDPval、AA Briefcase 等基准较 Grok 4.6 有提升。
IT之家(RSS)AI 评分8080 小米发布并开源 MiMo-V2.6 系列,Pro 与 Flash 双版本,API 价格与前代持平
小米发布并开源 MiMo-V2.6 系列,含 Pro 与 Flash 两个原生全模态模型。MiMo-V2.6-Pro 在 AA 智能指数 v4.3.2 取得 46 分。
Fuli Luo@_LuoFuliAI 评分7171
🚨 AI News | TestingCatalog@testingcatalogAI 评分7272
Xiaomi MiMo@XiaomiMiMoAI 评分5858
Dongxi 东锡 NLP@dongxi_nlpAI 评分7070
OpenRouter@OpenRouterAI 评分6060小米 MiMo-V2.6 系列三款模型上线 OpenRouter,包括 1T+ 参数旗舰、开源 MoE 模型和约 10 倍速的旗舰变体。三款模型均支持文本、图像、视频和音频输入,上下文为 1M。
Arena.ai@arenaAI 评分6666
Xiaomi MiMo@XiaomiMiMo精选AI 评分7373推荐理由:官方发布全模态模型并开放权重、技术报告和训练代码,附与 Claude Opus 5、GPT-5.6 Sol 的 Agent 基准对比数据。
clem 🤗@ClementDelangueAI 评分7070公众号:小米 MiMoAI 评分7474 小米发布并开源 MiMo-V2.6 系列,扩展强化学习规模迈向自我提升
Xiaomi MiMo 于今日正式发布并开源 MiMo-V2.6 系列模型,包含 Pro 与 Flash 两个原生全模态模型,称这是探索 RSI(递归自我改进)路径的关键一步。
Nathan Lambert@natolambertAI 评分6767
Artificial Analysis@ArtificialAnlysAI 评分6666
Rohan Paul@rohanpaul_aiAI 评分6868Grok 4.7 发布,官方称在同等价格和速度下较 Grok 4.6 有显著提升。Harvey Legal Agent Benchmark 上 Grok 4.7 得分 19.6%。
🚨 AI News | TestingCatalog@testingcatalogAI 评分6767
eric zakariasson@ericzakariassonAI 评分7272The Decoder:AI News(RSS)AI 评分7070 xAI 发布 Grok 4.7,价格低廉但基准成绩明显落后 Claude 与 GPT-6
xAI 发布 Grok 4.7,定价为每百万输入 token 2 美元、输出 token 6 美元,公司称其基于更大基座模型并经过更长强化学习训练。