#开源生态
#开源生态
今日 0 条
Qwen@Alibaba_QwenAI 评分6060Qwen:Blog Retrieval(API)精选AI 评分7272 Qwen 开源 Qwen-Image-2.1:7B 统一生成与编辑并原生支持透明图像
Qwen 团队开源 Qwen-Image-2.1,将文生图与图像编辑统一到一个模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/独立蒙版指定局部编辑,通过混合粒度注意力架构和 KV cache 复用提升推理效率,同时改进文字渲染、人像光照与人物产品保真度,并覆盖全景图、信息图和分镜等任务。
推荐理由:官方详解了 7B 统一图像模型的透明图像生成、10 图参考编辑与推理优化,读者可据此评估在设计等场景的可用性。
公众号:阶跃星辰(Step)精选AI 评分6666 阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重
阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。
推荐理由:官方完整公布架构参数、基准成绩和权重开放时间,读者可据此评估其在开源主力模型中的成本能力位置。
MiniMax (official)@MiniMax_AIAI 评分5656MiniMax 官方宣布 MiniMax Code CLI 现已开放,仓库地址为 https://github.com/MiniMax-AI/minimax-code。
公众号:MiniMax(稀宇科技)AI 评分5858 MiniMax Code CLI v0.4.12 以 MIT 协议正式开源
MiniMax 宣布 MiniMax Code CLI v0.4.12 面向全球开发者开放,并以 MIT 协议开源源码,称其为 MiniMax Code 客户端的核心组件。
Qwen@Alibaba_QwenAI 评分7373通义千问发布 Qwen3.8-Omni-Flash,是 Qwen 首个以智能体能力为核心构建的全模态模型,支持原生音视频理解、推理和工具调用。
Anthropic:Research(发表成果 · 网页)精选AI 评分7474 Anthropic:Claude 四周优化 30 多个开源生物分子模型,平均提速约 4 倍并开源代码
Anthropic 让 Claude 在不到四周内优化了超过 30 个开源生物分子模型,平均提速约 4 倍、精度损失极小,输出完全一致时也有近 2 倍加速。优化代码全部开源,还推出低内存 Big 模式,可在单张 NVIDIA GPU 节点上对超过 10,000 token 的生物分子系统做准确预测。
推荐理由:Anthropic 公布了完整提速数据、开源代码和比赛入口,读者可以据此评估 AI 优化科学计算代码的实际水平。
Google Developers Blog(RSS)精选AI 评分6363 Google 与 Speakeasy 开源 OpenAPI SDK 生成套件
Google 与 Speakeasy 合作,将 Speakeasy 的 OpenAPI 客户端代码生成套件以 AGPLv3 许可开源,此前原 SDK 生成供应商被收购并突然宣布关停,凸显闭源生成器的平台风险。
推荐理由:原文交代了开源 SDK 生成器的许可、语言覆盖和迁移背景,开发者可据此评估能否替代自有闭源生成管线。
Qwen:Blog Retrieval(API)精选AI 评分7878 Qwen 发布原生全模态模型 Qwen3.8-Omni-Flash,主打音视频智能体任务交付
Qwen 发布下一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频和视频输入及 1M token 上下文窗口,29 项评测平均分较 Qwen3.5-Omni-Plus 提升超过 25%,音频输入每小时价格下降超过 98%,音视频输入每小时价格下降超过 93%。
推荐理由:官方发布同时开放 API 和开源插件与运行时,读者可以据此评估音视频智能体在剪辑、会议、实时交互等工作流中的落地方式。
LangChain:Blog(RSS)AI 评分5252 LangChain 开源 Deep Life Sci:面向临床与实验室科学家的智能体助手
LangChain 发布开源智能体助手 Deep Life Sci,面向临床和实验室科学家。它接入 600K+ ClinicalTrials.gov 研究、2900 万 PubMed 摘要和 1200 万 PubMed Central 全文,并用沙盒子智能体进行真实数据分析。
Unsloth AI@UnslothAI精选AI 评分6868推荐理由:官方介绍了新 Docker 镜像和 Desktop 应用,列出本地训练运行模型的硬件支持与效率数字,读者可据此评估本地部署方式。
SenseTime@SenseTime_AIAI 评分5757
SenseTime@SenseTime_AIAI 评分5353公众号:面壁智能(MiniCPM)AI 评分6565 外部团队基于 MiniCPM-o 4.5 开源全模态交互智能体 Gander,让 Agent 边干活边对话
浙江大学等高校的外部研究者以 MiniCPM-o 4.5 为基座后训练,开源了端到端全模态交互智能体 Gander,论文、数据、代码和模型全部开放。
Artificial Analysis 完整文章(网页)AI 评分5858 Artificial Analysis 评测蚂蚁集团金融模型 Ling-3.0-flash-Fin
蚂蚁集团发布基于 Ling-3.0-flash 的金融开源权重模型 Ling-3.0-flash-Fin,在 Artificial Analysis Intelligence Index 得 23 分,Finance & Accounting Index 得 24 分。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分6161 蚂蚁 inclusionAI 开源全双工音视频交互模型 Realtime-Venus
蚂蚁集团 inclusionAI 在 Hugging Face 发布 Realtime-Venus,包含 Realtime-Venus-Omni 和 Realtime-Venus-Audio 两个 9B 检查点,基于 MiniCPM-o 4.5 / Omni-Flow 架构,语言骨干为 Qwen3-8B。
ViggleAI@ViggleAIAI 评分5151
ViggleAI@ViggleAIAI 评分5252
SiliconFlow@SiliconFlowAI精选AI 评分6666推荐理由:原文给出了参数规模、上下文长度、开源协议和定价,读者可据此评估它能否接入现有编码与 Agent 工具链。
SenseTime@SenseTime_AIAI 评分5858公众号:小红书技术(dots.llm)精选AI 评分6868 小红书 AllSpark 开源 Search Agent 模型 Iris,35B 与 397B 版本同量级成绩领先
小红书 AllSpark 团队发布并开源 Search Agent 模型 Iris,权重和评测代码已公开,数据与训练配方将陆续公布。
推荐理由:原文给出了数据构造、SFT-RL 训练和统一评测的完整思路,读者可以据此理解 Search Agent 的训练难点与可迁移方法。
MiniMax (official)@MiniMax_AIAI 评分6262
MiniMax (official)@MiniMax_AIAI 评分6161MiniMax 盘点其开源视频生成模型 MiniMax H3 的社区生态进展,该模型支持原生立体声音频和多模态参考控制。
vLLM 官方博客(RSS)AI 评分5353 vLLM 优化 Kimi K3 服务性能:吞吐提升 2.2–2.8 倍
vLLM 团队详解 Kimi K3 从 v0.27.1 到 0913 main 的服务性能优化,在 8K/1K、TP8、B300 节点测试下延迟降低 56%–60%,吞吐提升 2.2–2.8 倍,TTFT 降低 72%–85%。
Fireworks AI(网页)AI 评分5151 Fireworks 评测 2026 年九款最佳开源 LLM,GLM 5.2 与 Kimi K3 领跑基准
Fireworks 发布 2026 年开源 LLM 选型指南,覆盖 GLM 5.2、Kimi K3、Kimi K2.7 Code、DeepSeek-V4-Pro/Flash、MiniMax M3、Qwen3.7 Plus、gpt-oss-120b 和 Gemma 4 31B IT 九款模型。
Artificial Analysis@ArtificialAnlysAI 评分6464
OpenBMB@OpenBMBAI 评分5757Nathan Lambert:Interconnects(RSS)AI 评分5656 Nathan Lambert 整理开源 AI 与开放模型阅读清单
Nathan Lambert 发布一份开放模型领域精选阅读清单,涵盖基础概念、中美竞争与技术细节三部分。
OpenBMB@OpenBMBAI 评分6161面壁智能转发用户实测,MiniCPM5-2B 已可在 Android 上通过 llama.cpp 加载 GGUF 完成推理,全程数据不离开手机。
SiliconFlow@SiliconFlowAIAI 评分6767IBM Research:AIAI 评分5454 IBM 与 NASA 开源月球基础模型 NASA-IBM Lunar Foundation Model
IBM 与 NASA 开源 NASA-IBM Lunar Foundation Model,整合美日多次探月任务的多模态、多分辨率观测数据。
Tencent Hy@TencentHunyuanAI 评分5959
OpenBMB@OpenBMBAI 评分5757
Unitree@UnitreeRoboticsAI 评分5555宇树全面开源 UnifoLM-WLA-1.0 具身基础模型,官方称在全球开源模型中于多个基准取得新 SOTA 结果。单一模型可协调桌面与全身移动操作,支持跨任务和跨末端执行器泛化,实现单模型全身协调。
OpenBMB@OpenBMBAI 评分6161公众号:面壁智能(MiniCPM)AI 评分5454 面壁智能 MiniCPM5-2B 登顶 Hugging Face Trending,开放权重与训练数据
面壁智能 MiniCPM5-2B 登顶 Hugging Face Trending,在 AA Intelligence Index V4.1.1 评测中位居全球 4B 以下开放权重模型首位,34 项基准平均得分 53.9。
公众号:DeepSeek(深度求索)AI 评分8686 DeepSeek 发布 V4.1 Flash:552B MoE 多模态模型,同步开源并下调 API 定价
DeepSeek 正式发布 V4.1 Flash,全新 Causal-Encoder-Decoder 结构的 552B 参数 MoE 模型,输入激活 8B、输出激活 16B,具备原生多模态视觉理解,基准测试超越包括 DeepSeek V4 Pro 在内的旗舰模型。
Ant Ling@AntLingAGIAI 评分5252Cohere 产品与研究博客(网页)精选AI 评分6666 Cohere 发布开源权重翻译模型 North Small Translate,WMT26 得分 83.60 超越 DeepL 与 Google Translate
Cohere 发布机器翻译模型 North Small Translate,为 MoE 架构,总参数 218B、激活 25B,支持 50+ 语言,WMT26 全语言得分为 83.60,高于 DeepL NextGen 的 81.37 和 Google Translate 的 68.20,Agentic 版本达 84.36。
推荐理由:官方公布了 WMT26 各语言和分区域得分、吞吐与单任务成本数据,读者可据此评估其相对 DeepL 和开源模型的位置。