Nathan Lambert 撰文分析开源模型的中美实力格局
Nathan Lambert 发布其向美国国会汇报的开源模型现状综述,指出中国开源权重模型已在下载量、基准成绩和学术采用上领先,自 2025 年 7 月起在 Hugging Face 下载量上领先约 1.6B(总 3.2B,为美国两倍)。
推荐理由:作者基于自己持续追踪的下载量、基准和 arXiv 数据,给出开源权重模型中美竞争格局的全景与政策视角。
Nathan Lambert 发布其向美国国会汇报的开源模型现状综述,指出中国开源权重模型已在下载量、基准成绩和学术采用上领先,自 2025 年 7 月起在 Hugging Face 下载量上领先约 1.6B(总 3.2B,为美国两倍)。
推荐理由:作者基于自己持续追踪的下载量、基准和 arXiv 数据,给出开源权重模型中美竞争格局的全景与政策视角。
Kev 发布了一组基于 Qwen3.5 的小型决策模型,包含 0.8B、4B 和 9B 三个规格,采用 rank-16 LoRA 加 pointer head 架构,支持在同一请求中处理 yes/no、多选和打分问题并返回概率。
SGLang-Diffusion 发布对 Qwen-Image 2.1 的 Day-0 支持,覆盖文本生成图像、多图编辑和透明 RGBA 输出,单 checkpoint 即可完成。
智谱 ZCode 宣布就产品安全问题完成整改并向所有用户道歉,已将 ZCode 开源至 https://github.com/zai-org/ZCode,承诺相关代码数据无留存、未用于模型训练。
曾运营npm五年的seldo发布长文,主张npm、PyPI、Docker Hub等软件包注册表对达到规模的企业按Docker模式收取供应订阅费,并将固定比例版税按依赖树权重自动分账给其代码进入付费客户依赖树的维护者。
Google 推出开源的声明式 agent 执行控制平面 AX,提供 Task、Workspace、Gateway、Model 四个原语来沙箱化 agent 任务、配置网络策略和模型密钥。
Flet 团队发布 Flet 1.0 并宣布可用于生产应用开发。该开源 Python 框架基于 Flutter 渲染 UI,flet build 支持 apk、aab、ipa、ios-simulator、windows、macos、linux、web 八个目标平台,应用可捆绑 Python 3.12、3.13 或 3.14,Apache 2.0 协议下已上架 PyPI。
Pirate Face 上线去中心化基础设施,把 Hugging Face 上的开放模型(LLM、图像、音频、数据集)镜像为可校验的磁力种子链接,覆盖 66.9 万以上符合条件的项目。
阿里 Qwen 团队发布开源权重图像生成与编辑模型 Qwen-Image-2.1,视觉生成部分仅 7B 参数,团队称在其自建基准上超过多数闭源模型,独立基准尚待验证,可在 RTX 3090 等消费级 GPU 上运行。
阶跃星辰(StepFun)发布旗舰模型 Step 5 Preview,主打智能体工作,采用稀疏 MoE 架构,总参数 600B、每 token 激活 27B,支持 1M token 上下文窗口和视觉输入。
阿里千问开源图像模型 Qwen-Image-2.1,将文生图与图像编辑整合在同一模型中,视觉生成部分仅 7B 参数,原生支持透明图像的生成与编辑。更新亮点包括轻量结构与推理优化、支持最多 10 张参考图的局部编辑与人像商品保真,以及文字排版和人物光影表现提升,模型已上架 GitHub、HuggingFace 和 ModelScope。
Qwen 团队开源 Qwen-Image-2.1,将文生图与图像编辑统一到一个模型中,视觉生成组件仅 7B 参数,并原生支持生成和编辑透明图像。模型支持最多 10 张参考图、圆形/涂鸦/独立蒙版指定局部编辑,通过混合粒度注意力架构和 KV cache 复用提升推理效率,同时改进文字渲染、人像光照与人物产品保真度,并覆盖全景图、信息图和分镜等任务。
推荐理由:官方详解了 7B 统一图像模型的透明图像生成、10 图参考编辑与推理优化,读者可据此评估在设计等场景的可用性。
阶跃星辰发布旗舰模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识和金融场景,将于 10 月 15 日开源完整权重。
中电信人工智能科技于 9 月 17 日发布星辰大模型 Xing4.0-29B-A4B,总参数 29B、激活参数 4B,据称是国内首个基于昇腾 Atlas 900 A3 SuperPoD 液冷超节点与昇思 MindSpore 框架完成训练的百亿参数大模型。
阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 MoE 架构,总参数量 600B、激活 27B,支持 100 万 Token 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球开源模型前三,单任务成本为 Claude Opus 5 的 1/8。
推荐理由:官方完整公布架构参数、基准成绩和权重开放时间,读者可据此评估其在开源主力模型中的成本能力位置。
有人用 Fable-5.1 破解了热敏标签打印机固件,绕过其通过 RFID 检测第三方耗材后降速降质的限制,项目开源在 http://github.com/ThreeDaPrint/niimbot。
Rohan Paul 转引 @rauchg 数据称 Vercel AI Gateway 上开源模型 token 占比或创纪录地达 78.4%,闭源为 21.6%。
开源个人 AI 智能体 OpenClaw 发布 2026.9.5 版本,整合 4,179 个 pull request,来自 502 个贡献者账号。核心变化是 Atomic Updates,在现有 Gateway 继续运行时校验新版本,失败可回滚,保证始终有可用的智能体协助诊断。
中国电信于 9 月 17 日发布并开源新一代星辰大模型 Xing4.0-29B-A4B,总参数量 29B、激活参数 4B,原生支持 256K 上下文、可扩展至 512K,官方称是国内首个基于国产算力与国产框架完成训练的百亿参数大模型。
Latent Space 的 AINews 汇总了 Jev 发布两天内出现的 6 个复现版本,包括基于 ModernBERT 的 Laya、基于扩散模型的 DiffusionGemmaJev。
MarkTechPost 发布一篇 LLM 模型格式与量化方法科普,先区分存储容器(safetensors、GGUF)与量化方法(GPTQ、AWQ、bitsandbytes NF4 等),再逐个讲解 GGUF 的量化命名、GPTQ 与 AWQ 原理、EXL2/EXL3 及 MLX 等格式。
Jina AI 发布端到端视觉文档解析模型 jina-ocr-v1,总参数 3.4B,每 token 激活约 570M,可将 PDF、扫描件、表格和发票一次转成 Markdown。
GrapheneOS 称 Android 17 QPR1 是自 Honeycomb(3.x)以来首个未向 AOSP 发布就新增应用开发者 API 的版本,新 API 目前仅 Pixel OS 独占。
PrismML 发布 Ternary Bonsai 2 27B,将 Qwen3.8 27B 转为三值权重,模型仅 5.93 GB(FP16 为 53.80 GB),Apache 2.0 开源,官方称在 20 个基准上保留母模型 98.2% 的平均分,支持文本与图像输入和 262K token 上下文。
美国国家档案与文件署运营的 Federal Register 网站被发现提供阿里 Qwen 模型搜索公众意见的功能,9 月 15 日被 X 用户截图发现,周三已被撤下。
MiniMax 宣布 MiniMax Code CLI v0.4.12 面向全球开发者正式开放,并以 MIT 协议开源源代码。在基于 FrontierHarness Eval 的评测中取得 76.7% 任务通过率,成功任务耗时中位数 4 分 33 秒,两项指标均优于报告所列公开基线。
MiniMax 官方宣布 MiniMax Code CLI 现已开放,仓库地址为 https://github.com/MiniMax-AI/minimax-code。
MiniMax 宣布 MiniMax Code CLI v0.4.12 面向全球开发者开放,并以 MIT 协议开源源码,称其为 MiniMax Code 客户端的核心组件。
OpenJev 是一个纯浏览器、无后端的本地实验站点,用户可在自己的 GPU 上加载模型,对比两种决策方式:直接读取选项 logits 并归一化,或让模型逐 token 写出 JSON 概率分布,并用 performance.now() 实测各阶段耗时。
该指南从文档完善度、许可证、维护状态和安全控制等维度盘点 11 个开源 Agent harness,包括 OpenCode、Pi、Goose、Cline、OpenHands、Aider、Codex CLI、Qwen Code、Kilo Code、Hermes Agent 和 OpenClaw。
Flet 发布 1.0,支持用一套 Python 代码构建 Web、桌面和移动应用,无需前端经验。提供 150+ 控件、iOS 和 Android 预编译包、flet build 打包分发、基于 Pyodide 的浏览器运行,以及 Flet MCP 供编码助手获取 API 信息,项目开源。
PrismML 宣布推出三值量化版本的 Bonsai 2 27B,基础模型升级至 Qwen3.8 27B,以不到 1/9 的内存占用在综合基准测试中达到基础模型 98.2% 的分数,整体表现好于 Qwen3.6 27B。