#开源生态
#开源生态
今日 2 条
OpenBMB@OpenBMBAI 评分5757
Unitree@UnitreeRoboticsAI 评分5555宇树全面开源 UnifoLM-WLA-1.0 具身基础模型,官方称在全球开源模型中于多个基准取得新 SOTA 结果。单一模型可协调桌面与全身移动操作,支持跨任务和跨末端执行器泛化,实现单模型全身协调。
IT之家(RSS)AI 评分5555 宇树科技完全开源通用人形机器人基座模型 UnifoLM-WLA-1.0,刷新开源多项评测 SOTA
宇树科技宣布完全开源新一代通用人形机器人基座模型 UnifoLM-WLA-1.0,称刷新全球开源模型多项评测 SOTA。真机评测中单模型统筹 64 个任务,覆盖桌面操作与全身移动操作,具备跨任务、跨末端执行器的泛化能力,在多项具身推理评测中领先国内外开源模型。
Thomas Wolf@Thom_WolfAI 评分7474DeepSeek 发布 DeepSeek-V4.1-Flash,称其为新架构家族中最小模型,具备原生视觉理解,面向更快推理、更高吞吐和扩展到更大模型而设计。
OpenBMB@OpenBMBAI 评分6161公众号:面壁智能(MiniCPM)AI 评分5454 面壁智能 MiniCPM5-2B 登顶 Hugging Face Trending,开放权重与训练数据
面壁智能 MiniCPM5-2B 登顶 Hugging Face Trending,在 AA Intelligence Index V4.1.1 评测中位居全球 4B 以下开放权重模型首位,34 项基准平均得分 53.9。
MarkTechPost(RSS)精选AI 评分8787 DeepSeek AI 发布 DeepSeek-V4.1-Flash:1M 上下文、FP4 KV 缓存与跨层注意力复用
DeepSeek AI 发布多模态 MoE 模型 DeepSeek-V4.1-Flash,552B 主干加 196B Engram 参数,上下文窗口 1M,prefill 激活 8B 参数、decode 激活 16B,全局 KV 缓存降至每 token 890 字节,约为 DeepSeek-V4-Flash 的 1/4、DeepSeek-V1 的 1/437。
推荐理由:文章拆解了 KV 缓存压缩和预精简架构的具体做法,读者可以对照其工程路径评估长上下文部署成本。
IT之家(RSS)AI 评分8686 DeepSeek 发布 V4.1 Flash 模型,基准超越 V4 Pro 并下调 API 定价
深度求索正式发布 DeepSeek V4.1 Flash,为 552B 参数 MoE 模型,采用全新 Causal-Encoder-Decoder 结构,原生支持多模态,基准测试超越包括 DeepSeek V4 Pro 在内的旗舰模型。
公众号:DeepSeek(深度求索)AI 评分8686 DeepSeek 发布 V4.1 Flash:552B MoE 多模态模型,同步开源并下调 API 定价
DeepSeek 正式发布 V4.1 Flash,全新 Causal-Encoder-Decoder 结构的 552B 参数 MoE 模型,输入激活 8B、输出激活 16B,具备原生多模态视觉理解,基准测试超越包括 DeepSeek V4 Pro 在内的旗舰模型。
clem 🤗@ClementDelangueAI 评分5252
Thomas Wolf@Thom_WolfAI 评分6262Hugging Face 发布 ML Intern,上线于 HuggingChat,目标是让 2026 年为任务训练模型像 vibe-coding 一个应用一样简单。
Nathan Lambert@natolambert精选AI 评分8585推荐理由:曾在 HuggingFace 工作的作者分析了这起收购的软实力逻辑,指出其每年值约 100 亿美元的原因。
Ant Ling@AntLingAGIAI 评分5252
elvis@omarsar0AI 评分6161Cohere 产品与研究博客(网页)精选AI 评分6666 Cohere 发布开源权重翻译模型 North Small Translate,WMT26 得分 83.60 超越 DeepL 与 Google Translate
Cohere 发布机器翻译模型 North Small Translate,为 MoE 架构,总参数 218B、激活 25B,支持 50+ 语言,WMT26 全语言得分为 83.60,高于 DeepL NextGen 的 81.37 和 Google Translate 的 68.20,Agentic 版本达 84.36。
推荐理由:官方公布了 WMT26 各语言和分区域得分、吞吐与单任务成本数据,读者可据此评估其相对 DeepL 和开源模型的位置。
Hugging Face:Blog(RSS)AI 评分5656 IBM 发布 Granite Time Series PatchTST-FM-r2,采用 Apache 2.0 与 OpenMDW 1.0 双许可
IBM 发布 Granite Time Series PatchTST-FM-r2,约 385M 参数,支持最长 8,192 上下文、99 分位数概率预测和缺失值插补。
Robbyant@robbyant_brainAI 评分6363
elvis@omarsar0AI 评分5959Hacker News 热门(buzzing.cc 中文翻译)AI 评分6969 Desert Ant Labs 发布 18 个可在设备上运行的专用小模型
欧洲 AI 实验室 Desert Ant Labs 正式成立并上线首批 18 个端侧专用模型(12 个稳定版、6 个 beta),覆盖音频、视觉和文本任务,通过 Swift、Kotlin 和 JavaScript 的统一 SDK 提供,在 GitHub 和 Hugging Face 开放。
IT之家(RSS)AI 评分5454 面壁智能联合 OpenBMB 开源 MiniCPM5-2B,AA 榜单 4B 以下开源基座模型第一
面壁智能联合 OpenBMB 开源 2B 端侧基座模型 MiniCPM5-2B,在 AA 榜单获 23 分,居全球 4B 以下开源基座模型第一,Agentic Index 达 20 分,同级模型如 LFM2.5-2.6B、Granite 4.2 3B、Mistral 3 3B 仅 2 分。
Ant Ling@AntLingAGIAI 评分5555inclusionAI 在 ModelScope 发布开源视觉模型 Ling-3.0-flash-VL,采用 MIT 协议,提供 BF16 和 FP8 两种权重。
Ant Ling@AntLingAGIAI 评分5454HuggingFace Daily Papers(社区热门论文)AI 评分5757 Gander 全双工全模态交互智能体技术报告发布并开源
作者发布 Gander 技术报告,这是一个端到端模型,在单一框架内统一全模态感知、实时交互与智能体能力,支持视频、语音、文本流式输入与随时打断的全双工交互。其采用 Cerebellum-Brain 协同框架,小脑负责实时交互与对话,大脑负责复杂推理与智能体任务,并基于流式 Thinker-Talker 架构实现低延迟;模型、代码和数据将开源。
HuggingFace Daily Papers(社区热门论文)AI 评分5252 Miles v0.1 发布:面向生产级后训练的开源 RL 系统
Miles v0.1 是一个全栈、生产就绪的前沿后训练系统,围绕 slime 的设计,将 RL 训练循环各环节按可验证、干净、可定制的原则构建,并已在 https://github.com/radixark/miles 开源。
IT之家(RSS)AI 评分6262 蚂蚁百灵发布开源 Ling-3.0-flash-VL,首个原生多模态模型引入视觉反馈闭环
蚂蚁集团发布并开源百灵系列首个原生多模态大模型 Ling-3.0-flash-VL。模型基于 Ling-3.0-flash 的 MoE 架构,总参数 124B、单次推理激活 5.5B,原生支持图像、文本与视频输入,上下文窗口 256K Token,并引入观察、行动、验证、修正的视觉反馈闭环机制。
公众号:蚂蚁百灵(Ling)AI 评分6565 蚂蚁百灵开源首个原生多模态大模型 Ling-3.0-flash-VL
蚂蚁百灵发布并开源首个原生多模态大模型 Ling-3.0-flash-VL,基于 Ling-3.0-flash 的 MoE 架构,总参数 124B,单次推理激活 5.5B,原生支持图像、文本与视频输入,上下文窗口 256K Token。
LG AI Research:官方研究博客AI 评分5353 LG AI Research 发布表格基础模型 EXAONE Tabular,纯合成数据预训练
LG AI Research 发布面向结构化表格数据的分类与回归基础模型 EXAONE Tabular,完全基于 SCM 合成数据预训练,未使用任何真实表格数据,通过上下文学习免重训直接预测。
Together AI 研究与产品博客(RSS)精选AI 评分6868 Together AI 深度解析开源模型 AI 编码栈 MIGHT
Together AI 发布深度解析文章,介绍开发者从闭源模型转向开源模型所需的 AI 编码栈,提出由 Model、Inference、Gateways、Harness、Tools 组成的 MIGHT 框架。
推荐理由:原文给出开放权重模型编码栈的分层框架,读者可据此按任务选模型、按价格选供应商并保持工作流稳定。
HuggingFace Daily Papers(社区热门论文)AI 评分7474 NVIDIA 发布 Nemotron IMO 2026 开源配方,纯自然语言证明拿下 30/42 达金牌线
NVIDIA 基于 Nemotron 3 Ultra 训练 SFT 与 RL 两个专精检查点,结合生成-验证-精炼的测试时推理流水线,在 IMO 2026 正式得分 30/42,超过 29 分的金牌线,全程不使用形式化证明器、外部工具或联网。
Hacker News:AI 热帖AI 评分5353 作者发布浏览器端 LLM 注意力权重可视化工具
作者发布一个基于 Transformers.js 的 LLM 注意力可视化工具,可悬停查看生成 token 依赖的历史 token,代码开在 GitHub。可视化将所有层、所有注意力头的注意力权重乘以 value 向量模长后聚合为单一数值控制透明度,并预生成提示词避免下载数百 MB 模型;作者还通过修改 onnx 文件暴露内部值,上传到自己的 Hugging Face 仓库供浏览器生成使用。
Cohere@cohereAI 评分5151Cohere 发布首个围绕 decode megakernel 构建的完整 LLM 文本生成服务系统,性能最高比 vLLM 快 1.58x。该系统为 North Mini Code 打造,完全开源。
ViggleAI@ViggleAIAI 评分5555LangChain:Blog(RSS)AI 评分5858 LangChain 讲解 deepagents 多智能体框架中的上下文组织方式
LangChain 发布博客,介绍 deepagents 中的 context modes 如何帮助子智能体分叉 supervisor 的上下文或以隔离方式启动,从而让多智能体工作更快、更省、更聚焦。
Ant Ling@AntLingAGIAI 评分5252
Thomas Wolf@Thom_WolfAI 评分6464
Nathan Lambert:Interconnects(RSS)AI 评分5151 开源动态第 24 期:Motif-3、GLM-5.3、Hy4-preview 与开源模型许可证趋势
本期开源模型汇总指出,2026 年开源模型竞争加剧带来许可证分化:Google 和 Meta 转向 Apache 2.0,而智谱 GLM-5.3 从 MIT 改为自定义许可证,要求年收入超 100 亿美元的推理或微调服务商通过 Z.AI 安全审查,且未定义关联方带来不确定性。
clem 🤗@ClementDelangueAI 评分6363Berkeley RDI:Blog(AI 安全与评测)精选AI 评分6161 Berkeley RDI 发布开源平台 CUA-Lite,面向计算机使用智能体
Berkeley RDI 推出开源平台 CUA-Lite,为计算机使用智能体提供三个标准化抽象。其环境接口下运行 15+ 个覆盖桌面、浏览器和移动端的基准,并提供含 30k+ 可验证任务的免 VM 桌面沙箱;统一监督数据格式已转换 10+ 个公开 CUA 数据集;每模型一个 harness 在评测、SFT 和 RL 间共享,支持 14 个模型族。
推荐理由:原文说明了平台的三项标准化抽象及覆盖规模,读者可以据此评估它在整合分散的计算机使用智能体资源上的可用性。
OpenBMB@OpenBMBAI 评分5858IBM Research:AIAI 评分5151 IBM Research 展示用 llm-d 在 544 块 NVIDIA H100 上服务 GLM-5.2 智能体负载
IBM Research 联合 Red Hat、Google 的开源项目 llm-d 展示在 544 块 NVIDIA H100 GPU 上部署 753B 参数的开放权重 MoE 模型 GLM-5.2(约 39B 激活),在数百到 3000 个并发编码智能体负载下峰值输出超 6.6M tokens 每分钟,零抢占。