#开源生态
#开源生态
今日 2 条
Arthur Mensch@arthurmenschAI 评分6666The Decoder:AI News(RSS)AI 评分7474 Mistral AI 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元
Mistral AI 完成 30 亿欧元 Series D 融资,估值超过 210 亿欧元,公司称这是欧洲科技公司有史以来最大的股权融资轮。三星电子领投,EQT 管理的 Scaleup Europe Fund 和 PSG Equity 联合领投,a16z、Nvidia、ASML 等老股东继续参与。
IT之家(RSS)AI 评分6060 Mistral AI 完成 30 亿欧元 D 轮融资,投后估值超 210 亿欧元,三星电子领投
Mistral AI 宣布完成 30 亿欧元 D 轮融资,投后估值超 210 亿欧元,由三星电子、Scaleup Europe Fund、PSG Equity 领投,融资规模创欧洲科技公司历史记录。资金将用于前沿研究,公司称凭借开放权重模型、算力基础设施和 AI 产品提供全栈方案,避免客户依赖单一供应商。
Mistral AI:News(网页)精选AI 评分7373 Mistral 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元
Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,公司称这是欧洲科技公司有史以来最大的股权融资,距其成立三年。
推荐理由:融资公告由公司官方发布,给出了金额、估值、领投方和资金用途,读者可以据此了解欧洲主权 AI 阵营的资本动向。
🚨 AI News | TestingCatalog@testingcatalogAI 评分7171
OpenBMB@OpenBMBAI 评分6262OpenBMB 发布 MiniCPM5 端侧模型,采用 Apache 2.0 协议,1B 与 2B 版本支持 128K 上下文、编码、推理和智能体工具调用。
公众号:面壁智能(MiniCPM)AI 评分5858 面壁智能联合 OpenBMB 开源 MiniCPM5-2B,AA 榜单 4B 以下综合第一
9 月 8 日,面壁智能联合 OpenBMB 开源 2B 端侧基座模型 MiniCPM5-2B,支持工具调用、深度搜索、代码生成。
IT之家(RSS)AI 评分6262 微信开源多模态嵌入模型 WeMM-Embedding,已在微信大规模使用且日调用量达 10 亿次
微信 AI 于 9 月 4 日宣布开源通用多模态嵌入模型 WeMM-Embedding,包含 2B、4B、9B 三个版本,支持文本、图像、视频、视觉文档及任意交错的多模态输入。
HuggingFace Daily Papers(社区热门论文)AI 评分5959 Feyospace-v1:七人独立团队训练出领先的开源网络智能体模型
论文提出以数据为中心的 Feyospace-v1 框架,通过五套系统与可重置的编码、漏洞、CTF、内核历史、完整利用、固件和设备环境生成数据,经执行验证和证据审计后保留 164,269 条轨迹用于长上下文监督微调。
vLLM 官方博客(RSS)精选AI 评分6363 vLLM x AgentX:面向真实世界智能体推理服务的全栈优化
vLLM 团队发布针对智能体负载优化的博客,基于 SemiAnalysis 的公开 AgentX 基准展示成果:DeepSeek V4 Pro 在 GB300 上达到 83K total tokens/GPU-秒。
推荐理由:vLLM 团队结合 AgentX 实测数据讲解智能体负载的全栈优化方法与失败教训,读者可以借此理解并行策略如何跟随模型架构调整。
MarkTechPost(RSS)AI 评分6363 OpenBMB 发布 MiniCPM5-2B:2.52B 稠密模型,34 项基准平均 53.9,面向端侧运行
OpenBMB 发布 MiniCPM5 系列第二个 checkpoint MiniCPM5-2B,2.52B 稠密模型,原生 131,072 token 上下文,Apache 2.0 权重,采用标准 LlamaForCausalLM 架构,可通过 vLLM、SGLang、llama.cpp、Ollama 等主流引擎直接运行。
OpenBMB@OpenBMBAI 评分5454
OpenBMB@OpenBMBAI 评分6262
OpenBMB@OpenBMBAI 评分5858
Artificial Analysis@ArtificialAnlysAI 评分5555
OpenBMB@OpenBMBAI 评分5353
凡人小北@frxiaobeiAI 评分6666
Tencent Hy@TencentHunyuanAI 评分6363IT之家(RSS)AI 评分5959 科大讯飞发布星火 X2.5 模型:293B-A30B MoE 架构,全国产平台训练
科大讯飞 9 月 7 日正式发布星火 Spark X2.5 多语言文本生成模型,基于全国产平台训练,采用 MoE 框架,参数为 293B-A30B,支持 256K 上下文。模型全面提升代码和智能体能力,覆盖 200 余种语言,已在讯飞星辰 MaaS 平台上线,输入定价 1.6 元/百万 Token(缓存命中 0.24 元),输出 6 元/百万 Token。
MarkTechPost(RSS)AI 评分6565 IFM 发布 K2 Horizon:六款 Apache 2.0 开源模型,规模覆盖 0.9B 到 375B
MBZUAI 旗下前沿实验室 IFM(Institute of Foundation Models)于上周发布 K2 Horizon 系列模型,共六款:375B-A23B、36B-A4B、32B、7B、3.7B 和 0.9B,均采用 Apache 2.0 许可证。一同发布的还有预训练语料等配套资源。IFM 是 MBZUAI 于 2025 年 5 月成立的前沿实验室。
ViggleAI@ViggleAIAI 评分5555MarkTechPost(RSS)AI 评分5252 H Company 发布 NeoMME 260M/800M 单塔多模态编码器,取消视觉塔和因果解码器
H Company 发布 NeoMME 系列多模态编码器,包含 260M 和 800M 两个双向 Transformer 模型,用单一塔处理多语言文本和 32×32 图像块,去掉了独立视觉塔和因果解码器,以离散掩码扩散方式预训练。
MarkTechPost(RSS)AI 评分5252 Meta FAIR 联合牛津和 UCL 提出 AI Research Preference Models(RPMs):在消耗 GPU 时数前排序 ML 实验
Meta FAIR、牛津大学和 UCL 团队提出 AI Research Preference Models(RPMs),在执行前对未运行的 ML 实验候选排序,只执行获胜者。
Ant Ling@AntLingAGIAI 评分5151
IT之家(RSS)AI 评分5151 阿里千问开源 Qwen-Drive-1.0-4B 自动驾驶视觉语言模型
阿里千问本周开源 Qwen-Drive-1.0-4B,一款基于 Qwen3.5-4B 构建的自动驾驶视觉语言基础模型,官方称其为首个面向自动驾驶的视觉语言基础模型。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5757 蚂蚁 inclusionAI 发布块扩散视觉语言 GUI 智能体 LLaDA-UI
蚂蚁 inclusionAI 在 Hugging Face 发布 LLaDA-UI,一个基于 MoE 的块扩散视觉语言 GUI 智能体,总参数约 16.7B,语言骨干为 LLaDA2.0-mini-base。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5353 蚂蚁 inclusionAI 发布 LLaDA2.2-mini 智能体扩散语言模型
蚂蚁 inclusionAI 在 Hugging Face 发布 LLaDA2.2-mini,这是 LLaDA2 系列的轻量级智能体扩散语言模型,总参数 16B、推理仅激活 1.4B。
IT之家(RSS)AI 评分5353 F-Droid 拟借鉴 Debian 新 AI 政策:允许使用生成式 AI,责任由人类开发者承担
开源安卓应用商店 F-Droid 考虑采用类似 Debian 的 AI 政策,拟议文本直接沿用 Debian 政策全文并替换名称。此前 Debian 社区以孔多塞投票制表决,9 个选项中第 5 项“负责任地使用生成式 AI”胜出。
Rohan Paul@rohanpaul_aiAI 评分5454
Rohan Paul@rohanpaul_aiAI 评分5151上海人工智能实验室提出 Harness-of-Harness(HoH)框架,让编码智能体在多次迭代间持续携带代码、测试证据、已知问题和更新后的计划。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分3535 TERMy 发布:一款不使用 LLM 的高速终端助手
开发者在 Show HN 发布 TERMy,一款不使用大语言模型的高速终端助手,项目代码托管在 GitHub(github.com/gioblu/NPC-Forge)。帖子获 100 HN Points,feed 未提供更多功能细节。
MarkTechPost(RSS)AI 评分6565 NVIDIA 发布开源虚拟推理路由器 PAIR,将本地 AI 请求分发到 RTX、DGX Spark 和 Mac 节点
NVIDIA 本周发布开源虚拟推理路由器 PAIR(v0.1.1 公测),自动发现局域网内设备并把独立推理请求调度到不同节点,模型仍由 Ollama 或 LM Studio 执行。
ginobefun@hongming731AI 评分3131IT之家(RSS)AI 评分8383 Anthropic 宣布 Claude 用 11 天完成费马大定理首个端到端形式化证明
Anthropic 于 9 月 4 日宣布,Claude 在基本自主运行 11 天后,完成费马大定理首个端到端、经计算机检查的 Lean 形式化证明。
DAIR.AI@dair_aiAI 评分4949arXiv 论文(2609.04010)提出 diffusion-augmented LLMs,即 Uno,一类在自回归模型分布上用扩散并行抽取多个 token 的新模型。
Rohan Paul@rohanpaul_aiAI 评分3535
MiniMax (official)@MiniMax_AIAI 评分2424
Ant Ling@AntLingAGIAI 评分3939蚂蚁百灵发布 Ling-3.0-flash-Sante,一个基于 Ling-3.0-flash 构建、面向健康与医疗领域增强的 MoE 模型,名字取自法语 santé(健康)。
Mistral AI@MistralAIAI 评分2626
Anthropic@AnthropicAI精选AI 评分7676Anthropic 宣布 Claude 上月完成了 Fermat 大定理的首个形式化证明,这是迄今最大的 Lean 证明。
推荐理由:原文给出证明规模、验证范围和完整代码入口,读者可以据此了解 AI 形式化数学论证的实际能力边界。