#开源生态
#开源生态
今日 2 条
凡人小北@frxiaobeiAI 评分6060IT之家(RSS)AI 评分7676 阿里发布全模态模型 Qwen3.8-Omni-Flash,支持 1M 上下文,百万 Token 图文音视频输入 0.8 元
阿里千问上线新一代原生全模态模型 Qwen3.8-Omni-Flash,可同时处理文本、图像、音频和视频输入,支持 1M 上下文。在 30 项评测上相比上一代 Qwen3.5-Omni-Plus 平均得分提升超过 26%,官方称音视频能力接近 Gemini 3.8 Flash、音频能力整体超过 Gemini 3.8 Flash。
Qwen@Alibaba_QwenAI 评分7373通义千问发布 Qwen3.8-Omni-Flash,是 Qwen 首个以智能体能力为核心构建的全模态模型,支持原生音视频理解、推理和工具调用。
HuggingFace Daily Papers(社区热门论文)精选AI 评分8585 DeepSeek-V4.1-Flash 发布:552B MoE 多模态模型主打 KV cache 压缩
DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,支持最长 100 万 token 上下文,模型权重已在 Hugging Face 开放。
推荐理由:论文给出了每 token KV cache 字节数等具体压缩指标,并与上一代模型直接对比,可评估长上下文 Agent 部署成本变化。
IT之家(RSS)AI 评分7171 美国《联邦公报》网站被发现部署阿里千问搜索工具,同日下线
美国国家档案馆运营的《联邦公报》网站周三被发现提供由阿里巴巴千问模型驱动的搜索工具,供用户搜索拟议联邦法规,但当天即下线,部署时间不明。据路透社查阅的截图和源代码存档,该工具与社交媒体讨论几乎同时出现又被移除;AI 专家认为未必构成国家安全风险,千问是开放权重模型,成本低于 Anthropic 和 OpenAI 等闭源模型,美国国家档案馆和白宫截至发稿未回应置评请求。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分7070 PrismML 发布 Ternary Bonsai 2 27B:体积缩小 9 倍以上,保留 98.2% 基准性能
PrismML 发布 Ternary Bonsai 2 27B,基于 Qwen3.8 27B,采用三值权重加 FP16 分组缩放,有效每权重 1.76 bit,模型体积 5.9GB,比全精度模型小 9 倍以上,基准综合得分 83.9,保留全精度模型 98.2% 的性能。
Anthropic:Research(发表成果 · 网页)精选AI 评分7474 Anthropic:Claude 四周优化 30 多个开源生物分子模型,平均提速约 4 倍并开源代码
Anthropic 让 Claude 在不到四周内优化了超过 30 个开源生物分子模型,平均提速约 4 倍、精度损失极小,输出完全一致时也有近 2 倍加速。优化代码全部开源,还推出低内存 Big 模式,可在单张 NVIDIA GPU 节点上对超过 10,000 token 的生物分子系统做准确预测。
推荐理由:Anthropic 公布了完整提速数据、开源代码和比赛入口,读者可以据此评估 AI 优化科学计算代码的实际水平。
Google Developers Blog(RSS)精选AI 评分6363 Google 与 Speakeasy 开源 OpenAPI SDK 生成套件
Google 与 Speakeasy 合作,将 Speakeasy 的 OpenAPI 客户端代码生成套件以 AGPLv3 许可开源,此前原 SDK 生成供应商被收购并突然宣布关停,凸显闭源生成器的平台风险。
推荐理由:原文交代了开源 SDK 生成器的许可、语言覆盖和迁移背景,开发者可据此评估能否替代自有闭源生成管线。
elvis@omarsar0AI 评分5454
Rohan Paul@rohanpaul_aiAI 评分6363Qwen:Blog Retrieval(API)精选AI 评分7878 Qwen 发布原生全模态模型 Qwen3.8-Omni-Flash,主打音视频智能体任务交付
Qwen 发布下一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频和视频输入及 1M token 上下文窗口,29 项评测平均分较 Qwen3.5-Omni-Plus 提升超过 25%,音频输入每小时价格下降超过 98%,音视频输入每小时价格下降超过 93%。
推荐理由:官方发布同时开放 API 和开源插件与运行时,读者可以据此评估音视频智能体在剪辑、会议、实时交互等工作流中的落地方式。
LangChain:Blog(RSS)AI 评分5252 LangChain 开源 Deep Life Sci:面向临床与实验室科学家的智能体助手
LangChain 发布开源智能体助手 Deep Life Sci,面向临床和实验室科学家。它接入 600K+ ClinicalTrials.gov 研究、2900 万 PubMed 摘要和 1200 万 PubMed Central 全文,并用沙盒子智能体进行真实数据分析。
DAIR.AI@dair_aiAI 评分5555NVIDIA 论文提出 Agora,把多个研究智能体的共享记忆记录为 Git 中只增不改的 DAG,每个结果、假设和验证都是不可变 commit,父边标明依赖关系,索引列出开放分支与验证状态。
Unsloth AI@UnslothAI精选AI 评分6868推荐理由:官方介绍了新 Docker 镜像和 Desktop 应用,列出本地训练运行模型的硬件支持与效率数字,读者可据此评估本地部署方式。
SenseTime@SenseTime_AIAI 评分5757
SenseTime@SenseTime_AIAI 评分5353
Thomas Wolf@Thom_WolfAI 评分5555小米团队称 MiMo-V2.6 目前正处于 RL 训练中途,探索 RL 的规模上限。其扩展了三个方向:算力(每步约 2B tokens,1568 prompts × 16 rollouts。
HuggingFace Daily Papers(社区热门论文)AI 评分7272 Edge0 用预路由预测让 35B MoE 模型在 24GB 单卡从 SSD 流式推理
论文提出 Edge0,一种流式 MoE 推理引擎,通过每层提前一个 token 预测下一层路由的 prerouter,使专家预取与实际路由一致,解决 SSD 卸载无法提前读取的延迟问题。
公众号:面壁智能(MiniCPM)AI 评分6565 外部团队基于 MiniCPM-o 4.5 开源全模态交互智能体 Gander,让 Agent 边干活边对话
浙江大学等高校的外部研究者以 MiniCPM-o 4.5 为基座后训练,开源了端到端全模态交互智能体 Gander,论文、数据、代码和模型全部开放。
Rohan Paul@rohanpaul_aiAI 评分6464Mozilla 发布 91 页报告称开放权重 AI 目前仅落后前沿约 4 个月。OpenRouter 上 8 月 token 量前十的模型有 8 个是开放权重。
Rohan Paul@rohanpaul_aiAI 评分6161HuggingFace Daily Papers(社区热门论文)AI 评分5555 Agora 论文提出以 Git 作为共享记忆的集体 AutoResearch 系统
论文提出 Agora,用 Git 存储的只追加有向无环图作为智能体共享记忆,每条结果、洞察或验证都是可检出复现的 commit。
Rohan Paul@rohanpaul_aiAI 评分6262Hacker News 热门(buzzing.cc 中文翻译)AI 评分6464 NVIDIA 推出 CUDA Rust,支持用 Rust 原生编写 GPU kernel
NVIDIA 宣布押注 Rust 原生 GPU 编程,将 CUDA Rust 发展至 2027 年及以后,提供 cuda-oxide(SIMT,需 pinned nightly)和 cutile-rs(Tile,stable Rust 1.89+、CUDA 13.3)两条路线,GPU kernel 可直接编译到 PTX 而非包装其他语言。
Rohan Paul@rohanpaul_aiAI 评分6767MarkTechPost(RSS)AI 评分6363 Knowledgator 发布 GLiFormer:575M 参数编码器不生成 token 实现 91.10 F1 嵌套 JSON 提取
Knowledgator Engineering 发布 schema 条件化编码器框架 GLiFormer,单个模型可在推理时按标签和 schema 完成 NER、分类、关系抽取、嵌套 JSON 结构化和文本嵌入。
Rohan Paul@rohanpaul_aiAI 评分5656
elvis@omarsar0AI 评分5252Artificial Analysis 完整文章(网页)AI 评分5858 Artificial Analysis 评测蚂蚁集团金融模型 Ling-3.0-flash-Fin
蚂蚁集团发布基于 Ling-3.0-flash 的金融开源权重模型 Ling-3.0-flash-Fin,在 Artificial Analysis Intelligence Index 得 23 分,Finance & Accounting Index 得 24 分。
IT之家(RSS)AI 评分6565 Mozilla 第二版《开源 AI 现状》报告:中美最佳模型能力差距缩至 4.4 个月
Mozilla 9 月 15 日发布第二版《开源 AI 现状》报告,称中国最佳开放权重模型与美国前沿闭源模型的能力差距已缩至 4.4 个月。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分6161 蚂蚁 inclusionAI 开源全双工音视频交互模型 Realtime-Venus
蚂蚁集团 inclusionAI 在 Hugging Face 发布 Realtime-Venus,包含 Realtime-Venus-Omni 和 Realtime-Venus-Audio 两个 9B 检查点,基于 MiniCPM-o 4.5 / Omni-Flow 架构,语言骨干为 Qwen3-8B。
MarkTechPost(RSS)AI 评分6666 Prior Labs 发布 TabPFN-3.5:默认设置即超越 Otto Kaggle 冠军方案
Prior Labs 发布表格基础模型 TabPFN-3.5,参数量增至 220M,在 TabArena 等 7 个基准上排名第一。它在 2015 年 Otto Kaggle 竞赛上用原始数据和默认设置取得 0.375 的 private leaderboard log loss,优于冠军方案的 0.382,推理约 1 分钟。
IT之家(RSS)AI 评分5858 中国移动开源机器人通用工程底座 Open-RAIL,连接 VLA / WAM 模型与机器人本体
中国移动宣布面向全球开源 Open-RAIL,一个连接 VLA / WAM 模型与机器人本体的通用工程底座,让模型推理、真机执行、数据回流、模型迭代在同一底座内闭环运转。
karminski-牙医@karminski3AI 评分6565Hacker News:AI 热帖AI 评分7474 两人用 LLM 一个月写出 M4 Mac Mini 的 OpenGL ES 3.0 合规 GPU 驱动
作者与 Niklas 用 Codex 和 Claude 在约一个月内为 M4 Mac Mini 与 MacBook Neo 构建了完全符合 OpenGL ES 3.0 的 Linux GPU 驱动,Minecraft 可跑 200fps。
ViggleAI@ViggleAIAI 评分5151
Ars Technica:AI(RSS)AI 评分7272 Mozilla 报告称中国开源模型与硅谷前沿模型差距缩至 4.4 个月
Mozilla 9 月 15 日发布的 State of Open Source AI 报告称,美国闭源前沿模型与中国最佳开源权重模型的性能差距已缩至 4.4 个月,Kimi K3 在 Artificial Analysis Intelligence Index 上仅落后 Anthropic Fable 5 三分,成本只有其 30%。
Hacker News:AI 热帖AI 评分6565 F-Droid 有多少应用是 LLM 生成的?作者审查 102 个应用得出 72.5% 多为 AI 编写
一位 FOSS 爱好者人工审查 F-Droid 2026 年 9 月 12 日推送更新的 102 个应用,依据提交记录、Agent 基础设施和 README 风格做三档分类,结果 74 个(72.5%)大多为 AI 编写,10 个难以归类,18 个(17.6%)几无 AI 痕迹。
IT之家(RSS)AI 评分5454 开源项目 CUDA-for-AMD-Windows 让 AMD RX 9060 XT 跑通部分 CUDA 库
开发者 Speedstu 发布 CUDA-for-AMD-Windows 开源项目,通过 PowerShell 脚本结合 ZLUDA 翻译层与 AMD HIP/ROCm,在 Windows 上让 AMD Radeon RX 9060 XT 运行部分 CUDA 依赖软件。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分6262 Hacker News 热帖逐点批驳 Dario Amodei 的《We Must Pace the Frontier》
Dario Amodei 发表博文《We Must Pace the Frontier》,主张监管开源权重模型、打击蒸馏并寻求反垄断豁免。作者逐点反驳,指出 OpenAI 智能体近期三次入侵公共基础设施、近十周未察觉 HuggingFace 攻击,认为所谓 AGI 僵尸网络威胁在技术上站不住脚,并将限制开源模型类比为 90 年代美国对强加密的管制。