#开源生态
#开源生态
今日 2 条
OpenClaw🦞@openclawAI 评分5151Baseten 工程博客(网页)精选AI 评分6262 Baseten 解析后训练最佳开源模型并按成本分档推荐
Baseten 发文解析开源模型后训练的成本驱动因素,指出活跃参数量是 RL 后训练成本的最大来源,总参数和 KV cache 主要限制推理速度,并按成本档位推荐 DeepSeek-V4-Flash、GLM-5.2、Kimi K2.6、Kimi K2.7 Code、Nemotron-3-Super-120B 和 Qwen3 系列。选型建议关注库支持、基准表现和后训练循环成本三方面。
推荐理由:原文把后训练成本拆解为活跃参数、总参数和 KV cache 三个因素,并按成本档位比较了多款开源模型,方法可直接迁移到选型。
MarkTechPost(RSS)AI 评分6666 Perplexity 在 Mac 上推出 Hybrid Compute,云端智能体把敏感步骤下发给本地模型并由端侧隐私门控把关
Perplexity 在 Mac 上推出 Hybrid Compute,Computer 任务从云端前沿模型起步,遇到私有文件时把该步骤下发给本地模型再合并结果。
Meituan LongCat@Meituan_LongCat精选AI 评分6868推荐理由:官方宣布 LongCat-2.0 可在 Cline 免费试用,并给出安装命令和模型选择路径,读者可直接接入现有编码工作流。
HuggingFace Daily Papers(社区热门论文)AI 评分5959 Harness-of-Harness 论文提出多天自主软件开发框架,平均相对提升 52.25%
论文提出 Harness-of-Harness(HoH)框架,让基于 LLM 的编码智能体在无人工干预的自主开发中持续改进软件。HoH 运行在现有 coding-agent harness 之上,将执行组织为规划-编码-测试的迭代循环,平衡修复与能力增长,并把开发拆成小而可验证的增量。
Rohan Paul@rohanpaul_ai精选AI 评分8383推荐理由:原文给出交易价格、估值倍数和留任奖金等关键细节,读者可以快速了解这桩收购的规模与进展。
IT之家(RSS)AI 评分8282 英伟达接近以约 140 亿美元收购 Hugging Face,最快本周达成协议
彭博社报道称,英伟达正就收购 Hugging Face 展开深入谈判,最快可能于本周达成协议,以 129 亿美元收购外加 10 亿美元员工留任激励,总规模接近 140 亿美元。
OpenClaw🦞@openclawAI 评分2525
MiniMax (official)@MiniMax_AIAI 评分5353
MiniMax (official)@MiniMax_AIAI 评分3535
Hao AI Lab@haoailabAI 评分4040
Thomas Wolf@Thom_WolfAI 评分3939Thomas Wolf 转发 @RemiFabreRobot 的视频,用 Microduck 鸭子学走路的过程讲解强化学习(RL),配乐由 @antoinepirrone 制作。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分6565 slotstream 发布:在 48GB Mac 上通过 SSD 流式加载运行 104GB 的 Qwen3.8-Flash-Next
作者发布 slotstream,一个 Swift 单二进制工具,把 104GB(4-bit、125B 参数 MoE)的 Qwen3.8-Flash-Next 从 SSD 流式加载到内存不足以容纳的 Mac 上运行。
SemiAnalysis@SemiAnalysis_AI 评分4343
elvis@omarsar0AI 评分5858
DAIR.AI@dair_aiAI 评分5050
OpenRouter@OpenRouterAI 评分2828
Hao AI Lab@haoailabAI 评分5050
OpenClaw🦞@openclawAI 评分3030
凡人小北@frxiaobeiAI 评分6565
Hugging Face:Blog(RSS)精选AI 评分6262 Hugging Face 发布 @huggingface/kernels,提供 207 个 WebGPU 内核用于浏览器本地 AI 推理
Hugging Face WebAI 团队发布 @huggingface/kernels 库及 207 个以独立仓库形式托管在 Hub 上的 WebGPU 内核(Apache-2.0),每个内核带 manifest、正确性测试、基准用例和 WGSL 着色器模板。
推荐理由:原文给出与 ORT WebGPU 的对比数据和开源加载方式,读者可据此评估浏览器本地推理的可行路径。
OpenBMB@OpenBMBAI 评分4646蚂蚁 inclusionAI:HuggingFace 新模型AI 评分5252 蚂蚁 inclusionAI 发布 Ling-3.0-flash 原生混合推理模型
蚂蚁 inclusionAI 发布下一代原生混合推理模型 Ling-3.0-flash,总参数 124B、激活参数 5.1B,约为前代 1T 级旗舰 Ring-2.6-1T 的 12.4% 和 8.1%,在关键基准上持平或超越前代。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4545 蚂蚁 inclusionAI 发布 Ling-3.0-flash-singprobe 流式安全探针
蚂蚁 inclusionAI 在 Hugging Face 发布 Ling-3.0-flash-singprobe,一个基于 Ling-3.0-flash 的流式安全护栏探针,复用基座模型隐藏状态在每个 token 上输出意图、不安全性和幻觉风险共 10 类评分,探针参数仅 5.18M,解码开销低于 0.5%。
蚂蚁 inclusionAI:HuggingFace 新模型AI 评分4545 蚂蚁 inclusionAI 发布 Ling-3.0-tiny-singprobe 流式安全探针
蚂蚁 inclusionAI 在 Hugging Face 发布 SingProbe,一个基于 Ling-3.0-tiny 的流式安全探针,仅 3.22M 参数,复用基座模型隐藏状态在每个 token 上输出 8 类意图、不安全响应和幻觉风险评分,解码开销低于 0.5%。
Tencent Hy@TencentHunyuanAI 评分6767
X.PIN@thexpinAI 评分6262
X.PIN@thexpinAI 评分5757IT之家(RSS)AI 评分5757 腾讯混元 Hy4 preview 轻量版发布开源:1.5TB 压至 214GB,支持异构设备联合推理
腾讯混元团队 9 月 1 日发布并开源 Hy4 preview 轻量版,将模型权重从接近 1.5TB 压缩至约 214GB。
HuggingFace Daily Papers(社区热门论文)AI 评分4848 DreamX-Creator 1.0 发布:7B 模型实现 2K 分辨率原生音视频联合生成
DreamX-Creator 1.0 是一个以 7B 生成器为核心的原生音视频联合生成系统,基于首帧和文本提示对音频与视频流联合去噪,通过 Gated Cross-Modal Attention 在网络后半段耦合两个模态。
Qwen@Alibaba_QwenAI 评分3939HuggingFace Daily Papers(社区热门论文)AI 评分5353 CogEvol 论文提出高效可靠的学习环境生成模型并开源 CogEvol-4B
论文提出 CogEvol 系列模型,将课程简报一次性生成结构化 JSON 幻灯片或自包含交互式 HTML 页面,22 万生产请求中幻灯片中位耗时 17 秒、交互页 59 秒。
上海人工智能实验室 InternLM:原创项目精选AI 评分6363 上海AI实验室发布 InternLumina-U2:16B-A1B 多码本扩散统一多模态模型
上海AI实验室发布 InternLumina-U2,一个 16B 参数(激活 1B)的 MoE 扩散语言模型,用 8 码本全离散视觉表示统一覆盖文本问答、文生图、图像理解与编辑、视频及 3D 理解。
推荐理由:原文给出多码本全离散统一架构的设计细节、基准分数和双硬件适配说明,读者可以了解统一理解与生成模型的一条新路线。
IT之家(RSS)AI 评分6161 科大讯飞开源词元星火 X2.5-4B 和 1.7B 端侧模型,原生支持 100 万 Token 上下文
科大讯飞旗下词元星火发布并开源星火 X2.5-4B 和 X2.5-1.7B 两款端侧通用大模型,原生支持最长 100 万 Token 上下文窗口。
Ethan Mollick@emollickAI 评分5252公众号:数字生命卡兹克AI 评分3131 数字生命卡兹克联合11位年轻人成立AI组织AGORAY并启动公开招募
自媒体数字生命卡兹克宣布与11位年轻人成立AI爱好者组织AGORAY,名字取自AGORA(古希腊公共广场)和RAY(一束光)。首批成员以14至20岁的学生为主,包括黑客松获奖者、开源项目运营者和独立开发者,运营团队此前在北京、上海、广州、深圳、杭州、沈阳等城市逐一面试。组织计划一起测试新模型、参加比赛、做项目和办小型活动,并启动面向26岁以下人群的公开招募。
HuggingFace Daily Papers(社区热门论文)AI 评分4040 Sparse Readout Prism 用稀疏 readout 特征解释 Logit Lens 分数
论文提出 Sparse Readout Prism(SRP),仅用 unembedding 权重分解 readout,把任意 token logit 或 logit 差表示为稀疏 readout 特征贡献之和。
MarkTechPost(RSS)AI 评分5959 Keenable AI 开源 NEEDLE:每小时重建查询集的实时搜索基准
Keenable AI 开源实时搜索基准 NEEDLE,通过每小时(新闻)和每日(金融、学术、法律、长尾)从 RSS、Google Trends、SEC XBRL、arXiv、CourtListener 等公开来源重建查询集,避免模型记忆或下载答案作弊。
公众号:智谱(GLM)AI 评分2424 智谱发布2026年中报,称MaaS平台进入爆发期
智谱官方公众号发布2026年中报,主题为“智能上界,新局加载”,正文仅提及MaaS平台进入爆发期,未提供更多细节。
elvis@omarsar0AI 评分5555