Latent Space 对话 MIT 的 Alex Zhang:从 GPU Kernel 到递归语言模型 RLM
MIT 研究者 Alex Zhang 在 Latent Space 播客中详解递归语言模型(RLM),其基于 RLM 的 harness 是首个接近解决 ARC-AGI-3 的系统,早于 OpenAI 的 Astra。
MIT 研究者 Alex Zhang 在 Latent Space 播客中详解递归语言模型(RLM),其基于 RLM 的 harness 是首个接近解决 ARC-AGI-3 的系统,早于 OpenAI 的 Astra。
OpenRouter 联合创始人兼 CEO Alex Atallah 与 AMP 的 Anjney Midha 在 Latent Space 播客中回顾公司从 Llama、Alpaca、Mistral 兴起时期到服务超 1000 万开发者、每日处理超 10 万亿 token 的发展历程。
GitHub 与 Yale Program on Climate Change Communication 对 1039 名 GitHub 美国用户调查显示,80% 有兴趣使用帮助编写更节能代码的工具,74% 想测量软件或开发流程的环境影响,71% 担心 AI 的环境影响。
阿里巴巴 CEO 吴泳铭在杭州云栖大会 2026 上分享机器智能时代战略路线图,称机器思考目前不足人类思考总量的 3%,规模化到人类能力的 1,000 倍仍有巨大空间。
Nathan Lambert 发布其向美国国会汇报的开源模型现状综述,指出中国开源权重模型已在下载量、基准成绩和学术采用上领先,自 2025 年 7 月起在 Hugging Face 下载量上领先约 1.6B(总 3.2B,为美国两倍)。
推荐理由:作者基于自己持续追踪的下载量、基准和 arXiv 数据,给出开源权重模型中美竞争格局的全景与政策视角。
曾运营npm五年的seldo发布长文,主张npm、PyPI、Docker Hub等软件包注册表对达到规模的企业按Docker模式收取供应订阅费,并将固定比例版税按依赖树权重自动分账给其代码进入付费客户依赖树的维护者。
有人用 Fable-5.1 破解了热敏标签打印机固件,绕过其通过 RFID 检测第三方耗材后降速降质的限制,项目开源在 http://github.com/ThreeDaPrint/niimbot。
Rohan Paul 转引 @rauchg 数据称 Vercel AI Gateway 上开源模型 token 占比或创纪录地达 78.4%,闭源为 21.6%。
Latent Space 的 AINews 汇总了 Jev 发布两天内出现的 6 个复现版本,包括基于 ModernBERT 的 Laya、基于扩散模型的 DiffusionGemmaJev。
GrapheneOS 称 Android 17 QPR1 是自 Honeycomb(3.x)以来首个未向 AOSP 发布就新增应用开发者 API 的版本,新 API 目前仅 Pixel OS 独占。
Mozilla 9 月 15 日发布第二版《开源 AI 现状》报告,称中国最佳开放权重模型与美国前沿闭源模型的能力差距已缩至 4.4 个月。
Mozilla 9 月 15 日发布的 State of Open Source AI 报告称,美国闭源前沿模型与中国最佳开源权重模型的性能差距已缩至 4.4 个月,Kimi K3 在 Artificial Analysis Intelligence Index 上仅落后 Anthropic Fable 5 三分,成本只有其 30%。
一位 FOSS 爱好者人工审查 F-Droid 2026 年 9 月 12 日推送更新的 102 个应用,依据提交记录、Agent 基础设施和 README 风格做三档分类,结果 74 个(72.5%)大多为 AI 编写,10 个难以归类,18 个(17.6%)几无 AI 痕迹。
Dario Amodei 发表博文《We Must Pace the Frontier》,主张监管开源权重模型、打击蒸馏并寻求反垄断豁免。作者逐点反驳,指出 OpenAI 智能体近期三次入侵公共基础设施、近十周未察觉 HuggingFace 攻击,认为所谓 AGI 僵尸网络威胁在技术上站不住脚,并将限制开源模型类比为 90 年代美国对强加密的管制。
作者回应 Dario Amodei 关于放缓前沿 AI 的文章,认为 P(doom) 相关的灭绝性风险被高估,真正的问题是对普通人和社会的伤害。作者指出目前造成实际问题的都是闭源美国模型,开放权重模型的扩散能拉平竞争并起到天然减速作用;现行监管在欧美都接近失效,API 限制主要针对防止中国蒸馏,而各方仍在公共开源资源上承压。
一位博主公开致信 Dario Amodei,回应其《We Must Pace the Frontier》及 Anthropic 承诺嵌入式第三方评估、Sam Altman 数小时内表态同意一事,主张改为立法要求所有面向公众的 AI 模型以开放配重发布。
Y Combinator CEO Garry Tan 接受 CNBC 和 TechCrunch 采访时表示,监管机构不应干预中国实验室对前沿模型的知识蒸馏,美国小型开源权重实验室反而应该以合法方式做同样的事。
Nathan Lambert 发布一份开放模型领域精选阅读清单,涵盖基础概念、中美竞争与技术细节三部分。
推荐理由:曾在 HuggingFace 工作的作者分析了这起收购的软实力逻辑,指出其每年值约 100 亿美元的原因。
本期开源模型汇总指出,2026 年开源模型竞争加剧带来许可证分化:Google 和 Meta 转向 Apache 2.0,而智谱 GLM-5.3 从 MIT 改为自定义许可证,要求年收入超 100 亿美元的推理或微调服务商通过 Z.AI 安全审查,且未定义关联方带来不确定性。
vLLM 团队发布针对智能体负载优化的博客,基于 SemiAnalysis 的公开 AgentX 基准展示成果:DeepSeek V4 Pro 在 GB300 上达到 83K total tokens/GPU-秒。
推荐理由:vLLM 团队结合 AgentX 实测数据讲解智能体负载的全栈优化方法与失败教训,读者可以借此理解并行策略如何跟随模型架构调整。
美国企业正加速采用开源 AI 模型。AT&T 今年改用开源模型,占比已从 5 月的 20% 升至 40%,未来或达 60%,相比今年早些时候节省最高 80% 的 AI 成本;Airbnb 和 Deloitte 也在采用。
SemiAnalysis 发推称赞 @vllm_project 团队近期实现的智能体(agentic)工作负载优化,称其为技术实力出色的团队,并注明这是一条五部分推文串的第一条。
TechCrunch 报道,初创公司 Abliteration.ai 将去除安全护栏的开源权重模型(包括 Z.ai 的 GLM-5.3)托管为商业服务,用户可通过网页或 API 免费查询。
Tom Tunguz 分析 Meta 发布 Muse Spark 模型及双轨 API 定价:Standard Tier(muse-spark-1.3)输入 $1.25/m。
推荐理由:作者用价差算出数据补贴的具体规模,把 Meta 双轨定价解读为 AI 数据供应链的垂直整合,提供了一种可迁移的分析视角。
智谱 Z.ai 官方账号发布简短动态,原文仅为 We're still up,表示服务仍在正常运行。正文没有提供更多技术细节或说明。