Artcraft 用 Claude Opus 5.5 生成七款 Adobe 软件开源替代品
Artcraft 从可控 AI 图像视频编辑工具转向开源应用套件,用 Claude Opus 5.5 以 Rust 复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具,并提供可在浏览器运行的 WebAssembly 版本。
Artcraft 从可控 AI 图像视频编辑工具转向开源应用套件,用 Claude Opus 5.5 以 Rust 复刻 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具,并提供可在浏览器运行的 WebAssembly 版本。
Nous Research 完成 9000 万美元 B 轮融资,估值 15 亿美元,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 等参投,公司累计融资达 1.58 亿美元。
Kubernetes 创始人 Craig McLuckie 和 Joe Beda 创办的 Stacklok 推出云端 harness Mecatl,将智能体循环与客户端、模型提供方、状态存储和执行环境解耦,该项目于 6 月作为开源项目上线 GitHub。
Mistral 表示其新模型 Le Chonk 能够与顶级闭源模型竞争,同时保持开放权重。
OpenAI 发布内部前沿模型在数学开放问题上的新结果,并公开 Lean 证明形式化及研究细节。相关材料已发布在 GitHub 上。
推荐理由:OpenAI 公开内部前沿模型在数学开放问题上的结果,并同步放出 Lean 证明形式化与细节,可供研究者直接复核。
Simon Willison 发布 llm-mistral 0.16,这是 llm 命令行工具接入 Mistral 模型的插件更新。原文未披露该版本的具体功能、参数或可用性细节。
Musubi 发布轻量决策模型 PolicyLM-1.7B,开放权重,可将纯英文写成的内容政策在 50 毫秒内应用到消息上。该模型成本与速度接近主流社交平台的 AI 分类器,但具备现代 LLM 的灵活性,无需专门训练即可执行复杂政策,政策变更时也不必重新训练。联合创始人 Filip Jankovic 称其让平台管理者能主动为内容打标,并提到这一兴趣可追溯到 2024 年的 GLiNER 项目。
Simon Willison 表示欣赏 EmbeddingGemma 2 采用 Apache 2.0 许可。他认为嵌入模型不适合用闭源、仅托管的形式:嵌入模型通常要计算并存储成千上万甚至数百万个向量,一旦厂商停供该模型,用户就得为重新计算这些已存向量付费。他本人不愿自托管,更愿意付费使用托管版本,同时知道厂商停托管后可以自行运行开放权重版本,或另找能运行的供应商。
Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间,采用 Apache 2.0 许可,参数量 7.4 亿。
推荐理由:EmbeddingGemma 2 把文本、图像、音频、视频统一到同一嵌入空间,并给出端侧内存与向量截断的具体数据,便于判断本地检索与 RAG 的可行性。
Simon Willison 发布 TIL,演示如何用 Parseable 接收并查询 Datasette 产生的 OpenTelemetry traces。Parseable 是兼容 OpenTelemetry 的新型可观测性工具,提供 AGPL 协议的 Rust 开源实现(单个约 180MB 二进制)、企业版和云托管选项。
法国 AI 实验室 Mistral 于周二发布 Mistral Large 4(ML4),这是一个 1 万亿参数的大规模多模态模型,绰号 Le Chonk,目前仅通过公开的 guardrail 端点访问,计划在三周内完成安全测试后开放权重。
LibreOffice 背后的非营利组织 The Document Foundation 本周发文称,在可预见的未来「不会」为其开源文档编辑器加入 AI 功能,并强调软件「不包含生成式 AI 功能」是刻意的设计立场。该组织表示,目前没有任何 AI 集成能同时满足数据留在用户设备上、不依赖单一 AI 供应商等要求,因此默认安装中不会有任何 AI,用户仍可通过安装扩展连接本地 AI 模型。
Mistral 发布迄今最大模型 Mistral Large 4,拥有 1 万亿参数、490 亿激活参数,已在 Mistral Studio 开放 API 预览,权重预计 10 月底发布。
NVIDIA 最新《State of AI in Telecommunications》报告显示,89% 受访者认为开源模型与软件对公司 AI 战略重要。
AI 公司 Reflection 发布首款免费开放模型 Beam,采用 MoE 架构,每 token 激活 5010 亿总参数中的 230 亿,面向编码、逻辑推理和智能体任务。
推荐理由:Reflection 首款开源权重模型 Beam 以 MoE 架构和超大规模 RL 训练,在推理与编码基准上以更少算力对标 GLM 5.2 和 Qwen 3.8。
Reflection 发布 Beam,一个面向编码、智能体与科研任务的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,Apache 2.0 全量权重将于本月放出。
Z.ai(智谱 AI)的 GLM 5.3 已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码和长周期智能体任务。Bedrock 提供全托管 API、跨区域推理、提示词缓存和服务层级,支持 OpenAI 兼容的 Responses 与 Chat Completions API 以及 Invoke 和 Converse API。
推荐理由:GLM 5.3 在 Bedrock 上线,读者可了解其 753B MoE 规格、编码与安全能力及托管接入方式。
Reflection AI 发布首款前沿开源权重模型 Beam,称其在高级推理基准上追平 Z.ai 的 GLM-5.2,并比当前领先的西方开源模型表现更好,推理算力用量少 3-4 倍。
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举行,多场议程聚焦创始人在开源与闭源 AI 之间的选择。讨论覆盖多模型应用、模型定制、基础设施与芯片,Together AI、Pathway、Oumi、Nvidia 等公司高管将参与,议题包括何时开源模型能超越专有方案,以及企业该自建、定制还是租用模型。
AWS 发布 Quick Resource Migrator 示例 MCP 服务器,托管于 Amazon Bedrock AgentCore,可在单次工具调用中把 Amazon Quick 的 chat agents、action connectors、知识库、flows 和 spaces 从开发账户迁移到生产账户。
Meta 宣布开源项目 Muse Gadgets,提供 ESP32 开发板固件和 Linux SDK,让爱好者把自制设备接入其 AI 智能体 Muse,代码采用 Apache 2.0 许可。
哈佛物理学家 Matthew Schwartz 在 Anthropic 客座博文中介绍开源工具 BootLoops,它让 Claude 完成精确科学计算,三个月内团队在 18 个领域产出 36 篇手稿、19 位合著者。
Meta 推出开源项目 Muse Gadgets,提供开源固件和 Linux SDK,让开发者用 Raspberry Pi 或 ESP32 等低成本硬件搭建接入个人 AI 智能体 Muse 的设备,并给出彩色电子墨水屏、HDMI 电视棒等项目示例。
Meta 开源了让用户自制 Muse AI 硬件的代码,Muse 搭载其新 AI 智能体。用户可用 ESP32 开发板或 Raspberry Pi 配合 SDK,将 Muse 接入显示屏、按钮和传感器等设备,Meta 提示需自行承担风险。Meta 还免费发放自制的 Muse Home Link 硬件,可用社区技能控制灯光、电视和打印机等,共制造 5000 台,现已开放候补名单,本月内发货。
Cloudflare 发布面向 AI 智能体的决策模型 Clef 和 Clef-flash,返回带概率的简短分类而非长文本,并称智能体决策不再必须有人参与。
NVIDIA 宣布本月推出 64GB 统一内存版 DGX Spark,由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等厂商伙伴独家发售,10 月 23 日上市,起售价 4999 美元。
推荐理由:NVIDIA 官方给出 64GB 版 DGX Spark 的定价、上市时间与双机集群实测数据,可据此判断本地跑大模型的成本与扩展方式。
AI 初创公司 Photon 完成 450 万美元种子轮融资,由 Gradient 和 A* 联合领投,Vercel、红杉中国等参投。Photon 帮助开发者在 iMessage、WhatsApp 等消息应用上构建智能体,目前已吸引超 4 万名开发者注册,四个月内收入增长 10 倍,消息量上月增长 5 倍。
AWS 发布开源决策模型 Strands Decider 2B,基于 Qwen3.5-2B 构建,可在本地运行,用于在预设选项中做选择并给出置信度评分。该模型由 AWS 杰出工程师 Marc Brooker 在看过 TypeSafe 的 Jev 后自行开发,曾在同规模模型的 Jevbench 排名上短暂登顶,随后由 Strands Labs 整理发布。
MIT 研究者 Alex Zhang 在 Latent Space 播客中详解递归语言模型(RLM),其基于 RLM 的 harness 是首个接近解决 ARC-AGI-3 的系统,早于 OpenAI 的 Astra。
NVIDIA NeMo Agent Toolkit(NAT)可通过自定义 memory provider 接入 Amazon S3 Vectors,作为多智能体系统的持久化记忆层,并部署在 Amazon EKS 上。
推荐理由:Hugging Face CEO 亲自说明被 NVIDIA 收购后的用人与开源长期投入思路,对理解其后续开源路线有直接参考。
NVIDIA 发布开源表格基础模型 Kumo Tabular,对带标签表格做单次前向推理即可完成分类和回归,无需训练、调参或特征工程。
推荐理由:官方技术博客披露了架构、纯人工数据预训练配方和四项基准成绩,读者可据此评估其替换梯度提升树的可行性。
GitHub 公布 H1 2026 透明度数据,政府下架请求从 2025 全年的 98 起增至 2026 上半年的 708 起,这一增长主要源于报告口径调整,而非内容删除量上升。GitHub 还回顾了 2026 年美国州级立法会期,重点跟进 AI 内容溯源与年龄验证议题,其中加州 AI 透明度法案 SB 1000 已采纳更窄的通知—回应机制,以兼容不可撤销的开源许可证。
godot-cpp 10 已进入 ConanCenter,可把任意 C/C++ 库以 GDExtension 形式接入官方 Godot 构建,无需重新编译引擎。
蚂蚁百灵 Ling-3.0-flash-Fin 在 FrontierFinance System Performance 与 Vals AI Finance Agent v2 两项金融智能体评测中取得领先。
H Company 发布 Holo4 系列通用计算机使用模型,包含 Holo4 27B(dense)和 Holo4 35B-A3B(MoE,3B 激活)两个规格,支持 256K 上下文,可在桌面、网页、Android、代码沙箱和业务 API 上以同一方式调用。
2026 年世界互联网大会乌镇峰会将于 11 月 2 日至 5 日在浙江乌镇举行,主题为“开源开放共建共享 —— 携手构建网络空间命运共同体”。本届峰会设置 27 个分论坛,主论坛设“人工智能乌镇对话”环节,邀请全球领军科技企业、知名开源大模型企业负责人及人工智能科学家围绕全球人工智能开源生态构建展开交流。“互联网之光”博览会已邀请 400 余家企业参展。
Jeff 发布基于 Qwen3.5 与 Gemma 4 微调的零样本分类模型 Jeff-Qwen3.5-0.8B、Jeff-Qwen3.5-2B 和 Jeff-Gemma4-E2B,与 Jev 使用相同请求格式,单次前向输出各选项校准概率。