SkyProduction 限免活动第二期:MiniMax H3 会员限时免费无限用
SkyProduction(天工工作台)9月9日至14日推出第二期限免活动,会员可免费无限使用自部署的 MiniMax H3 768P 模型。该通用多模态生成模型支持文生视频及参考图片、视频、音频联合生成,并输出原生立体声。平台同期提供剧本翻译、出海转绘、3D导演台及直出10分钟视频等短剧制作工具。
SkyProduction(天工工作台)9月9日至14日推出第二期限免活动,会员可免费无限使用自部署的 MiniMax H3 768P 模型。该通用多模态生成模型支持文生视频及参考图片、视频、音频联合生成,并输出原生立体声。平台同期提供剧本翻译、出海转绘、3D导演台及直出10分钟视频等短剧制作工具。
Zepto 在 Databricks 和 MLflow 上构建评估优先的 AI 智能体,以支撑其快速增长的实时客户支持。该方法将评估作为开发核心环节,通过持续测试与迭代提升智能体可靠性。文章详述了其工程实践与落地路径,为同类大规模客服场景提供参考。
Gary Marcus 归纳两条警告:Terence Tao 连发三帖,担忧 AI 缺乏智识品味、解题不等于新洞见,并以 OpenAI 在 Navier-Stokes 争议中花费 2250 万美元抢先 Alpöge 和 Buckmaster 为背景,呼吁透明度;刚从 Anthropic 离职的 Jacob Coxon 则发文警告前沿实验室的未来风险。
千问联合牛津、清华、上海交大学姐及AI开发者发布《大学生AI全场景使用指南》,聚焦大学高频13类任务,预计四年可省3000+小时、节约约1万元支出。指南覆盖生活费规划、课程资料管理、期末复习、简历规划等场景,主创团队将于今晚直播演示具体用法。
千问面向大学生和教师推出专属会员优惠,每月9.9元可连续订阅6个月。用户在千问APP 7.0.7及以上或千问PC端 4.2.2及以上发送“我要领取教育优惠”并完成身份认证即可参与。该优惠主要面向工作助理等高频复杂任务场景,开通后可在免费权益基础上获得更多使用额度。
GPT Image 2.5 已在 OpenRouter 上线,提供来自 @OpenAI 的两个模型。 它带来更锐利的细节、更忠实的参考照片,以及比 GPT Image 2 最高降低 50% 的延迟。
蚂蚁百灵发布并开源首个原生多模态大模型 Ling-3.0-flash-VL,基于 Ling-3.0-flash 的 MoE 架构,总参数 124B,单次推理激活 5.5B,原生支持图像、文本与视频输入,上下文窗口 256K Token。
PostTrainBench v1.1 用于衡量 LLM 自主完成后训练的能力,每个智能体拿到 4 个基座模型,需在 7 个目标基准上最大化得分。评测用 LLM 裁判标记污染、外部 API 或蒸馏、查询榜单历史等违规行为,被标记的运行按基座模型成绩计分。
LG AI Research 发布面向结构化表格数据的分类与回归基础模型 EXAONE Tabular,完全基于 SCM 合成数据预训练,未使用任何真实表格数据,通过上下文学习免重训直接预测。
Epoch AI 推出 AI Chip Users explorer,以 Nvidia H100 等效值(H100e)估算 OpenAI、Google DeepMind、Anthropic、Meta Superintelligence Labs 和 SpaceXAI 用于研究、训练和推理的算力。
Factory 现已登陆 Claude Marketplace,企业客户可将 Anthropic 的采购承诺额度用于 Factory,工程团队无需再走单独的采购流程即可使用其自主软件开发能力。
Together AI 发布深度解析文章,介绍开发者从闭源模型转向开源模型所需的 AI 编码栈,提出由 Model、Inference、Gateways、Harness、Tools 组成的 MIGHT 框架。
推荐理由:原文给出开放权重模型编码栈的分层框架,读者可据此按任务选模型、按价格选供应商并保持工作流稳定。
OpenRouter 发布对 ByteDance Seedance 2.5 视频模型的评测,该模型自 2026 年 8 月 7 日上线其视频 API,生成 4 到 30 秒、480p 或 720p 的片段,支持图像、视频、音频引用和首尾帧控制,音频同趟生成不加价。
推荐理由:原文基于自家端点数据给出 Seedance 2.5 的计费公式、能力边界和与 Seedance 2.0、Wan 3.0、Veo 3.1 的逐项对比,便于按需求选型。
OpenRouter 发布教程,演示通过 API 向 google/gemini-3.1-flash-image(即 Nano Banana 2)发送源图和文本指令完成图像编辑,编辑结果以 base64 形式在响应中返回。教程给出 Python 和 TypeScript 示例、提示词写法、多轮小步编辑方法,以及更换模型只需改一个字段,并介绍了 Nano Banana 系列四个成员的价格与质量差异。
推荐理由:原文给出完整可运行的图像编辑请求代码和提示词写法,读者可以照搬并把模型换成其他供应商做对比。
Claude Code v2.1.266 修复了 2.1.265 引入的回归问题,该问题导致单独设置 CLAUDE_CODE_USE_GATEWAY 环境变量时强制要求 Cloud 网关登录,使搭配 API key 或自定义认证头的配置全部请求失败。此版本恢复该变量单独设置时被忽略的行为,无需更改配置。
Sierra 今日开源 hyper-𝜏-bench,这是一个新的长时程智能体评测基准,用于衡量模型不仅能作为智能体行动、还能构建智能体的能力。该基准聚焦于“构建智能体的智能体”这一任务场景,为长时程自主智能体开发提供评测标准。
Baseten 为托管 rollout 设计了跨集群的 delta 权重同步方案:训练端只需向 Amazon S3 发布一次 checkpoint 或 delta,由 Baseten Delivery Network 分发到各独立 rollout 集群,集群无需与训练端直连。
Coval 2026 年 9 月早期访问基准显示,Baseten 位居语音 AI 排行榜首位并处于质量-延迟帕累托前沿,其 STT 部署速度约为 OpenAI 的 5 倍,同时 WER 最优。Baseten 以 Qwen3 ASR 1.7B Streaming 定义 STT 帕累托前沿,当前基准中无其他供应商在更快的同时实现更低 WER。
Runway 发布 Runway Plugins,面板可直接嵌入 Premiere Pro 和 After Effects,无需导出导入即可在时间线内生成图像和视频、重渲染片段并一键放置结果。
推荐理由:原文给出了插件的功能范围、付费条件与下载方式,剪辑工作流用户可据此评估是否把生成环节搬进时间线。
推荐理由:原文给出了 Astra 的正式开放范围和覆盖产品,读者可以确认自己的订阅计划是否已可用。
Databricks 提出 LTAP 架构,打破数据库领域延续 40 年的 OLTP 与 OLAP 分离规则,将两类工作负载统一到单一系统。该方案由 Jonathan Katz 主导,旨在消除传统上事务处理与分析处理之间的数据复制和架构割裂,让同一份数据既能支撑实时事务又能进行复杂分析。LTAP 的核心价值在于简化数据栈,降低运维复杂度和端到端延迟。
Claude Code v2.1.265 发布,新增将 --plugin-dir 指向插件文件夹的支持,并限制工具结果落盘上限为 1 GB。该版本修复了恢复前台子代理时破坏提示缓存复用、插件路径反斜杠绕过符号链接检查、VS Code 与 SDK 会话偶发需重新登录等问题,同时改进了大仓库 --worktree 启动的并行检出性能。
Krea AI 宣布推出 GPT Images 2.5 图像生成模型。新版本带来更强的真实感、一致的编辑能力和更快的生成速度,用户可立即试用。
MIT 研究生 Beatriz Yankelevich 将 GPT-5.6 Sol 接入实验室软件,用于运行和优化量子芯片的常规测量,从而将精力转向实验设计与数据分析。在信号清晰时,该模型可自主完成标准测量序列,包括识别跃迁频率、校准脉冲及测定量子信息保留时间;但在信号弱或噪声大时仍需研究人员指导。EQuS 团队现已定期使用智能体处理常规测量任务。
Tom Tunguz 引用 OpenAI 内部数据,分析其 3x 研究生产力增益的来源:每名研究员 8 小时班次对应 3.14 个 agent 工作日,通常并行运行 4 个 agent。
推荐理由:文章用 OpenAI 自己披露的数据拆解 3x 生产力说法,指出其中一半工作仍需人工干预且推理成本激增 40 倍。
Cohere 发布首个围绕 decode megakernel 构建的完整 LLM 文本生成服务系统,性能最高比 vLLM 快 1.58x。该系统为 North Mini Code 打造,完全开源。