跳到正文

全部动态

今日 13 条
9月9日周三
  1. 公众号:昆仑万维(天工)31

    SkyProduction 限免活动第二期:MiniMax H3 会员限时免费无限用

    SkyProduction(天工工作台)9月9日至14日推出第二期限免活动,会员可免费无限使用自部署的 MiniMax H3 768P 模型。该通用多模态生成模型支持文生视频及参考图片、视频、音频联合生成,并输出原生立体声。平台同期提供剧本翻译、出海转绘、3D导演台及直出10分钟视频等短剧制作工具。

  2. Gary Marcus:The Road to AI We Can Trust(RSS)59

    Gary Marcus 转述 Terence Tao 与前 Anthropic 员工 Jacob Coxon 的两条 AI 警告

    Gary Marcus 归纳两条警告:Terence Tao 连发三帖,担忧 AI 缺乏智识品味、解题不等于新洞见,并以 OpenAI 在 Navier-Stokes 争议中花费 2250 万美元抢先 Alpöge 和 Buckmaster 为背景,呼吁透明度;刚从 Anthropic 离职的 Jacob Coxon 则发文警告前沿实验室的未来风险。

  3. 公众号:千问APP(阿里)34

    千问推出学生与教师专属会员优惠:每月9.9元连享6个月

    千问面向大学生和教师推出专属会员优惠,每月9.9元可连续订阅6个月。用户在千问APP 7.0.7及以上或千问PC端 4.2.2及以上发送“我要领取教育优惠”并完成身份认证即可参与。该优惠主要面向工作助理等高频复杂任务场景,开通后可在免费权益基础上获得更多使用额度。

  4. Epoch AI:研究、数据与评测44

    PostTrainBench v1.1 基准评测:LLM 自主后训练能力

    PostTrainBench v1.1 用于衡量 LLM 自主完成后训练的能力,每个智能体拿到 4 个基座模型,需在 7 个目标基准上最大化得分。评测用 LLM 裁判标记污染、外部 API 或蒸馏、查询榜单历史等违规行为,被标记的运行按基座模型成绩计分。

  5. Together AI 研究与产品博客(RSS)68

    Together AI 深度解析开源模型 AI 编码栈 MIGHT

    Together AI 发布深度解析文章,介绍开发者从闭源模型转向开源模型所需的 AI 编码栈,提出由 Model、Inference、Gateways、Harness、Tools 组成的 MIGHT 框架。

    推荐理由:原文给出开放权重模型编码栈的分层框架,读者可据此按任务选模型、按价格选供应商并保持工作流稳定。

  6. OpenRouter:Announcements(RSS)71

    OpenRouter 评测 Seedance 2.5:长镜头与已有素材编辑的场景及成本解析

    OpenRouter 发布对 ByteDance Seedance 2.5 视频模型的评测,该模型自 2026 年 8 月 7 日上线其视频 API,生成 4 到 30 秒、480p 或 720p 的片段,支持图像、视频、音频引用和首尾帧控制,音频同趟生成不加价。

    推荐理由:原文基于自家端点数据给出 Seedance 2.5 的计费公式、能力边界和与 Seedance 2.0、Wan 3.0、Veo 3.1 的逐项对比,便于按需求选型。

  7. OpenRouter:Announcements(RSS)64

    OpenRouter 教程:用代码调用 Nano Banana 2 编辑图像

    OpenRouter 发布教程,演示通过 API 向 google/gemini-3.1-flash-image(即 Nano Banana 2)发送源图和文本指令完成图像编辑,编辑结果以 base64 形式在响应中返回。教程给出 Python 和 TypeScript 示例、提示词写法、多轮小步编辑方法,以及更换模型只需改一个字段,并介绍了 Nano Banana 系列四个成员的价格与质量差异。

    推荐理由:原文给出完整可运行的图像编辑请求代码和提示词写法,读者可以照搬并把模型换成其他供应商做对比。

  8. Claude Code:GitHub Releases(RSS)29

    Claude Code v2.1.266 发布:修复 2.1.265 网关回归问题

    Claude Code v2.1.266 修复了 2.1.265 引入的回归问题,该问题导致单独设置 CLAUDE_CODE_USE_GATEWAY 环境变量时强制要求 Cloud 网关登录,使搭配 API key 或自定义认证头的配置全部请求失败。此版本恢复该变量单独设置时被忽略的行为,无需更改配置。

  9. Sierra:Blog(RSS)38

    Sierra 开源 hyper-𝜏-bench:评估能构建智能体的智能体

    Sierra 今日开源 hyper-𝜏-bench,这是一个新的长时程智能体评测基准,用于衡量模型不仅能作为智能体行动、还能构建智能体的能力。该基准聚焦于“构建智能体的智能体”这一任务场景,为长时程自主智能体开发提供评测标准。

  10. Baseten 工程博客(网页)37

    Baseten 如何优化托管 rollout 的 delta 权重同步

    Baseten 为托管 rollout 设计了跨集群的 delta 权重同步方案:训练端只需向 Amazon S3 发布一次 checkpoint 或 delta,由 Baseten Delivery Network 分发到各独立 rollout 集群,集群无需与训练端直连。

  11. Baseten 工程博客(网页)36

    Baseten 登顶 Coval 语音 AI 基准测试

    Coval 2026 年 9 月早期访问基准显示,Baseten 位居语音 AI 排行榜首位并处于质量-延迟帕累托前沿,其 STT 部署速度约为 OpenAI 的 5 倍,同时 WER 最优。Baseten 以 Qwen3 ASR 1.7B Streaming 定义 STT 帕累托前沿,当前基准中无其他供应商在更快的同时实现更低 WER。

  12. Runway:News(网页)63

    Runway 推出 Adobe 插件,Premiere Pro 和 After Effects 内可直接生成和编辑

    Runway 发布 Runway Plugins,面板可直接嵌入 Premiere Pro 和 After Effects,无需导出导入即可在时间线内生成图像和视频、重渲染片段并一键放置结果。

    推荐理由:原文给出了插件的功能范围、付费条件与下载方式,剪辑工作流用户可据此评估是否把生成环节搬进时间线。

  13. Databricks:Blog(RSS)28

    LTAP 如何打破 40 年数据库规则,统一 OLTP 与 OLAP 工作负载

    Databricks 提出 LTAP 架构,打破数据库领域延续 40 年的 OLTP 与 OLAP 分离规则,将两类工作负载统一到单一系统。该方案由 Jonathan Katz 主导,旨在消除传统上事务处理与分析处理之间的数据复制和架构割裂,让同一份数据既能支撑实时事务又能进行复杂分析。LTAP 的核心价值在于简化数据栈,降低运维复杂度和端到端延迟。

  14. Claude Code:GitHub Releases(RSS)43

    Claude Code v2.1.265 发布:新增插件目录支持与多项修复

    Claude Code v2.1.265 发布,新增将 --plugin-dir 指向插件文件夹的支持,并限制工具结果落盘上限为 1 GB。该版本修复了恢复前台子代理时破坏提示缓存复用、插件路径反斜杠绕过符号链接检查、VS Code 与 SDK 会话偶发需重新登录等问题,同时改进了大仓库 --worktree 启动的并行检出性能。

  15. OpenAI:官网动态(RSS · 排除企业/客户案例)49

    GPT-5.6 Sol 如何助力量子计算实验

    MIT 研究生 Beatriz Yankelevich 将 GPT-5.6 Sol 接入实验室软件,用于运行和优化量子芯片的常规测量,从而将精力转向实验设计与数据分析。在信号清晰时,该模型可自主完成标准测量序列,包括识别跃迁频率、校准脉冲及测定量子信息保留时间;但在信号弱或噪声大时仍需研究人员指导。EQuS 团队现已定期使用智能体处理常规测量任务。