跳到正文

#部署/工程

今日 12 条
9月19日周六
  1. OpenRouter:Announcements(RSS)63

    OpenRouter 实测 Jev 决策模型对比 LLM,何时该用决策模型替代生成文本

    OpenRouter 发布教程,实测 TypeSafe 的决策模型 Jev 1.13 与 GPT Luna、Claude Opus 在工单分诊和提示词注入筛查上的表现:Jev 每 1000 张工单成本 $0.0248、中位延迟 194ms,准确率与 LLM 相当。

    推荐理由:OpenRouter 用自家基准数据对比 Jev 与生成式 LLM 的成本和延迟,并给出路由与验证两套可直接复用的代码模式。

9月18日周五
  1. 公众号:智谱(GLM)62

    智谱上线 GLM-5.3-FlashX,推理速度最高 200 tokens/s

    智谱正式推出 GLM-5.3-FlashX,在 GLM-5.3-Flash 基础上加大对 Infra 侧投入与推理优化,速度最高 200 tokens/s,算力基于 10 万张国产芯片。该模型此前曾以 Ox Alpha 之名面向开发者,官方称其长期保持同尺寸最强智能水平并具备高性价比,API 已上线,Model Key:GLM-5.3-FlashX。

  2. IT之家(RSS)59

    华为发布 Peerium 计算架构,Atlas 950 超节点为首代产品

    华为 9 月 17 日在上海发布 AI 时代全新计算架构 Peerium,称基于嵌套并行、统一内存寻址和平等互联,可实现百万级处理器作为一台计算机协同工作。该架构提出 Nested BSP 计算范式,关键互联技术为基于开放协议的灵衢;首代产品为 Atlas 950 超节点,25.6 万卡 Atlas 950 集群已在部署中,基于 NPO 的 Atlas 960 系统正在测试中。

9月17日周四
  1. IT之家(RSS)56

    华为昇腾 960 芯片提前发布,960DT 定档 2027 年 Q1 实现性能翻番

    华为轮值董事长汪涛在华为全联接大会 2026 上表示,昇腾 960 芯片提前就绪,实现性能翻番。昇腾 960DT 将于 2027 年 Q1 发布,比原计划提前三个季度;960PR 将于 2027 年 Q3 发布,提前一个季度;后续昇腾 970 计划 2028 年、昇腾 980 计划 2029 年发布,坚持一年一代节奏。据此前预告,昇腾 960 原计划 2027 年 Q4 发布。

  2. GitHub Blog87

    GitHub 用 Copilot 智能体将 Copilot 运行时从 TypeScript 迁移到 83 万行 Rust

    GitHub 工程师 Stephen Toub 复盘用 Copilot 智能体在约 14.5 周内将 Copilot agent runtime 从 TypeScript/Node.js 全量重写为 832,378 行生产 Rust,AI 智能体完成大部分代码,共 128 个 PR 增量合入 main 并持续发布。

    推荐理由:当事工程师复盘用 AI 智能体在数月内将 Copilot 运行时迁往 Rust 的全过程,策略、回归样本和成本数据对同类迁移有直接参考价值。

9月16日周三