跳到正文

#部署/工程

今日 12 条
9月2日周三
  1. Meituan LongCat68

    LongCat-2.0 现已在 @cline 中免费试用!🐱 [引用 @cline]:LongCat-2.0 目前在 Cline 中免费使用。 这是一款来自 @Meituan_LongCat 的 1.6T 开源权重 MoE 模型,拥有 1M 上下文,得分与 Claude Opus 4.7 和 Gemini 3.1 Pro 相近。 立即尝试:npm i -g cline /model 在免费模型下选择 LongCat-2.0

    推荐理由:官方宣布 LongCat-2.0 可在 Cline 免费试用,并给出安装命令和模型选择路径,读者可直接接入现有编码工作流。

  2. 公众号:数字生命卡兹克65

    UU远程新版本上线:完整 TUI 渲染与多终端会话管理,强化远程 Vibe Coding 体验

    UU远程于9月2日上线新版本,重点优化终端功能,补齐 TUI 渲染交互与终端会话管理能力。主要更新包括:Mac 免密码登录、移动端输入优化并新增调用系统输入法的独立输入框、可同时创建和管理多个终端会话并支持手机与电脑间跨端同步接管(通过 uuyc-cli lterm 命令)。

    推荐理由:作者实测新版本并给出使用路径,读者可据此评估手机端远程跑 Coding Agent 的可行性。

  3. Modal 官方工程博客(RSS)45

    Modal 发布 Botika 客户案例:全栈生成式 AI 基础设施实践

    Modal 官方博客介绍时尚电商公司 Botika 如何利用 Modal 平台运行其全栈生成式 AI 业务。Botika 在 Modal 上处理 100TB 图像数据管道、训练数十亿参数的专有基础模型,并服务约 15 个生产推理模型。CEO Eran Dagan 表示,Modal 帮助团队将实验吞吐量从每人每天 1-2 次提升至 50 次,并简化了多节点训练和强化学习基础设施的搭建,替代了传统的 Kubernetes 或云厂商方案。

  4. SemiAnalysis28

    SemiAnalysis 致谢 AMD 团队在几周内快速提升了 MI355X 在智能体工作负载上的性能,测试基于 Qwen3.5 397B 和 MiniMax M3 等前沿模型的真实生产负载。配图为 SemiAnalysis InMaxM3 数据:在 Qwen3.5 397B FP4 智能体场景下,MI355X(SGLang)2026-08-31 的每 $1 TCO 总 token 产出与 P90 交互速度曲线较 2026-08-12 明显改善,图中 B300 TCO 为 $2.26/chip/hr,MI355X 为 $1.5/chip/hr。

  5. IT之家(RSS)44

    马斯克在 G20 演讲:预计 AI 将令全球经济规模增加约 20%-30%

    马斯克 9 月 1 日在 G20 会议上演讲称,预计 AI 将使全球经济规模增加约 20%-30%,即每年增加约 20 万亿至 30 万亿美元。他预计到 2027 年底 AI 将能完成所有数字领域的工作,AI 编程能力明年可能达到"Stockfish 级";未来 10 年全球人形机器人数量将超 10 亿台,每台生产力至少相当于人类 5 倍,有望使全球经济规模扩大 10 倍以上。

9月1日周二
  1. Hugging Face:Blog(RSS)62

    Hugging Face 发布 @huggingface/kernels,提供 207 个 WebGPU 内核用于浏览器本地 AI 推理

    Hugging Face WebAI 团队发布 @huggingface/kernels 库及 207 个以独立仓库形式托管在 Hub 上的 WebGPU 内核(Apache-2.0),每个内核带 manifest、正确性测试、基准用例和 WGSL 着色器模板。

    推荐理由:原文给出与 ORT WebGPU 的对比数据和开源加载方式,读者可据此评估浏览器本地推理的可行路径。

  2. IT之家(RSS)76

    路透社调查:美国 AI 数据中心现大量幽灵用电需求,得州等多州出手整治

    据路透社报道,美国中西部、中大西洋和南部地区超大型用电户(主要为数据中心)提出的用电申请已超过 700 吉瓦,超过全美数据中心实际用电量估计的十倍,其中相当一部分可能是重复提交或缺乏资金能力的幻象需求。

    推荐理由:路透社调查给出超 700 吉瓦用电申请与各州整治措施的具体数字,读者可以据此了解 AI 数据中心电力泡沫的真实规模。