跳到正文
原文
X.PIN· @thexpin · X·· 20 天前AI 评分52
AI 导读

Z.ai 宣布其 GLM-5.3 驱动的 Infra Agent 为 GLM-5.3-Flash 设计、调试并优化了生产推理基础设施,覆盖 100,000+ 中国芯片。不到两周吞吐达到初始基线的 3 倍,硬件效率和单 token 成本据称与主流 Nvidia GPU 相当。团队称之为递归自我改进,即模型改进运行自身的基础设施。

整理与数据来源:AIHOT

来源:X.PIN · x.com