X.PIN· @thexpin · X·2026-09-18 19:35· 20 天前AI 评分52AI 导读Z.ai 宣布其 GLM-5.3 驱动的 Infra Agent 为 GLM-5.3-Flash 设计、调试并优化了生产推理基础设施,覆盖 100,000+ 中国芯片。不到两周吞吐达到初始基线的 3 倍,硬件效率和单 token 成本据称与主流 Nvidia GPU 相当。团队称之为递归自我改进,即模型改进运行自身的基础设施。另有 2 家信源报道整理与数据来源:AIHOT来源:X.PIN · x.com#现象/趋势#部署/工程查看事件全部后续