智谱 GLM 团队于 9 月 17 日公布了在递归自我改进方向上的首个工程化实践进展,核心是让 AI 自主优化其运行系统。
具体而言,由 GLM-5.3 驱动的 Infra Agent 负责设计、调试并优化了 GLM-5.3-Flash 的推理基础设施,实现了模型对其自身运行系统的反向改进。
根据官方博客,Infra Agent 在超过 10 万张国产芯片组成的集群上,从零开始构建了生产级推理服务,并在不到两周内将端到端吞吐量提升至初始基线的 3 倍,硬件利用效率与单 Token 成本已达到主流 NVIDIA GPU 的同等水平。该系统已投入实际应用,GLM-5.3-Flash 以匿名模型 Ox-Alpha 在 OpenCode 和 OpenRouter 上线,6 天内 Token 调用量超过 62 万亿。
值得一提的是,这是国内大模型厂商首次公开将“AI 自我改进”应用于生产环境,标志着 AI 不仅限于编写代码,还能参与整个推理系统的工程闭环。若需进一步了解相关技术细节,可参考开云娱乐|开云体育官方中国下载。

