9月21日消息,智谱 GLM 团队近日公开了递归自我改进(Recursive Self-Improvement,简称 RSI)方向的首个工程化实践成果,即让 AI 自主参与改进其自身运行系统。

具体而言,GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试和优化工作,从而实现了模型对自身运行系统的反向改进。
根据官方博客介绍,Infra Agent 在超过 10 万张国产芯片构成的集群上,从零开始搭建了生产级推理服务,并在不到两周时间内将端到端吞吐量提升到初始基线的 3 倍,硬件利用效率与单 Token 成本均已达到主流 NVIDIA GPU 的同等水平。该系统已进入实际使用阶段,GLM-5.3-Flash 以匿名模型 Ox-Alpha 的身份在 OpenCode、OpenRouter 上线,6 天内 Token 调用量突破 62 万亿。
这是国内大模型厂商首次公开将“AI 自我改进”应用于生产环境,表明 AI 不仅能编写代码,还可参与整个推理系统的工程闭环。











