智谱GLM公开国内大模型首个递归自我改进实践

饮食技巧 7℃

9月21日消息,智谱 GLM 团队近日公开了递归自我改进(Recursive Self-Improvement,简称 RSI)方向的首个工程化实践成果,即让 AI 自主参与改进其自身运行系统。

文章主题示意图
主题配图,非事件现场。摄影:Nicolas Foster。 /。 Pexels。

具体而言,GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试和优化工作,从而实现了模型对自身运行系统的反向改进。

根据官方博客介绍,Infra Agent 在超过 10 万张国产芯片构成的集群上,从零开始搭建了生产级推理服务,并在不到两周时间内将端到端吞吐量提升到初始基线的 3 倍,硬件利用效率与单 Token 成本均已达到主流 NVIDIA GPU 的同等水平。该系统已进入实际使用阶段,GLM-5.3-Flash 以匿名模型 Ox-Alpha 的身份在 OpenCode、OpenRouter 上线,6 天内 Token 调用量突破 62 万亿。

这是国内大模型厂商首次公开将“AI 自我改进”应用于生产环境,表明 AI 不仅能编写代码,还可参与整个推理系统的工程闭环。