智谱披露大模型递归自我改进实践进展

IT时代网9月17日消息,智谱GLM团队今日披露递归自我改进(Recursive Self-Improvement,简称RSI)方向的首个工程化实践进展,即让AI自己动手改进自身的运行系统。具体而言,由GLM-5.3驱动的Infra Agent完成了GLM-5.3-Flash推理基础设施的设计、调试与优化,实现了模型对自身运行系统的反向改进。

据官方博客介绍,Infra Agent在超过10万张国产芯片组成的集群上,从零完成了生产级推理服务的搭建,不到两周就把端到端吞吐提升至初始基线的3倍,硬件利用效率与单Token成本达到主流NVIDIA GPU的相当水平。

这套系统已投入真实使用。GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上线,6天Token调用量超过62万亿。

该团队表示,这是国内大模型厂商首次公开将AI自我改进用于生产环境,意味着AI不再只是编写代码,还能参与整个推理系统的工程闭环。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。

编辑:林一舟

THE END