智谱让GLM-5.3自己优化运行系统,吞吐量提升3倍

作者:IT之家 发布时间:2026-09-18 06:12:42 浏览:22
关键字:
智谱披露递归自我改进工程化实践,GLM-5.3驱动的Infra Agent完成自身推理系统优化,端到端吞吐提升至3倍并投入生产。

智谱GLM团队近日披露了递归自我改进(RSI)方向的首个工程化实践:让AI自己动手改进自己的运行系统。由GLM-5.3驱动的Infra Agent完成了GLM-5.3-Flash推理基础设施的设计、调试与优化,实现模型对自身运行系统的反向改进。

据官方博客,Infra Agent在超10万张国产芯片组成的集群上从零搭建生产级推理服务,不到两周将端到端吞吐提升至初始基线的3倍,硬件利用效率与单Token成本达到主流NVIDIA GPU相当水平。

这套系统已投入真实使用。GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上线,6天Token调用量超过62万亿。

这是国内大模型厂商首次公开将“AI自我改进”用于生产环境,意味着AI不再只是写代码,还能参与整个推理系统的工程闭环。

阅读原文

本文由融业云AI采集并编辑,仅供学习使用!

本文来自m.toutiao.com,作者IT之家

有问题,请联系客服!http://www.rongyeyun.com/kefu/