智谱 GLM:AI 在十万卡国产集群上自建推理系统 两周推理吞吐大幅提升
今日,智谱 GLM 团队披露递归自我改进方向首个工程化实践进展,也就是让 AI 自己动手改进自己的运行系统。具体来说,由 GLM-5.3 驱动的 Infra Agent 在超过 10 万张国产芯片组成的集群上,从零搭建并调试推理服务,不到两周把整体处理速度提升到原来的 3 倍,硬件利用效率和单 Token 成本接近与主流英伟达 GPU 相当水平。这套系统已投入真实使用,GLM-5.3-Flash 以匿名模型 Ox-Alpha 在 OpenCode、OpenRouter 上线,6 天 Token 调用量超过 62 万亿。这是国内大模型厂商首次公开将“AI 自我改进”用于生产环境,意味着 AI 不再只是写代码,还能参与整个推理系统的工程闭环。
 
 
Back to Top