智谱 GLM 公布国内首个递归自我改进生产实践
智谱 GLM 团队披露了递归自我改进(RSI)在生产环境中的应用案例。由 GLM-5.3 驱动的 Infra Agent 完成了 GLM-5.3-Flash 推理基础设施的设计、调试和优化。在超过 10 万张国产芯片组成的集群上,该系统不到两周便从零搭建生产级推理服务。智谱称,端到端吞吐量提升至初始基线的 3 倍,硬件利用效率和单 Token 成本达到主流 NVIDIA GPU 系统的相近水平。该系统目前已投入实际使用。GLM-5.3-Flash 以匿名模型 Ox-Alpha 的名称在 OpenCode 和 OpenRouter 上线,据称 6 天内 Token 调用量超过 62 万亿。
本文来源:IT之家,仅供学习参考,版权归原作者所有。