❯ GLM-5.3 参与优化自身推理系统,公司称十万卡规模吞吐量增至三倍
工程闭环智谱公司称,GLM-5.3 已参与分析和修改运行自身的生产基础设施,在工程师设定目标与边界的前提下,协助完成假设、代码变更和实验,把 GLM-5.3-Flash 的吞吐量提升至原来的 三倍。
优化细节团队称,这套系统运行在超过 10 万张加速卡的规模上。此前公开案例包括定位 Python 全局解释器锁造成的传输瓶颈,据团队测试把一项超过 20% 的性能差距压到 1% 以内,以及通过内核修改取得 1.71 倍加速。
口径限制这是模型参与基础设施优化的团队自述,并非模型脱离人类独立升级自身。对算力运营方更实际的价值,是把排障速度和卡群利用率拉高;能否在不同工作负载上复现,还要看代码、测试条件和长期运行数据。
▪ SIGNAL所谓自我改进眼下更像有人监督的工程循环,产出先体现在吞吐量和排障速度。