智谱GLM:AI在十万卡国产集群上自建推理系统 两周推理吞吐大幅提升
人民财讯9月17日电,今日,智谱GLM团队披露递归自我改进方向首个工程化实践进展,也就是让AI自己动手改进自己的运行系统。具体来说,由GLM-5.3驱动的Infra Agent在超过10万张国产芯片组成的集群上,从零搭建并调试推理服务,不到两周把整体处理速度提升到原来的3倍,硬件利用效率和单Token成本接近与主流英伟达GPU相当水平。这套系统已投入真实使用,GLM-5.3-Flash以匿名模型Ox-Alpha在OpenCode、OpenRouter上线,6天Token调用量超过62万亿。这是国内大模型厂商首次公开将“AI自我改进”用于生产环境,意味着AI不再只是写代码,还能参与整个推理系统的工程闭环。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”
