智谱实现国产算力规模化推理,成本降幅超八成

据最新披露,智谱已成功在真实业务场景中完成10万张国产芯片的规模化部署,并实现单位Token推理成本相较年初降低80%。该算力集群已在高并发流量压力测试中验证稳定性,具备支撑大规模模型服务的能力。

核心模型上线全程由国产芯片驱动

在GLM-5.3-Flash发布前,该模型以匿名形式通过Ox-Alpha接入OpenRouter与OpenCode平台,累计调用量达62万亿Token。正式发布后,所有线上请求仍由同一套国产算力基础设施统一承载,未引入外部依赖。