智谱实现国产算力规模化推理,成本降幅超八成
据最新披露,智谱已成功在真实业务场景中完成10万张国产芯片的规模化部署,并实现单位Token推理成本相较年初降低80%。该算力集群已在高并发流量压力测试中验证稳定性,具备支撑大规模模型服务的能力。
核心模型上线全程由国产芯片驱动
在GLM-5.3-Flash发布前,该模型以匿名形式通过Ox-Alpha接入OpenRouter与OpenCode平台,累计调用量达62万亿Token。正式发布后,所有线上请求仍由同一套国产算力基础设施统一承载,未引入外部依赖。
声明:本站所有文章内容,均为采集网络资源,不代表本站观点及立场,不构成任何投资建议!如若内容侵犯了原著者的合法权益,可联系本站删除。
币安 Binance
币安交易所是全球加密货币交易所,注册奖励 500 U
