快讯 智谱Token推理成本较年初降80%:10万张国产芯片跑大模型 Web3 6小时前 0 阅读 ,8月31日消息,智谱披露,公司目前已经实现10万级国产芯片的规模化低成本推理,单位Token推理成本较年初下降80%。这批国产算力此前已经经过真实流量压测。GLM-5.3-Flash发布前以Ox-Alpha匿名上线OpenRouter和OpenCode,Token调用量达到62万亿;正式发布后,全部线上流量也继续由10万张国产芯片承载。