【智谱Token推理成本较年初降80%:10万张国产芯片跑大模型】金色财经报道,8月31日消息,智谱披露,公司目前已经实现10万级国产芯片的规模化低成本推理,单位Token推理成本较年初下降80%。这批国产算力此前已经经过真实流量压测。GLM-5.3-Flash发布前以Ox-Alpha匿名上线OpenRouter和OpenCode,Token调用量达到62万亿;正式发布后,全部线上流量也继续由10万张国产芯片承载。
原文链接:https://stockn.xueqiu.com/02513/20260831742450.pdf
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。

