智谱披露国产算力规模化成果

智谱披露,公司已实现10万级国产芯片的规模化低成本推理,单位Token推理成本较年初下降80%。

关键数据

  • 国产算力已通过真实流量压测

  • GLM-5.3-Flash发布前以Ox-Alpha匿名上线OpenRouter和OpenCode,Token调用量达62万亿

  • 正式发布后,全部线上流量由10万张国产芯片承载


影响

成本大幅下降意味着定价权转移。GLM-5.3-Flash折后输出价格每百万Token 0.25美元,较自家GLM-5.2低一个数量级,直接对标DeepSeek-V4-Flash价格带。

智谱7月初透露自研芯片计划,8月10日启用超5万张国产卡,月底官宣10万张规模,一个月内翻倍,显示国产推理集群扩产速度呈指数级增长。