智谱Token推理成本较年初降80%:10万张国产芯片跑大模型

BiRun 讯,动察 Beating AI 快讯,智谱披露,公司目前已经实现 10 万级国产芯片的规模化低成本推理,单位 Token 推理成本较年初下降 80%。

这批国产算力此前已经露过面。智谱发布 GLM-5.3-Flash 时曾确认,该模型的全部线上流量由 10 万张国产芯片承载。发布前,匿名模型 Ox-Alpha 在 OpenRouter、OpenCode 上的大规模测试,同样跑在这批国产算力上。
你怎么看这条消息?来投第一票

评论

0/500
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯