Skip to main content
Aggregate OSChina 开源资讯 鸿蒙 18 Sep 2026 - 21:03

GLM-5.3-FlashX 上线,智谱把国产卡上的推理速度顶到 200 token/s

RSS 官方收录 · 可信分层展示

关键摘要

GLM-5.3 前阵子以"Ox Alpha"的匿名身份上线时,就已经是 OpenCode 和 OpenRouter 双平台调用量最大的模型。今天智谱给它加了个更快的版本,名字也直白——GLM-5.3-FlashX,最高 200 tokens/s。 背后的一张牌值得单独说。上一代 GLM 上线时,团队是在 10 万张国产芯片组成的集群上把推理服务从零搭起来的,当时的难点是内...

规则摘要 · 来源可核验

正文提要

GLM-5.3 前阵子以"Ox Alpha"的匿名身份上线时,就已经是 OpenCode 和 OpenRouter 双平台调用量最大的模型。今天智谱给它加了个更快的版本,名字也直白——GLM-5.3-FlashX,最高 200 tokens/s。 背后的一张牌值得单独说。上一代 GLM 上线时,团队是在 10 万张国产芯片组成的集群上把推理服务从零搭起来的,当时的难点是内...

来源:https://www.oschina.net/news/502582

打开官方原文 站点原文页 可信分区 本信源更多 今日简报 分享图 RSS 稍后再看列表