GLM-5.3-FlashX
拆解 GLM-5.3-FlashX 这次生产级提速:能力定位不变而吞吐提到 200 tokens/s 的逻辑、低延迟单独定价的取舍,以及十万张国产芯片撑起的推理优化。
GLM-5.3-FlashX 是智谱给 GLM-5.3-Flash 做的一次生产级性能分层:能力定位不变,输出吞吐提到 200 tokens/s,速度约为前代 5 倍、价格 2.5 倍。它把低延迟单独定价,为 Coding Agent、实时对话和工具调用压缩等待时间,背后是十万张以上中国产加速芯片的推理集群。