-
智谱上线 GLM-5.3-FlashX:最高 200 tokens/s,进一步提升推理速度
2026年09月18日,智谱正式推出 GLM-5.3-FlashX,将 GLM-5.3-Flash 的在线推理速度进一步提升,最高输出速度可达 200 tokens/s。新版本 API 已同步上线,Model Key 为 GLM-5.3-FlashX,企业和开发者可以通过智谱开放平台调用。 GLM-5.3-Flash 此前曾以匿名模型 Ox Alpha 与开发者见面。随着模型调用量增长,智谱表示,…- 232
- 0


