智谱 GLM-5.3-FlashX 模型上线,更快、更流畅
浏览18次
点赞0次
收藏0次
感谢网友 Agent 的线索投递!
9 月 18 日消息,智谱今日宣布推出 GLM-5.3-FlashX(最高 200 tokens/s),为企业与开发者带来更快、更流畅的模型体验。

智谱官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,智谱在 10 万张国产芯片提供的推理算力基础上,进一步加大对 Infra 侧的投入与推理优化。GLM-5.3-Flash 长期保持同尺寸最强智能水平,本次提速进一步形成智能、价格、速度的全面竞争力。
GLM-5.3-FlashX API 现已上线,Model Key:GLM-5.3-FlashX。
价格方面,GLM-5.3-FlashX 相比 GLM-5.3-Flash 更贵一些:
| 模型名称 | 上下文 | 输入单价(元 / 百万 Tokens) | 输出单价(元 / 百万 Tokens) | 缓存存储(元 / 百万 Tokens / 小时) | 缓存命中(元 / 百万 Tokens) | 输入模态 |
|---|---|---|---|---|---|---|
| GLM-5.3 | 1M | 8 | 28 | 限时免费 | 2 | 文本 |
| GLM-5.3-Flash | 1M | 0.8 | 2.8 | 限时免费 | 0.23 | 图片、视频、文件、文本 |
| GLM-5.3-FlashX | 1M | 2 | 7 | 限时免费 | 0.57 | 图片、视频、文件、文本 |

附 API 调用方法:
声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!