跳到正文
IT之家 AI·· 17 天前评分70

智谱 GLM-5.3-FlashX 模型上线,更快、更流畅

摘要

IT之家 9 月 18 日消息,智谱今日宣布推出 GLM-5.3-FlashX(最高 200 tokens/s) ,为企业与开发者带来更快、更流畅的模型体验。 智谱官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名与全球开发者见面,获得海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,智谱在 10 万张国产芯片提供的推理算力基础上, 进一步加大对 Infra 侧的投入与推理优化 。GLM-5.3-Flash 长期保持同尺寸最强智能水平,本次提速进一步形成智能、价格、速度的全面竞争力。 GLM-5.3-FlashX API 现已上线,Model Key: GLM-5.3-FlashX 。 价格方面,GLM-5.3-FlashX 相比 GLM-5.3-Flash 更贵一些: 模型名称 上下文 输入单价(元 / 百万 Tokens) 输出单价(元 / 百万 Tokens) 缓存存储(元 / 百万 Token...

本站只提供摘要与原文入口。完整内容请阅读原文。

来源:IT之家 AI · ithome.com