智谱上线 GLM-5.3-FlashX 高速推理模型
IT时代网9月18日消息,智谱宣布推出 GLM-5.3-FlashX 模型,最高输出速度可达每秒 200 tokens,面向企业与开发者提供更快的模型调用体验。
据官方介绍,GLM-5.3-Flash 此前曾以“Ox Alpha”的名称与全球开发者见面,获得了海内外开发者的广泛认可,调用量持续攀升。面对快速增长的需求,智谱在由 10 万张国产芯片提供的推理算力基础上,进一步加大对基础设施侧的投入与推理优化。
官方称,GLM-5.3-Flash 长期保持同尺寸下最强的智能水平,此次提速进一步形成智能、价格与速度的全面竞争力。GLM-5.3-FlashX 的 API 现已上线,模型标识为 GLM-5.3-FlashX,价格相比 GLM-5.3-Flash 更贵一些,具体调用方式以官方文档为准。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。
编辑:林一舟
THE END