智谱发布 GLM-5.3-FlashX,大模型输出速度最高达 200 tokens/s

智谱 AI 旗下 BigModel 平台正式上线 GLM-5.3-FlashX 大模型,API 同步开放,模型标识为“GLM-5.3-FlashX”。该版本最高输出速度达 200 tokens/s,面向企业与开发者提供高吞吐、低延迟推理服务。其前身 GLM-5.3-Flash 曾以“Ox Alpha”匿名亮相海外。智谱称,依托 10 万张国产芯片算力底座并加强推理优化,FlashX 在保持原有智能水平和定价基础上提升生成速度,开发者可通过官方 API 文档接入,用户也可在体验中心试用。

上一篇:

下一篇:

发表回复

登录后才能评论