智谱宣布推出 GLM-5.1 高速版(GLM-5.1-highspeed)API,并已向部分企业客户开放。该模型输出速度达 400 tokens/s,刷新全球大模型 API 速度纪录。在保持旗舰级能力的同时,实现低延迟与高吞吐兼顾。模型由智谱 GLM 团队与 TileRT 团队联合研发,通过重构推理引擎、优化调度系统及底层基础设施,实现生产级稳定输出。该能力已在智谱 MaaS 平台落地,适用于 AI 编程、实时交互及高频决策等场景。
智谱宣布推出 GLM-5.1 高速版(GLM-5.1-highspeed)API,并已向部分企业客户开放。该模型输出速度达 400 tokens/s,刷新全球大模型 API 速度纪录。在保持旗舰级能力的同时,实现低延迟与高吞吐兼顾。模型由智谱 GLM 团队与 TileRT 团队联合研发,通过重构推理引擎、优化调度系统及底层基础设施,实现生产级稳定输出。该能力已在智谱 MaaS 平台落地,适用于 AI 编程、实时交互及高频决策等场景。