Token导航 LogoToken导航TokenDH.com

智谱发布GLM-5.1高速版,刷新全球大模型API速度纪录

更新时间 2026-05-22来源 品玩正文 319字阅读约 1分钟1 张图片

品玩5月22日讯,智谱今天宣布,正式面向部分企业客户推出GLM-5.1高速版API。该模型输出速度达到400 tokens/s,刷新了当前全球大模型厂商API的速度上限。

这一突破打破了行业长期以来“高速即轻量”的惯例,首次在国产大模型中将旗舰级能力与极致低延迟同时带入生产环境,用户无需再为响应速度牺牲模型质量。

该高速版由智谱GLM团队与TileRT团队联合打造,通过推理引擎、调度系统与底层基础设施的系统级优化,实现了稳定可用的生产级能力。实测显示,其在30秒内即可完成复杂网页代码生成,并支持在3D游戏等场景中实现瞬时建模与实时交互。目前,该API已面向智谱MaaS平台部分企业客户开放,适用于AI编程、实时语音等对延迟极度敏感的场景。

资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多