品玩

科技创新者的每日必读

打开APP
关闭

智谱发布GLM-5.1高速版,刷新全球大模型API速度纪录

5月22日

品玩5月22日讯,智谱今天宣布,正式面向部分企业客户推出GLM-5.1高速版API。该模型输出速度达到400 tokens/s,刷新了当前全球大模型厂商API的速度上限。

这一突破打破了行业长期以来“高速即轻量”的惯例,首次在国产大模型中将旗舰级能力与极致低延迟同时带入生产环境,用户无需再为响应速度牺牲模型质量。

该高速版由智谱GLM团队与TileRT团队联合打造,通过推理引擎、调度系统与底层基础设施的系统级优化,实现了稳定可用的生产级能力。实测显示,其在30秒内即可完成复杂网页代码生成,并支持在3D游戏等场景中实现瞬时建模与实时交互。目前,该API已面向智谱MaaS平台部分企业客户开放,适用于AI编程、实时语音等对延迟极度敏感的场景。

取消 发布

下载品玩App,比99.9%的人更先知道关于「智谱」的新故事

下载品玩App

比99.9%的人更先知道关于「智谱」的新故事

iOS版本 Android版本
立即下载
AI阅读助手
以下有两点提示,请您注意:
1. 请避免输入违反公序良俗、不安全或敏感的内容,模型可能无法回答不合适的问题。
2. 我们致力于提供高质量的大模型问答服务,但无法保证回答的准确性、时效性、全面性或适用性。在使用本服务时,您需要自行判断并承担风险;
感谢您的理解与配合
该功能目前正处于内测阶段,尚未对所有用户开放。如果您想快人一步体验产品的新功能,欢迎点击下面的按钮申请参与内测 申请内测