品玩5月22日讯,智谱今天宣布,正式面向部分企业客户推出GLM-5.1高速版API。该模型输出速度达到400 tokens/s,刷新了当前全球大模型厂商API的速度上限。
这一突破打破了行业长期以来“高速即轻量”的惯例,首次在国产大模型中将旗舰级能力与极致低延迟同时带入生产环境,用户无需再为响应速度牺牲模型质量。
该高速版由智谱GLM团队与TileRT团队联合打造,通过推理引擎、调度系统与底层基础设施的系统级优化,实现了稳定可用的生产级能力。实测显示,其在30秒内即可完成复杂网页代码生成,并支持在3D游戏等场景中实现瞬时建模与实时交互。目前,该API已面向智谱MaaS平台部分企业客户开放,适用于AI编程、实时语音等对延迟极度敏感的场景。





0 条评论
请「登录」后评论