品玩

科技创新者的每日必读

打开APP
关闭

权威大模型榜单:阿里千问3.7全球第五、国产第一

5月21日

5月21日消息,三方机构Artificial Analysis公布了最新的全球大模型榜单,阿里新发布的旗舰模型Qwen3.7-Max得分56.6分,超过了Kimi-K2.6、DeepSeek-v4-Pro-Max、GLM5.1等所有国产模型,性能接近GPT、Claude、Gemini的最强模型,位列全球第五、国产第一。据了解,Qwen3.7-Max即将上线阿里云百炼对外提供API服务。

图说:Artificial Analysis官网截图显示,Qwen3.7-Max位列全球第五、国产第一
图说:Artificial Analysis官网截图显示,Qwen3.7-Max位列全球第五、国产第一

Artificial Analysis 是一个独立的 AI 大模型评测与分析平台,它对全球大模型进行多维度的基准测试和性能评估,形成系统性的大模型智能水平综合排名,因此该榜单也被业内公认为是最具影响力、含金量最高的大模型三方榜单之一。阿里千问大模型曾多次登上Artificial Analysis榜单前沿,1个月前发布的Qwen3.6-Max-Preview,就曾创下国产模型性能最佳。

如今,这一成绩再度被千问自身超越。在5月20日晚公布的最新一期Artificial Analysis 大模型总榜中,Qwen3.7-Max得分56.6,较上代旗舰模型进步4.8分,逼近GPT-5.4(xhigh)、Gemini3.1 Pro Preview、Claude-Opus4.7(max),在总榜的所有模型中排名第五,稳居国产模型第一。

据了解,Qwen3.7-Max为Agent智能体而创新设计,实现了编程、智能体、推理等核心能力的大幅突破。千问3.7可与Claude Code、OpenClaw、Hermes Agent、Qwen Code等各类Agent框架完美协同,通过自主编程和Agent工具调用,可独立完成35小时、超1000次工具调用的复杂长程任务,交付令人惊艳的生产级成果,可完美胜任企业级的复杂任务。

取消 发布

下载品玩App,比99.9%的人更先知道关于「阿里千问」的新故事

下载品玩App

比99.9%的人更先知道关于「阿里千问」的新故事

iOS版本 Android版本
立即下载
AI阅读助手
以下有两点提示,请您注意:
1. 请避免输入违反公序良俗、不安全或敏感的内容,模型可能无法回答不合适的问题。
2. 我们致力于提供高质量的大模型问答服务,但无法保证回答的准确性、时效性、全面性或适用性。在使用本服务时,您需要自行判断并承担风险;
感谢您的理解与配合
该功能目前正处于内测阶段,尚未对所有用户开放。如果您想快人一步体验产品的新功能,欢迎点击下面的按钮申请参与内测 申请内测