品玩

科技创新者的每日必读

打开APP
关闭

阿里通义 Qwen3 模型技术报告全公开

5月15日

品玩5月15日讯,据爱范儿报道,阿里通义千问正式公开了其 Qwen3 系列模型的技术报告。在技术报告中,用户可以深入了解到 Qwen3 模型架构、预训练及后训练过程、模型性能表现等诸多此前尚未公布的技术细节。

据介绍,Qwen3 的核心创新在于将两种模式整合至统一框架:思考模式 (用于复杂多步推理)和非思考模式 (基于上下文的快速响应)。这一设计无需切换模型(比如对话优化模型 GPT-4o 和专用推理模型 QwQ-32B),而是在同一个模型内根据用户查询或对话模板进行动态模式切换。同时,Qwen3 引入思考预算机制 ,允许用户在推理过程中自适应分配计算资源,从而根据任务复杂度平衡延迟与性能。

此外,通过利用旗舰模型的知识,Qwen3 团队显著降低了构建轻量级模型所需的计算资源,同时确保其性能具有高度竞争力。

取消 发布

下载品玩App,比99.9%的人更先知道关于「阿里通义」的新故事

下载品玩App

比99.9%的人更先知道关于「阿里通义」的新故事

iOS版本 Android版本
立即下载
AI阅读助手
以下有两点提示,请您注意:
1. 请避免输入违反公序良俗、不安全或敏感的内容,模型可能无法回答不合适的问题。
2. 我们致力于提供高质量的大模型问答服务,但无法保证回答的准确性、时效性、全面性或适用性。在使用本服务时,您需要自行判断并承担风险;
感谢您的理解与配合
该功能目前正处于内测阶段,尚未对所有用户开放。如果您想快人一步体验产品的新功能,欢迎点击下面的按钮申请参与内测 申请内测