Qwen(通义千问)模型系列
Qwen(通义千问,英文读作“kun”)是阿里巴巴通义千问团队(阿里云)开发的大规模语言模型(LLM)和多模态模型(MLLM)系列,官方模型主页位于 qwenlm.aliyun.com。该系列既包含 Qwen Max/Plus/Turbo、Qwen-VL、Qwen-Audio 等专有版本,也包含 Qwen1.5、Qwen2、Qwen2.5、Qwen3 以及 QwQ、Qwen2.5-Coder、Qwen2.5-Math 等开放权重模型。
核心能力
通义千问可以执行自然语言理解、文本生成、视觉理解、音频理解、工具调用、角色扮演、智能体等多种任务;其语言和多模态模型均在大规模、多语言、多模态数据上进行预训练,并在高质量语料上后训练以与人类偏好对齐。Qwen 采用基于字节的 BPE 词元化和 ChatML 对话模板,不存在未登录词。
多模态与结构化输出
阿里云向开源社区提供通义千问系列 LLM 与 MLLM,其中多模态模型包括 Qwen-VL(视觉语言模型)、Qwen-TTS(文字转语音模型)和 Qwen-Audio,最新的 Qwen3-Omni 能同时处理和推理文本、音频与视觉多种模态。Qwen 还擅长理解表格等结构化数据并生成 JSON 输出,Qwen2.5-72B 可撰写超过 5000 字的中文长文本报告,Qwen3 提供“Web Dev”模式可按简单输入构建个性化网站。
Qwen2.5 系列
Qwen2.5 是阿里云研发的通义千问系列开源大模型,在知识掌握、编程、数学和指令遵循上相比 Qwen2 显著提升,MMLU 得分 85+;支持最高 128K 上下文 tokens 与 8K 输出 tokens,覆盖中文、英文、法文、西班牙文、阿拉伯文等 29 种以上语言。开放权重版本包括 0.5B、1.5B、3B、7B、14B、32B 和 72B 多种参数规模。
Qwen3 系列
最新的 Qwen3 系列采用混合思考模式(“Thinking”和“Non-Thinking”),可灵活控制推理性能、速度和成本;支持 119 种语言和方言,并支持 Model Context Protocol(MCP),以增强智能体能力。Qwen3 开放了从 0.6B、1.7B、4B、8B、14B、32B 等密集模型到 30B-A3B、235B-A22B 等 MoE 模型的权重,Qwen3-2507 更新版支持 256K token 长上下文并可扩展至 100 万 tokens。
Qwen3.5 与 Qwen3.8 旗舰模型
2026 年 2 月,阿里巴巴开源了 Qwen3.5-397B-A17B(又名 Qwen3.5-Plus),这是原生多模态基础模型,可处理文本、图像和视频输入并生成文本,支持 201 种语言和方言(较 Qwen3 系列的 119 种大幅增加)。该模型结合线性注意力机制与稀疏 MoE 架构以降低推理成本,全球开发者可通过 Hugging Face、GitHub、ModelScope 获取,也可在 Qwen Chat 体验,并通过阿里云百炼(Model Studio)调用 API。
2026 年 8 月,阿里云发布了 Qwen 系列迄今最强的旗舰模型 Qwen3.8-Max:采用稀疏 MoE 架构,总参数 2.4 万亿、激活参数 95B,支持最高 100 万 tokens 上下文,并原生支持视觉智能;在 Text Arena 排名第五、Vision Arena 排名第二,在编码、实际工作、科研和长周期任务上表现突出。该模型面向全球开发者通过阿里云百炼(Alibaba Cloud Model Studio)API 提供,模型权重随后开源,并可在阿里云工作智能体平台 QwenWork 上体验。
部署与微调
企业和开发者可在阿里云 PAI Model Gallery 中一键部署、微调和评测 Qwen2.5 模型:支持 SFT 与 DPO 两种微调算法,可部署到 EAS,服务兼容 OpenAI API。开源权重可通过 Hugging Face、ModelScope 和 GitHub 获取,支持 llama.cpp、Ollama、LM Studio、MLX、MNN、OpenVINO 等本地推理框架,以及 SGLang、vLLM、TensorRT-LLM 等大规模推理部署框架。
相关导航
数据评估
关于Qwen-阿里特别声明
本站深度导航提供的Qwen-阿里都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由深度导航实际控制,在2026年8月27日 上午12:16收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,深度导航不承担任何责任。
