简介
阿里巴巴集团的大语言模型家族,由总部位于中国杭州的阿里云Qwen团队开发。中文全称"通义千问"大致可译为"对千问的统一回答"。该家族涵盖参数量从6亿到2350亿的稠密模型、视觉语言及语音变体、专用编程产品线(Qwen3-Coder),以及总参数量可达4800亿的MoE(混合专家)架构。Qwen是阿里云的AI智能层,在中国及全球范围内与企业和开发者客户展开竞争。大多数模型采用Apache 2.0许可证发布,前沿旗舰模型则以专有形式保留,通过阿里云以API方式出售。
历史
阿里巴巴于2023年4月启动内测。服务在通过中国《生成式人工智能服务管理暂行办法》所要求的安全评估后,于2023年9月正式向公众开放。首批开放权重版本于2023年12月发布,将1.8B和72B参数模型上传至Hugging Face。Qwen2于2024年6月发布,Qwen2.5于2024年9月跟进,引入了在多项基准测试中超越Meta AI Llama 3的MoE架构。2025年4月28日发布的Qwen3是迄今最重要的代际跃进。它引入了混合推理机制,可在用于多步骤任务的"思考模式"与用于快速响应的标准生成模式之间切换,并以前代两倍的36万亿词元进行训练。Qwen团队因融入Qwen3-Next产品线的架构研究荣获NeurIPS 2025最佳论文奖。Qwen3-235B-A22B在ArenaHard上得分95.6,在AIME'24上得分85.7,与当时最优秀的闭源模型不相上下。
现状
截至2026年7月,阿里巴巴采用双层模型战略。开放权重层以Qwen3.6系列(2026年4月发布,Apache 2.0)为核心,Qwen3.6-27B在代码代理基准SWE-bench Verified上超越了更大规模的Qwen3.5-397B-A17B(77.2对76.2)。专有层Qwen3.7系列于2026年5月20日在杭州阿里巴巴云栖大会上揭幕,包含Qwen3.7-Max(旗舰版)和Qwen3.7-Plus(2026年6月1日发布的多模态代理变体),均仅通过阿里云API提供。截至2026年5月,Qwen应用注册用户已达2.34亿,该家族累计下载量超过3亿次。开放的低层级产品构建起全球开发者的认可度,专有旗舰产品则通过云订阅变现,与DeepSeek在国内以及OpenAI在国际上的策略如出一辙。
关系
Qwen是阿里巴巴针对DeepSeek(另一家主要中国开放权重实验室)的直接竞争回应。在中国前沿实验室中,Qwen定期与MiniMax和Zhipu GLM进行比较,但Qwen的参数规模和下载量使其拥有更广泛的影响力。在国际层面,开放权重产品线与Meta AI的Llama系列竞争最为直接。截至2026年中期,最重要的外部事件是Anthropic指控阿里巴巴对任何AI系统实施了已知规模最大的模型蒸馏攻击:2026年4月22日至6月5日,通过25,000个虚假账号进行了2,880万次欺诈性交互,针对Claude的软件工程和代理推理能力为Qwen训练所用。美国国防部已将阿里巴巴列入第1260H条款"中国军事企业"名单,使美国企业采购Qwen驱动服务的流程更加复杂。
关注要点
随着DeepSeek和Meta AI持续发布完全开放的前沿模型,双层开源/闭源策略能否维持开发者忠诚度。Anthropic的蒸馏申诉于2026年6月提交美国参议院后,将如何塑造美中AI知识产权法律,国会是否会就蒸馏行为立法。美国先进半导体出口管制将如何制约阿里云训练Qwen后继模型的能力。开源与闭源前沿之争是否会改变Qwen的授权立场。覆盖119种语言的多语言路线图进展如何,这是相较于以英语为主的西方实验室最清晰的产品差异化优势。