Qwen3-Coder
通义千问团队开源的AI编程智能体模型,支持92种语言、本地Agent和全仓库代码理解
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
通义千问团队开源的AI编程智能体模型,支持92种语言、本地Agent和全仓库代码理解
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
想象一下:你在深夜赶一个紧急需求,代码写到一半突然卡壳,不是因为你不会,而是因为代码库太复杂,一时找不到调用路径。如果这时候有一个能帮你看懂代码、写对逻辑、甚至直接帮你完成调试的助手,你会不会觉得像多了一个并肩作战的战友?
Qwen3-Coder 就是这样一个存在。它是阿里巴巴通义千问团队在2025年发布的代码专用大模型,定位远不止代码补全,它是一个真正意义上的AI编程智能体(Agent),能够理解整个代码仓库、执行多步复杂任务、调用工具、自主调试。

图1:Qwen3-Coder 家族支持多种规格,从轻量到超大参数覆盖各类使用场景
通用大语言模型(如 GPT-4、Claude)在自然语言理解上已经非常强大,但当它们面对专业代码任务时,往往暴露出几个明显短板:代码上下文理解不够深入(无法真正吃透整个仓库的结构)、编程语言覆盖面有限(很多小众语言训练不足)、长程依赖处理弱(代码修改牵一发动全身,需要跨文件理解)。
通义千问团队从2024年开始深耕代码模型赛道,Qwen2.5-Coder系列已经在多项基准测试中追平甚至超越GPT-4 Turbo Code。到了Qwen3-Coder,团队引入了一个核心理念——Agentic Coding(智能体编程),不只是让模型写代码,而是让它像一个真正的程序员一样工作:拆解任务、规划步骤、调用工具、修正错误、交付结果。
Qwen3-Coder 家族包含多个规格的模型:
| 型号 | 类型 | 活跃参数 | Context长度 | 特点 |
|---|---|---|---|---|
| Qwen3-Coder-Next | 指令微调 | 3B(总80B MoE) | 256K | 极低推理成本,适配本地Agent |
| Qwen3-Coder-30B-A3B | 指令微调 | 3B(总30B MoE) | 128K | 平衡性能与资源消耗 |
| Qwen3-Coder-480B-A35B | 指令微调 | 35B(总480B MoE) | 256K+1M(外推) | 对标Claude Sonnet 4性能 |
最令人惊艳的是 Qwen3-Coder-Next(2026年2月发布):一个总参数800亿但每次推理只激活30亿的MoE(混合专家)模型。这意味着它可以在消费级高端GPU(如RTX 4090)上本地运行,同时达到接近Claude Sonnet 4.5的编程能力——这对个人开发者来说是革命性的。
训练方法上,Qwen3-Coder采用了三项核心技术:
海量代码数据预训练:在7.5万亿token上训练,其中代码占比高达70%,覆盖92种编程语言,远超同类开源模型。
Agentic RL(智能体强化学习):在post-training阶段引入长程强化学习,让模型通过多轮交互学会使用工具、规划任务、自我纠错。
Long Context优化:原生支持256K token上下文,配合extrapolation方法可扩展到1M token,足以一次性处理完整的中型代码仓库。

图2:Qwen3-Coder-Next 在 SWE-bench-Pro 真实软件工程任务上的评测表现
全仓库级代码理解:不同于传统代码补全工具只能看到当前文件,Qwen3-Coder能够消化整个代码仓库。你可以让它解释某个模块的设计意图、分析依赖关系、梳理代码调用链。对于维护大型开源项目或接手遗留代码的开发者来说,这相当于有了一个永不疲倦的代码考古学家。
多语言代码生成与转换:支持92种编程语言,包括Python、JavaScript、TypeScript、Go、Rust、Java、C++等主流语言,也覆盖Kotlin、Swift、Haskell、Scala、R、MATLAB等。它不仅能生成新代码,还能在不同语言之间进行代码翻译(如把Java转成Kotlin),这对遗留系统迁移和跨平台开发极有价值。
编程智能体(Agentic Coding):通过Qwen Code命令行工具,开发者可以启动一个交互式AI编程助手。模型能够:调用Bash执行命令、读写文件、搜索代码、使用浏览器搜索技术文档、自主规划多步骤任务并逐步执行。例如,你可以告诉它帮我把这个REST API改成GraphQL,它会自动理解代码结构、制定迁移方案、执行修改并验证。
代码执行与调试:集成代码执行能力,模型可以运行代码并根据输出结果进行自我修正。这解决了大模型常见幻觉代码问题——生成的代码能跑才能算真正可用。在finetuning/sft目录下提供了完整的代码执行数据准备脚本,确保模型输出的代码具有真实可运行性。
最简单的方式是通过Hugging Face transformers直接调用,代码示例:
from transformers import AutoModelForCausalLM, AutoTokenizer
model = AutoModelForCausalLM.from_pretrained('Qwen/Qwen3-Coder-30B-A3B-Instruct')
tokenizer = AutoTokenizer.from_pretrained('Qwen/Qwen3-Coder-30B-A3B-Instruct')
# 即可开始对话式编程
生产环境建议用vLLM部署以获得更高吞吐量:
vllm serve Qwen/Qwen3-Coder-30B-A3B-Instruct --dtype half --tensor-parallel-size 2
硬件需求参考:3B模型(Next)推荐8-16GB显存(INT4量化),可在RTX 3060上运行;30B模型推荐24-40GB显存,需要A100 40G或4090双卡;480B模型需要多卡集群。
仓库提供了完整的SFT和DPO训练代码,支持LoRA和全参数微调两种模式。
本地推理性能受硬件限制严重:3B参数量虽小但实际运行流畅度依赖GPU;CPU推理几乎不可用。
480B超大模型无法本地运行:大多数开发者只能体验3B/30B规格,480B需要云端或集群。
非完全开源:权重开放但训练数据细节未公开,且License限制了某些商业用途。
Agent模式仍有出错概率:复杂多步任务中,模型可能出现规划偏差或工具调用错误,建议在高风险操作前人工复核。
Qwen3-Coder的发布在开源社区引发了强烈反响。它的意义不仅在于刷新了多项基准测试分数,更在于它真正把AI编程助手从概念落地到了可用的产品形态。Qwen3-Coder-Next的MoE架构也向业界证明了:小参数高效推理与强大编程能力完全可以兼得。
代码模型正在经历三个阶段的演进:代码补全(Code Completion)→ 代码助手(Code Assistant)→ 编程智能体(Code Agent)。Qwen3-Coder站在了第三阶段的潮头,与Claude Code、GPT-4 Turbo Code形成了三足鼎立的竞争格局——而它的开源属性和本地部署选项,给了开发者更多的选择自由。