Qwen Code 深度剖析:通义开源的“终端 Agent“,如何用 77.8% SWE-bench 证明开源编程智能体真的能打

发布时间:2026/9/5 0:17:02
Qwen Code 深度剖析:通义开源的“终端 Agent“,如何用 77.8% SWE-bench 证明开源编程智能体真的能打 通义开源了模型 框架双开源的终端 Agent开箱即用的 Agentic 能力、多协议可切模型、SWE-bench_Verified 77.8%。本文深挖代码架构并给出从安装到 headless 修 bug 的完整实战。引子开源 Agent 的通义时刻2026 年 AI 编程智能体江湖闭源阵营有 Claude Code、Gemini CLI开源阵营有 OpenClaw、dsh。而 9 月通义千问Qwen家族的一张牌正在改变天平——Qwen CodeThe open-source AI coding agent that lives in your terminal[1]。它最特别模型和框架双开源——Agent 是开源框架驱动它的 Qwen 模型也开源无 vendor lock-in[1]。官方 SWE-bench_Verified 77.8% 证明开源编程智能体真的能打。一、一个住在终端里的开源 AI 编程 Agent1.1 一句话定位与起源Qwen Code 是 QwenLM 开源的终端 AI 编程 Agent。最初基于 Google Gemini CLI v0.8.2从 v0.1 起停止同步上游独立开发成多协议、多平台 Agent 框架[1]。1.2 四大特性Agentic out of the boxAuto-Memory / Auto-Skills / SubAgents / Agent Teams / MCP动态工作流零配置Open-source, inside and out框架 Qwen 模型双开源无厂商锁定Multi-protocolOpenAI/Anthropic/Gemini/Qwen 四协议本地 Ollama/vLLM运行时切换Beyond the terminalIDE 插件 / Desktop / Daemon / SDK / IM 机器人二、与 Claude Code 的能力对照2.1 对齐清单官方声称如果你会 Claude Code你就已经会 Qwen Code——甚至更多[1]能力Qwen CodeClaude CodeSubAgents / Agent Teams / Dynamic Workflows✓✓Auto-Memory / Auto-Skills / Hooks✓✓内置 Skills/review /batch /loop /bugfix✓✓MCP / Plan Mode / LSP 集成✓✓Auto Mode / Sandbox / Git Worktrees✓✓Computer Use桌面自动化✓✓IDE 插件 / SDK / Headless✓✓开源模型框架✓—多协议OpenAI/Anthropic/Gemini/Qwen✓—Agent Arena多模型同任务对打✓—Daemon Modeqwen serve 多客户端✓—IM 通道Telegram/钉钉/微信/飞书✓—2.2 独有卖点多协议最性感同一个 Agent 跑在 Claude/OpenAI/本地 Ollama 上都行——运行时切换 provider告别模型锁定[1]。三、代码架构深度剖析基于官方 README 的包结构与能力描述[1]。3.1 总体架构monorepomonorepopackages/下 SDKTS/Python/JavaCLI 核心独立包IDE 插件分别维护——每个入口复用统一 Agent 内核[1]。3.2 核心模块Agent 循环规划-执行-验证闭环做成了默认行为工具调用与 MCPMCP 标准协议挂外部工具 内置 Shell/文件记忆与技能Auto-Memory 跨会话记忆Auto-Skills 自动发现复用内置/review/batch/loop/bugfix子智能体SubAgents / Agent Teams 复杂任务并行拆解3.3 多协议适配层内核与协议解耦Agent 逻辑记忆/工具/规划与调用哪个模型完全分离。模型只是大脑提供方框架提供全部能力——这是运行时切换 provider 的底层原因。3.4 从 Gemini CLI 到独立框架Qwen Code 承认源自 Gemini CLI v0.8.2v0.1 起独立开发[1]。开源的意义fork 不是被锁住而是获得积累后自由长出全新物种。Qwen Code 从Gemini 衍生长成多协议多平台、深度集成通义的独立框架。四、性能实证SWE-bench_Verified 77.8%4.1 评测配置官方透明公开配置项值数据集SWE-bench_Verified500 例运行每版本 3 trials共 1500 jobs模型Qwen 3.7 Max上下文1Mmodel_context_length1,000,000迭代上限max_iterations5004.2 版本趋势版本平均分pass1pass3pass^30.0.1477.80%84.6%84.6%69.2%0.5.076.60%83.0%83.0%68.4%0.15.077.67%84.6%84.6%68.6%0.22.077.33%84.4%84.4%68.0%4.3 如何正确看待77.8% 是模型 框架组合拳——既测 Qwen 3.7 Max 代码能力也测 Qwen Code 的 Agent 能力真实 repo 里规划/改码/跑测试。接近 80% 已进入第一梯队开源方案在长周期工程上已能与闭源旗舰掰手腕[1]。五、生态与热点从 Qwen Code 看开源 Agent 军备竞赛5.1 通义千问模型生态Qwen Code 是通义生态一环深度集成 Qwen 模型Qwen 3.7 Max打通阿里云 Model Studio官方bailian-cli扩展图像/视频生成、知识检索、应用编排、模型部署[1]。5.2 开源 Agent 格局Qwen Code 补上模型 框架双开源这一极别的开源 Agent 靠闭源模型驱动时它连大脑都开源。5.3 自举开发用自己造自己官方 READMEQwen Code is actively iterating on itself——用它自己的 Agent 和模型提 issue、提交 PR、review 代码、跑测试[1]。用自己造自己是开源项目最高级的自我证明不是我们相信它行而是我们每天都在用它。六、实战环节安装、跑任务、多客户端命令均来自官方 README[1]。Node 22。6.1 安装# Linux / macOS curl -fsSL https://qwen-code-assets.oss-cn-hangzhou.aliyuncs.com/installation/install-qwen-standalone.sh | bash # WindowsPowerShell irm https://qwen-code-assets.oss-cn-hangzhou.aliyuncs.com/installation/install-qwen-standalone.ps1 | iex # NPMNode 22 npm install -g qwen-code/qwen-codelatest6.2 快速开始qwen # 交互式终端 UI # 会话内 /auth 配置 provider 和 API key多协议切换运行时切换 provider——先 Qwen再 Anthropic 或本地 Ollama同一会话同一套 Agent 能力[1]。6.3 Headless 实战让 Qwen Code 修一个 bugqwen -p 修复 src/todo.py 中删除已完成任务时可能抛 KeyError 的 bug并运行 pytest 验证6.4 项目讲解qwen serve 多客户端 / Agent Arenaqwen serveDaemonHTTPSSEACP 协议共享 Agent 会话多客户端连同一个 Agent——团队共享长上下文工作空间[1]qwen serveAgent Arena让多个模型在同一任务上头对头对打直观比较表现——模型选型神器免搭评测框架[1]。Python SDK集成进工具链[1]import asyncio from qwen_code_sdk import is_sdk_result_message, query async def main(): result query( Summarize the repository layout., {cwd: /path/to/project, path_to_qwen_executable: qwen}, ) async for message in result: if is_sdk_result_message(message): print(message[result]) asyncio.run(main())七、我的观点7.1 三条判断判断一双开源是最锋利的武器。OpenClaw 开源平台、dsh 开源工具但模型 框架双开源、且能驱动任意模型含本地的 AgentQwen Code 是标杆。本地模型 开源框架的组合第一次真正可行。判断二77.8% 是组合拳不是单点。同时验证了 Qwen 3.7 Max 代码能力和 Qwen Code 的 Agent 能力。但仍是官方 harness 下的数字——真实项目的稳定性、长会话漂移需自己实测。判断三从 Gemini CLI fork 到独立框架是开源最动人的叙事。开源不是复制粘贴而是站在巨人肩膀上长出全新物种。这正是开源 Agent 军备竞赛里最值得关注的一条线。如果你在找没有天花板的编程 Agent——模型可换、本地可跑、框架开源——Qwen Code 值得今天装上试试。参考资料[1] 官方 READMEraw.githubusercontent.com/QwenLM/qwen-code/main/README.md一级2026[2] 官方文档 qwenlm.github.io/qwen-code-docs一级2026[3] 官方对比报告 codeagents improvement report二级[4] 生态仓库acpxQwen Code Claw、modelstudioai/cli二级[5] npm 包页 qwen-code/qwen-code一级