硬核横评
硬核横评

终端里养一支工程队:五款命令行编程 agent 横评

本篇只比"终端编码代理"这一形态,不比谁的模型更聪明:横向对比 MiniMax Code CLI、Claude Code、Codex CLI、Qwen Code 与 Gemini CLI 七个维度(安装、无头与 CI、模型自由度 BYOK、权限与沙箱、扩展面、开源许可、计费模式),仓库数字统一取 2026-09-20 GitHub API 快照。核心发现:模型自由度是最大分野,五款里只有 MiniMax 与 Qwen Code 支持 BYOK 到别家厂商;沙箱做得最实的是 Codex CLI 的 full-auto 断网加目录围栏;Claude Code 扩展面最成熟但闭源且只吃自家模型。文末给个人日常、无人值守 CI、企业合规、换模省钱四类场景的选型账,并点出上下文可读性、权限误判、模型锁定三项共性弱点。

发布于 2026年9月20日8 分钟阅读
<!-- terminal-coding-agent-comparison-review | review | 终端里养一支工程队:五款命令行编程 agent 横评 -->

本篇与站内既有横评的分工先讲清:claude-code-vs-cursor-vs-codex 比的是 Claude Code、Cursor、Codex 三强的模型能力与工作流(上下文窗口、多文件改写、实测迁移成功率);ai-coding-tool-free-credits-comparison-review 只算各家免费额度这本账;mcp-clients-comparison-review 比的是用哪个客户端去调 MCP server。本篇专攻"终端 agent"形态锋面,只比终端形态加工程可用性,不重复上面三篇。四篇文章互补,各管一段。

一、评测口径与入选标准

本篇只比"终端形态加工程可用性"七个维度:安装方式、是否支持无头与 CI、模型自由度(BYOK 能力)、权限与沙箱、扩展能力(MCP、skills、subagents)、开源与许可、定价模式。先把口径钉死,省得后面被误读。

第一,本篇不跑任何编码 benchmark,也不下"谁的模型更聪明"的结论。五款背后接的模型各不相同,推理质量、工具调用准确率都不在本文范围;你要冲着能力对比来,请直接看 Claude Code 与 Cursor、Codex 的能力横评

第二,凡是 star、fork、语言、许可这类仓库数字,均为 2026-09-20 当天的 GitHub API 快照。Claude Code 闭源无公开仓库,因此不列 star。星数是滚动指标,请以你打开仓库时的实时数字为准。

第三,定价与免费额度只给模式描述,具体数字以官方定价页为准;免费额度的逐项拆解请看 AI 编程工具免费额度横评。本文凡是查不到确切出处的,一律写"以官方文档为准",绝不编造。

入选标准有两条。其一,必须是"终端原生"的编程 agent,也就是能在 shell 里直接跑、不依赖图形 IDE 就能完成读代码、改文件、跑命令这一整条链路;纯 IDE 插件(如 Cursor 本体)不在本篇名单。其二,必须开源可查,或至少 CLI 可公开下载并有官方文档支撑;查不到官方口径的不写。

二、五方总览:star 与许可快照

下表仓库数字来自 2026-09-20 的 GitHub API(Claude Code 闭源不计)。

项目仓库star(2026-09-20)fork语言许可创建最近 push
MiniMax Code CLIMiniMax-AI/minimax-code1,443159TypeScriptMIT2026-06-012026-09-20
Claude Code闭源无公开仓库不计不计不计专有不计不计
Codex CLIopenai/codex125,43919,478RustApache-2.02025-04-132026-09-20
Qwen CodeQwenLM/qwen-code28,0053,075TypeScriptApache-2.02025-06-262026-09-20
Gemini CLIgoogle-gemini/gemini-cli107,09314,605TypeScriptApache-2.02025-04-172026-09-20

从这份快照能读出三件事。其一,开源三强(Codex、Gemini CLI、Qwen Code)的 star 在两万八到十二万五之间,Gemini CLI 与 Codex 同处十万星量级;MiniMax Code CLI 是 2026-06-01 才建仓的新人,一千四百多星、当天仍有 push。其二,许可分两派:MiniMax 走 MIT 最宽松,其余三款开源走 Apache-2.0,Claude Code 闭源专有。其三,语言上 Codex 已用 Rust 重写,其余三款开源仍是 TypeScript,闭源那款语言不可查。

Qwen Code 在仓库描述里写明是 Gemini CLI 的复刻(fork),并针对 Qwen 系列模型做了 parser 适配。

需要特别说明:本文不比较 LobeChat、Aider 这类聊天前端或老牌 CLI,也不列查不到官方仓库数据的产品,提了等于编数据,所以不写。

三、逐家过:安装、入口、模型自由度、权限沙箱、扩展、许可

MiniMax Code CLI(mcode)

安装:官方提供一键脚本,macOS、Linux、WSL 走 curl -fsSL https://filecdn.minimax.chat/public/install.sh | bash,Windows 走 irm .../install.ps1 | iex(来源:ai-bot.cn 详情页,2026-09-20)。登录用 mcode login(国内)或 --region global(海外),/status 看账户、/provider 选模型。

入口形态:三种。交互式 TUI(直接 mcode 或 mcode 后接一句话);无头模式 mcode exec,专给脚本、CI、批量任务;ACP 协议 mcode acp,把 agent 接进 Zed 这类 IDE。mcode init . 生成 AGENTS.md 做项目引导。

模型自由度:强。既能用 MiniMax 账号或 Token Plan,也能 BYOK 接入 OpenAI 或 Anthropic 兼容 API,设 MCODE_PROVIDER_API_KEY 再 mcode provider add 即可。

权限与沙箱:官方描述里有"权限控制加沙箱",并支持 Plan Mode、--continue 与 --session 续会话。具体沙箱实现以官方文档为准。

扩展:内置 MCP 与托管连接器,支持 subagents 并行,插件分官方、本地、GitHub 三类,还有内置 skills;mcode-tools 提供网络搜索与媒体工具。

许可与评测:MIT,开源(来源:GitHub API 2026-09-20)。官方口径的 FrontierHarness Eval 任务通过率 76.7%,成功任务耗时中位数 4 分 33 秒,均优于公开基线(来源:ai-bot.cn 详情页)。想要它的安装与定位细节,可看本站的 MiniMax Code CLI 开源资源盘

Claude Code

安装:三条路,产物都是同一个 claude 命令。npm 安装 npm install -g @anthropic-ai/claude-code(需要 Node 18 以上);原生安装器 curl -fsSL https://claude.ai/install.sh | bash;包管理器 brew install claude-code 或 Windows 的 winget install Anthropic.ClaudeCode(来源:Anthropic 官方文档与 2026 安装指南)。Anthropic 明确不建议用 sudo 装全局包。

入口形态:交互式 REPL 是主场,但无头能力很完整。claude -p 跑完即退出,--output-format 支持 text、json、stream-json,配合 --allowedTools、--disallowedTools、--permission-mode plan,能直接塞进 GitHub Actions。

模型自由度:弱。只吃 Claude 自家模型,默认 Pro、Team、Enterprise 上是 Sonnet 5,Max 与 API 计费走 Opus 4.8,用 ANTHROPIC_MODEL 或 --model 切换。BYOK 指的是带自己的 Anthropic API Key(ANTHROPIC_API_KEY),走按量计费、绕过订阅,但模型仍是 Claude,换不成别家。它还有 CLAUDE_CODE_USE_BEDROCK 与 CLAUDE_CODE_USE_VERTEX 两个开关,把 Claude 跑在 AWS Bedrock 或 GCP Vertex 上。

权限与沙箱:默认 Manual 模式,第一次动工具或碰文件会停下来问你;settings.json 里写 permissions 画边界,hooks 做事件触发。它自身不捆绑操作系统级断网沙箱,要在受限环境跑,通常配容器加 --dangerously-skip-permissions。换句话说,沙箱靠你给,不在它肚子里。

扩展:生态最成熟的一档。MCP 走 settings.json 的 mcpServers;subagents 放 .claude/agents;hooks 放 .claude/hooks;skills 是斜杠命令;plugins 放 .claude/plugins。项目记忆走 CLAUDE.md。和 IDE 三强能力对比 那篇里它胜率最高。

许可与定价:闭源专有,CLI 可下载、源码不开放。定价走订阅:Pro 20 美元/月、Max 100 至 200 美元/月、Team 席位;或绑 ANTHROPIC_API_KEY 按 token 付费(来源:Anthropic 定价页,2026-09-20)。Free 档只含聊天、不含 CLI,所以它没有免费档。

Codex CLI

安装:npm install -g @openai/codex(Node 22 以上)、brew install codex,或独立安装器 curl -fsSL https://chatgpt.com/codex/install.sh | sh(来源:openai/codex 官方文档)。OpenAI 同样提醒别用 sudo 装全局。

入口形态:交互式 codex 之外,给一句话就进非交互,codex "任务" 会边跑边把结果显出来;官方文档单列了 Non-interactive 与 CI mode,适合无人值守。

模型自由度:弱。只接 OpenAI 自家模型(gpt-5 与 codex 系列),BYOK 是带自己的 OPENAI_API_KEY 走按量,换不成别家。想用 Claude 或 Gemini 的人,这一款直接出局。

权限与沙箱:这是 Codex 的招牌。审批分三档,suggest(默认,只读仓库任意文件,写文件与命令都问)、auto-edit(自动批改文件,命令仍问)、full-auto(读写加执行都自动)。关键在 full-auto 里,每条命令默认断网(network-disabled)并关在工作目录沙箱里:macOS 用 Apple Seatbelt 把可写根限制到 $PWD、$TMPDIR、~/.codex;Linux 推荐 Docker,容器里套 iptables 把出网除了 OpenAI API 全拦掉。这种"默认断网加目录 jail"是五家里把沙箱做进工具内核的一档。

扩展:MCP 走 ~/.codex/config.toml 的 mcp_servers;官方还列了 connectors 与 tracing。扩展生态相对收敛,没有 Claude Code 那种 skills、plugins、hooks 全家桶。

许可与定价:Apache-2.0,开源,且已用 Rust 重写(来源:openai/codex GitHub API 2026-09-20)。定价免费 CLI 加 ChatGPT 套餐含额度,或 OpenAI API 按量。

Qwen Code

安装:npm install -g @qwen-code/qwen-code@latest(Node 22 以上)、brew install qwen-code,或独立安装器 curl -fsSL .../install-qwen-standalone.sh | bash(来源:QwenLM/qwen-code 官方文档)。它是 Gemini CLI 的复刻,安装体验几乎一致。

入口形态:交互式 qwen 之外,无头 qwen -p "..." 给脚本、CI、批量用;daemon 模式 qwen serve 走 HTTP 加 SSE(ACP),多个客户端共享一个 agent;还提供 TypeScript、Python、Java 三套 SDK。IM Bot 模式还能接 Telegram、钉钉、微信、飞书。

模型自由度:强,而且是五家里最自由的。官方写明多协议,OpenAI、Anthropic、Gemini、Qwen 四家 API 通吃,任意第三方供应商或本地模型(Ollama、vLLM)都能接,且运行时可切换。接 DashScope 走兼容模式,接 ModelScope 每天还有 2000 次免费推理调用。

权限与沙箱:默认会先问你再动手,继承 Gemini CLI 的审批与沙箱(-s)设计,也有 Plan Mode。沙箱细节以官方文档为准。

扩展:最丰富的一档,且站在 Gemini CLI 肩上。Auto-Memory、Auto-Skills、SubAgents、Agent Teams、MCP 全有;还能扩到 IDE 插件、桌面端、Web UI、IM 机器人。

许可与定价:Apache-2.0,开源(来源:QwenLM/qwen-code GitHub API 2026-09-20)。Qwen OAuth 免费档给 2000 请求/日、60 请求/分;付费走 DashScope 或 ModelStudio,或 BYOK 任意供应商按量。

Gemini CLI

安装:npm install -g @google/gemini-cli(Node 20 以上)、brew install gemini-cli,或 npx @google/gemini-cli 免装即跑(来源:google-gemini/gemini-cli 官方文档与仓库 README)。

入口形态:交互式 gemini 之外,gemini -p "任务" 非交互、读 stdin、能管道串接,加 -o json 出结构化结果;--headless 也专门给脚本与 CI。它原生带 Google Search grounding,能在终端里直接查当下文档,别家 CLI 没有这能力。

模型自由度:弱。只吃 Gemini 模型(Pro 与 Flash,1M 上下文),BYOK 是带自己的 GEMINI_API_KEY 走 AI Studio 按量,或接 Vertex AI 给企业。

权限与沙箱:审批多档,default(每步问)、auto_edit(自动批文件改、命令仍问)、plan(只读,适合安全探索)、yolo(-y,全自动,名字就是警告)。-s 或 --sandbox 把工具跑在隔离环境,配宽松审批模式时建议开。

扩展:MCP 走 ~/.gemini/settings.json;subagents 用 .gemini/agents 里的 Markdown 文件定义、各自独立上下文;extensions 有官方画廊,skills 自成体系;项目记忆走 GEMINI.md。

许可与定价:Apache-2.0,开源(来源:google-gemini/gemini-cli GitHub API 2026-09-20)。免费档用个人 Google 账号登录,官方仓库 README 写的是最高 60 请求/分、1000 请求/日;GEMINI_API_KEY 免费档更低,Vertex AI 无免费档、按量。具体数字以官方为准。

四、分维度对比总表

把七个维度摊成对照表(MIT 与 Apache-2.0 均开源,Claude Code 标专有即闭源)。

维度MiniMax Code CLIClaude CodeCodex CLIQwen CodeGemini CLI
安装curl/irm 脚本加 npmnpm 加原生安装器/brew/wingetnpm 加 brew 加独立安装器npm 加 brew 加独立安装器npm 加 brew 加 npx
无头与 CImcode execclaude -p(json 输出)codex 与 codex execqwen -p 加 daemon(ACP)gemini -p(管道加 json)
模型自由度 BYOK强:MiniMax 或 OpenAI/Anthropic 兼容弱:仅 Claude弱:仅 OpenAI强:四协议加本地模型弱:仅 Gemini
权限与沙箱权限控制加沙箱默认询问,沙箱靠容器三档审批,full-auto 断网沙箱默认询问,继承沙箱多档审批加 -s 沙箱
扩展MCP/subagents/插件/skillsMCP/subagents/hooks/skills/pluginsMCP/connectorsMCP/SubAgents/Teams/skillsMCP/subagents/extensions/skills
开源许可MIT专有(闭源)Apache-2.0Apache-2.0Apache-2.0
定价免费开源加 Token/API订阅 20 至 200 或 API 按量套餐含额度或 API 按量OAuth 免费 2000/日或按量Google 免费档或 API/Vertex 按量

模型自由度是五家最大的分水岭。三款开源工具里 MiniMax 与 Qwen 都支持 BYOK 接别家模型,Claude Code、Codex、Gemini CLI 则各自锁自家模型。

五、场景账:你到底该把谁搬上生产线

选型先想清自己要的是"个人随手用""无人值守跑 CI""企业合规审计"还是"想换模型省钱"。这四类场景的答案完全不同。

场景首选一句话理由
个人日常随手改Claude Code 或 Gemini CLI前者整仓上下文最稳,后者免费档零成本、1M 上下文吞整仓
上 CI 无人值守Codex CLI 或 Claude CodeCodex 的 full-auto 断网沙箱天生为无人值守设计;Claude Code 的 -p 加 json 易接流水线
企业合规审计Claude Code(Bedrock/Vertex)或 Codex前者可把 Claude 跑在自家云账号,后者断网沙箱留痕清晰
想换模型省钱派MiniMax Code CLI 或 Qwen Code二者 BYOK 通吃多协议,模型价低就切哪边,不被单家绑死

个人日常这一档,Gemini CLI 免费档几乎零门槛:个人 Google 账号登录即用 Pro 级模型,免信用卡,适合先装来感受终端 agent;愿为稳定上下文付费的,Claude Code 的 Manual 权限加整仓理解最顺手。

上 CI 这一档,Codex 的 full-auto 在断网沙箱里自动跑完、交回结果,最接近"丢进去不用管";Claude Code 用 -p 加 --allowedTools 也能稳接 GitHub Actions。差别在于:Codex 把安全边界做进工具,Claude Code 交给你在 settings 里配。

企业合规这一档,红线是"数据不出指定云、操作可审计"。Claude Code 的 Bedrock 与 Vertex 开关把推理放进企业自己的云账号;Codex 的断网沙箱加容器出网白名单让每次调用的网络去向可解释。两条路都比把密钥塞进消费级 SaaS 更稳。

想换模型省钱这一档,MiniMax 与 Qwen 是唯二把"模型切换"当一等公民的产品:今天用 MiniMax 的 Token Plan,明天嫌贵就切自建 vLLM,配置改一处即可。其余三家换模型等于换工具。

六、冷思考:终端 agent 的共性短板

终端 agent 再香,也有三道共性短板,选型前得先认账。

第一,上下文与日志可读性。无头模式吐出来的是一段长文本或一行 JSON,人想回看改了哪些文件、为什么并不轻松。CI 里跑完一轮,差量常埋在成百上千行 stdout 里,得靠你接 git diff 与结构化输出。

第二,权限误判风险。不管是 Manual 询问还是 yolo 全自动,agent 对"这条命令危不危险"的判断都来自模型,不是来自沙箱。Codex 用断网加目录 jail 压住爆炸半径,Claude Code 靠你配 allowedTools,其余几家靠你人肉把关。审批模式是安全网不是保险箱,随便开 --dangerously-skip-permissions 这类开关等于交出终端。

第三,绑定自家模型的隐形成本。Claude Code、Codex、Gemini CLI 三家的"免费档"或"套餐含额度"都绑着自家模型,你用顺手后,迁移成本在习惯与上下文不在代码。哪天想换便宜模型却发现 agent 不会用,才是真锁死。MiniMax 与 Qwen 的 BYOK 自由代价小得多。

最后收一句:本篇结论不是"谁最强",而是"谁最像你要的那件事"。先把终端形态、模型自由度、沙箱、许可想清楚,再谈能力。想看这批热点里 Step 系列模型的终端适配,可看 Step 5 Preview 热点;想把 MiniMax Code CLI 落到本地部署,可看 MiniMax Code CLI 开源资源盘;想把 Qoder 的站点能力接到工作流,可看 Qoder Sites SOP。继续比能力,请看 Claude Code 与 Cursor、Codex 的能力横评;比免费额度,请看 AI 编程工具免费额度横评;比 MCP 客户端,请看 MCP 客户端横评

常见问题

问题1:这篇横评到底比了什么,没比什么?

A1:只比终端形态加工程可用性七个维度:安装、无头与 CI、模型自由度 BYOK、权限与沙箱、扩展、开源许可、定价。不跑编码 benchmark,不下"谁更聪明"的结论;能力对比请看 Claude Code 与 Cursor、Codex 的能力横评

问题2:star 数为什么和我看到的不一样?

A2:全文仓库数字均为 2026-09-20 的 GitHub API 快照,星数滚动变化属正常。Claude Code 闭源无公开仓库,不列 star。请以你打开仓库时的实时数据为准,本文数字只代表当天。

问题3:哪款能真正不被厂商锁死模型?

A3:五家里只有 MiniMax Code CLI 与 Qwen Code 明确支持 BYOK 接别家模型(OpenAI、Anthropic、Gemini、本地等)。Claude Code、Codex CLI、Gemini CLI 各自只吃自家模型,带自有 API Key 也只是走按量,换不成别家。

问题4:上 CI 无人值守,谁最省心?

A4:Codex CLI 的 full-auto 在断网加目录沙箱里自动执行,最贴近"丢进去不用管";Claude Code 用 claude -p 加 --allowedTools 把工具提前批好,也能稳接 GitHub Actions。两者都把安全边界做进流水线,只是 Codex 做进工具、Claude Code 做进配置。

问题5:免费档最香的是哪款?

A5:Gemini CLI 用个人 Google 账号登录即享免费档,官方 README 写最高 60 请求/分、1000 请求/日(以官方为准);Qwen Code 的 Qwen OAuth 免费档给 2000 请求/日。Claude Code 无免费档,Codex 与 MiniMax 的 CLI 本身免费但模型要付费或按量。免费额度的逐项拆解请看 AI 编程工具免费额度横评

本文由 AI 辅助生成,经人工审核编辑。最后更新:2026-09-20

常见问题

这篇横评到底比了什么,没比什么?
只比终端形态加工程可用性七个维度:安装、无头与 CI、模型自由度 BYOK、权限与沙箱、扩展、开源许可、定价。不跑编码 benchmark,不下"谁更聪明"的结论;能力对比请看 [Claude Code 与 Cursor、Codex 的能力横评](/zh/posts/claude-code-vs-cursor-vs-codex)。
star 数为什么和我看到的不一样?
全文仓库数字均为 2026-09-20 的 GitHub API 快照,星数滚动变化属正常。Claude Code 闭源无公开仓库,不列 star。请以你打开仓库时的实时数据为准,本文数字只代表当天。
哪款能真正不被厂商锁死模型?
五家里只有 MiniMax Code CLI 与 Qwen Code 明确支持 BYOK 接别家模型(OpenAI、Anthropic、Gemini、本地等)。Claude Code、Codex CLI、Gemini CLI 各自只吃自家模型,带自有 API Key 也只是走按量,换不成别家。
上 CI 无人值守,谁最省心?
Codex CLI 的 full-auto 在断网加目录沙箱里自动执行,最贴近"丢进去不用管";Claude Code 用 claude -p 加 --allowedTools 把工具提前批好,也能稳接 GitHub Actions。两者都把安全边界做进流水线,只是 Codex 做进工具、Claude Code 做进配置。
免费档最香的是哪款?
Gemini CLI 用个人 Google 账号登录即享免费档,官方 README 写最高 60 请求/分、1000 请求/日(以官方为准);Qwen Code 的 Qwen OAuth 免费档给 2000 请求/日。Claude Code 无免费档,Codex 与 MiniMax 的 CLI 本身免费但模型要付费或按量。免费额度的逐项拆解请看 [AI 编程工具免费额度横评](/zh/posts/ai-coding-tool-free-credits-comparison-review)。

相关文章