本篇与站内既有横评的分工先讲清:claude-code-vs-cursor-vs-codex 比的是 Claude Code、Cursor、Codex 三强的模型能力与工作流(上下文窗口、多文件改写、实测迁移成功率);ai-coding-tool-free-credits-comparison-review 只算各家免费额度这本账;mcp-clients-comparison-review 比的是用哪个客户端去调 MCP server。本篇专攻"终端 agent"形态锋面,只比终端形态加工程可用性,不重复上面三篇。四篇文章互补,各管一段。
一、评测口径与入选标准
本篇只比"终端形态加工程可用性"七个维度:安装方式、是否支持无头与 CI、模型自由度(BYOK 能力)、权限与沙箱、扩展能力(MCP、skills、subagents)、开源与许可、定价模式。先把口径钉死,省得后面被误读。
第一,本篇不跑任何编码 benchmark,也不下"谁的模型更聪明"的结论。五款背后接的模型各不相同,推理质量、工具调用准确率都不在本文范围;你要冲着能力对比来,请直接看 Claude Code 与 Cursor、Codex 的能力横评。
第二,凡是 star、fork、语言、许可这类仓库数字,均为 2026-09-20 当天的 GitHub API 快照。Claude Code 闭源无公开仓库,因此不列 star。星数是滚动指标,请以你打开仓库时的实时数字为准。
第三,定价与免费额度只给模式描述,具体数字以官方定价页为准;免费额度的逐项拆解请看 AI 编程工具免费额度横评。本文凡是查不到确切出处的,一律写"以官方文档为准",绝不编造。
入选标准有两条。其一,必须是"终端原生"的编程 agent,也就是能在 shell 里直接跑、不依赖图形 IDE 就能完成读代码、改文件、跑命令这一整条链路;纯 IDE 插件(如 Cursor 本体)不在本篇名单。其二,必须开源可查,或至少 CLI 可公开下载并有官方文档支撑;查不到官方口径的不写。
二、五方总览:star 与许可快照
下表仓库数字来自 2026-09-20 的 GitHub API(Claude Code 闭源不计)。
| 项目 | 仓库 | star(2026-09-20) | fork | 语言 | 许可 | 创建 | 最近 push |
|---|---|---|---|---|---|---|---|
| MiniMax Code CLI | MiniMax-AI/minimax-code | 1,443 | 159 | TypeScript | MIT | 2026-06-01 | 2026-09-20 |
| Claude Code | 闭源无公开仓库 | 不计 | 不计 | 不计 | 专有 | 不计 | 不计 |
| Codex CLI | openai/codex | 125,439 | 19,478 | Rust | Apache-2.0 | 2025-04-13 | 2026-09-20 |
| Qwen Code | QwenLM/qwen-code | 28,005 | 3,075 | TypeScript | Apache-2.0 | 2025-06-26 | 2026-09-20 |
| Gemini CLI | google-gemini/gemini-cli | 107,093 | 14,605 | TypeScript | Apache-2.0 | 2025-04-17 | 2026-09-20 |
从这份快照能读出三件事。其一,开源三强(Codex、Gemini CLI、Qwen Code)的 star 在两万八到十二万五之间,Gemini CLI 与 Codex 同处十万星量级;MiniMax Code CLI 是 2026-06-01 才建仓的新人,一千四百多星、当天仍有 push。其二,许可分两派:MiniMax 走 MIT 最宽松,其余三款开源走 Apache-2.0,Claude Code 闭源专有。其三,语言上 Codex 已用 Rust 重写,其余三款开源仍是 TypeScript,闭源那款语言不可查。
Qwen Code 在仓库描述里写明是 Gemini CLI 的复刻(fork),并针对 Qwen 系列模型做了 parser 适配。
需要特别说明:本文不比较 LobeChat、Aider 这类聊天前端或老牌 CLI,也不列查不到官方仓库数据的产品,提了等于编数据,所以不写。
三、逐家过:安装、入口、模型自由度、权限沙箱、扩展、许可
MiniMax Code CLI(mcode)
安装:官方提供一键脚本,macOS、Linux、WSL 走 curl -fsSL https://filecdn.minimax.chat/public/install.sh | bash,Windows 走 irm .../install.ps1 | iex(来源:ai-bot.cn 详情页,2026-09-20)。登录用 mcode login(国内)或 --region global(海外),/status 看账户、/provider 选模型。
入口形态:三种。交互式 TUI(直接 mcode 或 mcode 后接一句话);无头模式 mcode exec,专给脚本、CI、批量任务;ACP 协议 mcode acp,把 agent 接进 Zed 这类 IDE。mcode init . 生成 AGENTS.md 做项目引导。
模型自由度:强。既能用 MiniMax 账号或 Token Plan,也能 BYOK 接入 OpenAI 或 Anthropic 兼容 API,设 MCODE_PROVIDER_API_KEY 再 mcode provider add 即可。
权限与沙箱:官方描述里有"权限控制加沙箱",并支持 Plan Mode、--continue 与 --session 续会话。具体沙箱实现以官方文档为准。
扩展:内置 MCP 与托管连接器,支持 subagents 并行,插件分官方、本地、GitHub 三类,还有内置 skills;mcode-tools 提供网络搜索与媒体工具。
许可与评测:MIT,开源(来源:GitHub API 2026-09-20)。官方口径的 FrontierHarness Eval 任务通过率 76.7%,成功任务耗时中位数 4 分 33 秒,均优于公开基线(来源:ai-bot.cn 详情页)。想要它的安装与定位细节,可看本站的 MiniMax Code CLI 开源资源盘。
Claude Code
安装:三条路,产物都是同一个 claude 命令。npm 安装 npm install -g @anthropic-ai/claude-code(需要 Node 18 以上);原生安装器 curl -fsSL https://claude.ai/install.sh | bash;包管理器 brew install claude-code 或 Windows 的 winget install Anthropic.ClaudeCode(来源:Anthropic 官方文档与 2026 安装指南)。Anthropic 明确不建议用 sudo 装全局包。
入口形态:交互式 REPL 是主场,但无头能力很完整。claude -p 跑完即退出,--output-format 支持 text、json、stream-json,配合 --allowedTools、--disallowedTools、--permission-mode plan,能直接塞进 GitHub Actions。
模型自由度:弱。只吃 Claude 自家模型,默认 Pro、Team、Enterprise 上是 Sonnet 5,Max 与 API 计费走 Opus 4.8,用 ANTHROPIC_MODEL 或 --model 切换。BYOK 指的是带自己的 Anthropic API Key(ANTHROPIC_API_KEY),走按量计费、绕过订阅,但模型仍是 Claude,换不成别家。它还有 CLAUDE_CODE_USE_BEDROCK 与 CLAUDE_CODE_USE_VERTEX 两个开关,把 Claude 跑在 AWS Bedrock 或 GCP Vertex 上。
权限与沙箱:默认 Manual 模式,第一次动工具或碰文件会停下来问你;settings.json 里写 permissions 画边界,hooks 做事件触发。它自身不捆绑操作系统级断网沙箱,要在受限环境跑,通常配容器加 --dangerously-skip-permissions。换句话说,沙箱靠你给,不在它肚子里。
扩展:生态最成熟的一档。MCP 走 settings.json 的 mcpServers;subagents 放 .claude/agents;hooks 放 .claude/hooks;skills 是斜杠命令;plugins 放 .claude/plugins。项目记忆走 CLAUDE.md。和 IDE 三强能力对比 那篇里它胜率最高。
许可与定价:闭源专有,CLI 可下载、源码不开放。定价走订阅:Pro 20 美元/月、Max 100 至 200 美元/月、Team 席位;或绑 ANTHROPIC_API_KEY 按 token 付费(来源:Anthropic 定价页,2026-09-20)。Free 档只含聊天、不含 CLI,所以它没有免费档。
Codex CLI
安装:npm install -g @openai/codex(Node 22 以上)、brew install codex,或独立安装器 curl -fsSL https://chatgpt.com/codex/install.sh | sh(来源:openai/codex 官方文档)。OpenAI 同样提醒别用 sudo 装全局。
入口形态:交互式 codex 之外,给一句话就进非交互,codex "任务" 会边跑边把结果显出来;官方文档单列了 Non-interactive 与 CI mode,适合无人值守。
模型自由度:弱。只接 OpenAI 自家模型(gpt-5 与 codex 系列),BYOK 是带自己的 OPENAI_API_KEY 走按量,换不成别家。想用 Claude 或 Gemini 的人,这一款直接出局。
权限与沙箱:这是 Codex 的招牌。审批分三档,suggest(默认,只读仓库任意文件,写文件与命令都问)、auto-edit(自动批改文件,命令仍问)、full-auto(读写加执行都自动)。关键在 full-auto 里,每条命令默认断网(network-disabled)并关在工作目录沙箱里:macOS 用 Apple Seatbelt 把可写根限制到 $PWD、$TMPDIR、~/.codex;Linux 推荐 Docker,容器里套 iptables 把出网除了 OpenAI API 全拦掉。这种"默认断网加目录 jail"是五家里把沙箱做进工具内核的一档。
扩展:MCP 走 ~/.codex/config.toml 的 mcp_servers;官方还列了 connectors 与 tracing。扩展生态相对收敛,没有 Claude Code 那种 skills、plugins、hooks 全家桶。
许可与定价:Apache-2.0,开源,且已用 Rust 重写(来源:openai/codex GitHub API 2026-09-20)。定价免费 CLI 加 ChatGPT 套餐含额度,或 OpenAI API 按量。
Qwen Code
安装:npm install -g @qwen-code/qwen-code@latest(Node 22 以上)、brew install qwen-code,或独立安装器 curl -fsSL .../install-qwen-standalone.sh | bash(来源:QwenLM/qwen-code 官方文档)。它是 Gemini CLI 的复刻,安装体验几乎一致。
入口形态:交互式 qwen 之外,无头 qwen -p "..." 给脚本、CI、批量用;daemon 模式 qwen serve 走 HTTP 加 SSE(ACP),多个客户端共享一个 agent;还提供 TypeScript、Python、Java 三套 SDK。IM Bot 模式还能接 Telegram、钉钉、微信、飞书。
模型自由度:强,而且是五家里最自由的。官方写明多协议,OpenAI、Anthropic、Gemini、Qwen 四家 API 通吃,任意第三方供应商或本地模型(Ollama、vLLM)都能接,且运行时可切换。接 DashScope 走兼容模式,接 ModelScope 每天还有 2000 次免费推理调用。
权限与沙箱:默认会先问你再动手,继承 Gemini CLI 的审批与沙箱(-s)设计,也有 Plan Mode。沙箱细节以官方文档为准。
扩展:最丰富的一档,且站在 Gemini CLI 肩上。Auto-Memory、Auto-Skills、SubAgents、Agent Teams、MCP 全有;还能扩到 IDE 插件、桌面端、Web UI、IM 机器人。
许可与定价:Apache-2.0,开源(来源:QwenLM/qwen-code GitHub API 2026-09-20)。Qwen OAuth 免费档给 2000 请求/日、60 请求/分;付费走 DashScope 或 ModelStudio,或 BYOK 任意供应商按量。
Gemini CLI
安装:npm install -g @google/gemini-cli(Node 20 以上)、brew install gemini-cli,或 npx @google/gemini-cli 免装即跑(来源:google-gemini/gemini-cli 官方文档与仓库 README)。
入口形态:交互式 gemini 之外,gemini -p "任务" 非交互、读 stdin、能管道串接,加 -o json 出结构化结果;--headless 也专门给脚本与 CI。它原生带 Google Search grounding,能在终端里直接查当下文档,别家 CLI 没有这能力。
模型自由度:弱。只吃 Gemini 模型(Pro 与 Flash,1M 上下文),BYOK 是带自己的 GEMINI_API_KEY 走 AI Studio 按量,或接 Vertex AI 给企业。
权限与沙箱:审批多档,default(每步问)、auto_edit(自动批文件改、命令仍问)、plan(只读,适合安全探索)、yolo(-y,全自动,名字就是警告)。-s 或 --sandbox 把工具跑在隔离环境,配宽松审批模式时建议开。
扩展:MCP 走 ~/.gemini/settings.json;subagents 用 .gemini/agents 里的 Markdown 文件定义、各自独立上下文;extensions 有官方画廊,skills 自成体系;项目记忆走 GEMINI.md。
许可与定价:Apache-2.0,开源(来源:google-gemini/gemini-cli GitHub API 2026-09-20)。免费档用个人 Google 账号登录,官方仓库 README 写的是最高 60 请求/分、1000 请求/日;GEMINI_API_KEY 免费档更低,Vertex AI 无免费档、按量。具体数字以官方为准。
四、分维度对比总表
把七个维度摊成对照表(MIT 与 Apache-2.0 均开源,Claude Code 标专有即闭源)。
| 维度 | MiniMax Code CLI | Claude Code | Codex CLI | Qwen Code | Gemini CLI |
|---|---|---|---|---|---|
| 安装 | curl/irm 脚本加 npm | npm 加原生安装器/brew/winget | npm 加 brew 加独立安装器 | npm 加 brew 加独立安装器 | npm 加 brew 加 npx |
| 无头与 CI | mcode exec | claude -p(json 输出) | codex 与 codex exec | qwen -p 加 daemon(ACP) | gemini -p(管道加 json) |
| 模型自由度 BYOK | 强:MiniMax 或 OpenAI/Anthropic 兼容 | 弱:仅 Claude | 弱:仅 OpenAI | 强:四协议加本地模型 | 弱:仅 Gemini |
| 权限与沙箱 | 权限控制加沙箱 | 默认询问,沙箱靠容器 | 三档审批,full-auto 断网沙箱 | 默认询问,继承沙箱 | 多档审批加 -s 沙箱 |
| 扩展 | MCP/subagents/插件/skills | MCP/subagents/hooks/skills/plugins | MCP/connectors | MCP/SubAgents/Teams/skills | MCP/subagents/extensions/skills |
| 开源许可 | MIT | 专有(闭源) | Apache-2.0 | Apache-2.0 | Apache-2.0 |
| 定价 | 免费开源加 Token/API | 订阅 20 至 200 或 API 按量 | 套餐含额度或 API 按量 | OAuth 免费 2000/日或按量 | Google 免费档或 API/Vertex 按量 |
模型自由度是五家最大的分水岭。三款开源工具里 MiniMax 与 Qwen 都支持 BYOK 接别家模型,Claude Code、Codex、Gemini CLI 则各自锁自家模型。
五、场景账:你到底该把谁搬上生产线
选型先想清自己要的是"个人随手用""无人值守跑 CI""企业合规审计"还是"想换模型省钱"。这四类场景的答案完全不同。
| 场景 | 首选 | 一句话理由 |
|---|---|---|
| 个人日常随手改 | Claude Code 或 Gemini CLI | 前者整仓上下文最稳,后者免费档零成本、1M 上下文吞整仓 |
| 上 CI 无人值守 | Codex CLI 或 Claude Code | Codex 的 full-auto 断网沙箱天生为无人值守设计;Claude Code 的 -p 加 json 易接流水线 |
| 企业合规审计 | Claude Code(Bedrock/Vertex)或 Codex | 前者可把 Claude 跑在自家云账号,后者断网沙箱留痕清晰 |
| 想换模型省钱派 | MiniMax Code CLI 或 Qwen Code | 二者 BYOK 通吃多协议,模型价低就切哪边,不被单家绑死 |
个人日常这一档,Gemini CLI 免费档几乎零门槛:个人 Google 账号登录即用 Pro 级模型,免信用卡,适合先装来感受终端 agent;愿为稳定上下文付费的,Claude Code 的 Manual 权限加整仓理解最顺手。
上 CI 这一档,Codex 的 full-auto 在断网沙箱里自动跑完、交回结果,最接近"丢进去不用管";Claude Code 用 -p 加 --allowedTools 也能稳接 GitHub Actions。差别在于:Codex 把安全边界做进工具,Claude Code 交给你在 settings 里配。
企业合规这一档,红线是"数据不出指定云、操作可审计"。Claude Code 的 Bedrock 与 Vertex 开关把推理放进企业自己的云账号;Codex 的断网沙箱加容器出网白名单让每次调用的网络去向可解释。两条路都比把密钥塞进消费级 SaaS 更稳。
想换模型省钱这一档,MiniMax 与 Qwen 是唯二把"模型切换"当一等公民的产品:今天用 MiniMax 的 Token Plan,明天嫌贵就切自建 vLLM,配置改一处即可。其余三家换模型等于换工具。
六、冷思考:终端 agent 的共性短板
终端 agent 再香,也有三道共性短板,选型前得先认账。
第一,上下文与日志可读性。无头模式吐出来的是一段长文本或一行 JSON,人想回看改了哪些文件、为什么并不轻松。CI 里跑完一轮,差量常埋在成百上千行 stdout 里,得靠你接 git diff 与结构化输出。
第二,权限误判风险。不管是 Manual 询问还是 yolo 全自动,agent 对"这条命令危不危险"的判断都来自模型,不是来自沙箱。Codex 用断网加目录 jail 压住爆炸半径,Claude Code 靠你配 allowedTools,其余几家靠你人肉把关。审批模式是安全网不是保险箱,随便开 --dangerously-skip-permissions 这类开关等于交出终端。
第三,绑定自家模型的隐形成本。Claude Code、Codex、Gemini CLI 三家的"免费档"或"套餐含额度"都绑着自家模型,你用顺手后,迁移成本在习惯与上下文不在代码。哪天想换便宜模型却发现 agent 不会用,才是真锁死。MiniMax 与 Qwen 的 BYOK 自由代价小得多。
最后收一句:本篇结论不是"谁最强",而是"谁最像你要的那件事"。先把终端形态、模型自由度、沙箱、许可想清楚,再谈能力。想看这批热点里 Step 系列模型的终端适配,可看 Step 5 Preview 热点;想把 MiniMax Code CLI 落到本地部署,可看 MiniMax Code CLI 开源资源盘;想把 Qoder 的站点能力接到工作流,可看 Qoder Sites SOP。继续比能力,请看 Claude Code 与 Cursor、Codex 的能力横评;比免费额度,请看 AI 编程工具免费额度横评;比 MCP 客户端,请看 MCP 客户端横评。
常见问题
问题1:这篇横评到底比了什么,没比什么?
A1:只比终端形态加工程可用性七个维度:安装、无头与 CI、模型自由度 BYOK、权限与沙箱、扩展、开源许可、定价。不跑编码 benchmark,不下"谁更聪明"的结论;能力对比请看 Claude Code 与 Cursor、Codex 的能力横评。
问题2:star 数为什么和我看到的不一样?
A2:全文仓库数字均为 2026-09-20 的 GitHub API 快照,星数滚动变化属正常。Claude Code 闭源无公开仓库,不列 star。请以你打开仓库时的实时数据为准,本文数字只代表当天。
问题3:哪款能真正不被厂商锁死模型?
A3:五家里只有 MiniMax Code CLI 与 Qwen Code 明确支持 BYOK 接别家模型(OpenAI、Anthropic、Gemini、本地等)。Claude Code、Codex CLI、Gemini CLI 各自只吃自家模型,带自有 API Key 也只是走按量,换不成别家。
问题4:上 CI 无人值守,谁最省心?
A4:Codex CLI 的 full-auto 在断网加目录沙箱里自动执行,最贴近"丢进去不用管";Claude Code 用 claude -p 加 --allowedTools 把工具提前批好,也能稳接 GitHub Actions。两者都把安全边界做进流水线,只是 Codex 做进工具、Claude Code 做进配置。
问题5:免费档最香的是哪款?
A5:Gemini CLI 用个人 Google 账号登录即享免费档,官方 README 写最高 60 请求/分、1000 请求/日(以官方为准);Qwen Code 的 Qwen OAuth 免费档给 2000 请求/日。Claude Code 无免费档,Codex 与 MiniMax 的 CLI 本身免费但模型要付费或按量。免费额度的逐项拆解请看 AI 编程工具免费额度横评。