硬核横评
硬核横评

AI 终端编程 Agent 横评:Claude Code、Codex CLI、Gemini CLI、Aider、OpenHands 怎么选

横评 5 款终端编程 agent:Claude Code、Codex CLI、Gemini CLI、Aider、OpenHands,从模型支持、开源状态、git 集成、自主性等六个维度对比,按个人开发者/企业/多模型玩家等身份给选型建议。本文为代表性对比非亲自压测,定价以官网为准。

发布于 2026年8月3日12 分钟阅读

工具概览

AI 工具对比表
工具价格评分优点缺点
Claude Code$20/月起(含 Pro)或按 API 用量4.7
  • 200K 上下文,整仓理解强
  • 工具调用稳定,幻觉率低
  • 终端原生,可串行多步任务
  • 无 GUI,上手门槛略高
  • 重度使用 API 费用不低
Codex CLI开源免费(按模型 API 计费)4.2
  • 开源可自托管
  • 沙箱执行更安全
  • 可切换多家模型
  • 配置繁琐
  • 长任务稳定性待提升
<!-- ai-coding-agent-comparison-review | review | AI 终端编程 Agent 横评:Claude Code、Codex CLI、Gemini CLI、Aider、OpenHands 怎么选 -->

2026 年下半年,编程 agent 赛道的重心明显从"代码补全"转向"自主交付完整任务"。过去两年大家卷的是 IDE 里的 Tab 补全,现在卷的是终端里的自主交付:给它一个任务,它自己规划、改文件、跑命令、修 bug、提交代码。Qwen3.8-Max 能在沙箱里自主编程十数天不停,就是这个方向的极致体现。终端/CLI 编程 agent 正成为继 IDE 插件之后,开发者工具链的下一个入口。

这篇挑了 5 款最有代表性的终端编程 agent 横着比:Claude Code、Codex CLI、Gemini CLI、Aider、OpenHands。它们都跑在终端里,都能自主改代码,但出身、模型绑定、开源策略、适用场景截然不同。本文按场景给结论,不列虚榜单。

先说清楚一件事:下面所有对比,都是基于各工具官方文档、GitHub 仓库与公开信息做的代表性对比,非亲自压测。star 数和许可证经 GitHub API 于 2026-08-03 核实,定价和功能随时可能变动,以官网为准。本篇聚焦终端/CLI agent,区别于已有的 IDE 横评。

一、为什么 2026 年终端编程 agent 值得单独看一轮

终端编程 agent 之所以在 2026 年集中爆发,有三个原因。第一,模型能力够了。Claude Sonnet/Opus 系列、GPT-5 系列、Gemini 3 系列的长上下文和推理能力,已经能支撑"读整个仓库、规划多步、改多个文件"的复杂任务,不再是一问一答的水平。第二,agentic 框架成熟了。工具调用、文件读写、命令执行、沙箱隔离这些基础设施,从实验室走向了生产级工具。第三,开发者习惯在迁移。越来越多开发者发现,在终端里用自然语言描述任务,比在 IDE 里逐行操作更快,尤其对重复性重构、跨文件修改、写测试这类活。

但终端 agent 也不是万能的。它的短板同样明显:没有 IDE 那样的可视化 diff 预览(部分工具已补上),对大型 monorepo 的上下文管理仍有瓶颈,调试体验不如 IDE 直观。所以 2026 年的现实是:IDE 补全和终端 agent 并存,各管一段。本篇只看终端这一段。

五款工具各押一个方向,没有全能王。Claude Code 押 agentic 深度和 Anthropic 模型绑定,Codex CLI 押轻量和 OpenAI 生态,Gemini CLI 押免费额度和 Google 模型,Aider 押 git 集成和模型自由,OpenHands 押自主开发 agent 和开源。理解了各自押的宝,选型看你的活就够了。

二、五位选手入场(数据截至 2026-08-03)

先把五位的家底亮出来。star 数和许可证经 GitHub API 核实,定价来自各家官网或说明文档。标"以官网为准"的数字未经实时核验。

工具厂商/维护方GitHub 仓库Stars语言许可证定价模式
Claude CodeAnthropic闭源(无公开仓库)--专有Claude Pro/Max 订阅或 Anthropic API
Codex CLIOpenAIopenai/codex约 103,495RustApache-2.0ChatGPT 订阅或 OpenAI API
Gemini CLIGooglegoogle-gemini/gemini-cli约 106,324TypeScriptApache-2.0Gemini API(有免费额度+付费)
AiderAider-AIAider-AI/aider约 47,897PythonApache-2.0开源免费(自带 API Key)
OpenHandsOpenHandsOpenHands/OpenHands约 82,962TypeScriptMIT开源免费(自带 API Key)

三个细节先点出来。第一,开源这件事,Aider、OpenHands、Codex CLI、Gemini CLI 全部开源(Apache-2.0 或 MIT),只有 Claude Code 是闭源专有。第二,模型绑定这件事,Claude Code 只能用 Anthropic 模型,Codex CLI 主要面向 OpenAI 模型,Gemini CLI 面向 Gemini 模型;Aider 和 OpenHands 不绑定模型,支持任意 LLM via API。第三,免费这件事,Aider 和 OpenHands 本身免费开源,你只需为自己的 API 调用付费;Gemini CLI 有免费额度;Claude Code 和 Codex CLI 主要靠订阅。

三、横向对比:六个维度摊开看

把官方描述摊开,按六个维度对一遍。这张表是基于官方文档与公开描述的代表性对比,非亲自压测。

维度Claude CodeCodex CLIGemini CLIAiderOpenHands
模型支持Anthropic 专属OpenAI 为主Gemini 专属任意 LLM via API任意 LLM via API
开源状态闭源开源(Apache-2.0)开源(Apache-2.0)开源(Apache-2.0)开源(MIT)
Git 集成最强(核心特性)
自主执行命令是(agentic)有限是(最强自主性)
多模型切换有限是(核心特性)
上手门槛中(需订阅)低(ChatGPT 用户即用)低(有免费额度)中(需配 API Key)中高(需配环境)

注意几个对不上的地方:Claude Code 虽闭源但 agentic 能力公认最强,能规划、编辑、执行命令、调用工具链;Aider 的"git 集成"不是普通的支持 git,而是把 git commit 作为核心工作流,每次改动自动 commit,可回滚,diff 可追溯;OpenHands 的"自主性"指它能像 agent 一样自己拆解开发任务、写代码、跑测试、修 bug,前身是 OpenDevin。Codex CLI 用 Rust 写的,轻量是它的卖点。Gemini CLI 的最大优势是 Google 给的免费额度。

四、逐个拆:五款各自的最佳射程

Claude Code:agentic 深度最强,Anthropic 生态用户的首选

Claude Code 是 Anthropic 官方的终端编程 agent。它不是代码补全工具,而是一个能规划任务、编辑多文件、执行终端命令、调用工具链的 agentic agent。你在终端里用自然语言描述需求,它自己拆解步骤、改代码、跑测试。绑定 Anthropic 模型(Claude Sonnet/Opus 系列),通过 Claude Pro/Max 订阅或 Anthropic API 计费。

它押的宝是"agentic 深度加 Anthropic 模型"。对已经在用 Claude 模型的团队,Claude 的长上下文和推理能力是第一梯队,Claude Code 把这些能力直接接进了终端工作流。代价是:闭源、模型不可替换、订阅制、没有免费档。

适合谁:已经在用 Anthropic API 或 Claude 订阅的开发者、需要深度 agentic 能力的团队、做复杂多步重构的场景。想要模型自由或开源的看其他几款。

Codex CLI:轻量快速,OpenAI 生态用户的首选

Codex CLI 是 OpenAI 官方的终端编程 agent,仓库 openai/codex,约 103,495 star,用 Rust 编写,Apache-2.0 开源。官方描述是"Lightweight coding agent that runs in your terminal"。通过 ChatGPT 订阅或 OpenAI API 计费。

它押的宝是"轻量加 OpenAI 生态"。Rust 写的,启动快、占用低;ChatGPT 订阅用户可以直接用,不用额外配 API Key。开源也意味着你可以审计和定制。代价是:模型主要面向 OpenAI 系列(虽然开源,但深度优化在 OpenAI 模型上)、agentic 自主性不如 Claude Code 和 OpenHands、git 集成不如 Aider 深。

适合谁:ChatGPT 订阅用户、OpenAI API 开发者、喜欢轻量工具的开发者、要开源但不想折腾模型配置的人。

Gemini CLI:免费额度最大方,Google 生态用户的首选

Gemini CLI 是 Google 官方的终端编程 agent,仓库 google-gemini/gemini-cli,约 106,324 star,TypeScript 编写,Apache-2.0 开源。官方描述是"An open-source AI agent that brings the power of Gemini directly into your terminal"。通过 Gemini API 计费,有免费额度。

它押的宝是"免费额度加 Gemini 模型"。Google 给的免费额度是五款里最大方的,个人开发者可以零成本上手。开源、TypeScript 写的便于定制。绑定 Gemini 模型,长上下文是 Gemini 的强项。代价是:模型不可替换、agentic 深度不如 Claude Code、社区生态不如 Aider 和 OpenHands 成熟。

适合谁:预算有限的个人开发者、Google 生态用户、想零成本试水终端 agent 的新手、需要超长上下文的场景。

Aider:git 集成最强,多模型玩家的首选

Aider 是开源社区维护的终端 AI 编程助手,仓库 Aider-AI/aider,约 47,897 star,Python 编写,Apache-2.0 开源。官方描述是"aider is AI pair programming in your terminal"。本身免费开源,你只需为自己的 LLM API 调用付费。

它押的宝是"git 集成加模型自由"。Aider 把 git 作为核心工作流:每次 AI 改动自动 commit,你可以随时回滚、查看 diff、对比版本。更关键的是它不绑定任何模型,Claude、GPT、Gemini、DeepSeek、本地模型,只要你能拿到 API Key,Aider 都能接。这让它在多模型玩家眼里是无可替代的。代价是:agentic 自主性不如 Claude Code 和 OpenHands(更像 pair programming 而非自主 agent)、需要自己配 API Key、Python 环境依赖。

适合谁:多模型玩家、重视 git 版本控制的开发者、想用不同模型做 A/B 对比的人、不想被任何厂商绑定的人。

OpenHands:自主开发 agent,要做完整开发任务的首选

OpenHands 是开源社区维护的自主开发 agent,仓库 OpenHands/OpenHands,约 82,962 star,TypeScript 编写,MIT 开源。前身是 OpenDevin。官方描述是"AI-Driven Development"。本身免费开源,你只需为自己的 LLM API 调用付费。

它押的宝是"自主开发加开源"。OpenHands 的定位不是 pair programming,而是自主开发 agent,给它一个开发任务,它自己拆解、写代码、跑测试、修 bug,目标是交付完整任务。这和 Qwen3.8-Max 自主编程十数天的方向同向。不绑定模型,支持任意 LLM via API。MIT 许可是五款里最宽松的。代价是:上手门槛最高(需要配环境、配模型、理解 agent 工作流)、调试体验仍在完善、对简单任务可能"杀鸡用牛刀"。

适合谁:要 agent 自主完成完整开发任务的团队、开源社区贡献者、需要最宽松许可证(MIT)的项目、探索 agent 自主开发前沿的人。

五、选型决策树:四个身份对号入座

别看热度选,看你的身份和活是什么。给四个高频身份的决策路径,直接对号入座。

身份一:个人开发者/预算有限。 你是一个人开发,不想花太多钱,想试试终端 agent。选 Gemini CLI,免费额度最大方,零成本上手。想完全免费(只花 API 费)选 Aider,配个 DeepSeek 或 Gemini API Key,成本极低。

身份二:企业/团队。 你的团队要统一工具链,重视稳定和支持。选 Claude Code,Anthropic 生态的 agentic 深度最强,订阅制便于团队管理。已用 OpenAI 生态选 Codex CLI。

身份三:多模型玩家。 你手里有多个模型的 API Key,想在不同模型间切换对比。选 Aider,模型自由是它的核心特性。想要更高自主性选 OpenHands,同样不绑定模型。

身份四:开源/自主开发探索者。 你关注 agent 自主完成完整开发任务的能力,想用最宽松的开源许可证。选 OpenHands,MIT 许可、自主开发 agent 定位。重视 git 工作流选 Aider。

还有几个常见组合。一是 Claude Code 做复杂任务加 Aider 做日常改动,深度和灵活性兼顾。二是 Gemini CLI 做免费实验加 Codex CLI 做正式产出,先试后正式。三是 OpenHands 做自主开发加 Aider 做 git 回滚兜底,agent 出错时有退路。终端 agent 不是单选题,按身份配组合更现实。

六、四个避坑:模型绑定陷阱、免费额度限制、自主性边界、安全红线

第一,模型绑定是最大的隐形坑。"终端编程 agent"这五个字掩盖了巨大的模型差异。Claude Code 只能用 Anthropic 模型,Gemini CLI 只能用 Gemini,Codex CLI 主要面向 OpenAI。如果你的任务恰好不适合某个模型,工具再好也白搭。Aider 和 OpenHands 不绑定模型,是唯一的"模型自由"选项,但需要你自己配 API Key 和选模型。

第二,免费额度的限制是隐形坑。Gemini CLI 的免费额度有用量限制;Aider 和 OpenHands 本身免费但 API 调用要花钱;Claude Code 和 Codex CLI 主要靠订阅。免费能试水,但严肃使用几乎都要付费。别指望白嫖 agent。

第三,自主性边界是认知坑。终端 agent 的"自主"不是"全自动"。Claude Code、OpenHands 虽然能自主规划和执行,但仍然需要人类审查和确认。Aider 更偏 pair programming 而非自主 agent。把 agent 当成"按一下就交付完整项目"的工具会踩坑,它放大人的效率,不替代人的判断。

第四,安全是硬红线。终端 agent 能执行命令、改文件、跑代码,这意味着它能造成实际破坏。在生产环境用 agent 必须做好沙箱隔离、权限控制、代码审查。开源工具(Aider、OpenHands、Codex CLI、Gemini CLI)可以审计代码,闭源工具(Claude Code)需要信任厂商的安全实践。以各工具安全文档为准,生产环境务必做好防护。

FAQ

Q:哪个免费能玩? A:Gemini CLI 有 Google 提供的免费额度,个人开发者可以零成本上手。Aider 和 OpenHands 本身免费开源,你只需为自己的 API 调用付费(配一个便宜的模型 API Key,成本极低)。Claude Code 和 Codex CLI 主要靠订阅(Claude Pro/Max 或 ChatGPT 订阅),没有完全免费的档位。

Q:哪个适合企业? A:Claude Code 的 agentic 深度最强,订阅制便于团队统一管理,适合已经在用 Anthropic 生态的企业团队。已用 OpenAI 生态的企业选 Codex CLI。要完全开源和自主可控选 OpenHands(MIT 许可,最宽松)。

Q:哪个改 git 文件最稳? A:Aider。它把 git 作为核心工作流,每次 AI 改动自动 commit,可随时回滚、查看 diff、对比版本。其他四款都支持 git,但 Aider 的 git 集成是最深的。OpenHands 在自主开发任务中也会管理代码版本,但定位不同。

Q:多模型支持哪家强? A:Aider 和 OpenHands。两者都不绑定任何模型,支持任意 LLM via API,Claude、GPT、Gemini、DeepSeek、本地模型都行。Aider 尤以模型切换和对比为特色。Claude Code、Codex CLI、Gemini CLI 分别绑定各自厂商的模型,不可替换。

Q:新手选哪个? A:预算有限选 Gemini CLI(免费额度最大方,零成本上手)。已有 ChatGPT 订阅选 Codex CLI(直接能用,不用额外配置)。想要模型自由选 Aider(配一个 API Key 即可)。新手不建议直接上 OpenHands,上手门槛最高。

看法

终端编程 agent 在 2026 年正处于从"新鲜玩具"到"生产力工具"的转折点。五款工具代表了五种路线:Claude Code 走的是"闭源深度绑定"路线,用最强的 agentic 能力换你的生态锁定;Codex CLI 走的是"轻量开源"路线,用 Rust 和 OpenAI 生态换你的订阅;Gemini CLI 走的是"免费引流"路线,用免费额度换你的 Google 生态入门;Aider 走的是"git 原生"路线,用版本控制和模型自由换你的社区忠诚度;OpenHands 走的是"自主开发"路线,用 agent 自主性和 MIT 许可换你的探索参与。

编程 agent 正从"补全"走向"自主交付完整任务",与 Qwen3.8-Max 的自主编程定位同向。但无论 agent 多强,人类审查仍是最后一道关。选工具的真正标准不是哪个最强,而是哪个最匹配你的工作流和生态。想清楚你用什么模型、做什么任务、要不要开源、预算多少,答案自然就出来了。


代表性对比声明:本文是基于各工具官方文档、GitHub 仓库与公开信息做的代表性对比,非亲自压测。star 数和许可证经 GitHub API 于 2026-08-03 核实,定价和功能随时可能变动,以各工具官网最新说明为准。文中对能力的定性判断基于公开描述和社区反馈,不代表本站实测结论。

参考来源

本文由 AI 辅助生成,经人工审核编辑。最后更新:2026-08-03

常见问题

哪个免费能玩?
Gemini CLI 有 Google 提供的免费额度,个人开发者可以零成本上手。Aider 和 OpenHands 本身免费开源,你只需为自己的 API 调用付费(配一个便宜的模型 API Key,成本极低)。Claude Code 和 Codex CLI 主要靠订阅(Claude Pro/Max 或 ChatGPT 订阅),没有完全免费的档位。
哪个适合企业?
Claude Code 的 agentic 深度最强,订阅制便于团队统一管理,适合已经在用 Anthropic 生态的企业团队。已用 OpenAI 生态的企业选 Codex CLI。要完全开源和自主可控选 OpenHands(MIT 许可,最宽松)。
哪个改 git 文件最稳?
Aider。它把 git 作为核心工作流,每次 AI 改动自动 commit,可随时回滚、查看 diff、对比版本。其他四款都支持 git,但 Aider 的 git 集成是最深的。OpenHands 在自主开发任务中也会管理代码版本,但定位不同。
多模型支持哪家强?
Aider 和 OpenHands。两者都不绑定任何模型,支持任意 LLM via API,Claude、GPT、Gemini、DeepSeek、本地模型都行。Aider 尤以模型切换和对比为特色。Claude Code、Codex CLI、Gemini CLI 分别绑定各自厂商的模型,不可替换。
新手选哪个?
预算有限选 Gemini CLI(免费额度最大方,零成本上手)。已有 ChatGPT 订阅选 Codex CLI(直接能用,不用额外配置)。想要模型自由选 Aider(配一个 API Key 即可)。新手不建议直接上 OpenHands,上手门槛最高。

相关文章