五个终端 Agent 同日发版:2026 下半场的战争在终端里打
9 月 30 日,Copilot CLI、Claude Code、Antigravity CLI、Kiro CLI 同日发版,加上前一天的 Gemini CLI 和 Codex CLI v0.159 系列——五个终端 Agent 挤在 48 小时内更新。这不是巧合,是"终端优先"变成全行业共识的证据。这篇盘点最重要的版本(Codex 0.159 的关键词是"控制"),再聊聊为什么 2026 下半场所有大厂都在往终端里砸资源。

9 月 30 日这天,终端 Agent 圈发生了一件挺魔幻的事:五个 CLI 在同一天发版。GitHub Copilot CLI v1.0.90、Claude Code v2.1.286、Antigravity CLI v1.2.14、Kiro CLI v2.26.0——全是 9 月 30 日;Gemini CLI v0.62.0 和 Codex CLI 的 v0.159 系列(9 月 29 日连发 0.159.0/0.159.1/0.159.2,30 日再跟 0.159.3)紧挨着。这不是约好的,这是"终端优先"已经变成全行业共识的证据。
这篇盘点这场"发版潮"里最重要的几个版本,再聊聊:为什么 2026 年下半年,所有大厂都在往终端里砸资源?
先看 Codex CLI 0.159:关键词是"控制"
9 月 29 日的 rust-v0.159.0 是个"终端工作流"版本,核心就一个主题:让用户在 AI 干活的时候更有控制感。instant_interrupt(打断正在回复的 AI 并转向)、更安全的沙盒(已批准命令的文件系统保护收紧)、draft recovery(长会话崩了能找回草稿)、更好的 Mermaid 渲染和 transcript 导航。
注意这个版本的定性:它不承诺"更智能",承诺"更可控"。ChatGPT AI Hub 的评价很到位——这是一个"开发者体验和控制面"的更新,而不是"agentic coding 已经安全了"的证明。OpenAI 的措辞也很谨慎:"steer"(引导)不等于"撤销文件变更"、"验证正确性"、"回滚半执行计划"。保守的解读是:交互控制变好了,但 Git 检查点、权限边界、diff review、回滚流程这些工程纪律,一点都不能少。
有意思的是发版节奏:9 月 28 日 v0.158.0,29 日连发三个 0.159.x,30 日再来个 0.159.3。Havoptic 的统计说 Codex CLI 在 2026 年发了 99 个版本,平均 2.6 天一个——终端 Agent 的迭代速度,已经超过了传统软件,进入了"按天发版"的时代。
其他四家:各走各的路
Claude Code v2.1.286(9 月 30 日):走"稳定"路线。从 9 月的更新轨迹看(2.1.277 支持 AGENTS.md、2.1.280 默认 Opus 5.5、2.1.281 修稳定性),Anthropic 的策略是"高频小步、绝不翻车"。终端 Agent 一旦崩了丢的是用户几小时的工作,所以 Claude Code 把"不丢东西"放在"多新功能"前面——这是 toB 思维。
GitHub Copilot CLI v1.0.90(9 月 30 日):走"生态"路线。Copilot 的优势从来不是单点功能最强,是"我在哪你在哪"——VS Code、JetBrains、CLI、Slack、Teams 全覆盖。CLI 只是它拼图里的一块,但对终端重度用户来说,"不用换工具就能用 Copilot"本身就是理由。
Antigravity CLI v1.2.14(9 月 30 日):走"Google 一体化"路线。Google 在 9 月砍掉了 Gemini CLI 的个人版,全力推 Antigravity(CLI + Desktop + Cloud + SDK 统一体)。它的差异化是"一次配置处处生效"——hook 写一次,四个端都管用。代价是模型锁定:基本只有 Gemini 可选。
Kiro CLI v2.26.0(9 月 30 日):走"后发差异化"路线。Kiro 的背景是 AWS 系,spec-driven 开发是它的标签。在巨头们拼"控制"和"稳定"的时候,它赌的是"方法论"——用 spec 把需求先写清楚,再让 Agent 干。这条路子和 vibe coding 的"一句话开干"是反着的,但企业客户吃这一套。
为什么都在卷终端?三个原因
第一,终端是 Agent 的"最高权限区"。IDE 里 Agent 的动作是受限的(插件 API 的沙盒),终端里 Agent 几乎无所不能:读写文件、跑命令、调网络、起服务。Agent 越自主,越需要直接操作机器——终端是离"真正干活"最近的地方。谁占领了终端,谁就占领了 Agent 的"手"。
第二,终端用户是付费意愿最强的人群。重度终端用户 = 资深工程师 = 团队技术决策者。拿下他们,等于拿下团队的选型话语权。Pro 500($500/月)这种定价,目标用户画像就是这群人——"靠快吃饭"的现场演示、live coding、高频重构。
第三,终端是"可观测性"最好的地方。所有命令都有输出,所有文件变更都能 diff,所有网络请求都能抓包。对比之下,IDE 里的 Agent 操作很多是"黑盒"的。2026 年下半场的主题是"可信",而终端天生更可信——看得见、能审计、好回滚。
给你的三条实操建议
第一,别只装一个 CLI,全装上,但只深度用一个。五个 CLI 的安装成本都很低(npm/winget 一行命令),全装上花不了 10 分钟。然后选一个主力深度用一个月,其他的留着对比。选型的依据不是功能列表,是"它搞砸的时候,你花了多久恢复"——恢复成本才是终端 Agent 的真实价格。
第二,把"打断"练成肌肉记忆。0.159 的 instant_interrupt 代表了一个趋势:好的终端 Agent 一定支持随时打断和转向。养成习惯:Agent 跑超过 30 秒没输出你想要的东西,直接打断,别等。你的时间比它的 token 贵。
第三,终端 Agent 的配置文件,进版本库。不管是 AGENTS.md、settings.json 还是 hooks 脚本,都应该和代码一起进 git。换机器、换工具、团队协作,配置跟着走。这是 9 月 18 日 Claude Code 支持 AGENTS.md 那篇(art14)讲过的道理,这里再强调一次:配置即资产,资产进仓库。
五家 CLI 对照:选型看这张表
把五家放在一张表里看,差异一目了然:
- Codex CLI:模型 GPT-6.1 Sol/Astra(OpenAI 全家桶);强项是"控制"(instant_interrupt、沙盒、draft recovery);发版节奏最快(2.6 天一个版本);适合"天天用、想尝鲜"的人。风险:发版太快,偶尔有 regression。
- Claude Code:模型 Claude 全家桶(Opus/Sonnet 5.5);强项是"稳定"(高频小步、绝不丢东西);AGENTS.md 兼容;适合"靠它吃饭、丢不起工作"的人。风险:模型选择少,不用 Claude 就别来。
- Copilot CLI:模型多(GPT、Claude,按 Pro 500 的档位);强项是"生态"(VS Code/JetBrains/CLI 全覆盖);适合"已经在 GitHub 全家桶里"的人。风险:单项都不极致,适合"够用党"。
- Antigravity CLI:模型基本只有 Gemini;强项是"一体化"(hook 写一次四端生效);适合"Google 生态重度用户"。风险:模型锁定最严重,Argon 开放前旗舰模型用不上。
- Kiro CLI:模型 AWS 系;强项是"方法论"(spec-driven);适合"企业级流程、要审计"的团队。风险:社区最小,遇到问题能抄的作业最少。
一句话选型:个人极客选 Codex,靠谱干活选 Claude Code,全家桶用户选 Copilot,Google 信徒选 Antigravity,企业流程选 Kiro。没有银弹,只有"最适合你工作流"的那个。
终端 Agent 选型决策树:三问定去留
别被功能列表淹没,三个问题就能定:
第一问:你最常用的模型是哪家?CLI 只是"壳",模型才是"芯"。你主力用 GPT,就在 Codex/Copilot 里选;主力用 Claude,Claude Code 是唯一答案;主力用 Gemini,Antigravity。先有芯,再选壳——反过来会很痛苦。
第二问:你能接受的最大"搞砸成本"是多少?如果 Agent 删错一个文件,你的损失是"半小时"还是"半天"?前者选 Codex(激进、尝鲜),后者选 Claude Code(保守、稳定)。选型的本质不是选功能,是选"你和它之间的信任协议"。
第三问:你的协作半径有多大?一个人用,选你最爽的;团队用,选"配置能进仓库、行为可审计"的(Claude Code、Kiro 在这方面更成熟);给全公司推,选"有企业级支持"的(Copilot、Kiro)。协作半径越大,"个人喜好"的权重越低,"可管理性"的权重越高。
2026 Q4 预测:终端战争的三个走向
走向一:IDE 和终端的界限消失。Cursor 已经在推"Projects"(云端并行),终端 CLI 也在加"可视化"(Mermaid 渲染、富 transcript)。两边在向中间靠拢:未来的形态可能是"终端的执行力 + IDE 的可视化",谁先做出"无缝切换",谁就赢了下半场。
走向二:"打断"变成标配,"自动"变成卖点。0.159 的 instant_interrupt 只是一个开始。可以预见,每个 CLI 都会加上"随时打断、随时转向",然后竞争转向"不用打断"——Agent 一次做对的比例。2027 年的 benchmark,很可能从"任务完成率"变成"零打断完成率"。
走向三:企业级功能下沉到个人版。审计日志、SSO、权限管理——这些现在还是企业版专属的功能,会随着"可信"主题的推进,逐步下沉。独立开发者也能用上"准企业级"的终端 Agent。这对个人是好事,对"靠企业版赚钱"的厂商是压力。
一句话总结:9 月 30 日的"五 CLI 同日发版",不是巧合,是终端 Agent 战争进入白热化的发令枪。IDE 的战争打完了(Cursor、Windsurf、Copilot 各有地盘),下一场战争在终端里打——拼控制、拼稳定、拼生态。对用户来说这是好事:竞争越激烈,"可打断、可审计、可回滚"就越快变成标配。但记住,终端的权限越大,围栏就要越高。装之前,先把你的 AGENTS.md 写好,把沙盒打开,把重要分支保护起来。枪越快,越要先检查保险。
原始来源
相关文章

2026 年 10 月 7 日,Google Developers 发布 Developer Knowledge API 生态:Google Cloud、Firebase、Android 等官方文档变成程序化事实来源,配 gcloud CLI 入口、官方 Agent Skill(一行安装)、MCP server 和多语言客户端库。为什么「文档 API 化」能连根拔掉 vibe coding「模型记错 API」的经典翻车。

2026 年 10 月 7 日,GitHub 在 Changelog 宣布:Copilot CLI 1.0.94-0 起,/model 命令可发现本机 Ollama 里的模型,与云端模型并列可选。发现不等于自动接入,需手动确认;模型须支持工具调用与流式输出。同时官方预告了本地模型的智能路由,并明确:选本地模型不会关闭遥测,离线模式仍需显式设置 COPILOT_OFFLINE=true。

10 月 3 日,工程师 Kevin Liao 发表檄文冲上 HN 前页:记忆插件是一场 RAG 片段抽奖,Agent 需要的是文档工作区。本文拆解他的诊断、开源的 Operator Memory 插件、两个最强的反方质疑,以及今晚就能开始的最小实践。