Devin 降价 30%-70%:Cognition 一边降价一边刷榜,$0.60/任务正在变成行业锚点
9 月 29 日,Cognition 宣布 Devin 全线降价:Fusion 与 Normal 模式降 30-40%,Devin Review 最高降 70%。同一周,Devin Fusion 在 FrontierCode 1.1 Extended 上拿下 68.8 分,平均每个任务只花 $0.60。刚宣布年化收入破 10 亿美元、刚融完 20 亿美元的公司选择降价,买的不是现金流,是定价话语权。

发生了什么:降价和刷榜在同一周发生
9 月 29 日,Cognition 宣布 Devin 全线降价:Fusion 和 Normal 模式降价 30%-40%,Ultra 模式降 15%-20%,Devin Review 最高降 70%。降价的理由不是促销,而是技术降本——更聪明的模型路由、工具调用合并、上下文缓存复用。
同一周,Cognition 公布了 Devin Fusion 在自家 FrontierCode 1.1 Extended 数据集上的成绩:68.8 分,平均每个任务成本 $0.60。Fusion 的思路是"主力+跟班"双模型架构:能力强的模型负责规划和终审,成本低的模型负责执行;再加上自家的 SWE-2 模型(从月之暗面的 Kimi K3 后训练而来),在 FrontierCode 1.1 主榜上拿到 50.0%,成本比 Fable 5.1 低 64%。
时间线值得注意:这次降价发生在 Bloomberg 披露 Cognition 年化收入突破 10 亿美元(四个月翻一番)、公司完成 20 亿美元融资、估值 480 亿美元之后不到一周。
为什么这次不一样:降价的不是一家卖不动的公司
商业常识是:降价通常意味着产品在能力上拼不过了,只能靠价格找补。Cognition 偏偏反着来——它刚刚证明了自己是 AI 编程赛道赚钱最快的公司之一,然后选择主动降价。
这只有一种解释:它买的不是现金流,是市场份额和定价话语权。一家刚融完 20 亿美元、ARR 破 10 亿的公司,降价不需要向任何人解释生存问题,它只需要在对手反应过来之前,把"便宜又强"的心智钉死。这是一种典型的"用 runway 换 share"的打法,而 Cognition 恰好两者都有。
技术上这次降价也站得住脚。Fusion 的"主力+跟班"架构本质上是把"贵模型的每一分钱都花在刀刃上":规划、消歧、终审用贵模型;探索代码库、写代码、修 lint、写测试用便宜模型。工具调用合并和缓存复用进一步压缩了重复推理。降本的每一分钱都来自工程优化,而不是补贴——至少 Cognition 是这么说的,而 68.8 分的基准成绩是它敢这么说的底气。
真正的杀招:$0.60/任务这个数字
但比降价本身更值得玩味的,是 Cognition 公开了一个数字:平均每个任务 $0.60。
GitHub Copilot 和 Cursor 至今都按"席位"收费:一个人头一个月多少钱。席位制假设的是"一个人类登录、一个月干固定量的活"。但 autonomous coding agent 的工作方式完全不是这样:它无人值守地跑,烧掉的 token 随着任务大小剧烈波动,厂商的真实成本也跟着每个底层模型调用上下浮动。席位制在这种工作模式下,本质上是在"拍脑袋定价"。
Cognition 的打法很简单:降价,同时公布一个"每个任务成本"的基准数字。这就给了企业采购一个可以拿去拷打所有厂商的锚点——"Devin 一个任务 $0.60,你们呢?"谁先定义"按任务计价"的参考点,谁就掌握了下一轮定价谈判的话语权。Copilot 有 470 万付费用户、Cursor 背靠 SpaceX,但在"每个任务多少钱"这个问题上,它们至今没有给出过对等的数字。
这也是为什么说"按任务/按产出付费"是 AI 编程的终局:当 agent 真的能独立交付一个 PR、一次迁移、一份代码评审时,按人头收费就显得荒谬。Cognition 只是在把终局提前。
给 vibe coder 的三个提醒
先说好消息:降价潮对个人开发者是利好。Devin 的 Core 档 $20/月+用量,降价后做中小任务的成本明显下来了;更重要的是,"成本透明化"正在变成行业惯例——以后选 agent 工具,你可以直接问三个问题:我的典型任务平均多少钱?失败重试的钱谁出?所谓的路由和缓存优化是真的工程,还是营销话术?
再说冷水。第一,FrontierCode 是 Cognition 自己的数据集,68.8 分是"自己出题自己考"。基准分可以参考,但别把它当成圣经——独立第三方复现之前,所有"第一名"都要打个折看。第二,$0.60 是"平均"每个任务,你的任务不是平均任务:一个中等规模的重构任务烧掉几十美元依然很常见,账要按自己的工作流算。第三,Devin Review 降 70% 听起来很香,但代码评审恰恰是"便宜没好货"风险最高的环节——省下来的钱如果换来的是漏掉的 bug,只会更贵。
一句话总结:Cognition 在用降价改写游戏规则,规则改写对买方永远是好事。但买之前,先算自己的账,别替厂商的基准分买单。
原始来源
相关文章

Gergely Orosz 走访 OpenAI、Anthropic、Cursor、Ramp 后写下的 2026 行业现状:近 100% 代码由 AI 生成、Agent PR 八个月涨近 10 倍、code review 沦为表演、IDE 被判为遗产产品。本文提炼报告要点,并给出 vibe coder 的三个判断与四件本周可做的事。

2026 年 10 月 8 日,Google Cloud 在 Gemini at Work 2026 大会上发布 Gemini agent:为工作而生的统一 Agent,拿目标自己规划、按任务在 Gemini 和 Claude 模型之间自动选择,并推出拥有独立邮箱、calendar 和通讯录席位的「同事 Agent」。四点判断:Agent 竞赛的下半场是「更像同事的 Agent」。

10 月 3 日,Sites in ChatGPT 以约 209 点赞、218 评论冲上 HN 前页。这不是发布,而是一场清算:提示词直达 URL,到底是玩具、原型托管,还是生产力?四个争论焦点、文档实锤的技术事实(D1/R2、登录、自定义域名),以及给 vibe coder 的三个判断。