一位开发者的实测:Cursor 和 Windsurf,到底谁更快交付?
一位开发者在同一个 TypeScript 仓库里,用同一套 5 个任务实测了 Cursor 和 Windsurf:从第一个 prompt 到 CI 通过计时。结论是 Cursor 赢在多文件编辑和模型阵容,Windsurf 赢在免费额度和 Cascade 的端到端规划。一份民间基准的 honest 拆解。

发生了什么:一场“民间基准测试”
10 月初,一位开发者在 DEV 社区发布了一篇 Cursor vs Windsurf 的实测对比。方法很实在:同一个 TypeScript 仓库、同一套 5 个任务(加带校验的 REST 接口、400 行组件拆 hooks、WebSocket 竞态调试、30 个包的配置文件迁移、给无测试的工具模块写单测),每个任务从第一个 prompt 计时到 CI 通过,还记录了“一次通过率”(直接接受 vs 手动调整 vs 拒绝)。
先说结论:Cursor 赢了大多数场景——多文件编辑更强、模型阵容更成熟(GPT-5.5、Claude Opus 4.7)、Tab 补全不挡路。Windsurf 的反击点是免费额度(无限补全、有限的 Cascade 点数)和 Cascade agent 的端到端任务规划。作者的建议很直白:整天泡在编辑器里就买 Cursor;想要 $0 体验像样的 agent 功能,从 Windsurf 起手。
价格现状(2026 年 10 月):Cursor Pro $20/月,Pro+ $60,Ultra $200,Teams $40/人/月;Windsurf Pro $15/月,Business $30/人/月。两家都是 VS Code fork,但哲学不同:Cursor 把 AI 当精密仪器(精准行内编辑、定向 chat、Composer 多文件),Windsurf 赌自主性(Cascade 跨整个会话保持上下文、按计划执行少打扰)。
为什么值得看:基准的价值不在排名,在方法
先泼冷水:这是 n=1 的民间测试,一个仓库、一个人,结果别当真理。但它的方法值得学——用自己的仓库、自己的任务、计时到 CI 通过,这才是选型该做的事。厂商 benchmark 都是精心挑选的任务,而你的代码库才是真正的考场。
另一个有价值的观察是两家的哲学分岔:Cursor 的“精准仪器”路线适合 already 知道要改什么的开发者;Windsurf 的“自主规划”路线适合把整段任务甩给 agent 的人。这其实对应了 vibe coding 的两种姿势——你是司机还是乘客。
我们怎么看:别抄结论,抄方法
这篇实测最大的用处不是告诉你买哪个,而是给你一套选型模板:拿你自己的仓库,定 3–5 个你天天干的任务,计时,记录一次通过率,跑两家。半天时间,比看十篇评测都有用。另外注意价格表里的细节:Cursor 的免费档 agent 请求有限,重度用很快烧完;Windsurf 的免费补全无限但 Cascade 点数有限——先看清自己的用量画像,再对号入座。
原始来源
相关文章

2026 年 9 月 30 日,Bitdefender 宣布 AI Guardian 进入公开 beta:给自主 AI Agent 加的安检门,每一次工具调用、文件访问、密钥使用都要先拿到 allowed / flagged / blocked 裁决。首批 macOS 独占、beta 期免费,支持 Claude Code 与 OpenClaw。为什么这道「Agent 行为防火墙」来得正是时候。

公网上的每个接口都会在某个深夜被超预期调用。这篇实战为一人团队搭建限流体系:算法选型(滑动窗口 vs 令牌桶)、四层防御、AI 接口烧钱专项防护、配额设计、429 响应规范、误伤排查,最后附上线检查清单。

10 月 3 日,Sites in ChatGPT 以约 209 点赞、218 评论冲上 HN 前页。这不是发布,而是一场清算:提示词直达 URL,到底是玩具、原型托管,还是生产力?四个争论焦点、文档实锤的技术事实(D1/R2、登录、自定义域名),以及给 vibe coder 的三个判断。