返回笔记列表

我花了两周测试18个AI编程工具,最后选择了这3个

2026-06-18Marvis 实测Cursor对比测评AI IDECLI

我的测试方法论

在开始测试之前,我先定义了自己的工作和评判标准。我是一个全栈开发者,日常技术栈是 TypeScript + Next.js + PostgreSQL。每天编码 6-8 小时,涉及的场景包括:新功能开发(60%)、bug 修复(20%)、代码审查(10%)、重构(10%)。

我为每个工具设计了三个测试任务:

1.从零实现一个 REST API 端点(含数据库查询、参数校验、错误处理)
2.在已有代码库中修复一个涉及多个文件的 bug
3.阅读一个 500 行的陌生代码文件并解释逻辑

最终选定的三个工具

Cursor — AI IDE 核心主力

选 Cursor 的原因不是它某个功能最强,而是它最不打断心流。Tab 补全快到几乎无感知,Composer 模式在处理跨文件功能时省了大量时间。$20/月对于全职开发者来说,相当于每天不到 1 块钱。

适用场景:日常编码、新功能开发、全栈项目

Claude Code — 复杂任务攻坚

当 Cursor 的 Composer 开始「忘掉上下文」或者生成质量下降时,我会切到 Claude Code。它处理复杂后端逻辑的能力明显更强——API 设计更合理、错误处理更周全、代码注释更清晰。

适用场景:架构设计、复杂 API 开发、需要深度推理的任务

Aider — 终端里的快刀

做 bug 修复和小范围重构时,我不喜欢切 IDE。在终端里直接 aider,描述问题、看 diff、确认修改、自动 commit,整个过程流畅到上瘾。Git 原生集成是 Aider 最大的杀手锏。

适用场景:bug 修复、小范围重构、快速修改

一个试过但放弃的工具:Windsurf

Windsurf 的理念很好——「agentic IDE」,全程 AI 驾驶。但实测下来存在两个问题:一是 AI 代理的自主决策偶尔会出乎意料地修改不该改的文件;二是上下文理解在大型项目中不够稳定。它适合 demo 和小项目,但在生产级代码库中不够可靠。

关键心得

测试了 18 个工具后,我最大的体会是:不存在「最好」的工具,只有最适合你工作流的组合。不要被营销话术牵着走,先问自己三个问题:

1.你的主要开发场景是什么?
2.你愿意为这个工具改变多少工作习惯?
3.你的预算是多少?(免费工具在复杂任务上几乎都打不过付费的)

回答完这三个问题,你的选择范围会从 80+ 缩小到 3-5 个。剩下的就是试——每个至少用三天,然后凭感觉选。直觉往往比评测文章更准。

相关工具

Cursor

AI-first 代码编辑器,支持整项目上下文理解和多文件编辑。2026年AI编程工具收入第一,$2B ARR。