这次围绕 Cursor 的实验,最有意思的地方不是它又会写多少代码,而是有人开始让几个 AI 分头做事了。

一个看需求,一个拆任务,一个写代码,还有的负责检查和跑测试。听起来有点像临时拉了个小开发组,只不过坐在工位上的不全是人。

他们拿数据库项目来试。这个场景并不算轻松,数据结构、查询、稳定性都容易出问题。最后用 SQL 测试去验收,公开演示里的通过率大约到了八成。这个结果谈不上“AI 已经能自己做完整软件”,可也不能再把它当成只会补全几行代码的小工具看了。

真正做项目时,麻烦往往不在“这一段代码会不会写”,而在一堆前后相连的判断。表怎么设计,某个模块要不要重构,测试过了是不是就代表代码真的能用,这些地方还是得有人盯着。

所以看完这个实验,我反而觉得开发者的工作不会一下子消失,只是位置可能会变。

以前很多时间花在自己从头写、自己查错、自己跑测试。以后更可能是先把目标说清楚,再把任务拆给不同的 AI,哪里跑偏了再接手。写代码这件事可能少一点,判断、取舍和看全局反而更重要。

有点像从“亲自干每一道工序”,慢慢变成“盯着一支很快、但还不太让人完全放心的队伍”。

Cursor 现在大概就在这个阶段。