用了半年AI编程,我承认之前太乐观了

 

半年前,我也真的相信"AI让我效率翻倍"。直到那个相亲App的聊天窗口一点就白屏,直到改老代码改一处崩两处,直到我发现花在"改AI写的代码"上的时间,比自己写还多——我才承认:之前,确实太乐观了。

最近半年,AI编程工具的热度越来越高。Copilot、Cursor、各种Agent编码产品轮番上阵,朋友圈里隔三差五就有人晒"十分钟写完一个项目""AI帮我重构了整个系统"。

笔者也是这波浪潮的早期参与者。从最初的兴奋,到后来的逐渐冷静,经历了一个完整的心理周期。今天想聊聊这半年的真实感受——我们对大模型在开发中的提效能力,确实高估了。

不是它不行,而是我们期望它行的地方,和它实际能行的地方,存在错位。

📌 核心观点(建议做成引用卡片)

  • 首版"能跑通" ≠ "能用",中间隔着从 60 分到 90 分的打磨;
  • 真正的成本在维护,而维护恰恰是 AI 最弱的地方;
  • 大模型没有"系统观",只能做到局部最优;
  • 整体提效没传闻中夸张——个人体感约在 10%–20%。

一、首版确实能跑通,但"能跑通"和"能用"是两回事

先说大模型确实做得不错的地方。

给它一个明确的需求描述,比如"写一个用户注册接口,包含参数校验、密码加密、JWT生成",它大概率能给你一个可运行的版本。甚至一些中等复杂度的功能,比如 OAuth 对接、消息队列消费者、简单的 CRUD 后台,它都能写得像模像样。

笔者自己也经历过这种时刻。昨晚用 WorkBuddy 试着开发一个相亲App,从需求输入到前后端代码生成,全部完成只花了 1 小时 26 分钟。看着界面上能跑起来的匹配逻辑、用户资料页、聊天窗口,心里确实有一瞬间的震撼——这也太快了。

但问题在于,"能跑通"和"能用"之间,隔着一道巨大的鸿沟。

拿那个相亲App来说。它确实跑起来了,但仔细一看:类命名乱七八糟,UserHandler、MatchProcessor、ChatManagerV2 混在一起,完全看不出命名规范;错误处理是空的,点一下异常路径整个页面白屏;数据库表设计没有索引,数据量一上去查询直接卡死;更别提什么单元测试、日志记录、性能监控了。

这些不是 AI"想不到",而是它没有办法知道你的具体上下文。你的系统架构、团队规范、业务边界条件、部署环境限制——这些都需要人来补。

所以首版代码的真实状态是:它给了你一个 60 分的起点,但从 60 分到 80 分、再到 90 分,花的时间可能和你自己从头写差不多。

更准确地说,AI 帮你省掉的是"从零到一"的重复劳动;但真正让代码上线、让系统稳定的,是后面那些琐碎的、需要上下文理解的打磨。这部分,AI 帮不上太多忙。

二、维护才是噩梦的开始

如果说首版生成只是"不够完美",那后续维护就是"让人崩溃"。

笔者有过这样的经历:三周前让 AI 写了一个模块,当时跑通了就没细看。现在需求变更,需要加新功能。打开代码,发现问题不少。

第一,看不懂。AI 生成的代码,风格往往和团队现有代码不一致。变量命名习惯不同,抽象方式不同,错误处理模式不同。你团队用 Strategy 模式处理多态,AI 给你写一堆 if-else;你团队用 Result 类型处理错误,AI 给你 try-catch 然后 return null。

这种不一致,首次生成时还能接受。但当代码量积累起来,维护成本就开始指数级上升。就像那个相亲App里的命名混乱:UserHandler、MatchProcessor、ChatManagerV2——为什么有个 V2?V1 去哪了?为什么不叫 UserService、MatchingService、ChatService 保持统一?这些命名背后没有规范、没有约束,完全是 AI"想到哪写到哪"。三个月后你自己再看,都得愣半天。

第二,改不动。你想在 AI 生成的模块上加个功能,发现它的内部耦合很奇怪。几个本应分离的职责被揉在一个函数里,一些本应提取常量的魔法数字散落各处。你试图重构,改了一处,另外两处就坏了。

这时候你会意识到,AI 生成的代码缺少"可维护性"这个维度。它不会主动想"这段代码三个月后还有人能看懂吗",它的目标是"让这段代码在当前测试用例下通过",而不是"让这段代码在长期演进中保持健康"。

第三,不敢删。AI 有时候会生成一些看起来有用、但实际没被调用的代码——多余的抽象层、过度的设计模式、冗余的中间转换。你知道没必要,但不敢删,因为不确定删了会不会影响隐藏的依赖。

于是代码就这么臃肿下去,直到某天新人接手,对着这堆代码骂娘。

三、问题的本质:AI 没有"系统观"

为什么会出现这些问题?核心原因在于,大模型没有"系统观"。

什么是系统观?就是一个有经验的开发者写代码时,脑子里装着整个系统的样子:这个模块的上游是谁、下游是谁,这个接口的调用方有哪些,这个数据结构的演进历史,这个业务逻辑背后的妥协是什么。

这种"系统观"不是看几行代码能获得的,它是长期参与项目、读文档、参加评审、处理线上问题积累出来的。AI 没有这个过程。它每次生成代码,都是从零开始理解你的需求,而不是在你的系统上下文里"生长"出一段代码。

举个更工程化的例子:一次线上故障排查。一个有系统观的工程师看到报错,能顺着调用链、结合最近的发布记录、想到某个历史遗留的"临时方案",很快定位根因。而让 AI 帮你修这个 bug,它只能在当前文件的上下文里做局部修补——它不知道上周那次"临时加的开关",也不知道隔壁团队刚改过的接口契约。补完这边,那边又裂了。

所以 AI 写代码的方式,本质上是局部最优的。它在每个函数、每个模块的层面做得不错,但跨模块的协调、跨时间的演进、跨团队的协作,它顾不了。

而软件开发的真正难点,恰恰不在单个函数怎么写,而在系统的演进和维护。

四、提效的真实数字,可能没那么好看

很多文章喜欢说"AI 编程提效 50%""开发效率翻倍"。笔者对这些数字持怀疑态度。

首先,这些数字怎么来的?多数是"首版代码生成时间"的对比。以前写个 CRUD 要两小时,现在 AI 十分钟生成,于是"提效 12 倍"。但 CRUD 只是开发工作的一小部分。调试、联调、评审、处理边界情况、写单测、处理线上告警、重构老代码——这些占据开发者大部分时间的工作,AI 提效非常有限。

其次,"生成快"不等于"交付快"。你花十分钟让 AI 生成代码,但花两小时 review、修改、补全、测试。总时间可能比自己写还长。特别是有经验的开发者,对代码质量要求更高,改 AI 代码的时间可能更多。

更现实的是,这种"首版快"的表象,反而可能给你挖坑。

笔者有个做后端的朋友就遇到过。他用 AI 工具快速完成第一版,代码跑通了,demo 也很顺。领导一看:"不错啊,两天就搞定了。"然后进入第二阶段,需求细化、边界暴露、性能问题出现。这时候改起来就慢了,一个 bug 追半天,一个重构动好几个文件。

领导不理解了:"第一版这么快,怎么后面这么磨叽?是不是在摸鱼?"

朋友有苦说不出。他总不能说"第一版是 AI 写的,我根本没理解透,现在改起来比从头写还难"吧?

这种"首版快、后续慢"的节奏,和软件开发本身的规律相悖。正常项目,前期设计评审花时间多,编码阶段相对稳定;AI 介入后,前期编码被压缩,后期维护、调试、重构时间反而被拉长。总时间未必减少,只是成本转移了——从"写代码"转移到了"改代码"。

⚠️ 说明:下面是我个人半年下来的体感估算,不是严谨的统计数据,仅供参考。

我的体感是:对熟悉的、重复的、模式化的任务,AI 确实能省时间,大概提效 30%–50%;但对需要深度理解业务、涉及复杂系统交互、需要长期维护的任务,AI 提效接近于零,甚至可能是负的——因为你还得花时间理解它写的东西。综合下来,整体开发效率提升,可能在 10%–20% 之间。没有传说中那么夸张。

五、不是 AI 不行,是我们的期望错了

写到这里,想强调一点:这不是在否定 AI 编程的价值。它在代码补全、快速原型、学新框架、生成样板代码这些场景下确实很好用。

问题出在期望上。

行业里有一种叙事,暗示 AI 正在"取代程序员""让开发变简单"。这种叙事制造了过高的期望,然后让很多人在实际使用后产生落差。

但软件开发从来不只是一个"写代码"的问题。需求理解、架构设计、系统演进、团队协作、质量保障、运维监控——这些才是软件工程的主体。AI 目前能做的,只是"写代码"环节里的部分工作。

把"写代码"等同于"软件开发",就像把"砌砖"等同于"建筑工程"。砌砖确实重要,但建筑学的核心是设计、结构、材料、环境、功能的综合考量。

六、一些务实的建议

最后,分享几点这半年摸索出来的务实用法。

把 AI 当"打字员",不当"架构师"。你已经想清楚要写什么了,让 AI 帮你快速敲出来。但设计决策、架构选择、模块划分,还是得你自己来。

首版生成后,花足够时间 review。不要因为它"能跑通"就直接提交。逐行看,理解每一行的意图,检查边界条件,确认和现有系统的一致性。这个时间不能省。

维护阶段谨慎使用 AI。老代码修改、跨模块重构、涉及业务逻辑的调整,AI 容易引入新问题。这些场景,自己写可能更可控。

保持自己的编码能力。不要因为有了 AI 就放弃练习。你需要保持对代码的敏感度和判断力,否则连 AI 写的代码好不好都看不出来。


写在最后

大模型是好工具,但工具就是工具。它不会取代开发者对系统的理解、对质量的追求、对业务的洞察。

我们这代人赶上了 AI 浪潮,应该学会用好它,但不该被它的神话裹挟。认清它能做什么、不能做什么,才能在实践中真正发挥它的价值。

过度乐观和过度悲观一样,都会让人做出错误的判断。

笔者选择诚实地写下这些感受,因为我相信:只有正视工具的局限,才能真正用好工具。

共勉。

 


如果这篇对你有启发,欢迎点个「在看」,或把你的真实体感留在评论区——这半年,AI 到底帮你提效了多少?

posted @ 2026-08-22 11:51  草原狼666  阅读(9)  评论(0)    收藏  举报