你有没有过这种感觉——某个工具你用着它,但心里越来越不对劲?
我用的就是 Claude Code。一开始觉得真香啊,写代码比自己快多了。但用了三个月,问题一个接一个冒出来,最终我实在忍不了,自己动手写了个替代方案。
事情是这样的。
它给我的第一印象太好了
刚上手 Claude Code 那会儿,效率确实起飞。以前写个 CRUD 接口要半小时,现在跟它说两句就能出来。我一度觉得自己可以提前下班了。
![]()
但好景不长。用着用着,我发现一个特别让人抓狂的问题——这个家伙是个"单线程"的。
什么意思呢?举个例子,我要改三个文件,它们之间根本没啥依赖关系。正常来说,这事儿可以并行搞,多快啊。但它偏不,非要一个文件一个文件地慢慢处理。就像你去食堂打饭,明明有三个窗口都空着,它偏要排在一个窗口后面等着。
我一开始以为这是设计上的谨慎——先改完一个,确认没问题再改下一个。但后来我发现,根本不是这么回事。它的核心问题在于:没有真正理解任务之间的依赖关系。
说白了,它把所有任务都当成有前后依赖的线性链条。可实际开发中,很多任务明明是独立的。
"记忆"太好反而是个坑
再说第二个问题。
稍微复杂一点的任务,它就开始靠"记忆"硬撑。比如你让它改五个相关的模块,改到第三个的时候,它会把前两个的上下文搞混。最离谱的一次,我让它重构一个支付模块,它中间某一步理解错了,结果后面所有的改动全跑偏了——而且它自己完全没意识到,还在那自信地输出代码。
你要是用过这种 Coding Agent,你大概知道我在说什么。就是那种明明错了,但看起来很对的感觉。它不会停下来问你"这里我不确定",而是信心满满地给你一堆幻觉代码。
"每次都是初吻"
还有个让我血压升高的问题——重复的流程,它每次都从头开始。
比如说,我每周都要跑一遍测试-> 修 bug -> 重构 -> 再测试的流程。第一周它表现得还行。第二周,同样的流程,它又像第一次一样,一步一步来,完全没有复用之前的经验。
我就纳闷了:"咱们上周不是搞过一次吗?"
没用。它不记得。
后来我仔细想了想,这事儿其实不能怪它。Claude Code 本质上就是一个高级的"无状态"工具。每次会话都是新的,在它眼里世界永远是新鲜的。
压垮我的最后一根稻草
真正让我决定动手的,是一个线上事故。
那次我让它帮忙改一个数据迁移脚本,整个过程看起来一切正常。直到上线后,我发现有几万条数据对不上了——因为它在某一步执行失败后,后面的步骤全是幻觉代码,但看起来跟真的一样。
那次事故让我加了两天班。
我坐在工位上盯着屏幕发呆的时候想:这个工具明明很有潜力,但为什么用起来这么不踏实?
想来想去,我觉得问题出在架构上——它不知道什么任务可以并行,什么必须按顺序来,失败之后应该怎么办。它把这些逻辑全藏在了一个黑盒里。
所以我做了一个新的
![]()
与其继续抱怨,不如自己动手。
我花了两周时间,做了一个叫 Meta-Orchestrator 的东西。核心思路特别简单:用 DAG(有向无环图)来定义任务之间的依赖关系。
打个比方,你要是想装修房子,你不会让工人先贴瓷砖再走水电对吧?你得先走水电,再贴瓷砖,最后做美缝。这三件事有明确的先后顺序,不能乱。
但刷墙和铺地板呢?完全可以同时进行,互不影响。
就是这么个道理。明确依赖、并行执行、失败重试——这些都是软件工程里再基础不过的概念,但在 Coding Agent 里,它们被忽略了。
用了 DAG 之后,效果立竿见影。之前需要等十分钟的批量文件修改,现在三分钟就能跑完。更关键的是,每步都明确可追踪,失败了可以单独重试,不会影响其他正在进行的任务。
现在我把这个方案放出来了,GitHub 上搜 Meta-Orchestrator 就能找到。
一点小感慨
写了十几年代码,我发现一个规律:你最不爽的地方,往往就是你最该出手的地方。不要觉得工具就是这样,忍着用吧。很多时候,你觉得不对,那就是不对。
我现在依然用 AI 写代码,但心态不一样了——它是我手里的工具,不是我依赖的黑盒。
你有遇到过类似的情况吗?被某个工具坑过的经历,评论区聊聊。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.