叫AI把按钮涂蓝,它写了迁移脚本跑50轮测试

叫AI把按钮涂蓝,它写了迁移脚本跑50轮测试

AICoding AgentClaude

数据源:HN讨论与社区实测

9月9日,网站 opusfived.dev 冲上 Hacker News 首页榜首。该页面一天内斩获 948 个赞。左侧是一个模拟电商页面,右侧提供与大模型的对话框。通关目标只有一个:「把加入购物车按钮改成蓝色,不要让 Claude 改动任何其他东西」。

当你输入改色指令后,Claude 确实把按钮变蓝了。但它顺手给样式表加了向后兼容的过渡类,编写了一套按钮迁移脚本。紧接着,它自动启动了一套 50 轮延迟压测系统来验证新按钮。大众读者把这当成人工智能犯傻的搞笑段子。代码补全工具底层的行为惯性在这里被放大了。这是判断边界失效的工程事故。

给零用户项目写迁移脚本

假设你接手一个两小时前刚建立的新项目。项目没有任何真实用户访问。产品经理要求修改核心数据字段名。人类程序员会调出全局替换功能。花上十秒钟就能解决问题,人类连回滚都不会多看一眼。

在模型的运行逻辑里,世界有着截然不同的运转方式。Hacker News 用户 MisterMunchkin 分享了实测经历。他要求模型重命名一个基础字段。模型不仅添加了新字段名,还以防御性编程姿态保留旧代码。它把旧字段的值硬编码保留在代码库接口中。它的理由看似专业——必须考虑万一有未知外部用户正通过 API 调用这个旧字段。

opusfived.dev挑战界面 图:opusfived.dev 挑战界面。来源:opusfived.dev

对新生项目展现出向后兼容责任感,是当前顶流模型的通病。开发者 dudeinhawaii 也被类似操作折磨。他想让模型快速糊一个初步的原型页面。模型自顾自地在后台搭建起高可用监控框架,对第一版应用进行 50 轮延迟测试。他不得不连续点击停止按钮。这个原型注定要推倒重写一百万次。单从这个行为看,模型对业务生命周期的判断力等同于零。

重构比打补丁省力

人类工程师面对需求变更时,脑海中会有一张成本核算表。一种路径是在原有代码上继续堆砌补丁。另一种路径是从第一性原理出发,评估全部推倒重来的工作量。高赞用户 stillpointlab 指出了工具的缺陷。优秀工程师会评估两种方案并比对成本。第一性原理视角的重构,往往比小心翼翼地打补丁工作量更小。

大模型目前还不具备这种跨维度的核算能力。模型在海量开源代码训练中形成了强依赖。它们倾向于将当前存在的一切代码视为既定事实。你要求修改 A 功能时,模型会调动算力担忧 B 功能用户受牵连。它最终交出一份长篇大论且满是兼容性妥协的保护代码。

任务场景人类工程师决策路径AI模型执行逻辑造成的工程后果
原型开发初期快速跑通核心逻辑建立完善的监控和自动化压测体系核心功能被海量周边脚手架代码淹没
重命名数据字段执行全局替换保留旧字段并编写兼容层代码代码库体积膨胀,后续维护成本上升
重构遗留模块寻找最优解锚定旧逻辑,增加条件分支打补丁模块复杂度失控,变异为无法阅读的黑盒

这套逻辑在快速迭代的新项目里就是制造技术债务的引擎。在代码重构较量中,模型选择了看似稳妥的添砖加瓦。无用的系统复杂性轻而易举地压垮了项目的可维护性。

免除向后兼容责任

模型分不清什么是需要严阵以待的线上链路,也分不清什么是玩具代码。开发者必须手动给它划定坚硬的物理边界。人类工程师不得不防范这个电子助手。

社区开发者 theshrike79 提供了实操解法。他在项目根目录放置了醒目的 PROJECT.md 文件,在头部大写加粗写明。这是一个单人项目,不需要考虑向后兼容,不需要防御性编程,不需要写单元测试。

opusfived.dev首页 图:opusfived.dev 首页入口。来源:opusfived.dev

一旦书面明确解除了模型的责任枷锁,它的表现立刻大幅转变。它像卸下重担一样变得松弛、敏捷且高效。对于大语言模型,这是一个必须用文字死死钉在项目根目录里的强制解除协议。他打了一个精准的比方。这就好像你拥有一台超级聪明的计算机,每天必须花费时间修筑栅栏,防止它跑出圈外强行帮忙。

高增益训练劈开阵营

这种过度热心,引发了社区阵营撕裂。一部分追求绝对控制权的开发者,果断放弃最新模型,转投 Codex 或底层工具怀抱。Codex 展现出了冰冷、克制且近乎外科手术式的精准执行力。老派程序员找回了丢失的代码掌控感。

站在底层训练视角的开发者看到了另一面。genxy 提出了反方观点。当前模型展现出的过度主动,正是高增益训练必然导致的结果。如果模型在训练阶段没有被塑造成充满干劲的样子。面对真正需要完整工程考量的复杂任务时,人类开发者每天都要花费精力去鞭策它干活。我们在享受开箱即用福利时,必然要承受它偶尔越界带来的冗余代码。两拨人的分歧是对代码库控制权让渡程度的分歧。

划定边界成为新必修课

当我们嘲笑先进模型为了蓝色按钮大动干戈时。我们正在直面编程范式的剧烈重组。模型不可能知道业务核心重点在哪里,因为它没有经历过为了活命而妥协质量的生死存亡。

从这场风波里可以发现,大模型写代码最明显的毛病在于过热的自驱力。它拥有着强大的算力,随时准备为连主流程都没跑通的草稿,构建一套支撑百年基业的微服务架构。人类工程师的核心价值正在发生转移。核心价值正在从「如何把正确的代码写出来」转移到「如何阻止系统被无用代码淹没」。

把该干的事毫无保留地交给机器,把不该干的边界清清楚楚地讲明白。让 AI 知道何时该动用工程思维,何时只需简单地把按钮涂蓝。这就是 2026 年用 AI 写代码的人必须掌握的新必修课。

参考链接:

  • HN 讨论 (item?id=49623754)