9月9日,网站 opusfived.dev 冲上 Hacker News 首页榜首。该页面一天内斩获 948 个赞。左侧是一个模拟电商页面,右侧提供与大模型的对话框。通关目标只有一个:「把加入购物车按钮改成蓝色,不要让 Claude 改动任何其他东西」。
当你输入改色指令后,Claude 确实把按钮变蓝了。但它顺手给样式表加了向后兼容的过渡类,编写了一套按钮迁移脚本。紧接着,它自动启动了一套 50 轮延迟压测系统来验证新按钮。大众读者把这当成人工智能犯傻的搞笑段子。代码补全工具底层的行为惯性在这里被放大了。这是判断边界失效的工程事故。
给零用户项目写迁移脚本
假设你接手一个两小时前刚建立的新项目。项目没有任何真实用户访问。产品经理要求修改核心数据字段名。人类程序员会调出全局替换功能。花上十秒钟就能解决问题,人类连回滚都不会多看一眼。
在模型的运行逻辑里,世界有着截然不同的运转方式。Hacker News 用户 MisterMunchkin 分享了实测经历。他要求模型重命名一个基础字段。模型不仅添加了新字段名,还以防御性编程姿态保留旧代码。它把旧字段的值硬编码保留在代码库接口中。它的理由看似专业——必须考虑万一有未知外部用户正通过 API 调用这个旧字段。
图:opusfived.dev 挑战界面。来源:opusfived.dev
对新生项目展现出向后兼容责任感,是当前顶流模型的通病。开发者 dudeinhawaii 也被类似操作折磨。他想让模型快速糊一个初步的原型页面。模型自顾自地在后台搭建起高可用监控框架,对第一版应用进行 50 轮延迟测试。他不得不连续点击停止按钮。这个原型注定要推倒重写一百万次。单从这个行为看,模型对业务生命周期的判断力等同于零。
重构比打补丁省力
人类工程师面对需求变更时,脑海中会有一张成本核算表。一种路径是在原有代码上继续堆砌补丁。另一种路径是从第一性原理出发,评估全部推倒重来的工作量。高赞用户 stillpointlab 指出了工具的缺陷。优秀工程师会评估两种方案并比对成本。第一性原理视角的重构,往往比小心翼翼地打补丁工作量更小。
大模型目前还不具备这种跨维度的核算能力。模型在海量开源代码训练中形成了强依赖。它们倾向于将当前存在的一切代码视为既定事实。你要求修改 A 功能时,模型会调动算力担忧 B 功能用户受牵连。它最终交出一份长篇大论且满是兼容性妥协的保护代码。
| 任务场景 | 人类工程师决策路径 | AI模型执行逻辑 | 造成的工程后果 |
|---|---|---|---|
| 原型开发初期 | 快速跑通核心逻辑 | 建立完善的监控和自动化压测体系 | 核心功能被海量周边脚手架代码淹没 |
| 重命名数据字段 | 执行全局替换 | 保留旧字段并编写兼容层代码 | 代码库体积膨胀,后续维护成本上升 |
| 重构遗留模块 | 寻找最优解 | 锚定旧逻辑,增加条件分支打补丁 | 模块复杂度失控,变异为无法阅读的黑盒 |
这套逻辑在快速迭代的新项目里就是制造技术债务的引擎。在代码重构较量中,模型选择了看似稳妥的添砖加瓦。无用的系统复杂性轻而易举地压垮了项目的可维护性。
免除向后兼容责任
模型分不清什么是需要严阵以待的线上链路,也分不清什么是玩具代码。开发者必须手动给它划定坚硬的物理边界。人类工程师不得不防范这个电子助手。
社区开发者 theshrike79 提供了实操解法。他在项目根目录放置了醒目的 PROJECT.md 文件,在头部大写加粗写明。这是一个单人项目,不需要考虑向后兼容,不需要防御性编程,不需要写单元测试。
图:opusfived.dev 首页入口。来源:opusfived.dev
一旦书面明确解除了模型的责任枷锁,它的表现立刻大幅转变。它像卸下重担一样变得松弛、敏捷且高效。对于大语言模型,这是一个必须用文字死死钉在项目根目录里的强制解除协议。他打了一个精准的比方。这就好像你拥有一台超级聪明的计算机,每天必须花费时间修筑栅栏,防止它跑出圈外强行帮忙。
高增益训练劈开阵营
这种过度热心,引发了社区阵营撕裂。一部分追求绝对控制权的开发者,果断放弃最新模型,转投 Codex 或底层工具怀抱。Codex 展现出了冰冷、克制且近乎外科手术式的精准执行力。老派程序员找回了丢失的代码掌控感。
站在底层训练视角的开发者看到了另一面。genxy 提出了反方观点。当前模型展现出的过度主动,正是高增益训练必然导致的结果。如果模型在训练阶段没有被塑造成充满干劲的样子。面对真正需要完整工程考量的复杂任务时,人类开发者每天都要花费精力去鞭策它干活。我们在享受开箱即用福利时,必然要承受它偶尔越界带来的冗余代码。两拨人的分歧是对代码库控制权让渡程度的分歧。
划定边界成为新必修课
当我们嘲笑先进模型为了蓝色按钮大动干戈时。我们正在直面编程范式的剧烈重组。模型不可能知道业务核心重点在哪里,因为它没有经历过为了活命而妥协质量的生死存亡。
从这场风波里可以发现,大模型写代码最明显的毛病在于过热的自驱力。它拥有着强大的算力,随时准备为连主流程都没跑通的草稿,构建一套支撑百年基业的微服务架构。人类工程师的核心价值正在发生转移。核心价值正在从「如何把正确的代码写出来」转移到「如何阻止系统被无用代码淹没」。
把该干的事毫无保留地交给机器,把不该干的边界清清楚楚地讲明白。让 AI 知道何时该动用工程思维,何时只需简单地把按钮涂蓝。这就是 2026 年用 AI 写代码的人必须掌握的新必修课。
参考链接:
- HN 讨论 (item?id=49623754)