太长不看版
- AI 把写代码的门槛拉低了,却把 Review 的成本推高了。技术债最后落到谁头上,是个真问题
- Claude Code 负责人 Boris Cherny 公开回信提出:AI 写的生产代码,审查标准应该比人写的更高
- 审不审、审多严,看的是"爆炸半径"(blast radius):代码搞砸后会波及多少钱、多少用户、多少权限
- 中小团队不必照搬大厂自动化,守住"能解释"这道门槛、维护好上下文规范、配上基础测试护栏,就能跑起来
2026 年 9 月 11 日,Anthropic Claude Code 负责人 Boris Cherny 在 X 上贴出一封读者来信,附上了自己的回信。
这不是一封 API 使用咨询。写信的人在一家公司干了 12 年,语气克制,但每个字都指向同一件事:当所有人都在用 AI 疯狂产出代码,技术债该由谁来还?
一、一封 12 年老员工的求助信
邮件主题为 “What to do about slop?”,写信人是一名在现公司工作 12 年的开发者
邮件译文:
你好,
我知道收到回复的概率很低,但还是想试一下。我在 [公司名已打码] 做开发,到现在 12 年了。现在我做的,基本就是让它继续跑下去。
转向智能体开发(agentic development)带来了不少摩擦。团队里似乎有两种观点,我希望你能谈谈怎么处理这种分歧。
观点一:我们像以前一样写代码,只是被 AI 加速了。可能不会审全部代码,但这些代码应该是可审的。提交代码的人应该能解释它。代码应该写得便于维护——或者比以前更容易维护,不管维护它的是人还是智能体。
观点二:Vibe code(凭感觉写代码):把代码当成黑盒。不用操心它,只检查输出结果就行。
这场争论可能会越来越激烈,因为有很多面临裁员风险的人,他们做不到第一种,但能产出大量第二种。而为第一种观点辩护的担子,落在了那些还能看懂代码的人身上。不过话说回来,我对 AI 也算不上专家。
我会试着用代码复杂度来指导产出。但有时候,一个简单得多的方案——换个完全不同的设计,或者把需求稍微放宽一点——智能体想不到,我们这里也没人知道该怎么让它产出那种结果。所以很多人只是在硬推。判断他们的方案错没错,比让他们生成代码花的时间还多。
总之,感谢你的任何建议。
这封信撕开了一个现实:AI 降低了写代码的门槛,却成倍推高了 Review 的认知成本。
二、Boris 的回信:按"爆炸半径"分两档
Boris 回得不慢,也回得很实在。他给的判断准绳只有一条:按"爆炸半径"(blast radius)定标准,代码分两档跑。

所谓爆炸半径,就是这段代码一旦线上翻车,会波及多少钱、多少用户、多少数据权限。
| 评估维度 | 第一档:低风险(原型 / 一次性代码) | 第二档:高风险(生产环境核心代码) |
|---|---|---|
| 典型场景 | 内部脚本、数据跑批、演示 Demo、临时排查工具 | 支付、登录、用户数据、对外服务 |
| 出错后果 | 任务结束即扔,影响范围小 | 触碰资金与权限,波及大量用户 |
| 审查策略 | 当黑盒,只验输出结果 | 逐行审、严格审 |
| 质量基线 | 不考虑长期维护 | 必须可读、可解释、可持续维护 |
| 责任归属 | 使用者自担 | 工程师守质量门 |
(表格由回信内容整理,个别场景举例为本文补充)
为什么说 AI 生产代码的标准要更高?
Boris 给了结论,没有展开原因。他的原话是:“Production code written by Claude should have a higher bar than if it was written by a human.”
按本文的理解,有两点。
一是体量: 人写代码再快也有上限,AI 能成批产出看起来自洽、实际藏着边缘漏洞的代码。
二是注意力: 面对海量生成代码,人更容易漏看;标准一松,代码库烂得比过去更快。
三、没有大厂护栏的中小团队,怎么落地?
很多人会说,Anthropic 有算力跑自动化 fuzzing 和 e2e 测试,中小团队学不来。确实,中小团队不必照搬大厂那套重型架构,把逻辑轻量化就行。
1. 守住"能解释"这道门槛。 不管代码是谁生成的,提 PR 的工程师是第一责任人。讲不清"这段代码干了什么、为什么这么干",就打回。
2. 把规范写进上下文。 代码质量差,往往是上下文和工程指引没给够。维护好 CLAUDE.md 和 skills,教会 AI 按你代码库的方式干活。
3. 自动化兜底,人守最后一道。 团队再小,也该配上基础的静态检查和自动化测试。方向对不对,最终还得人来拍板。
第 3 条最关键。原信里那句"判断方案错没错,比让它生成还费时间",说的就是这件事。卡住进度的是验证这一环。
四、评论区交锋
帖子引来上百条回复。挑几条有代表性的,能看出争议长什么样。
支持分档的:
- Ibesh(@ibesh_tech):审查标准该跟着爆炸半径走,跟谁写的无关。用完就扔的脚本?直接上线。碰钱或碰登录的东西,他仍然一行行自己读。
- Erika Reed(@erikaintell):一次性代码像租来的车,没人会去洗它;生产代码是你真要住进去的。
- SergeantMess(@SergeantMess):企业经常要处理第二种情况。代码是被收购的创业公司写的,原开发者早走了,没文档,没人看得懂那些奇怪的语言和编码习惯。想重构、复用或者维护,对公司是一场噩梦。
唱反调的:
- Riley David Jesus Seaburg(@RileySeaburg):"你对烂代码的答案,就是多买点 token。"换更强模型、调高 effort、重写代码库,Boris 给的三条建议拆开看都是加投入。
- DSM Pro Engineering(@dsmproengineer):“有些日子,AI 一天给我生成上百万行代码。难道要我全审一遍?哈哈,不可能。我现在是项目经理,不是程序员了。”
- Fernando Fernandez(@FinFerFer):很多非资深开发者已经不会看堆栈了。他们从各种上下文里复制粘贴 vibe code,生产环境一崩就怪 Claude。缺的是对技术栈和编程的了解、质量意识,还有责任感。
应届生怎么办? 有人问 Boris:如果新一代学生都不自己写代码了,学校还该教编程吗?他的回答值得完整引用:
We are in a weird moment: coding is automated, but the rest — system design, code review, and so on — are not yet fully automated. For the next 6-12 months, some engineering skills you learn in school will remain critical for people that write software. After that, they will become basic “background” skills you learn in school, like geometry and history are today. You don’t use these every day but they give you frameworks and ways of thinking about the world that come in handy later on.
——Boris Cherny(来源:帖子评论区回复,2026-09-11)
翻译过来就是:我们正处在一个奇怪的时刻,写代码被自动化了,系统设计、代码审查这些还没有。未来 6 到 12 个月,学校里学的工程技能对写软件的人仍然关键;再往后,它们会变成像几何、历史那样的基础背景技能,不天天用,但会给你看世界的框架,以后总用得上。
五、Boris 没回答的问题
回信写得是挺实在的,但评论区有些问题他始终没正面接。
1. 给了原则,没给配置。 有人直接问他要那套 lint 规则(Gatien,@gatien7:“Have you shared some of ur lint rules you used ?”),有人想让他展开讲讲 Claude 驱动的 e2e 测试和 fuzz 测试怎么搭(Chathur Gudesa,@chathur_gudesa)。这些问题下面都没有回复。
他的答案停在"把 CLAUDE.md 和 skills 维护好",具体长什么样,只能自己摸 🤣。
2. 建议的本质是加投入。 换更强的前沿模型、把 effort 调到 high 或 xhigh、实在不行重写代码库,直白讲就是:多烧算力、多花时间。
Riley 那句"你对烂代码的答案,就是多买点 token"说的就是这个🤣。
FAQ
Q:AI 写的生产代码必须逐行人工 Review 吗?
A:分场景。原型和一次性代码当黑盒,只看输出;碰资金、登录、用户数据的生产代码逐行审,标准还要高于人写的。
Q:为什么说 AI 生成代码更容易拖垮代码库?
A:真正的风险是生成速度带来的错误体量。AI 出活快,错误成批出现,更依赖自动化护栏和分级审查来接。
Q:什么是"爆炸半径"?
A:代码出错后波及的范围,涉及资金、用户量和权限等级。半径越大,审查就得越严。Boris Cherny 用它判断一段代码该审到什么程度。
Q:中小团队没有大厂的自动化工具怎么办?
A:按爆炸半径分档,把审查精力压在高风险场景;配上基础静态检查和自动化测试;把"能解释代码"设为提交门槛。
Q:AI 写的代码不达标,Boris 给了什么建议?
A:Boris Cherny 的建议是换最新前沿模型、把 effort 调到 high 或 xhigh、维护好 CLAUDE.md 与 skills 教会 Claude 在你的代码库里干活;还不行就多引导它,或让它清掉技术债、重写代码库。
参考来源
- Boris Cherny(@bcherny)X 帖子及回信,2026-09-11。https://x.com/bcherny/status/2098217571153838124


602

被折叠的 条评论
为什么被折叠?



