MisoTech Logo
MisoTech<Decode />
首页关于服务项目博客联系隐私政策免责声明
MisoTech Logo
MisoTech

Decode the Stack

专业技术解决方案和见解,帮助您解码技术栈。

快速链接

  • 首页
  • 关于
  • 项目
  • 博客
  • 联系
  • 隐私政策
  • 免责声明

联系

Email: [email protected]

地址: San Francisco, CA

关注我

© 2026 MisoTech. 保留所有权利。

使用 Next.js 和 Tailwind CSS 制作,充满❤️

Vibe Coding方法论Harness最佳实践

代码能跑不算完:AI写的代码,讲不清3个问题就别合并

2026年10月01日
Archer
10 min read
代码能跑不算完:AI写的代码,讲不清3个问题就别合并

针对使用 AI 编程时“任务成功但理解失败”的空心化问题,作者基于 Anthropic 的理解验证思路与自身四个真实项目的迭代实践,提炼出一套极简实操工作流:通过剖析理解流失的三大漏点(会话内/会话间/未落纸),确立“任务完成”与“理解完成”两条并行验收线,利用固定三问复述与 Harness/CLAUDE.md 沉淀,把技术认知从脑内传话筒升级为机器可驻留的环境资产。

工具信息

官网
https://www.corexpertdata.com?r_sk=Er7zH-edcqeEOsch&r_sc=1&r_fl=2

优点

  • 1. 验收标准客观硬核:用“自己能否复述”作为理解验收的试金石,复述卡壳即是认知盲区,摆脱了“我觉得我懂了”的自欺欺人。
  • 2. 解决多会话冷启动痛点:将人脑传话筒负担卸下,沉淀为 CLAUDE.md 与 Harness 规范,杜绝新会话推翻旧决策。
  • 3. 投入产出比极高:每批次仅需多花 3-5 分钟进行收尾三问复述,换来长期接单、维护与重构的从容掌控。

缺点

  • 1. 对开发者的自律性有硬性要求,在追求极速交付时必须克制“直接开下一批”的冲动。

对比表

点击表头可排序
工具
交付模式
完工验收线
跨会话语境传递
开发者角色蜕变
双线理解验收工作流
双线验收:不仅代码过测试,更要通过收尾三问复述,讲不清不进下一阶段。沉淀至 CLAUDE.md 与 Harness 框架;规则显性化,新会话自动继承项目语境。系统规则的架构与维护者,AI 干活时是员工、交付时是导师,认知资产随项目越积越厚。
传统审批按钮模式
单线验收:只要代码跑通、测试全绿就认为完工。依赖人脑肉身充当传话筒;新会话冷启动,决策与隐性规则反复被推翻。被动的审批者,离代码越来越远,随时间推移逐渐丧失对系统的解释权与报价底气。
高亮单元格表示该列中的最佳值。

"任务完成和理解完成,从此是两条验收线。"

上一篇《别再无脑点同意了》的结尾,我埋了个钩子:Anthropic 开发者分享的那套理解验证工作流,8 步展开又是一整篇。

这篇就是来还愿的。

先把丑话说在前面:官方公开的内容只有一页纸的概述,完整的 8 步并没有逐条铺开。所以今天这篇不是官方翻译,是我把那套思路拿到自己手头项目上跑了几个月的实操版:我怎么用的,哪里疼,最后改成了什么样。

为什么这事值得单独写一篇?

因为我后来发现,审批按钮的对立面不是更努力地看代码,而是你根本说不清自己哪里没懂。看完这篇你会拿到一套能直接抄的东西:每个阶段收尾的固定三问、复述确认的判断标准,以及一条把理解验收从玄学变成硬门槛的规则。

📌 本文看点

01 理解会从三个地方漏掉

02 三问不过版:理解也过验收

03 AI 的 KPI 与你的 KPI

01 BACKGROUND

先交代我拿什么验证的

上篇讲过我沦为审批按钮的翻车史,这篇先交代验证的靶子。

拿到这套工作流的时候,我还在 VibeCoding 口喷。遇到复杂一点的需求,第一反应是先让 Gemini 出 PRO 和 DEV 文档,前端后端的项目进度分别要一遍,再连同新需求一起丢给 Gemini 评估。一个需求四道手续:先等它出文档,再去前端要进度,再去后端要进度,最后合并评估。链条越长,我离代码越远。我心里清楚这么干活不对劲,但没别的办法。

所以看到那套工作流,我的反应很直接:能不能简化我的流程,提高点效率。

我的做法是立马挨个拿自己的项目开刀:图个简单、富屿扇海居两个微信小程序,加上个人站和游戏站,全部拿来做需求功能的迭代优化,一个一个验证。

为什么非要四个项目一起跑?

说实话,单项目容易自欺:跑通了,可能只是这个项目恰好简单。四个跑下来,哪些动作是通用的,哪些只是巧合,一目了然。

02 THREE LEAKS

理解会从三个地方漏掉

四个月跑下来,我先说结论:理解这个东西,会从三个地方漏掉。

1 会话内流失。上下文一长,前面讲过的东西它自己就忘了,后面给的方案跟前面定的决策打架。代价是返工:前面刚定好的事,后面悄悄被推翻。

2 会话间清零。新开会话,冷启动。上一批为什么这么设计、哪个接口不能动,它一概不知,你从头再喂一遍。代价是重复沟通:同样的背景,讲一次是必要,讲三次就是白干。

3 从未落纸。最隐蔽的一类:哪些文件是生成的不能手改、部署有什么顺序讲究,这些规则从来没写下来过,只在你脑子里。代价最贵:哪天你忙忘了、人不在,这条规则就当没存在过。

Image

— 理解的三条泄漏路径

你发现没有,这三个地方漏掉的是同一种东西:项目的语境。问题域你可以补文档,方案域你也可以让 AI 讲,唯独这些藏在项目环境和习惯里的东西,模型权重里长不出来。漏掉多少,你就当多少次审批按钮。

漏点摸清了,对策其实很朴素。

03 THREE QUESTIONS

我的实操版:阶段收尾三问

我的用法很朴素:每个阶段结束讲。一批功能做完,我不急着开下一批,先让它按固定三问讲一遍:

1 这次做了什么;

2 为什么这么做;

3 放弃了哪些方案。

💡 小技巧:这三问的话术可以直接抄,用普通人听得懂的话讲讲,你刚才做了什么、为什么这么做、放弃了哪些方案。

它讲的时候,我只干一件事:跟着复述。这套动作的成本低到几乎无感:它讲一遍,你复述一遍,一个批次多花不了几分钟。

复述得出来,这批就算过。复述卡壳,就让它换个说法再讲一遍,别嫌慢。因为卡壳的位置,往往就是我没真懂的位置。这种感觉怎么说呢?就像学生时代自查背课文,背到哪一句卡住,哪一句就是没记住的,比任何一句我觉得都会了都诚实。

「三问讲不清,这一批就不算完——跟测试不绿不合并,是一个道理。」

四个项目跑下来我才发现,这套东西真正值钱的不是讲懂,是把理解变成批次的验收标准。换句话说,理解成了和代码同级的交付物:代码要过测试,理解要过三问。

Image

— 三问不过版:把理解变成验收标准

04 CASE STUDY

真实战场:个人站内容管理后台

光说方法太虚,讲一个真实的过程。个人站新增内容管理后台,需求内容比较多,我拆成了几批做。第一批挺顺:一个会话里边聊边做,它讲得清楚,我也跟得上。

问题出在第二批,新开会话,冷启动。干干净净的一个新会话,像刚入职第一天的新人:东西在哪不知道,规矩是什么没听过。

它不知道第一批为什么把内容模型设计成那样,不知道哪个接口是给小程序用的不能动。我把上一批的决策重新喂一遍,喂完发现,它给的方案还是跟第一批定下来的东西打架。

说实话那一刻挺挫败的,我都教过它一遍了,怎么还是不对。

更烦的是那些从来没写下来的隐性规则。哪些文件是生成的不能手改,部署有什么顺序讲究,每次都得我现场想起来,再口述给它。

那一刻我突然意识到一件事:分批次开发,本质上是每个新会话都在接手一个别人的项目,上一个会话就是那个别人。靠我的脑子当两个会话之间的传话筒,既不可靠,也不可复用。

所以我现在的解法,是把理解搬出脑子、搬进项目环境,正经开始搭Harness 框架:

三行沉淀

每批收尾,把做了什么、为什么、放弃了什么写进 CLAUDE.md。新会话开场先读这个,不用我重新讲。

隐性规则显性化

哪些不能手改、什么顺序部署,逐条写下来,写一次管所有会话。

重复操作 skill 化

同样的活儿第二次干,就做成 skill,连讲都省了。

💡 小技巧:三行沉淀的话术也可以直接抄,收尾时在会话里说一句,把我们这批的结论整理成三行:做了什么、为什么、放弃了什么,我会贴进 CLAUDE.md。

这里注意区分一下:第三节的固定三问,是让它讲给我听,验收我的理解;这三行沉淀,是我写给它读,给下个会话铺路。方向相反,缺一不可。

之前写过一篇《我对 Harness 的观点和实操心得》,当时更多是讲给 AI 立规矩。这次不一样:这些沉淀锁住的不只是它的行为,还有我的理解。我的角色,也从传话筒变成了规则的维护者。

05 TWO LINES

想明白的事:两条验收线

跑完四个项目,我最大的变化是对做完的定义变了。以前一批功能合了就算完。现在三问讲不清,就不算完。任务完成和理解完成,从此是两条验收线。

那套工作流里有句话我一直记得:成功标准不是任务完成,是你对问题、方案、影响有可复述、可辩护的掌握。翻译成大白话:AI 做完是它的 KPI,你讲得清才是你的 KPI。你们俩从第一天起,就没在同一个方向使劲。

对我来说这不是什么理念,是饭碗。独立接单的人,讲得清为什么的交付,报价才硬气;将来要转行、要被面试,能辩护的理解就是安全垫。

说到底,理解验证不是对 AI 的不信任,是对自己的投资。AI 每个会话都是冷启动,但你的理解可以驻留:沉淀进 CLAUDE.md,沉进 Harness,越积越厚。

Image

— 两条验收线:AI 的 KPI 与你的 KPI

∞ THE END

写在最后

这个系列聊到第三篇了。《从人肉跑一遍到AI自己验》讲机器那一侧:跑的动作可以外包给 AI。《别再无脑点同意了》讲人这一侧的病:你怎么沦为审批按钮。这一篇补上工具:理解怎么验收,怎么驻留。

现在就可以开始:拿你手头最近的一个开发批次,按三问让它讲一遍,你复述一遍。卡壳了别慌,恭喜你,找到没懂的位置了。这套动作我自己也磨了几个月才顺手,你不用再磨,直接抄作业就行。

对了,你上一次复述自己项目卡壳,是什么时候?评论区聊聊。

至于问题域、方案域、语境域这三条轴上,理解具体怎么断、断在哪一轴,展开又是一整篇。想看的,评论区说一声。

END

我是艾启蒙,用AI陪伴成长,用技术创造价值!

如果这篇文章对你有帮助,点个「分享」,让更多想学AI编程的朋友看到。 觉得内容有价值?设个邮箱订阅,以后每次更新都能第一时间收到。
返回博客列表

目录

  • "任务完成和理解完成,从此是两条验收线。"
  • 先交代我拿什么验证的
  • 理解会从三个地方漏掉
  • 我的实操版:阶段收尾三问
  • 真实战场:个人站内容管理后台
  • 想明白的事:两条验收线
  • 写在最后
  • "任务完成和理解完成,从此是两条验收线。"
  • 先交代我拿什么验证的
  • 理解会从三个地方漏掉
  • 我的实操版:阶段收尾三问
  • 真实战场:个人站内容管理后台
  • 想明白的事:两条验收线
  • 写在最后

目录

  • "任务完成和理解完成,从此是两条验收线。"
  • 先交代我拿什么验证的
  • 理解会从三个地方漏掉
  • 我的实操版:阶段收尾三问
  • 真实战场:个人站内容管理后台
  • 想明白的事:两条验收线
  • 写在最后
  • "任务完成和理解完成,从此是两条验收线。"
  • 先交代我拿什么验证的
  • 理解会从三个地方漏掉
  • 我的实操版:阶段收尾三问
  • 真实战场:个人站内容管理后台
  • 想明白的事:两条验收线
  • 写在最后

相关内容

别再无脑点同意了!3道防线把判断权从AI手里拿回来

过度依赖 AI 编程易导致开发者沦为麻木的“审批按钮”——点同意只需 3 秒,看懂却要 30 分钟。这种决策疲劳会导致“智能体黑箱”,造成任务成功但认知完全空心化的隐形负债。本文提出 5 信号自测清单与 3 道关键防线,帮助开发者把技术判断权从 AI 手中拿回来。

共同标签:Vibe Coding, 方法论

2026/9/24
从人肉跑一遍到AI自己验:我的3个土办法和1张边界清单

人工“跑一遍主流程”是 AI 编码交付中最脆弱的一环,极易漏掉边界输入、异常状态与暗中改坏的旧模块。本文提出“AI的能力边界由可验证反馈决定”,并通过三句轻量级 Prompt 动作将验证动作外包给 AI,把每一次踩坑转化成自动拦截的机器资产。

共同标签:方法论, Vibe Coding

2026/9/11
别再收藏 Prompt 模板了:从写好一句话,到设计一个系统

作为 Prompt 工程系列的总纲收尾篇,本文指出当前开发者最大的误区是“把加规则等同于解决问题”。在 Agent 时代,Prompt 已经不再是一次性的短句,而是需要长期维护的系统资产。文章整合了注意力机制、信号设计、架构分层、自动化边界和健康监控五个维度,呼吁开发者从“外部归因”转向“系统化设计”。

共同标签:Vibe Coding, 最佳实践

2026/8/11
你把 Prompt 维护外包给 AI,等于亲手养了台膨胀机器

本文深度拆解了将 Prompt 维护全盘外包给 AI 自动迭代的陷阱。由于大模型在处理长文档时缺乏全局审视能力,面对 badcase 往往只做加法(追加规则)而不做减法,最终会导致 Prompt 极度臃肿。作者呼吁:执行交自动化,判断留给人。

共同标签:Vibe Coding, 最佳实践

2026/8/10

加载评论中…