1.7 KiB
1.7 KiB
created, type, tags, source
| created | type | tags | source | ||||||
|---|---|---|---|---|---|---|---|---|---|
| 2026-06-27 06:25 | zettel |
|
Anthropic 团队用例 PDF + best-practices (2026) |
自给自足验证循环配合 TDD
给 Claude 一个它自己能跑、能读结果、能据此纠正的验证手段(build / test / lint),它就能闭环自我迭代而不必每步等人。这个"自给自足循环"(self-sufficient loop)是 agentic 编码可靠性的核心。
关键在于验证信号的客观性:测试通过 / 失败是二值、确定、模型无法自我安慰的反馈。因此先写测试再写实现(TDD)时效果尤其好 —— 测试先确立了一个明确的 GREEN 目标,模型的每次改动都有可证伪的对照,而不是"我觉得写完了"。
落地要点:
- 在
CLAUDE.md写清"如何运行测试 / lint / build"(否则模型会反复猜错命令)。 - 用 Hooks(
PostToolUse(Edit|Write))把验证变成确定性自动触发,不依赖模型自觉去跑。 - 对照 RED→GREEN→REFACTOR:先让测试失败,再让模型实现到通过。
本质:把"目标回溯验证"内建进循环,胜过让模型做"正向任务检查"自评。
Related
- 20260320100200 目标回溯验证vs正向任务检查 —— 为什么客观验证优于自评
- 20260319120100 Hook驱动优于提示词驱动 —— 用 hook 强制验证发生
- 20260627062503 Explore-Plan-Implement-Commit 四阶段工作流 —— Implement 阶段嵌入此循环
- Claude Code 新项目开发最佳实践 (2026 调研)