分享
详解 Claude 的循环工程
输入“/”快速插入内容
详解 Claude 的循环工程
用户4242
用户4242
8月5日修改
作者:Mr. Buzzoni(
@polydao
)
原帖链接
用一段话说明:
循环工程意味着,你不用亲自给智能体写提示词,可以开始构建一个替你向智能体发出提示的系统。
它由触发器启动,在隔离空间中完成工作,由第二个智能体拒绝不合格输出,把发生过的事情写入磁盘,并在第二天从上一次停止的位置继续。
本文会介绍这个想法的来源、Claude Code 中的四类循环、如何按顺序构建第一个循环,以及循环会在你睡觉时以哪四种方式产生账单。
60 秒了解核心概念
问题
简短回答
什么是循环?
智能体反复执行工作,直到满足停止条件。
2026 年改变了什么?
控制点从编写提示词,转移为设计替你编写提示词的系统。
什么让循环有效?
闸门:某个能够客观拒绝输出的东西。
什么让循环失效?
同一个东西缺失。
从哪里开始?
一项重复任务、一个技能、一个状态文件、一道闸门。
成本是什么?
难以预测的词元成本,以及必须持续支付的审查时间。
谁应跳过它?
任务不会每周重复,或无法自动检查的人。
一个起点事实
2026 年 3 月,Andrej Karpathy 向 GitHub 推送了三个文件,总计约 630 行。
一个文件承载模型,一个负责为它评分,一个规定智能体可以修改哪个文件。然后他合上了电脑。
两天后,这个设置已经完成了大约 700 次实验,并找出了 20 项改进,针对的是他亲自调过二十年的一个模型。
其中一项是注意力路径中缺失的一个标量。没有任何 linter 能捕捉它。一位细致的工程师本可以发现它,但二十年来没有人发现。
其中的提示词很普通。真正重要的一切都存在于周围的三个文件中:选择下一个实验、运行它、给它评分、保留改动或回滚,再来一次。
Shopify 的 CEO 也在内部模型上运行过类似的夜间设置,醒来后发现模型质量提升了 19%,而该模型的规模只有原先的一半。
人到第 12 个实验左右就会感到厌倦,循环永远不会。
这个术语在一周内出现。
2026 年 6 月,OpenClaw 作者 Peter Steinberger 发帖称,人们应当设计“为智能体写提示词的循环”,而非亲自给智能体写提示词。该帖获得超过 800 万次浏览。同一时期,领导 Anthropic Claude Code 团队的 Boris Cherny 表示,他现在的工作是编写循环来提示 Claude,并让它自己判断下一步做什么。6 月 7 日,Google Chrome 团队工程师 Addy Osmani 将这件事完整写下,并给出了后来被固定下来的名字。
三个人,一周时间,彼此没有协调。这通常意味着,地面早已移动,只是所有人还站在上面。
与此同时,你的订阅可能只用了 10% 的能力:一个窗口、一项任务、一个人坐在那里等待输出结束。
1. 循环工程处在什么位置