graph engineer vs loop engineer :
不是替代,是嵌套。Loop 是最小的 Graph(单节点自环);Graph 里每个干活的节点内部仍在跑自己的 Loop。"Loop Engineering is dead" 是 Hamel Husain 的反讽炒作。完整递进链:Prompt → Context → Harness → Loop → Graph,每层向外包一层。
多 Agent 不是必然更好。《Nature Machine Intelligence》2026 年研究(260 种配置):可拆分的金融任务多 Agent 最高 +80.8%;强顺序依赖任务最高 −70%;SWE-bench Verified 上四类多 Agent 架构全部 −1.3%~−12.8%。决定变量是任务可拆分性,不是复杂度。
选型规则(社区共识版):一个 Agent + 工具 = Loop;多个 Agent + 交接 = Graph。当你在 Loop 里硬塞并行、独立评审、人工审批门时,就是该升级到 Graph 的信号。
显示更多
AI ENGINEERING FROM SCRATCH
看着不错,适合失业的老登儿学习
Loop Engineering 的意思是不是
让 Agent 干活要闭环 🤔
Harness Engineering 现在还处在很早期的阶段。软件工程发展了几十年,有成熟的方法论、教科书、最佳实践,新人进场基本都是站在前人踩过的坑上往前走。Harness Engineering 完全不是这样,现在能参考的经验少,能抄的作业也少,大部分东西都得自己摸索。
但早期恰恰是它的价值所在。一个领域一旦成熟,规则和最佳实践都定型了,新人进去更多是学习和执行,很难再抢到认知红利。而在早期,谁先动手实践、先踩坑、先总结出一套自己的方法论,谁就更有可能把这些经验沉淀成后来者绕不开的参考。
这个阶段最重要的不是等一套完善的方法论出现了再学,而是主动进场,一边做一边总结,把自己变成正在定义这套方法论的人之一。
显示更多
Loop Engineering 里最重要也最难的是 user in the loop
除非你的产品不是给 user 做的
Loop Engineering 最稳的上线方式不是一步到位无人值守。
而是分 3 层放权:
L1:只报告
每天扫 CI、issue、PR,输出摘要,不改任何东西。
L2:小修复
只处理 lint、文档、测试快照这类低风险任务,必须开 PR。
L3:有限自动化
只在明确白名单里自动处理,遇到权限、支付、数据库、生产配置立刻停。
先让它看,再让它动,最后才考虑自动合并。
显示更多
Loop Engineering 最容易被误解成:
让 Agent 一直自动跑。
它真正重要的地方,是目标定义。
以前你写 Prompt,是告诉 AI 这一次怎么做。
现在你设计 Loop,是告诉 AI:
什么算完成。
怎么验证完成。
失败了怎么办。
哪些动作禁止做。
什么时候必须停下来。
这要求的是管理能力。
显示更多