📝 本期播客简介

本期我们克隆了:知名播客 AI Engineer The Great Loops Debate — Dex Horthy, Geoff Huntley, Ian Livingstone, Greg Pstrucha, @insecure-agents

原内容更新时间:2026-07-17

这是一场关于AI循环工程(Loops)的牛津制辩论,由《Insecure Agents》主持人Ali How主持。四位来自Keycard、HumanLayer等前沿AI公司的技术领袖分成两队,围绕"循环背后的炒作与实际效果之间是否存在差距"展开激烈交锋。正方认为循环已经足够成熟,是迈向完全自主软件工厂的关键一步;反方则坚持炒作跑在了工程纪律前面,今天的循环远未达到银弹级别。

辩论从循环的历史、解剖结构一直延伸到未来,涵盖了Ralph Loop的起源、上下文腐化、语义验证、经济可行性、共享记忆安全等核心议题。如果你正在思考AI时代的软件工程范式、自主Agent的边界,或者单纯想知道该不该把循环引入自己的开发流程,这场高手过招会给你大量一手经验和尖锐判断。

👨‍⚕️ 本期嘉宾

本场辩论共有四位嘉宾。Ian Livingstone是Keycard的CEO兼联合创始人,长期关注AI安全与身份验证;Geoff Huntley是Ralph Loop的创造者,这一概念深刻影响了Anthropic等公司的Agent设计;Greg Pstrucha是Sentry的开发者,对代码质量和工程实践有深入见解;Dex Horthy是HumanLayer的CEO,专注于AI与人类协作的工程化方案。主持人Ali How同时是Keycard技术团队成员。

⏱️ 时间戳

开场与辩论规则

01:09 辩论开场:循环的炒作与实际效果之间是否存在差距

02:44 牛津辩论制规则:改变最多人想法的一方获胜

03:20 双方立场介绍:正方认为没有差距,反方认为炒作跑在纪律前面

循环的历史与起源

04:47 Geoff:循环是不可避免的,我已经两年半没手动写过代码了

06:56 Dex:Kubernetes花了七八年才搞对,循环也需要时间沉淀

09:27 Ian:循环本来就是一切构建工作的核心,从50年前到今天都是如此

11:39 Greg:炒作让你相信可以靠砸token把质量问题"编排"掉,但经济上不可持续

循环的解剖结构:什么才是一个好的循环

17:23 Geoff:Ralph为什么从greenfield走向通用?因为模型生成的代码比大多数开发者都好

21:32 Greg:验证手段里加入非确定性,正确性就会越来越低

23:26 Dex:上下文腐化与愚钝区,如何判断模型已经开始胡乱挣扎

26:48 验证的矛盾:如何防止Agent通过修改测试来作弊

循环的未来与软件工厂

29:16 Dex:Loom实验证明,炒作跑在纪律前面,那东西现在还不行

31:56 Greg:循环什么时候能回本?有些场景值,但别被Twitter带偏

34:52 Ian:共享记忆的访问控制是个没解决的问题,但雏形开始出现

36:44 Greg:Agent偏爱复杂性,我不放心把架构决策交给它

总结陈词

45:49 Greg:多尝试,自己思考,别扎进炒作泡沫里

46:53 Ian:火车已经出站了,你别无选择必须跟上

48:50 Dex:我热切期待关灯软件工厂可行的世界,但在此之前,用循环别那么用

49:18 Geoff:类型系统很重要,Rust很好;我已经几乎不用开源软件了

🌟 精彩内容

💡 "我们管自己叫工程师,但其实不是真正的工程师"

Geoff尖锐地指出软件行业缺乏真正的责任归属机制。在讨论Agent签名和代码责任时,他直言这个行业在个人层面根本没什么真正的责任,这让我们在引入自主Agent时面临更大的治理挑战。

"我们这个行业其实挺闹剧的。我们个人层面根本没什么真正的责任。我们管自己叫工程师,但我们其实不是真正的工程师。"

💡 "模型是醉的,你不能信任它们,但我们可以通过工程手段消除故障域"

Geoff用"醉汉"比喻LLM的不可靠性,但强调这正是循环工程的价值所在——不是追求模型完美,而是用pre-commit hooks、类型系统、确定性测试等手段把不可靠的模型约束在安全轨道上。

"我们得戴上工程师的帽子。我们现在有点像火车司机了,我们的工作就是让火车保持在轨道上。因为,坦白说,模型是醉的,对吧?你不能信任它们。"

💡 "炒作让你相信可以靠砸token把质量问题编排掉"

Greg直击当前AI工程化的核心幻觉:以为在循环上叠循环就能解决质量问题。他指出语义验证虽然有用,但最终产出的代码依然很烂,而且token成本在大公司会迅速变得不可持续。

"当下这种炒作驱动的话语,会让你相信一件事:你可以在循环上叠循环再叠循环,靠砸更多token来把质量问题给'编排'掉。我不认为这是可持续的。"

💡 "火车已经出站了,你别无选择"

Ian用这个比喻总结了循环工程的必然性。在竞争激烈的市场里,没有公司能说"我们不碰循环这套东西"。问题不是会不会发生,而是什么时候发生、程度有多深。

"火车已经出站了。一旦火车出站,全世界每个人都会说,天哪,我得稳住阵脚,我们得跟上别人。而且他们必须跟上。"

💡 "先去想办法快2倍、3倍,因为试图一步快100倍,你会把一切都搞砸"

Dex给出了务实的建议:不要试图端到端自动化一切,而是在系统里逐步建立小型增量循环。他提醒工程师不要抛弃几十年积累的软件工程纪律,从小处迭代才是正道。

"你能想象吗,如果世界上每个软件工程师都快了2到3倍,并且产出质量接近人类水平?那会改变世界上每一家企业。而我们却试图走得太远。"

💡 "Agent偏爱复杂性,它们会无休止地往技术栈上堆东西"

Greg分享了一线经验:AI生成的代码倾向于过度工程化。真正资深工程师的价值在于知道不该做什么、哪些取舍值得做,而这恰恰是Agent目前最缺乏的判断力。

"任何有多年经验的工程师都会告诉你,重要的不只是你该做什么,还有你不该做什么。就我的经验来看,Agent偏爱复杂性。"

💡 "我已经几乎不用任何开源软件了,直接按需求生成代码"

Geoff抛出一个极端但引人深思的做法:为了缩小供应链攻击的爆炸半径,他选择vendor化所有源代码,让Agent可以直接修改。这暗示了AI时代软件供应链可能发生的根本性变化。

"当供应链攻击发生的时候,我的反应就是:没影响到我。你要尽可能把自己所有的源代码都vendor化,这样Agent才能真正用循环去修改它。"

🌐 播客信息补充

本播客采用原有人声声线进行播客音频制作,也可能会有一些地方听起来怪怪的

使用 AI 进行翻译,因此可能会有一些地方不通顺;

如果有后续想要听中文版的其他外文播客,也欢迎联系微信:iEvenight


在小宇宙查看该单集文稿

Podden och tillhörande omslagsbild på den här sidan tillhör yikai. Innehållet i podden är skapat av yikai och inte av, eller tillsammans med, Poddtoppen.