Highlights from my conversation about agentic engineering on Lenny’s Podcast
这是一篇 Simon Willison 于 2026-04-02 发布的播客摘录总结,整理了他在 Lenny’s Podcast 上关于 agentic engineering 的主要判断。它不是一篇系统方法论文,而更像一份来自一线实践者的“现场报告”:随着 2025-11 这一轮模型跃迁到来,编码本身正快速变便宜,真正稀缺的能力越来越集中到验证、筛选、评估和负责任地使用这些 agent 上。
- 文中把
2025-11视为一个转折点:GPT-5.1和Claude Opus 4.5让 coding agent 从“经常生成接近可用的代码”进一步跨到“多数时候真的能按要求做出能运行的东西”。 - 这也解释了为什么软件工程师会先成为风向标:代码是少数还能比较直接验证对错的信息工作,所以 agent 对工程工作的冲击,会比很多更难验收的知识工作更早暴露出来。
- 文章反复强调,瓶颈已经从“写实现”转向“验证想法是否值得、原型里哪个方案最好、交付给别人是否安全可靠”。Simon 的一个具体做法是:对一个功能先做三个原型,再把时间花在比较和测试上。
- 它还提出了一个很重要的二阶判断:代码变便宜以后,评估软件反而更难了。因为现在很容易在一小时内做出“看起来像成熟项目”的库和文档,但真正可信的软件仍然需要长期使用、打磨和现实反馈。
- 文章对“经验”的作用也给出了更细分的判断:资深工程师会被 agent 放大,新人因 onboarding 成本下降也会受益,但中间层工程师可能最容易被挤压。
- Simon 给出的应对建议不是和模型比“会不会写代码”,而是投资自己的
agency。这里的agency指人的主动性、适应变化和借助工具放大自身能力,而不是把“agent”误听成某种自动拥有目标感的系统。 - 他也明确反对把这些工具想得过于轻松:高效使用 coding agents 很消耗经验和注意力,甚至会带来赌博式、成瘾式加班冲动。虽然中断成本下降了,但认知疲劳和过度工作风险反而上升。
- 在风险边界上,这篇文章的判断很清楚:如果只是给自己写点有 bug 的东西,vibe coding 问题不大;但一旦代码会影响别人,就必须提高验证标准。同样,agent 现在已经能做出像样的安全研究,但没有复现实证的安全报告只会制造噪声。
ℹ️ Conflict:
- 这篇更像 Simon Willison 的一线观察与播客口述,不是严格定义过术语和边界的工程论文,因此很多判断都带有强烈个人经验色彩。
- 文中关于
2025-11转折点、95%AI 代码占比和“中间层最危险”等判断都很有启发性,但仍属于快速变化期的趋势观察,不应直接当作稳定规律。 - 它一方面强调中断成本下降、手机也能高效写代码,另一方面又强调高质量使用非常耗神;两者并不矛盾,但说明“更容易开始”不等于“更容易稳定交付”。
- Agentic engineering
- Shipping at Inference-Speed
- Just Talk To It - the no-bs Way of Agentic Engineering
- Simon Willison, “Highlights from my conversation about agentic engineering on Lenny’s Podcast”, 2026-04-02.
- 原文摘录:[llm-wiki/raw/01_AI/Highlights from my conversation about agentic engineering on Lenny’s Podcast](/raw/01_AI/Highlights from my conversation about agentic engineering on Lenny’s Podcast.md)