🔧 AI 知识库

写 Prompts 的时代已经过去!Claude 创始人对话互联网大厂负责人:Loop 时代到来了

原文链接

写 Prompts 的时代已经过去!Claude 创始人对话互联网大厂负责人:Loop 时代到来了

原文链接:https://mp.weixin.qq.com/s/eh_InHkl8PCeyjAeGz90ng

摘要

Claude 创始人 Boris Cherny 与 Spotify 工程负责人 Niklas Gustavsson 对话,提出 AI 编程正从 Prompt 时代进入 Loop 时代。核心观点:写 Prompt 容易,构建验证循环(Verification Loop)才是难点。Agent 能跑多远不重要,跑偏后能否被拉回来才是关键。文章还介绍了 Spotify 基于 Honk 系统的 fleet management 实践经验。

主要内容

1. 核心转变:Prompt → Loop

  • "Prompts 很简单,Loops 很难"
  • Agent 拿到任务后自主执行,甚至长时间无人监督
  • 最麻烦的不是 Prompt 写得不够准确,而是跑偏后有没有东西能拉回来
  • **Karpathy 团队《LOOPS.md》**核心:写 loop,不要写 prompt

2. Spotify 的实践:Honk + Fleet Management

  • Spotify 后端 monorepo 超 2000 万行代码
  • 传统做法:发文档让各团队自己改迁移 → 重复劳动,一次迁移拖几个月
  • Fleet Management:把同类改动推到整个代码库
  • Honk V2 基于 Claude Agent SDK,Agent 跑在 Kubernetes Pod 中,可访问内部工具和 CI
  • 早期用 LLM Judge 判断 Agent 生成的 PR,成功率从 20-30% 拉到 80% 后去掉
  • 关键前提:CI、测试、组件 Owner、内部工具等基础设施已就位

3. Verification Loop(验证循环)—— 进生产的门槛

  • Boris 指出:很多公司在 verification loop 上投入不够
  • 自动 PR 越来越多后,测试必须顶上来(过去靠人审)
  • Agent 修 bug 必须告诉它:如何复现、跑哪些测试、失败日志在哪
  • 改接口需要:类型检查、集成测试、回滚方案
  • 没有验证循环,Agent 不知道写对没有

4. 脚本 vs LLM 的边界

  • 规则稳定、边界清楚的任务 → 确定性脚本仍然好用
  • 但真实代码很快让脚本变复杂(API 可能被封装、赋值、藏分支)
  • LLM 的价值在灰区:规则开始变形时,让模型读上下文、判断调用关系
  • "code has an enormous API surface" — Niklas

5. 代码标准化 + 基础设施 = Agent 生产力

  • Claude 会参考仓库其他代码,同类代码十种写法会让模型困惑
  • 项目结构、命名、错误处理、测试命令、PR 模板 → 同时在喂给人 + LLM
  • 生产力靠基础设施,不靠多熬 hours — Boris
  • 速度和质量不是二选一:把质量实践自动化,写成 Skill / CLAUDE.md / MCP

6. 开发者新角色

  • 编码能力仍然在线,Agent 越能干,越要知道如何拆任务、设边界、验收、从失败日志拉回来
  • 代码不难了以后,计划、验证、品味、维护依次冒出来
  • 把 README、测试命令、任务边界、日志、CI、回滚路径整理清楚,比多背十条提示词更管用

原文关键段落

Agent 接到任务后,会自己拆解,继续往下做,并且在很长时间里没有人盯着。这个时候,验证循环就是 "the single most important thing"。

让 Agent 修 bug,至少要告诉它怎么复现、跑哪些测试、失败日志在哪里。让它改接口,也要准备类型检查、集成测试和回滚方案。没有这些,Agent 也能写代码,但它不知道自己写对没有。

速度和质量,不该被放到两边。engineering productivity is always about investing in infrastructure. It's not about working more hours.