开发者生态
morning
AI-Native SDLC 从您的基础设施开始
2026-08-31
1 阅读
约5分钟阅读
aviramha
字号:
Anthropic 发布了一本手册,用于围绕编码代理重构软件生命周期。它的前提是,传统的SDLC是在编写代码是缓慢部分时设计的,代理使该部分变得更快,并且约束转移到它周围的阶段。该框架有六个阶段,每个阶段都会提交一个下一阶段可以读取的工件。规划产生一个intent.md。设计将其转化为spec.md。在编辑任何代码之前,Build 会生成 plan.md。部署将审核策略放入 REVIEW.md 中。它比大多数流程文档更具体,但它也遗漏了一个重要的细节,可以决定流程的其余部分是否真正有效,这就是代理代码在检查自身时运行的内容。第 4 阶段:代理检查自己的工作 # 第 4 阶段是反馈循环,代理在工程师看到之前检查自己的工作。剧本要求你给它一些东西来检查,无论是测试、构建还是屏幕截图差异。它告诉您通过编辑测试来阻止代理将红色测试变成绿色,并使用在修复期间阻止对测试文件进行编辑的挂钩。对于 UI 工作,建议通过 MCP 在浏览器或屏幕截图工具中进行连接。然后,它比大多数组织更进一步,要求您将编码代理自己的配置视为软件:在 CI 中运行的评估,每当它们发生变化时重新测试 CLAUDE.md、技能和挂钩,每个生产事件都变成永久评估。第 4 阶段要求您在任何工作之前准备好测试套件和构建,分别使用一个命令在本地运行。这个先决条件是剧本停止和基础设施开始的地方。它告诉您代理需要可以运行的测试。它没有说明这些测试应该针对什么运行,对于一个与十几个其他(加上数据库、队列、第三方 API 等)对话的服务来说,它描述了大多数现实世界的软件,这就是大部分问题。为什么验证是困难的部分 # 如果测试针对代理机器上这十几个服务的假副本运行,那么测试通过会告诉您代码可以对抗假冒服务。它是否对集群中的那些起作用是一个不同的问题。运行这些相同测试的开发人员大致知道对它们的信任程度。他们知道假计费服务是一年前编写的,而真正的计费服务在两个月前更改了其身份验证标头。他们知道假搜索端点总是返回相同的三个结果,而真正的搜索端点会分页。他们知道假集合中没有任何内容会限制他们的速率或超时。经纪人对此一无所知。它看到测试通过并报告工作已完成。这与其说是剧本中的缺陷,不如说是它所能涵盖的内容的边缘。每个其他阶段都处理存储库中的文件,而 Anthropic 可以具体说明这些文件,因为 Claude Code 是他们的。服务、数据库、队列、消息代理以及代码所涉及的所有其他内容都是您的。没有模型供应商可以告诉您这些是什么样子,因此剧本告诉您进行检查并就此停止。 Anthropic 的剧本采用图表。箭头表示首先采用这个,顶行是您可以在没有先决条件的情况下开始的地方。反馈回路位于该行。代理永远看不到正在运行的系统 # 查看工件链包含的内容:intent.md、spec.md、plan.md、CLAUDE.md、技能、REVIEW.md。每个人都记录了一个人决定并写下的事情。这些都不允许代理查看系统现在在生产(或登台)中运行的情况。不是上游服务在调用时返回的内容,不是队列中的内容,也不是临时数据库当前的架构实际是什么,这可能是代理正在处理的分支后面的多次迁移。 CLAUDE.md 告诉代理组织决定了什么,而不是实际运行的内容。 mirrd 的作用#mirrord 让代理的代码针对临时集群中的真实服务运行,而不是在其机器上的伪造服务上运行。代码仍然在本地运行,或者在 CI 运行器或沙箱上运行。改变的是它周围的一切:进程读取与它在集群中代表的服务相同的环境变量和秘密,它的出站调用通过集群的网络发出,集群内的流量可以路由到它。我们为开发人员构建了这个,他们主要使用它来通过消除部署和等待周期来缩短反馈循环。代理可以从中获得更多收益,因为开发人员仍然可以判断一组赝品的陈旧程度,但代理却不能。对集群中的服务运行检查意味着没有人需要做出这样的判断。在检查之前它也有帮助。相同的连接使代理可以查看 API 实际返回的内容以及队列上的消息实际包含的内容,而不是根据文档进行工作。针对一个集群运行多个代理 # 该剧本建议运行多个 Claude Code 会话
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱