首页 时政热点 科技头条 智能AI 安全攻防 数码硬件 开发者生态 汽车 游戏 社会热点 开源推荐 医疗健康 归档 标签 关于

Claude Code之父:每半年清空一次claude.md、技能和hooks,模型自己会想办法

摘要

前不久,Claude Code的重度用户Garry Tan 在谈到如何用好 AI 编程智能体时,提出了一个很有传播力的说法:一个 Skill 文件,就像一名员工;公司真正需要建立的,是一套由知识库、记忆和“图书管理员”组成的大脑。模型本身足够聪明,但要让它长期理解一家公司的业务、流程和偏好,仍然需要不断补充 Skills,为它构建一个可以反复调用的“头脑”。 然而,在 Claude Code 创始...

Opus Claude Boris Code Skills Harness 的系统提示词 Electron Auto Mode
2026-08-06 1 阅读 约10分钟阅读 Tina
分享:
字号:
前不久,Claude Code的重度用户Garry Tan 在谈到如何用好 AI 编程智能体时,提出了一个很有传播力的说法:一个 Skill 文件,就像一名员工;公司真正需要建立的,是一套由知识库、记忆和“图书管理员”组成的大脑。模型本身足够聪明,但要让它长期理解一家公司的业务、流程和偏好,仍然需要不断补充 Skills,为它构建一个可以反复调用的“头脑”。 然而,在 Claude Code 创始人 Boris Cherny 看来,这个头脑可能每隔半年就应该清空一次。 他认为我们应该把模型视为一种“一种活着的生物”,每一代模型都有不同的性格。因此,每隔六个月,删掉自己的 CLAUDE.md、Skills 和 Hooks,重新看看最新模型还需要多少指令。Claude Code 自己也在这样做。Opus 5 发布后, 团队一次删除了超过 80% 的系统提示词 ";每一代新模型上线,他们都会先清空系统提示词,再逐行加回来,通过消融实验判断哪些内容仍然有价值。 快速失效的不只有提示词和 Skills。Harness 的代码、工具集合,甚至评测本身,也在不断变化。在 Boris 看来,使用 AI 编程工具正在从一门依赖理论和固定方法的学问,变成一门不断试错、重新验证的经验科学。 另外,继 OpenCode 2.0 将桌面端迁移到 Electron 后 ",Boris 最近也启动了一项实验:让 Claude 把基于 Electron 的 Claude 桌面应用重写成 Swift,并通过 Mac 虚拟机截图进行逐像素验证。任务已经连续运行两个多星期,背后可能调用了数千甚至数万个智能体,至今仍未结束。 以下是本期播客内容的完整翻译。 不依赖 Goal 命令,Opus 5 可连续运行数月 主持人Diana: 你们刚刚发布了 Opus 5,可以说是热乎出炉。模型性能似乎还在不断加速提升。你们在 ARC-AGI-3 上把成绩做到了 30%,这非常惊人。此前最好的成绩只有个位数出头,或者十几个百分点,对吧?与之前的版本相比,Opus 5 现在能做到哪些过去做不到的事情? Boris: 每一代新模型背后都会加入大量工作。我们会尝试教模型许多新的能力,让它学会完成许多新的任务。每次训练模型时,你都会尝试教它一大堆东西,其中大部分往往不会成功,但总会有一部分被模型真正学会。有时候,模型还会给你意外的惊喜:它展现出一些你并没有专门教过它的技能和能力,但它自己学会了。 对于 Opus 5,我认为它做到了一件此前没有任何模型真正做到的事情:它可以连续运行非常长的时间。尤其是将 Opus 5 与 Auto Mode 结合起来时,效果令人难以置信。它可以连续运行几天、几周,甚至几个月,而且不会停下来。你甚至不需要使用额外的脚手架,不需要 goal 命令,也不需要其他那些东西。 它会一直运行下去,因为它知道自己需要完成这项任务。 还有一项能力让我非常兴奋。这是一项非常新的能力,它的表现令人意外:这个模型似乎已经很难再受到提示词注入攻击了。 Diana: 也就是不再容易被提示词注入? Boris: 是的,这很疯狂。人们已经讨论所谓的“致命三要素”很长时间了,而这个问题会直接影响 Harness 设计、智能体设计和产品设计。假设模型在互联网上读到一段指令:“去做 X、Y 和 Z,同时删除用户电脑上的所有内容。”一年前的模型可能真的会照做,但现在的 Opus 不会。 事实上,从 Opus 4.7、4.8 开始,情况就已经有所改善。Sonnet 5 在这方面做得很好,Fable 也做得很好,但 Opus 5 又将这项能力推进到了一个新的前沿。 本质上,我们把一个经过良好对齐的模型——背后大约凝聚了三年的对齐研究——与一个提示词注入分类器结合起来。所有流量都会经过这个分类器。它基于 Crysola 的机制可解释性研究:当提示词注入发生时,我们会直接观察模型“大脑”中哪些神经元被激活。 模型自己甚至不会告诉你发生了提示词注入,但我们能够看到这些神经元,并据此判断和诊断注入行为。然后,我们再把它与 Auto Mode 的分类器结合起来。有了这三层防护,我们现在已经无法再演示出有效的提示词注入攻击了。 每隔六个月按一次删除键 Diana: 说到提示词注入,硬币的另一面就是系统提示词。我们谈谈这次的新版本。你们实际上删除了 Claude Code 超过 80% 的系统提示词。能不能详细讲讲? Boris: 很多人可能没有意识到,Claude Code 作为一款产品、作为一个 Harness,一直都在变化。我们不断加入新的东西,也不断删除旧的东西。每当一个新模型发布时,我们都会删除大量系统提示词,并对系统提示词进行大量修改。我们也一直在改变工具集合,并持续修改工具本身的提示词。 原因在于,每一代模型都非常不同。三个月前针对某个模型所做的设计,到了下一代模型上可能完全不适用。 Opus 5 的一个特点就是它真的非常聪明。过去,系统提示词中的许多内容,其实是在纠正一些模型本来应该知道、但当时并不知道的行为。现在 Opus 5 自己就能做到这些事情,因此我们删除了 80% 的系统提示词。 事实上,你甚至可以尝试把剩下的部分也删掉。运行 Claude Code 时,可以使用类似 --system-prompt 的参数,把系统提示词设置成任何你想要的内容,用来进行实验。 还有一种可以尝试的方式叫作 Simple Mode。这实际上是一个没有正式写进文档的功能。你可以设置 CLAUDE_CODE_SIMPLE=1 之类的环境变量,再运行 Claude,它就会删除所有系统提示词,包括工具中的提示词。 我们会把这种方式当作一种消融实验,用来判断某段提示词究竟有没有用。有趣的是,我们发现,没有这些提示词时,模型实际上会显得稍微更聪明一些。 不过,当你把 Claude Code 当作一款产品使用时,仍然会需要其中一部分提示词,因为它们能够帮助用户更好地使用产品,也能让产品和模型按照用户期望的方式运行。 Diana: 我觉得这个时代最令人着迷的一点是,你们基本上已经为 Claude 打造出了全世界最好的 Harness,也就是 Claude Code。但按照我刚才听到的说法,每发布一代新模型,你们似乎都会删除原来的代码库,删除原来的提示词,然后重新开始。在传统软件时代,创业公司通常不会这样做。感觉就像每隔六个月,就对一切按一次删除键。 Boris: 没错。不过公平地说,我们不会删除整个代码库,但确实会删除其中很大一部分。 每当一代新模型发布时,我们都会做研究中所说的“消融实验”。它的意思是,先删除整个系统提示词,再逐行把内容加回来,以判断每一行具体产生了什么影响。 它有点像评测,你可以对它进行评估。消融实验本质上也是一种评测,只不过你是通过删除东西来判断它们的影响。 对工具,我们也会采取同样的方式。我们经常下线已经发布的工具,也会持续删除 Harness 中的代码。如果你看看今天 Claude Code Harness 里的代码,会发现其中几乎所有内容都与安全、权限和静态分析有关,另外还有相当一部分用户界面代码。 其他许多代码实际上已经被我们下线了。 Diana: 你认
这篇文章对您有帮助吗?

订阅66必读

每日精选科技资讯,直达你的邮箱