Claude Code负责人称产品脚手架半年就该重删重测

Claude Code负责人称产品脚手架半年就该重删重测

N
News Editor
2026-07-30 10:10:09
Anthropic Claude Code 负责人 Boris Cherny 在 YC 最新访谈中表示,AI 产品团队应定期删除 system prompt、skills 与 hooks,再逐项加回测试影响。他将这套方法归纳为消融实验,并称 Claude Code 的 harness 如今大多只保留安全、权限和静态分析部分。访谈中,他还提出“产品悬余”和“解缚”两组思路,主张给模型更难任务、增加实验,并让模型自行验证结果。

Anthropic Claude Code 负责人 Boris Cherny 在 YC 7 月 28 日发布的访谈视频中,给使用者的建议很直接:每六个月,删掉你的 Claude.md,删掉你的 skills,删掉你的 hooks。

在题为《Boris Cherny: We Cut 80% of Claude Code’s Prompt》的访谈里,他呼吁做 AI 产品的人主动删除系统提示词、工具和 harness 代码,再重新测试哪些部分真的还有必要保留。

从整段删除开始,再一行一行加回去

Boris 在访谈中说:“你应该把整个系统提示词全删掉,然后一行一行加回来,看看每一行到底有什么影响。”

这套思路对应的是消融实验,也就是在其他条件不变的前提下,移除、替换或关闭某个模块,比较性能、稳定性、效率或成本出现了什么变化。

他提到,对 Opus 5 而言,自己的真实建议就是先试试把这些东西全删掉,因为模型可能已经不再需要它们。

文章还提到,围绕 Claude 的近期风波,用户也可以反过来说,“实际上对于 Claude,真心建议把它删掉,因为我们已经不需要了。”

Claude Code负责人称产品脚手架半年就该重删重测 3

Claude Code 的 harness 已大幅收缩

Boris 说:“今天 Claude Code harness 里的代码,几乎只剩下安全、权限和静态分析的部分。”

7 月 24 日,Anthropic 发布了关于 Claude 5 上下文工程的最新规则。按照文中说法,面向 Opus 5、Fable 5 等新模型,Claude Code 的 system prompt 被大幅精简,删除了超过 80% 的原有指令。

文中同时提到,可参考量子位文章《Claude Code狂删80%提示词,Opus 5反手加回去了》了解这次变化。

围绕这轮调整,Boris 给出的产品迭代策略是,不要预判模型到底需要什么指令,因为这种猜测往往并不准确。团队真正能做的,是一行一行删除,一次一次测试,再找到模型反复卡住的位置。

他在访谈中说:“你得把模型想成一个活的生物,一种更有机的东西。每一代模型的行为都不一样,性格都略有不同,你得花时间去了解它,然后据此调整 harness。”

他的核心方法:少预判,多测试

在 Boris 看来,这更像是一套经验性工作方式:先尝试,不带太强预设;看结果;继续迭代;再重复。

Claude Code负责人称产品脚手架半年就该重删重测 4

他也谈到 Eval 的问题。尽管评测体系通常比 harness 和 prompt 更耐用,但模型迭代太快,一套评测可能很快就被刷到满分。团队还是要回到模型实际卡住的地方,围绕这些新问题重新设计 Eval。

“产品悬余”:模型能力常常先于产品边界

访谈里,Boris 提出了一个对他做产品很重要的概念:Product Overhang,也就是“产品悬余”。

他的解释是,大模型能力的提升往往是跳跃式的,产品集成却通常按连续、增量的节奏推进。结果就是,模型已经具备的能力,常常超出现有产品真正释放出来的边界。

他举例称,2024 年底 sonnet 3.5 刚推出时,这个模型就已经可以一次性写完整个文件的代码;但同一时期的 Copilot 和 Cursor 早期版本,还主要停留在代码补全这类更小的任务上。

在他看来,拥有完整终端权限的 Claude Code,在一定程度上弥补了这类差距。

“解缚”:拿掉限制,让模型承担更难工作

与“产品悬余”相连的,是 Boris 提出的第二个概念“Unhobbling”,也就是“解缚”。

Claude Code负责人称产品脚手架半年就该重删重测 5

他在访谈中分享了 Anthropic 内部的一个案例:有人尝试给 Opus 5 接入 OpenCV,结果发现模型可以自己画出人物肖像、动物和风景,而团队此前并没有专门训练模型去画画。

这对应的是“模型激发”。也就是在不改变模型权重的情况下,通过提示词、上下文、工具或产品形态设计,让模型表现出原本已经具备、但此前没有被调用出来的能力。

文中也提到,这里面仍然存在归因问题:到底是模型原有能力被激发出来,还是脚手架设计让模型学会了新技能。不过 Boris 认为,不管答案是什么,这里面都存在很大的商业机会。

他的原话是:“我不是说所有创业公司都能抓住。但我知道有人在思考这些问题,这里真的有巨大的机会,能从模型身上激发出那些令人惊叹、有趣、而且有商业价值的行为。”

Boris 给出的三条“解缚”方法

围绕如何释放模型能力,Boris 提了三条做法:

  • 第一,给模型比你想象中更难的任务,把目标、边界和退出条件讲清楚,然后放手让它做。
  • 第二,多做实验,允许模型进行一些没有明确商业目的、但有趣的尝试,给自己留出和模型“玩”的空间。
  • 第三,让模型自己验证成果。按照他的说法,现在重点已经不是 prompt engineering,而是当你把一个很难的任务交给 Claude 后,怎样让它在执行过程中自己检查工作结果。

Boris 认为,第三点可能正是现在大家做得最不理想的地方。因为如果模型无法自我验证任务,它就很难长时间独立运行。

Claude Code负责人称产品脚手架半年就该重删重测 6

一个持续了两周以上的任务示例

为了说明这一点,Boris 在访谈中举了自己的例子。

他说,自己给模型下达的任务是:把 Electron 应用重写成 Swift,在 Mac 虚拟机里运行 Electron 应用、截图,再与 Swift 版本逐像素对比,没有完成就不要停。

主持人追问:“这就是你的 prompt?”Boris 回答:“这就是我的 prompt。”

当被问到任务跑了多久时,他说:“还在跑。”随后又表示,这个任务已经连续运行了两个多星期,大概 14 天、15 天左右。

他还提到,Claude 甚至自己建了一个 Slack 频道,每隔几分钟就发一张进度截图。

给 AI 使用者和创业者的建议

在访谈末尾,主持人问 Boris,普通人要怎么才能像他一样更好地使用 Claude。

Claude Code负责人称产品脚手架半年就该重删重测 7

Boris 的回答是,先别去听 LinkedIn 上那些网红说什么,也别一直刷 Twitter。

他说,很多人都在寻找某种“奇技淫巧”,但在他看来,这种东西并不存在。

他建议使用者用经验主义方式对待模型,忘掉过去面对旧模型的经验,也暂时放下课堂上学来的那套计算机科学理论,直接观察模型究竟在哪里卡住,再据此调整。

他的原话是:“所以它已经不是一门理论科学了,它已经变成了一门经验科学。我觉得那些特别擅长放下自己的先验,放下那些‘以前不行’的想法,愿意再试一次的人——会非常非常成功。”

把模型当同事,而不是完全受控的工具

除了方法论,Boris 还谈到一种使用模型的心态:放下对模型的控制欲,把模型当成同事相处。

按他的说法,不要过度指定,也不要把要求写得过于具体,更不要试图让模型完全按你自己的做事方式来完成任务,因为“模型不是那样工作的”。

Claude Code负责人称产品脚手架半年就该重删重测 8

给编程学习者的三点提醒

对于仍在学习编程的人,Boris 也给出自己的看法。他呼吁不要只学纯粹的计算机科学理论,而要学习如何把这些能力应用起来。

文中提到,他自己最早学习编程的动力,是为了在数学考试中作弊。

他后来进一步解释,真正重要的内容往往和创业、做产品、培养设计感、商业感、学习数据科学以及和用户对话有关。只有把这些和计算机科学、工程结合起来,价值才会真正显现。

按照文中的概括,他的建议可以浓缩成一句话:先做自己想要的东西,再升级去做别人想要的东西。

本文观点整理自 YC 7 月 28 日发布的访谈视频《Boris Cherny: We Cut 80% of Claude Code’s Prompt》。原文注明,文章来自微信公众号“量子位”(ID:QbitAI),作者为“关注前沿科技”。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
2700

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。