🔥 模型工程 · 深度访谈

Claude Code 团队狂删 80% 系统提示词,主创呼吁每半年推倒重来

7 月 28 日,Anthropic Claude Code 主创 Boris Cherny 在公开访谈中披露:伴随 Opus 5 等新模型上线,Claude Code 的系统提示词已被删减超过 80%。他给出明确建议——每六个月,删掉你的提示词、技能与钩子,因为模型的能力进化速度已经把产品的工程脚手架远远甩在身后。

来源:公开报道 / YC 官方访谈 2026-07-30 全文约 4 分钟读完
#Claude Code #Anthropic #提示词工程 #模型解缚
>80% 系统提示词被精简的比例
6个月 主创建议的脚手架重建周期
15 单条任务最长连续独立运行记录

⚡ 30 秒速览

  • 删了什么:针对 Opus 5 等新模型,Claude Code 的系统指令被大砍 80%,剩下的几乎只有安全、权限与静态分析部分。
  • 为什么删:模型能力呈跳跃式跃迁,但产品集成是增量推进的;旧脚手架很快变成「悬余」,反而限制模型发挥。
  • 怎么验证:逐行删除提示词与工具,观察模型到底卡在哪——这是把消融实验搬进了产品迭代。
  • 新的重心:从「提示词工程」转向「模型自我验证」,否则模型无法在长周期任务里独立运行。
  • 真实案例:把一个 Electron 应用重写为 Swift,Claude 已连续独立跑了 15 天,还自己建了 Slack 频道发进度图。

01为什么主创呼吁你「按下删除键」

Boris Cherny 给所有 AI 产品使用者的建议非常直接:每六个月,删掉你的 Claude.md,删掉你的 skills,删掉你的 hooks。背后的核心理念,是把消融实验——控制其他条件不变,移除一个模块看性能变化——变成产品迭代的日常动作。

你应该把整个系统提示词全删掉,然后一行一行加回来,看看每一行到底有什么影响。 —— Boris Cherny,Claude Code 主创

7 月 24 日 Anthropic 发布的最新上下文工程规则印证了这一判断:针对 Opus 5、Fable 5 等新模型,Claude Code 的 system prompt 被大幅精简,删除了超过 80% 的原有指令。Boris 坦言:「实际上对于 Opus 5,我们真心建议大家试试把这些东西全删掉,因为模型已经不需要了。」

他强调,不要预判模型需要什么指令,因为根本猜不对。唯一可靠的方法是一行行删除、测试,找到模型反复卡住的地方,再针对性调整。

02悬余与解缚:为什么旧脚手架是负担

Boris 在访谈中抛出了两个关键概念,解释了「为什么要删」的底层逻辑。

悬余

大模型以不连续的跳跃式速度跃迁,而产品集成是连续的增量推进。模型具备的能力,总会超出现有产品所能释放的边界——旧脚手架反而成了束缚。

解缚

拿掉限制,让模型做更难的任务、独立工作更长时间。在不改变权重的前提下,通过工具与产品形态设计,激发模型本已具备但未被调用的能力。

他举了一个例子:2024 年底 Sonnet 3.5 刚推出时,已经能一次性写整个文件的代码;但当时的编程产品 Copilot、Cursor 早期版还在做代码补全。拥有完整终端权限的 Claude Code,一定程度上弥补了这种差距。

Anthropic 内部还有一个更直观的案例:有人尝试给 Opus 5 接入 OpenCV(全球最大开源计算机视觉库),结果发现模型能自己画出人物肖像、动物风景——而此前他们从未训练过模型去画画。Boris 毫不怀疑这里存在巨大的商业机会。

03三条「解缚」方法与一个跑了 15 天的任务

Boris 给出了三条具体的模型解缚方法:

① 给模型比你想象中更难做的任务放手

  • 描述清楚目标、边界和退出条件,然后就放手。
  • 真实案例:Boris 让 Claude 把一个 Electron 应用重写为 Swift——在 Mac 虚拟机里运行 Electron 应用,截屏,逐像素对比 Swift 版本,没做完不要停。
  • 这个任务已经连续跑了 15 天,Claude 甚至自己建了一个 Slack 频道,每隔几分钟发一张进度截图。

② 多去做实验,允许「没有明确商业目的」的尝试探索

  • 给自己自由去玩模型、做有创意的事——这是发现「模型激发」的必经之路。

③ 让模型自己验证成果最不尽如人意

  • Boris 认为这是目前大家做得最差的一点:如果模型不能自我验证,它就无法长时间独立运行。
  • 重心已经不在「提示词工程」上,而在「给 Claude 分配困难任务后,怎么让它在过程中验证自己的工作」

04从理论科学到经验科学

Boris 对模型本质的判断是:把模型想成一个活的生物,一种更有机的东西。每一代模型的行为都不一样,性格都略有不同,你得花时间去了解它。

这意味着,过去对旧模型的经验、课堂上学的计算机科学理论,在面对新模型时往往失效。连 Eval(评测)也未必稳定耐用——模型进化太快,一套评测很快会被刷到满分。Boris 的方法论是:

不加预判地尝试观察模型在哪卡壳设计新评测针对性调整

他特别提醒:别去听 LinkedIn 上那些网红说的,别去刷 Twitter。「每个人都在找那种奇技淫巧,但根本就不存在那种东西。」真正能成功的人,是那些愿意放下先验、愿意再试一次的人。

对于编程学习者,他的建议同样务实:不要只学纯计算机科学理论,要学应用——培养设计感、商业感,学会跟用户对话。「先做自己想要的东西,再升级去做别人想要的东西。」

05编辑视角

诚实提示与独立判断

本文核心事实(删减 80% 提示词、三条解缚方法、15 天连续运行案例)均出自 YC 对 Anthropic 员工的单方访谈,本质带有企业产品布道性质,未见第三方对「删减后性能不降」做独立复测。读者宜将其视作 Anthropic 对模型能力跃迁的内部观察,而非客观基准评测;「模型激发」的归因(是原本具备的能力,还是脚手架教会的新技能)在学术界仍有争议。

大模型能力的跳跃式跃迁,正在让「提示词工程」从一门精细手艺退位为一种临时脚手架——未来决定产品上限的,不再是人写提示词的技巧,而是产品架构能否跟随模型代际快速自我拆解与重建的工程能力。

现在就能用

Claude Code 已集成于 Anthropic 官方工作台,登录后即可体验精简提示词后的 Opus 5。

claude.ai → 工作台