文章摘要
文章介绍了针对Claude 5代模型的上下文工程新规则,强调通过优化提示结构和信息组织方式,提升模型理解与生成效果,并提供了具体实践建议。
文章总结
好的,这是根据您提供的英文文章内容,用中文重新陈述的主要文章内容,已保留关键细节并删除了与主题无关的导航、页脚等元素。
文章标题:Claude 5代模型的上下文工程新规则
核心观点: 随着Claude模型能力的提升,我们删除了Claude Code中超过80%的系统提示词,且未对编码评估结果造成可衡量的损失。本文分享了从中总结出的上下文工程新规则,并指导用户如何将这些经验应用于自己的Claude Code和AI代理中。
主要发现与新旧规则对比:
从“给规则”到“让Claude自行判断”
- 旧做法: 为防止Claude出现删除文件等最坏情况,系统提示词中会包含非常强硬的指令(例如“默认不写注释,永远不要写多段落文档字符串”)。但这些指令在某些场景下是错误的。
- 新做法: 新模型具备更好的判断力,无需硬性规则。例如,新提示词改为“编写与周围代码风格一致的代码:匹配其注释密度、命名习惯和惯用写法”。
从“给例子”到“设计接口”
- 旧做法: 通过提供示例来指导Claude使用工具。
- 新做法: 示例会限制Claude的探索空间。应更关注工具、脚本和文件本身的设计,通过参数(如将状态枚举为“待办”、“进行中”、“已完成”)来暗示Claude如何使用,而非提供具体示例。
从“一次性全给”到“渐进式披露”
- 旧做法: 将所有信息(如代码审查、验证方法)都放在系统提示词中。
- 新做法: Claude现在能很好地按需加载上下文。例如,将验证和代码审查功能做成独立的“技能”,让Claude在需要时选择性调用。工具也支持“延迟加载”,代理在使用前才搜索其完整定义。用户自己的
CLAUDE.md和Skill.md文件也应采用此策略,避免做成一个庞大的知识库,而是建立一个可按需加载的文件树。
从“重复指令”到“简洁的工具描述”
- 旧做法: 在系统提示词和工具描述中重复相同的指令。
- 新做法: 删除重复内容,将工具的使用方法直接放在工具描述中,而非系统提示词里。
从“手动记忆”到“自动记忆”
- 旧做法: 鼓励用户通过快捷键手动将信息保存到
CLAUDE.md文件中。 - 新做法: Claude现在会自动保存与工作和用户相关的重要记忆。
- 旧做法: 鼓励用户通过快捷键手动将信息保存到
从“简单规格”到“丰富引用”
- 旧做法: 依赖简单的Markdown文件作为计划或规格说明。
- 新做法: Claude能处理更复杂的引用,例如引用HTML工件、代码(如详细的测试套件或不同代码库中的函数),甚至使用“评分标准”来让Claude验证特定领域的品味(如好的API设计)。
如何应用于你的上下文工程:
- 系统提示词: 与产品上下文紧密相关,用于告诉Claude它正在操作什么产品。如果你在构建自己的代理框架,应在此处投入大量精力。
- CLAUDE.md: 保持轻量,简要描述仓库用途,主要篇幅用于记录代码库中的“陷阱”。避免陈述Claude通过查看文件系统就能知道的“显而易见”的事情。善用渐进式披露,例如在
CLAUDE.md中引用一个独立的验证技能文件。 - 技能: 将其视为轻量级指南,让Claude在需要时找到信息。避免过度约束,除非是高度重要的领域。对于较长的技能,应尽量拆分成多个文件以实现渐进式披露。技能最适合编码你、你的团队或产品特有的观点、知识或最佳实践。
- 引用: 可以使用
@符号提及文件作为引用。优先使用代码文件(如HTML原型),因为它能提供清晰、高保真的指令。
总结: 就像我们做的那样,你可能需要简化你的系统提示词、技能和CLAUDE.md文件。我们推出了一个名为claude doctor的新命令,可以帮助你自动完成这项工作。
评论总结
根据评论内容,总结主要观点如下:
1. 系统提示词应简化,赋予模型更多判断力 - 多位评论者支持减少冗长指令,让模型自主判断。例如,luciana1u 认为趋势终点是提示词仅需“you know what to do”(评分无);simonw 提到使用“use your own judgement”效果良好(评分无);firasd 指出过度修饰提示词不必要,更倾向于手动编辑(评分无)。
2. 对 Anthropic 文章内容持怀疑或批评态度 - 部分评论质疑文章缺乏新意或具体细节。orbital-decay 认为内容“像常识”,且 Anthropic 的建议与实际情况不符(评分无);m3h 批评“give Claude judgment”过于模糊,要求具体变更列表(评分无);0gs 指出文章未注明人类贡献者(评分无)。
3. 担忧自动记忆功能的风险 - Kiro 和 threecheese 对自动记忆表示担忧。Kiro 认为记忆可能污染上下文,干扰实验性任务(评分无);threecheese 指出记忆功能会做出不合理假设,且用户无法精细控制,导致意外决策(评分无)。
4. 其他观点:锁定效应、模型退化等 - Fordec 认为简化提示词是 Anthropic 增加锁定效应的手段,并指出 Opus 5 错误率上升(评分无);devnonymous 讽刺地总结“没人真正理解原理,只是乱试”(评分无);janpeuker 建议使用反例而非示例来引导模型(评分无)。