
写作 Prompt 堆到十几条,输出还是忽好忽坏:先做一次「规则体检」
把一段用了半年的写作 Prompt 逐条体检:哪些规则是模型拿不到的事实边界,哪些该收成一句带理由的判断原则,哪些可以直接删掉,再用同一批材料复测。
同一段写作 Prompt 用上半年,多数人会把它加到十几条。它要求语气专业严谨,又要求亲切自然;要求篇幅尽量短,又要求一条信息都别落下;开头叮嘱一遍「认真检查」,结尾再叮嘱一遍。规则越加越多,输出却开始摇摆:同一份材料,周一写出来干净利落,周三那份丢了一项必须写清的事,语气也从公告滑成了聊天。
Anthropic 在 2026 年 7 月的复盘里解释过这种摇摆的来源。他们翻看自家产品 Claude Code 的内部使用记录时发现,同一个请求里经常出现互相抵触的指令:系统提示写着「文档该怎么写就怎么写」,技能文件里写着「不要加注释」。模型能从上下文里猜出用户想要什么,但动手之前,它得先花力气处理这些重叠和冲突的指令,才能决定听谁的。1
官方今年的方向:把规则换成判断
同一篇复盘给出了他们自己的做法和结果:他们删掉了 Claude Code 系统提示的 80% 以上,把剩下的留给新一代模型(Claude Opus 5、Claude Fable 5)使用,在自家的编码评估上没有测出损失。删掉的主要是那类为防范最坏情况而加的约束,他们改成让模型借助上下文和判断力自己决定。1
他们举了一个具体的前后对照。旧写法是一串禁令:默认不写注释;绝不写多段的文档字符串,一行封顶;用户没有要求时,不主动写计划、决策或分析文档。新写法是一句判断:「写出与周围代码一致的代码,跟随它的注释密度、命名和习惯。」这句话没有列举任何一种情况,却把那一串禁令想管的事都管了——判断依据来自代码本身,模型读一眼就能拿到。
他们同时把「重复自己」列为过时做法。早前的模型有时需要把同一条指令说两遍,或者更听上下文末尾的话;现在的模型两处都听,那些重复的叮嘱可以直接删掉。
这套结果来自他们自家的产品、模型和编码任务,80% 这个比例不能照搬到你写通知的 Prompt 上。能迁移过来的是那条判断标准:模型自己拿得到的信息,值得写成规则;模型本来就能拿捏的尺度,写成一句它会自己判断的原则。
Anthropic 在 2026 版最佳实践里,把这条写成了收尾的话:最好的 Prompt 是那个用最少的必要结构就能稳定达成目标的,长度和复杂度都不加分。2
规则体检:给每条规则贴一个标签
把现有 Prompt 摆开,逐条问一个问题:这条规则约束的东西,是模型拿不到的信息,还是它能自己拿捏的尺度?答案会落在三个标签上。
| 判定 | 这条规则长什么样 | 处理动作 |
|---|---|---|
| 硬约束 | 必须覆盖的事实项、口径与来源、合规与法务要求、必须逐字保留的日期和数字、篇幅与格式上限 | 留下,写全,放在显眼处 |
| 判断原则 | 一串特例组成的风格要求:不要用列表、不要写黑话、每段不超过三句 | 收成一句原则,附上理由和边界 |
| 脚手架 | 模型本来就会做好的动作、不携带信息的头衔、与任务无关的叮嘱 | 直接删掉 |
体检里还有一项要单独做:把方向相反的规则两两找出来。「专业严谨」和「亲切自然,像同事说话」是一对;「全文 600 字以内」和「必须覆盖五项事实」在材料复杂时也是一对。这类规则把取舍留给模型,而模型每次的侧重略有不同,成稿的语气和详略就跟着摆动。处理方式只有两种:留下更贴合读者任务的那一条,或者写清谁优先。
判断原则怎么写:原则、理由、边界
把一串禁令换成原则,是为了让模型在规则没写到的地方也拿得出方向。一句可用的原则要带三样东西:能自己判断的一句话、这条原则背后的目的、一个允许破例的边界情形。
通知类文字里最常出现的一类要求是排版和用词偏好。
改写前:「不要用列表,不要用破折号,不要堆砌『赋能』『闭环』这类黑话。」
改写后:「正文以成段文字展开,一段只负责一件事。这样写的理由是读者要通读一遍就抓住结论,列表会把结论切成散点。当内容本身是并列的独立项——生效时间、费用档位、操作入口——才用列表,每项一行以内。」
第二句里的理由值得单独说。Anthropic 在 2026 版最佳实践里把它列为一条独立技巧:与其写「永远不要使用项目符号」,不如说明你偏好成段文字,因为读起来更顺、更像在说话。你把原因写出来,模型就能在原则没覆盖到的地方做出方向一致的选择。2
同一篇里还有两条与体检相关的提醒。要求最好写成想看到的做法:「用成段的流畅文字」比「别用列表」更容易被执行。示例属于值得保留的一类,不过现代模型会非常仔细地模仿示例里的每个细节,留哪个示例要看住。2
一条可直接复制的「规则体检」Prompt
第一轮只做检查,不改写,也不生成成稿。把体检表拿在手里确认过,再进第二轮。
你是一名提示词编辑。下面是我用了半年的写作 Prompt,规则越加越多,输出开始忽好忽坏。
<prompt>
[粘贴你现在用的写作 Prompt 全文]
</prompt>
<task>
逐条检查 prompt 里的规则,输出一份《规则体检表》。
第一步,编号摘录每一条规则,保持它的原意,不要合并或改写。
第二步,给每条规则判定类型:
- 硬约束:模型自己拿不到的事实、口径、边界、必须逐字保留的内容、篇幅与格式硬指标;
- 判断原则:由一串特例组成的风格要求,模型有能力自行拿捏尺度;
- 脚手架:模型本来就会做好的动作、不携带任何信息的头衔、与任务无关的叮嘱。
第三步,判定为「判断原则」的规则,写出改写后的一句原则,附上理由(这条原则是为了让读者做成什么),再加一个边界情形(什么情况下允许破例)。
第四步,判定为「脚手架」的规则,写明删除。
第五步,单独找出【互相打架的规则】:哪些规则的方向彼此相反,或者在同一份材料上无法同时满足,并给出只留一条或标明优先顺序的建议。
输出格式:
| 编号 | 规则原文 | 判定 | 依据 | 处理动作 |
另附两个清单:
【冲突规则】两两列出方向冲突的规则,并说明冲突发生在什么情形。
【我的疑问】你无法判断类型的规则,以及需要我确认的业务信息。
这一轮只输出体检表和两个清单。改写 Prompt 和生成成稿,留到我说确认之后的下一轮。
</task>第二轮按确认结果重写,并准备好复测。
这是我确认后的《规则体检表》:
[粘贴确认后的表格与两个清单]
请按它重写我的写作 Prompt,并给出复测方案。
1. 新 Prompt 只保留三类内容:硬约束、改写后的判断原则、必须由我填写的业务信息占位符。
2. 删除所有判定为脚手架的规则;对冲突规则,按我给出的优先顺序只保留一条。
3. 在硬约束里写明:材料里确认不了的内容,标为「待确认」写在末尾。
4. 输出三份内容:
- 新版 Prompt 全文;
- 改动清单(原编号 → 保留 / 改写 / 删除,各用一句话说明理由);
- 复测方案(用哪几份材料、看哪几项是否达标、哪些差别算变差)。复测这一步要单独留出时间。做法是同一批材料用同一份验收标准跑两遍:先用旧版建立基线,再用新版跑同一批材料,逐项对照。最常见的三种变差是:原本覆盖的事实项掉了、口径被改动了、篇幅失控。Anthropic 的评估指南把这套做法写得很具体:先把成功标准定成具体、可测、与真实任务一致的条件,测试用例要贴近你真实的任务分布,并覆盖那些容易出问题的情况。3
实战:把 14 条规则减到 5 条
下面这组材料和 Prompt 是虚构的,用来展示规则变化会带来什么差别。
一家 SaaS 公司的运营同学用同一段 Prompt 写产品变更通知,规则已经加到 14 条。其中九条是:
你是一位有 15 年经验的企业传播专家。
请一步一步思考,先分析读者,再开始写。
语气要专业严谨,符合正式公告规范。
同时要亲切自然,像同事在跟用户说话。
不要用列表,不要用破折号,不要堆砌「赋能」「闭环」这类词。
全文控制在 600 字以内。
每段不超过三句话。
必须覆盖这五项:变更内容、生效时间、影响范围、用户需要做什么、去哪里求助。
材料里没有的内容不要写。体检结果如下。
| 编号 | 规则原文 | 判定 | 依据 | 处理动作 |
|---|---|---|---|---|
| R01 | 你是一位有 15 年经验的企业传播专家 | 脚手架 | 头衔不携带模型拿不到的信息,成稿里也看不出它 | 删除 |
| R02 | 请一步一步思考,先分析读者,再开始写 | 脚手架 | 分析步骤由模型自己安排 | 删除 |
| R03 | 语气要专业严谨,符合正式公告规范 | 冲突 | 与 R04 方向相反,模型只能折中,语气在两种腔调之间来回 | 只留一条,改写为「把话说清楚」 |
| R04 | 同时要亲切自然,像同事在跟用户说话 | 冲突 | 与 R03 相反;真要显得体贴时,它还会越过 R09 的事实边界 | 删除 |
| R05 | 不要用列表、破折号、黑话 | 判断原则 | 三条禁令在材料真有并列项时互相绊住 | 改写成一句原则,附理由与边界 |
| R06 | 全文控制在 600 字以内 | 硬约束(次要) | 篇幅是硬指标,但与 R08 在材料复杂时互相挤压 | 保留,并写明覆盖事实优先 |
| R07 | 每段不超过三句话 | 判断原则 | 真正想要的是「一段只做一件事」,句数是拍出来的数字 | 改写成原则 |
| R08 | 必须覆盖这五项 | 硬约束 | 事实边界,模型无从推测 | 保留 |
| R09 | 材料里没有的内容不要写 | 硬约束 | 边界,保留并改写成可执行动作 | 改为「只写材料里能确认的内容;确认不了的标为『待确认』」 |
按体检结果重写之后,五条规则代替了原来的十四条:
你在为「XX 协作工具」写一份面向现有客户的变更通知。
【这份文字要完成的事】
读者是已经开通服务的客户。他们最想知道的是:这次变更会不会影响我,我要不要现在做点什么。读完他们应该能自己判断要不要行动。
【必须写清的事实】
只写材料里能确认的内容:变更内容、生效时间、影响范围、用户需要做什么、去哪里求助。
材料里确认不了的内容,标为「待确认」写在末尾。
篇幅尽量控制在 600 字以内;写全上面五项和这个上限冲突时,先把事实写全。
【写作原则】
正文以成段文字展开,一段只负责一件事。这样写的理由是读者要通读一遍就抓住结论,列表会把结论切成散点。当内容本身是并列的独立项(生效时间、影响范围、操作入口)时用列表,每项一行以内。
语气以「把话说清楚」为准:事实句给全限定条件,把用户要做的事放在他们能照着做的位置,行业黑话换成日常说法。同一份材料——客户端的离线草稿保留时间从 30 天调整为 7 天,2026 年 9 月 30 日生效——两版 Prompt 交出的文字,差别集中在几处:
| 检查项 | 旧版输出 | 新版输出 |
|---|---|---|
| 材料里没有的说法 | 多出一条「可在设置中切回 30 天」 | 未出现 |
| 生效时间 | 写到了 | 写到了,并带上年份 |
| 用户要做什么 | 停在「请及时处理」 | 写清导出路径与截止日期 |
| 求助入口 | 漏掉 | 写到了 |
| 语气 | 「亲爱的用户」与「优化升级」混在一起 | 全篇同一种说法 |
| 篇幅 | 约 480 字 | 约 160 字 |
旧版那份文字的毛病,都能对着体检表里的几组规则找出来:R03 与 R04 方向相反,模型折中出一会儿亲切一会儿公文的腔调;R04 想要体贴,R09 要求只用材料里的内容,模型在写不出好消息时挑了前者,于是多出一句材料里没有的「可在设置中切回 30 天」;R06 的 600 字上限与 R08 的五项事实互相挤压,写到一半篇幅就紧,第五项「去哪里求助」被挤掉了。
删掉规则之后,稳定性从哪里来
第一,省下的是动手前的判断成本。重叠和冲突的指令要求模型先决定听谁的,处理这些冲突的开销不会出现在成稿里,却会消耗它安排在写作上的注意力。1
第二,原则能管到规则没写到的情况。写通知时会遇到的情形列不完,一串特例总有覆盖不到的地方;一句带理由的原则,在没被覆盖的地方仍然给得出方向。
第三,冲突规则是摇摆的直接来源。这件事可以自己验证:同一批材料跑两遍旧版,再跑两遍新版,比较哪一组两次之间的差别更小。差别小下来的那一组,说明输出更多由材料决定,模型每次裁决所占的比重更小。
这些内容必须原样留下
硬约束不参与瘦身。合规与法务口径、监管要求、必须逐字保留的日期数字范围、必须覆盖的事实项、篇幅与格式硬指标,删掉它们等于把风险交给模型去猜。
那次删掉 80% 的依据是新一代模型。你手里的模型如果版本较老、能力较弱,或者你换用了一个体积很小的本地模型,被删掉的脚手架得有选择地加回来:判断原则对能力较弱的模型往往不够用,它需要更明确的动作指令。1
写作任务里的中间产物也都在硬约束这一栏。来源账本、必留清单、写作状态卡这类东西,携带的是模型自己拿不到的材料与判断依据,它们的作用是补信息,所以不在删除范围。
体检的结论还有时效。模型换代、任务类型更换、你开始写一个新的文种,这套判断都要重做一遍。
发布前 30 秒检查清单
- 新版 Prompt 里的每一条规则,能不能用一句话说清它约束的是什么?说不清的那条删掉。
- 有没有两条规则的方向彼此相反?只留一条,或者写清谁优先。
- 每句判断原则后面,有没有跟着理由和边界情形?
- 必须覆盖的事实项、口径、篇幅上限,是不是完整地留了下来?
- 同一批材料,旧版和新版各跑过一遍了吗?差别记下来了没有?
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
