
写作 Prompt 先写「什么算合格」:让 AI 按验收标准交稿
把「写得清楚、自然、完整」改成可逐条检查的验收标准,让 AI 先按标准写稿,再只修正未达标的部分。
你让 AI「写得准确、简洁、有条理」,它通常不会反驳,只会把这些词各做一点:句子短了,重点却没了;段落看着整齐,读者要做什么仍然不清楚。问题往往不是 Prompt 缺少形容词,而是没有告诉模型一份合格稿件要满足哪些可检查的条件。
今天只改一个地方:在写作要求前面,先写出「什么算合格」。让模型先按这组标准成稿,再逐条检查;检查失败,只改失败的部分,不要整篇凭感觉重写。
今日实践:把好文风改成验收标准
「有条理」「自然」「信息完整」都太宽,模型很难判断自己是否达标。把它们换成读者可以直接核对的句子:
| 模糊要求 | 可验收的写法 |
|---|---|
| 有条理 | 开头先给结论;每段只回答一个问题;段落之间不重复同一信息 |
| 信息完整 | 必须交代对象、动作、条件和例外;材料没提供的内容标为「待确认」 |
| 简洁 | 删除不改变意思的修饰语和重复句;保留数字、日期、限制条件和操作路径 |
| 自然 | 优先使用常用动词;少用抽象名词堆叠;连续三句不要使用相同句式 |
这一步不是给模型增加一套漂亮的术语,而是把「写得好不好」变成几道能回答「是」或「否」的问题。Anthropic 的提示工程概览把成功标准、可经验测试的方法、第一版 Prompt列为开始优化前的准备条件,并提醒并非所有失败都该靠 Prompt 解决。1
Google 的提示设计指南也把任务拆分、约束、输出格式和迭代测试列为常用策略;复杂任务可以拆成连续步骤,前一步的结果交给下一步处理。2
可直接复制的 Prompt
下面这条 Prompt 适合把一份事实材料改写成帮助中心说明、产品通知或工作邮件。你只要替换「读者」「目的」「材料」和长度即可。
你是一名中文编辑。请根据「材料」写一份给「读者」看的「文本类型」。
<任务>
- 读者:[谁会读这段文字]
- 目的:[读者看完后要理解什么,或完成什么动作]
- 文本类型:[帮助中心说明 / 产品通知 / 工作邮件 / 其他]
</任务>
<验收标准>
成稿必须同时满足以下条件:
1. 任务完成:开头直接说明与「目的」最相关的结论;读者能据此知道下一步做什么。
2. 信息可核对:只使用「材料」明确提供的事实;数字、日期、名称、条件和例外必须保留;材料没有提供的内容写成「待确认」,不要猜。
3. 结构清楚:每段只处理一个问题;按「结论—必要说明—行动或限制」组织信息;删掉重复内容。
4. 信息密度合适:删除不改变意思的开场白、套话和宣传语;不要为了简短删掉限制条件、操作路径或例外。
5. 中文自然:使用常用动词和短句;避免空泛的「全面提升」「赋能」「无缝衔接」等表达;不要为了显得正式而堆抽象名词。
6. 格式达标:全文控制在[字数范围];使用[段落数 / 项目符号 / 其他格式];只输出最终成稿,不输出分析过程、自评或标题(除非任务要求标题)。
</验收标准>
<执行顺序>
1. 先从「材料」中提取必须保留的事实、条件、例外和待确认信息。
2. 根据「任务」确定正文应该先回答哪个问题。
3. 写出第一版成稿。
4. 对照「验收标准」逐条检查;只修正没有达标的项目,不添加材料之外的事实。
5. 再检查一遍数字、日期、名称、条件和例外,确认没有被改写或遗漏。
<材料>
[把原始材料粘贴在这里]
</材料>这里有一个容易被忽略的顺序:先定义标准,再写执行步骤。如果只在结尾补一句「请检查质量」,模型通常只会做宽泛的自我评价;把标准放在任务前面,后面的写作步骤才有明确的验收对象。
另外,标准不要超过你能真正检查的范围。给出四到六条、每条包含一个动作或结果,通常比塞进二十条形容词更容易维护。像「语气高级」「读起来舒服」仍然不是验收标准,除非你能把它拆成句长、用词、段落节奏等可观察条件。
一个最小示例
下面的材料是人为编写的练习,不对应真实产品:
材料:记账 App 的 4.2 版本支持导入 CSV 文件。上传后可以先预览;导入失败时可以下载错误报告。含公式的表格暂不支持导入。
任务:写一段 100~140 字的帮助中心说明,让第一次使用导入功能的用户知道怎么做,以及遇到什么情况要先处理。如果只有「写得简洁、友好、清楚」,一版常见输出可能是:
4.2 版本新增 CSV 导入功能,操作简单又方便。上传文件后即可快速完成导入,让记账更高效。如果遇到问题,请检查文件后重试。
它没有明显语病,却漏掉了预览、错误报告和「含公式表格暂不支持」这三个决定用户能否完成操作的事实。
把验收标准放进去后,合格版本可以是:
4.2 版本支持导入 CSV 文件。上传后先预览内容,再确认导入;如果失败,可下载错误报告排查。含公式的表格暂不支持导入,请先另存为不含公式的 CSV 文件。
这版没有增加材料之外的功能,也没有用「快速」「高效」替代具体动作。读者能按顺序操作,也能提前知道自己的文件是否受限。
练习时可以先不追求一次成功。用同一份材料分别运行「只有风格要求」和「带验收标准」的版本,比较四个地方:
- 任务:开头是否直接回答读者要做什么;
- 事实:数字、名称、条件和例外是否都保留;
- 结构:读者能否按正文顺序完成操作;
- 语言:删掉套话后,句子是否更像人在说明一件具体的事。
什么时候值得用
适合:
- 你反复生成同一种文本,人工返工点也比较稳定;
- 任务同时包含读者、目的、事实边界、结构、长度和语气要求;
- 你需要比较两版 Prompt,而不是凭感觉判断哪版更好;
- 团队成员要共同使用同一套写作要求,必须有一组可复查的标准。
不适合直接套用:
- 材料缺少关键事实。验收标准只能防止模型乱补,不能替你查证事实;
- 你还说不清读者要完成什么。先补清任务目的,否则「任务完成」这一条没有检查对象;
- 文本是广告创意、诗歌或其他开放性创作,唯一的好坏标准就是「是否合乎预期」。此时可以保留少量示例,让模型理解方向,但不要伪造一套看似精确的评分表;
- 你修改的是 API 的高层指令,而不是普通聊天 Prompt。OpenAI 的提示工程文档建议把提示词修改放在 fixtures、测试和评估检查之后,并用测试套件监控迭代效果;自然语言里的「验收标准」不能替代调用层级和程序化评估。3
为什么这条规则有用,但不是保证书
模型并不会自动知道「清楚」在你的工作里意味着什么。对一封产品通知来说,清楚可能是「用户知道要点和下一步」;对一篇观点文章来说,清楚可能是「论点、证据和限制分得开」。把目标拆成验收标准,相当于把编辑脑中的判断提前写出来,减少模型用自己的默认标准填空。
它还有一个实际好处:失败时你知道该改哪一条。漏了例外,就改「信息可核对」;段落总在绕圈,就改「结构清楚」;句子太官腔,就改「中文自然」。不要把所有失败都压缩成「再写得好一点」。
不过,验收标准可能把文字写得过于规整。若每条标准都要求短句、固定结构和禁止修辞,最终成稿会像表格,不像文章。复盘时要同时检查「是否达标」和「是否仍然适合这个文本类型」;后一个判断需要你结合真实读者来做,不能完全交给模型。
最后,把标准当成一组可修改的测试,而不是永远正确的规则。先拿两三份真实材料跑一遍,记下具体遗漏,再新增一条可观察的标准。连续几次都没有发现新问题,就停止加规则,避免 Prompt 越写越长,反而遮住了真正重要的要求。
References
- 1Prompt engineering overview
docs.anthropic.com
- 2Prompt design strategies
ai.google.dev
- 3Prompt engineering
platform.openai.com

AI 文字 Prompt 日课
每日精选提升 AI 文字质量的 prompt 实践:讲清原理、适用场景,并给出可直接套用的示例。
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
Related content
- Sign in to comment.