核心观念:提示词是「工程」,不是「许愿」
同一句话每次结果不同,通常不是模型的问题,而是提示词里缺少三类信息:目标、示例、约束。补齐后,输出稳定性会有明显提升。
四步调试流程
第一步:把目标写成可验收的形式
不要写「帮我优化这段话」,改成可验收的描述:
- ❌ 帮我写得更好
- ✅ 把这段说明改写成面向新手的版本:不出现专业缩写,句子不超过 25 字,保留全部操作步骤
验收标准越具体,返工次数越少。
第二步:给 1-2 个示例
示例比形容词有效得多。给出你期望的输入输出对,模型会模仿结构与语气:
输入:功能 A 已上线
输出:功能 A 现已在网页端与移动端开放,可在「设置-实验室」中开启。
第三步:加约束,而不是加形容词
常见有效约束:
- 长度:几点、多少字、几段
- 范围:只讨论 X,不要扩展 Y
- 格式:Markdown 表格 / 要点列表 / JSON
- 禁止项:不要使用某些词、不要编造数据
第四步:做一次「回归测试」
改完提示词后,用同一批 3-5 个样例重新跑一遍,确认:
- 之前修好的问题没有复发
- 新加的约束没有引发副作用
这一步最容易被跳过,也是提示词「越改越飘」的主要原因。
常见问题与对策
- 输出太长:明确字数上限,并要求「先给结论再展开」
- 语气不稳定:给语气示例,而不是描述语气(写「像这样:…」比写「要专业」有效)
- 总是编内容:明确写「不确定就回答不确定,不要推测」
小结
把提示词当成需要迭代和测试的东西,而不是一句咒语。定目标、给示例、加约束、做回归,四步下来输出质量会稳定很多。