第 05 章 · AI 学习
先定义什么叫做好:输出要求与参考示例
你让AI“写得专业一点”,它增加了更多术语;你让它“详细一点”,它把三百字扩成三千字;你让它“更有深度”,它写出了许多宏大的判断。
结果更长、更正式,却仍然不能直接使用。
“专业、详细、有深度”并不是完全错误的要求。问题在于,你和AI对这些词没有共同标准。对于内部通知,“专业”可能意味着准确、简洁、没有歧义;对于给老板的报告,“有深度”可能意味着有证据、有判断、有下一步;对于客户方案,“详细”也不能等于把所有背景都堆进去。
让AI稳定产出合格结果,需要在开始前回答:
这份结果给谁使用、放在哪里使用、必须包含什么、怎样组织、有哪些限制,以及满足哪些条件才算完成?
一、本章学完,你能做到什么
学完这一章,你应该能够:
- 把“专业、详细、好看”等模糊要求改成可检查标准;
- 从内容、结构、格式、语气、长度、限制和完成条件定义结果;
- 为同一份事实材料设计不同对象的输出;
- 正确使用正例和反例,而不是要求AI机械模仿;
- 完成一张“输出标准卡”。
本章只解决“什么叫做好”。第一次结果怎样继续修改,将在下一章处理。
二、生成完了,不等于工作完成了
AI在屏幕上返回一段完整文字,只能说明生成过程结束。工作是否完成,要回到真实使用场景。
例如AI已经生成会议纪要,但如果:
- 负责人和日期没有确认;
- 讨论内容被写成决定;
- 表格不能复制到公司的协作系统;
- 待办没有对应原文;
- 关键事项遗漏;
这项工作就没有完成。
同样,AI说“代码已完成”“测试已通过”“表格已分析”,也需要实际打开文件、运行测试、复核公式或回查数据。
结果标准必须连接真实交付,而不只连接AI的回复。

图:原文在提出“AI说完成,不等于项目完成”之后的配图。这里用于建立生成结束与业务验收之间的区别;画面内容与授权待人工确认。
三、用七个维度定义输出
1. 内容:必须包含什么
先列必要信息,不要只说“写完整”。
例如一份项目周报必须包含:
- 本周已经完成的事项;
- 与计划相比的进度;
- 当前异常和影响;
- 需要协助或决定的事项;
- 下周行动、负责人和日期;
- 尚未确认的信息。
还可以明确不需要什么,例如不重复项目背景,不写没有证据的原因分析。
2. 结构:信息按什么顺序组织
结构服务于读者的使用动作。
给老板的材料可以先写结论、风险和需要决定的事项;给执行同事的材料可以先写任务、负责人、日期和依赖;给客户的材料需要先确认共识,再列双方下一步。
结构不是为了“看起来完整”,而是帮助读者快速找到要做的事。
3. 格式:结果以什么形式交付
明确是普通文字、Markdown、表格、邮件正文、Word大纲、PPT页纲、JSON、代码文件还是其他形式。
如果要表格,说明字段;如果要PPT,说明页数和每页结构;如果要导入系统,说明字段名、日期格式和是否允许空值。
4. 语气:读者应该感受到什么
不要只说“正式”或“亲切”。结合关系说明:
- 内部通知:直接、清楚,不制造恐慌;
- 给领导的简报:结论先行,少铺垫,明确需要决策的事项;
- 给客户的邮件:尊重、克制,不替双方作出未确认承诺;
- 操作指南:普通员工能看懂,避免不必要的技术缩写。
5. 长度:信息要压缩到什么程度
长度要与场景相连。
“控制在300字”比“简短一点”更清楚;“一页A4内,让负责人两分钟看完”比单纯字数更贴近使用。
长度不能以删除关键事实为代价。必要时把正文与附件分开。
6. 限制:什么不能发生
常见限制包括:
- 不编造数字、客户信息和来源;
- 不改变正式制度口径;
- 不把建议写成决定;
- 不泄露个人信息;
- 不使用未经授权的品牌素材;
- 不删除原始数据;
- 不自动发送或发布;
- 不超出当前任务范围。
7. 完成条件:怎样判断可以交付
完成条件要能够逐项检查。例如:
- 所有事实均可在材料中定位;
- 每个行动都有负责人和日期,缺失项标记“待确认”;
- 表格可以正常打开,公式抽查正确;
- PPT在投影模式下文字可读;
- 代码可以运行,关键测试通过;
- 对外内容已由有权限的人审核。
四、同一份材料,为什么需要三个版本
假设项目组有以下事实:
- 数据迁移完成80%;
- 接口联调比计划晚两天;
- 延迟原因尚未完全确认;
- 测试环境将在周四恢复;
- 是否调整上线日期,需要负责人决定。
给老板的版本
重点是影响、风险和需要决定的事项:
当前数据迁移完成80%。接口联调比计划晚两天,具体原因仍在确认,测试环境预计周四恢复。若周四无法恢复,原上线日期可能受影响。请负责人在周四检查结果后决定维持原计划或顺延。
给项目成员的版本
重点是行动和协作:
| 事项 | 当前状态 | 下一步 | 负责人 | 日期 |
|---|---|---|---|---|
| 数据迁移 | 完成80% | 完成剩余数据并核对数量 | 待确认 | 周三 |
| 接口联调 | 晚两天 | 确认失败原因,恢复后重测 | 待确认 | 周四 |
| 上线计划 | 待决定 | 根据周四测试结果提交建议 | 项目负责人 | 周四 |
给客户的版本
重点是已确认事实、影响和下一次同步,不透露未经确认的内部推测:
当前数据迁移正在按批次推进,接口联调受测试环境影响有所延迟。我们预计周四完成下一轮验证,并在验证后同步对整体计划的影响。当前上线日期尚未调整,如有变化将由双方确认后更新。
三份内容依据同一组事实,但对象不同,结构、语气和行动要求也不同。这就是输出标准的作用。
五、完整案例:给三个对象写项目进展
原始任务
根据下面的项目记录写一份专业、详细的项目进展。
AI很可能生成一份标准周报,包含项目背景、整体目标、阶段进展、风险和展望。内容看起来完整,却没有说明给谁看,也不知道读者看完要做什么。
先补输出标准
【使用对象】部门负责人
【使用场景】周一经营会上口头汇报前的书面预读
【阅读时间】控制在2分钟内
【必须包含】
1. 本周关键进展,只写已确认事实;
2. 与原计划相比的差异;
3. 当前风险及证据;
4. 需要负责人决定的事项;
5. 下周行动、负责人和日期。
【结构】先结论,再风险,再决策事项,最后行动。
【格式】一页以内,使用小标题和五列表格。
【语气】直接、克制,不写“全面提升”等空泛表述。
【限制】原因未确认时标记“待确认”,不得自行推测。
【完成条件】
- 每个数字都能回到项目记录;
- 建议与事实分开;
- 决策事项不超过3项;
- 缺失的负责人和日期明确标记。
AI开始前的复述
要求AI先复述:它应说明结果给部门负责人预读,重点是结论、风险、决策和行动,而不是写一份面面俱到的项目介绍。
如果复述正确,再让它生成。
生成后的检查
先逐项对照标准,而不是凭整体感觉:
- 是否在开头给出结论?
- 是否把“可能原因”写成已确认原因?
- 是否区分事实与建议?
- 是否出现负责人和日期缺失?
- 是否真的可以两分钟读完?
输出标准把“我觉得不够好”变成了“第三项缺少证据、第四项超出三项、表格第二行没有负责人”。这种反馈可以直接进入下一轮修改。
六、参考示例怎样使用
有时你很难用语言说清“我想要什么”,一份好示例会很有帮助。
正例
正例告诉AI哪些特点值得保留。例如:
参考这份周报的“结论先行、风险单列、行动带负责人和日期”三项结构。不要复制其中的事实、措辞和项目名称。
反例
反例能说明什么不能发生。例如:
这份旧周报的问题是背景过长、事实与建议混在一起、没有明确下一步。新版本需要避免这三点。
示例不能代替标准
如果只说“照着这个写”,AI可能机械模仿长度、语气和结构,甚至带入不相关内容。
使用示例时明确:
- 学什么;
- 不学什么;
- 哪些事实不能复制;
- 哪些地方需要适应当前对象。

图:原文在“生成内容筛选与五维评估”小节之前的配图。这里用于说明参考示例之后仍要按标准筛选结果;画面内容与授权待人工确认。
七、不同任务的标准为什么不同
写作任务
重点检查事实、对象、目的、结构、语气和能否直接使用。
数据分析
重点检查字段、口径、公式、异常、结论依据和能否复算。
长文档提取
重点检查是否完整、能否定位原文、是否混淆不同文件和版本。
图片和PPT
重点检查尺寸、可读性、信息层级、品牌、文字、事实和版权。
代码和小工具
重点检查能否运行、关键功能是否工作、是否破坏原有功能、权限和错误处理。
AI智能体
重点检查任务范围、知识来源、工具权限、测试题、异常处理和人工接管。
不要把“生成了一个结果”作为所有任务的共同完成标准。
八、在Claude、WorkBuddy或其他产品中怎样做
可以采用四步:
- 输入第03章的任务说明;
- 上传第04章的小型材料包;
- 粘贴本章的输出标准卡;
- 要求AI先复述“必须满足的标准”和“仍然缺失的信息”。
然后让AI先生成结构或小样,而不是立刻生成全部内容。结构确认后,再完成全文。
复杂任务可以要求AI在结果后附一张自检表,但AI自检只能提供候选问题,不能替代人的核验。

图:原文在“三层验收让AI工作真正变成项目推进”总结后的配图。这里用于提醒读者把输出标准落实到真实交付;画面内容与授权待人工确认。
九、可复制的输出标准卡
【输出标准卡】
结果名称:
给谁使用:
使用场景:
读者看完要做什么:
【必须包含】
1.
2.
3.
【不需要包含】
【结构顺序】
【交付格式】
【语气与表达】
【长度或使用时间】
【禁止事项】
【参考示例】
需要学习:
不得复制:
【完成条件】
- [ ]
- [ ]
- [ ]
开始前,请先复述你理解的输出标准,并指出仍然无法满足的条件。
十、把形容词改成标准
| 模糊要求 | 可检查表达 |
|---|---|
| 专业一点 | 使用公司正式口径;每项结论附依据;不使用口语和夸张表达 |
| 详细一点 | 包含背景、现状、问题、依据、行动、负责人和日期 |
| 简洁一点 | 300字以内;先结论;只保留影响当前决定的信息 |
| 有深度 | 至少区分事实、解释和建议;指出一个反方证据和一个待确认项 |
| 好看一点 | 使用三级信息层级;正文最小字号明确;颜色不超过品牌规范 |
| 可执行 | 每项行动都有负责人、日期、输入和完成标志 |
十一、常见错误
错误一:标准很多,却互相冲突
“既要非常详细,又要200字以内”可能无法同时满足。需要说明优先级。
错误二:规定格式,却没有规定内容
一张漂亮表格仍可能装满空话。先确定读者需要什么信息。
错误三:给了示例,却没有说明学习什么
AI可能复制错误事实、旧规则或不适合当前对象的语气。
错误四:把AI自评当成验收
AI说“已经满足全部要求”不是证据。人仍需逐项检查真实结果。
错误五:只检查文字,不检查交付
文件打不开、公式错误、页面溢出、链接失效、代码无法运行,都属于未完成。
十二、练习:一份材料,三个版本
选择一份不敏感的真实材料,分别为以下对象设计输出:
- 给负责人:帮助他快速判断和决定;
- 给执行同事:帮助他明确行动;
- 给外部客户或合作方:帮助双方确认事实和下一步。
要求:
- 三个版本使用同一组事实;
- 分别填写输出标准卡;
- 写出结构、语气和长度为什么不同;
- 至少设置三项完成条件;
- 让一位同事按标准检查,而不是只问“你觉得好不好”。
十三、怎样判断自己真的学会了
完成下面五项,就算通过本章:
- 能把三个模糊形容词改成可检查要求;
- 输出标准覆盖内容、结构、格式、语气、长度、限制和完成条件;
- 正例或反例明确说明学习什么、不复制什么;
- 同一材料的三个版本与各自对象和用途一致;
- 另一位同事可以只看标准判断结果是否合格。
本章小结
好结果不是“写得像那么回事”,而是满足真实使用条件。
定义结果时依次说清:
内容 → 结构 → 格式 → 语气 → 长度 → 限制 → 完成条件
有了清楚任务、真实材料和输出标准,AI仍可能在第一版中出现问题。下一章将解决:怎样判断问题出在哪里,给出具体反馈,并通过多轮协作得到最终版本。