展开知识库目录
先别问 AI 能不能做,先问这件事做错了我能不能发现
判断一件事能不能交给 AI,看三样:材料给不给得全、过程管不管得住、结果查不查得了。给不全就补材料,管不住就缩小范围,查不了就让它停在草稿阶段。
先把任务拆成输入、动作和交付物
别先问“AI 会不会做”,先问“做错了能不能在交付前发现”。有现成材料、有明确产物、能抽样核对的工作,适合交给 AI 整理或起草;结果会直接影响付款、合规或对外承诺的,就不能把模型输出当结论。
判断时用四问:能不能观察、能不能回滚、能不能追溯、影响范围大不大。四项越清楚越适合自动化;任何一项说不清,就缩小任务,只让 AI 准备证据或候选方案。
这些情况适合用,另外几种先停一下
适合用
- 材料已经存在,需要提取、归类、比较或改写
- 任务有明确交付物,并且有人能检查事实与质量
- 工作能拆成小步,出错后能回到原材料纠正
先别急着用
- 需要资质人员签字、审批或承担最终责任
- 输入缺失又补不上,却要求得出确定结论
用“可观察 × 可回滚 × 可追溯 × 影响范围”四问筛任务
为什么这样安排
NIST AI 风险管理框架强调按场景识别、衡量和管理风险;这里收窄成接任务前能用的四问,不空谈“AI 有风险”。
- 01
把任务改写成动作
“分析客户流失”太大,改成“从 80 条已脱敏访谈中标出离开原因,并保留访谈编号”。
- 02
写出最坏的错法
列出漏标、错标、虚构原因三种失败;若错了会直接发给客户,就先取消自动发送。
- 03
设计一份盲抽样
随机抽 10 条,由不知道 AI 结论的人对照原文,把三类错误分别计数。
- 04
决定 AI 在哪一站停
让它停在“候选主题 + 证据编号”,最终合并和业务判断由负责人签字。
复制前先替换 {占位}
任务准入三问提示词(复制后改 {占位})
请帮我判断下面这个任务适不适合交给 AI,并给出方案:
任务描述:{一句话任务}
材料:{手头有什么材料,缺什么}
由谁负责最终判断:{我 / 领导 / 客户}
请按三问回答:
1. 材料给得全吗?缺什么会影响结果;
2. 过程管得住吗?哪些步骤能回滚、能检查;
3. 结果查得了吗?用什么证据核对。
最后给出建议:直接交给 AI / 缩小范围后交给 AI / 别交给 AI。任务准入四问(示例)
下面是已经填过变量的示例。复制时请换成自己的文件名、数字和材料位置,别把示例数据原样交出去。
看清格式再改
任务准入四问(示例)
任务:从 80 条访谈提取流失原因 AI 动作:标注候选原因;不得推断未说出的动机 可观察:每条原因带访谈编号和原句 可回滚:输出写新表,不覆盖访谈原文 抽检:随机 10 条,漏标/错标/虚构分别计数 停点:AI 不决定优先级,不向客户发送
先对症状,别一上来重写整段提示词
回答很完整,却不知道依据在哪
- 常见原因
- 任务只要求结论,没要求证据位置
- 怎么修
- 把输出改成“主张—证据—来源—不确定项”四列。
模型替你做了价值判断
- 常见原因
- 没划清建议、执行和决策的边界
- 怎么修
- 明确只生成候选方案,并写出由谁按什么标准拍板。
换一批材料后结果完全失控
- 常见原因
- 第一次只测了典型样本
- 怎么修
- 加入边界样本和缺失样本,再决定是否批量处理。
最后五分钟,逐项打勾
这篇具体参考了什么
正文按公开教程和官方文档重新整理,并换成了可以直接操作的中文场景。产品能力、规则和投稿要求会更新,真正执行前请再打开原始页面核对一次。
