展开知识库目录
AI 基础与认知

先别问 AI 能不能做,先问这件事做错了我能不能发现

判断一件事能不能交给 AI,看三样:材料给不给得全、过程管不管得住、结果查不查得了。给不全就补材料,管不住就缩小范围,查不了就让它停在草稿阶段。

AI 能做什么含可复制模板更新 2026-08-13
先说结论

先把任务拆成输入、动作和交付物

别先问“AI 会不会做”,先问“做错了能不能在交付前发现”。有现成材料、有明确产物、能抽样核对的工作,适合交给 AI 整理或起草;结果会直接影响付款、合规或对外承诺的,就不能把模型输出当结论。

判断时用四问:能不能观察、能不能回滚、能不能追溯、影响范围大不大。四项越清楚越适合自动化;任何一项说不清,就缩小任务,只让 AI 准备证据或候选方案。

使用边界

这些情况适合用,另外几种先停一下

适合用
  • 材料已经存在,需要提取、归类、比较或改写
  • 任务有明确交付物,并且有人能检查事实与质量
  • 工作能拆成小步,出错后能回到原材料纠正
先别急着用
  • 需要资质人员签字、审批或承担最终责任
  • 输入缺失又补不上,却要求得出确定结论
照着做

用“可观察 × 可回滚 × 可追溯 × 影响范围”四问筛任务

为什么这样安排

NIST AI 风险管理框架强调按场景识别、衡量和管理风险;这里收窄成接任务前能用的四问,不空谈“AI 有风险”。

  1. 01

    把任务改写成动作

    “分析客户流失”太大,改成“从 80 条已脱敏访谈中标出离开原因,并保留访谈编号”。

  2. 02

    写出最坏的错法

    列出漏标、错标、虚构原因三种失败;若错了会直接发给客户,就先取消自动发送。

  3. 03

    设计一份盲抽样

    随机抽 10 条,由不知道 AI 结论的人对照原文,把三类错误分别计数。

  4. 04

    决定 AI 在哪一站停

    让它停在“候选主题 + 证据编号”,最终合并和业务判断由负责人签字。

复制前先替换 {占位}

任务准入三问提示词(复制后改 {占位})

请帮我判断下面这个任务适不适合交给 AI,并给出方案:
任务描述:{一句话任务}
材料:{手头有什么材料,缺什么}
由谁负责最终判断:{我 / 领导 / 客户}
请按三问回答:
1. 材料给得全吗?缺什么会影响结果;
2. 过程管得住吗?哪些步骤能回滚、能检查;
3. 结果查得了吗?用什么证据核对。
最后给出建议:直接交给 AI / 缩小范围后交给 AI / 别交给 AI。
填好的例子

任务准入四问(示例)

下面是已经填过变量的示例。复制时请换成自己的文件名、数字和材料位置,别把示例数据原样交出去。

看清格式再改

任务准入四问(示例)

任务:从 80 条访谈提取流失原因
AI 动作:标注候选原因;不得推断未说出的动机
可观察:每条原因带访谈编号和原句
可回滚:输出写新表,不覆盖访谈原文
抽检:随机 10 条,漏标/错标/虚构分别计数
停点:AI 不决定优先级,不向客户发送
结果不对怎么办

先对症状,别一上来重写整段提示词

回答很完整,却不知道依据在哪

常见原因
任务只要求结论,没要求证据位置
怎么修
把输出改成“主张—证据—来源—不确定项”四列。

模型替你做了价值判断

常见原因
没划清建议、执行和决策的边界
怎么修
明确只生成候选方案,并写出由谁按什么标准拍板。

换一批材料后结果完全失控

常见原因
第一次只测了典型样本
怎么修
加入边界样本和缺失样本,再决定是否批量处理。
交付前检查

最后五分钟,逐项打勾

参考资料

这篇具体参考了什么

正文按公开教程和官方文档重新整理,并换成了可以直接操作的中文场景。产品能力、规则和投稿要求会更新,真正执行前请再打开原始页面核对一次。