浏览 AI 知识库

AI 辅助访谈逐字稿编码:从原句到主题并保留反例

从一份获得处理许可、已去标识的访谈逐字稿开始,逐段编号、保留原句,再做开放编码、主题归纳和反例检查;研究者解释始终与受访者原话分栏。

按实际操作顺序推进

每完成一段就检查当前输出,确认结果符合预期后再继续。

  1. 01准备先贴近原句,后提出主题,最后找不支持它的材料
  2. 02执行要求 AI 把观察与解释分栏
  3. 03检查AI 质性编码最危险的是制造受访者没有说过的话
  4. 04完成从主题可以回到每一位受访者的原段落
质性分析现场

三个人都说审批慢,却不一定说的是同一件事

逐字稿里出现三句‘审批慢’:一位不知道要补哪些材料,一位等不到负责人回复,另一位在系统状态上停了五天。AI 若直接合并成‘流程效率低’,研究者会丢掉可行动的差异。

下文句子均为教学构造,不是采访所得;真实访谈需先核对同意范围、去标识程度和所在机构的研究伦理规则。

  • 每段话都有访谈编号
  • 开放编码保留具体过程
  • 主题里包含反例和研究者判断
逐字稿准备

编号和隐私处理要发生在生成主题之前

记录教学原句初始编码研究者待问
P01-L18第一次提交后才知道还缺一张表。材料要求在首次提交前不可见是否有正式清单?
P02-L31发给负责人的消息两天没回。负责人响应等待这两天是否仍可推进其他步骤?
P03-L09系统里一直显示待审核,我不知道卡在哪。状态反馈不透明状态停留时间是否有系统记录?
P04-L12我这次当天就知道缺什么。反例:材料告知及时与 P01 是否在同一流程版本?

编号可回查匿名原稿;对外展示短引语也应再次检查能否重新识别个人或组织。

编码顺序

先贴近原句,后提出主题,最后找不支持它的材料

  1. 01

    确认许可并冻结匿名稿

    逐项检查知情同意是否允许第三方 AI 处理;不允许时在批准环境内做人工编码。保留原稿只读副本,给段落稳定编号。

    有许可决定和匿名稿版本。
  2. 02

    逐句生成候选开放编码

    让 AI 只描述发生的动作或等待,禁止把‘审批慢’直接写成单一根因。研究者逐行确认、改名或撤销。

    每个编码能回到原句。
  3. 03

    归并主题并寻找反例

    把信息缺失、责任不清和系统等待分开;同时搜索同一流程中推进顺利的片段,记录主题何时不成立。

    主题定义包含纳入、排除和反例。
可复制输入

要求 AI 把观察与解释分栏

可复制使用

要求 AI 把观察与解释分栏

研究问题:申请审批的哪些环节造成等待?以下是已获许可、去标识且逐段编号的教学片段:[P01-L18]... [P02-L31]...。
请输出:段落编号、原句短摘、贴近原话的候选开放编码、可能主题、需要研究者核对的问题。不要拼接不同受访者的话,不要用一个‘效率低’主题覆盖所有过程;再列出至少一条可能推翻主题的反例搜索条件。主题定义请另列纳入条件、排除条件和可能存在的流程版本差异;无法核对的解释只放研究者待确认栏。

真实逐字稿只在允许的工具和数据处理环境中使用。

编码结果

主题要能解释差异,而非只换一个抽象词

候选主题纳入片段不纳入或反例还缺什么证据
材料要求发现过晚P01-L18P04-L12 告知及时流程版本和首次提交清单
责任人响应等待P02-L31不能从 P03 推断相同原因消息时间和职责范围
系统状态不可解释P03-L09P04 不涉及系统状态状态日志与节点定义
偏差排查

AI 质性编码最危险的是制造受访者没有说过的话

汇总里出现一句找不到原段落的精彩引语

原因
AI 把多人的相似表述拼成一句话。
怎么改
删除该引语,只用可回查的单段原句;跨人概括必须标成研究者解释。

反例被当成异常值删掉

原因
只寻找支持主主题的材料。
怎么改
保留反例编号,检查流程、时间或对象差异是否解释冲突。
研究者验收

从主题可以回到每一位受访者的原段落

边界说明

教学片段不等于研究发现

编辑依据审批流程访谈教学片段

所有受访者编号和引语均为编辑部构造;不得引用为真实受访者证据。