展开知识库目录

让 AI 扩展检索词,怎么避免它编论文和 DOI

AI 可以扩展同义词、缩写和旧称,但不能证明主题词有效、论文存在或 DOI 正确。让它只交候选词,验证回到数据库。

先看最危险的省事方式

让 AI 同时给关键词和参考文献,十条 DOI 里有几条根本打不开

学生输入“帮我找远程医疗与 2 型糖尿病的同义词,并推荐十篇高质量论文和 DOI”。AI 返回的表格整齐、题名像真的、DOI 格式也像真的;可进入 DOI 解析页后,有的不存在,有的指向完全不同的文章。学生不得不重新核对,反而比自己从种子论文扩词更慢。

解决办法不是要求 AI“绝对不要幻觉”,而是改变交付物:它只能生成待验证的词汇候选,不返回论文、作者、期刊、年份和 DOI。正式主题词、词义和检索效果必须去目标数据库核对。

  • 一份按类型分组的候选词表
  • 每个词对应的数据库验证记录
  • 不含任何未经核对的论文或 DOI
先划清任务边界

AI 能帮你想表达,不能替数据库确认学术记录

任务可以交给 AI 吗最终到哪里验证
提出自由词、拼写变体、缩写和旧称候选可以,但每项标记为候选并解释可能歧义种子论文题名摘要、数据库实际结果
判断某个词是不是正式 MeSH 主题词不能凭模型回答定稿NLM MeSH Browser 或目标数据库词表
判断一个词是否提高召回或带来误检不能脱离实际检索判断目标数据库单词试检、种子论文召回和误检样本
推荐真实论文、作者、期刊和 DOI本任务明确禁止数据库记录、出版社页、DOI 解析与 Crossref 元数据
把 PubMed 检索式直接翻成 Web of Science 语法只能提出草稿两个数据库当前帮助页和账号内实跑
只生成候选词

这条指令刻意不让 AI 找论文

先提供真实种子论文中已经出现的词,模型才有语境。没有种子词时也可以扩展,但所有输出都保持“待验证”。

可复制使用

这条指令刻意不让 AI 找论文

你只负责扩展文献检索的候选词,不负责找论文。

研究主题:{主题}
学科与数据库:{例如生物医学 / PubMed}
核心概念:{概念 1、概念 2}
已从真实种子论文核对的词:{词及原文位置}

请按概念分别给出:
1. 自由词候选;
2. 拼写与词形变体;
3. 缩写与全称;
4. 旧称或相邻术语;
5. 可能存在歧义、需要谨慎试检的词。

每个词说明可能相关的理由和可能带来的误检。
不得输出或猜测论文题名、作者、期刊、年份、DOI、PMID,也不得声称某个词已经是正式主题词。
最后输出一张“待数据库验证”表,验证状态全部填“未验证”。
候选词要逐项过库

一个词只有通过来源、词义和结果三关,才能进入检索式

候选词先查什么实跑时看什么可能决定
TelemedicineMeSH Browser 是否存在正式主题词及层级主题词检索能否覆盖种子论文作为 MeSH 与自由词同时保留
telehealth种子论文是否真实使用,词义是否比 telemedicine 更宽单独运行时主要误检来自哪里保留为自由词或增加字段限制
T2DM目标文献是否常用该缩写是否出现其他含义的稳定误检保留在 Title/Abstract,或因歧义删除
AI 新提出的相邻词能否在真实题名摘要或词表找到依据是否增加新的相关记录,而不只增加噪声无证据则删除,不因模型解释流畅而保留

验证状态建议只用“已由词表确认、已由种子论文确认、试检保留、试检删除、仍待确认”,不要用笼统的“可信”。

AI 还是输出了论文时

把它当作陌生人发来的书目线索,从零核对

  1. 01

    先解析 DOI 或数据库编号

    打不开、解析到其他作品或元数据不一致,立即标记为错误,不自己猜测修补字符。

  2. 02

    再比对完整元数据

    核对题名、作者、期刊、年份、卷期页和作品类型。Crossref 记录来自成员与可信来源,但元数据也可能不完整,仍要看出版社页。

  3. 03

    最后判断与问题是否相关

    真实存在不等于适合纳入。回摘要和全文判断对象、设计与结果,不按 AI 的“推荐理由”直接保留。

  4. 04

    把错误反馈回词汇任务

    删掉书目部分,只保留能够在真实记录中得到支持的术语候选;不要继续让模型修复同一批 DOI。

本文依据

主题词、记录和 DOI 分别回到自己的权威入口