展开知识库目录
让 AI 扩展检索词,怎么避免它编论文和 DOI
AI 可以扩展同义词、缩写和旧称,但不能证明主题词有效、论文存在或 DOI 正确。让它只交候选词,验证回到数据库。
让 AI 同时给关键词和参考文献,十条 DOI 里有几条根本打不开
学生输入“帮我找远程医疗与 2 型糖尿病的同义词,并推荐十篇高质量论文和 DOI”。AI 返回的表格整齐、题名像真的、DOI 格式也像真的;可进入 DOI 解析页后,有的不存在,有的指向完全不同的文章。学生不得不重新核对,反而比自己从种子论文扩词更慢。
解决办法不是要求 AI“绝对不要幻觉”,而是改变交付物:它只能生成待验证的词汇候选,不返回论文、作者、期刊、年份和 DOI。正式主题词、词义和检索效果必须去目标数据库核对。
- 一份按类型分组的候选词表
- 每个词对应的数据库验证记录
- 不含任何未经核对的论文或 DOI
AI 能帮你想表达,不能替数据库确认学术记录
| 任务 | 可以交给 AI 吗 | 最终到哪里验证 |
|---|---|---|
| 提出自由词、拼写变体、缩写和旧称候选 | 可以,但每项标记为候选并解释可能歧义 | 种子论文题名摘要、数据库实际结果 |
| 判断某个词是不是正式 MeSH 主题词 | 不能凭模型回答定稿 | NLM MeSH Browser 或目标数据库词表 |
| 判断一个词是否提高召回或带来误检 | 不能脱离实际检索判断 | 目标数据库单词试检、种子论文召回和误检样本 |
| 推荐真实论文、作者、期刊和 DOI | 本任务明确禁止 | 数据库记录、出版社页、DOI 解析与 Crossref 元数据 |
| 把 PubMed 检索式直接翻成 Web of Science 语法 | 只能提出草稿 | 两个数据库当前帮助页和账号内实跑 |
这条指令刻意不让 AI 找论文
先提供真实种子论文中已经出现的词,模型才有语境。没有种子词时也可以扩展,但所有输出都保持“待验证”。
可复制使用
这条指令刻意不让 AI 找论文
你只负责扩展文献检索的候选词,不负责找论文。
研究主题:{主题}
学科与数据库:{例如生物医学 / PubMed}
核心概念:{概念 1、概念 2}
已从真实种子论文核对的词:{词及原文位置}
请按概念分别给出:
1. 自由词候选;
2. 拼写与词形变体;
3. 缩写与全称;
4. 旧称或相邻术语;
5. 可能存在歧义、需要谨慎试检的词。
每个词说明可能相关的理由和可能带来的误检。
不得输出或猜测论文题名、作者、期刊、年份、DOI、PMID,也不得声称某个词已经是正式主题词。
最后输出一张“待数据库验证”表,验证状态全部填“未验证”。一个词只有通过来源、词义和结果三关,才能进入检索式
| 候选词 | 先查什么 | 实跑时看什么 | 可能决定 |
|---|---|---|---|
| Telemedicine | MeSH Browser 是否存在正式主题词及层级 | 主题词检索能否覆盖种子论文 | 作为 MeSH 与自由词同时保留 |
| telehealth | 种子论文是否真实使用,词义是否比 telemedicine 更宽 | 单独运行时主要误检来自哪里 | 保留为自由词或增加字段限制 |
| T2DM | 目标文献是否常用该缩写 | 是否出现其他含义的稳定误检 | 保留在 Title/Abstract,或因歧义删除 |
| AI 新提出的相邻词 | 能否在真实题名摘要或词表找到依据 | 是否增加新的相关记录,而不只增加噪声 | 无证据则删除,不因模型解释流畅而保留 |
验证状态建议只用“已由词表确认、已由种子论文确认、试检保留、试检删除、仍待确认”,不要用笼统的“可信”。
把它当作陌生人发来的书目线索,从零核对
- 01
先解析 DOI 或数据库编号
打不开、解析到其他作品或元数据不一致,立即标记为错误,不自己猜测修补字符。
- 02
再比对完整元数据
核对题名、作者、期刊、年份、卷期页和作品类型。Crossref 记录来自成员与可信来源,但元数据也可能不完整,仍要看出版社页。
- 03
最后判断与问题是否相关
真实存在不等于适合纳入。回摘要和全文判断对象、设计与结果,不按 AI 的“推荐理由”直接保留。
- 04
把错误反馈回词汇任务
删掉书目部分,只保留能够在真实记录中得到支持的术语候选;不要继续让模型修复同一批 DOI。
