用 AI 补参考文献信息:DOI、作者和卷期必须指向同一篇文章

10-01 3阅读

参考文献只剩作者姓氏、半个标题和年份时,AI 很容易补出一条格式漂亮的记录。危险在于每个字段看起来都像真的,组合起来却属于几篇不同文章。更可靠的任务,是让模型组织候选和差异,由你确认哪些字段确实属于同一条出版记录。

用 AI 补参考文献信息:DOI、作者和卷期必须指向同一篇文章

AI概念配图,非真实界面

先把已知字段锁住

以下题名、作者、期刊和候选信息均为虚构练习,代号“候选甲 DOI”与“候选乙 DOI”不是可解析的标识符。原始笔记是“许岚、陶青,社区借阅时段观察,二〇二四”。先逐字保存,不让 AI 在检索前润色标题或自动调换作者顺序。

把题名、作者、年份分别放入字段,并给每项标明出处:手写笔记、文章首页或已有参考书目。出处不同,可靠程度也可能不同。若笔记里没有期刊名和页码,就明确写缺失,不能让模型根据主题猜一个合适的刊物。

Crossref 提供元数据检索和按 DOI 获取记录等入口;其搜索帮助也展示了用完整引文、题名或作者寻找作品的方法。这适合寻找候选,但检索得分高不代表身份已确认,更不代表可以把第一条结果所有字段直接覆盖原记录。

对照候选,不拼接字段

假设人工查到两条练习候选:甲题名完全相同,作者为许岚、陶青,年份二〇二四,刊于《社区阅读研究》第八卷第二期,页码三十三至四十二;乙题名多出“跨地区比较”,作者只有许岚,年份相同,刊于另一刊物。

模型应把甲列为更值得核验的候选,并明确乙的题名与作者都不同。不能拿甲的标题、乙的 DOI,再从第三条记录借来页码。每份候选必须作为完整的一组信息保留,选中后才讨论怎样补入最终书目。

在真实操作里,打开候选 DOI 的落地页,查看实际题名与作者顺序,再核对期刊、卷期和页码或文章编号。若出版社显示的是文章编号,就按其原样记录,不要把它改造成页码范围。找不到字段时留下待核,不以排版完整为优先目标。

时间差异需要解释

同一篇文章可能显示在线发表和编入期刊的不同日期。看到年份不同,先记录日期类型和来源,再查看你要遵循的引用要求,不能把所有日期强行统一。更正说明、预印本和正式版本也可能是相关但独立的记录,需确认自己实际引用的是哪份。

让 AI 输出一行一项的对照:字段、原始值、候选值、支持页面、处理决定。题名与作者完全对应只是起点;卷期、文章编号和版本关系仍需检查。对真实页面中的信息,保存可回到具体记录的链接,比只记一次搜索的关键词更有用。

可复用提示:请依据我提供的原始引文和候选记录逐字段对照。保留每个候选的整体身份,不跨记录拼接 DOI、作者、期刊或卷期。标出匹配、冲突、缺失以及日期类型;缺乏依据的字段留空。先完成身份核对,再按指定格式排版,不发明来源。

先验证一条,再批量处理

用上面的练习给模型加入一个故意错误:候选甲的 DOI 栏填入“候选乙 DOI”。即使其余字段吻合,也应被标成标识符冲突,而不是顺手通过。再删除甲的页码,看它能否保留缺失,而非按照常见期刊格式补出一段数字。

批量处理时,每条引文保留独立编号;重复出现的题名也不要未经核对就合并。处理状态可以写成“已对照出版社”“只找到候选”“暂未找到”。这些状态表示你实际做过的工作,不是模型对自己输出的信心评分。

最后再调整作者缩写、标点和排列顺序,检查格式化过程有没有删掉副标题、重音字符或文章编号。无法补齐的书目应带着缺口返回,而不是被藏在一个流畅列表里。AI 能减少字段比对的劳动,不能用语言熟悉度证明一篇文章确实存在。

参考资料

文章版权声明:除非注明,否则均为云鹊BLOG原创文章,转载或复制请以超链接形式并注明出处。