Rayyan 系统综述实操:导入文献、去重与双人筛选

从检索记录导入到独立筛选与分歧处理,梳理可追溯的系统综述初筛流程。

文献卡片经过去重、双人筛选和分歧复核的原创流程示意图

系统综述的题名与摘要筛选常有几百到几千条记录。Rayyan 可以集中保存记录、标记纳入或排除,并支持多人独立筛选。软件让过程更有序;纳入标准是否合理、判断是否一致,仍由研究团队负责。

先准备检索记录和规则

在数据库完成检索后,分别导出原始记录文件,不要在导入前随意合并或删改。给每个文件保留数据库名称、检索日期和检索式,例如 PubMed-2025-02-20.nbib。先写出适用人群、研究设计、干预或暴露、结局以及排除条件,再让两位筛选者用少量记录试筛,讨论容易产生歧义的标准。

一条可执行的标准应足够具体。例如“成人随机对照试验”需要说明:混合成人与儿童的研究如何处理?只报告会议摘要是否进入全文筛选?不写清楚,两个筛选者很可能都以为自己在执行同一标准,实际却做出不同判断。正式开始前可以随机抽取 20 条左右作试筛,把歧义写进规则,再统一培训;这个数字只是练习建议,不是固定方法学门槛。

登录 Rayyan,创建一个 Review,按来源上传支持的文献格式。导入后核对总记录数、题名和摘要是否完整,并记录各来源的原始数量。若字段乱码或缺失,先检查导出格式和编码,不要在错误记录上继续筛选。Rayyan 导入帮助说明了导入方式和常见故障。

导入、去重、双人独立筛选、分歧复核和全文筛选的流程图

图 1:筛选流程示意;每一步都要保留实际记录数与决定依据。

导入时让每批文件名称能回到原始数据库和检索日期。若同一数据库因导出上限分成多批,仍需保留每批的范围,避免后续因误传或重传造成数量不一致。完成导入后抽查不同来源的数条记录,特别关注摘要、DOI 和发表年份;数据缺一列时,筛选质量会直接受到影响。

去重后再开始初筛

同一论文可能同时来自 PubMed 和其他数据库。使用 Rayyan 的重复记录检查功能,逐组核对题名、作者、年份和 DOI,再确认哪些记录确为重复。相似题名可能对应会议摘要与正式论文,不能看到文字相近就一概删除。把“导入多少、去重多少、进入题名摘要筛选多少”分别记下,后续绘制文献筛选流程图时才有依据。Rayyan 帮助中心提供了重复记录管理入口。

去重不是单纯删除相同的字符串:同一论文在不同数据库可能有不同的作者缩写、页码或标题标点,真正不同的论文也可能同名。对自动提示的成对记录,先比较 DOI、期刊、作者和研究内容;不确定时保留并标记待查。删除前记录数量,删除后复核剩余记录数。这样在报告中才能解释“识别的记录数”和“进入筛选的记录数”为何不同。

两人独立判断,再处理分歧

邀请第二位筛选者,开始前开启 Blind Mode(盲筛),使两人独立标记记录。每条记录按预先约定选择纳入、排除或待定;排除时尽量使用统一的原因标签。待定不是最终结论,需要回到原文或由团队讨论。Rayyan 的盲筛说明筛选指南解释了独立判断和冲突处理的基本流程。

两人完成同一批记录后,关闭盲筛,查看判断相反的条目,按方案通过讨论或第三人裁决。把裁决规则和重要分歧记在外部工作记录里,不应只留下最后的“纳入/排除”标签。题名摘要阶段只能初步判断,最终纳入通常还需阅读全文并核对研究信息。

讨论分歧时,先看双方依据的条款,再看记录本身是否信息不足。若题名摘要无法确定“患者是否接受某干预”,通常应让它进入全文核查,而不是凭个人经验猜测。把常见分歧转成更明确的筛选规则,之后对尚未筛选的记录一致执行;若规则发生重要变化,也应回头检查先前做出的决定。

用一张数量表检查流程

工作中可以维护下面这样的表,并在每阶段结束时填写真实数字

阶段 需要记录的内容 常见核对点
数据库导出 各来源及导出条数 文件是否完整、日期是否清楚
合并与去重 重复记录数、剩余数 自动判断是否经过人工抽查
题名摘要筛选 排除、待定、进入全文的条数 两位筛选者是否完成同一批
全文筛选 无法取得全文及各排除原因 原因是否互斥且可解释

不要为使数字看起来整齐而修改记录。数量不守恒时,先查找批次重复导入、筛选状态未结束或导出范围不同的原因,再写最终流程图。

导出前检查可追溯性

检查待定记录是否清零、分歧是否处理完,再导出文献及决定。保存原始数据库导出文件、Rayyan 导出文件、检索式和筛选记录。不同版本的界面与套餐功能可能变化,操作时以账号内帮助为准;若导出需要包含全体成员的决定,要检查盲筛状态与导出选项。Rayyan 导出说明说明了这一点。

导出后的 CSV 或 RIS 可继续用于提取研究信息或参考文献管理,但要保持“筛选结果”和“提取表”之间的记录标识一致。一个题名可能出现多个报告,不能把“记录条数”误当“独立研究数量”。风险偏倚评价是阅读全文后的另一项工作,不能由题名摘要阶段的纳入标签代替。

从题名摘要走向全文筛选

题名摘要阶段“纳入”通常只表示值得取得全文,并非最终确定研究符合标准。全文阶段要核对研究设计、实际招募人群、干预内容、结局和时间点;排除时记录最主要、可解释的原因。例如一篇文章同时不符人群与研究设计,团队应按预先约定的优先顺序记录一个主要原因,否则各类排除数可能难以核对。

若同一试验发表了主文、亚组分析和长期随访三篇论文,题名摘要可能是三条记录,最终应按研究单位整合信息,避免在 Meta 分析中将相同受试者重复计入。筛选时可用标签将报告关联起来,但论文发表时还应在研究特征表中解释这些报告之间的关系。

Rayyan 提供了帮助团队组织工作和保存决定的界面,但它不会替代原始检索记录、全文获取记录或最终的数据提取表。每完成一阶段,就保存一次导出和数量汇总,并让另一位成员复查关键计数;这样遇到条目意外消失或状态改变时,才有可追溯的检查点。

若团队中途增加新检索批次,不要直接把新记录混进已完成筛选的旧批次而不留痕迹。给新增批次标注来源和日期,重新去重,再明确哪些记录需由两名筛选者补筛;最终报告分别列明原检索与更新检索的时间。所有决定都应能回到一条原始记录及其筛选依据,才便于处理争议和更新综述。

项目结束前,可请一位未参与初筛的成员按最终纳入清单随机回查数条文献:它们能否对应到原数据库导出记录、全文文件与提取表?若一环缺失,先补齐索引关系再进入结果撰写。

参考资料

— 文章结束 —返回文章列表