上一节已经掌握了检索搭建文献池的方法,本节将教你如何准确地选择有用的文献。很多大学生、研究生以及科研人员在完成定向检索之后,会面对成百上千条零散的题录而无从下手,手动翻找效率低下,稍不注意就会漏过高价值的核心文献,甚至在之后的写作中才发现纳入了许多低质量的无效文献,从而影响到研究结论的严谨性。
文献分层筛选是根据科研需求,从大量的文献中逐层缩小范围,精准找到高价值的目标文献的一种标准化高效的方法,完全符合PRISMA2020版官方文献筛选规范,适合于系统性文献综述、Meta分析、课题开题等需要严谨文献支持的各种科研场景,目前国内多所双一流高校图书馆的公开调研数据表明,使用标准化分层筛选逻辑的科研人员,文献筛选效率比传统的手动逐篇翻看方式要高60%以上,彻底解决了筛选标准混乱、漏筛错筛等问题。
1. 文献分层筛选前置准备:明确规则避免返工
正式开始分层筛选之前,必须先做好两项基础准备工作,即确定清楚的筛选目标和制定出可以执行的纳入排除规则,这是后面所有筛选操作的依据,可以防止筛选过程中标准前后不一致造成的反复返工。我们整理出不同的研究场景下文献分层筛选标准的参考表,你可以直接对照使用。
1.1 分层逻辑基础:确定四阶筛选维度的不同
分层筛选的核心逻辑就是从泛到精逐层递进,各个层次的筛选依据、耗时占比都有明确的界限,提前理清这些界限可以避免你把时间浪费在低价值的操作上。
-初筛层次:只依靠题录信息进行操作,不需要下载全文,主要目的是快速缩小文献池的总体规模,耗时占总筛选时间的15%左右
-复筛层次:根据标题、摘要信息来判断主题的匹配程度,只淘汰那些明显不符合研究范围的文献,耗时占总筛选时间的40%左右
-精读筛层次:下载全文核对核心要素,剔除信息缺失的不合格文献,耗时占总筛选时间的30%左右
-终筛层次:依靠标准化量表完成质量评价,最后分出文献的优先级,耗时占总筛选时间的15%左右
1.2 工具提前配置:适配各阶段筛选需求
提前准备好相应的工具可以大大提高效率,核心期刊文献库提前设置好检索式筛选条件,优先导出包含标题、作者、摘要、关键词的完整题录,选定适合自己研究场景的文献管理软件,提前建好对应的分层筛选标签分组,提前下载对应研究类型的文献质量评价量表电子版,后续可以直接对照打分。
这里我们对比了NoteExpress、Zotero、EndNote3款主流文献管理软件在分层筛选场景下的功能优劣势差异:
- NoteExpress:更适合于需要自定义多层级标签的社科文献标引场景,自带国内知网、CSSCI等数据库的题录自动识别功能,社科科研人员上手难度小
- Zotero:依靠批量去重插件可以大大减少自科学者初筛去重的重复工作量,开源免费可以自定义脚本批量处理题录,适合于需要批量处理WOS等外文数据库大量题录的用户
- EndNote:更适合于需要同步输出PRISMA流程图统计数据的医学类研究,内置的批量导出统计功能可以直接对接PRISMA2020版的筛选数据填报要求
2. 三阶核心文献分层筛选操作流程:PRISMA规范下的标准化实操
本节所有的操作步骤都严格按照PRISMA官方发布的文献筛选规范进行,并且根据国内高校图书馆公开的调研数据来提高效率,常规手动筛选1200篇题录平均需要14天,使用下文的三阶分层提速法可以将耗时缩短到3个工作日,效率提高幅度远远大于传统的方式。
文献分层筛选常见误区占比分布图(示意)
2.1 第一阶:初筛(题录层级批量处理)
初筛阶段的主要操作边界是题录层级去重、库源初筛,不需要逐篇下载全文,依靠核心期刊文献库的导出题录就可以完成全部操作,直接将待筛选量级压缩40%。
实操步骤如下:
1. 批量去重:将从知网、Web of Science等不同的数据库中导出的题录统一导入到选定的文献管理软件中,利用自带的批量去重功能,按照DOI号、标题+第一作者双重校验规则进行去重,可以直接清除掉25%到30%的重复文献
2. 库源初筛:依靠题录里的来源标记迅速剔除会议摘要、征稿通知、科普短文、报纸新闻等完全不是正式学术研究的无效文献,并且直接排除发表时间、研究地域完全不符合你预设规则的文献
按照初筛批量去重的提速技巧来操作,常规1200篇初始题录经过初筛之后,量级大体上可以缩减到400-500篇左右,从而大大减少了无效翻看的时间。
2.2 第二阶:中筛(摘要与全文匹配核验)
中筛阶段首次公开了可复用的关键词权重赋值法实操细节,可以给三类核心关键词分配不同的得分占比,即研究主题关键词占60%、研究方法关键词占25%、研究范围关键词占15%,单篇文献总分低于60分直接判定为不匹配淘汰,快速完成主题匹配判定。
中筛分为两个子环节:
1. 标题摘要筛选:按照事先设定的权重赋值规则,对每一篇文献的摘要中包含的核心要素进行对照,统计出每一篇文献的匹配得分,将得分低于60分的文献直接淘汰,经过这一环节之后,文献的数量级可以再次压缩到初筛后的50%左右
2. 全文初筛:给所有的留存文献添加下载链接,批量下载全文之后核对全文的研究内容、核心结论,剔除摘要信息和正文实际内容完全不符的文献,排除无法获取全文的文献
关键词权重赋值法的主要优点就是筛选标准统一,不会出现不同时间判断标准不一致的情况,特别适合于需要双人协同筛选的系统性综述类研究,PRISMA2020版也新增了这一阶段淘汰数量的统计要求,需要同步记录本环节的淘汰篇数,之后直接对应到PRISMA筛选流程图的“筛选后排除”节点。
2.3 第三阶:终筛(质量分层交叉核验)
终筛阶段要准确区分出不同的研究类型所对应的质量评价量表,错配量表会造成筛选结果出现严重的偏倚,量性类RCT研究用Jadad量表评分,质性研究用CASP量表,AMSTAR2是评价已发表综述质量分层合规性的工具。
本环节中加入了双一流高校医学硕士真实的实操案例,该用户第一次写Meta分析的时候,手动筛选1200篇文献花了2周时间,还出现了3处漏筛错误,后来用本文整理的分层筛选流程,依靠Zotero批量去重、NoteExpress自定义标签分层标引和PRISMA flow图同步统计,只花了3个工作日就完成了全部筛选工作,并且经过导师审核没有出现错漏。他还总结出三个避坑实操细节
1.去重操作要进行双重校验,只依靠标题去重不能清除同一研究团队分批次发表的高度相似重复文献
2.关键词权重赋值规则要在筛选前和协同筛选的同学一起确定,防止两人打分相差超过20%
3.终筛打分完毕之后要双人交叉核验得分,得分相差大于5分的文献直接拉入讨论组共同判定去留
3. 不同学科场景的文献分层筛选适配方案
社科和自科的文献池结构不同,可以根据需要调整分层筛选的规则,提高适配性。
- 社科场景:人文社科领域外文文献占比较低,在初筛时可以先筛选CSSCI、北大核心等来源标签,在中筛时主要看文献的理论框架是否匹配,权重赋值法中可以将研究主题关键词的占比提高到70%,更适合社科类主题的匹配判定需求
- 自科场景:理工科领域外文顶刊文献占比较高,初筛阶段优先使用Zotero的批量插件按照DOI号去重,避免WOS、Scopus等不同数据库导出的重复题录占用筛选时间,终筛阶段优先使用对应领域的方法学质量评价量表核验实验设计的严谨性
- 医学场景:医学类Meta分析要完全符合PRISMA规范,在每一轮筛选结束后都要同步记录淘汰的数量,初筛去重数、摘要筛选淘汰数、全文筛选淘汰数、终筛质量淘汰数分别对应PRISMA流程图的不同节点,完全满足期刊投稿的合规性要求
4. 高效文献分层筛选注意事项与避坑指南
很多新手在筛选过程中容易踩入各种误区,我们根据大量的用户实操数据整理出最常见的避坑要点
1. 不要在初筛阶段过于严格,初筛只需要剔除完全无关的、重复的文献,不能过早地根据主观判断淘汰可能有关的文献,否则会漏掉一些重要的核心文献
2. 所有的筛选操作都需要留下痕迹,每一层淘汰的文献都要单独建立文件夹进行保存,并且标注淘汰的原因,以便于后面导师或者审稿人提出疑问时可以直接追溯,完全符合PRISMA规范的溯源要求
3. 双人交叉核验机制不能少,对于系统性综述、Meta分析等高要求的筛选场景,必须要有两个独立的筛选人员同时进行操作,出现分歧的时候参照事先制定好的纳入排除标准来核对,无法达成一致的部分则请第三方仲裁
4. 定期备份筛选数据,防止文献管理软件出现故障造成多日筛选成果全部丢失,每天导出一次筛选标记后的题录备份
5. 文献分层筛选结果的合规归档方法
完成所有的筛选之后,就需要按照文献的质量分层进行归档,便于后面写作时使用。
1. 第一层级:核心文献,即终筛得分前20%的高影响力经典文献,单独建立分组,后续优先用于支撑研究的核心论证部分
2. 第二层级:重点引用文献,即终筛得分在20%-70%区间的文献,对应支撑研究的研究现状、方法借鉴部分
3. 第三层级:补充参考文献,即终筛得分70%以后的文献,仅作为背景补充内容参考
归档时同步导出PRISMA2020版要求的全流程筛选统计数据,即初始检索总篇数、初筛去重篇数、中筛摘要淘汰篇数、全文获取篇数、终筛淘汰篇数、最终纳入篇数,直接生成官方规范的PRISMA筛选流程图,满足所有学术投稿的合规性要求。
下一节讲解单篇文献的深度信息拆解逻辑。
常见问题
- Q:文献分层筛选与普通文献筛选有何不同?A:普通文献筛选一般是一次性的粗略筛选,而文献分层筛选则是按照从泛到精的多层级递进逻辑,依次进行初筛去重、主题匹配、质量校验、深度适配的多轮筛选,可以大大降低无效文献遗漏的风险,适合于系统性综述类的严谨科研需求。
- Q:文献分层筛选每层的淘汰率设置多少比较合理? / A:没有统一固定数值,通常初筛层淘汰率控制在60%-70%左右,主要剔除重复和完全不相关文献;复筛层淘汰率在40%-50%,排除主题不匹配的文献;终筛层淘汰率控制在10%-20%,仅保留完全符合研究纳入标准的高质量文献。
- Q:没有文献分层筛选的相关经验可以直接上手操作吗? / A:可以,建议先参考PRISMA官方筛选框架明确各层的纳入排除标准,搭配文献管理工具辅助去重和批量标记,按照入门层→进阶层→核心层的顺序逐步推进,过程中双人交叉核验筛选结果就能大幅降低失误概率。
- Q:文献分层筛选过程中出现筛选结果分歧怎么处理? / A:优先提前预设分歧协商机制,由两名筛选人员独立同步筛选,出现分歧时先对照预先制定的纳入排除标准逐一核对,仍无法统一时邀请第三方研究人员介入仲裁,最终保留所有经三方确认符合标准的文献。