6.数据提取
多数情况下,在开始正式的数据提取之前,会预先指定一个数据提取方案(protocol),即表格的“表头”(可采用Word,也可采用Excel)。该方案可以指导作者在数据提取阶段需要重点提取哪些数据。常见需要提取的数据包括:研究相关基本信息、研究对象相关信息,以及研究核心方法和主要结果。研究相关基本信息包括:作者(第一作者)、年份、国家、研究设计、样本量。研究对象相关信息例如:年龄、性别、BMI、病程等(如果有的话)。研究核心方法及主要结果包括:主要变量测量方法、干预方案、随访时间、主要结果。此数据提取方案多由文献回顾小组共同决定,并通过在一两篇文献中进行预试验,对此进行相应的调整。形成一个完整的数据提取方案,可大大加速后续工作进程。示例5-12展示了某文献综述中提取的主要数据;表格下方对表格中使用到的缩写进行了标注。
示例5-12 数据提取表头及编码的使用

MD:Mediterranean diet,LF:low fat,F:female,M:male;RCT:randomized clinical trial,SD:standard deviation.
在进行数据提取时,要擅长使用编码(coding)。例如,针对“研究设计”这一栏目,纳入综述的各个研究可能采用了不同的研究设计,包括:随机对照试验(RCT)、横断面调查(cross-sectional)或病例对照(case-control)。在表格中,可以采用不同的编码(或缩写)来代表不同的研究设计;同时,在表格下方进行相应的说明。例如,1表示随机对照试验;2表示横断面调查;3表示病例对照。采用此种方法,可以大大缩减表格的篇幅,具有事半功倍的效果。如示例5-12所示,本综述中,对于性别(女性F、男性M)使用了缩写代替;类似地,对于干预措施也采用了缩写表述。同时,在表格的下方,使用了标注进行解释。
对于主要研究结果,需要说明提取的数据格式是怎样的。针对连续性变量,多提取均值和标准差;针对分类变量,多提取频数和百分比。对于有干预的研究,需要说明提取的是干预后数据还是干预前后的差值。如果主要观察指标是相关系数,可以提取相关系数及可信区间;如果主要观察指标是优势比,可以提取OR值及可信区间。针对文中的主要研究结果,如果作者未进行汇报(缺失值)或所汇报的内容不符合数据提取格式,需要说明如何处理这种情况。同时,在表格下方,使用标注的形式,说明哪些数据是间接计算来的。如示例5-13所示,本综述中,对于缺失值,该作者通过文中提供的其他数据计算而来。如示例5-14所示,本综述中,对于缺失值,该作者通过邮件联系原文作者而获取。类似地,如示例5-15所示,本综述中,对于缺失值,从图中提取而来。Cochrane手册中详细地介绍了如何处理缺失值,可进行参考。
示例5-13 缺失值处理方法——根据已有数据计算而来
To assess association between IA and sleep problems,data of 2 * 2 tables calculating odds ratios(ORs)of sleep problems regarding IA status were extracted(where possible)from primary studies.If these data were not provided,crude and adjusted ORs with information concerning the confidence interval(CI),mean,and SD of sleep scores for both groups of normal and internet addicted participants were extracted.Additionally,some studies reported Pearson correlation coefficients between these variables,which were also extracted.(https://www.daowen.com)
示例5-14 缺失值处理方法——联系作者获取
If data cannot be extracted from the paper or calculated from available information,we contacted the authors via email.
此外,对于包含多个时间点测量值的研究,需要说明提取的是哪个时间点的数据,且注意保持一致。如示例5-15所示,本综述中,由于不同的研究在不同的时间点对研究结果进行了评估,为保持清晰和一致性,该综述着重提取了离干预结束最近的一个时间点的数据。
示例5-15 数据提取说明及缺失值处理方法
Variabilities in the timing and frequencies of outcome measures were anticipated among different studies.For clarity and consistency,we focused on study outcomes that were collected closest to the end of the intervention.Data were extracted fromthe graphs if not reported in the text.
在撰写这一部分时候,需要说明数据提取由几个人完成,是否是独立完成。如果出现不一致的地方,如何处理。如示例5-16所示,本综述中,多名作者参与到了数据提取过程中。
示例5-16 数据提取参与人员
Full text review and data extraction.Following initial screening,full text was reviewed for final eligibility by a group of 8 reviewers(AA,BH,JY,LD,LG,LM,PT,RJ).Each article was reviewed independently by two reviewers.If either of the two reviewers rated the article as eligible,the article was included for data extraction.