NHANES(National Health and Nutrition Examination Survey)是美国一项具有代表性的全国性健康和营养调查项目,旨在通过综合性的健康和营养评估来监控美国民众的健康趋势和生活方式的变化。它涵盖了人口统计学信息、营养摄入、实验室测试、体格检查以及生活方式和社会经济调查等多个领域。

官方网站:

https://www.cdc.gov/nchs/nhanes/index.htm

1、特点

①权威数据来源

在研究设计吸取全球专家意见。

②大型数据库

收集400+主题,主要包含人口统计数据、膳食数据、检查数据、实验室数据和问卷数据。

③持续更新

以2年为更新周期,且围绕当前关注重点。

图片

④权威杂志认可

近10年,NHANES数据库共有300+IF≥20论文。

⑤免费下载

NHANES数据库中的大部分数据都可以免费下载,且无需注册。

⑥适用性广

NHANES数据库适合大部分的临床科室,例如个大内科、妇科、口腔科、眼科、检验科、儿科等,但暂不含核磁共振(MR)、B超和中医药相关数据。

2、数据分布

(1)了解数据模块及变量

通过NHANES官网的查询功能,基于关键词获得目标表后,就可以使用前面获取NHANES数据库的方法,获取和整理数据集

NHANES数据库的数据模块分为2大类:问卷和检查。

①问卷

包括人口学数据(年龄、教育程度、种族等)、饮食营养数据(摄入能量、矿物质元素等)、健康相关信息(风险因素、诊断数据、治疗数据等)

②检查

包括体格检查(听力、血压、身体成分、骨密度、眼科检查、呼吸系统、口腔检查等)和实验室检查(重金属(血)、血生化(血)、各类维生素(血)等)。

(2)筛选变量

根据研究目的,从NHANES数据库中筛选出相关的变量。可以使用R包如nhanesA来帮助筛选和处理数据。

其中,提取数据的方法如:

点击任意年份即可,如NHANES 2017-2018

数据主要在

Data, Documentation, Codebooks

下载XPT文件即可

(3)整理数据

对筛选出的变量进行整理,包括数据清洗、格式转换和合并。

3、整合流程

①提取分析变量。

②多周期变量纵向合并(年份合并)。

③多个数据变量整合成一个数据。

④根据变量纳排研究人群。

⑤将多个NHANES变量整合成文章分析的一个变量。

⑥变量的分析重组。

(5)加权重分析数据

NHANES使用复杂的抽样设计,因此在分析时需要考虑样本权重。单个周期的话,就只需要那一个周期的权重进行,多个周期的画,需要进行计算,基础原则=合并权重=原始权重、合并周期数,特殊周期的需要特殊的计算公式,后面遇到再计算

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐