决策树模型与Logistic回归分析模型识别高血压危险因素的效果比较
Comparison of the effects of decision tree model and Logistic regression analysis model on identif-ying risk factors of hypertension
摘要目的 利用决策树模型和Logistic回归分析模型分析清丰县居民高血压的危险因素,比较两种分析方法的不同.方法 采取多阶段分层整群抽样的方法,在清丰县15~ 74岁人群中抽取4087名常住居民进行调查.建立决策树与Logistic回归分析模型.结果 决策树和Logistic回归分析模型均显示高年龄、中心性肥胖、初中以下文化、农村、糖尿病、吸烟、饮酒和有高血压家族史为高血压危险因素.超重/肥胖变量被纳入决策树模型,在Logistic回归分析模型中被剔除,共线性诊断提示中心性肥胖和超重/肥胖两变量有较强的共线性.曲线下面积(Area Under the Curve,AUC)和综合判别改善指数(Integrated Discrimination Improvement,IDI)均提示决策树模型预测高血压效果的能力稍高于Logistic回归分析模型.结论 决策树模型预测能力稍高于Logistic回归分析模型,在高血压危险因素的分析中可行、直观,同时不受变量间共线性的影响;Logistic回归分析模型可以充分展现自变量与因变量的数量依存关系,与决策树模型互为补充,可结合两者来描述高血压的危险因素.
更多相关知识
- 浏览242
- 被引42
- 下载2

相似文献
- 中文期刊
- 外文期刊
- 学位论文
- 会议论文


换一批



