摘要:疾病症状和患者概况数据集(CSV)包含 10 列特征涵盖 100 多种疾病,MIT 许可证,可用性 10.00/10,专为临床分析、疾病诊断预测和医疗 AI 模型训练而构建。
数据集简介
数据集概述
心血管疾病数据集包含 70,000 条患者记录、11 个特征 + 1 个目标变量。心血管疾病是全球主要死亡原因,早期识别高危人群至关重要。数据集包含客观特征(年龄、身高、体重、性别)、检查特征(血压、胆固醇、血糖)和主观特征(吸烟、饮酒、体力活动),目标变量为心血管疾病(二元),所有数据在医学检查时收集。
数据结构与关键特征
包含 70,000 条记录、11 个特征分三类:
(1) 客观特征(年龄(天)、身高(cm)、体重(kg)、性别);
(2) 检查特征(收缩压、舒张压、胆固醇(1-3)、血糖(1-3));
(3) 主观特征(吸烟、饮酒、体力活动,二元);
(4) 目标变量:心血管疾病(二元:0 无/1 有)。
应用价值与研究方向
支持心血管疾病风险预测(机器学习模型)、风险因素分析(年龄、性别、BMI、血压、胆固醇、血糖、生活方式)、二元分类建模、特征工程、探索性数据分析、临床决策支持、公共卫生研究和算法基准测试。
数据集来源
该数据集所有数据在医学检查时收集。由张家梁(Bob)整理并于2026年在7zcode平台公开发布。
数据集信息
免责声明与引用
数据仅用于科研与教学用途。若用于商业场景,请自行核验数据许可。如需引用,请在论文或报告中注明数据集名称与版本号。
作者信息
作者:Bob (张家梁)
项目编号:Datasets-100
文件大小:670K
原创声明:本数据集为整理作品
联系方式

开源协议
本项目采用AGPL-3.0开源协议,允许个人和组织自由使用、修改和分发代码,但基于本项目的衍生作品必须同样开源,且用于提供网络服务时需向用户提供完整源代码。本项目仅供学习研究使用,作者不对使用本项目产生的任何后果承担责任,使用者应遵守当地法律法规,合理合法使用本项目。如本项目对您的研究或工作有所帮助,欢迎引用并注明出处。


评论(0)