摘要:肺音数据集用于从电子听诊器声音检测肺部疾病。听诊器技术的进步使高质量的患者声音录音成为可能。该数据集使用电子听诊器记录健康和不健康受试者的肺音,包含 7 种疾病的声音(哮喘、心力衰竭、肺炎、支气管炎、胸腔积液、肺纤维化和慢性阻塞性肺病 COPD)以及正常呼吸音。
数据集简介
数据集概述
肺音数据集用于从电子听诊器声音检测肺部疾病。听诊器技术的进步使高质量的患者声音录音成为可能。该数据集使用电子听诊器记录健康和不健康受试者的肺音,包含 7 种疾病的声音(哮喘、心力衰竭、肺炎、支气管炎、胸腔积液、肺纤维化和慢性阻塞性肺病 COPD)以及正常呼吸音。数据集包含从胸壁各个有利位置检查的音频录音,听诊器放置位置由执行诊断的专科医生确定。每次录音复制三次,对应强调某些身体声音的各种频率滤波器。数据集可用于开发从肺音检测肺部疾病或识别正确肺音类型的自动化方法。
数据集包含来自 112 名受试者(35 名健康,77 名不健康)的呼吸音,年龄 21-90 岁(平均 ±SD:50.5 ±19.4),43 名女性和 69 名男性。文件命名规则:以滤波器类型字母(B、D 或 E)开头,后跟字母 P、唯一患者编号(从 1 开始)和下划线,然后包括诊断、声音类型、胸部测量位置、年龄和性别。三种滤波器类型:(1) B(Bell 钟形模式):放大 20-1000 Hz 频率范围声音,强调 20-200 Hz 低频;(2) D(Diaphragm 膜片模式):放大 20-2000 Hz 频率范围声音,强调 100-500 Hz 频率;(3) E(Extended 扩展模式):放大 20-1000 Hz 频率范围声音,强调 50-500 Hz 频率。胸部区域编码:三个有序字母 {A 前部/P 后部}、{L 左/R 右}、{L 下/M 中/U 上}。声音类型和受试者数量:正常 35、湿啰音 23、哮鸣音 41、爆裂音 8、支气管音 1、哮鸣音&爆裂音 2、支气管音&爆裂音 2。疾病诊断:正常(N)、哮喘、COPD、支气管炎(BRON)、心力衰竭、肺纤维化、胸腔积液。数据文件:包含”data annotation.xlsx”(匿名人口统计信息:年龄/性别、录音位置、注释符号含义)和原始”.zsa”文件(按患者编号范围分组,每个文件最多 12 个录音)。
数据集用于设计自动化机器学习算法以检测肺部疾病,提供来自 112 名受试者的真实肺音录音,涵盖多种肺部健康状况,丰富、扩展和平衡少数公开可比数据集,可用于训练医疗专业人员的听诊技能。支持肺部疾病检测、肺音类型识别、音频信号处理、噪声去除、机器学习特征提取、深度学习模型训练(CNN、RNN、Transformer)、生物医学工程研究、人工智能医疗应用、医学教育与培训、听诊技能训练、临床决策支持。数据再利用:(1) 以不同方式处理音频文件以去除噪声;(2) 提出机器学习算法的特征提取技术;(3) 开发和测试新的机器学习算法;(4) 听诊器文件可用于专业教育和培训。
数据集来源
该数据集来源于112 名受试者的电子听诊器肺音录音。由张家梁(Bob)整理并于2026年在7zcode平台公开发布。
数据集信息
免责声明与引用
数据仅用于科研与教学用途。若用于商业场景,请自行核验数据许可。如需引用,请在论文或报告中注明数据集名称与版本号。
作者信息
作者:Bob (张家梁)
项目编号:Datasets-140
文件大小:51M
原创声明:本数据集为整理作品
联系方式

开源协议
本项目采用AGPL-3.0开源协议,允许个人和组织自由使用、修改和分发代码,但基于本项目的衍生作品必须同样开源,且用于提供网络服务时需向用户提供完整源代码。本项目仅供学习研究使用,作者不对使用本项目产生的任何后果承担责任,使用者应遵守当地法律法规,合理合法使用本项目。如本项目对您的研究或工作有所帮助,欢迎引用并注明出处。


评论(0)