摘要:婴儿哭声音频语料库(Infant Cry Audio Corpus)是通过 Donate-a-cry 公益采集活动构建的婴儿哭声数据集,音频样本由用户通过 Android 和 iOS 移动应用自主上传。
数据集概述
婴儿哭声音频语料库(Infant Cry Audio Corpus)是通过 Donate-a-cry 公益采集活动构建的婴儿哭声数据集,音频样本由用户通过 Android 和 iOS 移动应用自主上传。数据集中保存的是原始、未经修改和人工审核的婴儿哭声音频,并由贡献者自行标注婴儿性别、年龄阶段以及可能的哭泣原因,可用于婴儿哭声识别、音频分类和智能育儿辅助等研究。
数据结构与关键特征
数据集的标签信息直接编码在音频文件名中,主要包括应用实例 UUID、录制时间戳、应用版本、婴儿性别、年龄阶段和哭泣原因等信息。其中性别包括男性(m)和女性(f);年龄划分为 0–4 周、4–8 周、2–6 个月、7 个月–2 岁以及 2 岁以上等阶段;哭泣原因包括饥饿(hu)、需要拍嗝(bu)、腹痛(bp)、不适(dc)、疲劳(ti)、孤独(lo)、冷热不适(ch)、害怕(sc)和未知(dk)等类别。iOS 与 Android 文件采用相似命名结构,主要区别在于 Android 时间戳以毫秒表示,而 iOS 使用秒级 Unix 时间戳。
应用价值与研究方向
该数据集可用于婴儿哭声原因分类、年龄与性别相关声学特征分析、异常哭声识别、智能婴儿监护和辅助育儿系统等研究。研究人员可以提取 MFCC、Mel 频谱、基频、能量和声谱图等音频特征,并结合 CNN、LSTM、CRNN、Transformer 或预训练音频模型进行分类与识别;还可进一步探索噪声环境下的鲁棒识别、类别不平衡处理、自监督音频表示学习和移动端轻量化部署,为智能婴儿监护设备和婴幼儿健康辅助分析提供数据基础。
数据集来源
由张家梁(Bob)整理并于2026年在7zcode平台公开发布。
数据集信息
免责声明与引用
数据仅用于科研与教学用途。若用于商业场景,请自行核验数据许可。如需引用,请在论文或报告中注明数据集名称与版本号。
作者信息
作者:Bob (张家梁)
项目编号:Datasets-536
文件大小:39M
原创声明:本数据集为整理作品
联系方式

开源协议
本项目采用AGPL-3.0开源协议,允许个人和组织自由使用、修改和分发代码,但基于本项目的衍生作品必须同样开源,且用于提供网络服务时需向用户提供完整源代码。本项目仅供学习研究使用,作者不对使用本项目产生的任何后果承担责任,使用者应遵守当地法律法规,合理合法使用本项目。如本项目对您的研究或工作有所帮助,欢迎引用并注明出处。


评论(0)