摘要:歌剧演唱声音数据集是一个面向中国戏曲声乐分析、情感识别与演唱质量评估的音频数据集,收集了具有不同演唱风格、情绪表现和角色特征的戏曲演唱片段。

数据集概述

歌剧演唱声音数据集是一个面向中国戏曲声乐分析、情感识别与演唱质量评估的音频数据集,收集了具有不同演唱风格、情绪表现和角色特征的戏曲演唱片段。数据按照演唱风格、自白/倾诉、对话、女性角色表演和组合表现等 5 个类别进行组织,每个类别包含约 100 条音频录音,单段时长约 5 秒,整体类别分布较为均衡。该数据集不仅保留实际音频文件,还提供多项演唱表现评分和整体质量标签,可用于分析中国戏曲中特有的音色、语调、节奏、情感表达和角色化声音特征。

数据结构与关键特征

该数据集采用“音频文件 + 演唱属性评分 + 综合标签”的结构,每条记录通过 Singer_ID 和对应音频文件建立关联。主要特征包括演唱风格、情感表达、对话表现、女性角色塑造和组合/喜剧表现等风格指标,同时包含呼吸控制、音域、情绪表现力、韵律准确性、音准、真假声控制以及发音清晰度等声乐技术指标,评分通常为 0–100。这些特征能够从艺术表现与声学技巧两个层面对演唱质量进行描述。目标变量为整体演唱表现,采用二元标签表示,其中 1 代表整体表现质量较高,0 代表整体表现质量较低,适合开展分类预测与综合评分研究。

应用价值与研究方向

该数据集适用于戏曲演唱质量评估、情感识别、声乐风格分类、角色声音分析和智能音乐教育等研究。研究人员可以从音频中提取 MFCC、Mel 频谱、基频、共振峰、能量和节奏等声学特征,并结合 CNN、CRNN、LSTM、Audio Transformer 或自监督音频模型进行演唱质量和风格识别。进一步可开展跑调检测、呼吸控制评价、真假声识别、发音清晰度分析、戏曲角色分类、情感强度预测以及自动声乐反馈系统研究,为中国传统戏曲数字化保护、智能声乐教学和计算音乐学提供数据支持。

数据集来源

由张家梁(Bob)整理并于2026年在7zcode平台公开发布。

数据集信息

免责声明与引用

数据仅用于科研与教学用途。若用于商业场景,请自行核验数据许可。如需引用,请在论文或报告中注明数据集名称与版本号。

作者信息

作者:Bob (张家梁)
项目编号:Datasets-461
文件大小:200M
原创声明:本数据集为整理作品

联系方式

开源协议

本项目采用AGPL-3.0开源协议,允许个人和组织自由使用、修改和分发代码,但基于本项目的衍生作品必须同样开源,且用于提供网络服务时需向用户提供完整源代码。本项目仅供学习研究使用,作者不对使用本项目产生的任何后果承担责任,使用者应遵守当地法律法规,合理合法使用本项目。如本项目对您的研究或工作有所帮助,欢迎引用并注明出处。

声明:本站所有项目资源都可以正常运行,亲测无错!而且我们录制了演示视频,在我们注明的环境版本下,项目运行效果完全和演示视频一致。客服QQ:下载须知