摘要:河南戏曲多模态表演数据集是一个面向传统戏曲数字化保护、表演风格识别与多模态文化计算的文化艺术数据集,主要围绕河南戏曲表演中的声音、视觉行为和文本内容构建。

数据集概述

河南戏曲多模态表演数据集是一个面向传统戏曲数字化保护、表演风格识别与多模态文化计算的文化艺术数据集,主要围绕河南戏曲表演中的声音、视觉行为和文本内容构建。数据整合了演员演唱音频、由戏曲视频与图像提取的视觉表演特征,以及唱词和叙事文本等信息,并通过统一的 sample_id 建立不同模态之间的对应关系。该数据集能够从唱腔、动作、姿态、面部表情及歌词语义等多个维度描述戏曲表演,为河南戏曲艺术的数字保存、智能分析和文化传播提供数据基础。

数据结构与关键特征

数据集主要包含音频、视觉和文本三种模态。视觉CSV记录表演时长、手势强度、运动能量、姿态变化、面部表情、手部动作、身体朝向和舞台位置等特征;文本CSV则包含歌词长度、词密度、情感得分、情感倾向、比喻使用、重复率和语义丰富度等语言特征,并与视觉数据共享目标标签,用于表示表演风格或情感类别。音频部分包含不同戏曲角色行当的演唱记录,其中 danAll 包含 54个旦角音频文件,老生包含 28个老生音频文件,能够体现不同角色在音色、唱腔、节奏和情感表达方面的差异。

应用价值与研究方向

该数据集适用于河南戏曲角色与唱腔识别、表演风格分类、戏曲情感分析、动作行为分析和传统文化数字化研究。音频部分可采用 MFCC、Mel频谱、Wav2Vec 2.0、HuBERT 或 Audio Transformer 分析唱腔和角色特征,文本部分可使用 BERT、RoBERTa 等模型分析歌词语义与情感,视觉特征则可结合机器学习、时序网络或 Transformer 建模演员动作与舞台表现。进一步可以研究音频—视觉—文本多模态融合、旦角与老生自动识别、唱腔情感与身体动作关联、戏曲表演检索、数字文化遗产知识库以及河南戏曲智能展示与辅助教学系统。

数据集来源

由张家梁(Bob)整理并于2026年在7zcode平台公开发布。

数据集信息

免责声明与引用

数据仅用于科研与教学用途。若用于商业场景,请自行核验数据许可。如需引用,请在论文或报告中注明数据集名称与版本号。

作者信息

作者:Bob (张家梁)
项目编号:Datasets-511
文件大小:830M
原创声明:本数据集为整理作品

联系方式

开源协议

本项目采用AGPL-3.0开源协议,允许个人和组织自由使用、修改和分发代码,但基于本项目的衍生作品必须同样开源,且用于提供网络服务时需向用户提供完整源代码。本项目仅供学习研究使用,作者不对使用本项目产生的任何后果承担责任,使用者应遵守当地法律法规,合理合法使用本项目。如本项目对您的研究或工作有所帮助,欢迎引用并注明出处。

声明:本站所有项目资源都可以正常运行,亲测无错!而且我们录制了演示视频,在我们注明的环境版本下,项目运行效果完全和演示视频一致。客服QQ:下载须知