摘要:该数据集面向情感感知型虚拟直播与人机交互研究,共包含35,000条观众互动记录。
数据集概述
该数据集面向情感感知型虚拟直播与人机交互研究,共包含35,000条观众互动记录。每条记录以观众文本消息为核心,并通过图像编号和音频编号关联相应的面部表情图像与情感语音样本,同时记录直播场景、互动行为、观众意图、参与程度和响应优先级等背景信息。
数据结构与关键特征
根据所列字段,数据包含11个属性,包括text_id、image_id、audio_id、audio_folder、audience_message、broadcast_context、interaction_type、audience_intent、engagement_level、response_priority和目标字段emotion。数据覆盖愤怒、厌恶、恐惧、快乐、中性、悲伤和惊讶七类情绪,每类包含5,000条记录,类别分布均衡。文本、面部图像和TESS情感语音通过标识符进行跨模态关联。
应用价值与研究方向
该数据集可用于多模态情感识别、观众情绪分析、互动意图识别、参与度预测和响应优先级评估。结合自然语言处理、计算机视觉、语音情感识别与多模态融合技术,可构建能够理解观众情绪并实时调整表情、语气和回复策略的虚拟主播系统,还可用于智能客服、数字人直播、交互式广播和情感感知通信研究。
数据集来源
由张家梁(Bob)整理并于2026年在7zcode平台公开发布。
数据集信息
免责声明与引用
数据仅用于科研与教学用途。若用于商业场景,请自行核验数据许可。如需引用,请在论文或报告中注明数据集名称与版本号。
作者信息
作者:Bob (张家梁)
项目编号:Datasets-622
文件大小:480M
原创声明:本数据集为整理作品
联系方式

开源协议
本项目采用AGPL-3.0开源协议,允许个人和组织自由使用、修改和分发代码,但基于本项目的衍生作品必须同样开源,且用于提供网络服务时需向用户提供完整源代码。本项目仅供学习研究使用,作者不对使用本项目产生的任何后果承担责任,使用者应遵守当地法律法规,合理合法使用本项目。如本项目对您的研究或工作有所帮助,欢迎引用并注明出处。


评论(0)