摘要:多模态文本遗产数据集是一个面向非物质文化遗产数字化保护、传统工艺知识建模与文化创意设计研究的多模态数据集,围绕传统工艺技术的文化背景、制作流程、工匠实践和文化价值进行系统化记录。
数据集概述
ICH 多模态文本遗产数据集是一个面向非物质文化遗产数字化保护、传统工艺知识建模与文化创意设计研究的多模态数据集,围绕传统工艺技术的文化背景、制作流程、工匠实践和文化价值进行系统化记录。数据集以结构化文本为核心,同时结合工艺过程中的音频记录和高分辨率图像,形成“文本—声音—图像”多模态遗产知识体系,可用于描述陶艺、手工织造、木雕等不同传统技艺,并支持文化信息学、数字人文和非遗创新设计等研究。
数据结构与关键特征
数据集主要包括 ICH_text_dataset.csv、音频数据和图像数据三部分,其中 CSV 包含约 1300 条工艺知识记录,核心字段包括 record_id、general_category、technique_name、难度级别、artisan_type、cultural_significance、sentence 和 target,用于描述工艺类别、技术名称、专业难度、工匠类型、文化价值以及具体操作步骤或背景知识;音频部分记录工具与材料碰撞、制作节奏和工艺环境声,图像部分则展示材料、工具、加工阶段和最终成品,从而建立“工艺属性 + 描述文本 + 声学特征 + 视觉过程”之间的对应关系。需要注意,数据说明中同时出现“10列”和“8列”两种描述,而当前明确列出的字段为 8个,实际研究时建议以 CSV 文件真实表头为准。
应用价值与研究方向
该数据集适用于非遗工艺分类、传统技艺知识抽取、多模态检索、文化知识图谱和非遗辅助设计等研究,可利用 BERT、RoBERTa 或大语言模型分析工艺描述文本,采用 CNN、Vision Transformer、CLIP 等模型学习工艺图像特征,并利用音频模型提取工具声、节奏和材料交互特征,再通过多模态 Transformer 等方法实现联合表示。进一步可以研究工艺步骤自动识别、技艺类别预测、文化意义语义分析、工匠知识数字化、跨模态非遗内容检索、传统工艺知识问答以及面向现代产品设计的非遗元素智能推荐与再设计。
数据集来源
由张家梁(Bob)整理并于2026年在7zcode平台公开发布。
数据集信息
免责声明与引用
数据仅用于科研与教学用途。若用于商业场景,请自行核验数据许可。如需引用,请在论文或报告中注明数据集名称与版本号。
作者信息
作者:Bob (张家梁)
项目编号:Datasets-494
文件大小:100M
原创声明:本数据集为整理作品
联系方式

开源协议
本项目采用AGPL-3.0开源协议,允许个人和组织自由使用、修改和分发代码,但基于本项目的衍生作品必须同样开源,且用于提供网络服务时需向用户提供完整源代码。本项目仅供学习研究使用,作者不对使用本项目产生的任何后果承担责任,使用者应遵守当地法律法规,合理合法使用本项目。如本项目对您的研究或工作有所帮助,欢迎引用并注明出处。


评论(0)