非物质文化遗产多模态工艺知识数据集

发布时间:2026/8/30 10:04:09
非物质文化遗产多模态工艺知识数据集 摘要多模态文本遗产数据集是一个面向非物质文化遗产数字化保护、传统工艺知识建模与文化创意设计研究的多模态数据集围绕传统工艺技术的文化背景、制作流程、工匠实践和文化价值进行系统化记录。数据集概述ICH 多模态文本遗产数据集是一个面向非物质文化遗产数字化保护、传统工艺知识建模与文化创意设计研究的多模态数据集围绕传统工艺技术的文化背景、制作流程、工匠实践和文化价值进行系统化记录。数据集以结构化文本为核心同时结合工艺过程中的音频记录和高分辨率图像形成“文本—声音—图像”多模态遗产知识体系可用于描述陶艺、手工织造、木雕等不同传统技艺并支持文化信息学、数字人文和非遗创新设计等研究。数据结构与关键特征数据集主要包括 ICH_text_dataset.csv、音频数据和图像数据三部分其中 CSV 包含约 1300 条工艺知识记录核心字段包括 record_id、general_category、technique_name、难度级别、artisan_type、cultural_significance、sentence 和 target用于描述工艺类别、技术名称、专业难度、工匠类型、文化价值以及具体操作步骤或背景知识音频部分记录工具与材料碰撞、制作节奏和工艺环境声图像部分则展示材料、工具、加工阶段和最终成品从而建立“工艺属性 描述文本 声学特征 视觉过程”之间的对应关系。需要注意数据说明中同时出现“10列”和“8列”两种描述而当前明确列出的字段为 8个实际研究时建议以 CSV 文件真实表头为准。应用价值与研究方向该数据集适用于非遗工艺分类、传统技艺知识抽取、多模态检索、文化知识图谱和非遗辅助设计等研究可利用 BERT、RoBERTa 或大语言模型分析工艺描述文本采用 CNN、Vision Transformer、CLIP 等模型学习工艺图像特征并利用音频模型提取工具声、节奏和材料交互特征再通过多模态 Transformer 等方法实现联合表示。进一步可以研究工艺步骤自动识别、技艺类别预测、文化意义语义分析、工匠知识数字化、跨模态非遗内容检索、传统工艺知识问答以及面向现代产品设计的非遗元素智能推荐与再设计。数据集来源由张家梁(Bob)整理并于2026年在7zcode平台公开发布。数据集信息免责声明与引用数据仅用于科研与教学用途。若用于商业场景请自行核验数据许可。如需引用请在论文或报告中注明数据集名称与版本号。作者信息作者Bob (张家梁)项目编号Datasets-494文件大小100M原创声明本数据集为整理作品