阅读视图

新书推荐|《文化遗产领域的人工智能与智慧数据:全球进展与中国方案》

2026-07-02 14:20 湖北

《文化遗产领域的人工智能与智慧数据:全球进展与中国方案》作为《数字人文与智能计算》丛书的第二卷,由泰勒-弗朗西斯出版集团旗下的Routledge出版社以开放获取形式出版。

一、书籍简介

《文化遗产领域的人工智能与智慧数据:全球进展与中国方案》(AI and Smart Data for Cultural Heritage: Global Achievements and China’s Innovations)作为《数字人文与智能计算》丛书的第二卷,由泰勒-弗朗西斯(Taylor & Francis)出版集团旗下的Routledge出版社以开放获取形式出版。本书探究人工智能与智慧数据为数字人文(DH)研究带来的范式转型,汇集亚洲、欧洲、北美及南美多地的研究成果,以全球视野展现文化遗产领域的创新研究方法与实践路径。

从大数据演进至智慧数据、迈入人工智能时代的发展进程中,数字人文研究者持续开拓全新的研究概念、方法范式与实践形态。智慧数据可依托任意规模的可信、情境化、认知型、预测性且可直接应用的数据提炼研究洞见;在人工智能的协同赋能下,智慧数据将持续在本领域发挥核心价值。本书兼顾理论路径与实践应用,系统呈现数字人文领域中人工智能与智慧数据赋能文化遗产的前沿进展与发展趋势,同时也为文化遗产场景下运用此类技术的批判理论、方法体系与实践探索做出了重要学术贡献。

对于深耕技术与人文研究交叉领域的数字人文研究者、文化遗产专业从业者及人工智能技术实践者而言,本书是不可或缺的核心参考读物。

二、编者简介

王晓光,武汉大学信息管理学院院长、教授,同时担任武汉大学文化遗产智能计算实验室主任与数字人文研究中心主任,研究方向涵盖数字资产管理、知识组织、语义出版及数字人文。

曾蕾,美国肯特州立大学信息科学系教授,获美国匹兹堡大学博士学位。曾担任国际图联(IFLA)标引与分类法委员会主席、国际知识组织学会(ISKO)理事、国际信息科学与技术学会 (ASIS&T) 理事、都柏林核心元数据组织(DCMI)顾问委员会主席及执行委员会委员、W3C 图书馆关联数据(LLD)工作组特邀专家成员、国际联盟 iSchools 数字人文课程委员会(iDHCC)主席等。其研究领域包括知识组织系统、元数据、语义技术与数字人文,累计出版专著6部,发表学术论文百余篇。

高瑾,伦敦大学学院(UCL)数字人文研究中心(UCLDH)联合主任,伦敦大学学院信息研究系数字档案方向讲师,兼任维多利亚与阿尔伯特博物馆研究员。研究聚焦数字人文史、网络分析、数字化、来源研究与数据标准领域。

赵珂,武汉大学信息管理学院、文化遗产智能计算实验室助理研究员。她拥有武汉大学信息资源管理博士学位、伦敦大学学院数字人文理学硕士学位,以及分获中国与韩国院校的艺术学学士、工学学士学位,研究方向聚焦数字叙事、数字人文与人机交互。

三、出版信息

  • 书名:《文化遗产领域的人工智能与智慧数据:全球进展与中国方案》(AI and Smart Data for Cultural Heritage: Global Achievements and China’s Innovations)

  • 主编:王晓光,曾蕾,高瑾,赵珂

  • 电子书出版时间:2026年5月25日

  • 出版地:伦敦

  • 出版社:Routledge

  • DOI:https://doi.org/10.4324/9781003666530

  • 总页数:396页

  • 电子书ISBN:9781003666530

  • 开放获取资助方:武汉大学

四、书籍目录

第一部分 全球创新路径

第1章

人文学科的开放数据应用——来自《开放人文数据期刊》的观察

作者:Barbara McGillivray, Daniele Borkowski, Andrea Farina, Simon Mahony, Xiaoguang Wang

第2章

智能体人工智能在社科与人文数据发现中的应用

作者:Vassilis Routsis, Yujian Gan, Sagar Uprety, Antonis Bikakis

第3章

基于Arches平台的文化遗产资源管理——面向资源清单与概念型叙词表的智慧数据方案

作者:Dennis Wuthrich, Philip Carlisle, Kevin Kochanski

第4章

协同网络环境下的智慧数据:建筑与城市空间图像获取

作者:Artur Simões Rozestraten, Giselle Beiguelman, Vânia Mara Alves Lima

第5章

作为数据基础设施的馆藏资源——德国与澳大利亚的实践视角

作者:Marco Humbel, Julianne Nyhan, Nina Pearlman

第6章

泰国社区档案与文化遗产数字化技术

作者:Pimphot Seelakate

第7章

利用非完美AI成果深化佛教典籍研究——以SAT文本数据库为例

作者:Kiyonori Nagasaki

第8章

文化遗产项目开发中的伦理设计考量

作者:Lala Hajibayova

第二部分 中国创新实践

第9章

从故纸遗存到活态内核——人工智能时代文献遗产的智能化发展研究

作者:Li Niu, Chi Jin, Anrunze Li, Rundong Hu

第10章

面向中国古琴减字谱释读的知识增强多模态大语言模型

作者:Cuijuan Xia

第11章

基于大语言模型的非物质文化遗产文本自动词性标注

作者:Zhixiao Zhao, Dongbo Wang

第12章

数字化再现与活化——面向中国青铜器图像智能生成的扩散模型微调研究

作者:Xilong Hou, Xiaoguang Wang

第13章

中国古代科技文献数据库建设与知识挖掘

作者:Xiang Zheng, Mingjie Li

第14章

智慧元数据视角下价值增值驱动的北京传统村落本体建模

作者:Chunqiu Li, Jie Guo, Jiayi Wang, Wirapong Chansanam, Chen Chen

第15章

故宫博物院馆藏数据的重构与增益

作者:Yipei Ye

五、章节简介

第1章

人文学科的开放数据应用——来自《开放人文数据期刊》的观察

Open Data Adoption Across the Humanities:Insights from the Journal of Open Humanities Data

数字人文研究规模持续拓展,数据驱动研究方法与开放研究理念已逐步成为领域共识。开放数据与智慧数据是这一转型的核心支撑,与英国、欧盟及全球层面的研究数据开放出版行动方向一致。作为人文学科领域规模最大的跨学科数据期刊,《开放人文数据期刊》(JOHD)过去六年间发展迅速,折射出学界对开放数据的关注度持续上升。期刊内容展现了不同学科的多元实践路径,但开放数据的采纳程度与管理模式仍存在显著差异,也为数字人文社群带来了值得深入探讨的重要问题。

本章通过对JOHD刊载成果中的开放数据实践开展量化分析,探究人文学科各领域采纳、共享与出版开放数据的现状。研究发现,不同学科在数据集类型、规模与生成方式上存在明显的不均衡性,地理分布层面也存在代表性缺口。研究结论明确了领域未来发展的关键方向,对数字人文领域的开放数据建设具有广泛启示:尤其揭示了人工智能与智慧数据应用的不均衡现状,阐明了人工-自动化混合工作流在应对标注复杂度问题上的核心作用,同时指出部分学科与数据类型存在严重的代表性不足。

Digital Humanities (DH) research has steadily expanded, embracing data-driven methods and open research principles. Open and smart data play a key role in this shift, aligning with UK, European, and global efforts to publish research data openly. The Journal of Open Humanities Data (JOHD), the largest interdisciplinary data journal in the humanities, has grown rapidly over the past six years, reflecting a rising interest in open data. Its content reflects the range of approaches across disciplines, though adoption and management of open data still vary widely, raising important questions for the DH communities. This chapter explores how various humanities disciplines adopt, share, and publish open data with a quantitative analysis of open data practices in JOHD publications. Findings show significant disciplinary asymmetries in dataset types, sizes, and generation methods. We also identify gaps in geographical representation. These findings highlight critical areas for future development and have broader implications for open data in DH, particularly by revealing the uneven adoption of AI and smart data, the essential role of hybrid manual-automated workflows in managing annotation complexity, and the significant underrepresentation of certain disciplines and data types.

第2章

智能体人工智能在社科与人文数据发现中的应用

Agentic AI for Data Discovery in the Social Sciences and Humanities

大语言模型的最新进展推动了多智能体系统的发展,使其能够处理愈发复杂的领域专属任务。本章介绍CORDIAL-AI项目——这是一项结合检索增强技术、以API为核心驱动的研究项目,可通过自然语言交互访问高度复杂、粒度精细的英国人口流动普查数据。系统通过分层智能体解析用户意图、检索相关元数据并生成可执行查询,能够适配繁杂的代码表、层级嵌套的地理区划与多维度变量。研究重点关注可解释性、数据来源追溯与元数据整合三大维度。

通过低秩适应(LoRA)进行微调的实验表明,只要配备充足的合成数据与专家标注训练语料,小型开源大语言模型的数据检索表现可接近专有模型水平。初步实证基准测试显示,模型在变量选择、地理实体识别与API调用准确率上均有提升。本章将研究结论置于数字研究基础设施的更广泛方法论讨论中,强调批判性系统设计、严谨的数据治理与以用户为中心的评估,是推动数据密集型研究负责任发展的核心。CORDIAL-AI这类系统降低了复杂数据集的使用门槛,为社会科学与人文领域的研究开辟了新的可能。在注重语境、阐释与透明度的学科领域,此类工具能够帮助研究者提出更具深度的问题,更清晰地追溯研究结论的生成过程。

Recent advances in large language models have enabled the development of multi-agent systems capable of handling increasingly sophisticated and domain-specific tasks. This chapter explores CORDIAL-AI, a retrieval-augmented, API-driven project that provides natural language access to highly complex and granular UK census flow data. Layered agents parse user intent, retrieve relevant metadata, and generate executable queries that navigate extensive code lists, hierarchical and nested geographies, and multi-dimensional variables. Particular attention is given to explainability, provenance, and metadata integration. Fine-tuning via low-rank adaptation demonstrates that small open-source LLMs can approach the data retrieval performance of proprietary models when provided with sufficient synthetic and expert-annotated training corpora. Preliminary empirical benchmarks show improvements in variable selection, geographic recognition, and API-call accuracy. These findings are situated within broader methodological discussions on digital research infrastructures, emphasising the importance of critical system design, rigorous data curation, and user-centred evaluation in advancing responsible practices in data-intensive research. Systems like CORDIAL-AI make it easier to work with complex datasets, lowering technical barriers and opening new possibilities for research across the social sciences and humanities. In fields where context, interpretation, and transparency matter, such tools can help researchers ask more nuanced questions and more clearly trace how findings are produced.

第3章

基于Arches平台的文化遗产资源管理——面向资源清单与概念型叙词表的智慧数据方案

Managing Cultural Heritage Resources with the Arches Platform:Smart Data for Resource Inventories and Concept-based Thesauri

即便依托现代技术,对实物遗存、考古遗址等文化遗产资源进行记录登记依然是一项难题。文化遗产对象与场所的语境化描述复杂度高,遗产资源阐释本身存在固有不确定性,这都对主流数据管理平台的能力提出了挑战。本章阐述 Arches平台(www.archesproject.org)如何通过数据架构、知识表示标准、信息管理工作流与系统集成能力,应对文化遗产信息管理的诸多挑战,为可扩展、高性能的智慧数据系统建设提供支撑。

Arches采用CIDOC-CRM等本体构建文化遗产资源的语义数据模型,通过定义信息类与属性,搭建具备语境化、认知性与预测性的数据结构。平台的数据管理、发现、传播与集成能力,能够为学者与遗产资源管理者提供可信、相关且可直接应用的信息。Arches采用模块化、可扩展的架构设计,本章将重点介绍其在遗产资源清单、叙词表与受控词表等权威数据管理场景下的具体应用。

Documenting cultural heritage (CH) resources such as physical objects and archaeological sites, even with modern technologies, remains a challenge. The complexities of describing CH objects and places in context and the inherent uncertainties that come with interpreting heritage resources stretch the capabilities of most modern data management platforms. This chapter describes how the Arches platform (https://www.w3.org/1999/xlink" xlink:href="https://www.archesproject.org">www.archesproject.org) implements data schema, knowledge representation standards, information management workflows, and systems integration capabilities that meet the challenges of managing CH information and support the creation of scalable and fast smart data systems. Arches implements ontologies, such as the CIDOC-CRM, to create semantic data models of cultural heritage resources. These data models define the information classes and properties needed to structure contextualised, cognitive and predictive data. The platform’s data management, discovery, dissemination, and integration capabilities deliver the trusted, relevant, and consumable information demanded by both scholars and CH resource stewards. Arches is a modular and extensible platform, and this chapter will highlight specific Arches data management applications for heritage inventories and authority data such as thesauri and controlled vocabularies.

第4章

协同网络环境下的智慧数据:建筑与城市空间图像获取

Smart Data in Collaborative Web Environments to Access Architectural and Urban Spaces Images

十五年来,ARQUIGRAFIA项目持续建设智慧数据资源,致力于巴西建筑与城市空间文化遗产的保存与开放获取。项目对实体图像馆藏进行数字化处理,同时开放用户自由上传数字图像,在此基础上搭建了一整套摄影信息表示与检索工具体系。为引导用户细致观察图像、对照片中的建筑与城市空间形成自主判断,ARQUIGRAFIA构建了一套基于造型-空间二元属性的建筑主观阐释内部体系。与此同时,项目还研发了知识组织系统,明确了描述图像的术语定义与术语间关联关系。

项目也持续孵化各类试点项目,例如将音频讲解与地理标记摄影图像相关联的“露天博物馆”项目。目前,项目团队与数字馆藏研究组合作开展人工智能技术实验,测试多种计算机视觉模型对ARQUIGRAFIA馆藏图像的分析效果。这些实验提取了艺术与设计维度的相关数据,挖掘出原始编目体系中未能呈现的馆藏解读层次。

For fifteen years, the ARQUIGRAFIA project has been creating smart data to preserve and enable access to the cultural heritage of Brazilian architecture and urban spaces. This path provided a set of tools for representing and retrieving photographic information, as a result of the digitisation of physical collections of images as well as digital images freely uploaded by users. The ARQUIGRAFIA has thus developed an internal system of subjective interpretations of architectures based on binomials of plastic-spatial qualities in order to encourage users to closely observe images and formulate judgments about buildings and urban spaces represented in photographs. Additionally, a Knowledge Organisation System has been developed, considering the definitions of terms and their interrelationships that describe such images. Synchronously, it has functioned as an incubator for pilot projects such as Open Air Museum, that associates audio messages with georeferenced photographic images. Currently, experiments with AI resources in partnership with the Digital Collections and Research team have tested different Computer Vision models to analyse the set of images available in the ARQUIGRAFIA. These experiments have collected data on art and design, uncovering layers of the collection’s legibility that were not evident in its original cataloguing.

第5章

作为数据基础设施的馆藏资源——德国与澳大利亚的实践视角

Collections as Data Infrastructures;Perspectives from Germany and Australia

参与国家及国际数字基础设施项目的文化遗产机构(图书馆、档案馆、博物馆、高校馆藏与植物标本馆等)有着怎样的实践经验?哪些因素推动或制约了文化遗产机构打通分散的馆藏数据孤岛?不同国家的影响因素存在何种差异?

2020年代初,全球掀起“馆藏即数据”(Collections as Data)基础设施的建设热潮,例如英国的“迈向国家馆藏”计划、欧盟的“欧洲文化遗产共同数据空间”项目,以及澳大利亚研究数据共享平台等。然而,尽管文化遗产机构是数字基础设施的核心数据供给方,目前仍缺乏跨国比较的定性研究来呈现机构的实践视角。厘清这一视角,有助于更深入地理解机构推进馆藏数据框架建设时面临的潜在且关键的挑战。

本章首次就馆藏即数据基础设施建设的国际经验展开对话研究,在英国相关调研结论的基础上,补充德国与澳大利亚两国文化遗产机构的两组焦点小组访谈数据。研究结论涵盖基础设施项目的顶层设计路径、学科文化差异、职业发展体系不足与伦理问题等多个维度。

What are the experiences of cultural heritage organisations (libraries, archives, museums, university collections and herbaria) participating in national and international digital infrastructure projects? Which factors enable and impede cultural heritage organisations in unifying siloed collections? How do these factors differ between countries? The early 2020s were marked by a surge of investments in Collections as Data infrastructures, such as made by the United Kingdom’s Towards a National Collection programme, the European Commissions’ Common European Data Space for Cultural Heritage, or the Australian Research Data Commons. However, despite cultural heritage organisations’ key role as data providers for digital infrastructures there is a lack of qualitative research comparing their perspectives internationally. Ascertaining such a perspective is necessary to better understand the latent and yet potent challenges that are encountered by institutions as they seek to advance collections data frameworks. This chapter takes the first steps in bringing international perspectives on Collections as Data infrastructure developments in conversation. Findings from UK consultations are advanced with data gathered in two focus group discussions held with cultural heritage organisations in Germany and Australia. The findings address issues in the way infrastructure programmes tend to be set up, divergent disciplinary cultures, deficiencies in professional development and ethics.

第6章

泰国社区档案与文化遗产数字化技术

Community Archives in Thailand and Digital Technology for Cultural Heritage

本章梳理了泰国社区档案的发展简史,并提出界定泰国社会档案特征的概念框架。尽管社区档案在泰国的整体存在感较弱,但部分社区档案已成为泰国社会中最具创新性的档案实践形态。作者通过文献研究,梳理了泰国社区档案与文化遗产馆藏建设中技术应用的相关案例,揭示了数字时代泰国社区档案运用数字技术开展档案工作的动因与实践路径。

This chapter presents a short history of community archives in Thailand and a conceptual framework for defining the characteristics of archives in Thai society. Although it seems that community archives are under-represented in Thailand, some community archives are found to be among the most innovative archives in society. The author uses a literature review to explore some Thai case studies on the usage of technologies in the provisioning and analysis of community archives and cultural heritage collections. The findings reveal the motives and methods of Thai community archives to use digital technology for their archival practices in the Digital Age.

第7章

利用非完美AI成果深化佛教典籍研究——以SAT文本数据库为例

Enhancing Buddhist Scripture Research with Imperfect AI Outcomes:A Case Study of the SAT Text Database

本章探讨如何将高精度AI光学字符识别(OCR)技术与国际图像互操作框架(IIIF)相结合,部署以文献为核心的检索增强生成(RAG)系统,借助“存在瑕疵但具备实用价值”的AI输出,切实提升佛教典籍研究效率。

研究以SAT大藏经文本数据库与社群编目平台为基础,将日本国立国会图书馆的AI-OCR技术应用于大型木刻大藏经图像数据集,实现了OCR识别文本与SAT带行号基准文本的逐段对齐。文本到IIIF图像的点击跳转功能,解决了长篇典籍中段落定位的“最后一公里”难题——即便OCR结果仍有残余误差,也可作为高效索引指向原始文献证据。本章公布了不同版本OCR的准确率基准,介绍了逐行渐进修正OCR结果的编辑工作流,并探讨了符合文本编码倡议(TEI)规范的异文记录方案。

此外,研究还推出了“Bauddha AI”RAG服务,可整合通过Apache Solr检索到的领域文献结论,生成带文献来源与链接支撑的内容摘要。作者认为,将存在瑕疵的OCR结果与权威文本对齐、以精选文献约束生成内容,二者结合能够构建可靠、可供学者核验的研究工作流。尽管该方法仍存在覆盖范围有限、多语种扩展不足、大语言模型表现不稳定等局限,但可迁移至其他人文学科领域,降低文献溯源与文献综述的成本。

This chapter examines how “imperfect yet practical” AI outputs can measurably enhance Buddhist scripture research by integrating high-accuracy AI-OCR with IIIF and by deploying a literature-centred RAG system. Building on the SAT Daizōkyō Text Database and a community curation platform, this study applies the National Diet Library’s AI-OCR to large woodblock Tripiṭaka image sets and implements passage-level alignment between OCR text and SAT’s line-numbered main text. Click-through navigation from text to IIIF images closes the “last-mile” gap of locating passages within long volumes, turning OCR – despite residual errors – into an efficient pointer to material evidence. The paper reports accuracy benchmarks across OCR versions, describes an editing pipeline that incrementally corrects OCR at the line level, and discusses TEI-conformant strategies for recording variants. Complementarily, it introduces “Bauddha AI”, a RAG service that synthesises findings from domain papers retrieved via Apache Solr, enabling sourced, link-backed summaries. The author argues that (1) aligning imperfect OCR with trusted texts, and (2) constraining generation with curated literature, jointly produce reliable, scholar-auditable workflows. While limitations remain – coverage, multilingual expansion, evolving LLM behaviour – the approach is portable across humanities domains and lowers the cost of source verification and literature synthesis.

第8章

文化遗产项目开发中的伦理设计考量

Consideration of Ethical Design in the Development of Cultural Heritage Initiatives

本章提出,知识表示、组织与发现系统的设计必须纳入伦理考量,因为这类系统同时兼具技术属性与社会属性。基于其社会技术属性,本章重点探讨这类系统如何体现、支撑与约束价值敏感设计(Value Sensitive Design)的核心价值,包括个人隐私尊重、所有权与财产权、无偏见原则、普遍可用性、信任机制、知情同意与环境可持续性。在人工智能技术飞速发展的当下,要推动这些价值落地,需要通过实证研究与理论建构,全面评估价值敏感设计在弥合社会价值与技术进步分歧方面的潜力。

In this chapter it is argued that ethical considerations in the design of knowledge representation, organisation, and discovery systems are essential, as these systems encompass both technical and social dimensions. Given their socio-technical nature, the focus of the discussion is an examination of how these systems embody, support, and constrain core values central to Value Sensitive Design, including respect for individual privacy, ownership and property rights, freedom from bias, universal usability, trust, informed consent, and environmental sustainability. To promote these values in this era of rapidly advancing AI, empirical inquiry and theoretical development are needed for thorough assessment of the potential of Value Sensitive Design to mediate potential divergences between social values and technological progress.

第9章

从故纸遗存到活态内核——人工智能时代文献遗产的智能化发展研究

From Dusty Pages to Living Essence:A Study on the Intelligent Development of Documentary Heritage in the Era of AI

本章探讨人工智能时代文献遗产的智能化转型路径,阐释其在保存与活化集体文化记忆中的核心作用。研究以文化计算与语义技术相关理论为基础,构建了包含模式、能力、资源三个维度的三维发展模型。该模型强调文化基因提取、知识逻辑组织与情境化用户服务三大核心。

本章借助大语言模型等前沿工具,回应遗产获取、语义理解与公众参与层面的核心挑战。研究以入选《世界记忆名录》的苏州丝绸档案为案例,展示了如何对历史文献进行语义结构化处理、嵌入动态知识网络,并通过智能化服务面向多元受众传递价值。研究表明,人工智能能够弥合认知鸿沟、提升阐释能力,推动文献遗产的可持续发展与创造性转化。本章最终提出,未来的文化记忆不应仅停留在保存层面,更应借助数字智能实现主动活化,让人们能够与历史建立更深入、更具价值的联结。

This chapter explores the intelligent transformation of documentary heritage in the era of artificial intelligence, highlighting its role in preserving and revitalising collective cultural memory. Drawing on theories of cultural computing and semantic technologies, it constructs a three-dimensional development model comprising the model, capability, and resource dimensions. The model emphasises the extraction of cultural genes, logical organisation of knowledge, and contextualised user services. Through advanced tools such as LLMs (Large Language Models), the chapter addresses key challenges in heritage access, semantic understanding, and public engagement. Using the Suzhou Silk Archives in the Memory of the World as a case study, it demonstrates how historical documents can be semantically structured, embedded in dynamic knowledge networks, and delivered through intelligent services to diverse audiences. The study illustrates the potential of AI (Artificial Intelligence) to bridge cognitive gaps, enhance interpretability, and promote the sustainable development and creative transformation of documentary heritage. Ultimately, this chapter advocates for a future in which cultural memory is not merely preserved but actively revitalised through digital intelligence, enabling deeper, more meaningful engagement with the past.

第10章

面向中国古琴减字谱释读的知识增强多模态大语言模型

A Knowledge-enhanced Multi-modal Large Language Model for Chinese Guqin Subtractive Notation Interpretation

古琴是中国最古老的传统乐器之一,音色雅致、文化象征意蕴深厚,是典型的多模态文化记忆资源。多模态大语言模型的发展,为多模态文化记忆资源的知识服务提供了新的解决方案。然而,对于古琴减字谱相关的文本、图像、音视频等特殊文化记忆资源,现有多模态大语言模型的知识表示能力仍需优化,才能达到预期效果。

本研究以多模态古琴减字谱资源为训练数据,结合古琴减字谱知识图谱,探索多模态大语言模型在文化遗产领域的垂直应用路径。研究的最终目标是借助生成式人工智能技术,通过知识增强的多模态大语言模型,帮助更多人理解古琴减字谱。本研究搭建的释读应用场景表明,大语言模型在解决判别类问题时表现优异;但在自然语言交互的生成类问题中,结合知识图谱技术与人类专家构建的形式化知识,能够显著提升大语言模型在垂直任务中的准确率、可靠性与专业性。

Guqin is one of the oldest traditional Chinese musical instruments, known for its refined sound and deep cultural symbolism as a typical multimodal cultural memory resource. The development of multimodal large language models (MLLMs) provides new solutions for the knowledge service of multimodal cultural memory resources. However, for the knowledge representation of some special cultural memory resources such as text, images, audio, and video resources related to the Guqin Subtractive Notation, the existing MLLMs need further optimisation to achieve the expected results. This study uses multi-modal Guqin Subtractive Notation resources as training data, and combines them with the Knowledge Graph of Guqin Subtractive Notation to explore a vertical application path of MLLMs in the field of cultural heritage. The ultimate goal of this study is to use the knowledge-enhanced MLLMs to help more people understand the Guqin Subtractive Notation with the help of Generative AI technologies. The practical construction of the interpretation application scenario in this study demonstrates that LLMs perform better in solving discriminative problems, but in addressing generative issues in natural language interaction, combining Knowledge Graph technology and the formalised knowledge generated by human experts can significantly enhance the accuracy, reliability, and professionalism of LLMs in vertical tasks.

第11章

基于大语言模型的非物质文化遗产文本自动词性标注

Automatic Part-of-Speech Tagging of Intangible Cultural Heritage based on Large Language Models

大语言模型引发了自然语言处理领域的技术变革,也推动了各垂直领域应用的发展。本研究探索将大语言模型应用于非物质文化遗产领域的自动文本标注——该领域拥有专业词汇体系与独特文化语境。

研究分为三个阶段:第一,从中国非物质文化遗产官方网站采集非遗文本数据,通过人机协作方式构建高质量标注数据集;第二,针对非遗文本设计零样本、单样本、少样本等不同提示格式的微调数据;第三,采用低秩适应(LoRA)与全参数微调两种方式,测试Qwen与GLM模型在不同训练数据量下的表现。与低秩适应相比,全参数微调对提示一致性的要求更高,鲁棒性更弱。研究结论为优化大语言模型的精准文本标注能力提供了参考,对非物质文化遗产及其他专业领域均具有借鉴意义。本研究凸显了微调策略、数据准备与指令结构设计对提升模型表现的重要价值。

Large language models (LLMs) have revolutionised natural language processing, enabling advancements in domain-specific applications. This study explores the use of LLMs for automatic lexical annotation in intangible cultural heritage (ICH), a field with specialised vocabulary and cultural context. The research follows three phases: (1) Collecting ICH data from China’s official Intangible Cultural Heritage website and creating a robust annotation dataset through human-machine collaboration. (2) Developing fine-tuning data with various prompting formats (0-shot, 1-shot, 3-shot) for ICH texts. (3) Evaluating Qwen and GLM models using LoRA and full-parameter fine-tuning to assess performance across training data volumes. Compared to LoRA, full parameter fine-tuning has higher requirements for prompt consistency and poorer robustness. These results provide insights into optimising LLMs for precise lexical annotation, with implications for ICH and other specialised fields. The study highlights the importance of fine-tuning strategies, data preparation, and instruction structuring in enhancing model performance.

第12章

数字化再现与活化——面向中国青铜器图像智能生成的扩散模型微调研究

Digital Recreation and Revitalisation:Fine-tuning Diffusion Models for the Intelligent Generation of Chinese Bronze Vessel Images

生成式人工智能技术为文化遗产的保护、修复与传播带来了新机遇。本章以中国青铜器为研究案例,探究生成式人工智能在图像智能生成领域的变革潜力,及其在文化遗产领域的创新应用路径。

研究构建了中国青铜器领域本体,实现青铜器图像的多维度语义表示;提出一种大语言模型辅助的人机协同语义标注方法,提升语义标注效率。在此基础上,研究利用低秩适应算法对Stable Diffusion模型进行微调,实现了高质量、风格统一的中国青铜器图像生成。微调后的模型在生成内容的视觉质量与图文匹配度上均有显著提升,为文物保护、修复与文化传播提供了新的工具与技术路径。最后,本章探讨了人工智能驱动图像智能计算的底层逻辑与实现路径,阐明其在推动文化遗产数字化再现与活化中的作用。生成式人工智能不仅深化了对文化文物的语义理解与计算分析,也推动了文化遗产智慧数据资源的建设,进而促进文化遗产的创新复用与活化发展。

Generative AI technologies bring new opportunities for the preservation, restoration, and dissemination of cultural heritage. Focusing on Chinese bronze vessels as a case study, this chapter investigates the transformative potential of generative AI in intelligent image generation and its innovative application within cultural heritage domain. A domain ontology for Chinese bronze vessels is constructed to enable muti-dimensional semantic representation of bronze vessel images. A human-AI collaborative semantic annotation method, enhanced by large language models, is proposed to improve the efficiency of semantic annotation. Furthermore, by leveraging the LoRA algorithm to fine-tune the Stable Diffusion model, this study achieves high-quality and style-consistent image generation of Chinese bronze vessels. The fine-tuned model significantly enhances both the visual quality and text-image alignment of generated content, offering new tools and technical pathways for artifact preservation, restoration, and cultural communication. Finally, this chapter discussed the underlying logic and implementation pathways of AI-driven intelligent image computing, and highlighting their role in facilitating the digital recreation and revitalisation of cultural heritage. Generative AI not only strengthens the semantic understanding and computational analysis of cultural artifacts, but also facilitates the development of smart data resources for cultural heritage, thereby advancing the innovative reuse and revitalisation of cultural heritage.

第13章

中国古代科技文献数据库建设与知识挖掘

Database Construction and Knowledge Mining of Ancient Chinese Scientific and Technological Documents

为保存中国古代科技文献、盘活历史资源、支撑中国科技史研究,本章建设并研究了中国古代科技文献数据库(ACSTDD)。数据库收录了1912年以前(不含1912年)天文、地理、农业、水利、数学、物理、化学、生物、医药等多个科技领域的古代文献,提供分类浏览、组合检索等功能,同时配备辅助学术研究的相关工具。

基于该数据库,本章开展古代科技文献书目提要的知识挖掘实践,以清代蚕桑、棉花类农书为例,实现了作者、内容、地理分布等维度的知识重组与可视化呈现。本章弥补了中国古代科技文献组织程度不足的研究空白。通过数据库对分散的历史资源进行系统化整理,突破了古代科技文献碎片化分布导致无法开展大规模比较研究的局限,为科技史跨学科研究开辟了新路径。

To preserve ancient Chinese scientific and technological documents, utilise historical resources, and support research in the history of Chinese science and technology, this chapter constructs and studies the Ancient Chinese Scientific and Technological Documents Database (ACSTDD). The database contains ancient documents from various scientific and technological fields, including astronomy, geography, agriculture, hydraulics, mathematics, physics, chemistry, biology, and medicine before 1912 ce (excluding 1912 ce). It provides features, such as classification browsing and combination search. The system also provides tools to assist academic research. Based on ACSTDD, this chapter carries out the knowledge mining practice of bibliographic summaries of ancient scientific and technological documents. This chapter uses sericulture, cotton, and mulberry agricultural documents in the Qing dynasty as examples to achieve knowledge reorganisation and visual presentation related to authors, content, and geographical distribution. This chapter fills the gap and addresses the issue of the insufficient organisation of ancient Chinese scientific and technological documents. The systematic organisation of these scattered historical resources through ACSTDD enables large-scale comparative studies that were previously impossible due to the fragmented nature of ancient Chinese scientific and technological documents, opening new avenues for interdisciplinary research in the history of science and technology.

第14章

智慧元数据视角下价值增值驱动的北京传统村落本体建模

Value Addition-driven Ontology Modelling of Beijing Traditional Villages from the Perspective of Smart Metadata

传统村落蕴含古建筑、民俗等丰富的乡村文化资源,凭借其历史、文化与艺术价值备受学界与社会关注。本章阐释智慧元数据的核心内涵,提出价值增值驱动的北京传统村落本体建模方案。从智慧元数据视角出发,对传统村落的海量历史文化资源进行系统化组织,能够推动“数据—信息—知识—智慧”的层级转化,实现文化的代际传承与价值提升。

本章从官方平台“中国传统村落数字博物馆”采集北京市国家级传统村落的相关数据,从多格式资源中提取事件、民俗、故事、文化发展、历史沿革等知识实体粒度的信息。所构建的本体定义了村落信息、文化遗产、社会关系、历史发展、地理空间五大核心类,用于规范描述村落相关维度的内容。在智慧元数据的理论指引下,通过打通传统村落各类资源的关联链路,清晰呈现村落文化资源间的内在互动关系。本章研究为传统村落文化知识发现与文化的历时性传承提供了参考思路。

Traditional villages are rich in rural culture resources, such as ancient architecture and folklore, and have attracted attention due to their historical, cultural and artistic value. This chapter explains smart metadata and proposes value addition driven ontology modelling for traditional villages in Beijing. From the perspective of smart metadata, organising the abundant historical and cultural resources in a traditional village facilitates the transformation of “data-information-knowledge-wisdom”, enabling intergenerational cultural inheritance and value enhancement. This chapter collects data on national-level traditional villages in Beijing from the official website named “Traditional Chinese Village Digital Museum”. Events, folklore, story, cultural development, history, and other information at knowledge entity granularity will be extracted from the collected resources in various formats. The proposed ontology in this chapter defines core classes to describe village information, culture heritage, social relation, historical development, and geography. With the guidance of smart metadata and the interconnections of traditional village resources, interactive relationships between village cultural resources are expressed. This chapter offers insights for the discovery of traditional village cultural knowledge and cultural inheritance over time.

第15章

故宫博物院馆藏数据的重构与增益

Reconstruction and Enhancement of the Palace Museum's Collection Data

本文以故宫博物院为研究案例,回应数字时代博物馆面临的信息管理挑战。研究在CIDOC CRM框架下,构建了适配中国古代文物的专属本体模型——中国古代文物概念参考模型。通过编制受控词表、引入知识图谱技术,将馆藏编目数据重构为标准化、结构化的知识图谱。

这一转型优化了故宫博物院馆藏线上平台的检索服务,提升了检索效率与双语检索能力。此外,结构化数据可与大语言模型深度融合,提升机器理解、逻辑推理与内容生成效果。故宫博物院的实践实现了博物馆知识的创新组织与馆藏数据的价值挖掘,将传统编目数据转化为可计算的三元组结构,适配人工智能时代的数据处理需求。本研究不仅提升了故宫博物院的信息管理效率,也为其他文化遗产机构提供了可借鉴的实践经验。

This paper, taking the Palace Museum as a case, addresses museums’ information-management challenges in the digital age. It explores the development of an ontology model, Ancient Chinese Artifacts Conceptual Reference Model, tailored for ancient Chinese artifacts within the CIDOC CRM framework. Controlled vocabularies are compiled, and knowledge graph technology is introduced to restructure collection cataloguing data into a standardised and structured graph. This transformation enables enhanced search services on the Palace Museum’s collection online platform, including improved retrieval and bilingual search capabilities. Moreover, it facilitates the integration with large language models for better computer understanding, logical reasoning, and content generation. The Palace Museum’s practice innovatively organises museum knowledge and extracts value from collection data, converting traditional cataloguing data into a computable triple structure, thus meeting the AI-era’s data-processing demands. This research not only boosts the Palace Museum’s information-management efficiency but also provides valuable insights for other cultural heritage institutions.

六、学者评价

武汉大学副校长陆伟在本书的新书发布会视频致辞中向伦敦国王学院给予本次发布会的支持表示感谢。他表示,该书的出版是武汉大学信息管理学院和文化遗产智能计算实验室在国际数字人文领域研究的重要成果。未来,武汉大学将持续推进跨学科创新与国际学术合作,为全球文化遗产的数智化转型与人类文明的可持续发展贡献出中国智慧与力量。

Graham Wynn在致辞中表示,KCL高度重视国际学术交流,此次新书发布会是两校深化合作的重要契机,期待未来双方在教学、科研和人才培养上持续拓展合作空间。

Carolyn Kirby表示,该丛书的持续出版彰显了数字人文领域的蓬勃活力,泰勒-弗朗西斯(Taylor & Francis)出版集团将继续支持这一开放学术成果的发表,推动全球范围内的知识共享与学术对话。

信息管理学院院长、文化遗产智能计算实验室主任、丛书主编王晓光教授表示,人工智能技术的快速演进正在深刻重塑数字人文的研究范式与方法路径。文化遗产智能计算实验室紧抓学术前沿机遇,组织编写并出版此书,汇聚四大洲40位学者的学术贡献,标志着实验室在国际学术协作网络建设上的进一步发展。未来实验室将继续深化跨国、跨学科的合作机制,推动丛书向着更具前瞻性和包容性的方向发展,为数智赋能文化发展提供中国方案。

以上内容来自书籍官网

https://www.taylorfrancis.com/books/oa-edit/10.4324/9781003666530/ai-smart-data-cultural-heritage-xiaoguang-wang-marcia-lei-zeng-jin-gao-ke-zhao

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编辑丨洪冰凤

校对丨罗斯鹏

排版丨魏翔

阅读原文

跳转微信打开

  •  

学术前沿 | 《迈向数智时代的中国数字人文自主知识体系建设》

王晓光 2026-06-26 08:30 湖北

《图书与情报》2026年第3期荐读

导语

今年正值习近平总书记“5·17”重要讲话发表十周年,《图书与情报》于2026年第3期策划了“构建中国信息资源管理学科自主知识体系”专题,邀请多位专家学者探讨学科自主知识体系构建过程中的若干关键问题,特别对相关二级学科方向的独特角色和作用及构建中国信息资源管理学科自主知识体系的学科建设、方法创新、实践探索等进行了深度解读。

今天推送武汉大学信息管理学院王晓光教授在该专题刊发的《迈向数智时代的中国数字人文自主知识体系建设》笔谈文章。

1 价值意蕴

在百年之未有大变局的时代背景下,构建具有主体性与原创性的中国哲学社会科学自主知识体系已经成为各学科发展不可回避的时代命题。伴随着人工智能的蓬勃发展,作为多学科交叉的新兴研究领域,数字人文愈加受到学界关注,但从现实进路来看,目前的数字人文研究在基础理论、知识结构与话语体系上,仍面临众多挑战和困惑。在文化强国战略下,如何借助数字人文专业和学科建设,进一步促进文化建设数智化赋能和信息化转型,值得学界认真思考。

(1)数字人文自主知识体系是文化强国建设的重要任务。2016年,习近平总书记在哲学社会科学座谈会上提出“不断推进学科体系、学术体系、话语体系建设和创新,努力构建一个全方位、全领域、全要素的哲学社会科学体系”,2022年进一步指出 “加快构建中国特色哲学社会科学,归根结底是构建中国自主的知识体系”。中国自主知识体系建设已经上升为国家战略,是新时代文化自信与文化强国建设的重要任务。中国的数字人文自主知识体系建设不单要回应数字人文作为一个交叉性学科的规范化发展需求,更要回答人工智能时代科技与人文融合发展的中国实践方向与路径在哪里的问题。自主知识体系建设必须突破对西方既有理论的路径依赖和单一性学科的执念,形成能够回应中国实践、解释中国经验、提出中国方案并具有国际对话能力的学术表达。

(2)数字人文自主知识体系是文化建设数智化转型的重要支撑。数字人文一直以文化资源与人文知识的数字化生产为核心议题。数智技术迅猛发展、快速迭代,推动社会整体由数字化向数据化、智能化跃进。国家“十五五”规划纲要提出“推动文化建设数智化赋能、信息化转型,发展新型文化业态”。文化和科技的深度融合已成为文化事业与文化产业发展的重要引擎,对数字人文领域的期待不仅是工具层面的更新要求,更是体系层面的重构命题。以多学科融合的理论、方法与技术构建数字人文研究探索的知识体系,解决文化资源数智化创新中的问题,解析人文社会数字化转型中的内在机理与治理逻辑已经成为数字人文领域不可回避的历史责任与时代命题。

(3)数字人文自主知识体系是推动信息资源管理学科高质量发展的重要抓手。党的十九届五中全会提出了“建设高质量教育体系”的战略导向。随后教育部新文科建设工作组发布《新文科建设宣言》,要求发扬科学精神,在充分发掘社会科学与自然科学、人文科学内部各学科间内在逻辑关联的基础上,打破传统学科间的壁垒,实现知识体系的联结渗透,以此引领顶层设计、专业设置与人才培养模式创新发展。在此背景下,信息资源管理学科在守正的基础上创新二级学科发展,推进学科生态体系与边界重塑,凝聚合力促进学科高质量发展。数字人文作为一个新兴交叉研究领域,方兴未艾,其研究问题要求融合信息资源管理与文史哲等多学科的理论、方法与技术,这对于创新和发展信息资源管理学科自主知识体系,并拓展其应用交叉空间具有重要意义。

2 目标原则

中国数字人文自主知识体系建设应当体现中国特色,解决数智时代文化创新发展的现实问题,满足学科内涵式发展的时代需求。在数智技术引发知识生产方式深刻变革的背景下,中国数字人文自主知识体系构建需要以继承性、民族性、系统性、原创性与时代性为基本原则,确立学科主体性、话语显示度与现实解释力。

(1)厚植中华优秀传统文化根脉的自主性构建。从建构主义视角,知识生成具有情境与文化嵌入性。任何知识体系都不是脱离具体历史语境而存在的抽象产物,而是在特定社会实践、制度环境与文化传统中不断建构和重塑的。数字人文作为“舶来品”,虽然其理论框架与研究范式受到西方知识传统的影响,但其进入中国后,与中华优秀传统文化深度结合,产生了重要的化学反应。特别是近年来,在习近平文化思想指引下,面对中华优秀传统文化创造性转化与创新性发展的时代任务,中国数字人文学界自觉将古籍、文物、遗址等文化遗产研究与现代数智技术相结合,在图情、文学、历史、考古、哲学等众多学科领域,提出了许多主题、内容和形式都十分新颖的数字人文研究项目,在历史场景虚拟复原、传统文化基因挖掘、标识性符号提炼、智慧数据资源建设和智能化阐释等方面取得了一系列重要的原创性学术成果,不仅为建设历史文化大数据和全景展示中华优秀传统文化提供了重要支撑,也形成了文化遗产数智活化的中国示范性方案。

(2)依托信息资源管理学科的协同性构建。自1949年罗伯托·布萨(Roberto Busa)借助计算机成功为1100多万拉丁文作品编制索引开始,数字人文研究就与图情行业实践和信息资源管理学科研究密切关联。从全球的数字人文研究项目实践来看,数字人文研究大概可以分为三类:一类是人文类数据资源建设和数字工具开发,这类研究可以称得上是面向人文领域的数智基础设施建设研究;一类是面向传统人文问题的新技术、新方法,特别是数智建模类研究,这类研究可以称为人文建模型探索研究;还有一类主要是面向由新兴数字技术带来的新型人文现象和问题的研究,包括数字劳工、数字交往、人工智能伦理、AI价值观对齐等主题,这类研究可以说是人文进路的数字现象研究。这三类研究的同步推进,意味着数字人文研究并不是一个独立的学科,而是一个多学科交叉的领地,这一点在早期的数字人文先驱学者中就有一定共识。所以,数字人文自主知识体系建设必须关注交叉性和协同性,发挥多学科力量。特别是在人工智能大发展和广泛应用的今天,信息资源管理学科因其对信息技术的天然亲近性和对信息资源利用的先天优势,应该扮演比以往更加重要的角色,以其独特的信息实践优势和数智能力,成为数字人文研究的重要力量。

(3)跨越多层次堆栈结构的系统性构建。发展数字人文不是在人文研究中进行简单的技术植入和工具应用。数字人文知识体系的建设离不开多维度多层次的变革。在数字人文堆栈结构中,计算机学科提供了计算思维和知识表示技术的创新,图情学科提供了文献资源数字化转化的理论与方法,以及数据挖掘、知识建模和文本计量的数字研究方法,历史、文学、艺术、哲学等学科则提供了观察问题的视角和范式创新场景。技术方法在人文问题中的深入应用,还离不开数字学术基础设施的建设,方法库与数据集的扩展,以及新兴学术平台,如文科实验室、专业学术期刊、专业学术会议的建设与运营,它们共同构成了数字人文蓬勃发展所必须的学术社群和学术生态。在这些新兴学术基础设施上,深入挖掘学术问题,凝练学术概念,进一步明确数字人文的核心研究议题,是数字人文知识体系建设的关键。近些年来,在数字人文的体系性发展过程中,一批数字人文实验室和研究中心陆续建成,为我国数字人文研究的可持续发展夯实了平台基础。一批关键研究主题,如数字记忆、数字叙事、文化遗产活化等也逐渐得到学界认可。

(4)面向全球视野与标识性概念的原创性构建。概念是人类的思维形式与认识成果,界定人对经验世界的理解,按照体系化逻辑联结的诸多概念构成了本学科描述领域现象、问题、任务和活动的话语体系。标识性概念的意义在于凝练、鲜明地表达了学科的核心议题与研究范畴,是自主知识体系“活的灵魂”,具有学科专门性与独特性。以往的数字人文研究中术语创新并不丰富,这主要源于数字人文的实践性强于理论性,在某些方面还没有提出具有解释力的标识性概念。面对人工智能带来的巨大变革,数字人文急需提出标识性概念,并在重大社会文化现象与现实问题上提供解决方案和理论框架,方能在哲学社会科学数智化变革中树立标志性旗帜、确立学术地位,并在势不可挡的社会数智化转型浪潮中彰显其学术价值。

面向数智化和全球化交织的新情境,中国的数字人文自主知识体系建设,必须在关注主体性的同时,积极开展全球对话,在人文领域高质量数据集建设、AI驱动的文化遗产保护与活化、文化遗产可信数据空间建设、数字文化体验设计与传播等全球性新兴议题上,提出全球公认的原创性概念和解决方案。为此,中国学界需要在吸纳、借鉴与创新之间找到平衡点,从新问题、新实践出发,提炼规律性理论,形成兼具学理深度与学科辨识度的原创性概念,以此为突破口,完成数字人文知识体系全球引领性建设。

3 行动路径

中国数字人文自主知识体系建设离不开学科体系、学术体系与话语体系三者的协同发展。三大体系是自主知识体系的功能外化,通过持续实践、协同互动成为构建自主知识体系的内生动力,也是衡量学科成熟度的重要尺度。

(1)以学科体系建设为锚点。作为一个交叉学科,数字人文与多个人文学科都关系密切。目前,数字人文的学科化建制取得了一定进展。从学术源头来看,数字人文相关研究与信息资源管理学科有着天然联系,大量的数字人文项目都与文献资源数字化和数字平台建设有关。但其作为典型的交叉研究领域,数字人文知识体系建设与整合工作存在多学科间的内在张力,随着传统人文学科对计算机技术的深度采用和融合,数字人文的学科定位存在一定不确定性。目前,在信息资源管理一级学科下建设数字人文二级学科的现实选择具有合理性,这与当代数字人文研究项目关注人文与文化领域的数智基础设施建设现实状况相符,同时也与数字文化产业蓬勃发展的趋势相符。数字人文学科建设不能只满足学科建设内在需要,更应该响应社会发展现实需求。数字人文应在数字文化产业发展中发挥其学术引领价值和理论指导作用,通过“科技+文化”的融合性和探索性研究推动数字文化产业创新发展。目前,数字人文作为一个二级学科,已经进入社科基金目录体系,其学科建制化发展不仅能正向发挥信息资源管理学科的辐射价值,也能反向促进信息资源管理学科在新时代哲学社会科学中的战略支撑作用。

数字人文学科建设应支撑新文科专业发展。信息资源管理相关的专业是典型的新文科专业。以武汉大学信息管理学院的数字文化本硕博贯通制实验班为例。该专业是响应国家文化数字化战略、勇担文化强国使命的表现,也是新文科建设的典型实践。数字人文的学科化建制,有利于推动文化和科技的深度融合,培养兼具人文素养、数据思维与数智能力的拔尖创新型复合人才,形成文化建设数智化赋能、信息化转型的生力军。

(2)以学术体系建设为保障。数字人文研究的实践性与应用性特征明显。发展数字人文离不开学术生态的系统化建设,包括学术期刊、学术论坛、专业协会和委员会、专业实验室、学术联盟、研究中心等学术平台的建设。数字人文作为一个跨学科研究领域,其学术体系的建设可以在各个相关学科内同步推进。目前,在中国多个一级学会中都已经成立了数字人文专业委员会,如中国索引学会下设的数字人文专业委员会、中国科学技术史学会下设的数字人文专业委员会。此外,多个数字人文研究联盟也已经成立,如数字人文机构联盟、数字人文专业发展联盟等。数字人文类实验室也在蓬勃发展,如武汉大学文化遗产智能计算实验室、中国人民大学数字人文研究院、北京大学数字人文研究中心等。在专业期刊建设上,国内也已经成立了《数字人文》和《数字人文研究》两本专业期刊。这些新兴的数字人文学术平台为中国数字人文研究事业的创新性发展奠定了坚实的学术平台基础,也为其可持续发展提供了巨大空间。

(3)以话语体系建设为关键。话语体系的核心是概念与术语体系。作为新兴交叉领域,数字人文的知识体系中借鉴和交织使用了来自多个传统学科的概念与术语,自有的概念与术语还不丰富,这就意味着数字人文知识体系,特别是基础理论还不够丰富和成熟。因此,未来的数字人文研究在借鉴、吸收相关学科必要概念的同时,应围绕数字人文实践活动,提出具有原创性和标识性的独特概念,并努力构建具有连续性、解释力和影响力的理论和话语体系。在话语体系构建过程中,应着重注意话语的时代性和专业性,突出创新性特征。要统筹把握中国数字人文自主知识体系建设的历史逻辑、民族特征与时代语境,在继承的基础上,努力围绕信息哲学、智能计算、文化数据、数字批判、沉浸式体验等当代数字人文研究的关键议题和新兴方法,提炼学术概念和理论命题,形成经得起历史检验的理论体系。

*参考文献略,详见原文。

*本文原载于《图书与情报》2026年第3期13-16页,作者:王晓光,转载自“图书与情报”微信公众号,已获转载授权。

阅读原文

跳转微信打开

  •  

学术前沿丨《计算文化遗产期刊 (JOCCH)》论文荐读

2026-06-20 13:35 湖北

《计算文化遗产期刊》(ACM Journal on Computing and Cultural Heritage, JOCCH)是由美国计算机协会(ACM)于2008年创办的季刊,为计算技术与文化遗产交叉领域的国际权威专业期刊,被SCIE、Scopus等主流学术数据库收录,2025年影响因子约3.1,位列JCR计算机科学跨学科应用分类Q3区;期刊聚焦数字人文、遗产三维数字化、AI文博应用等方向,实行严格的同行评议,年发文量仅约30篇,在该细分交叉领域具备较高的学术认可度。本期内容将选取JOCCH中的10篇论文进行介绍。

1.《嫦娥:中国古典敦煌舞蹈高质量动作捕捉数据集》

Chang-E:A High-Quality Motion Capture Dataset of Chinese Classical Dunhuang Dance

Zeyu Wang, Chengan He, Zhe Yan, Jiashun Wang, Yingke Wang, Junhua Liu, Angela Shen, Mengying Zeng, Holly Rushmeier, Huazhe Xu, Borou Yu, Chenchen Lu, Eugene Y. Wang

摘要:敦煌舞蹈源自列入联合国教科文组织《世界遗产名录》的莫高窟壁画,具有独特的文化价值,但目前面临数字化与保护的现实难题。本文介绍了全球首个面向敦煌舞蹈的开源综合动作捕捉(motion capture)数据集“嫦娥(Chang-E)”,该数据集涵盖8大类全身动作数据,总计收录40分钟的专业舞蹈内容(预览可访问:https://cislab.hkust-gz.edu.cn/projects/chang-e/)。

数据集包含三种数据格式:通过动作捕捉获取的骨骼数据、基于骨骼数据用机器学习生成的人体网格数据,以及现场录制的多视角视频。该数据集可支撑敦煌舞蹈文化的各类创意应用,一场沉浸式新媒体展览已验证了其实际应用价值。在数据集构建过程中,团队采用动作插补(motion inbetweening)算法拼接不同舞蹈片段以完成编舞,再通过时序重排技术将重新演绎的舞蹈序列与音乐同步,增强了歌舞表演的韵律感与协调性。此外,团队还为数字舞者的重构动作序列添加了视觉特效,呈现出契合佛教禅修与身体认知理念的艺术化视觉效果。

嫦娥数据集为敦煌舞蹈的数字保护与创意重构提供了基础支撑,不仅输出了高质量数据,也为未来的图形学与文化遗产研究提供了跨学科协作框架。

Abstract:Derived from the mural drawings in the UNESCO-listed Mogao Caves, Dunhuang dance has unique cultural value but faces challenges of digitization and preservation. In this article, we introduce the first open comprehensive motion capture dataset of Dunhuang dance, Chang-E, including full-body movements documented across 8 categories, totaling 40 minutes of professional dance (preview available at https://cislab.hkust-gz.edu.cn/projects/chang-e/). This dataset contains three formats: skeleton data acquired from motion capture, body mesh generated from skeleton using machine learning, and multiview videos recorded on site. The dataset supports various creative applications for Dunhuang dance culture, as demonstrated by an immersive new media exhibition. Through the curation process, we applied motion inbetweening algorithms to concatenate different dance sequences for choreography. Also, these reinterpreted dance sequences are synchronized with music using retiming techniques, augmenting the rhythms and harmony between the music and dance performance. Furthermore, we applied visual effects on the regenerated motion sequences of digital dancers, achieving artistic and appealing visual results echoing Buddhist discourses of meditation and bodily cognition. The Chang-E dataset enables digital preservation and creative reimagination of Dunhuang dance, offering not only high-quality data but also an interdisciplinary collaboration framework for future graphics and cultural heritage research.

图:中国古典敦煌舞蹈(嫦娥)数据集的生成流程与应用场景。我们采用动作捕捉技术录制舞蹈演员的敦煌舞蹈表演,将三维动作数据适配为蒙皮多人线性模型(Skinned Multi-Person Linear, SMPL)格式,并基于该数据集进一步完成舞蹈再创作与视觉特效制作。壁画图像取自敦煌莫高窟第112窟。舞剧图像出自《丝路花雨》。

Fig.The generation process of the CHinese classical DunhuANG dancE (Chang-E) dataset and its applications. We captured dance artists performing Dunhuang dance using motion capture technology, fitted the 3D motion data into Skinned Multi-Person Linear (SMPL) format, and further created reinterpretations and visual effects based on the dataset. The mural image is from Mogao Cave 112 in Dunhuang. The stage drama image is from Silk Road, Flower, and Rain.

2.《DeepHadad:利用合成数据提升受损铭文可读性》

DeepHadad:Enhancing Readability of Damaged Inscriptions with Synthetic Data

Andrei C. Aioanei, Jonathan Klein, Konstantin M. Klein, Regine R. Hunziker-Rodewald, Dominik L. Michels

摘要:历经数百年自然侵蚀,古代铭文已出现不可逆的重要文字信息流失,严重阻碍碑铭学研究,也造成了历史知识的大量空白。字母磨损、物理损毁等因素,往往会大幅降低铭文的可读性。

本文提出DeepHadad神经网络模型,该模型基于程序化生成的合成数据训练,通过位移图(displacement maps,DM)与图像到图像翻译(image-to-image translation)技术,对受损严重的古代铭文进行数字修复,提升其可读性。该模型得名于公元前8世纪中期哈达德(Hadad)雕像上著名的帕纳穆瓦一世铭文——这座受损玄武岩雕像上,部分位置仅残留极淡的文字痕迹。

本研究的核心难点在于缺少保存完好与受损状态的字形配对训练数据:每一个字形实例都具有唯一性,不存在不同侵蚀程度的对应样本。对此,团队通过模拟侵蚀过程生成合成训练数据,使神经网络能够成功泛化至真实数据场景。通过提取补全图并叠加至三维模型上,我们显著提升了哈达德雕像上几乎无法辨认的亚拉姆语铭文的清晰度。

定量与定性实验均证实,该方法能够复原那些原本会永久遗失、或仅能通过耗时漫长的人工工作修复的文字内容。本研究为前沿人工智能技术应用于古代文字遗产可读性提升开辟了全新路径,所提出的方法可助力重要铭文的全面研究,也彰显了人工智能辅助技术在古代文物修复与碑铭学领域的应用潜力。

Abstract:The deterioration of ancient inscriptions over centuries has resulted in irrevocable loss of vital written records, hampering epigraphic analysis, and creating significant gaps in historical knowledge. Factors such as eroded letters and physical damage often compromise the readability of these inscriptions. We present DeepHadad, a neural network trained on procedurally generated synthetic data that use displacement maps and image-to-image translation to digitally restore severely damaged ancient inscriptions to a more readable state. The network’s name is derived from the famous Panamuwa (I) inscription on the mid-8th century BCE Hadad statue, where, at certain places, only faint traces of letters remain on the damaged basalt statue. A key challenge in this work is the lack of well-preserved and damaged glyph pairs for training, as each glyph instance is unique and therefore not found in different states of erosion. We address this by generating synthetic training data through simulated erosion processes, enabling our neural network to successfully generalize to real data. By extracting and overlaying completion maps onto the 3D model, we significantly enhance the legibility of the barely recognizable Aramaic inscription on the Hadad statue. Quantitative and qualitative experiments confirm that our approach can recover textual content that would otherwise be lost or recoverable only through time-consuming manual work. This research opens a pioneering avenue for employing state-of-the-art AI to enrich the readability of ancient textual heritage. Our methodology facilitates a more comprehensive analysis of significant inscriptions and demonstrates the potential of AI-assistive technologies to advance the field of ancient restoration and epigraphic studies.

图:DeepHadad 网络架构。生成器(上方)由初始卷积层、下采样模块、自注意力模块、SPADE 模块以及带跳跃连接的上采样模块组成,用于重建受损的位移图。判别器(下方)采用卷积模块、自注意力层与残差模块评估重建质量。图例以不同颜色标注了各类网络层。

Fig. DeepHadad network architecture. The generator (top) employs initial convolution, downsampling blocks, self-attention, SPADE blocks, and upsampling blocks with skip connections to reconstruct damaged DMs. The discriminator (bottom) utilizes convolutional blocks, self-attention layers, and a residual block to assess reconstruction quality. The color-coded legend details the various layer types.

3.《基于可微渲染技术对已佚祭坛屏的虚拟重建研究》

Towards the Virtual Reconstruction of Physically Lost Altarpieces through Differentiable Rendering

Anna Pagès-Vilà, Imanol Munoz-Pandiella

摘要:人类对艺术创作及其保护的关注贯穿整个人类历史。正因如此,我们如今才能欣赏到来自不同时期、不同地域的艺术作品。但并非所有艺术品都能完好留存,大量作品因各类原因永久消失。为弥补这一损失,已佚艺术品的虚拟重建是计算机图形学与文化遗产领域共同关注的前沿研究方向。

现有相关研究多基于人工建模,或依赖大量现代照片完成重建。而在这项跨学科研究中,我们提出了一种全新的重建方法:仅依托留存的唯一一张历史图像,结合可微渲染(differentiable rendering)技术,对已损毁的祭坛屏进行三维重建。

此外,我们以西班牙巴尔斯市毁于西班牙内战的圣施洗约翰祭坛屏为案例,对所提方法进行了验证。该方法实现了祭坛屏主体浮雕的部分三维重建,结果无论对专业研究者还是公众都具有实用价值,能够帮助人们更好地理解作品的立体感与空间关系,是已佚文物虚拟复原领域的一项重要进展。

Abstract:The interest of human beings in artistic creation, and its preservation, has been a constant throughout history. Thanks to this, today we can enjoy works from various moments and origins. However, not all works have been so fortunate, and many have disappeared for various reasons. To mitigate this loss, the virtual recreation of lost works of art is an open topic of interest for the computer graphics and cultural heritage communities. In the literature, we can find works along this line that are based on manual modeling or the use of numerous modern photographs. In this interdisciplinary work, however, we present a new methodology for reconstructing destroyed altarpieces for which only a single historical image is preserved, leveraging modern techniques of differentiable rendering. Additionally, we test our methodology in the reconstruction of the altarpiece of Sant Joan Baptista (Valls, Spain) destroyed during the Spanish Civil War. Our approach results in the partial 3D reconstruction of the main reliefs of the altarpiece. These results are truly useful, both for experts and for the public, as they allow for a better understanding of its volumetrics and its relationship with space, representing an important step forward in the virtual recovery of lost artifacts.

图:本研究调整后的工作流程:相机参数需与拍摄照片的参数对齐,环境贴图可采用HDR照片或合成图像,参考图像由初始渲染结果与祭坛屏历史照片合成得到。

Fig.Our adaptation of the workflow: Cameras must align with the photographs, environment maps can be HDR photos or synthetic images, and reference images are created by combining initial renderings with photographs of the altarpiece.

4《LanternOperAR:在混合文创产品中融入中国哲学,以互动体验传播越剧文化》

LanternOperAR: Engaging Yue Opera Culture with Chinese Philosophy in Hybrid Gift through Interactive Experience

Ningning Xu, Yifei Chen, Teng Ma, Qinglin Mao, Xinlie Huang, Haibo Zhou, Xu Sun

摘要:越剧是中国传统的全唱式叙事艺术,承载着中国文化思想与深厚历史底蕴。在此背景下,文化场馆开始应用增强现实(Augmented Reality, AR)技术,以打破被动观赏的体验模式,让观众成为主动参与者。

本文以“LanternOperAR”为探索案例,这是一款融合阳明心学中国哲学理念、用于推广越剧文化的混合文创产品。我们结合实体交互界面与虚拟内容,打造沉浸式文化互动体验。具体而言,我们首先开展田野调查,探究越剧文化传播的机遇与挑战;基于专家访谈与公众线上调研结果,提炼出一系列设计目标,指导产品的设计与开发流程。

该方案融合了AI图像处理、生成式AI、信息可视化与游戏化设计,结合AR技术,在AR叙事与互动过程中生成并呈现文化知识。我们邀请20名受试者对LanternOperAR进行评估,收获了关于系统可用性与整体体验的正面反馈,也收集到了后续优化的建议。研究结论可为文化产品与文化应用设计提供参考,为文化研究者与从业者提供借鉴。

Abstract:Yue Opera is a traditional Chinese through-sung storytelling style that conveys Chinese cultural ideologies and historical depth. In this context, Augmented Reality (AR) has been adopted in cultural venues to break the passive watching experience, turning the audience into active participants. In this article, we present an exploratory case study of LanternOperAR, a hybrid cultural gift to promote Yue Opera with the Chinese philosophy of Yangmingism. We incorporate the tangible interface and virtual content to create an interactive cultural experience. Specifically, we conducted a fieldwork study to investigate the promises and challenges of promoting Yue Opera. Based on expert interviews and an online survey with the public, we derived a set of design goals to guide the design and development process. Our approach incorporates the application of AI image processing, generative AI, information visualization, and gamification with AR technology to generate and visualize cultural knowledge in AR-based narratives and interactions. We evaluated LanternOperAR with 20 participants and acquired some positive feedback on system usability and overall experience, as well as some suggestions for further improvements. Our findings provide insights into the design of cultural products and cultural applications as guidance for cultural researchers and practitioners.

图:视觉设计概览与参考图像收集成果。

Fig. An overview of visual design with reference image collection results.

5.《故事灵感站:通过参与式阐释深化观众与博物馆藏品的联结》

Story Inspiration Station: Deeper Engagement with Museum Objects via Participatory Interpretation

Simon Bowen, Hattie Rowling, David Kirk

摘要:交互技术为文化遗产场所与藏品的新型互动形式提供了可能,包括实现参与式阐释、生成多元叙事,进而对官方遗产话语形成补充与反思。

为探索这一潜力,我们开发了“故事灵感站”交互式博物馆展项,利用数字化博物馆藏品激发观众的沉浸式思考。借此我们得以研究:交互式展项如何助力观众深化与藏品的联结,如何通过观众探索自身与他人对藏品的反馈,实现藏品阐释的民主化。

通过对系统使用数据与观众提交内容(1514份提交内容)的内容分析,以及对观众访谈(8人)与问卷反馈(6份)的主题分析,我们总结了深化遗产藏品互动、打破主流话语的相关策略,并为其他希望通过数字技术支持博物馆藏品多元叙事互动的从业者提供了设计参考。

Abstract:Interactive technologies offer the potential to support new forms of engagement with Cultural Heritage sites and collections, including the possibility of participatory interpretation and the production of polyvocal narratives that might challenge the Authorised Heritage Discourse. To explore this potential, we developed Story Inspiration Station, an interactive museum exhibit using digitised museum objects to prompt reflective engagement among visitors. This allowed us to investigate how an interactive exhibit can enable and scaffold deeper engagement with objects and democratise their interpretation through visitors’ exploration of their own and other’s responses to them. Through content analysis of system use and visitor responses (1,514 submissions) and thematic analysis of visitor interviews (n= 8) and survey responses (n= 6), we provide insights into strategies for deepening engagement with heritage objects and for challenging dominant discourses and provide design considerations for others seeking to digitally support polyvocal engagement with museum collections.

图:内容分析所用藏品:豹首、蛇石、香炉与格里芬首。

Fig.Objects used in the content analysis: Leopard Head, Snake Stone, Incense Burner and Griffin Head.

6.《拓展研究视角:通过多模态图像丰富化提升视觉档案的可及性》

Expanding Perspectives to Improve Access to Visual Archives through Multimodal Image Enrichment

Karina Rodriguez Echavarria, Myrsini Samaroudi

摘要:本研究针对文化遗产领域大规模视觉馆藏(尤其是博物馆与档案馆藏品)检索效率低的核心痛点展开。研究的核心贡献是提出了一套多模态内容理解方法,适用于缺少相关元数据、难以实现高效检索的图像馆藏。

该方法采用人工智能辅助图像分类与统一的视觉-语言理解技术,结合视觉特征与语义上下文,生成丰富且有价值的元数据。该方法支持专业人员为大规模图像数据集添加专业与非专业两类标签,完成数据丰富化与可视化处理,符合可发现、可访问、可互操作、可重用(FAIR)原则。这套全新的工作流程通过网页端的搜索与浏览界面,能够让不同受众更便捷地获取这些视觉资料。

研究以布莱顿大学设计档案馆的玻璃底片数据集为案例进行验证,该数据集包含约10000张数字化图像,记录了20世纪的历史设计作品,此前未完成分类。通过人工智能驱动的工作流程,该数据集补充了专业与非专业信息,用户可通过二维、三维可视化界面以及文本检索功能搜索、浏览数据集。

研究还探讨了当前可视化方案在为大规模文化遗产视觉馆藏打造更高效检索浏览功能方面的优势与局限。结果表明,尽管三维可视化比二维可视化具备更多功能特性,但用户仍需要更多辅助才能实现与大规模数据集的有效互动。因此,检索界面需要同时支持交互操作、视觉提示与文本检索,以优化用户的检索体验。

Abstract:The research tackles key challenges for improving the discovery of large-scale visual collections within the Cultural Heritage (CH) domain, particularly in museums and archives. Its contribution is a multimodal content understanding approach designed for image collections that lack relevant metadata, which hinders effective discovery. The proposed method utilises AI-assisted image classification and unified vision–language understanding, combining visual features with semantic context to generate rich and meaningful metadata. The proposed approach enables experts to enrich and visualise large-scale datasets of image collections by assigning both expert and non-expert labels, aligning with the Findable, Accessible, Interoperable and Reusable (FAIR) principles. Thus, the novel workflow broadens access to this visual material for diverse audiences through search and browse interfaces in a web browser. The proposed approach is demonstrated using the previously unclassified Design Archives’ glass plate negatives dataset, which consists of approximately ~10,000 digitised images depicting 20th-century historical designs. Through an Artificial Intelligence (AI) driven workflow, the dataset is enriched with expert and non-expert information. Users can search and browse results using 2D and 3D visualisations, as well as text-based search. The research also explores the advantages and current limitations of the proposed visualisation approach in creating more meaningful search and browsing functionalities for large Cultural Heritage (CH) visual collections. The results demonstrate that while 3D visualisations offer more affordances than their 2D counterpart, users require further support to interact with the large-scale datasets meaningfully. Hence, there is a need for discovery interfaces that support interactivity, visual cues and text-based search to enhance the users’ discovery journey.

图:(左上)编号U-360-178-O的图像,©布莱顿大学设计档案馆设计委员会馆藏;(右上)编号ODD-to-4-O的图像,©布莱顿大学设计档案馆设计委员会馆藏;(左下)编号GB-1837-DES-DCA-30-2-412.14-O的图像,©布莱顿大学设计档案馆设计委员会馆藏;(右下)编号GB-1837-DES-DCA-30-2-467.2的图像,©布莱顿大学设计档案馆设计委员会馆藏。

Fig.(Top-left) Image U-360-178-O, © Design Council Archive, University of Brighton Design Archives; (Top-right) Image ODD-to-4-O, © Design Council Archive, University of Brighton Design Archives; (Bottom-left) Image GB-1837-DES-DCA-30-2-412.14-O, © Design Council Archive, University of Brighton Design Archives; and (Bottom-right) Image GB-1837-DES-DCA-30-2-467.2, © Design Council Archive, University of Brighton Design Archives.

7.《一种用于敦煌古文献碎片两两匹配的自监督学习方法》

A Self-Supervised Learning Approach for Pairwise Matching of Ancient Dunhuang Fragments

MingKun Chen, YanPing Xiang, Yutong Zheng

摘要:在古文献拼接领域,尤其是敦煌文献修复中,传统方法往往聚焦于完整文献或真实配对的碎片,而对孤立碎片的关注不足——这类碎片对文献修复同样至关重要。受自然老化与保存方式不当的影响,绝大多数敦煌文献都以碎片形式留存。传统上,学者需依托过往拼接经验指导孤立碎片修复,这一过程往往耗时数年且成效有限。

本研究提出了一种全新的自监督两两匹配方法,用于辅助学者完成文献碎片的数字拼接。我们构建了包含完整文献、真实配对碎片与孤立碎片的数据集,并设计了精细化的预处理方案,将专家知识作为隐式约束融入其中,无需人工标注。

研究提出了全新的特征编码方式——带方位信息的二进制弗里曼编码(Binary Freeman Code with Azimuth Information,BFAz编码),可为匹配提供鲁棒的特征依据。针对正样本稀缺、碎片相似度标注难度大的问题,我们提出了自增强策略:通过学习碎片全局特征生成监督信号,构建碎片组以建立正负样本关系,再通过孪生网络(Siamese network)量化两两碎片的相似度。

实验结果表明,该方法能够高效筛选出高概率的正确拼接候选对象,彰显了计算机辅助修复技术在考古研究中的应用潜力。

Abstract:In the field of ancient manuscript rejoining, particularly for Dunhuang manuscripts, traditional approaches often focus on complete manuscripts or real paired fragments while overlooking orphan fragments, which are equally critical for restoration. Due to natural degradation and improper preservation methods, most Dunhuang manuscripts survive only as fragmented remnants. Scholars have traditionally relied on prior rejoining experience to guide the restoration of orphan fragments, a process that often takes years and achieves limited success. In this study, we propose a novel self-supervised pairwise matching approach designed to assist scholars in digital fragment rejoining. We construct a dataset comprising complete manuscripts, real paired fragments, and orphan fragments and apply a detailed preprocessing scheme that integrates expert knowledge as implicit constraints without requiring manual annotations. A novel feature encoding—BFAz encoding (Binary Freeman Code with Azimuth Information)—is introduced to provide robust matching cues. To address the scarcity of positive samples and the difficulty of annotating fragment similarity, we develop a self-augmentation strategy that generates supervisory signals by learning global fragment features, forming fragment groups to establish positive and negative sample relationships. Pairwise similarity is then quantified using a Siamese network. Experimental results demonstrate that our approach efficiently prioritizes correct rejoining candidates, highlighting the potential of computer-assisted restoration technologies in archaeological research.

图:古文献修复学者传统人工碎片拼接方式与本研究提出的两两匹配辅助修复方式对比。

Fig.Comparison between the traditional manual fragment rejoining experience of ancient manuscript restoration scholars and the pairwise matching strategy proposed in this study.

8.《西班牙克鲁尼亚罗马城出土伊西斯雕像的虚拟重建:用于交互式虚拟现实体验的三维模型》

The Virtual Reconstruction of a Statue of Isis Unearthed at the Roman City of Clunia (Spain): A 3D Model for Interactive Virtual Reality Experiences

Bruno Rodriguez-Garcia, Laura Corchia, María José Zaparaín Yáñez, Lucio Tommaso De Paolis

摘要:本研究旨在推动摄影测量(photogrammetry)、三维建模、虚拟主体(Virtual Agents)、虚拟现实(Virtual Reality,VR)等技术在文化遗产保护、修复与传播领域的应用。为此,研究以系统化的完整流程,完成了一尊伊西斯女神罗马雪花石膏雕像的虚拟重建并进行了效果评估。

该雕像出土于西班牙布尔戈斯省的克鲁尼亚罗马城,年代约为公元2世纪。虚拟重建基于雕像残件,并结合其他现存的伊西斯女神形象对比参考,还原了雕像现存与缺失的全部特征。生成的三维模型可作为虚拟主体应用于交互式体验中。

此外,对模型的差异分析、细节分析与顶点集中度分析均取得了理想结果。研究在布尔戈斯博物馆开展了交互式虚拟现实体验测试,邀请60名参与者体验三维模型可视化效果,参与者的评价整体高度正面。对参与者反馈的聚类分析显示,行为模式差异主要与年龄、虚拟现实使用经验相关。该虚拟重建三维模型为开源资源,可免费下载使用。

Abstract:This research aims to contribute to the advancement of technologies applied to the conservation, reconstruction, and dissemination of Cultural Heritage, such as photogrammetry, 3D modeling, Virtual Agents, and Virtual Reality. To this end, the virtual reconstruction process of a Roman alabaster sculpture of the Goddess Isis is presented and assessed in a comprehensive and systematic procedure. Unearthed at the Roman city of Clunia (province of Burgos, Spain), the sculpture dates back to approximately the 2nd c. AD. The virtual reconstruction depicts both existing and missing features, based on the remains and comparisons with other extant representations of the goddess. The generated 3D model was designed to function as a Virtual Agent in interactive experiences. Moreover, discrepancy, detail and vertex concentration analyses of the model yielded satisfactory results. The visualization of the 3D model was tested in an interactive Virtual Reality experience at the Museum of Burgos with 60 participants, whose evaluations were highly positive. Clustering of participant responses revealed behavior patterns that were primarily associated with age and previous experience with Virtual Reality. The 3D model of the virtual reconstruction is open access and free to download.

图:重建流程总览。

Fig.Summary of the reconstruction procedure.

9.《结合版面分析、光学字符识别与生成式 AI 实现大规模报纸语料结构化数据自动提取》

Automating the Extraction of Structured Data from Large Newspaper Corpora Using Layout Analysis, OCR and Generative AI

Nikos Kontonasios, Yannis Tzitzikas, Pavlos Fafalios

摘要:历史报纸是记录时代文化、社会、经济与政治面貌的珍贵资料,能够为研究历史事件与社会日常生活提供独特视角。但受限于传统研究方法(需人工逐页、逐篇查阅),这类档案的价值尚未得到充分挖掘。数字档案的出现一定程度上改善了资料的可及性,但由于缺少有效的内容解析与分析工具,仍难以支撑大规模历史研究。

光学字符识别(Optical Character Recognition,OCR) 技术是将扫描图像转换为可检索文本的基础,但仅靠OCR无法应对历史报纸的复杂情况——这类报纸往往存在图像质量退化、字体不统一、版面布局复杂等问题。同时,对报纸内容进行有效的分割与排序,是从特定报纸版面中提取结构清晰、逻辑有序数据的关键。

本文聚焦于一套完整技术管线(pipeline)的开发,以解决上述难题,并以法国《马赛信号报》(Le Sémaphore de Marseille)为案例(涵盖1827-1944年共35703期报纸)展开研究。所提出的系统整合了版面分析、OCR与生成式AI信息提取技术,从扫描图像中提取特定数据元素(本研究为船舶到港数据),并存储为机器可读格式以供后续分析。

结构化的输出结果能够帮助历史学家更高效、更大规模地分析历史贸易模式、经济趋势与区域互动情况。对系统核心组件的评估验证了方案的有效性:段落分割与信息提取的F1值达到96%,同时也指出核心的OCR模块仍有进一步优化的空间。

Abstract:Historical newspapers are invaluable resources that capture the cultural, social, economic and political dimensions of their time, providing unique insights into past events and daily life. However, the potential of these archives remains underutilised due to the limitations of traditional research methods, which rely on laborious manual examination of individual pages or articles. Digital archives have begun to address this issue by enhancing accessibility, but the lack of effective tools for parsing and analysing the contents still restricts their utility for large-scale historical research. Optical Character Recognition (OCR) technology plays a foundational role in converting scanned images into searchable text. However, OCR alone cannot adequately handle the complexities of historical newspapers, which often feature degraded image quality, inconsistent typography and intricate layouts. In parallel, the effective segmentation and ordering of newspaper content is essential for generating well-structured and logically ordered data from specific newspaper sections. This article focuses on the development of a pipeline that addresses these challenges, using the daily newspaper Le Sémaphore de Marseille as a case study (35,703 issues covering the period 1827–1944). The proposed system integrates layout analysis, OCR and Generative AI-driven information extraction techniques to extract specific data elements from scanned images, namely ship arrivals data, and to store them in a machine-readable format for further analysis. This well-structured output enables historians to analyse historical trade patterns, economic trends and regional interactions more efficiently and at a much larger scale. An evaluation of the key pipeline components demonstrates the effectiveness of the system, achieving an F1-score of 96% in paragraph segmentation and information extraction, while also highlighting the need for further improvement in the critical OCR component.

图:Arcanum系统识别出的版面区块示例。1850年1月11日的报纸版面(原始报纸图片来源:(retronews.fr))。

Fig.Example of the blocks identified by Arcanum. Issue of January 11, 1850 (source of original newspaper image: [retronews.fr]).

10.《基于扩散语言模型优化中国文物图像描述生成效果》

Improving Image Captioning for Chinese Cultural Relics with Diffusion Language Models

Chenggang Mi, Yu Li

摘要:精准详实的图像描述是中国文物记录与文化传播的核心基础,但受领域特殊性与“图像-描述”配对数据严重稀缺的限制,该任务发展受阻。尽管配对的图文数据有限,但相关文物领域的文本资料存量十分丰富。

本文提出了一套全新的中国文物图像描述生成框架,利用扩散语言模型(Diffusion Language Models,DLMs)有效挖掘海量领域文本的价值。该方法首先在大规模领域文本语料上预训练扩散语言模型,让模型习得领域专属的语言知识;再基于有限的配对图文数据,结合视觉特征对预训练模型进行微调。

实验结果表明,与未利用领域文本、或文本利用效率较低的方法相比,该策略显著提升了描述生成的效果。本研究彰显了扩散语言模型在利用现有领域文本、解决复杂视觉-语言生成任务数据稀缺问题上的优势,可为文化遗产文献记录及更广泛的自然语言处理应用提供有价值的工具支持。

Abstract:Accurate and detailed image captioning is crucial for documenting and disseminating knowledge about Chinese cultural relics, yet this task is severely limited by its domain-specific nature and the acute scarcity of paired image-caption data. While paired visual-text data is limited, substantial volumes of domain texts about these relics often exist. We propose a novel framework for Chinese cultural relics image captioning that effectively leverages this abundant domain texts using diffusion language models (DLMs). Our approach involves pretraining a DLM on the large corpus of domain texts to instill domain-specific linguistic knowledge, followed by fine-tuning the pretrained DLM on the limited paired image-caption data, conditioned on visual features. Experiments demonstrate that this strategy significantly boosts captioning performance compared to methods that do not exploit the domain texts or use them less effectively. This work highlights the power of DLMs in leveraging readily available domain text to overcome data scarcity for complex vision-language generation tasks, offering a valuable tool for cultural heritage documentation and broader natural language processing applications.

图:注意力模式可视化。(a)青铜礼器大克鼎的原始图像。该文物为上海博物馆馆藏。官方馆藏记录可查阅上海博物馆档案,文物图像的更多细节与社群整理资料可参考百度百科词条。(b)展示模型注意力集中在“饕餮纹”区域的情况。(c)展示模型注意力集中在“三足底座”的情况。完整描述为:“一件商代青铜鼎,用于祭祀仪式,以醒目的饕餮纹与三足底座为典型特征。”

Fig.Visualization of attention patterns. (a) is the original image of the bronze ritual vessel-Da Ke Ding. This artifact is part of the Shanghai Museum’s collection. For official museum records, see the Shanghai Museum documentation. For additional details and community-sourced documentation regarding this cultural relic image, please consult the Baidu Baike entry. (b) shows the model’s attention focused on the “Taotie designs” area. (c) illustrates the model’s attention concentrated on the “tripod base.” The full caption is: “A bronze Ding from the Shang Dynasty, used for ritual purposes, is characterized by its prominent Taotie designs and a tripod base.”

以上内容来自期刊官网

https://dl.acm.org/journal/jocch

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编译丨洪冰凤

校对丨罗斯鹏

排版丨魏翔

阅读原文

跳转微信打开

  •  

新书推荐|《中世纪手稿的数字化:圣查德福音书的物质性、复原与2D&3D再现》

2026-06-12 14:25 湖北

Bill Endres 的Digitizing Medieval Manuscripts: The St. Chad Gospels, Materiality, Recoveries, and Representation in 2D&3D 以八世纪 St. Chad Gospels 为核心个案,讨论中世纪手稿数字化如何服务于文本恢复、物质性研究、保存实践与知识再呈现。

内容介绍

Bill Endres 的《中世纪手稿的数字化:圣查德福音书的物质性、复原与2D & 3D再现(Digitizing Medieval Manuscripts: The St. Chad Gospels, Materiality, Recoveries, and Representation in 2D & 3D )》以八世纪 St. Chad Gospels 为核心个案,讨论中世纪手稿数字化如何服务于文本恢复、物质性研究、保存实践与知识再呈现。全书的研究目的在于说明,数字图像并非单纯的复制品,而是一种能够揭示手稿历史层累的研究工具。作者关注羊皮纸、墨水、颜料、磨损、擦除、褪色、装订变形等物质痕迹,试图通过光学成像与后期处理,重新读取肉眼难以辨识的信息,并由此推进古文献学、书籍史和数字人文之间的对话。

本书的创新点首先体现在方法整合上。作者将多光谱成像、替代色彩空间、反射变换成像、历史照片比对和三维呈现结合起来,展示不同技术如何分别处理文字恢复、表面细节观察、颜料损耗追踪和页面形态分析等问题。其次,作者强调开放源代码软件和可操作流程,使高级成像不只属于大型实验室,也能进入普通中世纪研究者的工作方法。最后,本书把技术问题放回手稿的宗教、文化和伦理语境中,讨论文物、开放获取、社区互惠和数字授权等问题,避免把数字化理解为纯粹技术工程。

从研究方向看,本书属于数字手稿学、计算古文献学和物质文本研究的交叉领域。它既面向损毁文本的恢复,也面向手稿长期保存和数字替代物的批判评估。作者尤其关心二维图像的限制,并进一步探索三维成像和虚拟现实作为新型知识空间的可能性。其价值在于提醒研究者,数字化手稿研究的核心并非追求更清晰的图像本身,而是通过图像、算法和物质性分析,重新理解手稿作为历史物、宗教物和知识媒介的复杂生命。

作者介绍

Bill Endres

比尔·恩德雷斯(Bill Endres),数字人文学者,2009年获亚利桑那州立大学博士学位,现任美国俄克拉荷马大学英语系副教授。其核心研究方向是用数字技术挖掘中世纪早期手稿的物质性,不只关注文字内容,更聚焦纸张、刻印、笔迹等肉眼难以察觉的实体特征。至今仍保留着诗歌与修辞学方向的研究兴趣,这也是其早期学术背景的重要组成部分。

研究主线:用数字技术挖掘中世纪早期手稿的物质性,不只关注文字内容,更聚焦纸张、刻印、笔迹等肉眼难以察觉的实体特征。

研究对象:主攻英国利奇菲尔德大教堂藏的公元 8 世纪《圣查德福音书(St Chad Gospels)》,同时覆盖公元 600-850年不列颠群岛产出的所有岛屿手稿(Insular manuscripts)。

研究技术:运用多光谱成像、反射变换成像和高精度 3D 捕获技术开展工作;其中 RTI 可识别无墨干刻的隐形文字,3D 扫描精度达 0.05 毫米,还会通过对比不同年代的数字化图像追踪手稿老化情况。

学术成果:出版专著《Digitizing Medieval Manuscripts: The St Chad Gospels, Materiality, Recoveries, and Representation in 2D & 3D》,并配套发布问答拓展文章《Collecting Light: Q&A with Bill Endres》;搭建学术网站Manuscripts of Lichfield Cathedral,免费开放《圣查德福音书》和《威克利夫圣经(Wycliffe Bible)》的知识共享资源;开发了《圣查德福音书》VR 体验测试版。

学术著作

专著

  • Digitizing Medieval Manuscripts: The St Chad Gospels, Materiality, Recoveries, and Representation in 2D & 3D, Arc Humanities Press, 2019.

期刊论文

  • “Digitization as Scholarly Intervention and Interpretive Act: A Case for 3D Capture in Studying the Agency of Materiality,” Manuscript Studies, 2025.

  • “The St. Chad Gospels: Ligatures and the Division of Hands,” Manuscripta, 2015.

  • “Imaging Sacred Artifacts: Ethics and the Digitizing of Lichfield Cathedral's St Chad Gospels,” Journal of Religion, Media & Digital Culture, 2014.

书籍章节与会议论文

  • (与Jenna Gorlewicz合著) “Haptics and Digital Codicology: Reimagining Tactile Experience in the Study of Manuscripts,” 收录于 Approaches to Digital Codicology: Interdisciplinarity and Intersections, 2025.

  • “A Manuscript Wanders into VR: Oh My!,” 收录于Insular Art at the Crossroads: Ninth International Insular Art Conference 2022, 2025.

  • “Oh Lord, make haste to help me: Prayer and Imagery Atop Canon Table II in the Book of Kells,” 收录于An Insular Odyssey: Manuscript Culture in Early Christian Ireland and Beyond, 2017.

  • “A Literacy of Building: Making in the Digital Humanities,” 收录于Making Humanities Matters, Debates in the Digital Humanities Series, 2018.

  • “More than Meets the Eye: Going 3D with an Early Medieval Manuscript,” 收录于Proceedings of the Digital Humanities Congress 2012, 2014.

出版信息

作者:Bill Endres

出版社:Arc Humanities Press

出版时间:2019年(电子书)/2023年(实体书)

丛书系列:Medieval Media and Culture

ISBN:9781802701227

书籍目录

导论 

视觉奇观的时代——物质性的数字化与光之解密

第一章 

复原:从多光谱成像到替代色彩空间

第二章 

反射变换成像:表面细节的增强观察

第三章 

原本不可知之物:历史照片的数字化与比较

第四章 

神圣器物:开放获取、权力、伦理与互惠

第五章 

知识空间的危机?——虚拟现实之展望

章节简介

导论 

视觉奇观的时代——物质性的数字化与光之解密

The Age of Visual Wonder: Digitizing Materiality and Unriddling Light

导论为全书建立理论框架和问题意识。作者从手稿随时间变化的物质状态谈起,指出羊皮纸、墨水、颜料、磨损、擦除、水损和褪色都使手稿成为有待重新辨读的历史对象。以 St. Chad Gospels 为核心案例,导论说明该手稿不仅保存了福音书文本,也保存了关于制作地点、书写者、艺术家、颜料层、边注、旅行经历和损毁过程的多重线索。作者的基本关切是,数字化不能停留在图像复制和在线开放层面,还应进一步进入手稿物质性分析。通过将视觉信息转化为数值,研究者可以运用数学处理、光谱成像和三维呈现来发现肉眼难以辨认的内容。导论同时批判二维图像的局限,强调手稿页面并非平面图像,而是具有厚度、弯曲、反光、纹理和损耗轨迹的三维物体。作者由此提出全书的主轴,即以数字成像技术恢复和保存手稿物质性,并在技术、伦理和知识空间三个层面重新理解中世纪手稿。

第一章 

复原:从多光谱成像到替代色彩空间

Recovery: From Multispectral Imaging to Alternative Colour Spaces

第一章集中讨论受损文本和图像的数字恢复方法。作者首先回顾早期使用化学试剂恢复褪色文字的传统,指出这类做法常常对手稿造成不可逆损害。随后,作者转向以光学性质为基础的非侵入式恢复路径,重点说明多光谱成像如何通过紫外、可见光和红外等不同波段捕捉页面反射信息。以 St. Chad Gospels 中水损文字、擦除文字和颜料残迹为例,作者展示了不同材料对不同波长光线的吸收和反射差异。铁胆墨、羊皮纸、碳基墨水和颜料层在光谱中的表现并不相同,恢复效果必须根据具体物质条件判断。本章的一个重要贡献是将高级成像与可操作的后期处理结合起来。作者讨论 ImageJ、替代色彩空间、数学运算、假彩色和去相关拉伸等方法,说明普通彩色图像甚至手机照片也可能通过适当处理产生有价值的恢复结果。此章的核心方向是建立一种可推广的恢复流程,使中世纪研究者能够理解图像、光线和材料之间的关系,并据此选择合适的数字方法。

第二章

反射变换成像:表面细节的增强观察

Reflectance Transformation Imaging: An Enhanced View of Surface Details

第二章讨论反射变换成像在手稿表面细节研究中的作用。与第一章重在恢复受损文字不同,本章关注页面表面起伏、压痕、刻写、墨迹隆起和颜料层状态。作者特别强调干笔书写的重要性。干笔书写通常用尖笔在页面上刻出痕迹,没有墨水,因此在普通光照下极难观察。RTI 通过从多个方向记录光线照射下的表面反应,使研究者能够在数字界面中改变虚拟光源方向,从而凸显细微凹凸。作者采用 highlight RTI 方法,以手持闪光灯模拟半球光源装置,这使该技术更易于实施,也降低了设备门槛。本章不仅说明 RTI 可用于辨认难读的干笔文字,还展示其对格线、压印、墨水和颜料隆起、页面局部损伤等问题的分析价值。其研究意义在于把手稿表面从被动背景转化为可读信息来源。页面的微小物理变化可以揭示书写过程、校订方式、使用痕迹和保存状态,因此 RTI 为古文献学、书籍史和保护研究提供了更细密的观察手段。

第三章 

原本不可知之物:历史照片的数字化与比较

The Otherwise Unknowable: Digitizing and Comparing Historical Photographs

第三章把历史照片纳入数字手稿研究,讨论早期摄影资料在追踪手稿老化和保护史方面的价值。作者指出,新的数字图像并不必然比旧照片包含更多历史信息,因为手稿在过去一百多年中可能已经失去颜料、文字痕迹或页面形态。早期照片记录了手稿在某一时刻、某种光照条件和某种摄影技术下呈现出的状态,因此可以成为分析长期变化的证据。本章以 St. Chad Gospels 的 1887 年照片、photostat 副本、彩色幻灯片、黑白照片和 2010 年多光谱成像项目为材料,说明如何将历史照片数字化、对齐、叠放和调节透明度,以观察颜料脱落、页面压平、边缘变化和过去修复处理的影响。作者也提醒读者,摄影本身具有技术限制,不同相机、镜头、光源和处理方式都会影响图像结果。因此,比较历史照片既能产生关于手稿老化的新知识,也能训练研究者批判性地看待图像证据。本章的研究方向是把摄影档案转化为时间序列材料,使数字化成为研究手稿生命史和保存状态的工具。

第四章 

神圣器物:开放获取、权力、伦理与互惠

Sacred Artefacts: Open Access, Power, Ethics, and Reciprocity

第四章转向数字化的人文和伦理维度,讨论开放获取、权力关系、版权、社区利益和互惠原则。作者认为,对于仍然服务于特定宗教共同体的手稿,研究者不能只把它看作文物资源或文化遗产。St. Chad Gospels 与 Lichfield Cathedral 的宗教生活、地方记忆和共同体身份相连,因此数字化工作本身也是一种社会关系。作者借用民族志中的互惠原则,强调研究者在追求开放获取和学术成果时,需要同时考虑保存机构、宗教共同体和公众使用者的需求与担忧。本章讨论 Creative Commons 授权、数字图像传播、开放数据的实际门槛、社区参与和长期信任关系等问题。作者指出,开放获取并不自动等于公平使用,因为高分辨率图像、多光谱数据和专业软件仍可能构成技术壁垒。真正有效的数字化应提供不同层次的访问方式,使普通观众、地方共同体和专业学者都能获得相应收益。本章的重点在于把数字人文从技术执行推进到责任实践,说明图像开放必须与伦理判断、社区协商和知识回馈结合起来。

第五章 

知识空间的危机?——虚拟现实之展望

A Crisis in Knowledge-Space? A Look Toward Virtual Reality

第五章讨论三维成像、虚拟现实和知识空间问题,是全书从图像处理走向媒介理论的一章。作者认为,二维照片虽然极大扩大了手稿访问范围,却容易削弱研究者对手稿三维属性的理解。手稿页面有弯曲、厚度、纹理、颜料隆起和装订约束,阅读手稿也包含身体姿态、距离、光线和触觉想象等经验。虚拟现实和三维渲染可以在一定程度上恢复这种空间感,使手稿重新作为可被环绕、接近和观察的物质对象出现。作者提出知识空间这一概念,用来理解不同媒介如何组织知识的生产、保存和传播。他梳理了从希腊辩证法、中世纪手稿、印刷书籍到 Web 2.0 的历史变化,说明每一种媒介环境都会塑造特定的认知方式。虚拟现实因此被视为新的知识空间,既提供沉浸式研究和教学的可能,也带来技术门槛、真实性、解释控制和感官替代等问题。本章的研究方向是探索数字手稿的未来形态,尤其是三维技术如何帮助研究者重新思考物质性、临场感和知识传递。

章节选读

第一章(节选)

水损与磨损文本的修复 

Recovery of Water-D amaged and Worn Text

如前所述,第 90 页在修复水损文本时面临诸多挑战。为评估相关方法与成像技术,我将相同方法应用于两张 RGB 图像,一张是大英图书馆于 2003 年通过高分辨率彩色相机拍摄,另一张是 Bill Endres 于 2010 年通过单色相机拍摄。我将示例限定在前两行的开头部分,因为这部分能有效呈现各类损伤情况。不过将两张图像并列对比后,能发现一处细微但关键的初始差异,2010 年图像中的羊皮纸看起来更偏灰色。对两张图像的颜色直方图进行分析后,这一观察结果得到了证实。按比例来看,2010 年的图像包含更多灰色,这是由红、绿、蓝频率的更大重叠所导致的。这一差异会对修复工作产生影响。

As mentioned, page 90 presents a range of challenges for recovering water-damaged text. To assess methods and imaging, I apply the same methods to two RGB images: one taken by a high-resolution colour camera by the British Library in 2003, and the other by a monochrome camera by Bill Endres in 2010. I limit examples to the beginning of the first two lines because they provide an efficient range of damage. Placing the images side-by-side, however, reveals a subtle but important beginning difference: the parchment in the 2010 image appears greyer. Examining colour histograms for each image affirms this observation. Proportionally, the 2010 image contains more grey, produced by a larger overlap of red, green, and blue frequencies. This difference affects recovery.

数码摄影并非一门精确的科学。不同的数码图像,其像素值存在差异,这会导致直方图的形状发生变化。对于 2010 年的图像,红、绿、蓝的绘图值范围更宽,进而影响了频率的重叠。直方图的谷值与峰值形状也略有不同。出现这类差异的原因在于,即便是高端相机,其传感器的灵敏度以及校准软件也存在区别。滤镜同样会造成差异。彩色数码相机配备拜耳滤镜(Bayer filter),它会阻挡所有频率,只保留每个光电探测器所需的红、绿、蓝频率。这些滤镜的灵敏度存在波动,因此需要不同的校准软件来合并频率,生成符合人眼视觉的彩色图像。不过对于 MSI 而言,当使用 LED 照明时,滤镜并非必要,这就消除了一个重要的变量。因此,不同相机拍摄的图像,所记录的反射光数值也不同。这不仅会导致直方图存在差异,更重要的是,它会使得数码修复的效果出现波动。

Digital photography is not an exact science. For different digital images, the values for pixels vary. This causes the shapes of histograms to vary. For the 2010 image, the graphed values for red, green, and blue are wider, affecting overlap. Valleys and peaks show slightly different shapes. Such differences occur because even in high-end cameras, the sensitivity of sensors and their calibrated software differ. But filters also cause variations. A colour digital camera has a Bayer filter blocking all frequencies except the red, green, or blue desired for each photodetector. The sensitivity of these filters fluctuates, requiring differently calibrated software to merge frequencies and produce a colour image that is realistic to the human eye. For MSI, when LED lighting is used, however, filters are unnecessary. This eliminates a significant variable. Therefore, different cameras produce images that record different values for reflected light. This causes histograms to differ, but importantly, it causes the success of digital recovery to vary.

对于第 90 页,使用 MSI 针对非可见频率拍摄的图像,最多只能实现有限的修复。紫外线光能够带来最佳效果,它能提升铁胆墨水(iron gall ink)书写的字母残留的可见度,这种墨水中的铁会吸收紫外线,而周围的羊皮纸则会反射更多紫外线。此外,由于羊皮纸反射的紫外线比渗透到透印文本中的更多,透印现象会逐渐消退。不过,水损导致变暗的羊皮纸会削弱这一积极效果。变暗的羊皮纸会吸收更多紫外线,因此对比度的提升十分微弱。虽然修复效果有限,但这些结果显示出像素值存在比例差异。这说明将可见与非可见频率的图像进行除法运算,可以增强墨水的痕迹,显现出受损文本的形态,这对于目前仍充满谜团的第一行文本而言意义重大。

For page 90, images taken with MSI for nonvisible frequencies produce, at best, minor recoveries. Ultraviolet light generates the best results. It increases the visibility of remnants of letters written in iron gall ink, the iron absorbing it while surrounding parchment reflects more of it. Furthermore, because parchment reflects more ultraviolet light than penetrates to the bleed-through text, bleed-through fades. However, parchment darkened by water-damage diminishes this positive gain. Darkened parchment absorbs more ultraviolet light. Contrast, therefore, increases only faintly. While recoveries are marginal, they indicate proportional differences for values of pixels. This suggests that dividing images of visible and nonvisible frequencies can enhance traces of ink and reveal patterns for damaged text, significant for the first line, still riddled in mystery.

在确认该墨水并非碳基墨水后,我们发现红外频率无法提供额外信息。例如,850 nm 的图像会让受损文本的残留痕迹消失,其更长的波长会穿透这些痕迹,反而将修复工作引向错误的方向。如前所述,铁胆墨水并不会像碳基墨水那样吸收红外光,因此这类频率最初无法提升对比度。不过,红外频率能够捕捉到比受损墨水更多的透印信息,这就带来了新的机会。通过数学运算,它们提供了另一种生成对比度的可能方式。

Confirming that ink is not carbon-based, infrared frequencies provide no additional information. For example, the image for 850 nm makes remnants of damaged text disappear. Its longer wavelengths pass through them, moving recovery in the wrong direction. As mentioned, iron gall ink does not absorb infrared light as carbon-based inks do; consequently, they are initially unbeneficial for increasing contrast. However, the ability of infrared frequencies to capture more bleed-through than damaged ink presents an opportunity. Through mathematical operations, they provide another possible way to generate contrast.

为尝试进行修复,并为数学运算筛选合适的频率,我将 RGB 多光谱图像分别除以其 638 nm 红、535 nm 绿和 465 nm 蓝通道。这一操作立刻得到了结果。这三个通道都大幅降低了透印带来的干扰,不过除以 465 nm 后,第一行的受损文本显现得最为清晰,即 tori suo。Latin Vulgate 证实了这一修复结果。第 90 页的内容是对 Matthew 20:8 的收尾,这则寓言讲述了工人们在不同时间开始工作,最终却获得相同报酬的故事。武加大译本中对应的预期词汇是 procuratori suo。第 89 页的结尾是 procura,因此 tori 补全了这个单词。suo 在三个结果中都清晰可见,在除以 465 nm 的 RGB 图像中最为明显。通过进一步的除法运算,465 nm 展现出了优化修复效果的潜力,也可用于修复其他存在水损文本的页面。不过 638 nm 和 535 nm 的结果同样有潜力,它们在不同的组合中可能会发挥作用。因此,MSI 拍摄的图像为修复工作提供了大量的可能性。不过,将 RGB 多光谱图像除以非可见频率的尝试并未成功。运算结果显示,850 nm 的像素值与 RGB 图像的像素值比例相似,完成除法后,受损文本的痕迹与透印现象都没有明显变化。在光谱的另一端,除以 365 nm 紫外线的结果同样令人失望,透印的干扰依然过强。不过受损文本显现为明亮的红棕色,这说明找到合适的配对进行除法运算或许能得到不错的结果。

To attempt recovery and identify further frequencies for mathematical operations, I divided the RGB multispectral image by its 638 nm (red), 535 nm (green), and 465 nm (blue) channels. This produced immediate results. All three dramatically decrease the interference caused by bleed-through; however, dividing by 465 nm makes the damaged text on the first line emerge most clearly: tori suo. The Latin Vulgate affirms this recovery. Page 90 begins by concluding Matthew 20:8, a parable about labourers starting their work at fluctuating times but all receiving identical pay. The expected Vulgate words are procuratori suo (his steward). Page 89 ends with procura; therefore, tori completes this word. The suo is evident in all three results, most clearly in the RGB image divided by 465 nm. Through further division, 465 nm shows promise for refining recoveries or producing them for other pages with water-damaged text. However, results from 638 nm and 535 nm also show promise. They could prove effective in different combinations. Therefore, images from MSI provide an excess of possibilities for producing recoveries. Dividing the RGB multispectral image by nonvisible frequencies, however, proved unsuccessful. Division demonstrates that 850 nm has proportionally similar values for pixels as the RGB image. Once divided, traces of damaged text and bleed-through remain relatively the same. At the other end of the spectrum, dividing by 365 nm (ultraviolet) produces likewise disappointing results. Bleed-through still interferes too strongly. However, the damaged text emerges as a bright reddish brown; therefore, finding the appropriate division partner might produce good results.

对于所有修复后的文本,生成伪彩色可以提升对比度。ImageJ 提供了许多颜色表(Look-Up Tables,luts)来实现这一功能。对于受损文本,伪彩色能够提升除以 465 nm、535 nm 和 638 nm 后的图像清晰度,对紫外线图像也有一定的改善作用。如前所述,应用 luts 需要进行实验,同一个 lut 并非总能为每一次修复都提升清晰度。

For any recovered text, generating false colour can increase contrast. ImageJ provides a number of luts for doing so. For the damaged text, false colour enhances clarity for dividing by 465 nm, 535 nm, and 638 nm, and some improvement for ultraviolet. As mentioned, applying luts requires experimentation. The same lut does not always add clarity to each instance of recovery.

无论是 e-Codices 还是 Digital Walters,随着可用的高分辨率手稿图像数量不断增加,中世纪研究者获得了前所未有的机会来深度修复文本内容。这也使得将 RGB 图像拆分为红、绿、蓝三个通道成为了一种极为重要的方法。拆分 RGB 图像本身通常无法直接完成修复,它往往只是第一步。例如,当我拆分大英图书馆拍摄的照片时,得到的三个通道并没有立刻呈现出结果。但将它们与彩色图像进行除法运算后就有了变化。三个通道的运算结果中,透印现象都有所减轻,其中除以红色和蓝色通道的两个结果中,出现了修复效果,分别是 tori 中的 to 和 suo 中的 su。生成伪彩色进一步优化了这些结果,在除以蓝色通道的结果中,我还修复出了 tori 中的 ri。

Whether e-Codices or the Digital Walters, because of the large and growing number of available high-resolution images of manuscripts, medievalists have unprecedented opportunities for recovering profound levels of content. This makes splitting RGB images into their red, green, and blue channels a highly significant method. Splitting RGB images tends not to generate recoveries in their own right. It tends to be the first step. For example, when I split the photograph taken by the British Library, the resulting three channels did not immediately provide results. However, dividing them into the colour image does. In all three, bleed-through lessens; in two, dividing by red and blue, recoveries occur: to of tori and su of suo. Generating false colour enhances these results. For dividing by blue, it leads to recovering ri of tori.

必要时,这些修复结果可以指导后续的数学运算。对于第 90 页的开头部分,虽然目前的结果已经可靠,但如果其他页面的字母更难修复,对单个频率进行除法运算或许能得到更精细的修复效果,并提供特定的处理方法。因此,在已有良好结果的基础上,比如除以 465 nm 的结果,进行下一步操作是合理的。由于 638 nm 的结果是第二好的,我也使用了这个频率,它与 465 nm 的差距足够大。对于铁胆墨水,我更倾向于用较高波长除以较低波长,这会让羊皮纸比修复后的文本更暗,我发现明亮的修复痕迹更容易辨认。不过作为测试,我也将它们反转了,看看更亮的羊皮纸是否能让结果更清晰。

When necessary, results from these recoveries can guide further mathematical operations. For the beginning of page 90, while the results are secure, dividing individual frequencies might produce refined recoveries and provide specific approaches if letters on other pages prove more resistant. Building off good results, such as dividing by 465 nm, therefore, provides a next logical step. Since 638 nm produced the second-best results, I also use this frequency. It provides a nice distance from 465 nm. For iron gall ink, I prefer to divide higher wavelengths by lower ones. This causes parchment to be darker than recoveries. I find bright recoveries more discernible. As a test, however, I reverse them: in case lighter parchment clarifies results.

对频率进行除法运算后,得到的结果通常是页面偏黑,可能只有微弱的可辨认文字行痕迹。对于第 90 页,当用 638 nm 除以 465 nm 时就是这种情况。不过调整直方图后,文本就显现出来了。此时像素值的范围大约在 0 到 3.4804 之间,当将这些值拉伸到完整的 0 到 255 范围后,文本就显现出来了。查看前两行的开头部分,可以发现修复效果十分显著。

Dividing frequencies normally produces results in which pages appear blackish, with perhaps faint hints of discernable lines of script. For page 90, this is the case when dividing 638 nm by 465 nm. Adjusting the histogram, however, reveals the text. In this case, values for pixels range from about 0 to 3.4804. When these values are stretched to cover the full range (0 to 255), the text emerges. A view of the beginning of the first two lines reveals strong recovery.

进一步的实验持续带来了良好的结果,将可见频率互相进行除法运算,都能得到修复效果。例如,用 535 nm 除以 505 nm,以及用 450 nm 除以 592 nm,都能清晰呈现受损文本。在第二个例子中,为了展示修复后的文本呈现为更暗的状态,我用较高频率作为除数。不过我还是更偏好更亮的文本。但羊皮纸的瑕疵或变色可能会让其中一种方式更有效。

Further experimenting continued to produce good results. Dividing visible frequencies into each other all generated recoveries. For example, dividing 535 nm by 505 nm and 450 nm by 592 nm provide good views of the damaged text. In the second example, to demonstrate recovered text appearing darker, I divide by the higher frequency. Again, lighter text is my preference. However, blemishes or discolouration of parchment can cause one or the other to be more beneficial.

紫外线频率的效果依然没有达到预期。将其他各个频率分别除以 365 nm 后,只有一个图像得到了不错的修复效果,即用 850 nm 除以 365 nm。不过这个图像的清晰度,还是比不上通过可见频率除法得到的结果。修复结果可能难以预测,有时手稿的材质与状态会以无法预期的方式影响反射光,导致我们无法获得预期的效果。因此,指导原则虽然重要,但也仅仅是指导而已。面对众多的选择,这些原则能够为我们的方法提供指引,使其系统化。但数码修复本身依然需要不断尝试与实验。

The ultraviolet frequency continued in its trend of not being as beneficial as expected. Dividing each of the other frequencies by 365 nm generates only one image that produces good recoveries: 850 nm by 365 nm. This image, however, provides less clarity than those derived from dividing visible frequencies. Results can be unpredictable. Sometimes, the materiality and condition of a manuscript affect reflected light in ways that do not provide the expected leverage. Therefore, guiding principles are important, but they are just that, guidance. For an otherwise overwhelming number of options, they direct and systematize the approach. However, digital recovery requires play and experimentation.

对于通过除法进行的修复,彩色相机拍摄的图像也提供了更多的机会。不过如前所述,拆分这类图像只能得到三个可用于除法运算的图像,每个通道对应一个,即红、绿、蓝。因此,可能的运算方式仅限于红除以绿、红除以蓝、绿除以蓝,如果需要也可以反转。拆分大英图书馆拍摄的照片后,绿色通道除以蓝色通道的结果得到了稳定的修复效果。应用不同的 luts 生成伪彩色,进一步优化了这些结果。另一种生成伪彩色并完成修复的方式,是合并与 RGB 图像预期不同的频率。例如,可以将绿、蓝和紫外线频率分别对应红、绿、蓝通道,合并生成伪彩色图像。

For recovery by division, images produced by a colour camera also provide further opportunities. However, as mentioned, splitting them produces only three images for division, one for each channel: red, green, and blue. Therefore, the possibilities are limited to dividing red by green, red by blue, and green by blue (and the reverse, if preferred). Splitting the photograph taken by the British Library generated solid recovery for the green-channel divided by blue. Applying different luts generates false colour, enhancing these results. Another way to generate false colour and recovery is to merge different frequencies than those expected for an RGB image. For example, a false colour image can be generated by combining green, blue, and ultraviolet frequencies for the red, green, and blue channels.

不过对于第 90 页,以各种组合合并频率都没有得到有益的结果。但依然存在其他的可能性,除法运算后的频率结果也可以进行合并。例如,将红外频率作为红通道,将一个除法运算后的频率作为绿通道,即 592 nm 除以 505 nm,再将紫外线作为蓝通道,合并后得到了极佳的结果。紫外线频率将更多受损文本的痕迹带入 RGB 图像中,而红外频率则淡化了透印现象。不过对于绿通道而言,用较高频率除以较低频率这一步十分关键,这会让修复后的文本比周围区域更亮,生成所需的对比度。如果将除数与被除数反转,铁胆墨水的痕迹就会变得更暗,不过在我看来,这会让它们的细节更难辨认。

For page 90, however, merging frequencies in various combinations did not generate beneficial results. Nonetheless, further possibilities exist: the results from divided frequencies can also be merged. For example, merging an infrared frequency for the red-channel, a divided frequency for the green (592 nm divided by 505 nm), and the ultraviolet for the blue produces excellent results. The ultraviolet frequency brings more traces of damaged text into the RGB image while infrared fades the bleed-through. However, for the green-channel, dividing the higher frequency by the lower frequency is significant. This causes recovered text to be lighter than its surroundings, generating needed contrast. When the divisor and dividend is reversed, the traces of iron gall ink become darker; however, to my eye, this makes their nuances more difficult to see.

最后,合并通道并不局限于只有一个通道包含除法运算后的频率,两个甚至全部三个通道都可以包含这类结果。在之前的合并图像中,蓝通道效果最好的除法运算结果是 535 nm 除以 465 nm。为了找到这个合适的除法组合,我最初在蓝通道的大致范围内测试结果,之后再逐步扩展。为了给红通道也加入一个除法运算后的结果,我发现 700 nm 除以 625 nm 是个不错的选择。再次说明,优化修复效果需要不断实验。将原始 RGB 图像分别除以三个通道,能让我们初步了解透印与受损文本是如何反射光线的。基于这些结果,我们可以开展有针对性的实验,提升得到有效结果的概率。

Finally, merging channels is not limited to a sole channel containing a divided frequency. Two or all three channels can contain them. In the prior merged image, one of the best divisions for the blue-channel turned out to be 535 nm divided by 465 nm. To find this division, I initially tested results within the general range of the blue-channel and then expanded them. To include a third divided result for the red-channel, I found that 700 nm divided by 625 nm was a good choice. Again, enhancing recoveries requires experimentation. Dividing the original RGB image by its three channels provides initial understanding about how bleed-through and damaged text reflects light. From these results, informed experimentation can proceed, increasing the chance of generating revealing results.

以上内容来自书籍官网与学者主页

https://www.arc-humanities.org/9781802701227/digitizing-medieval-manuscripts/

https://www.ou.edu/cas/english/people/bill-endres

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编辑 丨魏翔

校对 丨洪冰凤

排版 丨罗斯鹏

阅读原文

跳转微信打开

  •  

会议征稿 | DHd2027:Mind the Gap!—— 知识、不确定性与责任

2026-06-06 08:30 湖北

德语区数字人文协会“DHd2027:Mind the Gap!—— 知识、不确定性与责任”会议征稿

DHd2027介绍

德语区数字人文协会(DHd,Association for Digital Humanities in the German Speaking Areas)成立于2013年,主要为所有在德语国家数字人文领域从事研究和教学的各学科人士的平台和利益的正式代表。截至2026年4月,DHd共有528名研究人员。作为一个区域性协会,DHd既隶属于欧洲数字人文协会(EADH, European Association of Digital Humanities),也是数字人文组织联盟(ADHO, Alliance of Digital Humanities Organizations)的成员协会。DHd会员同时也是EADH的正式会员。

DHd2027是由马尔堡大学承办的德语区数字人文协会年度会议,会议主题为“Mind the Gap!——关注间隙:知识、不确定性与责任”。

间隙”(gap)是知识构成中的重要组成部分。它们既标示出尚未被填补的空白,也提出新的问题,并推动认知过程的展开。对于数字人文而言,这一点尤为关键:当知识被数字化编码、建模,并转化为机器可读的形式时,翻译、简化与中介性的灰色地带便不可避免地出现。无论是将非数字对象转化为数据、模型或数字表征,还是处理原生数字材料,研究者都必须先对材料进行采集、组织、归档与整理,才能使其成为可分析的研究对象。在这一过程中,各种形式的“间隙”不断生成。

间隙DHd2027聚焦于这些具有生产性、问题性以及责任意义的间隙、不确定性与差异,并反思隐藏其中的关于数据完整性和确定性的理想化假设,以及支撑这些假设的解释过程。会议关注以下问题:

•空白如何成为知识生产的认识论前提?

•不确定性如何成为数字人文的方法论挑战?

•数据处理中的责任应如何承担?

•缺失与差异如何催生新的解释与理解?

重点讨论内容包括:

•物质和历史遗产中的缺失

•算法黑箱问题

•数据缺口

•建模决策

•知识与基础设施获取的不平等

会议背景与理念

(1)会议背景

与人类文化相关的数据往往是不完整的:文献可能残缺不全,资料可能已经散佚,原始语境可能不复存在,或仅以碎片化的形式流传下来。与此同时,数字化与建模过程本身也会产生新的筛选与简化。每一种数据表征(representation)、分类(classification)或可视化(visualization),都意味着研究者必须决定什么被展示、什么被强调,以及什么被省略。特别是在数据驱动方法与人工智能技术广泛应用的背景下,透明性、可解释性、不确定性与责任等问题变得愈发重要。

“Mind the Gap!”这一主题还进一步指向数字知识生产中的各种不平等现象。尽管数字技术具有促进知识民主化的潜力,但在数据获取、工具使用、基础设施建设和学术发表机会等方面,仍然存在显著差异。这些差异可能受到地理位置、机构背景、社会条件以及其他结构性因素的影响。因此,DHd2027会议希望为讨论数字人文领域中的参与、责任与可持续发展提供空间。

(2)会议理念

DHd2027会议强调,“间隙”(gap)并不只是知识生产中的缺陷,也可以被理解为反思、解释与批判得以发生的生产性空间。如果知识不是一个已经完成的最终成果,而是一个持续建构的过程,那么不确定性、空白与差异便构成了科学认识生成的重要前提。

DHd2027希望与学界共同探讨:

• 如何实现负责任的数字知识生产;

• 如何建立反思性的研究实践;

• 如何推动数字人文的可持续发展。

征稿主题

DHd2027欢迎数字人文及相关学科领域的研究者投稿,特别鼓励以下主题:

(1)文化遗产与历史资料中的空缺

  • 历史、文化和物质遗产中的空缺与不确定性

  • 来源(Provenance)研究

  • 碎片化(Fragmentation)

  • 去语境化(Decontextualization)

  • 元数据缺失

(2)不确定性的建模

  • 模糊性(Vagueness)建模

  • 不确定性建模

  • 多义性建模

(3)数字化与数据处理中的局限

  • 数字化过程中的选择机制

  • 数据建模中的筛选问题

  • 标注(Annotation)的边界

(4)数字化缺失问题

  • “数字暗场(Digital Dark Field)”

  • 未被数字化的文化资源

(5)人工智能与算法透明性

  • 黑箱问题(Black Box)

  • AI方法

  • 可解释人工智能(XAI)

(6)大模型中的知识偏差

  • 大语言模型训练数据缺陷

  • 图像模型训练数据偏差

  • 知识空缺与算法偏见

(7)数字重建

  • 数字复原

  • 推测与证据之间的平衡

(8)科研成果呈现中的不确定性

  • 可视化中的不确定性

  • 数据聚合中的误差

  • 研究成果展示中的风险

(9)数据伦理

  • FAIR原则

  • CARE原则

  • 数据伦理问题

(10)隐私与敏感数据处理

  • 匿名化(Anonymization)

  • 假名化(Pseudonymization)

  • 有意识的数据省略

(11)数字能力与基础设施

  • 数据素养

  • DH教育与培训

  • 基础设施不平等

(12)文化数据与社会责任

  • 后殖民主义视角

  • 文化数据治理责任

(13)方法论创新

  • 混合研究方法(Mixed      Methods)

  • AI与诠释学(Hermeneutics)

(14)机构协同

  • GLAM机构(Galleries, Libraries, Archives, Museums)网络化

  • 数字研究基础设施建设

(15)数字人文的未来角色

  • 技术与社会不确定时代中的数字人文反思

投稿类型与字数要求

类型

字数要求

学术报告(Vorträge)

1500–2000词

博士论坛(Vorträge im Doctoral Consortium)

500–750词

专题讨论(Panel)

1200–1500词

海报(Poster)

500–750词

工作坊(Workshop)

1200–1500词

投稿与评审

(1)投稿平台

投稿通过ConfTool提交。

作者需:

  • 注册ConfTool账户;

  • 使用FidusWriter撰写并提交dhc格式文件;

  • 填写100–150词摘要。

所有录用摘要将发布于DHd协会Zenodo社区,收录于会议论文摘要集,并发布于会议官网与会议手册。

(2)重要时间

时间

事项

2026年8月1日23:59(德国夏令时)

投稿截止

2026年11月初

录用通知

2026年12月5日

提交修改终稿

2027年3月1–5日

会议召开

注意:投稿截止日期不会延期。

(3)评审方式

此次会议采用开放同行评审(Open Peer Review)

  • 作者与评审人身份互相公开(Open Identities)

  • 评审意见不公开

联系邮箱:dhd2027@uni-marburg.de

(4)语言要求

DHd2027主要交流语言:德语、英语

投稿可使用:德语、英语

会议鼓励使用德语报告,但英语报告同样欢迎。

(5)参会要求

会议为:线下会议(In-Person Conference)

要求:

  • 录用论文原则上需作者本人到场报告;

  • 不设混合参会模式(Hybrid);

  • Keynote主旨报告将提供直播。

会议关注方向

对于文化遗产数字化、智慧数据资源建设、古籍数字人文研究领域的研究者而言,此次会议主题与以下研究高度契合:

  • 文化遗产数据缺失与不确定性表达

  • 古籍知识组织与语义建模

  • AI驱动的文化遗产知识发现

  • 文化遗产智慧数据资源建设

  • 数字重建与数字孪生遗产

  • 文化数据伦理治理

  • GLAM机构协同创新

  • 人工智能与数字人文方法论融合

涉及“文化遗产智慧数据资源建设模式”“古籍智慧数据平台”“文化遗产数字化—数据化—智慧化转型”等主题的研究将与DHd2027的会议议题具有很高的契合度。

以上会议征稿内容来自DHd2027官方网站:

https://digitalhumanities.de/en/2026/06/01/call-for-papers-dhd2027/

更多征稿详情请进官网查询,如需转载请后台私信联系

编译|罗斯鹏

校对|魏翔

排版|洪冰凤

阅读原文

跳转微信打开

  •  

会议征稿|CHR 2027:第七届计算人文学研究会议 (Seventh Conference on Computational Humanities Research)

2026-05-30 07:30 日本

一、 CHR介绍

随着计算方法、统计方法和数学方法的日益普及,艺术与人文学科的研究格局已经发生了显著转变。这一新兴研究范式使用形式化方法和明确的计算模型,涵盖从定量分析技术到复杂数据处理方法的多种路径,同时也对这些方法进行批判性的理论反思。CHR认识到,处于这一交叉领域的学者往往缺乏合适的平台,来展示和发表既具有计算性、又立足于传统人文学科问题意识的研究。正是基于这一痛点,CHR应运而生。计算人文学研究学会(Computational Humanities Research Society,CHR)是一个国际性、跨学科的学术社群,汇聚了对人文学科计算方法感兴趣的研究者。CHR 成立于COVID-19疫情期间,最初以线上形式起步,后逐渐发展并在欧洲各地举办年度会议,如安特卫普会议(2022)、巴黎会议(2023)和奥胡斯会议(2024),目前已成为该跨学科学术领域的核心阵地。

CHR通过发布代码与数据以支持透明度与可复现性、预注册研究设计,以及为与人文相关的跨学科计算研究重新设计评审流程等方式分享 “研究故事” ,以推广良好学术实践。该学会打造了专属的专业学术平台,推动创新计算方法与严谨人文研究的深度融合,在坚守人文学科传统内核的同时,助力整个领域的方法论创新与可持续发展。

CHR致力于构建一个由运用各类计算与定量方法研究人文问题的学者组成的社群,将这一社群视为数字人文领域的补充。CHR积极欢迎拥有不同背景、经历与身份的人士,包括未被充分代表群体的学者,以及为计算人文领域贡献新颖视角的研究者。CHR2027将于2027年1月5日至8日英国曼彻斯特大学数字人文、文化与媒体中心主办,线下地点有待通知。

二、征稿要求

CHR2027有两个核心目标:

一是构建一个包容性的研究者社群,将计算与定量方法应用于各种形式的人文数据研究。CHR将该社群视为更广泛数字人文领域格局的有益补充,并积极鼓励所有能为计算人文带来全新视角的人士参与。

二是推动卓越研究。具体而言,指通过开放代码与数据促进研究的透明度与可复现性,支持能够明确理论框架与方法论的研究设计,以及更好地适配融合了计算方法与人文导向问题的跨学科研究工作。

相关主题

会议欢迎涵盖广泛主题的原创研究论文,包括但不限于:

  • 将统计方法和机器学习应用于人文学科数据的处理、扩充和分析,包括新媒体数据和文化遗产数据;

  • 假设驱动的人文学科研究、模拟研究和生成模型;

  • 为人文学科研究发展新的定量方法和实证方法;

  • 对人文学科中的偏见、不确定性和相互冲突的解释进行建模;

  • 评估方法、评估数据集和标准制定;

  • 对人文学科数据的分类和分期进行形式化、统计化或定量化评估;

  • 定量方法和计算人文学路径的理论框架与认识论;

  • 从其他学科转译和迁移方法,以及连接人文学解释与统计学解释的路径;

  • 计算人文学中的可视化、传播,包括开放科学,以及教学;

  • 人工智能在人文学科研究中的应用潜力与挑战。

四、投稿类型

(1)长论文

最多6000词,约12页。不包括参考文献、摘要、表格和插图。长论文应报告已经成的且尚未发表的原创成果。会议更倾向于论证简洁的论文。允许附录,以提高研究的可重复性。附录可包括预处理决策、模型参数、提示词、伪代码、补充数据或输入/输出示例,以及其他相关细节。不过,评审人在评审过程中没有义务阅读附录和补充材料。每篇论文的正文必须能够独立成立,论证充分,并且在不依赖附录信息的情况下也能被理解。允许提供指向外部信息、代码仓库和数据存储位置的链接,但在评审过程中,必要时必须进行匿名化处理。

(2)短论文(包括海报)

最多6000词,约12页。不包括短论文,包括海报:最多3000词,约6页。不包括参考文献、摘要、表格和插图。短论文应报告聚焦明确的研究贡献,也可以呈现正在进行中的研究。短论文将以短口头报告或海报的形式展示。作者可以选择自己偏好的展示形式,但最终展示形式将由程序委员会决定。允许附录,以提高研究的可重复性。附录可包括预处理决策、模型参数、提示词、伪代码、补充数据或输入/输出示例,以及其他相关细节。不过,评审人在评审过程中没有义务阅读附录和补充材料。每篇论文的正文必须能够独立成立,论证充分,并且在不依赖附录信息的情况下也能被理解。允许提供指向外部信息、代码仓库和数据存储位置的链接,但在评审过程中,必要时必须进行匿名化处理。

(3)快速报告

提交一份最多750词的摘要,不包括参考文献、表格和插图,用于在快速报告环节进行3分钟展示。这一形式很适合报告正在进行中的研究、介绍研究想法、初步结果,或围绕特定问题与回答展开的聚焦型研究。报告将在线下现场进行。

(4)工作坊

工作坊:最多1500词。工作坊应比主会议更具互动性。工作坊将在会议前举行,时间为2027年1月5日。工作坊提案应说明:

  • 工作坊的目标与组织形式;

  • 相关工作的学术背景;

  • 拟定时长,例如半天或全天;

  • 当天流程安排,包括活动类型;

  • 预期的主要成果;

  • 每位组织者或报告人的简短简介,包括姓名、所属机构和电子邮箱地址;

  • 吸引参与者的宣传计划;

  • 具体需求,包括但不限于特殊设备,例如音频/视频设备、软件、实体空间布置;

  • 参与者在参加工作坊之前应具备的任何技术知识、技能或经验。

  • 具体需求,包括但不限于特殊设备,例如音频/视频设备、软件、实体空间布置;

  • 参与者在参加工作坊之前应具备的任何技术知识、技能或经验。

五、投稿须知

会议欢迎来自不同背景的学者投稿。目前没有计划延长投稿截止日期。

投稿要求

  • 投稿应以英文撰写,并必须按照ACH制作的LaTeX模板排版,点击即可下载 ach-latex-en.zip。建议使用Overleaf在线环境进行写作。若要开始使用 Overleaf,请打开以下模板文件,选择 “Open as Template”,然后登录或创建新账户:LaTeX Overleaf template。

  • 投稿必须匿名提交。所有投稿都将经过双盲同行评审,最终录用决定由程序主席作出。未使用指定模板、未匿名化,或缺少参考文献的投稿将不经评审直接拒稿。

  • 每篇被录用的投稿至少须有一位作者注册参加会议,并展示论文或海报。

  • 被录用的论文将提交至Anthology of Computers and the Humanities在线出版。

投稿方式

论文应以PDF文件形式通过EasyChair会议管理系统提交,投稿链接目前尚未发布,需要持续关注会议信息。

投稿匿名说明

任何可能有助于识别作者身份的信息都应进行匿名化处理。为此,请注意:

  • 不要包含作者姓名和所属机构;

  • 代码和数据仓库应使用占位链接,例如 https://anonymous.4open.science/、https://zenodo.org/record/xxxxx;

  • 不要以可能暴露作者身份的方式提及自己的既有研究。例如,不要写 “We previously demonstrated (Smith, 2002)”,而应写 “Smith (2022) previously demonstrated”;

  • 致谢部分留空。

匿名期将持续到录用通知公布之日,即2026年10月23日。为支持双盲评审,作者在此期间不得公开宣传自己的投稿,例如通过社交媒体、博客或邮件列表进行推广。不过,CHR也认识到早期可见度的重要性,尤其是对于早期职业研究者和跨学科合作而言。因此,作者可以在投稿前发布预印本,例如发布在arXiv、Zenodo、HAL或机构知识库上,但不得在匿名论文中链接这些预印本。

评审人将被要求忽略任何外部身份标识,并严格聚焦于匿名提交的论文。学会同时鼓励实证反馈:将询问评审人是否认为自己能够识别出作者身份及其原因,以帮助CHR评估匿名机制的实际运行效果。

AI使用说明

新兴技术正在改变一些研究者开展研究的方式。作者可以使用任何工具来开展研究和准备论文,但作者有责任确保所有提交内容正确、可靠且具有原创性。如果作者在研究实践中使用了生成式AI和/或智能体式AI,例如用于文献检索、编程和写作,会议鼓励作者在投稿中加入一段关于其AI使用情况的反思说明。

六、CHR2027评审指南

如果评审人发现自己无法按时完成评审、评审任务分配存在问题,或对EasyChair的使用有任何疑问,应尽快联系会议组织方。

如果投稿不符合模板要求、匿名化要求或参考文献要求,评审人不应继续评审,而应联系CHR2027程序主席。

另,为促进跨学科交流、确保多元性以及推动社群参与,会议将安排少量社群成员评审和非专家评审。

涉及投稿范围

  • 研究结果为负面或尚无定论的论文;

  • 小型个案研究;

  • 原型系统和概念验证研究。

评审意见撰写

评审意见应当清晰、具体,并使用建设性的语言。评审人应确保评审意见能够:

  • 尊重作者及其研究投入;

  • 帮助作者改进论文,无论是为了最终定稿版,还是为了未来再次投稿。

评审核心要素

(1)贡献

评审人应清楚指出论文的核心贡献,包括:

  • 论文如何推进该领域的发展,或如何有益于 CHR 社群;

  • 论文可能在哪些方面产生影响;

  • 论文引出的有价值的后续研究问题;

  • 论文与人文学科相关研究之间的关联。

(2)优点

评审人应说明论文做得较好的方面,例如:

  • 研究问题或研究假设的表述是否清楚;

  • 方法论是否新颖且可靠;

  • 实验设计与执行是否合理;

  • 是否充分比较了既有研究;

  • 研究结果是否具有启发性;

  • 是否具有对学术社群产生影响的潜力;

  • 是否考虑了相关的社会与伦理问题。

(3)缺点

评审人应指出论文的不足,并提出改进建议。相关意见应当:

  • 具体而具有建设性;

  • 提供清晰、可操作的修改建议;

  • 有助于促进跨学科知识交流,而不是仅从单一学科标准出发进行否定。

补充指南:

除非评审人确实难以判断,否则应使用数字评分明确表达自己的评审立场。

在评审截止日期之前,评审意见可以随时修改。

送审论文属于保密材料,不得在同行评审流程之外分享或讨论。

评审人不得将论文上传至第三方商业工具。这种行为会违反评审保密原则,并构成同行评审不端行为。

组织者联系方式:pc@computational-humanities-research.org

以上内容来自CHR 2027官方网站:

https://2027.computational-humanities-research.org/cfp/

由数字人文资讯编辑而成

更多征稿详情请进官网查询,如需转载请后台私信联系

编译|魏翔

校对|洪冰凤

排版|罗斯鹏

阅读原文

跳转微信打开

  •  

新书推荐丨《数字人文引论》:全面呈现数字人文“新理念、新领域、新方法、新设施”

2026-05-23 08:30 湖北

《数字人文引论》

作者:李飞跃、桑海  主编

出版社:中华书局

书号:978-7-101-17674-2

出版时间:2026年4月

字数:454千字

定价:92.00

/ 内容简介 /

《数字人文引论》以“新理念、新领域、新方法、新设施”为总体框架,系统阐释数字时代人文研究的范式跃迁。全书围绕大模型与人文研究、数字史学、数字文献学等领域核心议题展开,深入探讨自然语言处理、主题模型、网络文本分析等技术方法,并对数字基础设施建设、数字媒介发展、知识范式变革及海外数字人文前沿动态进行全面论述,为理解数字时代人文研究的转型路径与未来发展提供系统而清晰的指引。

/ 作者介绍 /

主编

李飞跃,清华大学人文学院长聘教授、博士生导师,北京大学文学博士。兼任清华大学和中华书局《数字人文》、中国人民大学《数字人文研究》编委,中国索引学会数字人文专业委员会委员、中国古籍保护协会古籍整理与开发专业委员会委员等。主要从事诗歌文献、音乐文学与数字人文研究,开设“数字人文”“诗词曲经典研读”等本科课程、“诗歌文献的跨学科研究”等研究生课程。在《中国社会科学》、EMNLP等发表论文60多篇,主持国家社科基金重点项目等数项,曾获教育部高等学校科学研究优秀成果奖、清华大学教学成果奖一等奖等。

桑海,清华大学文学博士,《澳门理工学报》编辑、《数字人文》副主编。主要从事文艺理论、新媒体、数字传播研究,在《文史哲》《南京大学学报》《清华大学学报》《人民日报》等报刊发表多篇论文或评论。

作者团队

作者团队由清华大学、北京大学等十余所国内知名高校及科研机构的19位数字人文专家组成。他们在数字人文领域深耕多年,兼具理论深度与技术应用,并且长期从事一线的科研与教学工作。

(按章节先后顺序排列)

刘  石/ 清华大学人文学院

李飞跃/ 清华大学人文学院

孙茂松/ 清华大学计算机科学与技术系

孔存良/ 清华大学计算机科学与技术系

梁  晨/ 南京大学历史学院

李林芳/ 北京大学中国语言文学系

许  可/ 华东师范大学中国语言文学系

邱伟云/ 南京大学历史学院暨学衡研究院

左家莉/ 江西师范大学人工智能学院

张辰麟/ 昆明学院人文学院、教育部语言文字应用研究所

胡韧奋/ 北京师范大学国际中文教育学院数字人文系

苏  祺/ 北京大学外国语学院、北京大学人工智能研究院

赵  薇/ 中国社会科学院文学研究所

唐  宸/ 清华大学人文学院

姜文涛/浙江大学国际联合学院

饶高琦/ 北京语言大学国际中文教育研究院

李  斌/ 南京师范大学文学院语言大数据与计算人文研究中心、澳门大学人文学院

桑  海/ 澳门理工大学《澳门理工学报》编辑部

肖  爽/ 清华大学人文学院

/ 编辑推荐语 /

“清华数字人文丛书”中的第一本教材,以“四新”为框架,理论与研究成果相结合,全面阐述数字人文领域的主要研究方向。

目  录

《数字人文引论》

试  读

《数字人文引论》

END

转自“数字人文专业发展联盟”

已获转载授权

阅读原文

跳转微信打开

  •  

学术前沿 | 文化分析学刊(Journal of Cultural Analytics,JAC)介绍及论文荐读

2026-05-23 08:30 湖北

《文化分析学刊》(Journal of Cultural Analytics,简称 JCA)由普林斯顿大学数字人文中心出版,这是一份倡导开放获取的学术期刊,致力于发表计算方法在文化研究领域的前沿应用成果。该刊聚焦于人文学科、社会科学与计算机科学的交叉融合,探讨如何运用数字技术分析文化文本、历史文献、视觉艺术以及声音档案等多元文化样态。该刊特别鼓励具有全球视野、跨学科方法以及多语言、多文化背景的研究,推动计算人文学科的发展,并促进学界对文化数据化时代的新认识。

核心主题:

  • 计算与量化方法能否为我们理解数据化时代提供新的视角?

  • 如何在数据驱动的研究和分析实践构建理论?计算方法不应也不能替代严谨的研究方法论思考。

  • 人文学者能否在计算方法的标准化以及数据的文化语境化过程中发挥核心作用?

  • 如何融合批判性数据研究、批判性档案研究、计算人文学科与传统人文学术方法?

栏目设置:

  • 论文(Articles):发表经过同行评审的学术研究。

  • 数据论文(Data Essays):刊发经过同行评审的数据论文,并附上与文化研究相关的精选数据集。

  • 专题特写(Special Features):刊发更简短、更具时效性的文章,介入文化的计算分析议题,行文风格通俗易懂,面向非专业读者。这些短篇文章可以集体提交(例如围绕特定主题的圆桌讨论或专题集群),也可以采用“致编辑信”或评论文章的形式,亦或是旨在开启关于新方法、新数据集或新文章讨论的独立文章。

此外,期刊提供专题研究(Thematic Clusters),可按关键词进行检索,并接受特刊(Special Issues)的提案。

本期内容将选取《文化分析学刊》近两年间与数字人文相关的10篇论文进行介绍。

01

作为关系数据的书目元数据:一项跨学科方法论反思

Bibliographic metadata as relational data: A cross-disciplinary methodological reflection

Rossana Scebba

摘要:本文中反思了在数字/计算史学与定量经济史研究中,将书目元数据作为经验材料使用这一日益增长的跨学科共识。结合两个领域的实例,概述了预处理图书馆目录元数据的主要挑战。以旧鲁汶大学学术藏书为试点案例,展示了数据转换与准备的关键步骤,旨在协调通用流程并创建跨学科可复用资源。随后探讨了元数据如何应用于历史网络分析,讨论了其基本前提、潜在陷阱及关键建模决策。基于此分析,提出将多层网络表示作为表征书目元数据的结构忠实基础。最后,通过与定量经济史实践的比较,该文展示了采用假设驱动建模和统计推断如何回应学界对数字方法的质疑,从而推动数字史学的计算发展。

关键词:书目数据科学,数字史学,经济史,网络分析,多层网络

Abstract:In this paper, I reflect on the growing cross-disciplinary convergence around the use of bibliographic metadata as empirical material in digital/computational history and quantitative economic history. I outline the main challenges in preprocessing library catalog metadata, drawing on examples from both fields. A pilot case on the academic collection of the Old University of Louvain demonstrates key steps in data transformation and preparation, with the aim of aligning common routines and creating reusable resources across disciplines. I then examine how metadata can be applied in historical network analysis, discussing underlying premises, potential caveats, and key modeling decisions. Based on this examination, I propose a multilayer network representation as a structurally faithful base to represent bibliographic metadata. Finally, by drawing a comparison to practices in quantitative economic history, I show how adopting hypothesis-driven modeling and statistical inference can address skepticism toward digital approaches and thereby advance the computational development of digital history.

Keywords: bibliographic data science, digital history, economic history, network analysis, multilayer networks

图:地图显示了低地国家及周边地区每五十年间隔的印刷中心。气泡面积与每个城市相关的“旧藏学术藏书”中的印刷藏品数量成正比。历史边界随时间变化,数据来源于《世纪历史地图集》。

Figure:The maps show printing centers in the Low Countries and surroundings at fifty-year intervals. Bubble area is proportional to the number of printed holdings from the Collectio academica antiqua associated with each city. Historical boundaries are time-varying and drawn from the Centennia Historical Atlas.

02

微调史学家的宏观镜:Neo4j 中的中世纪韩国传记数据重用

Fine-Tuning the Historian's Macroscope: Data Reuse and Medieval Korean Biographical Records in Neo4j

Javier Cha

摘要:本文探讨了史学家“宏观镜”(macroscope)的开发与应用——这是一个基于 Neo4j 的计算框架,能够对中世纪韩国传记记录进行多尺度探索。虽然数字化极大地扩展了历史资料的获取渠道,但现有方法论难以在整合大型异构数据集的同时,保持阐释的严谨性与语境特异性。本研究展示了图数据库模型如何通过动态追踪庇护网络和亲属网络来增强历史探究。与通常会在个体细节与宏观结构模式之间造成生硬割裂的传统网络可视化工具不同,Neo4j 能够在不同分析层次之间实现无缝切换。本文阐述“宏观镜”如何帮助史学家发现被遮蔽的关系、优化分析焦点并生成新的研究问题。更广泛地,本文强调数字史学需要发展超越大规模可视化、能够批判性介入历史资料复杂性的方法论。

关键词:数字史学,韩国史,中世纪史,Neo4j,集体传记学,图数据库,宏观镜,数据重用

Abstract:This article explores the development and application of a historian’s macroscope, a computational framework that enables multiscalar exploration of medieval Korean biographical records using Neo4j. While digitization has greatly expanded access to historical sources, existing methodologies struggle to integrate large, heterogeneous datasets while maintaining interpretive rigor and contextual specificity. This research demonstrates how a graph database model enhances historical inquiry by enabling the dynamic traversing of patronage and kinship networks. Unlike conventional network visualization tools, which often impose a rigid divide between individual detail and macrostructural patterns, Neo4j facilitates seamless transitions across different levels of analysis. This discussion illustrates how the macroscope helps historians uncover obscured relationships, refine analytical focus, and generate new research questions. More broadly, it highlights the need for methodologies in digital history that move beyond large-scale visualization to critically engage with the complexities of historical sources.

Keywords:digital history, korean history, medieval history, neo4j, prosopography, graph database, macroscope, data reuse

图:截图显示了1469年与1589年功勋人物之间跨越两个节点距离的所有链接,通过类别节点进行分解以生成简化视图。

Figure:The screenshot shows all the links between merit subjects of 1469 and 1589 spanning two node distances, decomposed using category nodes to produce a simplified view.

03

量化古希腊罗马经典在现代早期英国的存在

Quantifying the Presence of Ancient Greek and Latin Classics in Early Modern Britain

Margherita Fantoli,Jukka Suomela,Toon Van Hal,Mark Depauw,Lari Virkki,Mikko Tolonen

摘要:本文探讨了在手摇印刷机时代(1470年代至1790年代)古典作品在现代早期英国的接受情况。研究考察了经典形成、知识传播以及数字档案在定量书籍史中的整合。研究通过量化方式描绘了古典经典在不同时期被认知的变化,提供了“变动中的经典”的全景视图。分析基于三个数据档案:《英文短标题目录》(ESTC)、《早期英文图书在线》(EEBO)和《十八世纪作品在线》(ECCO)。我们得出结论:可以观察到现代早期英格兰印刷的古典作者群体经历了一个“经典化”过程,这体现在出版物的多样性显著丧失,尽管古典作品的出版总量总体增加。偏好也发生了变化:古代希腊作者在18世纪获得了显著更多的空间。然而,这一发现需要与另一个观察相平衡:这一时期古希腊语原版著作的流通量并未增加。这种多维方法有助于全面理解古典学在现代早期英国的接受情况,并揭示文化和智识的转型。

关键词:古典学,现代早期英国,元数据,手摇印刷机

Abstract:This paper explores the reception of classical works in Early Modern Britain during the hand press era, between the 1470s and 1790s. It investigates canon formation, knowledge transmission, and the integration of digital archives in quantitative book history. The study quantitatively maps changing perceptions of the classical canon across time, offering a panoramic view of 'shifting canons'. The analysis is based on three data archives: the English Short Title Catalogue (ESTC), Early English Books Online (EEBO), and Eighteenth Century Collections Online (ECCO). We conclude that we can observe a “canonization” of the set of classical authors printed in Early Modern England, which is reflected in a significant loss of diversity in publications, despite a general increase of the publication of classical works. Preferences also shift, with ancient Greek authors of the early centuries gaining significantly more space in the 18th century. This finding however is balanced by the observation that the circulation of Ancient Greek editions in the original language does not increase during this time. This multidimensional approach contributes to a comprehensive understanding of the reception of Classics in Early Modern Britain, shedding light on cultural and intellectual transformations.

Keywords:Classics, Early Modern Britain, Metadata, Hand press

图:从17世纪到18世纪,28位最频繁出现的作者(蓝线)与其他作者(红线)的版本预测。点表示每十年间印刷最多的20位作者(蓝色)和其他作者(黄色)的实际计数。

Figure:Prediction of the editions of 28 most frequent authors (blue line) vs the rest of the authors (red line) from the 17th to the 18th century. The dots represent the real counts per decade of the 20 most printed authors (blue) and the others (yellow).

04

超越计算形式主义,或架构的重要性

Beyond Computational Formalism or, Architecture Matters

James E. Dobson

摘要:本文指出,尽管计算文学研究(CLS)常常宣称奉行形式主义方法论,但它并未充分重视其使用的计算模型——尤其是深度学习神经网络——形式化架构的重要性。针对学界倾向于对神经网络的运作进行流于表面的抽象概括、或将注意力过分集中在输出结果上的倾向,本文提出:架构不仅是技术细节,更是意义生成与历史性得以铭刻的关键场所。通过考察神经网络架构的谱系——从 Frank Rosenblatt 的感知机到当代基于 Transformer 的模型——本文展示了这些架构如何从物质性层面塑造机器学习模型的能力、输出结果和阐释可能性。

关键词:神经网络,形式主义,机器学习,人工智能,计算文学研究

Abstract:Despite frequently avowed commitments to formalist methodologies, computational literary studies (CLS) has insufficiently accounted for the importance of the formal architectures of the computational models it employs—particularly deep learning neural networks. Arguing against the tendency to treat neural networks with an abstract gloss of their operation or to focus attention on the outputs, this article posits that architecture is not merely a technical detail but a crucial site where meaning is made and historicity registered. By examining the genealogy of neural network architectures—from Frank Rosenblatt’s Perceptron to contemporary transformer-based models—this article demonstrates how these architectures materially shape the capacities, outputs, and interpretive possibilities of machine learning models.

Keywords:neural networks, formalism, machine learning, artificial intelligence, computational literary studies

06

生成美学:论AI诗歌中的形式僵化

Generative Aesthetics: On formal stuckness in AI verse

Ryan Heuser

摘要:本文通过一系列计算实验,考察了AI生成诗歌的形式与美学模式。通过对韵律和节奏的分析,揭示了大语言模型在其输出中表现出一种顽固的形式固着。本文证明,大语言模型往往使诗歌形式僵死,它们生成的文本在形式上趋于保守,甚至比文学史上形式最严格的时期更刻板地遵循传统诗歌惯例。本文将这一发现解释为一种追求理想化形态的计算逻辑——这种逻辑将满足形式期待置于对期待的巧妙挫败之上,将规则性置于变化之上,将趋同置于矛盾之上。本文提出“生成形式主义”作为一个批评框架,该框架扩展了传统以及量化和形式主义方法,用以理解生成系统如何处理、扁平化并物化文化生产。

关键词:人工智能,数字人文,批评理论,诗律学与诗学

Abstract:This paper examines the formal and aesthetic patterns of AI-generated poems through a series of computational experiments. Through analyses of rhyme and rhythm, it reveals how large language models (LLMs) exhibit a stubborn, formal stuckness in their outputs. The paper demonstrates that LLMs often ossify poetic forms by producing formally conservative texts that adhere more rigidly to traditional poetic conventions than even the most formally strict periods of literary history. The paper interprets these findings as evidence of a computational logic of idealization that privileges the satisfaction of formal expectation over its artful frustration, regularity over variation, and conformity over contradiction. It proposes “generative formalism” as a critical framework that extends traditional as well as quantitative and formalist methods to understand how generative systems process, flatten, and reify cultural production.

Keywords:artificial intelligence, digital humanities, critical theory, prosody and poetics

图:Chadwyck-Healey 语料库中押韵诗歌的频率与 LLM 生成诗歌的比较。生成模型被提示生成三种类型的诗歌:押韵诗、不押韵诗以及未指定是否押韵的诗。点表示平均概率;点的大小表示每个数据点对应的诗歌数量;须线表示标准误差。

Figure:Frequency of rhymed poems in the Chadwyck-Healey corpora compared with LLM-generated verse. Generative models were prompted for three types of poems: rhyming poems, unrhyming poems, and poems without specifying whether to rhyme. Points indicate mean likelihood; size indicates the number of poems per data point; whiskers show standard error.

07

情感的拉锯战:1967–2023 年中文流行歌词中情感周期的测量与建模

Tug-of-War of Emotion: Measuring and Modeling Sentiment Cycles in Chinese-Language Pop Song Lyrics, 1967-2023

Xiaolu Wang

摘要:流行音乐学者通常认为,流行歌词情感的趋势(随时间变得更积极或更消极)会“镜像”反映听众偏好或社会精神风貌的变化。例如,英文流行歌词中检测到的单调递减趋势通常被解读为“反映了”听众群体情感和精神状态的恶化,以及/或者对更消极(或更不积极)歌词偏好的增长。本研究通过提出一种替代性的“均衡解释”来挑战这种“镜像解释”。均衡解释认为,听众的平均情感偏好可能在几十年间保持大体稳定,而均衡过程要么使流行歌词的情感趋同于听众偏好,要么使歌词情感围绕听众偏好波动。为探索这一替代性解释,本研究测量并对超过26万首中文流行歌曲(1967-2023)的歌词情感运动进行了建模。为量化大量歌词的情感,本文开发了一种结合大语言模型和基于词典的情感分析的新方法,用以提取歌词中的情感信息。测量得到的平均歌词情感轨迹呈现出(阻尼)正弦波样式的模式,估计周期为34至35年。此外,本研究并未止步于识别情感模式,而是进一步构建了一个数学模型,解释形成此类模式的潜在文化过程——音乐听众与词作者之间的互动。一个简洁的阻尼谐振荡(DHO)模型能够解释中文歌词(周期性)和英文歌词(非周期性)中的歌词情感运动模式,并且模型参数经过统计估计。DHO模型对经验数据的解释力为均衡解释提供了支持。总体而言,本研究使任何试图将大众文化产品特征变化作为潜在社会心理趋势代理变量的尝试变得更为复杂。

关键词:流行音乐,情感分析,文化周期,大语言模型,自然语言处理,阻尼简谐振荡

Abstract:Scholars of popular music often assume that trends in the sentiment of pop song lyrics (becoming more positive or negative over time) “mirror” those in listeners’ preferences or the ethos of societies. For example, the detected monotone downward trend in the sentiment of English-language pop lyrics is typically interpreted as “reflecting” the deteriorating emotional and mental state in listener populations and/or the increasing demand for more negative (or less positive) lyric sentiment. This study challenges this “mirror interpretation” with an alternative “equilibration interpretation,” which posits that the average listener sentiment preference may remain largely stable across decades, and it is the equilibrating process that either brings the sentiment of pop lyrics closer to the listener preference or make the lyric sentiment oscillate around the listener preference. Exploring this alternative interpretation, this study measures and models the movement of lyric sentiment in more than 260,000 Chinese-language pop songs over six decades (1967–2023). To quantify the sentiment of a large volume of lyrics, a novel approach of combining large language model (LLM) and lexicon-based sentiment analysis is developed to extract affective information from lyrics. The resulting trajectory of measured average lyric sentiment exhibits a (damped) sine-wave-like pattern with an estimated period of 34 to 35 years. Moreover, this study does not stop at identifying sentiment patterns but goes further to build a math model that explains the possible cultural process—interactions between music listeners and lyricists—underlying the formation of such patterns. A parsimonious Damped Harmonic Oscillation (DHO) model can explicate both the periodic (in Chinese lyrics) and nonperiodic (in English lyrics) patterns of lyric sentiment movements, and the model parameters are estimated statistically. The explanatory power of the DHO model over empirical data lends support to the equilibration interpretation. In general, this study complicates any attempt to use changing features of mass cultural products as proxies for some underlying socio-psychological trends.

Keywords:popular music, sentiment analysis, cultural cycles, LLM, NLP, damped harmonic oscillation

图:年度平均歌词情感的周期性轨迹(计算过程借助 ChatGPT)。曲线周围的灰色带是 LOESS 预测情感值的 95% 置信区间。

Figure:Periodic trajectory of the yearly average lyric sentiment (calculations assisted by ChatGPT).

The gray band around the curve is the 95% confidence interval for the LOESS-predicted sentiment values.

08

莎士比亚公司项目数据集 2.0 版

Shakespeare and Company Project Data Sets, Version 2.0

Joshua Kotin, Rebecca Sutton Koeser

摘要:“莎士比亚公司项目”数据集详细描绘了两次世界大战之间 Sylvia Beach 经营的“莎士比亚公司”书店及借阅图书馆的面貌。本文概述了促成数据集重大更新的研究、数据策展和开发工作。2.0 版对 1.2 版中包含的数据集进行了细化和扩充,并新增了两个数据集,分别关注借阅图书馆流通图书的作者以及借阅图书馆成员的地址。本文应作为 2022 年发表于《文化分析学刊》的《莎士比亚公司项目数据集》一文的补充。

关键词:现代主义,文学,书籍史,图书馆,接受史,阅读,地图,人口统计,读者

Abstract:The Shakespeare and Company Project data sets provide a detailed portrait of Shakespeare and Company, Sylvia Beach’s bookshop and lending library in interwar Paris. This article outlines the research, data curation, and development that led to a major update of the data sets. Version 2.0 refines and augments the data sets included in Version 1.2, and adds two new datasets, focused on the authors of the books that circulated in the lending library and the addresses of lending library members. The article should be read as a supplement to "Shakespeare and Company Project Data Sets," published in the Journal of Cultural Analytics in 2022.

Keywords:modernism, literature, book history, libraries, reception history, reading, maps, demographics, readers

图:这张巴黎地图按区显示了成员分布,以及左岸成员占主导的情况。

Figure:This map of Paris shows members by arrondissement and the predominance of members on the Left Bank.

09

折衷主义读者

The Eclectic Reader

James English,J. D. Porter

摘要:近三十年来,折衷主义(Eclecticism)一直是文化消费社会学最核心的关注点之一,但关于读者阅读折衷主义的研究却几乎付诸阙如。我一直利用 Goodreads 的数据来弥补这一研究盲区。这项研究使我得以描述高度活跃的 Goodreads 用户在阅读习惯上呈现出的宽窄模式,这些模式在很大程度上类似于其他文化实践领域学者所发现的“杂食者(Omnivores)与单食者(Univores)”的社会分层图式。然而,我的分析也凸显了该定量模型的局限性,以及折衷主义概念本身在社会学文献中常被忽视的诸多弊端。这些问题具体涉及:折衷主义与时间性的内在关系;研究中对偏好(品味)与实践(习惯)的混淆与滑动;以及对文学和文化作品进行分类时,存在多种同样合理但不可通约(Incommensurable)的分类范式。

关键词:折衷主义,文化消费,文学社会学,经验读者研究,Goodreads,体裁,杂食者论题,阅读的时间性,文学数据研究

Abstract:Eclecticism has been among the most central concerns in the sociology of cultural consumption for 30 years, but hardly any research has been done on the eclecticism of readers. We have been using data from Goodreads to address this blind spot. Our research enables us to describe some general patterns of breadth vs narrowness in the reading habits of highly active Goodreads users, which largely resemble the socially hierarchized schema of omnivore vs univore discerned by scholars in other fields of cultural practice. But our analysis also highlights the limitations of our model, and indeed of eclecticism itself, a concept rife with problems that have have often gone unremarked in the sociological literature. These problems involve the relationship of eclecticism to temporality; the slippages between preference (taste) and practice (habit); and the sheer variety of equally legitimate but incommensurate ways to classify works of literature and culture.

Keywords:Eclecticism, cultural consumption, sociology of literature, empirical reader studies, Goodreads, genre, omnivore thesis, temporality of reading, literary data studies

图:3,209 位用户的距离得分(所有成对书籍之间平均距离)与香农得分(香农多样性指数)对比图,线条显示中位数和拟合线。颜色对应每个用户收藏中排名靠前的体裁簇。圆圈大小对应于每个用户收藏中用于计算得分的书籍数量。

Figure:Distance Score (mean of all pairwise distances between books) vs Shannon Score (Shannon diversity index) for 3,209 users, with lines showing median and fit. Color corresponds to the top genre cluster in a user’s collection. The size of a circle corresponds to the number of books in each user’s collection that were used to calculate their scores.

10

“德语虚构作品翻译映射”数据集:数据收集、范围与数据质量

The “Mapping German fiction in translation” dataset: Data collection, scope, and data quality

Lisa Teichmann

摘要:“德语虚构作品翻译映射”数据集包含 35,972 种翻译虚构作品的条目,这些作品原版以德语出版于 1980-2020 年间,作者共计 6,457 位,涉及 86 种语言。它是首个从德国国家图书馆提取的、可自由获取的书目翻译数据集(提取于 2021 和 2023 年)。该数据集是一个更大项目的一部分,该项目旨在通过翻译来映射德语虚构作品的地理与语言踪迹。项目开发了用于地理制图和网络分析的可视化工具,可在 GitHub 仓库中获得。本文中,我记录并评估了数据提取过程、编目与收藏实践以及数据质量,特别关注了所用方法的挑战与局限。

关键词:翻译,德国国家图书馆,书目数据,数据集,数字翻译史,数据质量

Abstract:The “Mapping German fiction in translation” dataset consists of 35,972 translated titles of fiction originally published in German between 1980-2020 by 6,457 authors in 86 languages. It represents the first freely available dataset of bibliographic translation data extracted from the German National Library in 2021 and 2023. The dataset is part of a project that aims at mapping the geographic and linguistic traces of German fiction by means of translation. Visualization tools for geographic mapping and network analysis have been developed which are available in a Github repository. In this paper I document and evaluate the data extraction process, cataloguing and collection practices, and data quality, with special attention to the challenges and limitations of the applied approach.

Keywords:translations, German National Library, bibliographic data, dataset, digital translation history, data quality

图:“德语虚构作品翻译映射”数据集的编译与文档工作流程。

Figure:Workflow for compiling and documenting the Mapping German fiction in translation dataset.

以上内容来自官方网站:

https://culturalanalytics.org/

经数字人文资讯小编翻译整理而成

如需转载请后台私信联系

编译丨罗斯鹏

校对丨魏翔

排版丨洪冰凤

阅读原文

跳转微信打开

  •  

专业资讯 | 欧洲文化遗产通用数据空间 (Common European Data Space for Cultural Heritage) 介绍

2026-05-15 08:30 湖北

欧洲文化遗产通用数据空间(Common European Data Space for Cultural Heritage,CE-DSH)是欧盟委员会于2021年11月10日正式启动的旗舰数字倡议,是欧盟数据战略框架下14个战略和公共利益领域数据空间之一。

该数据空间建立在Europeana欧洲数字文化平台之上,旨在为欧洲各地的博物馆、画廊、图书馆和档案馆提供一个可信、可互操作且包容的基础设施,实现文化遗产数据的跨边界、跨部门共享与再利用。它由Europeana基金会领导的联盟负责部署,通过欧盟数字欧洲计划(the DIGITAL Europe programme)提供资金支持。

一、 政策背景

2021年,欧盟数据战略提出构建单一数据市场的愿景,旨在提升欧洲全球竞争力与数据主权。在重点战略领域搭建欧盟通用、可互操作的数据空间,是该战略的核心支柱。数据空间整合各类数据基础设施与治理框架,助力数据共享,释放数据在创新、经济与社会领域的潜力。

这也是欧盟打造服务公共利益的数字基础设施、追求技术卓越与数字主权整体愿景的重要组成部分,同时坚守隐私安全、网络安全、数据伦理等欧洲核心价值观。文化遗产数据空间,正是欧盟战略性经济领域与公共事业领域可互操作数据空间生态体系的重要一环。

2021年《欧洲文化遗产通用数据空间建议书》正式发布,旨在鼓励并加速欧盟成员国文化遗产数字化与保护工作,提升数据空间内文化遗产内容供给,尤其是三维资源与高清数字资源。助力文化遗产机构把握数字化转型机遇,设定2030年高质量数据发展目标,为跨领域数据复用、创意创新奠定基础。

该政策延续了欧盟自2006年以来的文化遗产数字化投入与规划布局,彼时数字图书馆与欧洲数字文化平台倡议已初具雏形。

当下,多元包容发展,可靠、均衡的信息普惠面临挑战,而欧洲文化遗产承载着历史记忆与价值内核,为欧洲自主塑造未来发展道路提供资源支撑与灵感源泉。欧盟委员会主席冯德莱恩发布的《2024-2029年欧盟委员会政策指导方针》明确提出,要简化民众尤其是年轻一代接触、享用欧洲多元文化遗产的渠道。

地缘政治格局演变、气候环境持续恶化,促使欧洲提前布局,从网络安全与实体安全双重维度完善文化遗产数据韧性保障体系,守护各国数字化建设形成的文化遗产数据资源。

“数据开放”是欧盟2025年发布的《人工智能大陆行动计划》核心要义。该计划旨在挖掘人工智能潜力、防范技术风险,提升欧洲创新竞争力,捍卫民主价值观,保护文化与语言多样性。同时强调,可信、高质量、可互操作的数据集是人工智能安全合规落地的关键支撑。作为2025年11月《数据联盟战略》中“人工智能优质数据计划”的重要内容,欧洲超3000万件文化机构数字化藏品将向人工智能研发开放,扩充欧盟文化与语言资源库。

此外,欧洲文化遗产通用数据空间建设,被纳入欧盟文化战略框架《文化罗盘》20项旗舰行动之一,助力提升欧盟竞争力、发展韧性与社会凝聚力。

二、 发展历史——从“欧洲数字文化平台”到“欧洲文化遗产通用数据空间”

“欧洲文化遗产通用数据空间”是欧盟旗舰项目,旨在推动欧洲文化领域数字化转型,赋能数字文化遗产内容创作与复用。其建设深度依托过去二十年间欧洲数字文化平台倡议在欧盟委员会及各成员国政资支持下取得的各项成果。

“欧洲数字文化平台”构想始于2005年,由六国国家元首及政府首脑向欧盟委员会提议打造欧洲数字图书馆。2008年,欧洲数字文化平台官方门户正式上线,成为欧洲数字文化遗产统一访问入口。欧洲数字文化平台基金会作为独立非营利机构在荷兰成立,负责统筹项目建设与运营。

伴随文化遗产行业数字化转型,该平台不断迭代升级,如今已成为欧盟官方标杆性数字文化遗产门户,支持欧盟所有官方语言访问。

2017-2022年,依托欧洲联通设施计划资助,欧洲数字文化平台数字服务基础设施完成搭建与扩容。除门户资源访问功能外,应用程序编程接口及其他机器可读接口,支持数据提供商的元数据与数字资产在教育、科研及其他场景中复用。

多年来,欧洲文化遗产行业联合制定完善数据模型、授权发布规范等标准框架,实现元数据互操作、高质量数据归集与版权信息明晰化。相关标准不仅获得欧洲行业认可,更在全球范围内推广应用。

2022年,依托欧洲数字文化平台数字服务基础设施及2020-2025年战略规划,在欧洲数字化计划资金支持下,“欧洲文化遗产通用数据空间”正式启动建设。凭借深厚发展积淀,该数据空间成为欧盟为数不多的已投入实际运营的行业数据空间。

截至2025年,该数据空间已汇聚欧洲3200余家博物馆、图书馆、档案馆、美术馆的6100余万件数字化文化遗产资源,涵盖艺术品、历史文献、古迹遗址、文物藏品等类型。文化机构共享的数字资产中,约80%可实现不同形式的二次复用。

欧洲数字文化平台成熟的行业社群为数据空间发展提供坚实支撑:数千家文化遗产机构开放数字资源;平台聚合商论坛汇聚国家级、区域级、专题类认证聚合机构,助力中小机构数据共享与经验交流;欧洲数字文化平台网络协会集结近6000名行业专业人士,跨领域提供专业建议,深度参与数据空间建设。

各成员国积极参与并支持数据空间建设,其代表与欧盟委员会共同组成专家组,主导数据空间治理工作。同时成员国联合开展全欧文化推广活动,如“文化三维复刻计划”,汇聚欧洲标志性古迹、遗址与文物的高精度三维模型,欧盟轮值主席国持续为项目提供支持。

图:欧洲数字技术栈灵感源自欧洲栈(EuroStack)——数字主权的欧洲替代方案

图源:denkschets.nl

三、 发展现状与未来方向

欧洲文化遗产通用数据空间发展环境持续演变,机遇与挑战并存,深刻影响其2030年发展愿景与核心布局。

1. 发展机遇

(1) 创新技术赋能数据空间扩容,深挖文化遗产数据价值;丰富多元的数据资源催生全新应用场景,为数据持有方与跨行业使用者创造经济价值。

(2) 大数据、人工智能、三维建模、沉浸式技术等新兴技术门槛持续降低,可精准匹配文化遗产行业发展需求。

(3) 欧洲各国、欧盟层面及国际文化遗产相关倡议生态持续壮大;强化协同联动与系统互操作性,是实现大规模数据可持续复用、巩固数据空间标杆地位的关键。

(4) 围绕数据空间形成的文化遗产机构、认证聚合商、数字文创从业者社群不断壮大,成为推动行业数字化转型的重要助力。

相关配套倡议:欧洲文化遗产协作云、欧洲开放科学云、欧洲语言技术联盟、时光机器组织、欧洲创新与技术研究院文化创意板块,以及旅游、传媒等领域专项数据空间。

2. 现存挑战

(1) 人工智能等颠覆性技术快速迭代,对高质量数据需求激增;文化遗产机构愈发希望自主掌控数字数据复用规则,尤其是可商业化变现的数据使用权限。

(2) 中小文化遗产机构缺乏新兴技术应用能力,亟需常态化科普宣传、能力建设与技能培训,缩小数字技能鸿沟。

(3) 各类文化遗产相关倡议各自为战、壁垒森严,难以联动发展;需深化跨界合作,打破行业隔阂,实现资源协同与互联互通。

(4) 部分成员国未将文化遗产数字化纳入国家重点规划、资金投入不足,导致2030年数据空间资源建设目标进度滞后。

2030年前,数据空间将立足机遇、破解挑战:持续归集可信高质量文化遗产内容,依托欧洲数字文化平台门户开放资源,通过应用程序编程接口拓宽大众及行业复用渠道;搭建统一数据目录,实现多源异构数据集溯源式检索;建立数据供需方去中心化交换机制,打通与其他数据空间、行业倡议的互操作通道,适配多类型数据流转与多元使用规则。

四、 发展愿景

打造欧洲文化遗产通用数据空间,实现四大目标:

(1) 持续开放文化遗产资源,推动全民普惠访问;

(2) 优化数据流转体系,赋能欧洲价值创造、产业创新与竞争力提升;

(3) 适配参与主体需求与前沿技术发展趋势,动态迭代升级;

(4) 凝聚多元行业社群,依托可信治理模式、坚守伦理准则与以人为本的数字理念,助力文化遗产行业数字化转型。

五、 三大核心优先事项

2025-2030年战略围绕三大核心优先事项展开,同时贯穿三大横向核心主题,全面支撑数据空间落地、扩容与长效发展:

1. 横向主题

(1) 人工智能:挖掘人工智能在文化遗产数据应用的潜力,同时以文化遗产数据赋能欧洲人工智能产业发展;

(2) 三维与扩展现实:三维数字化是受损文化遗产保护修复的核心手段,结合扩展现实技术可打造沉浸式体验,活化欧洲文化遗产;

(3) 多语言服务:坚守欧洲文化与语言多样性,保障所有民众可使用母语无障碍访问数据空间资源。

2. 优先事项一:构建稳健可互操作的数据空间基础设施,提升数据多样性与质量

聚焦数据空间扩容升级,筑牢基础设施、标准框架与治理体系,丰富高质量、多类型文化遗产数据供给。

核心痛点

(1) 文化遗产及其他领域数据空间需适配全球化、分布式、跨学科数据交互,实现不同主体、数据类型、语言体系、法律伦理规则的融合互通;

(2) 数字化进程中数据类型迭代加快,老旧数据淘汰、新型数据涌现,需丰富数据粒度、数据类型与共享机制;

(3) 数据开放与人工智能普及背景下,数据溯源、完整性保护、防滥用需求凸显,同时需挖掘文化遗产数据商业价值,助力机构创新商业模式;

(4) 需简化机构数据共享流程,制定可落地的数据共享与融合规范,遵循FAIR数据原则(可检索、可访问、可互操作、可复用)与CARE数据原则(集体普惠、管控权属、责任担当、伦理合规)。

发展目标

(1) 完善并扩容基础设施、标准框架与工具,创新数据共享模式,兼容多元文化遗产数据类型

维护现有数据归集基础设施与标准工具,依托聚合商网络助力机构上传高质量资源;搭建统一数据目录,适配多领域、多用户差异化需求,兼顾数据互联互通与国家数据主权;落地去中心化溯源共享机制,扩大参与主体范围;增设人工智能专用机器可读标识,明确资源版权、来源与使用范围,规范人工智能内容生成与解读行为。

(2) 完善治理机制,保障基础设施、数据、工具与服务的互操作性

优先对接欧盟其他通用数据空间及各国、区域相关倡议,依托通用标准、协议与中间件平台,搭建永久标识符体系,确保数据可溯源、可信任;完善统一政策法规与访问权限保护规则,衔接数据保护、知识产权、竞争法、网络安全等通用法律框架,制定公平可扩展的数据共享规范,适配多元数据、工具与服务场景。

(3) 扩充多语言、高质量、三维及特色数据集

联合全球文化机构、博物馆、图书馆、档案馆及科研院所,持续供给权威可溯源、多语言、高质量文化遗产资源;重点收录濒危文化遗产、热门古迹遗址的三维数字模型,加大数字化程度较低的文化领域资源建设力度;对标2021年建议书2030年发展目标,新增高清数字档案与三维资产,通过数据空间目录开放溯源数据集共享。

3. 优先事项二:简化文化遗产数据访问渠道,推动跨领域复用

聚焦释放数据空间价值,提供多语言便捷访问服务,依托场景化应用,实现文化遗产可信数据跨行业复用。

核心痛点

(1) 技术壁垒、版权限制、授权规则模糊,制约数据访问与二次复用;缺乏统一技术标准与机器可读版权元数据;

(2) 欧盟拥有24种官方语言,语言隔阂严重影响文化遗产资源普惠访问;

(3) 欧洲各类文化数据倡议林立,需强化跨界协作,释放海量数据的创新价值。

发展目标

(1) 打造多语言便捷访问通道,开放可信文化遗产数据

依托欧洲数字文化平台门户,持续面向文化从业者、科研人员、数据科学家及普通民众开放多元文化馆藏;打造专题内容与线上数字展览,拉近民众与欧洲共同历史文化的距离;优化应用程序编程接口与数字工具包,强化检索发现功能,赋能开发者、创作者二次开发;运用人工智能翻译技术,完善24种官方语言全场景服务,实现民众母语无障碍访问。

(2) 以需求为导向打造全新应用场景,拓宽数据复用边界

开放多元可信文化遗产数据,围绕市场需求定制数据集与工具包;借助人工智能、机器学习实现文化数据智能富集、语义检索优化,提升数据可发现性;依托文化遗产数据训练欧洲人工智能模型,留存欧洲文化与语言多样性;通过三维建模与扩展现实技术打造古迹、文物、艺术品沉浸式虚拟体验;兼顾开放数据与授权受限数据的融合复用,创新商业模式与应用场景。

(3) 构建跨界合作生态,赋能数据复用创新

联动文化遗产机构、科研院所、文创产业,对接旅游、传媒、教育、文娱、科技等行业及普通民众;搭建长期可信伙伴关系,依托数据治理、资源适配与工具支撑,匹配不同用户数据需求;引导文创产业将遗产数据融入数字叙事、游戏开发、沉浸式体验,挖掘经济与教育价值;通过黑客马拉松、行业竞赛等形式,推动数据可视化、扩展现实开发、人工智能数据分析等技术创新;深化与其他数据空间及大型行业倡议的联动协作。

4. 优先事项三:通过能力建设、网络联动与创新赋能文化遗产行业数字化转型

以实操化、体系化、可持续方式推进行业数字化转型,为机构与社会带来切实经济与社会效益。

核心痛点

(1) 文化遗产数字化缺乏统一的数据采集、元数据架构、长期保存标准,无成熟认证工作流程保障数字资产真实性、精准性与长效可访问性;

(2) 机构数字技能鸿沟突出,中小机构、民间组织缺乏数字化馆藏、数字保护、人工智能及三维技术应用能力;

(3) 欧洲各国、区域、机构间存在数字发展失衡,行业、学术、文创、科技领域协作碎片化,经验共享不足,创新受阻;

(4) 政策制定者对数字化转型价值认知参差不齐,资金投入规划缺乏长期性与稳定性;欧盟战略与各国落地实施衔接不畅,难以规模化推广创新成果。

发展目标

(1) 牵头制定数字化、数据保护与共享通用标准框架

出台数字化采集、元数据标注、辅助元数据架构、数字资源保存统一标准;适配新兴技术需求,制定人工智能内容策划、数字叙事、非物质文化遗产数字化呈现等认证工作流程;对接欧盟法律法规,保障欧盟资助文化遗产项目标准统一、长期可用与互操作;以通用标准支撑去中心化数据共享,规范目录编撰、数据质量合规、参与者身份认证,融入欧盟数据空间生态体系。

(2) 合规普及人工智能、扩展现实、三维建模、关联开放数据等新兴技术

坚持让新兴技术赋能文化遗产保护传承,而非取而代之;制定人工智能、三维建模、扩展现实在文化遗产领域应用指南与关键绩效指标;搭建人工智能伦理治理框架,规范自动化技术、人工智能元数据生成、数字叙事的合规应用;面向行业从业者推出多语言培训课程与工具,推动文化机构、科研院校、文创产业跨界知识流转与技术普及。

(3) 以包容性建设补齐能力短板

面向全规模机构普及数字工具与技能培训,重点扶持中小机构、资金不足组织及小众社群;根据各成员国机构数字化成熟度,推行分阶段技术落地;依托欧洲数字文化平台网络协会,搭建行业交流、导师帮扶、同业学习机制,缩小机构间数字发展差距。

(4) 联动成员国落实2021年建议书发展目标

依托国家级、区域级、专题级数据聚合商、文化遗产机构及各国项目工作组,深化成员国协作;深入拓展数据空间本地网络,强化区域社群支撑,加大小语种资源建设力度,提升行业规模化、可持续发展能力;联合欧盟轮值主席国,持续开展全欧文化推广活动,放大政策落地成效。

(5) 探索长期投资、制度保障与可持续运营模式

搭建欧盟及各国文化遗产数字化永久治理架构,争取成员国稳定政策与资金支持;探索可持续运营与商业模式,依托场景化应用实现价值共创与收益闭环,保障数据空间长效运转。

六、 收藏介绍

1. 迁徙

人类一直在从一个地方迁移到另一个地方。了解著名移民的故事,以及普通人往返欧洲、在欧洲境内的旅程与生活。

2. 时尚

探索历史与当代时尚,以及它们如何影响我们的服装、鞋子、配饰和风格。探索草图、设计和服装,以及T台照片、目录和视频。

3. 考古学

探索文物和发掘,了解考古学家对人类历史和史前史的研究。

4. 艺术

探索艺术家和艺术运动,发现艺术及其绘画、素描、版画和雕塑的历史故事。

5. 工业遗产

探索技术与工业的历史,从工业革命到工业家、经济学家及普通职场生活的故事。

6. 手稿

探索手工制作的书面材料,从纸莎草到纸张。探索从古代到早期印刷时代的文本、插图及其背后人物。

7. 地图与地理

探索地球的物理和人类特征。发现地图和制图者、风景以及那些曾经探索过这些景观的人们。

8. 音乐

探索录音、乐谱、乐器和音乐风格,以及作曲家和表演者。

9. 自然历史

通过绘画、照片和标本的文字,以及研究它们的生物学家和植物学家,探索对动植物的研究。

10. 报纸

探索1618年至1980年代的印刷出版物。了解标题、全文文章、广告及其背后的作者。

11. 摄影

探索摄影的历史,发现令人惊叹的影像,并了解背后那些摄影师。

12. 体育

探索体育和运动员的历史,通过照片、影片、声音录音和文字记录从日常经历到奥运荣耀的高峰。

13. 第一次世界大战

通过官方历史、政治和宣传,探索1914-1918年的事件,以及前线和后方未被讲述的个人故事。

以上内容来自官方网站:

https://www.dataspace-culturalheritage.eu/en

经数字人文资讯小编翻译整理而成

如需转载请后台私信联系

编译丨洪冰凤

校对丨罗斯鹏

排版丨魏翔

阅读原文

跳转微信打开

  •  

专业资讯 | 宗教书籍规范索引(CRTA)介绍

2026-05-08 08:00 湖北

CRTA,即Chinese Religious Text Authority(宗教书籍规范索引),是一个面向中国宗教文献研究的开放式书目与学术信息平台。

一、CRTA简介

CRTA,即Chinese Religious Text Authority(宗教书籍规范索引),是一个面向中国宗教文献研究的开放式书目与学术信息平台。它的核心目标并不是提供单一文本的全文阅读,而是为1949年以前产生的中国宗教文献建立可靠、可检索、可关联的资料索引。该项目提供有关中国宗教文本的可靠书目和学术信息,重点关注1949年前的中国宗教文献;截至2026年4月,平台已收录超过6230条记录。

1.CRTA的意义

CRTA的重要性首先体现在它对中国宗教文献的规范化整理。中国宗教文本,尤其是晚明以来的善书、宝卷、道教文献、民间宗教经卷、佛教期刊、寺观志及各类地方性宗教印刷品,长期分散在不同丛书、图书馆、私人收藏和数字资源中。研究者常常面对同一文本多种题名、不同版本、不同收藏地点和复杂出版信息的问题。CRTA试图通过统一的条目结构,将题名、拼音、出版年代、出版地点、文本格式、作者或编者、出版者、所属丛书和馆藏来源等信息集中起来,使研究者能够跨越单一馆藏或单一丛书的限制,对宗教文本进行系统检索和比较。其高级检索页面也显示,用户可以按题名、拼音、出版地点、文本形态、作者、出版者和年代等字段检索条目。

CRTA将传统文献学中的目录、版本、题名和馆藏信息转化为结构化数据。传统研究往往依赖个别目录、馆藏记录或研究者手工比对,而CRTA把这些信息放入一个可查询的数据库环境中,使文本之间的关系可以被系统观察。其次,CRTA的目标之一是连接不同收藏、档案和私人图书馆中的书目信息,并进一步描绘宗教文本生产者、出版者和传播者之间的关系网络。项目说明称,CRTA旨在连接跨收藏、跨档案、跨私人图书馆的书目信息,以呈现宗教文本生产、出版和流通者之间更细致的关系网络。这正是数字人文方法的典型方向:不是只阅读单篇文本,而是通过结构化资料揭示大规模文本群中的模式、关系和流动路径。

2.CRTA的研究范围

从研究范围看,CRTA覆盖中国宗教书籍文化。首页列出的资料来源包括《道藏》《藏外道书》《民间宝卷》《明清民间宗教经卷文献》《善书宝卷研究丛书》《中国民间信仰资料汇编》《中国佛教期刊》等多个大型文本集合,也包括哈佛燕京图书馆、法国国家图书馆、德国巴伐利亚州立图书馆、日本国立国会图书馆、中国国家图书馆、韩国藏书阁、早稻田大学图书馆等机构馆藏。这说明CRTA的对象不是某一种宗教传统内部的经典目录,而是中国宗教出版、流通和收藏网络中的文本整体。

3.CRTA的数据开放

其开放数据页面说明,CRTA wiki的内容以XML格式提供下载,并在每月月初打包更新。这使CRTA不只是一个线上查询工具,也可以成为数字研究的基础数据源。研究者可以下载XML数据,对条目进行再加工,例如统计某类宗教文本的出版年代分布、分析不同地域的出版中心、追踪某类宝卷或善书的传播路径,或者结合GIS、网络分析和数据库技术考察文本、人物、机构、地点之间的关系。

二、用户指南

基础功能应用

1. 为新条目创建红色链接

(1) 首先在已有合集页面上创建新条目的链接。

(2) 在包含目标文本的合集页面点击编辑按钮。

(3) 进入编辑界面后,在编辑窗口内滚动文本,找到待新增条目的对应行。

(4) 如需新建链接,请依照以下规范,将文本标题替换为新条目名称:

  • 使用文本标题作为条目标题。

  • 不要加入朝代、编者姓名、卷数,或文献集页面上可能出现的其他附加信息。

  • 例如,潘公免灾宝卷 应写作:
    潘公免灾宝卷 - J202
    即:标题、一个空格、短横线、一个空格、文献集与索引号。

(5) 使用双方括号包裹条目名称与编号,即为站内页面链接代码,示例:[[潘公免灾寶卷 - J202]]。

(6) 滑动至编辑页面底部,点击保存修改。

(7) 此时将返回合集页面,原黑色文字位置会变为红色链接;红色链接代表该条目页面尚未创建。

2. 创建新条目

(1) 点击新条目的红色链接,会进入一个标题为“Creating[你的条目标题]”的页面。

(2) 在新的浏览器标签页中打开Guide:Mock Entry,点击Edit,选中编辑框中的全部代码并复制。Windows系统使用Ctrl+C,Mac系统使用Command+C。

(3) 回到新条目的浏览器标签页,将复制的代码粘贴到编辑框中。之后可以关闭Mock Entry的标签页。

(4) 现在已经有了一个条目的基本结构,但还需要加入自己的数据,并替换所有占位数据。

3. 添加信息框数据

信息框数据会显示在条目右上角的一个小框中。这里输入的数据会被加入数据库,并可通过关键词检索。没有证据支持的数据不建议加入。如果某些贡献者只是推测的,或不确定的出版日期,可把这些内容加入下一节。括号中的附加信息也不支持加入,例如贡献者的朝代名,如(唐)。

在编辑框中,找到Item_infobox部分,并按以下说明逐行替换占位数据。不要更改每一行开头的代码,只需要在等号“=”后添加数据。列举多个字符串时,避免使用中文顿号或中文逗号,应使用英文逗号。

4. 添加条目数据

Item Data部分包含关于文本的自由格式信息。贡献者可以在这里对Item Infobox模板中列出的基本数据作进一步说明。

点击页面顶部的Edit链接,回到编辑窗口。在已经完成的信息框模板之后、__TOC__这一行之前,添加一段简短的条目描述,说明该文本的基本信息。长度不要超过三句话。

之后,可按照以下指南,用来自文本本身的数据替换Item Data模板中的占位内容。如果某个字段没有清晰资料,可留空,不建议填写“No information”或类似表述。这些条目可以很简略,也可以很详细。最低限度上,它们应说明信息框中数据所涉及的任何歧义或复杂情况。

Item_data字段说明:

5. 上传并添加图片

理想情况下,如果有合适图片,条目应提供一张代表性图像作为作品的封面或题名页。

(1) 截取文本封面页或题名页的图片,选择其中更具代表性的一种。将图片缩放,或转换为索引色,大小小于1MB,并保存为jpg或png文件。

(2) 在浏览器新标签页中打开Special : Upload页面。也可以在另一个标签页或窗口中打开主页,然后点击页面最左侧的Upload File。如果需要在上传页面和条目页面之间来回切换,这种方式会更方便。

(3) 点击Browse,在电脑中找到该图片。

(4) 在Destination filename中,可以把文件名从普通的默认文件名改成更便于之后使用的名称,例如:
PanGongBaojuan1865.jpg

(5) 在Summary中,可以简要说明这张图片是什么。如果它只是书籍封面,则不一定需要说明。但如果以后想添加更多图片,在这里说明图片内容和来源会有帮助。

(6) 点击Upload File。上传完成后,会被带到该文件新建的wiki页面。

(7) 编辑新条目,滚动到条目开头附近信息框代码中的|image=这一行。

(8) 将信息框中的No cover.png替换为上传图片的文件名。注意保留开头的File:。

(9) 保存条目,以提交这些更改。

用户创建新条目

1. 点击红色链接到新作品,将进入一个名为“创建[您的作品标题]”的页面。

2. 在新的浏览器标签页中,打开“Guide:Mock Entry”,点击编辑,选择编辑框中的所有代码并复制(Windows上按Ctrl+C;Mac上的Command+C)

3. 返回浏览器标签页,带着新条目,并将代码粘贴到编辑框中;可以关闭带有模拟条目功能的标签页

4. 有了条目的基本结构,但需要添加自己的数据并替换任何占位数据

5. 回到正在创建新条目的浏览器标签页,将刚才复制的代码粘贴到编辑框中。完成粘贴后,可以关闭Mock Entry的标签页。

6. 新条目已经具备了一个基本结构,但这只是模板结构。接下来还需要加入自己的文本资料,并替换模板中的所有占位内容。

这一步的目的不是完成条目,而是先把CRTA条目的标准框架复制到新页面中。之后的工作才是根据手中的纸本文献或扫描本,逐项填写题名、拼音、出版地点、作者、年代、馆藏来源和其他说明信息

7. 操作提示:在复制Mock Entry时,需要选中编辑框中的全部代码,然后把这些代码完整复制并粘贴到新条目页面中。不要只复制页面显示出来的普通文字,因为条目格式依赖MediaWiki源代码。

条目页面示例

三、当前文本集

四、数据开源

CRTA wiki的内容以XML格式提供下载。数据会在每月月初打包更新,供用户下载。

可复制并粘贴以下链接,并将其中的 YYYY 和 MM 替换为最近的年份和月份:

五、MediaWiki

MediaWiki是一种用于建立wiki网站的开源软件。简单说,它不是一个普通网页编辑器,而是一套可以让多人共同创建、编辑、修订、链接和管理知识内容的平台。最著名的例子就是Wikipedia。MediaWiki官方说明也指出,Wikipedia正是建立在MediaWiki软件之上的;它是免费的、基于服务器运行的wiki软件,并以GNU GPL协议授权。

从技术层面看,MediaWiki用PHP处理网页内容,并把页面数据储存在数据库中,例如MySQL。它的核心特点是:页面可以不断被编辑,但旧版本不会被直接删除。每一次修改都会留下历史记录,因此用户可以查看版本差异,也可以在出错、误删或遭到破坏性编辑时恢复旧版本。MediaWiki还可以管理图片和多媒体文件,并通过扩展功能处理更复杂的内容,例如结构化数据。

MediaWiki最重要的功能之一是它的wikitext语法。用户不一定需要懂HTML或CSS,也可以通过相对简单的标记语言编辑页面。例如,双方括号可以创建内部链接,单方括号可以创建外部链接,撇号可以控制斜体或粗体,表格、脚注、分类、模板等也都有固定写法。这一点对CRTA这类学术资料平台很重要,因为它让研究者可以在不直接写网页代码的情况下,创建规范化条目、加入书目信息、上传图片、建立文本之间的链接。

MediaWiki的官方帮助页把使用功能分成几个主要部分:阅读、编辑、高级编辑、协作、个人设置和wiki管理。阅读功能包括搜索、导航、页面历史、版本差异和打印;编辑功能包括登录、编辑页面、预览、撤销、编辑摘要、新建页面、格式设置、链接、用户页、讨论页和签名;高级编辑则包括图片、列表、URL、脚注、表格、分类、子页面、文件管理、页面移动、复位向、保护页面、模板、特殊页面和导出等功能。

因此,MediaWiki的价值不只是“可以编辑网页”。它真正强大的地方在于,它把网页内容变成一个可追踪、可协作、可链接、可扩展的知识系统。一个普通网站通常由管理员发布内容,读者只能阅读;而MediaWiki允许授权用户持续补充、修订、讨论和维护内容。每个页面都不是孤立的,而是可以通过内部链接、分类、模板和页面历史加入一个更大的知识网络。

放到CRTA的语境中,MediaWiki的作用尤其清楚。CRTA的条目创建依赖典型的MediaWiki机制:红色链接表示页面尚未创建;点击红色链接可以新建条目;条目通过模板和信息框录入结构化资料;内部链接把文本、文献集、作者、馆藏和用户页面连接起来;图片上传功能可以加入封面或题名页;页面历史则可以记录不同贡献者对条目的修改过程。换言之,CRTA不是简单地把资料放在网上,而是利用MediaWiki建立一个可以持续扩充、修订和互相链接的宗教文献知识平台。

从数字人文角度看,MediaWiki很适合文献目录、知识库、项目手册和协作型数据库。它既保留传统文献学所重视的条目、版本、题名、馆藏、注释和参考书目,又通过数字平台把这些信息组织成可检索、可维护、可链接的资料网络。它的弱点也很明确:如果缺乏统一规范,条目格式容易混乱;如果没有编辑规则,资料质量会不稳定;如果权限管理过松,也可能出现误改或破坏性编辑。所以,一个成功的MediaWiki项目通常不仅需要软件本身,还需要清楚的编辑指南、字段规范、引用规则和维护机制。

对Wikipedia来说,它支撑百科知识的开放编辑;对CRTA来说,它支撑宗教文献书目资料的规范化整理;对数字人文项目来说,它提供了一种成本较低、可扩展性强、适合多人协作的知识管理框架。

六、最近更新

1.最近更新的文本条目

密乘课本-I121

密宗法语-I120

妙绘赞释-I117

上师无上供养观行法-I116

觉世新新-H169

吕祖本愿经-H168

孚佑帝君真经-H167

指路宝筏-H166

2. 最近更新的神明页面

赤松道人

启窍星君

石真官

丽农夫子

普济真人

玄真古佛

慈悲大仙

黄龙真人

西眉古佛

铁骨禅师

梧桐古佛

长寿古佛

文通古佛

福禄寿星

长眉大仙

灵祖大帝

镇魔大帝

玉液真人

皓月当空佛

无量度世古佛

无极天尊

吕祖

以上内容来自官网

https://crta.info/wiki/Main_Page

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编辑丨魏翔

校对丨洪冰凤

排版丨罗斯鹏

阅读原文

跳转微信打开

  •  

论文征集|第四届粤港澳大湾区跨学科博士论坛:数字驱动的社会公平:技术、身份与人文的研究

澳大高研院 2026-05-08 08:00 湖北

第四届粤港澳大湾区跨学科博士论坛现已正式启动征稿

由澳门大学人文社科高等研究院主办的第四届粤港澳大湾区跨学科博士论坛现已正式启动征稿。本届论坛以「数字驱动的社会公平:技术、身份与人文的研究」为主题,延续前三届论坛推动跨学科对话的宗旨,致力于搭建一个响应全球性挑战、探索未来发展方向的重要学术平台。在数字化快速发展的当代,「数字驱动的社会公平」已成为我们共同面对的重大课题。我们需要深入剖析技术系统中隐含的权力结构,审视数字身份如何重塑公民权利,并在工具理性之外重新确立人文关怀与社会责任的价值坐标。本届论坛将继续促进跨学科视野的融合,汇聚人文、社会、科技等多元领域的智慧与方法,共同探索兼具有创新意义与实践可能的研究方案,为建设可持续、公平且包容的未来社会贡献学术力量。

论坛目标

本届论坛面向在读及即将毕业的博士生,议题涵盖人文、社会科学、自然科学与技术科学等多个学科领域,旨在为青年学者提供一个跨学科交流与合作的平台。参与者将有机会展示研究成果、交流学术思想,并与不同领域的青年学者及知名专家深入对话,获得宝贵的建设性意见。论坛不仅能促进学术思想的碰撞,还致力于构建跨学科的学术网络,拓展青年研究者的学术视野,建立长期合作关系,并以创新观点响应全球面临的挑战。

论坛分议题

(包括但不限于以下方向)

  • 数字素养

  • 数字公平与政府治理

  • 数字身份与公民权利

  • 数字正义与平台劳动

  • 数字福祉与社会

  • 算法偏见与排斥

  • 公平机器学习实践

  • 量子计算与法律

鉴于议题的广泛性,论坛将设置中英文双语分论坛,以确保来自全球的学者能充分参与与交流。

投稿与参会指南

1. 投稿对象

欢迎所有在人文、社会科学、自然科学、技术科学等领域从事研究的在读及即将毕业的博士生投稿。

2. 论文要求

  • 语言:英文或中文

  • 篇幅:7,000 – 10,000字

  • 格式要求

  • 英文稿件请遵循『牛津格式』(Oxford Style)。相关写作规范请阅读全文。

  • 中文稿件请参照『南国学术-澳门大学学报』。相关写作规范请阅读全文。

  • 投稿形式:请扫海报上的二维码,填写个人资料并提交论文全文及个人简介。

  • 原创性:论文须为原创且未发表,组委会保留查重与学术审核之权利。

  • 入选优秀论文将有机会在人文社科高等研究院出版之刊物『数字素养研究』中审议发表。

3. 个人简介

  • 字数:150-200字

  • 语言须与论文一致(英文或中文)

  • 含作者学术背景、研究兴趣及近期成果

4. 保密条款

组委会承诺对所有提交的论文与个人资料严格保密。

参会事宜

1. 免费参会

本次论坛对所有参与者免费开放,不收取任何参会费用。

2. 优秀论文评选与现场报告

组委会将评选出优秀论文,并邀请作者于论坛期间在澳门大学现场汇报研究成果。受邀报告者之在澳期间住宿及餐饮费用将由组委会承担。

重要日期

  • 5月31日:征稿截止日期

  • 6月15日:入选通知

  • 8月26日至27日: 论坛举辩日期

联络方式

本文转载自澳门大学人文社科高等研究院官方推送,有关论坛更多内容,请点击阅读全文。如果您有任何疑问,请通过电子邮件的方式随时与我们联系:iash@mail.sysu.edu.cn。

我们诚挚邀请各位博士生踊跃投稿与参与,共同在技术与人文的交汇处,探寻数字时代的公平与未来。

来源|澳大高研院UMIAS

已获转载授权

阅读原文

跳转微信打开

  •  

会议通知|“大哉言数:AI时代人文研究的范式重构与价值回归”研讨会暨2026年中国数字人文年会(CDH2026)会议通知(第二号)

2026-05-01 15:56 湖北

摘要与海报征集5月10日截止

点击蓝字 关注我们

时间:2026年7月31日-8月3日

地点:内蒙古师范大学

    当前,人工智能与大数据技术正深刻重塑人文学科的知识生产方式与价值判断框架。“数”之一字,贯通古今:从古人“参天量地”的度量智慧,到今日数据驱动的数字人文,数字化浪潮不仅为人文学科开辟了全新的研究范式,更在“言数”之间激发了对文明演进、文化传承与社会治理的深层追问。

    在此背景下,中国索引学会数字人文专业委员会、内蒙古师范大学科学技术史研究院将以“大哉言数:AI时代人文研究的范式重构与价值回归”为主题共同主办2026年中国数字人文年会(CDH2026)。会议将邀请知名专家学者,围绕数字人文及相关领域的前沿问题,开展主旨发言、会议报告、专题讨论、案例分享、数字人文空间展演、海报展示等多种形式的学术交流活动。现诚挚邀请数字人文领域专家、学者与学生莅临会议,共探AI时代人文研究的范式重构与价值回归,为数字人文发展注入新动能。

一、 会议议题

包括但不限于:

1.典籍重光:科技古籍与多民族文献的智慧化整理

2.时空重构:GIS与时空大数据驱动的文明演进研究

3.协智重塑:多智能体与具身智能的人文社会仿真

4.谱系重绘:知识图谱与智能注释驱动的知识重组

5.记忆重述:AIGC赋能下的文化遗产与艺术创新

6.文脉重析:计量方法与主题模型的文本深度挖掘

7.伦理重思:数字人文中的算法批判与负责任创新

8.素养重育:数字人文课程体系与跨学科人才培养

9.数字人文学科建设

二、 会议信息

1.会议时间:

2026年7月31日至2026年8月3日

2.会议地点:

内蒙古师范大学(呼和浩特市赛罕区昭乌达路81号)

3.会议注册:

本次会议将于2026年6月开放注册报名。

注册费:1500元(6月30日之前早鸟价1000元),学生价800元,获会议录用宣讲论文/海报/项目作者一人可免注册费,如多于一人则需按增加人数缴纳注册费。参会代表交通食宿自理。

三、 征文征集

1.会议征文对象为数字人文相关专业的专家、学者与在读学生。

2.论文要求为:作品原创,未发表;中文、英文皆可;问题明确、方法严谨、论证充分、引用规范、观点新颖。

3.征文分为两轮,第一轮为论文摘要和海报征集,第二轮为入选论文全文提交,具体要求如下:

(1)论文摘要需包含中英文标题、摘要、关键词、作者姓名、作者单位、作者简介(姓名、单位、年级、邮箱、手机号码、研究方向等),摘要内容不少于500字。

(2)海报需以PPT格式制作,页面设置为90cm*120cm,纵向布局。

(3)论文全文格式可参考附件“CDH2026论文格式规范与要求”,正文字数为7000-15000字。

4.组委会将邀请国内知名学者组成专家评审组,对提交的论文开展严格评审,从中选出高水平学术论文在会议上进行交流和专家点评。

5.论文提交邮箱:20250051@imnu.edu.cn。邮件标题格式为“CDH2026论文摘要/全文-姓名-单位”。

6.摘要提交截止时间:2026年5月10日

摘要录用通知时间:2026年5月30日

论文全文提交截止时间:2026年6月30日

四、 项目征集

1.本次会议征集项目为中文或中国主题的数字人文研究项目,包括但不限于数据库、软件工具、数字平台、可视化作品、XR交互设计作品、大模型及智能体应用等。所征集的项目需提供可访问的路径和方式。专家委员会将根据项目征集情况分类评审后择优进行大会展示交流。

2.所有征集项目需填写“2026年中国数字人文年会项目报名表”进行报名,并提供相关附件(包括但不限于网站、APP、小程序、视频及图片等)。

3.请将报名表和相关附件压缩,以“CDH2026项目-项目名称”命名,发送至邮箱20250051@imnu.edu.cn。

4.项目征集截止时间:2026年5月30日

五、 会议组织

1.主办单位

中国索引学会

内蒙古师范大学

2.承办单位

中国索引学会数字人文专业委员会

内蒙古师范大学科学技术史研究院

内蒙古自治区科技文化遗产认知智能重点实验室

内蒙古师范大学蒙古学学院

3.协办单位(按笔画顺序排列)

IMR Press

上海大学数字人文研究与发展中心

上海外国语大学中国国际舆情研究中心

上海师范大学数字人文研究中心

上海财经大学“中文+数智经济”研究中心

上海财经大学国际文化交流学院

上海社会科学院信息研究所

上海图书馆历史人文大数据中心

山西数字人文研究院

云南大学历史与档案学院 “数字人文” 工作室

云南省图书馆数字资源与信息技术部

中山大学信息管理学院

中山大学数字人文实验室

中山大学数字人文联合研究院

中国人民大学数字人文研究院

中国社会科学院大学数字史学研究中心

中国社会科学院文学研究所数字信息研究室、数字人文与计算批评实验室

东华大学纺织遗产与数字人文实验室

北京大学数字人文研究中心

北京师范大学文理学院中文系

北京师范大学珠海校区图书馆数字人文中心

电子科技大学数字文化与传媒研究中心

兰州理工大学文学院

华中科技大学汉籍数字化实验室

华东师范大学数字文化发展协同创新中心

齐鲁工业大学 (山东省科学院) 数字人文研究中心

启元实验室战略研究中心

武汉大学文化遗产智能实验室

武汉大学数字人文研究中心

南京大学中华文明数智创新实验室

南京大学高研院数字人文创研中心

南京师范大学语言大数据与计算人文研究中心

南京师范大学数字与人文研究中心

南京农业大学数字人文研究中心

复旦大学大数据研究院人文社科数据研究所

首都师范大学初等教育学院

清华大学中国古典文献研究中心

淮阴师范学院文学院

湖北中医药大学医学人文学院

湖南女子学院文学与传播学院

(持续更新中)

4.媒体支持(按笔画顺序排列)

《Knowledge Organization》

《中国数字人文》

《古籍数字人文》

《全国报刊索引》

《南通大学学报(社会科学版)》

《信息与管理研究》

《烟台大学学报(哲学社会科学版)》

《数字人文》

《数字人文研究》

「DH数字人文」公众号

「DH数字人文动态」公众号

「IMR 图书情报学」公众号

「SHNU 数字人文」公众号

「三明学院学报」公众号

「山东大学」公众号

「广东省国学学会」公众号

「比特人文」公众号

「中国索引学会」公众号

「古代汉语信息处理」公众号

「立行数字人文」公众号

「全国报刊索引」公众号

「京狮人文DH」公众号

「科技古籍整理研究所」公众号

「域外汉籍与汉学研究」公众号

「揆古察今科史哲」公众号

「数字人文」公众号

「数字人文开放实验室」公众号

「数字人文研究」公众号

「数字人文资讯」公众号

AI & Innovation (《人工智能与创新》)

上海师范大学数字人文网

上海社科院信息所社科智能实验室(AI4SS Lab)

广东财经大学《智能高教》

社科大数字史学实验室

南京大学中华文明数智创新实验室

(持续更新中)

有意参与协办和媒体支持的单位,请扫描下方二维码登记相关信息,我们将在下一轮的会议通知中更新名单。

六、 会议联络

1.会议邮箱:20250051@imnu.edu.cn

2.会务咨询:周老师 13191432051/18852850582(微信同号)

附件

2026年中国数字人文年会项目报名表

CDH2026论文格式规范与要求

阅读原文

跳转微信打开

  •  

专业资讯 | 2025年数字人文奖(DH Awards 2025)——突出数字人文中的资源

2026-04-25 07:30 韩国

数字人文年度奖项于2012年设立,获奖资源可以向公众可以提名,以表彰数字人文相关的人才和专业知识。提名与投票环节全面面向公众,每人限投票一次。最终获奖名单由提名委员会(Nominations Committee)参考票选结果综合评定。设立该奖项旨在提升公众关注度,推介有趣的数字人文资源,并吸引更多人参与社群工作。提名资源不限语言、文字体系及研究领域。我们特别欢迎少数民族语言、文化及相关领域的代表性资源参选。所有被提名的资源都具有研究价值,有助于深入了解数字人文的边界。

数字人文数据可视化项目

01

(例如:对数字人文数据资源进行可视化呈现的作品)

第一名

香港流行文化地图

(Hong Kong Pop Culture Map)

https://digital.lib.hkbu.edu.hk/culture-map/

第二名

Thiep 3D

https://thiep3d.univ-littoral.fr/

第三名

数字幽灵展览

(Digital Ghosts exhibition)

https://inspace.ed.ac.uk/digital-ghosts/

其他提名项目(按字母顺序排列):

数字人文数据集或模型

02

(例如:用于数字人文研究的文本语料库、数据表、模型或类似内容)

第一名

哥伦比亚互联网与网络史:1988-1996年多人讲述的故事

(History of the Internet and the Web in Colombia. A story told in many voices 1988-1996)

https://historiasinternet.uniandes.edu.co/

第二名

数字萨福

(Sappho Digital)

https://sappho-digital.com/index.html

第三名

诗树——11种语言的诗歌语料库

(PoeTree – Poetry corpora in 11 languages)

https://poetree.org

其他提名项目(按字母顺序排列):

数字人文短篇出版物

03

(例如:数字人文领域的博客、文章、影片)

第一名
 沃尔什,梅兰妮等.《熊会是男孩》

The Pudding (Walsh, Melanie (et al.). ‘Bears Will Be Boys’, The Pudding) https://pudding.cool/2025/07/kids-books/

第二名
 东布罗夫斯基,奎因.《别再对自己撒谎:集体错觉与数字人文资助》,载《重新框架数字学术中的失败》

(Dombrowski, Quinn. ‘Stop lying to yourself: Collective delusion and Digital Humanities grant funding’, in Reframing Failure in Digital Scholarship)

https://read.uolpress.co.uk/read/reframing-failure-in-digital-scholarship-a56118ab-e4eb-4eb4-9dca-e8c343c6441b/section/9bbd0f75-6d96-48e2-bcc1-e8e5a6d07ce9#ch1

第三名
 丘拉,阿里安娜.《在包容性研究文化中与破碎共处:我们能从数字人文实验室的失败和过程中学到什么》,载《重新框架数字学术中的失败》

(Ciula, Arianna. ‘Living well with brokenness in an inclusive research culture: what we can learn from failures and processes in a digital humanities lab’, in Reframing Failure in Digital Scholarship)

https://read.uolpress.co.uk/read/316fdea1-5051-4f50-8957-afbc51342998/section/2e8944d9-ba98-4ef9-bcb8-159fa546e237#ch7

其他提名项目(按字母顺序排列):

数字人文工具或工具套件

04

(例如:用于构建数字人文资源的工具)

第一名
 ArtVis——艺术史可视化

(ArtVis – Art History visualized)

https://artvis.cvast.tuwien.ac.at/

第二名
 多民族语言智能数据处理与知识服务系统

(Multilingual Intelligent Data Processing and Knowledge Service System)

http://106.12.154.220:15001/

第三名
 RelicarIA

https://relicaria.streamlit.app/

其他提名项目(按字母顺序排列):

数字人文训练材料

05

(例如:各种形式的讲座、幻灯片、练习、视频或操作指南)

第一名
 情境中的负责任数据集:协作设计伦理人文学科数据教育

(Responsible Datasets in Context: Collaboratively Designing for Ethical Humanities Data Education)

https://www.responsible-datasets-in-context.com

第二名
 照亮过去——低成本多光谱成像培训

(Illuminating the Past — Training for low cost multispectral imaging)

https://grants.uccs.edu/illuminating-the-past/

第三名
 古代文本课程教材的大语言模型 (LLM-for-Ancient-Text-Coursebook)

https://github.com/chowshelly101-jpg/LLM-for-Ancient-Text-Coursebook/tree/main

其他提名项目(按字母顺序排列):

数字人文资源

06

(例如:数字人文数字学术出版物、档案库或资源库)

第一名
 看不见的东方数字语料库

(Invisible East Digital Corpus)

https://www.invisible-east.org/

第二名
 19世纪奥里诺科河旅行者

(Viajeros del Orinoco Siglo XIX)

https://biblioteca.uniandes.edu.co/proyectos/viajeros-orinoco/index.html

第三名
 20世纪印度建筑档案,PAHA(浦那建筑史档案馆)

(Architectural Archives of 20th century India, PAHA (Pune Architectural History Archive))

https://paha.site

其他提名项目(按字母顺序排列):

数字人文娱乐化应用

07

(例如:以娱乐为目的应用数字人文的项目)

第一名
 图钉故事

(Pin the Tale)

https://pinthetale.co.uk/

第二名
 Gamaikus

https://yohannawaliya.itch.io/gamaikus

第三名
 中国艺术史与3D绘画电子学习平台

(E-Learning Platform of Chinese Art History and 3D Paintings)

https://digital.lib.hkbu.edu.hk/history/3d-paintings/index.html

其他提名项目(按字母顺序排列):

以上信息来自“DH Awards 2025”官方网站:
 http://dhawards.org/dhawards2025/results/

经数字人文资讯小编翻译整理而成
 未经许可请勿转载

编辑 | 罗斯鹏

校对 | 魏翔

排版 | 洪冰凤

阅读原文

跳转微信打开

  •  

学术前沿丨《数字人文学刊 (DSH)》2026年第1期论文荐读

2026-04-19 08:30 湖北

本期内容将选取《数字人文学刊》2026年第1期(Volume 41,Issue 1,April 2026)中的10篇论文进行介绍。

《数字人文学刊》(Digital Scholarship in the Humanities,简称DSH)是一本国际性的、同行评审的期刊,发表关于人文学科中所有数字学术方面的原创研究,包括但不限于当前被称为数字人文学科的领域。该期刊主要发表长篇和短篇论文报告,理论、方法、实验和应用研究以及书评等。本期内容将选取《数字人文学刊》2026年第1期(Volume 41,Issue 1,April 2026)中的9篇论文进行介绍。

01

识读不可读文本:基于图像转文本语言模型构建 19 世纪英文报纸数据集

Reading the unreadable: creating a dataset of 19th century English newspapers using image-to-text language models

Jonathan Bourne

摘要:奥斯卡・王尔德曾言:“文学与新闻的区别在于,新闻不堪卒读,文学无人问津。” 遗憾的是,王尔德所处的 19 世纪数字化存档新闻文本,其光学字符识别(OCR)结果往往缺失或质量低劣,既降低了档案的可获取性,也使其在象征意义与字面意义上均成为 “不可读文本”。为解决这一问题,本研究采用预训练图像转文本语言模型 Pixtral 12B,对包含 8.4 万页 19 世纪英文报纸与期刊的《19世纪连续出版物典藏》(NCSE)开展光学字符识别。研究将该模型与四种主流OCR方法进行性能对比,结果显示其字符错误率中位数仅为1%,较次优模型低80%。本研究构建的NCSE2.0数据集优化了文章识别效果,具备高质量字符识别文本,并将文本划分为4个类别与17个主题,包含140万条条目与3.21亿个词汇。研究通过主题相似度、可读性与事件追踪分析验证了数据集的应用价值。该数据集免费开放,旨在助力历史学与社会学研究,让21世纪的读者得以足不出户识读这份“不可读文本”,共情王尔德对19世纪新闻水准的遗憾。

Abstract:Oscar Wilde said, ‘The difference between literature and journalism is that journalism is unreadable, and literature is not read’. Unfortunately, the digitally archived journalism of Oscar Wilde’s 19th century often has no or poor quality Optical Character Recognition (OCR), reducing the accessibility of these archives and making them unreadable both figuratively and literally. This paper helps address the issue by performing OCR on ‘The Nineteenth Century Serials Edition’ (NCSE), an 84k-page collection of 19th-century English newspapers and periodicals, using Pixtral 12B, a pre-trained image-to-text language model. The OCR capability of Pixtral was compared to four other OCR approaches, achieving a median character error rate of 1%, 5x lower than the next best model. The resulting NCSE v2.0 dataset features improved article identification, high-quality OCR, and text classified into four types and seventeen topics. The dataset contains 1.4 million entries, and 321 million words. Example use cases demonstrate analysis of topic similarity, readability, and event tracking. NCSE v2.0 is freely available to encourage historical and sociological research. As a result, 21st-century readers can now share Oscar Wilde’s disappointment with 19th-century journalistic standards, reading the unreadable from the comfort of their own computers.

图:边界框 “CLD-1853-07-30_page_2_B0C2R7” 分割为三个子框,重叠区域以深蓝色标注

Figure:Bounding box ‘CLD-1853-07-30_page_2_B0C2R7’ is split into three boxes. Overlap is shown as darker shades of blue.

02

非物质文化遗产剪纸纹样的数字化提取与分割

Digital extraction and segmentation of intangible cultural heritage paper-cut patterns

Daoling Chen , Pengpeng Cheng

摘要:剪纸艺术是中华传统文化中独具特色的非物质文化遗产,当前正面临传承与发展的双重困境。随着剪纸艺人离世、作品损毁流失,部分剪纸品类濒临消亡,其数字化保护工作迫在眉睫。本研究基于改进遗传算法自适应优化Canny算子阈值,结合Grab-Cut算法,实现非遗剪纸纹样的智能化提取与分割。研究首先通过双边滤波对采集的剪纸图像进行平滑处理,提升图像质量;其次采用改进遗传算法优化后的Canny算子,提取剪纸纹样整体轮廓;随后设计Grab-Cut算法,针对性分割剪纸设计元素轮廓,并借助CDR软件处理矢量图像,生成独立可编辑矢量文件;最后通过多种算法对比不同类型剪纸图像的轮廓提取效果。实验结果表明,本研究提出的方法可有效检测剪纸图像纹样真实边缘,完成轮廓提取,纹样各设计元素的像素分割精度达96%以上,为非遗剪纸艺术的数字化保护与创新应用提供了新方法。

Abstract:As a unique intangible cultural heritage in Chinese traditional culture, paper-cut art is now facing the dilemma of inheritance and development, and with the death of paper-cut artists and the damage and loss of paper-cut works, some paper-cut types also disappear. Therefore, the digital protection of paper-cut art is urgent. This research is based on the improved genetic algorithm adaptive optimization of Canny operator threshold and Grab-Cut algorithm to achieve intelligent extraction and segmentation of intangible cultural heritage paper-cut patterns. First, the collected paper-cut images are smoothed by bilateral filtering to improve the image quality. Second, based on the Canny operator optimized by the improved genetic algorithm, the overall contour of the paper-cut pattern is extracted. Then, the Grab-Cut algorithm is designed to segment the contours of decoupage design elements in a targeted way, and the vector image is processed by CDR software to obtain an independent editable vector image. Finally, the contour extraction experiments of different kinds of paper-cut images are compared by different algorithms. The results show that the method proposed in this article can effectively detect the true edge of the pattern in paper-cut images and complete the extraction of the pattern contour, and the accuracy of the segmentation pixels of each design element of paper-cut pattern is greater than 96 per cent. It provides a new method for the digital protection and innovative application of intangible cultural heritage paper-cut art.

图:剪纸图像平滑去噪处理 (a) 原始图像;(b) 增强后图像

Figure:Smoothing and denoising of paper-cut images. (a) Original and (b) enhanced.

03

丈量东方之声:华语流行歌词共性与特质的数字人文研究

Measuring sounds from the East: digital approaches to commonality and specificity in Chinese Mandarin pop lyrics

Zheyuan Dai , Haitao Liu

摘要:1978年改革开放以来,中国流行音乐产业高速发展,成为全球当代流行音乐的重要组成部分。本研究采用数字人文方法,对1978-2019年当代华语流行歌词开展系统性分析。研究运用文体计量指标布塞曼系数,从静态与动态双维度揭示了歌词文本的高活跃度,佐证了其叙事性的文体本质。歌词情感分析结果显示,文本整体呈现积极基调,而2000年成为重要分水岭,前后两个时期的情感特征呈现显著分化。主题建模分析进一步表明,不同时期歌词的主题分布模式呈现多元化特征,既体现了流行文化的普世性,也彰显了文化与时代语境塑造下的中国本土特质。

Abstract:Since China’s reform and opening-up in 1978, its popular music industry has experienced rapid development and emerged as a significant component of global contemporary pop music. This study conducts a systematic analysis of contemporary Chinese Mandarin pop lyrics (1978–2019) with digital methodologies. A stylometric measurement, the Busemann coefficient, was employed to demonstrate the lyrics’ high textual activity from both static and dynamic perspectives. This finding supports the lyrics’ stylistic essence as narratives. Besides, sentiment analysis of lyrics reveals an overall positive tone, though a significant watershed occurred around the year 2000, marking a divergence between the two periods. Furthermore, analyses with topic modeling demonstrate diversified topic distribution patterns across these periods, reflecting both the universality of popular culture and the distinctive Chinese characteristics shaped by cultural and temporal contexts.

图:潜在狄利克雷分配模型评估:一致性与困惑度对比

Figure:LDA model evaluation: Coherence vs. Perplexity.

04

文本可视化视域下江南禅诗对高丽汉诗的跨文化影响研究

Exploring the cross-cultural influence of song Jiangnan Chan Buddhist poetry on Goryeo Han poetry through text visualization

Yaqin Fu , Rongrong Fu , Linfeng Li

摘要:本研究选取三位代表性诗人,从词汇意象、时空解构、主题演变与情感表达四个维度,对比分析江南禅诗对高丽汉诗的影响。研究构建基于文本可视化的研究方法,融合词频 - 逆文档频率关键词提取、潜在狄利克雷分配主题建模与情感分析技术,辅以AI大模型新词挖掘与Kimi智能助手分词功能开展研究。研究得出四项核心结论:其一,两类诗歌均以自然与禅意为核心,共享相似的词汇与意象体系;其二,二者均体现永恒视角与历史意识的交织,以及宇宙宏大性与人世现实性的辩证关系;其三,主题演变层面,江南禅诗“自然与禅”的核心内核,在高丽汉诗中转化为“护国、弘法、济世”的三位一体框架;其四,江南禅诗侧重超脱与空寂的审美表达,高丽汉诗则融入世俗生活书写与历史记忆叙事。研究同时证实,该方法可有效提升古典诗歌文本的中文分词精度,彰显了量化对比分析在禅诗跨文化传播与嬗变可视化研究中的核心价值。

Abstract:This study examines the influence of Jiangnan Chan poetry on Goryeo Han poetry through a comparative analysis of three representative poets from four dimensions: vocabulary imagery, spatiotemporal deconstruction, thematic evolution, and emotional expression. It proposes a text visualization-based methodology employing Term Frequency–Inverse Document Frequency (TF-IDF)-based keyword extraction, Latent Dirichlet Allocation (LDA)-based topic modeling, and sentiment analysis, supplemented by neologism mining and Kimi Intelligent Assistant (KIMI)-based word segmentation using AI large models. The results reveal four key findings: (1) both poetries share similar vocabulary and imagery centered on nature and Chan Buddhism; (2) both reflect an interweaving of eternal perspective and historical consciousness, alongside a dialectic between cosmic vastness and human reality; (3) in terms of thematic evolution, the original focus on “Nature and Chan” in Jiangnan poetry was transformed in Goryeo Han poetry into a trinitarian framework of “national protection, Dharma propagation, and social salvation”; and (4) Jiangnan poetry emphasizes transcendence and emptiness, while Goryeo Han poetry incorporates depictions of secular life and historical memory. The findings also suggest that the proposed methodology is effective in improving the accuracy of Chinese word segmentation for ancient poetry texts. This study underscores the value of quantitative comparative analysis in visualizing the intercultural diffusion and transformation of Chan Buddhism poetry.

图:禅诗名词词云图 (a)雪窦重显;(b)杨杰;(c)义天

Figure:Noun word clouds of Chan Buddhism poetry: (a) Xuedou Chongxian; (b) Yang Jie; (c) Yitian.

05

近代早期英语的善恶语义空间:道德二元对立的计算语言学研究

The semantic space of good and evil in early modern English: a computational study of moral contrasts

Michael Gavin , Michael Witmore

摘要:本文提出一种创新研究方法,通过近代早期英语词向量的几何分析解读文化内涵。研究基于17世纪《早期英文图书在线》(EEBO-TCP)语料库,构建语义模型,梳理3.2万余个词汇的道德关联与性别属性。研究依托分布概念分析方法,设定善恶、女性-男性两大启发式坐标轴,将词汇映射至坐标轴中,挖掘语言使用内嵌的规范结构。情境、离散度与斜率等统计指标,揭示了概念与性别道德化宏观范式的适配规律。研究发现,多数词汇集中于“女性/邪恶”象限,而其语义邻域却常向抽象化、男性化与正向语义域倾斜。本研究提出全新指标——道德对比分数,可无监督挖掘文本潜在二元对立关系,识别塑造近代早期话语体系的文化维度,涵盖情感表达、信任机制、社会教化与领土合法性等范畴。研究勾勒出层次丰富的道德语义图景:道德对立并非静态固化,而是相互重叠、动态流变;该模型打破了固定二元对立的认知框架,证实语言是构建与重塑文化价值的动态高维场域。

Abstract:This article introduces a novel approach to understanding cultural meaning through the geometric analysis of word vectors in early modern English. Using a seventeenth-century corpus Early English Books Online (EEBO-TCP), the study constructs semantic models that chart the moral and gendered associations of over 32,000 words. Building on methods from distributional concept analysis, the authors define heuristic axes—good-evil and feminine-masculine—and project words onto these axes to explore normative structures embedded in language use. Statistical metrics such as situation, spread, and slope reveal how concepts align with broader patterns of moralized gender. Notably, most terms cluster in the ‘feminine/evil’ quadrant, yet semantic neighborhoods often slope toward abstract, masculine, and positive domains. A new metric, the moral contrast score, enables unsupervised discovery of latent binaries, identifying the cultural dimensions that structure early modern discourse—from affective expression and trust to social refinement and territorial legitimacy. The result is a richly layered moral landscape, where contrasts are not static but overlapping and mobile. Far from mapping fixed binaries, the model reveals a dynamic, high-dimensional field in which language organizes—and reconfigures—cultural values. This method offers a scalable, interpretive framework for investigating the moral geometry of meaning in historical texts.

图:核心词汇语义邻域图(左上:死亡;右上:戏剧;左下:牙买加;右下:信用)

Figure:The semantic neighborhood of death (upper left), play (upper right), jamaica (lower left), and credit (lower right).

06

复杂网络视角下现代简体汉字构形系统研究

Investigating the structural formation system of modern simplified Chinese characters from a complex network perspective

Wei Huang , Yonghui Xie , Junting Li

摘要:汉字在东方文明发展进程中具有核心地位,其构形体系具备系统性特征,而系统科学方法在汉字构形系统研究中的应用仍较为匮乏。为此,本研究基于复杂网络方法,探究现代简体汉字的宏观网络特征与核心系统属性。研究以汉字基础构件为节点、构件关联为边,构建共现网络、有向网络、加权网络三类网络模型及对应的随机对照网络;通过17项通用网络指标量化分析网络特征,深入阐释汉字构形系统的内在属性。研究结果表明,相较于随机网络,汉字构件网络呈现小世界性、无标度性、异配混合性、高中心性与层级组织性五大显著特征;这五大特征印证了汉字构形系统兼具复杂性、鲁棒性与经济性三大属性,分别源于构件的有序组合、紧密联结与高效配置。本研究成果为汉字构形系统的实证研究提供了重要补充。

Abstract:Chinese characters hold pivotal significance in the development of Eastern civilization. While their structural formation exhibits a systematic nature, system science approaches are seldom seen in analyzing the formation system. Therefore, based on complex network methods, this study aims to examine macro-scale network features and the essential system properties of modern simplified Chinese characters. Specifically, three types of networks were constructed: co-occurrence, directed, and weighted networks, along with their random counterparts. In these networks, primitive components served as nodes, and their relationships as edges. Subsequently, seventeen general network metrics were measured to analyze the network features, enabling deeper discussion of the system properties. Research results show that component networks exhibit five distinct network features compared to their random counterparts, including small-world feature, scale-free feature, disassortative mixing, high centrality, and hierarchical organization. These features demonstrate that the formation system displays three properties, namely complexity, robustness, and economy, which emerge respectively from organized, close-knit, and efficient component combinations. These findings serve as a significant supplement to the empirical research on the structural formation system of Chinese characters.

图:真实网络与随机网络全局拓扑图(a、c、e:真实网络;b、d、f:随机网络)

Figure:Global network graphs of real and random networks (a, c, e: network graphs of real networks; b, d, f: network graphs of random networks).

07

非遗审美中的情绪唤醒与视觉认知双路径研究——以硖石针刺灯彩画为例

A dual-path approach to emotional arousal and visual cognition in intangible cultural heritage: the case of Xiashi Pinprick Lantern Pictures

Wenwen Shi , Yi-Tong Cui , Yihong Liu , Weicong Li , Xinlong Li , Jing Sun

摘要:当前关于晚期Z世代对中国非物质文化遗产的审美体验与评价的实证研究仍较为匮乏。本研究以清代颜元庄硖石针刺灯彩画为研究对象,探究大学生群体的审美反馈,聚焦作品主题、潜在审美偏好及其与喜爱度的关联。研究采用双路径研究方法:其一,运用混合设计方差分析与语义差异量表,分析四大主题作品,通过因子分析与聚类分析提取审美潜在维度;其二,开展眼动实验,记录注视时长与注视次数,量化分析眼动指标与主观评分的相关性。研究结果表明:第一,园林主题灯彩画的喜爱度评分显著最高(P<0.001),主题与专业的交互效应不显著(P=0.094),说明不同专业群体的审美偏好具有一致性;第二,研究提取出情绪效价、形式审美、认知唤醒三大潜在维度,揭示了非遗审美的多层级体验结构;第三,潜在审美偏好与喜爱度呈极强正相关(r=0.94,P<0.01),而眼动注视指标与喜爱度无显著相关性(P=0.174;P=0.234)。研究证实,晚期Z世代对传统针刺灯彩艺术的偏好具有主题依赖性,由情绪与认知双重参与塑造。本研究结合主客观测量方法提供实证依据,深化了对晚期Z世代非遗审美认知的理解,为非遗传承与美育推广提供理论支撑。

Abstract:There is a limited empirical research on late Generation Z’s (Gen Z’s) experience and evaluation of Chinese intangible cultural heritage (ICH). This study examines university students’ aesthetic responses to Xiashi Pinprick Lantern Pictures by Yan Yuanzhuang (Qing dynasty), focusing on theme and latent preferences and their relation to liking. Using a dual-path approach, this study conducted (1) a mixed-design ANOVA and semantic differential scale to analyze four themes and extract latent dimensions via factor and cluster analysis, and (2) an eye-tracking experiment to record fixation duration and count, thus assess their correlations with subjective ratings. Results revealed: (1) the garden-themed pictures scored significantly higher in liking level (P < .001), with no significant theme–major interaction effect (P = .094), indicating consistent preferences across disciplines; (2) three latent dimensions, Emotional Valence, Form-Aesthetic, and Cognitive Arousal, were extracted, revealing a multi-layered structure of aesthetic experience; (3) latent preference strongly correlated with liking levels (r = 0.94, P < .01), whereas fixation-based metrics showed no significant correlation (P = .174; P = .234). These findings suggest that Gen Z’s preferences for traditional pinprick lantern art are theme-dependent and shaped by emotional and cognitive engagement. The study offers empirical evidence, through both subjective and objective measures, to better understand how ICH artworks are perceived by late Gen Z audiences, contributing to ICH transmission and the promotion of aesthetic education.

图: 《黛玉葬花》眼动热力图

Figure: Daiyu Burying the Fallen Flowers eye-tracking heatmap.

08

从浪漫到现实:数字人文视域下华语流行歌词的词汇与主题演变

From romance to reality: lexical and topic evolution in Chinese popular lyrics through digital humanities approaches

Yubo Wang , Lüyuan Wang , Fang Xie , Haitao Liu

摘要:本研究探究2000-2025年华语流行歌词的词汇与主题演变,映射大众情感变迁与社会文化转型。现有研究多忽视非西方歌词语料库,本研究填补这一空白,构建涵盖25年、1560首代表性歌曲的华语流行音乐历时语料库。研究采用数字人文方法,融合词频分析、可读性指标与BERTopic主题建模,追踪歌词词汇与主题的历时演变。研究发现,歌词高频词汇始终围绕情感表达、个体自省与人际互动三大核心;类符形符比显著提升,表明歌词词汇丰富度持续增长,文本复杂度呈波动变化,反映出创作风格的动态转向。主题分析识别出浪漫爱情、未来期许、都市生活等12大核心主题,主题结构从自然与时间的抽象表达,逐步转向情感具象化与心理内省化书写;近年来,负面情感主题与自我指涉艺术母题的占比显著上升。本研究为音乐、语言与社会交叉领域研究提供了全新方法论框架,彰显了数字人文工具在大规模歌词分析中,描摹集体情感与文化变迁的核心价值。

Abstract:This study explores the lexical and topic evolution of Chinese popular music lyrics from 2000 to 2025, reflecting changing public sentiments and broader socio-cultural transitions. While prior research has largely overlooked non-Western lyric corpora, this study addresses that gap by constructing the Chinese Popular Music Diachronic Corpus, comprising 1,560 representative popular songs sampled across twenty-five years. Using digital humanities approaches, it integrates word frequency analysis, readability metrics, and BERTopic-based topic modelling to trace lexical and topic evolution of lyrics over time. Findings reveal that high-frequency words consistently revolve around emotional expression, individual introspection, and interpersonal dynamics. Type-token ratio (TTR) has increased significantly, indicating growing lexical diversity, while textual complexity shows fluctuation, reflecting stylistic shifts in song writing. Topic analysis identifies twelve major topics, including romantic love, future aspirations, and urban life, with topic structures evolving from natural and temporal abstraction to emotional concreteness and psychological introspection. Recent years show a significant rise in negative emotional topics and self-referential artistic motifs. This study contributes a novel methodological framework for interdisciplinary research at the intersection of music, language, and society, and underscores the value of digital humanities tools in mapping collective emotions and cultural change through large-scale lyric analysis.

图:各项指标历年变化趋势

Figure:Trends of various metrics over the years.

09

文化分析与表征政治:埃及《箴言》杂志中犹太群体形象的呈现研究(1933-1953)

Cultural Analytics and the Politics of Representation: Mapping the Jewish Presence in Egypt’s al-Risālah (1933–1953)

Eid Mohamed , Said Hassan

摘要:本文融合文化分析与后殖民理论,探究1933-1953年埃及主流文学期刊《箴言》中犹太群体的形象表征。研究运用数字文本分析方法,识别并解读期刊档案中犹太形象的建构范式,揭示两次世界大战之间及战后初期,阿拉伯知识分子在政治张力下对犹太身份的协商与阐释。这一跨学科研究方法实现了量化建模与文本细读的结合,精准剖析文化生产机制,呈现这一关键历史节点阿拉伯印刷话语的内在矛盾性。本研究的核心价值在于,对锡安主义兴起与以色列建国这一重塑阿拉伯世界族群关系的关键时期的媒介文本开展数字化研究:随着阿拉伯犹太人大规模撤离埃及,《箴言》中犹太形象的动态演变,折射出社会层面对民族身份、宗教差异与殖民遗产的集体焦虑。全文分为两部分:第一部分将《箴言》置于反殖民与后奥斯曼知识思潮中,阐释其成为阿拉伯现代性多元理念博弈平台的历史背景;第二部分结合远读与阐释性分析,梳理期刊对犹太人的三重身份建构——现代性符号、西方帝国主义受害者、阿拉伯主权威胁者。这些形象建构并非单纯的历史遗存,更深刻影响着当代族群宗教身份与政治归属感的认知。本研究将数字人文工具与知识生产的后殖民批判相结合,为阿拉伯印刷文化、形象表征与媒介史研究提供了全新的方法论与认识论范式。

Abstract:This article investigates the representation of Jews in al-Risālah, a major Egyptian literary magazine (1933–53), by integrating Cultural Analytics and postcolonial theory. Using digital text analysis methods, it identifies and interprets patterns of Jewish representation within al-Risālah’s archive, uncovering how Arab intellectuals negotiated Jewishness amid the political tensions of the interwar and early postwar periods. This interdisciplinary approach enables a nuanced examination of cultural production, bridging quantitative modelling with close textual reading to reveal the ambivalences of Arab print discourse during a pivotal historical moment. The study’s significance lies in its digital examination of media texts published during the rise of Zionism and the establishment of Israel, an era that reshaped intercommunal relations across the Arab world. As Arab Jews began departing Egypt en masse, al-Risālah’s evolving depictions of Jews became symptomatic of broader anxieties over national identity, religious difference, and colonial legacies. Structured in two parts, the first contextualizes al-Risālah within anti-colonial and post-Ottoman intellectual currents, illustrating how the magazine became a platform for competing visions of Arab modernity. The second part synthesizes distant reading with interpretive analysis to assess how al-Risālah conceptualized Jews: as symbols of modernity, victims of Western imperialism, or threats to Arab sovereignty. These portrayals are not merely historical curiosities but inform contemporary understandings of ethno-religious identity and political belonging. By fusing digital humanities tools with a postcolonial critique of knowledge production, this study contributes a new methodological and epistemological model for analysing Arab print culture, representation, and media history.

图:《箴言》杂志核心关键词年度出现频次

Figure.Recurrence of key words in al-Risālah by years.

编译|洪冰凤

校对|罗斯鹏

排版|魏翔

阅读原文

跳转微信打开

  •  

学术前沿丨《数字人文学刊 (DSH)》2026年第1期论文荐读

2026-04-18 08:30 湖北

本期内容将选取《数字人文学刊》2026年第1期(Volume 41,Issue 1,April 2026)中的10篇论文进行介绍。

《数字人文学刊》(Digital Scholarship in the Humanities,简称DSH)是一本国际性的、同行评审的期刊,发表关于人文学科中所有数字学术方面的原创研究,包括但不限于当前被称为数字人文学科的领域。该期刊主要发表长篇和短篇论文报告,理论、方法、实验和应用研究以及书评等。本期内容将选取《数字人文学刊》2026年第1期(Volume 41,Issue 1,April 2026)中的10篇论文进行介绍。

01

识读不可读文本:基于图像转文本语言模型构建 19 世纪英文报纸数据集

Reading the unreadable: creating a dataset of 19th century English newspapers using image-to-text language models

Jonathan Bourne

摘要:奥斯卡・王尔德曾言:“文学与新闻的区别在于,新闻不堪卒读,文学无人问津。” 遗憾的是,王尔德所处的 19 世纪数字化存档新闻文本,其光学字符识别(OCR)结果往往缺失或质量低劣,既降低了档案的可获取性,也使其在象征意义与字面意义上均成为 “不可读文本”。为解决这一问题,本研究采用预训练图像转文本语言模型 Pixtral 12B,对包含 8.4 万页 19 世纪英文报纸与期刊的《19世纪连续出版物典藏》(NCSE)开展光学字符识别。研究将该模型与四种主流OCR方法进行性能对比,结果显示其字符错误率中位数仅为1%,较次优模型低80%。本研究构建的NCSE2.0数据集优化了文章识别效果,具备高质量字符识别文本,并将文本划分为4个类别与17个主题,包含140万条条目与3.21亿个词汇。研究通过主题相似度、可读性与事件追踪分析验证了数据集的应用价值。该数据集免费开放,旨在助力历史学与社会学研究,让21世纪的读者得以足不出户识读这份“不可读文本”,共情王尔德对19世纪新闻水准的遗憾。

Abstract:Oscar Wilde said, ‘The difference between literature and journalism is that journalism is unreadable, and literature is not read’. Unfortunately, the digitally archived journalism of Oscar Wilde’s 19th century often has no or poor quality Optical Character Recognition (OCR), reducing the accessibility of these archives and making them unreadable both figuratively and literally. This paper helps address the issue by performing OCR on ‘The Nineteenth Century Serials Edition’ (NCSE), an 84k-page collection of 19th-century English newspapers and periodicals, using Pixtral 12B, a pre-trained image-to-text language model. The OCR capability of Pixtral was compared to four other OCR approaches, achieving a median character error rate of 1%, 5x lower than the next best model. The resulting NCSE v2.0 dataset features improved article identification, high-quality OCR, and text classified into four types and seventeen topics. The dataset contains 1.4 million entries, and 321 million words. Example use cases demonstrate analysis of topic similarity, readability, and event tracking. NCSE v2.0 is freely available to encourage historical and sociological research. As a result, 21st-century readers can now share Oscar Wilde’s disappointment with 19th-century journalistic standards, reading the unreadable from the comfort of their own computers.

图:边界框 “CLD-1853-07-30_page_2_B0C2R7” 分割为三个子框,重叠区域以深蓝色标注

Figure:Bounding box ‘CLD-1853-07-30_page_2_B0C2R7’ is split into three boxes. Overlap is shown as darker shades of blue.

02

非物质文化遗产剪纸纹样的数字化提取与分割

Digital extraction and segmentation of intangible cultural heritage paper-cut patterns

Daoling Chen , Pengpeng Cheng

摘要:剪纸艺术是中华传统文化中独具特色的非物质文化遗产,当前正面临传承与发展的双重困境。随着剪纸艺人离世、作品损毁流失,部分剪纸品类濒临消亡,其数字化保护工作迫在眉睫。本研究基于改进遗传算法自适应优化Canny算子阈值,结合Grab-Cut算法,实现非遗剪纸纹样的智能化提取与分割。研究首先通过双边滤波对采集的剪纸图像进行平滑处理,提升图像质量;其次采用改进遗传算法优化后的Canny算子,提取剪纸纹样整体轮廓;随后设计Grab-Cut算法,针对性分割剪纸设计元素轮廓,并借助CDR软件处理矢量图像,生成独立可编辑矢量文件;最后通过多种算法对比不同类型剪纸图像的轮廓提取效果。实验结果表明,本研究提出的方法可有效检测剪纸图像纹样真实边缘,完成轮廓提取,纹样各设计元素的像素分割精度达96%以上,为非遗剪纸艺术的数字化保护与创新应用提供了新方法。

Abstract:As a unique intangible cultural heritage in Chinese traditional culture, paper-cut art is now facing the dilemma of inheritance and development, and with the death of paper-cut artists and the damage and loss of paper-cut works, some paper-cut types also disappear. Therefore, the digital protection of paper-cut art is urgent. This research is based on the improved genetic algorithm adaptive optimization of Canny operator threshold and Grab-Cut algorithm to achieve intelligent extraction and segmentation of intangible cultural heritage paper-cut patterns. First, the collected paper-cut images are smoothed by bilateral filtering to improve the image quality. Second, based on the Canny operator optimized by the improved genetic algorithm, the overall contour of the paper-cut pattern is extracted. Then, the Grab-Cut algorithm is designed to segment the contours of decoupage design elements in a targeted way, and the vector image is processed by CDR software to obtain an independent editable vector image. Finally, the contour extraction experiments of different kinds of paper-cut images are compared by different algorithms. The results show that the method proposed in this article can effectively detect the true edge of the pattern in paper-cut images and complete the extraction of the pattern contour, and the accuracy of the segmentation pixels of each design element of paper-cut pattern is greater than 96 per cent. It provides a new method for the digital protection and innovative application of intangible cultural heritage paper-cut art.

图:剪纸图像平滑去噪处理 (a) 原始图像;(b) 增强后图像

Figure:Smoothing and denoising of paper-cut images. (a) Original and (b) enhanced.

03

丈量东方之声:华语流行歌词共性与特质的数字人文研究

Measuring sounds from the East: digital approaches to commonality and specificity in Chinese Mandarin pop lyrics

Zheyuan Dai , Haitao Liu

摘要:1978年改革开放以来,中国流行音乐产业高速发展,成为全球当代流行音乐的重要组成部分。本研究采用数字人文方法,对1978-2019年当代华语流行歌词开展系统性分析。研究运用文体计量指标布塞曼系数,从静态与动态双维度揭示了歌词文本的高活跃度,佐证了其叙事性的文体本质。歌词情感分析结果显示,文本整体呈现积极基调,而2000年成为重要分水岭,前后两个时期的情感特征呈现显著分化。主题建模分析进一步表明,不同时期歌词的主题分布模式呈现多元化特征,既体现了流行文化的普世性,也彰显了文化与时代语境塑造下的中国本土特质。

Abstract:Since China’s reform and opening-up in 1978, its popular music industry has experienced rapid development and emerged as a significant component of global contemporary pop music. This study conducts a systematic analysis of contemporary Chinese Mandarin pop lyrics (1978–2019) with digital methodologies. A stylometric measurement, the Busemann coefficient, was employed to demonstrate the lyrics’ high textual activity from both static and dynamic perspectives. This finding supports the lyrics’ stylistic essence as narratives. Besides, sentiment analysis of lyrics reveals an overall positive tone, though a significant watershed occurred around the year 2000, marking a divergence between the two periods. Furthermore, analyses with topic modeling demonstrate diversified topic distribution patterns across these periods, reflecting both the universality of popular culture and the distinctive Chinese characteristics shaped by cultural and temporal contexts.

图:潜在狄利克雷分配模型评估:一致性与困惑度对比

Figure:LDA model evaluation: Coherence vs. Perplexity.

04

文本可视化视域下江南禅诗对高丽汉诗的跨文化影响研究

Exploring the cross-cultural influence of song Jiangnan Chan Buddhist poetry on Goryeo Han poetry through text visualization

Yaqin Fu , Rongrong Fu , Linfeng Li

摘要:本研究选取三位代表性诗人,从词汇意象、时空解构、主题演变与情感表达四个维度,对比分析江南禅诗对高丽汉诗的影响。研究构建基于文本可视化的研究方法,融合词频 - 逆文档频率关键词提取、潜在狄利克雷分配主题建模与情感分析技术,辅以AI大模型新词挖掘与Kimi智能助手分词功能开展研究。研究得出四项核心结论:其一,两类诗歌均以自然与禅意为核心,共享相似的词汇与意象体系;其二,二者均体现永恒视角与历史意识的交织,以及宇宙宏大性与人世现实性的辩证关系;其三,主题演变层面,江南禅诗“自然与禅”的核心内核,在高丽汉诗中转化为“护国、弘法、济世”的三位一体框架;其四,江南禅诗侧重超脱与空寂的审美表达,高丽汉诗则融入世俗生活书写与历史记忆叙事。研究同时证实,该方法可有效提升古典诗歌文本的中文分词精度,彰显了量化对比分析在禅诗跨文化传播与嬗变可视化研究中的核心价值。

Abstract:This study examines the influence of Jiangnan Chan poetry on Goryeo Han poetry through a comparative analysis of three representative poets from four dimensions: vocabulary imagery, spatiotemporal deconstruction, thematic evolution, and emotional expression. It proposes a text visualization-based methodology employing Term Frequency–Inverse Document Frequency (TF-IDF)-based keyword extraction, Latent Dirichlet Allocation (LDA)-based topic modeling, and sentiment analysis, supplemented by neologism mining and Kimi Intelligent Assistant (KIMI)-based word segmentation using AI large models. The results reveal four key findings: (1) both poetries share similar vocabulary and imagery centered on nature and Chan Buddhism; (2) both reflect an interweaving of eternal perspective and historical consciousness, alongside a dialectic between cosmic vastness and human reality; (3) in terms of thematic evolution, the original focus on “Nature and Chan” in Jiangnan poetry was transformed in Goryeo Han poetry into a trinitarian framework of “national protection, Dharma propagation, and social salvation”; and (4) Jiangnan poetry emphasizes transcendence and emptiness, while Goryeo Han poetry incorporates depictions of secular life and historical memory. The findings also suggest that the proposed methodology is effective in improving the accuracy of Chinese word segmentation for ancient poetry texts. This study underscores the value of quantitative comparative analysis in visualizing the intercultural diffusion and transformation of Chan Buddhism poetry.

图:禅诗名词词云图 (a)雪窦重显;(b)杨杰;(c)义天

Figure:Noun word clouds of Chan Buddhism poetry: (a) Xuedou Chongxian; (b) Yang Jie; (c) Yitian.

05

近代早期英语的善恶语义空间:道德二元对立的计算语言学研究

The semantic space of good and evil in early modern English: a computational study of moral contrasts

Michael Gavin , Michael Witmore

摘要:本文提出一种创新研究方法,通过近代早期英语词向量的几何分析解读文化内涵。研究基于17世纪《早期英文图书在线》(EEBO-TCP)语料库,构建语义模型,梳理3.2万余个词汇的道德关联与性别属性。研究依托分布概念分析方法,设定善恶、女性-男性两大启发式坐标轴,将词汇映射至坐标轴中,挖掘语言使用内嵌的规范结构。情境、离散度与斜率等统计指标,揭示了概念与性别道德化宏观范式的适配规律。研究发现,多数词汇集中于“女性/邪恶”象限,而其语义邻域却常向抽象化、男性化与正向语义域倾斜。本研究提出全新指标——道德对比分数,可无监督挖掘文本潜在二元对立关系,识别塑造近代早期话语体系的文化维度,涵盖情感表达、信任机制、社会教化与领土合法性等范畴。研究勾勒出层次丰富的道德语义图景:道德对立并非静态固化,而是相互重叠、动态流变;该模型打破了固定二元对立的认知框架,证实语言是构建与重塑文化价值的动态高维场域。

Abstract:This article introduces a novel approach to understanding cultural meaning through the geometric analysis of word vectors in early modern English. Using a seventeenth-century corpus Early English Books Online (EEBO-TCP), the study constructs semantic models that chart the moral and gendered associations of over 32,000 words. Building on methods from distributional concept analysis, the authors define heuristic axes—good-evil and feminine-masculine—and project words onto these axes to explore normative structures embedded in language use. Statistical metrics such as situation, spread, and slope reveal how concepts align with broader patterns of moralized gender. Notably, most terms cluster in the ‘feminine/evil’ quadrant, yet semantic neighborhoods often slope toward abstract, masculine, and positive domains. A new metric, the moral contrast score, enables unsupervised discovery of latent binaries, identifying the cultural dimensions that structure early modern discourse—from affective expression and trust to social refinement and territorial legitimacy. The result is a richly layered moral landscape, where contrasts are not static but overlapping and mobile. Far from mapping fixed binaries, the model reveals a dynamic, high-dimensional field in which language organizes—and reconfigures—cultural values. This method offers a scalable, interpretive framework for investigating the moral geometry of meaning in historical texts.

图:核心词汇语义邻域图(左上:死亡;右上:戏剧;左下:牙买加;右下:信用)

Figure:The semantic neighborhood of death (upper left), play (upper right), jamaica (lower left), and credit (lower right).

06

复杂网络视角下现代简体汉字构形系统研究

Investigating the structural formation system of modern simplified Chinese characters from a complex network perspective

Wei Huang , Yonghui Xie , Junting Li

摘要:汉字在东方文明发展进程中具有核心地位,其构形体系具备系统性特征,而系统科学方法在汉字构形系统研究中的应用仍较为匮乏。为此,本研究基于复杂网络方法,探究现代简体汉字的宏观网络特征与核心系统属性。研究以汉字基础构件为节点、构件关联为边,构建共现网络、有向网络、加权网络三类网络模型及对应的随机对照网络;通过17项通用网络指标量化分析网络特征,深入阐释汉字构形系统的内在属性。研究结果表明,相较于随机网络,汉字构件网络呈现小世界性、无标度性、异配混合性、高中心性与层级组织性五大显著特征;这五大特征印证了汉字构形系统兼具复杂性、鲁棒性与经济性三大属性,分别源于构件的有序组合、紧密联结与高效配置。本研究成果为汉字构形系统的实证研究提供了重要补充。

Abstract:Chinese characters hold pivotal significance in the development of Eastern civilization. While their structural formation exhibits a systematic nature, system science approaches are seldom seen in analyzing the formation system. Therefore, based on complex network methods, this study aims to examine macro-scale network features and the essential system properties of modern simplified Chinese characters. Specifically, three types of networks were constructed: co-occurrence, directed, and weighted networks, along with their random counterparts. In these networks, primitive components served as nodes, and their relationships as edges. Subsequently, seventeen general network metrics were measured to analyze the network features, enabling deeper discussion of the system properties. Research results show that component networks exhibit five distinct network features compared to their random counterparts, including small-world feature, scale-free feature, disassortative mixing, high centrality, and hierarchical organization. These features demonstrate that the formation system displays three properties, namely complexity, robustness, and economy, which emerge respectively from organized, close-knit, and efficient component combinations. These findings serve as a significant supplement to the empirical research on the structural formation system of Chinese characters.

图:真实网络与随机网络全局拓扑图(a、c、e:真实网络;b、d、f:随机网络)

Figure:Global network graphs of real and random networks (a, c, e: network graphs of real networks; b, d, f: network graphs of random networks).

07

非遗审美中的情绪唤醒与视觉认知双路径研究——以硖石针刺灯彩画为例

A dual-path approach to emotional arousal and visual cognition in intangible cultural heritage: the case of Xiashi Pinprick Lantern Pictures

Wenwen Shi , Yi-Tong Cui , Yihong Liu , Weicong Li , Xinlong Li , Jing Sun

摘要:当前关于晚期Z世代对中国非物质文化遗产的审美体验与评价的实证研究仍较为匮乏。本研究以清代颜元庄硖石针刺灯彩画为研究对象,探究大学生群体的审美反馈,聚焦作品主题、潜在审美偏好及其与喜爱度的关联。研究采用双路径研究方法:其一,运用混合设计方差分析与语义差异量表,分析四大主题作品,通过因子分析与聚类分析提取审美潜在维度;其二,开展眼动实验,记录注视时长与注视次数,量化分析眼动指标与主观评分的相关性。研究结果表明:第一,园林主题灯彩画的喜爱度评分显著最高(P<0.001),主题与专业的交互效应不显著(P=0.094),说明不同专业群体的审美偏好具有一致性;第二,研究提取出情绪效价、形式审美、认知唤醒三大潜在维度,揭示了非遗审美的多层级体验结构;第三,潜在审美偏好与喜爱度呈极强正相关(r=0.94,P<0.01),而眼动注视指标与喜爱度无显著相关性(P=0.174;P=0.234)。研究证实,晚期Z世代对传统针刺灯彩艺术的偏好具有主题依赖性,由情绪与认知双重参与塑造。本研究结合主客观测量方法提供实证依据,深化了对晚期Z世代非遗审美认知的理解,为非遗传承与美育推广提供理论支撑。

Abstract:There is a limited empirical research on late Generation Z’s (Gen Z’s) experience and evaluation of Chinese intangible cultural heritage (ICH). This study examines university students’ aesthetic responses to Xiashi Pinprick Lantern Pictures by Yan Yuanzhuang (Qing dynasty), focusing on theme and latent preferences and their relation to liking. Using a dual-path approach, this study conducted (1) a mixed-design ANOVA and semantic differential scale to analyze four themes and extract latent dimensions via factor and cluster analysis, and (2) an eye-tracking experiment to record fixation duration and count, thus assess their correlations with subjective ratings. Results revealed: (1) the garden-themed pictures scored significantly higher in liking level (P < .001), with no significant theme–major interaction effect (P = .094), indicating consistent preferences across disciplines; (2) three latent dimensions, Emotional Valence, Form-Aesthetic, and Cognitive Arousal, were extracted, revealing a multi-layered structure of aesthetic experience; (3) latent preference strongly correlated with liking levels (r = 0.94, P < .01), whereas fixation-based metrics showed no significant correlation (P = .174; P = .234). These findings suggest that Gen Z’s preferences for traditional pinprick lantern art are theme-dependent and shaped by emotional and cognitive engagement. The study offers empirical evidence, through both subjective and objective measures, to better understand how ICH artworks are perceived by late Gen Z audiences, contributing to ICH transmission and the promotion of aesthetic education.

图: 《黛玉葬花》眼动热力图

Figure: Daiyu Burying the Fallen Flowers eye-tracking heatmap.

08

从浪漫到现实:数字人文视域下华语流行歌词的词汇与主题演变

From romance to reality: lexical and topic evolution in Chinese popular lyrics through digital humanities approaches

Yubo Wang , Lüyuan Wang , Fang Xie , Haitao Liu

摘要:本研究探究2000-2025年华语流行歌词的词汇与主题演变,映射大众情感变迁与社会文化转型。现有研究多忽视非西方歌词语料库,本研究填补这一空白,构建涵盖25年、1560首代表性歌曲的华语流行音乐历时语料库。研究采用数字人文方法,融合词频分析、可读性指标与BERTopic主题建模,追踪歌词词汇与主题的历时演变。研究发现,歌词高频词汇始终围绕情感表达、个体自省与人际互动三大核心;类符形符比显著提升,表明歌词词汇丰富度持续增长,文本复杂度呈波动变化,反映出创作风格的动态转向。主题分析识别出浪漫爱情、未来期许、都市生活等12大核心主题,主题结构从自然与时间的抽象表达,逐步转向情感具象化与心理内省化书写;近年来,负面情感主题与自我指涉艺术母题的占比显著上升。本研究为音乐、语言与社会交叉领域研究提供了全新方法论框架,彰显了数字人文工具在大规模歌词分析中,描摹集体情感与文化变迁的核心价值。

Abstract:This study explores the lexical and topic evolution of Chinese popular music lyrics from 2000 to 2025, reflecting changing public sentiments and broader socio-cultural transitions. While prior research has largely overlooked non-Western lyric corpora, this study addresses that gap by constructing the Chinese Popular Music Diachronic Corpus, comprising 1,560 representative popular songs sampled across twenty-five years. Using digital humanities approaches, it integrates word frequency analysis, readability metrics, and BERTopic-based topic modelling to trace lexical and topic evolution of lyrics over time. Findings reveal that high-frequency words consistently revolve around emotional expression, individual introspection, and interpersonal dynamics. Type-token ratio (TTR) has increased significantly, indicating growing lexical diversity, while textual complexity shows fluctuation, reflecting stylistic shifts in song writing. Topic analysis identifies twelve major topics, including romantic love, future aspirations, and urban life, with topic structures evolving from natural and temporal abstraction to emotional concreteness and psychological introspection. Recent years show a significant rise in negative emotional topics and self-referential artistic motifs. This study contributes a novel methodological framework for interdisciplinary research at the intersection of music, language, and society, and underscores the value of digital humanities tools in mapping collective emotions and cultural change through large-scale lyric analysis.

图:各项指标历年变化趋势

Figure:Trends of various metrics over the years.

09

解码人工智能话语:基于机器学习的中德语境媒体表征对比研究(2018-2023)

Decoding AI discourse: contrastive analysis of media representations in German and Chinese contexts (2018–23) using machine learning techniques

Kuanyong Qiu , Noah Bubenhofer , Timo Hackel

摘要:现有研究多聚焦单一语言媒体中的人工智能(AI)话语,缺乏跨文化语境的对比分析。本研究优化露丝・沃达克话语分析框架,结合前沿机器学习方法,分析 2018-2023 年中德两国媒体话语中的人工智能表征。研究发现,中德媒体均聚焦本土相关的人工智能议题:中国媒体频繁援引政治人物言论(尤以习近平主席为核心),采用视角建构策略,对人工智能始终持积极立场;德国媒体则侧重科技人物叙事,尤其在ChatGPT发布后,对人工智能持更为批判与审慎的态度。两国媒体话语的差异,源于本土语境塑造的差异化媒介文化体系:中国媒体隶属于政党体系,将人工智能定位为推动经济发展的国家战略核心,传递政府核心立场;德奥瑞三国媒体则呈现多元视角,高度关注人工智能的潜在风险。本研究为各国人工智能政策的解读与制定提供了重要参考依据。

Abstract:Previous studies have primarily focused on artificial intelligence (AI) discourse within specific language media, with limited contrastive analyses across different cultural contexts. This study analyzes the representation of AI in German and Chinese media discourses from 2018 to 2023, employing a modified version of Ruth Wodak’s discourse analysis framework alongside advanced machine learning methods. Our findings indicate that both German and Chinese media concentrate on AI issues pertinent to their regions. Chinese media adopt a perspective strategy by frequently quoting political figures, particularly President Xi Jinping, and consistently maintain a positive stance on AI. Conversely, German media, especially after the launch of ChatGPT, highlight high-tech figures and adopt a more critical and cautious approach toward AI. These differences in media discourses arise from distinct media cultural systems shaped by their respective contexts. In China, media outlets are party-affiliated and promote a narrative framing AI as a national strategic endeavor crucial for economic growth, reflecting governmental viewpoints. In contrast, media from Germany, Austria, and Switzerland present diverse perspectives on AI, expressing significant concerns about its potential risks. This study offers valuable insights for interpreting and formulating AI policies across different nations.

图: 2018-2023 年中国媒体人工智能语料库十大子主题历时变化

Figure:Top ten subtopics over time 2018–2023 in Chinese media AI-related corpus (Color version of the figure is available in the supplementary data).

10

文化分析与表征政治:埃及《箴言》杂志中犹太群体形象的呈现研究(1933-1953)

Cultural Analytics and the Politics of Representation: Mapping the Jewish Presence in Egypt’s al-Risālah (1933–1953)

Eid Mohamed , Said Hassan

摘要:本文融合文化分析与后殖民理论,探究1933-1953年埃及主流文学期刊《箴言》中犹太群体的形象表征。研究运用数字文本分析方法,识别并解读期刊档案中犹太形象的建构范式,揭示两次世界大战之间及战后初期,阿拉伯知识分子在政治张力下对犹太身份的协商与阐释。这一跨学科研究方法实现了量化建模与文本细读的结合,精准剖析文化生产机制,呈现这一关键历史节点阿拉伯印刷话语的内在矛盾性。本研究的核心价值在于,对锡安主义兴起与以色列建国这一重塑阿拉伯世界族群关系的关键时期的媒介文本开展数字化研究:随着阿拉伯犹太人大规模撤离埃及,《箴言》中犹太形象的动态演变,折射出社会层面对民族身份、宗教差异与殖民遗产的集体焦虑。全文分为两部分:第一部分将《箴言》置于反殖民与后奥斯曼知识思潮中,阐释其成为阿拉伯现代性多元理念博弈平台的历史背景;第二部分结合远读与阐释性分析,梳理期刊对犹太人的三重身份建构——现代性符号、西方帝国主义受害者、阿拉伯主权威胁者。这些形象建构并非单纯的历史遗存,更深刻影响着当代族群宗教身份与政治归属感的认知。本研究将数字人文工具与知识生产的后殖民批判相结合,为阿拉伯印刷文化、形象表征与媒介史研究提供了全新的方法论与认识论范式。

Abstract:This article investigates the representation of Jews in al-Risālah, a major Egyptian literary magazine (1933–53), by integrating Cultural Analytics and postcolonial theory. Using digital text analysis methods, it identifies and interprets patterns of Jewish representation within al-Risālah’s archive, uncovering how Arab intellectuals negotiated Jewishness amid the political tensions of the interwar and early postwar periods. This interdisciplinary approach enables a nuanced examination of cultural production, bridging quantitative modelling with close textual reading to reveal the ambivalences of Arab print discourse during a pivotal historical moment. The study’s significance lies in its digital examination of media texts published during the rise of Zionism and the establishment of Israel, an era that reshaped intercommunal relations across the Arab world. As Arab Jews began departing Egypt en masse, al-Risālah’s evolving depictions of Jews became symptomatic of broader anxieties over national identity, religious difference, and colonial legacies. Structured in two parts, the first contextualizes al-Risālah within anti-colonial and post-Ottoman intellectual currents, illustrating how the magazine became a platform for competing visions of Arab modernity. The second part synthesizes distant reading with interpretive analysis to assess how al-Risālah conceptualized Jews: as symbols of modernity, victims of Western imperialism, or threats to Arab sovereignty. These portrayals are not merely historical curiosities but inform contemporary understandings of ethno-religious identity and political belonging. By fusing digital humanities tools with a postcolonial critique of knowledge production, this study contributes a new methodological and epistemological model for analysing Arab print culture, representation, and media history.

图:《箴言》杂志核心关键词年度出现频次

Figure.Recurrence of key words in al-Risālah by years.

编译|洪冰凤

校对|罗斯鹏

排版|魏翔

阅读原文

跳转微信打开

  •  

新书推荐 |《面向大数据的社会网络分析与文本挖掘:语言与网络的力量》

2026-04-10 08:31 湖北

Social Network Analysis and Text Mining for Big Data: The Power of Words and Networks提出了前沿的方法和工具,弥合了文本挖掘与社交网络分析研究之间的鸿沟,同时也为分析大规模文本和网络数据提供了新的见解。

《面向大数据的社会网络分析与文本挖掘:语言与网络的力量》(Social Network Analysis and Text Mining for Big Data: The Power of Words and Networks)提出了前沿的方法和工具,弥合了文本挖掘与社交网络分析研究之间的鸿沟,同时也为分析大规模文本和网络数据提供了新的见解。这些工具旨在满足商业分析师和研究人员的需求,以助力开创性分析结果的产生。

本书首先对社会网络分析和文本挖掘给出了明确定义,并融合了作者在该领域广泛研究中精心挑选的方法和工具。随后,重点演示了词汇与网络之间的相互作用如何释放大数据分析的全部潜力。书中的核心亮点是 Semantic Brand Score (SBS),这是一种通过文本分析评估品牌重要性的多功能且强大的指标。以上内容均通过实际应用和案例研究得到了证实与阐述,展示了这些分析方法在支持变革和优化管理决策方面的价值。书中还介绍了一款专门的软件工具,帮助用户执行文中详述的各项分析。

该书是商业领袖、营销专业人士、政策制定者、研究人员和大学生的必读之作。它为提升公司绩效和社会行动成效提供了实用的洞察和可操作的建议。全书写作风格兼顾了专业性与易读性,使资深研究人员和初涉该领域的读者都能理解其中的复杂概念。

作者介绍

安德烈亚·弗龙泽蒂·科拉东

Andrea Fronzetti Colladon

Andrea Fronzetti Colladon在罗马第三大学(Roma Tre University)担任教授,并负责领导商业与集体智能实验室(Business and Collective Intelligence Lab)。他致力于研究组织与个人的沟通、决策及变革模式,通过解码复杂系统为管理决策提供科学依据。他的研究融合了网络科学、自然语言处理和机器学习方法,并与社会科学、心理学和人文学科理论相结合,体现了深厚的跨学科底蕴。他发明了语义品牌评分(Semantic Brand Score)和OCEAN™变革管理模型(OCEAN™ Change Management Model),旨在将学术洞察转化为组织领导者可用的实践工具。其学术足迹涵盖了与麻省理工学院集体智能中心(MIT Center for Collective Intelligence)、东北大学(Northeastern University)和西奈山医院(Mount Sinai Hospital)等国际顶尖机构的广泛合作。作为多部学术著作的作者,他的代表作品包括本书以及《引领有意义的变革》(Leading Meaningful Change),这些著作为理解语言与网络在数据分析中的力量提供了重要框架。此外,他还通过教学与咨询服务于TIM(TIM)、Enel(Enel)和萨奇广告(Saatchi & Saatchi)等知名企业,助力团队应用创新管理工具并在复杂环境中提升竞争力。

罗伯托·韦斯特雷利

Roberto Vestrelli

Roberto Vestrelli现为意大利佩鲁贾大学(University of Perugia)工业与信息工程专业的博士候选人。他与安德烈亚·弗龙泽蒂·科拉东教授(Andrea Fronzetti Colladon)合著了《大数据的社会网络分析与文本挖掘:词汇与网络的力量》(Social Network Analysis and Text Mining for Big Data: The Power of Words and Networks)一书,展示了其在大数据分析领域的学术造诣。罗伯托·韦斯特雷利(Roberto Vestrelli)的研究方向集中于社会网络分析、文本挖掘及其在商业、环境治理与社会科学中的应用。他的研究成果涵盖了气候风险信息披露对企业价值的影响、媒体在塑造能源叙事中的作用,以及大语言模型在评估新闻自由时的表现等前沿课题。此外,他还参与开发了针对GDELT数据库(GDELT)的文本重构工具,并致力于通过大数据方法分析非洲地区的外国直接投资决定因素。通过将语义品牌评分等量化指标应用于数字营销与服务管理,他为理解复杂网络中的言论力量提供了重要的技术支持与理论视角。

出版信息

书名:《面向大数据的社会网络分析与文本挖掘:语言与网络的力量》(Social Network Analysis and Text Mining for Big Data: The Power of Words and Networks)

作者:Andrea Fronzetti Colladon, Roberto Vestrelli

出版时间:2025年6月20日

出版社:Routledge

DOI:

https://doi.org/10.4324/9781003504849

内容简介

本书系统展示了语言与社会网络相互交织所产生的深刻影响。该书的核心论点在于,文本与社会联系并非彼此孤立的两类对象,而是在持续互动中共同塑造人的观念、态度乃至更广泛的历史进程。作者以跨学科的研究视野,将社会网络分析(social network analysis, SNA)与文本挖掘加以整合,旨在揭示大数据表象之下更为复杂的社会关系结构与意义生成机制。

在方法层面,本书首先从社会网络分析的基本概念出发,细致介绍了节点、边、中心性和社群发现等关键工具,并说明这些分析框架如何被用于识别非正式领导者、追踪信息传播路径以及刻画群体内部的互动模式。随后,论述转向文本挖掘领域,涉及语料预处理、命名实体识别、情感分析等核心技术。全书最具特色之处,在于将二者加以有机结合:作者不仅将文本转化为词汇共现网络,还提出了语义品牌评分(Semantic Brand Score, SBS)这一指标,用以衡量某一品牌、概念或议题在社会话语中的重要性、关联性与记忆度。

本书试图回应的一个关键问题,是传统大数据分析中结构维度与语义维度之间长期存在的割裂。在海量非结构化文本的处理中,单纯依赖词频统计往往难以揭示更深层的意义关系,而复杂的机器学习模型虽然具有较强的预测能力,却常常因其“黑箱”特征而缺乏充分的可解释性。针对这一局限,本书提出了一条兼具理论解释力与方法可操作性的研究路径,即通过考察词语之间的连接关系来界定其意义生成方式。与此同时,它也在一定程度上克服了传统问卷调查中常见的响应偏差问题:通过对电子邮件流、社交媒体评论等自然生成数据的分析,研究者能够更接近群体行为与决策过程中的“诚实信号”,从而获得对社会互动模式更为真实的把握。

对于数字人文研究而言,这本书具有明显的方法论启发意义。它既可被视为连接计算分析与人文解释的桥梁,也可被视为重新审视文化、历史与社会现象的一种分析透镜。借助书中所提供的工具与案例,研究者得以超越传统质性细读的单一路径,在大规模文本数据中识别潜在的主题演变、话语结构与权力关系。无论是分析媒体报道、法律文献,还是文学文本——例如书中讨论的《爱丽丝梦游仙境》——这种方法都展示出较强的解释潜力。它不仅有助于重构历史语境中话语如何被策略性地使用,例如俾斯麦对电报文本的修辞性处理,也能够用于考察当代社会在气候风险、人工智能等议题上的认知偏向与舆论形成机制。

章节目录

一、 语言与网络的隐藏力量:统一分析方法

二、网络分析:核心概念与指标

1 社会网络分析

2 基础术语

3 从头构建网络

4 全网络指标

5 聚类与社区

  5.1 聚类

  5.2 社区发现

      5.2.1 Louvain 算法

6 相似性度量

  6.1 Jaccard 相似性

  6.2 SimRank 与其他度量

  6.3 同质性与同类匹配

7 网络拓扑结构

8 网络鲁棒性与韧性

  8.1 碎裂化度量

  8.2 网络拓扑对其鲁棒性的影响

9 节点中心性

  9.1 度中心性

  9.2 接近中心性

  9.3 中介中心性与结构洞

  9.4 特征向量中心性

  9.5 独特中心性

10 关键角色

11 考虑时间:互动性度量

  11.1 轮换领导力

  11.2 贡献的响应性与平衡

  11.3 同步性

三、文本挖掘

1 语料库预处理

  1.1 描述性统计

2 命名实体识别

3 关键词提取与文档分类

  3.1 文档分类的特征提取

  3.2 文档相似性

  3.3 寻找同义词和相关词汇

4 内容分析

  4.1 新颖性与信息量

  4.2 可读性与数值强度

  4.3 情绪挖掘

  4.4 代词与关系词

5 构建自定义度量:效度与信度

四、从语言到网络

1 构建词网络

2 语义品牌评分

  2.1 品牌形象与联想

  2.2 提高品牌连接性

3 网络主题模型

五、文本挖掘与社会网络分析的集成:案例研究与应用

1 媒体报道揭示了领先科技公司的品牌重要性吗?

  1.1 理解语料库特征

  1.2 寻找最相关的语料库内容

  1.3 衡量科技巨头的语义重要性

  1.4 理解品牌重要性的驱动因素

  1.5 区分语义重要性的正负驱动因素

2 评估工作的未来:哪些工作最容易受到人工智能颠覆?

  2.1 从在线新闻中识别 AI 技术

  2.2 AI 的角色

  2.3 衡量暴露程度

  2.4 创新度量

3 数据驱动的职场文化提升方法

  3.1 区分正面评论与负面评论的因素是什么?

  3.2 主题模型与多语言分析

  3.3 内容分析

4 通过 Airbnb 评论的文本挖掘评估纽约市的城市体验

  4.1 空间自相关与价格相关性

  4.2 城市特征相关性

  4.3 品牌形象

章节摘要

第一章

语言与网络的隐藏力量:统一分析方法

语言和网络在塑造历史、文化和人类行为方面拥有巨大的力量。本引言章节探讨了词汇如何通过精心构建的叙事产生激发情感反应、驱动社会变革或引发冲突的潜力,正如 Franco-Prussian War 期间的 Ems Dispatch 所证明的那样。与此同时,通过 Social Network Analysis (SNA) 描绘的人类联系揭示了维系社会、影响领导力并推动运动的隐藏结构。当 Text Mining 与 SNA 的技术工具相结合时,会产生极具价值的洞见,从而使人们能够更深入地理解决策过程和社会动态。基于这一观点,本章介绍了支持复杂系统研究的分析工具,阐明了语言和网络如何塑造人类互动以及社会结果。

Words and networks hold immense power in shaping history, culture, and human behavior. This opening chapter explores how words, through carefully crafted narratives, have the potential to evoke emotional responses, drive societal change, or initiate conflicts, as demonstrated by the Ems Dispatch during the Franco-Prussian War. At the same time, (human) connections – mapped through social network analysis (SNA) – reveal the hidden structures that bind societies, influence leadership, and drive movements. Invaluable insights emerge when the techniques and tools of text mining and SNA are combined, enabling a deeper understanding of decision-making processes and social dynamics. In line with this view, this chapter introduces analytical tools to support the study of complex systems, shedding light on how words and networks shape human interaction and societal outcomes.

第二章 

网络分析:核心概念与指标

本章介绍了(社会)网络分析的基础与高级概念,为理解网络如何辅助研究复杂现象奠定了坚实基础。内容从定义网络及其核心组成部分(如节点与边)展开,解释了如何利用来自访谈或非结构化来源的数据来表述和分析社会现象。通过引入中心性指标,本章使读者能够识别网络中处于战略位置的节点,并探讨了聚类与社区,重点介绍了在图谱中检测这些结构的技术。讨论进一步延伸至识别社会系统中的关键角色,以及理解网络位置变迁所带来的影响。此外,本章还探索了动态网络分析,概述了考察随时间演变的互动动态的方法,并引入了诸如轮换领导力等指标。依托作者的专业积累,本章对其实际科研工作中应用最广、影响最大的指标和技术进行了实用的、以研究为导向的综述。本章并不追求面面俱到,而是旨在为读者提供掌握并应用基础与高级概念所需的核心工具。

This chapter introduces fundamental and advanced (social) network analysis concepts and builds a foundation for understanding how networks help study complex phenomena. It begins with defining networks and their main components, such as nodes and edges. The chapter explains how to represent and analyze social phenomena using data from interviews or unstructured sources. It introduces centrality metrics, enabling readers to identify strategically positioned nodes within a network, and examines clusters and communities, focusing on techniques to detect them in a graph. The discussion extends to identifying key roles within a social system and understanding the implications of positional changes in a network. The chapter also explores dynamic network analysis, outlining methods for examining time-evolving interaction dynamics and introducing metrics such as rotating leadership. Building on the authors’ expertise, this chapter offers a practical, research-driven overview of the most impactful metrics and techniques used in their scientific work. Rather than aiming for exhaustive coverage, it focuses on equipping readers with essential tools needed to grasp and apply both foundational and advanced concepts.

第三章 

文本挖掘

本章全面介绍了文本挖掘与自然语言处理(NLP),重点探讨了分析大规模非结构化文本数据的实用技术。内容涵盖了数据预处理、情感分析和命名实体识别等核心方法,并特别侧重于词网络的构建与解读。文中展示了评估文本特征(如新颖性、信息量和复杂性)的基础及高级方法。此外,本章还突出了社会网络分析在考察词汇关系中的创新应用,为文本数据分析提供了独特的视角。

This chapter offers a comprehensive introduction to text mining and natural language processing (NLP), emphasizing practical techniques for analyzing large-scale unstructured text data. It covers core methods like data preprocessing, sentiment analysis, and named entity recognition, with a particular focus on constructing and interpreting word networks. We present basic and advanced approaches for evaluating textual features, such as novelty, informativeness, and complexity. We also highlight the innovative application of social network analysis to examine word relationships, offering a unique perspective on textual data analysis.

第四章

从语言到网络

本章探讨了将文本数据转化为网络的方法,以及利用社会网络分析技术对其进行分析的优势。文中强调了结合文本挖掘与网络分析以理解词汇间关系的强大力量,并阐述了该方法在市场营销和自然语言处理等领域的应用。本章还介绍了 Semantic Brand Score,这是一种通过网络分析衡量文本数据中品牌或概念重要性及记忆度的综合指标。最后,我们展示了这些方法的实际应用,包括品牌形象分析以及一种新颖的主题模型构建方法。

This chapter explores the transformation of textual data into networks and the benefits of analyzing them using social network analysis techniques. The chapter emphasizes the power of combining text mining and network analysis to understand relationships between words and how this approach can be applied to fields such as marketing and natural language processing. The chapter also introduces the Semantic Brand Score, a composite indicator designed to measure the importance and memorability of brands or concepts within textual data by leveraging network analysis. Lastly, we demonstrate practical applications of these methods, including brand image analysis and a novel approach to topic modeling.

第五章

文本挖掘与社会网络分析的集成:案例研究与应用

本章通过四个案例研究阐明了整合网络分析与文本挖掘技术的价值。第一个案例研究利用 New York Times 的在线新闻文章,评估了四个科技品牌的 Semantic Brand Score。第二个案例研究探讨了人工智能对劳动力动态的影响,其数据基础源于专利和职位描述。第三个案例研究聚焦于从 Glassdoor 收集的某全球咨询公司员工评论,展示了识别组织优劣势感知的有效方法。最后一个案例研究则通过挖掘 New York City 的 Airbnb 住客评论,利用非结构化文本勾勒出该市的各类城市特征。虽然目前已有大量用于 Social Network Analysis 和 Text Mining 的软件包,以及 R 和 Python 等编程语言的函数库,但能有效融合这些方法的图形界面应用仍较为匮乏。由本书作者之一开发的 SBS BI 软件集成了前述章节讨论的网络分析、文本挖掘及词网络分析技术,为研究者提供了针对这些方法的集成化解决方案。

This chapter presents four case studies that illustrate the value of integrating network analysis and text mining techniques. The first case study assesses the Semantic Brand Score of four technology brands by analyzing online news articles from the New York Times. The second case study explores the influence of artificial intelligence on workforce dynamics, using textual data from patents and job descriptions. The third case study focuses on employee reviews for a global consulting firm collected from Glassdoor, showcasing methods to effectively identify perceived organizational strengths and weaknesses. The final case study examines Airbnb guest reviews in New York City, leveraging unstructured text to map various urban characteristics of the city. While numerous tools and software packages are available for social network analysis and text mining, along with extensive libraries for programming languages like R and Python, few graphical interface applications effectively combine these methodologies. The SBS BI software, developed by one of the book’s authors, incorporates the network analysis, text mining, and word network analysis techniques discussed in the previous chapters, providing an integrated approach to these methods.

章节选读

第一章

语言与网络的隐藏力量:统一分析方法

社会网络分析(SNA)是一种方法论路径,用于描绘由相互连接的实体所构成网络的结构、关系与动态从根本上说,SNA 关注的是对个体、组织,或任何一种(社会)系统之间关系的映射与测量。这些连接通常被称为“边”(edges),它们将各个实体——也就是“节点”(nodes)——连接起来,形成网络框架。SNA 的历史根源可以追溯到社会学与人类学。当时,研究者试图理解社会结构与亲属体系。然而,直到计算工具和图论出现之后,SNA 才真正发展成为一门坚实而有前景的分析学科。随着我们所处的世界日益互联互通,分析和解释周围复杂系统的能力也变得愈发重要。今天,SNA 的应用已经远远超出社会科学本身,延伸到诸如生物学领域——例如研究蛋白质相互作用;流行病学领域——例如追踪疾病传播;商业领域——例如识别关键影响者;以及网络安全领域——例如检测计算机网络中的脆弱点。

当某一现象被以网络形式分析和表征时,对其结构和连接的考察能够揭示大量关于其运作方式的信息。例如,在一个社会系统中,高度连接的个体,亦即“中心节点”,可能在影响信息扩散方面发挥关键作用。而系统中的边缘节点虽然看似不那么重要,却可能提供接触新信息的机会,或在不同社群之间充当桥梁。同样,SNA 还可以用于评估复杂系统的韧性、适应性与脆弱性。例如,在一个高度中心化的网络中,移除一个关键节点便可能导致整个系统碎裂。相反,在一个更加去中心化的结构中,失去单一节点对整体功能的影响则较小。想一想,在对抗流行病或病毒时,正确切断一个人际网络中的连接是何等关键。

另一方面,文本挖掘是从大量非结构化文本中提取有价值信息和模式的过程。在一个被电子邮件、社交媒体帖子、文章、评论、访谈转录稿等数字内容所充斥的世界里,文本挖掘为我们提供了一套工具,使我们能够将海量文本数据转化为结构化数据。文本挖掘植根于自然语言处理(NLP)、计算语言学和信息检索。起初,它的应用相对有限,主要涉及一些较为简单的任务,例如从文献语料中提取关键词,或进行文档分类。然而,随着机器学习和人工智能的进步,文本挖掘已经扩展到更广泛的复杂技术之中,例如情感分析、主题建模以及实体识别。文本挖掘的应用几乎没有边界。企业利用它分析顾客评论和社交媒体讨论,从而依据消费者反馈调整策略。法律专业人士借助它筛查成千上万份文件,识别与案件相关的信息。在学术界,研究者则可以利用文本挖掘分析科学论文或文学作品,发现那些本来可能被忽略的趋势与洞见。

文本挖掘真正的挑战,在于人类语言的非结构化本质。语言丰富、复杂,并且高度依赖语境,这使其难以用传统统计方法加以分析。词语常常具有多重意义,语境会深刻影响理解,而不同语言之间的语法结构又可能存在巨大差异。本书讨论了多种文本预处理、分类和分析技术,旨在将表面上的混乱转化为有意义的结构化信息。我们也强调文本挖掘在不同领域中的实际应用,通过现实案例展示文本数据如何能够被有效利用。例如,我们表明,只要分析得当,文本就能够揭示潜在情绪、识别新兴趋势,并为理解人类行为提供有价值的洞见。到目前为止,我们已经介绍了两门看似彼此分离的学科。前者聚焦于从人类语言中分析并组织信息内容,后者则聚焦于组织和解释社会关系与互动。那么,这两个领域之间的连接究竟是什么?语言研究与网络研究之间的联系又在哪里?对此,我们已经可以从一个应用场景中找到部分答案:思考我们的大脑如何运作,以及为什么我们能够记住所读到或听到的内容。

正如前文所示,当词语变得令人难忘时,它们就拥有塑造命运或引发革命的力量。那么,究竟是什么决定了可记忆性?可记忆性并非纯属偶然;它是语言、结构和内容经过有意识选择之后,与人类心智发生共鸣的结果。词语和话语的可记忆性,对于理解它们如何影响人类行为至关重要。当令人难忘的词语被内化时,它们会塑造我们的感知,并驱使我们以某种特定方式行动。长期以来,研究者一直试图解释,为什么有些事物会被记住,而另一些则不会。很多人能够立刻认出某个鞋类品牌,或准确回忆起自己在商店里与谁交谈过,却很难记住购物清单上的项目。一个多世纪以来,心理学家始终在试图理解,究竟是什么因素决定了词语与文本的可记忆性。人类语言是表达和传递复杂思想的一种极其强大的工具。它的力量在于其组合性本质:意义不仅由单个词语决定,也由它们的线性结构和相互关系共同决定。对这两个方面——即词语意义及其连接关系——进行分析,有助于回答一个关键问题:为什么有些概念比其他概念更容易被记住,为什么某些词语更具可记忆性。Aka 及其同事发现,可记忆性的一个关键因素,在于我们的大脑会将词语与特定的语义类别联系起来。例如,像 uhm 和 damn 这样的口语词与俚语更容易被记住;与死亡相关的词语,如 bury 和 kill,也更容易被记住;与宗教相关的词语,如 altar,也同样如此。

语义记忆,也就是对一般知识与事实的记忆,在词语记忆中发挥着重要作用。我们的大脑和记忆是以联想方式运作的;也就是说,一个词之所以能留在我们脑中,是因为它与记忆中已经存储的某个概念发生了连接。因而,那些意义深厚、带有情感负荷、或与个人经验相关的词语,更容易被记住,这一点并不奇怪。按照 Tulving 的说法,语义记忆就像一个巨大的关于世界一般知识的存储系统,其中包括事实、概念和意义。因此,语义的认知层面,关涉的是大脑如何借助通过语言被调取和操控的储存信息,来表征抽象与具体概念。词语之所以会变得令人难忘,是因为它们在我们内心深处激起了某种共鸣——要么唤起与经验相连的情感,要么连接到先前获得的知识。传统观点通常认为,词语的结构(以及连接关系)与其意义是在大脑中分开处理的:前者由额叶区域处理,后者由颞叶区域处理。然而,Shain 等人在一项最新研究中发现,这两个要素实际上是通过同一个广泛分布的额颞脑网络来处理的。人脑的这种运作方式意味着:当我们阅读或聆听一个句子或一段话语时,大脑并不会把结构与意义分离开来;二者是同时并且整合地被处理的。

语义学研究的是语言中的意义,研究词语和短语如何表达思想、传达观念。但正如前文所指出的,人类语言不仅具有语义,也具有结构,也就是词语彼此如何关联、如何连接。词语会受到其所处语境、句法和语法结构的塑造。例如,请看这个句子:The bank closed at 5 PM。bank 这个词可以指金融机构、河岸,甚至可以指飞机的一个倾斜动作。语义学帮助我们识别这些可能的意义,但句子的结构及其中其他词语,尤其是动词 closed,则提示这里所说的是一家金融机构。类似 at 5 PM 这样的时间表达,又进一步澄清了这一解释。由此可见,一个词的意义,是通过它与其他词语的互动而形成的。因此,文本分析不能排除对词语连接关系的研究,因为词语的意义往往与其关系网络不可分割。

那么,有哪些工具可以用统一的方式分析词语的意义及其连接关系?本书最后几章试图回答这一问题,我们提出了一些分析方法,将词语与其关系纳入同一个统一框架之中加以考察。

例如,当我们把网络分析应用于文本时,就可以揭示词语之间的关系,以及这种相互连接性如何影响它们的可记忆性与影响力。网络分析使我们能够对术语、短语以及更广泛文本结构之间的连接进行可视化与量化。通过研究语义网络,我们学会把语言视为一个由相互连接元素构成的复杂系统,正如社会网络将人与人之间的关系加以映射一样。在这种网络中,节点可以代表词语或短语,边则代表它们之间的连接,例如共现关系。借助这一视角,我们能够识别出那些在传统分析中并不容易显现的模式与结构。例如,通过绘制一篇演讲或一段文字的语义网络,我们可以识别出那些充当“枢纽”的关键词——即在整个话语中高度连接、并对整体信息产生显著影响的词语。这些枢纽词对于文本的可记忆性可能至关重要,因为它们能够锚定内容,并促进回忆。同样地,应用于文本的网络分析还可能揭示文本的模块化结构,呈现不同主题或议题如何相互连接,并共同服务于一则信息的整体意义。本书表明,网络分析一旦与文本分析结合,就会成为剖析语言复杂性的强有力工具;它不仅使我们能够以统一方式理解各个组成部分,也使我们能够理解这些组成部分如何共同生成意义。

将社会网络分析与文本挖掘整合起来,为理解人类行为带来了一个新的维度。网络并不仅仅关乎谁与谁发生连接,正如词语也绝不仅仅是孤立的发声。二者结合起来,构成了一幅由互动、影响与意义交织而成的复杂织锦。通过同时分析个体、组织,甚至观念之间的关系,以及它们所使用的语言,我们就能够以前所未有的方式洞察信息如何流动、决策如何形成,以及人们如何回应其周围世界。例如,通过结合网络与词语的力量,我们就能够描绘、分析并理解媒体如何塑造某一位领导人或某一政治党派的形象。当某个政治人物在语义网络中处于中心位置时,他可能会在公民心中留下强烈印象。设想一个政治品牌频繁出现在新闻报道中,并经常与深嵌于媒体话语中的多样化主题或概念联系在一起,例如慈善、可持续性或移民议题。这个政治品牌就可能在潜在选民心中脱颖而出。实际上,只要观察媒体话语所生成的词语网络,便有可能预测选举结果。然而,网络分析与语义分析的结合,并不限于政治领域。这种方法可以应用于广泛的行业与场景。以推动能源转型这一挑战为例:我们如何确保像 energy community 或 green transition 这样的概念能够在消费者心中引发共鸣,并进而影响其行为?如果仅仅依赖这些术语出现的频率,一场单纯的媒体宣传攻势可能远远不够。真正使这些概念具有影响力的,是意义与词语连接方式的结合——也就是,这些信息如何与共同价值、日常关切或未来愿景发生联系。某些词语被如何、有意识地安放在媒体话语结构之中,往往决定了一场行为变革是否能够成功;正如精确校准过的修辞既可能引发冲突,也可能促进和平。

同样,企业传播材料,如新闻发布会或年度报告,也可以被分析,以揭示企业在大流行病、气候风险或社会议题参与等关键问题上的关注程度。这些文档中所形成的词语网络,不仅有助于衡量企业讨论这些问题时的强度,也有助于衡量其承诺的一致性与深度。总之,本书从理论与实践两个层面,为如何运用词语与网络的力量提供指导,重点讨论社会网络分析、文本挖掘及其整合应用。

以上内容来自书籍官网

https://www.taylorfrancis.com/books/mono/10.4324/9781003504849/social-network-analysis-text-mining-big-data-andrea-fronzetti-colladon-roberto-vestrelli

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编辑 丨魏翔

校对 丨洪冰凤

排版 丨罗斯鹏

阅读原文

跳转微信打开

  •  

会议通知丨中国历史文献研究会数字文献分会第四届年会

2026-04-03 08:30 湖北

为深入贯彻落实国家相关战略部署,中国历史文献研究会数字文献分会联合湖北大学文学院,立足雅学与传统语言文献的数字化整理及数据库建设实践,拟于2026年10月在武汉举办“中国历史文献研究会数字文献分会第四届年会”。

2026

国历史文献研究会数字文献分会

第四届年会

中国·武汉

在数字人文蓬勃发展的时代背景下,古籍文献的整理、研究与传承已步入数智赋能的新阶段。国家高度重视古籍资源的转化利用,明确以体系化整理、知识化构建、智能化应用为导向,系统推进古籍数字化进程。

为深入贯彻落实国家相关战略部署,进一步探讨数智时代传统文献研究的理论前沿与实践路径,中国历史文献研究会数字文献分会联合湖北大学文学院,立足雅学与传统语言文献的数字化整理及数据库建设实践,拟于2026年10月武汉举办“中国历史文献研究会数字文献分会第四届年会”。

会议拟围绕数智赋能下的传统文献本体研究、数据库及数据平台建设、数字人文教育教学理论与实践、人文学科高水平实验室建设等问题展开深入研讨,旨在推动古籍整理研究的理论、方法与实践创新,促进古籍资源的当代传承与活化利用。诚邀海内外专家学者与青年学子踊跃投稿、莅临研讨,携手推进古籍数字化研究与传承创新,共促数字文献研究高质量发展。

1

会议时间

2026年10月下旬

2

会议地点

湖北武汉

3

会议议题

共设置7个议题

1. 中国古典文献文本分析

2. 雅学与传统语言学研究

3. 中国古典文献的数字化整理与研究

4. 古籍大数据构建及智能体辅助研究

5. 数字人文理论与方法探索

6. 数字人文人才培养与教学实践

7. 人文学科高水平实验室建设

4

参会与投稿

请有意参会者于2026年6月30日前扫码提交参会回执;

2026年8月31日前提交会议论文全稿至会议邮箱shuziwenxian@ancientbooks.cn。

扫码填写参会回执

5

会议费用

1. 会议不收会务费;

2. 交通费、住宿费自理;

  1. 承办方负责会期餐食及会议其他费用。

6

会议联系

杜老师 :027-88661842

朱老师 :010-63311541

会议邮箱:

shuziwenxian@ancientbooks.cn

中国历史文献研究会数字文献分会

湖北大学文学院

中华书局古联公司

2026年 2月14日

END

来源 | 数字人文专业发展联盟

阅读原文

跳转微信打开

  •  

案例征集 | 面向全球!2026年世界互联网大会文化遗产数字化案例征集即日启动!

世界互联网大会 2026-04-03 08:30 湖北

以下文章来源于:世界互联网大会

世界互联网大会

世界互联网大会国际组织总部设在中国北京,宗旨是搭建全球互联网共商共建共享平台,推动国际社会顺应数字化、网络化、智能化趋势,共迎安全挑战,共谋发展福祉,携手构建网络空间命运共同体。

三星堆青铜神树借助裸眼3D技术动态呈现纹饰密码;应县木塔的榫卯结构在数字世界里实现完整“重生”;永乐宫壁画穿越700多年时空,“衣袂飘飘、裙裾飞扬”……2025年7月,世界互联网大会首次面向全球启动文化遗产数字化案例征集,最终遴选出40项案例,汇编成《世界互联网大会文化遗产数字化案例集(2025)》,为相关领域工作提供了可借鉴的实践经验。

今年,世界互联网大会继续面向全球征集文化遗产数字化优秀案例,促进数字技术赋能文化遗产保护,推动文化与科技高度交融,历史与现代深入交织,在数字浪潮中拓展文化遗产的崭新边界。

1

参与征集能获得哪些机遇

1. 入选《世界互联网大会文化遗产数字化案例集(2026)》,获颁证书。

2. 受邀出席世界互联网大会乌镇峰会等重要会议活动,与全球政企学研大咖交流合作。

3. 在世界互联网大会重要活动中对案例进行展览展示

4. 多语种媒体平台宣传曝光。

2

如何参与征集

01

面向对象

  • 本次案例征集面向政府部门、国际组织、社会团体、文博单位、科研机构、高等院校、企业等多种机构开放。

  • 鼓励跨领域联合申报

02

申报地址及截止时间

  • 申报机构请于北京时间2026年4月20日18:00前登录在线申报系统(文化遗产数字化项目)完成申报。

03

案例类型

    • 案例征集分文化遗产保护”“考古”“展示利用三个方向。

    • 依据文化遗产数字化工作特性,每一大类又下设若干小类,请结合案例实际情况选择适合的类别。详细分类标准见附件

    3

    评选如何进行

    将邀请全球文化遗产数字化领域的权威专家对申报材料进行多轮评审,最终确定入选案例。

    4

    申报要注意哪些事项

    1.申报案例符合时间要求

    申报案例开始实施或部署的时间应在2023年之后。

    2.申报信息准确、清晰

    申报方须保证申报内容真实、准确,避免虚构。案例实施过程中,如有其他参与机构,须如实完整填写。

    3.内容契合申报类别

    申报单位可选择一个领域或多个领域下的分类进行申报,每个领域选择一个具体案例。案例须与所选申报类型相契合。

    4.上传文件及时,大小适中

    • 正式评审前,案例申报方须按形式审核要求及时完善申报材料。

    • 建议上传文件大小适中的材料,以便评委下载查看。

    5.材料可公开

    确认所有申报材料中的数据、内容可公开。

    05

    征集咨询

    联系人

    陈先生 86-13187127549

    常女士86-18811567609

    张女士 86-15210397801

    邮  箱

    media@wicinternet.org

    digitalCH2025@163.com

    附件:《世界互联网大会文化遗产数字化案例集(2026)》征集分类

    点击文末“阅读原文”

    进入世界互联网大会官网

    来源 | 世界互联网大会公众号

    阅读原文

    跳转微信打开

    •  

    专业资讯|识别历史人物、地点及其他实体(HIPE)测评任务介绍

    2026-03-27 08:31 湖北

    识别历史人物、地点及其他实体(HIPE,Identifying Historical People, Places and other Entities),是一个专门针对历史报纸、档案等历史文献中命名实体识别(NER)和实体链接(EL)的国际评测任务系列。该任务通常作为评测论坛会议与实验室(CLEF,Conference and Labs of the Evaluation Forum)会议的一部分举行。其历届评测活动如下:

    一、HIPE-2020

    (1)任务背景

    命名实体(NE)处理自二十年前提出以来,已成为几乎所有文本挖掘应用的核心组件,并经历了重大发展。近年来其发展呈现两大趋势:深度学习架构的应用,以及对历史与文化遗产藏品文本的处理。前者带来全新可能,后者则因输入文本异构、历史化、含噪声等特点带来全新挑战。

    尽管命名实体处理工具已越来越多地应用于历史文本,但其效果远低于现代文本,且难以横向对比。在此背景下,impresso项目推出CLEF2020评测实验室识别历史人物、地点及其他实体(HIPE)任务,面向法、德、英三语历时性历史报纸文本,开展命名实体识别与链接任务。

    本共享任务目标有三:

    • 提升现有方法在非标准输入上的鲁棒性;

    • 实现历史文本命名实体处理效果的横向对比;

    • 长期推动历史文档的高效语义标引,支撑数字文化遗产藏品的学术研究。

    (2)任务概览

    HIPE共享任务包含两大核心命名实体处理任务:

    • 实体提及识别与分类(分两种难度)

    • 实体链接

    任务语料选自瑞士、卢森堡、美国的多家历史报纸,按时间跨度采样。注册团队可参与部分或全部任务。

    (3)组织方

    HIPE是CLEF2020评测实验室任务,由「impresso——往昔媒体监测」项目主办。impresso是跨学科研究项目,由计算语言学家、设计师与历史学家合作,面向大规模多语种数字化历史报纸开展语义标引。项目由瑞士国家科学基金会(SNSF)资助,项目编号:CR-SII5_173719。

    (4)任务内容

    任务1:命名实体识别与分类(NERC)

    1.概览

    ①子任务1:粗粒度NERC:按粗粒度类型识别并分类实体提及(见下图第1列)。

    ②子任务2:细粒度NERC:按细粒度类型识别并分类实体提及(见下图第2列),同时检测并分类1层嵌套实体与实体组成部分(头衔、职务等)。

    图:任务1要求系统输出的标注类型

    任务2:命名实体链接(EL)

    1.概览

    本任务将命名实体提及链接至知识库(KB)中的唯一指代;若知识库中无对应指代,则链接至标注为NIL。

    本次任务选用维基数据(Wikidata),使用2019年11月13日的固定快照数据(latest-all.nt.bz2)。

    图:需标注(任务1)与链接(任务2)的实体类型

    2.EL系统标注规范

    • 系统需对人物(PERS)、机构(ORG)、产品(PROD)、地点(LOC)类提及进行链接,输出对应维基数据ID(Q号);

    • 若知识库无对应实体,标注为NIL;禁止使用维基百科消歧义页;

    • 实体链接需同时覆盖字面义与转喻义(若存在)提及标注。转喻义的分类、识别与链接对人机均有难度,因转喻非HIPE核心任务,转喻链接为「可选优化项」,评估将采用灵活方案;转喻链接具体规则见附录A;

    • 实体组成部分与嵌套实体不参与链接。

    3.EL任务设置

    • 实体链接分两种模式:已知/未知实体提及边界。

    • 评估期分为两轮独立阶段:

    • 第一轮:无提及边界信息的实体链接(NEL)

    • 第二轮:已知提及边界(无实体类型信息)的实体链接

    (5)数据

    1.术语定义

    • 内容项(可简写为item):报纸版面以下的文本单元,本次任务仅指报纸文章,二者混用;

    • 时间桶:HIPE中以十年为单位,桶内所选文章均属于该十年的首年。

    2.语料

    评估语料为瑞士、卢森堡、美国多家历史报纸的历时性采样文章。

    • 语料选取:采用系统抽样与目的抽样结合。每家报纸按以下规则随机采样:

    • 覆盖报纸生命周期内预设十年段的首年;

    • 含标题、字符数超50、不限版面;

    • 人工筛选仅保留新闻内容,剔除副刊、表格、填字游戏、天气预报、时刻表、讣告及OCR噪声过大无法阅读的内容。

    • 语料特征:OCR质量为真实场景水平,随数字化时间与档案材质差异波动;不提供同一文本的多版本OCR,随文提供OCR质量评估值与行段图片链接。语料时间跨度为1798年—2018年,完整统计数据将于2020年2月随数据发布。

    • 语料标注:由母语者通过INCEpTION标注平台,按HIPE标注规范人工标注。标注前需在「迷你参考语料」(每语言10个内容项)上培训并校验标注一致性(IAA)。测试集部分样本、训练集与开发集随机样本将进行双标注与仲裁。

    3.数据格式

    数据采用IOB格式(Inside-Outside-Beginning,块内-块外-块首标注),格式类似CoNLL-U。

    (6)评估

    1.NERC评估

    采用宏平均/微平均精确率(P)、召回率(R)、F1值,分两种评估场景:

    • 严格模式:实体边界完全匹配;

    • 宽松模式:实体边界至少1个词元重叠。

      评估维度

    • 实体级(非词元级)微平均P/R/F1:按实体类型单独统计+全类型汇总;

    • 文档级宏平均P/R/F1:按单文档微平均结果取平均(区别于常规宏平均,按文档而非实体类型聚合,适配历史文本长度差异、缓解类别不平衡)。

    严格模式下边界错误会同时计为1个假阴性(漏检)+1个假阳性(误检),与CoNLL评估标准一致;宽松模式适用于边界不重要的场景。

    槽位错误率(SER)不再用于本次任务评估。

    2.NEL评估

    评估逻辑与NERC一致,将实体链接视为标签,连续相同链接视为单一实体;仅采用宽松模式(系统输出与标准答案有1个重叠链接标签即算正确)。

    转喻提及链接分两种评估场景:

    • 严格模式:仅计算转喻义链接;

    • 宽松模式:合并字面义+转喻义链接计算。

    该逻辑将在下一版评分工具中实现。

    二、HIPE-2022

    (1)任务背景

    HIPE-2022是自然语言处理与数字人文领域为研发高效的数字化历史文本信息检索与挖掘方法所开展的持续工作之一。经过文化遗产机构多年大规模数字化,人文学者对数字化历史文档的语义索引需求迫切,各类跨学科研究正推动仿真文档处理、文本转录中复杂信息的抽取、链接与表示。其中,命名实体(NE)的识别、分类与消歧是最核心的处理环节之一。

    然而,历史文本中的命名实体处理难度较大,效果远不及现代规范英文新闻文本。历史文档的实体处理主要面临领域异构性、输入噪声、语言动态变化、资源匮乏四大挑战。

    首届CLEF-HIPE-2020赛事针对约200年历史的英、法、德三种语言历史报纸,开展了命名实体识别与分类(NERC)、实体链接(EL)任务。该赛事结论表明:在训练数据充足的情况下,神经网络方法在历史文本NERC任务中可取得良好效果,但仍需在性能提升、OCR噪声处理、小样本场景适配、实体链接优化等方面进一步突破。HIPE-2022旨在推动这些方向的研究,并为参赛系统设置新挑战。

    (2)任务概览

    HIPE-2022聚焦18至20世纪多语言历史文档的命名实体处理,基于多套已标注实体数据集构建。相较于首届赛事,本届新增三大创新点:

    • 在历史报纸基础上,新增古典评论文档类型;

    • 拓展语言覆盖范围,历史报纸支持5种语言,古典评论支持3种语言;

    • 直面标注标签集与标注规范异构性问题。

    HIPE-2022要求参赛系统应对多语言、领域专属实体、多样标注规范等挑战,目标是探索命名实体处理方法在语言、时间、文档类型、标注类型间的迁移能力。

    (3)任务设置

    HIPE-2022沿用CLEF-HIPE-2020任务类型

    (4)实验数据

    1.基础数据集

    HIPE-2022数据整合6套基础命名实体标注数据集,源自欧洲多个文化遗产项目、主办方前期研究及HIPE-2020赛事,部分为首次公开。

    数据集涵盖历史报纸、古典评论两类文本,时间跨度约200年,多语言、多标签集、多标注规范。

    历史报纸数据集

    包含英、芬、法、德、瑞典五种语言,源自欧洲多国项目与国家图书馆:

    • HIPE-2020数据:首届赛事数据集,含瑞士、卢森堡、美国的法/德/英历史报纸(19–20世纪),约1万个链接实体,作为本届训练/验证集;测试集沿用首届测试集与未公开新数据,现有测试集不得用于训练。

    • NewsEye数据:法/德/芬/瑞典语历史报纸数据集,已公开部分含约3万个实体,作为训练/验证集;未公开部分(约20%)作为测试集。

    • SoNAR数据:德国柏林国家图书馆藏德语历史报纸数据集,已公开部分为验证集,预留部分为测试集,仅验证集可用于训练。

    • Le Temps数据:瑞士法语历史报纸历时数据集,未公开,约1万个实体提及,纳入训练/验证/测试集。

    • Living With Machines数据:英国图书馆藏18–19世纪英语报纸地名标注数据集,已公开部分含约3300个地名标注,作为训练/验证集;未公开部分为测试集。

      古典评论文档

    • AJMC数据集:源自Ajax多评论项目,为19世纪法/德/英古典评论,为本届新增数据。

    所有数据集文本来自不同OCR工具,质量参差不齐。

    2.实体标签集

    各基础数据集标签集与标注规范不同,HIPE-2022仅统一格式,保留原始标签集。各数据集实体类型见附录B,详情查看数据仓库中各数据集说明。

    数据集按标注类型适配对应任务(粗粒度NERC、细粒度NERC、EL)

    3.HIPE-2022数据发布

    HIPE-2022发布包为格式统一、结构规整的整合数据集,处理流程:

    • 转换为制表符分隔的HIPE格式(修正数据不一致、整合元数据);

    • 重新划分训练集与验证集。

    (5)HIPE格式与标注方案

    HIPE格式为制表符分隔文本格式,采用IOB标注规范(起始-内部-外部),类似CoNLL-U格式。

    1.文件结构

    文件包含三类行:

    • 空行:分隔文档;

    • 注释行:以 # 开头,补充信息;

    • 标注行:token与对应标注信息,以制表符分隔。

    单个文件包含一个数据集-语言-划分的所有文档,文档以空行分隔,前附元数据注释行。文档定义因数据集而异,详见各数据集说明。

    2.文档元数据

    基础数据集元数据粒度不同,HIPE-2022以元数据块保留信息,通过命名空间区分强制元数据与数据集专属元数据:

    3.文件内容

    每行共10列:

    • TOKEN:待标注词元

    • NE-COARSE-LIT:字面义粗粒度实体类型(IOB格式)

    • NE-COARSE-METO:转喻义粗粒度实体类型(IOB格式)

    • NE-FINE-LIT:字面义细粒度实体类型(IOB-子类型)

    • NE-FINE-METO:转喻义细粒度实体类型(IOB-子类型)

    • NE-FINE-COMP:实体组成类型

    • NE-NESTED:嵌套实体粗粒度类型(如有)

    • NEL-LIT:字面义维基数据Q号,无对应实体为NIL,无标注为_

    • NEL-METO:转喻义维基数据Q号,无对应实体为NIL

    • MISC:标记位,取值:

    • NoSpaceAfter:词元后无空格

    • EndOfLine:排版行结束

    • EndOfSentence:句子结束

    • Partial-START:STOP:非完整词元的实体起止偏移(Python切片规则)

    • 未指定值以_表示。

    (6)评估方案

    1.评估指标

    NERC采用宏平均/微平均精确率、召回率、F1值,分两种评估模式:

    • 严格模式:实体边界完全匹配

    • 宽松模式:实体至少1个词元重叠

    按实体级(非词元级)计算:

    • 微平均:全文档统一计算精确率、召回率、F1值,分类型与整体统计;

    • 宏平均:按文档级微平均得分取平均,适配历史文档长度差异,而非类别不平衡。

    严格模式下边界错误会同时计为假阴性与假阳性,与CoNLL标准一致;宽松模式放宽边界要求。

    实体链接(EL)评估逻辑同NERC,链接视为标签,无IOB编码,连续相同链接视为单一实体,仅采用宽松模式,与金标准至少1个重叠链接即为正确。

    本届评估沿用CLEF-HIPE-2020评估工具(仓库可能变更)。

    2.任务包、赛道与挑战赛

    为适配多维度任务设置(任务、语言、文档类型、标签集),本届以挑战赛+赛道组织评估,推动跨场景迁移能力研究。

    本届设3项挑战赛:

    第一项:多语言报纸挑战赛(MNC)

    目标:研发多语言历史报纸实体处理方法。

    要求:仅限报纸数据集;至少2种语言同任务;最多选2个任务包。

    第二项:多语言古典评论挑战赛(MCC)

    目标:适配数字人文专属领域实体处理。

    要求:仅限AJMC数据集;至少3种语言同任务;最多选2个任务包。

    第三项:全局适配挑战赛(GAC)

    目标:评估系统跨语言、跨文档、跨规范的适配能力。

    要求:同时包含报纸与AJMC数据;至少2种语言同任务;最多选2个任务包。

    三、HIPE-2026

    (1)任务背景

    在HIPE-2020和HIPE-2022的成功基础上,第三届HIPE大会聚焦于一个新的共享任务:从多语言历史文本中提取人物与地点之间的关系。参与者将开发帮助揭示隐性与显性问题的系统跨越时间的人与地之间的联系,促进研究历史知识图谱、空间人文学科与传记重建。人物-地点关系指文献中体现的个体与地点之间的语义关联,这类关系可揭示人物在特定时间所处位置、居住或工作地点,以及与其人生重要事件相关的地点,如出生地、常住地、到访地、旅行目的地。通过整合这些关系,可以有效还原人物的时空轨迹与人生历程。

    这类隐含或显式的时空关系无法仅通过实体在文档中的共现简单识别,需要结合时间推理、地理推断,并对含噪声的历史文本进行解读——这类文本通常线索稀疏或间接——才能以合理置信度检测并判定人物-地点关系。

    HIPE-2026的目标是推动此类关系的自动检测技术发展,实现人物时空移动轨迹还原,为数字人文研究提供支持。本任务同时适配生成式AI系统(大语言模型)与传统分类模型。

    (2)任务说明

    简言之,参赛团队需开发系统,判定历史文献中每一组人物-地点对所隐含的关系类型。每组对包含一个人物实体与一个地点实体,二者在文本中各有一处或多处提及。系统需判断:文本是否表明人物在文献时间范围内处于该地点(即时在场isAt关系)、人物在过去某一时间曾处于该地点(通用在场at关系),或无有效证据关联该人物与地点。

    如下图所示,isAt关系受时间约束,贴近文献发布时间;at关系仅以发布时间为右边界,可指向过去任意时间,不包含未来。下文将给出更详细、正式的任务定义。

    1.术语定义

    在定义子任务前,先明确术语:

    • 上下文(context):文献或段落全文及其元数据(如报刊名称、语言、发布日期)。

    • 人物(person):文献中由一组提及项聚合而成、指向特定人物的实体。

    • 地点(location/place):文献中由一组提及项聚合而成、指向特定地点的实体,二者可互换使用。

    • (人物,地点)对:同一文献中一个人物实体与一个地点实体组成的配对,为避免候选集过大,并非所有可能组合都会纳入。

    • at:关系类型,文本有证据表明人物曾在某一时间处于该地点。

    • isAt:更严格的时间限定关系类型,文本表明人物在文献报道的时间范围内处于该地点。

    •  系统(system):参赛团队开发的模型,输入上下文、人物-地点对与候选关系类型,输出关系标签。

    2.子任务

    本评测包含两个子任务,分别对应两类需分类的关系:

    子任务1:at关系分类

    给定上下文与人物-地点对,通用at关系判定文本是否隐含人物在过去任意时间曾处于该地点。系统需完成三分类:

    • TRUE:文本有明确证据支持

    • PROBABLE:可通过上下文隐含线索推断

    • FALSE:无证据或文本否定该关系

    子任务2:isAt关系分类

    给定上下文与人物-地点对,限时isAt关系判定文本是否隐含人物在文献时间窗口内处于该地点。系统需完成二分类:

    • TRUE:人物在文献发布前约一个月内处于该地点

    • FALSE:不符合上述时间条件

    isAt时间窗口:isAt为TRUE的条件是人物在文献发布日期前约一个月内身处该地,超出该窗口则为FALSE。

    at与isAt的关系:isAt是at的时间细化,判定at关系是否成立于发布前后。约束规则:若at为FALSE,则isAt不能为TRUE;若at为TRUE或PROBABLE,isAt进一步限定是否在文献时间窗口内。

    示例:

    • 报道美国总统当前访问柏林→at与isAt均为TRUE

    • 报道“去年总统访问柏林”→仅at为TRUE,isAt为FALSE

    为简化流程,评测时两个关系独立计分。

    (3)数据

    1.数据概览

    HIPE-2026数据包含两类:

    • 核心数据:法、德、英三语种历史报刊文献,覆盖19—20世纪约200年,划分为训练集、开发集、测试集(测试集A)。

    • 盲测集:法语文学文献(测试集B),用于评估模型跨领域泛化能力。

    报刊数据源自欧洲与美国图书馆馆藏,基于HIPE-2022已标注实体数据整理并重新标注;文学数据为全新curated数据,评测结束后公布制备细节。

    2.数据格式与内容

    数据采用专属JSON模式存储为JSON Lines(.jsonl)文件,这种格式将每篇文献的相关信息作为独立的一行,便于逐行读取和处理大规模数据集。文件按语言划分,每种语言对应一个独立的.jsonl文件。每篇文献包含四大核心部分:

    • 元数据(metadata)

    • document_id:文献唯一标识

    • 媒体信息:报刊名、时间跨度、来源类型、原始数据路径

    • 语言:de(德)/fr(法)/en(英)

    • 发布日期

    • 文本(text):文献全文,即关系推理的上下文。

    • 采样对(sampled_pairs):筛选后的人物-地点对,每条包含:

    • 人物/地点实体ID、维基数据QID(如有)

    • 人物/地点提及列表

    •  at/isAt标签(训练/开发集为金标准,测试集为null)

    • 可选的at/isAt标注说明

    3.数据划分与统计

    历史报刊数据分为训练、开发、测试集;文学数据仅发布盲测集。

    4.数据发布

    • 按数据集、版本、语言组织目录

    • 单语言、单划分对应一个UTF-8编码的.jsonl文件

    • 文件名规则:HIPE-2026-<版本>-impresso-<划分>-<语言>.jsonl

    • 所有提交文件遵循同一JSON模式

    (4)评测方法

    设置三类评测维度:

    • 准确率维度:鼓励高性能模型、前沿提示工程、智能体方法

    • 效率维度:鼓励轻量、可扩展方法(小参数量LLM、专用分类器)

    • 泛化维度:测试模型在盲测集(非新闻领域)的表现,仅评估at关系

    1.准确率评测维度

    ①指标

    采用宏召回率(平衡准确率),公式:

    • 计算每个标签的召回率:正确预测该标签样本数/该标签金标准样本数

    • 宏召回率=所有标签召回率的算术平均值

      该指标确保各类别权重均等,不受类别不平衡影响。

    ②空值处理

    at/isAt为null时,评测时转为FALSE。

    ③测试集A评测

    • at:三分类,宏召回率(|L|=3)

    • isAt:二分类,宏召回率(|L|=2)

    • 测试集A总分:GlobalScore_A=(at宏召回率+isAt宏召回率)/2

    2.准确率-效率评测维度

    试点评测,平衡准确率与资源消耗,需上报两项效率指标:

    • 参数总量(Params)

    • 模型磁盘大小(Size)

    ①计分与排名

    • 对准确率(Acc)、参数、大小三个维度分别排名(1=最优),效率维度数值越小排名越高。

    • 综合得分:R(s)=(r_Acc+r_Param+r_Size)/3按综合得分升序排名。

    • 示例:小参数量、小体积模型即使准确率略低,仍可能综合排名更高。

    3.泛化维度:盲测集B

    评估模型跨新闻领域到文学领域的泛化能力,仅评测at三分类,指标为宏召回率。

    4.可选大模型说明文本

    说明字段(*_explanation)不计分,仅用于模型可解释性分析,官方可能在综述论文中引用。

    5.技术计分流程

    官方GitHub提供“输出校验器”检查格式与模式合规与“计分工具”计算指标并生成评测报告。

    以上内容来自HIPE官方网站:

    https://hipe-eval.github.io

    经数字人文资讯小编翻译整理而成

    如需转载请后台私信联系

    编译丨洪冰凤

    校对丨罗斯鹏

    排版丨魏翔

    阅读原文

    跳转微信打开

    •  

    会议通知 | “大哉言数:AI时代人文研究的范式重构与价值回归”研讨会暨2026年中国数字人文年会(CDH2026)

    2026-03-20 14:38 湖北

    2026年7月31日-8月3日,内蒙古师范大学,“大哉言数:AI时代人文研究的范式重构与价值回归”研讨会暨2026年中国数字人文年会(CDH2026)

    ——CDH2026——

     “大哉言数:AI时代人文研究的范式重构与价值回归”研讨会暨2026年中国数字人文年会(CDH2026)

    会议通知(第一号)

    2026年7月31日-8月3日

    内蒙古师范大学

    2026期待与您相聚

    当前,人工智能与大数据技术正深刻重塑人文学科的知识生产方式与价值判断框架。“数”之一字,贯通古今:从古人“参天量地”的度量智慧,到今日数据驱动的数字人文,数字化浪潮不仅为人文学科开辟了全新的研究范式,更在“言数”之间激发了对文明演进、文化传承与社会治理的深层追问。

    在此背景下,中国索引学会数字人文专业委员会、内蒙古师范大学科学技术史研究院将以“大哉言数:AI时代人文研究的范式重构与价值回归”为主题共同主办2026年中国数字人文年会(CDH2026)。会议将邀请知名专家学者,围绕数字人文及相关领域的前沿问题,开展主旨发言、会议报告、专题讨论、案例分享、数字人文空间展演、海报展示等多种形式的学术交流活动。现诚挚邀请数字人文领域专家、学者与学生莅临会议,共探AI时代人文研究的范式重构与价值回归,为数字人文发展注入新动能。

    01

    会议议题

    包括但不限于:

    1. 典籍重光

    科技古籍与多民族文献的智慧化整理

    2. 时空重构

    GIS与时空大数据驱动的文明演进研究

    3. 协智重塑

    多智能体与具身智能的人文社会仿真

    4. 谱系重绘

    知识图谱与智能注释驱动的知识重组

    5. 记忆重述

    AIGC赋能下的文化遗产与艺术创新

    6. 文脉重析

    计量方法与主题模型的文本深度挖掘

    7. 伦理重思

    数字人文中的算法批判与负责任创新

    8. 素养重育

    数字人文课程体系与跨学科人才培养

    9. 数字人文学科建设

    02

    会议信息

    会议时间

    2026年7月31日至8月3日

    会议地点

    内蒙古师范大学

    (呼和浩特市赛罕区昭乌达路81号)

    会议注册

    本次会议将于2026年6月开放注册报名。

    注册费:1500元(6月30日之前早鸟价1000元),学生价800元,获会议录用宣讲论文/海报/项目作者一人可免注册费,如多于一人则需按增加人数缴纳注册费。参会代表交通食宿自理。

    03

    征文征集

    1、会议征文对象为数字人文相关专业的专家、学者与在读学生。

    2、论文要求为:作品原创,未发表;中文、英文皆可;问题明确、方法严谨、论证充分、引用规范、观点新颖。

    3、征文分为两轮,第一轮为论文摘要征集,第二轮为入选论文全文提交,具体要求如下:

    (1)论文摘要需包含中英文标题、摘要、关键词、作者姓名、作者单位、作者简介(姓名、单位、年级、邮箱、手机号码、研究方向等),摘要内容不少于500字。

    (2)论文全文格式可参考附件“CDH2026论文格式规范与要求”,正文字数为7000-15000字。

    4、组委会将邀请国内知名学者组成专家评审组,对提交的论文开展严格评审,从中选出高水平学术论文在会议上进行交流和专家点评。

    5、论文提交邮箱:

    20250051@imnu.edu.cn。邮件标题格式为CDH2026论文摘要/全文-姓名-单位

    6、摘要提交截止时间:

         2026年4月30日

         摘要录用通知时间:

         2026年5月30日

         论文全文提交截止时间:

         2026年6月30日

    04

    项目征集

    1、本次会议征集项目为中文或中国主题的数字人文研究项目,包括但不限于数据库、软件工具、数字平台、可视化作品、XR交互设计作品、大模型及智能体应用等。所征集的项目需提供可访问的路径和方式。专家委员会将根据项目征集情况分类评审后择优进行大会展示交流。

    2、所有征集项目需填写“2026年中国数字人文年会项目报名表”进行报名,并提供相关附件(包括但不限于网站、APP、小程序、视频及图片等)。

    3、请将报名表和相关附件压缩,以CDH2026项目-项目名称命名,发送至邮箱20250051@imnu.edu.cn

    项目征集截止时间:

    2026年5月20日

    05

    会议组织

    主办单位

    中国索引学会

    内蒙古师范大学

    承办单位

    中国索引学会数字人文专业委员会

    内蒙古师范大学科学技术史研究院

    内蒙古自治区科技文化遗产认知智能重点实验室

    内蒙古师范大学蒙古学学院

    协办单位(按笔画顺序排列)

    山西数字人文研究院

    上海大学数字人文研究与发展中心

    上海外国语大学中国国际舆情研究中心

    上海师范大学数字人文研究中心

    上海社会科学院信息研究所

    上海图书馆历史人文大数据中心

    中国人民大学数字人文研究院

    中国社会科学院文学研究所数字信息研究室、数字人文与计算批评实验室

    中山大学信息管理学院

    中山大学数字人文实验室

    北京大学数字人文研究中心

    电子科技大学数字文化与传媒研究中心

    华东师范大学数字文化发展协同创新中心

    齐鲁工业大学 (山东省科学院) 数字人文研究中心

    云南大学历史与档案学院 “数字人文” 工作室

    云南省图书馆数字资源与信息技术部

    武汉大学数字人文研究中心、武汉大学文化遗产智能计算实验室

    复旦大学大数据研究院人文社科数据研究所

    清华大学中国古典文献研究中心

    南京大学高研院数字人文创研中心

    南京师范大学数字与人文研究中心

    南京农业大学数字人文研究中心

    南京大学中华文明创新实验室  (持续更新中)

    媒体支持(按笔画顺序排列)

    《全国报刊索引》

    「全国报刊索引」公众号

    上海师范大学数字人文网

    上海社科院信息所社科智能实验室(AI4SS Lab)

    《中国数字人文》

    「中国索引学会」公众号

    「SHNU 数字人文」公众号

    「比特人文」公众号

    《数字人文》

    《数字人文研究》

    「数字人文」公众号

    「数字人文开放实验室」公众号

    「数字人文研究」公众号

    「数字人文资讯」公众号

    南京大学中华文明数智创新实验室

     (持续更新中)

       有意参与协办和媒体支持的单位,请扫描下方二维码登记相关信息,我们将在下一轮的会议通知中更新名单。

    06

    会议联络

    会议邮箱:20250051@imnu.edu.cn

    会务咨询:周老师 13191432051

    附件

    CDH2026论文格式规范与要求

    2026年中国数字人文年会项目报名表

    阅读原文

    跳转微信打开

    •