❌

阅读视图

数字人文:未来让现实重新问题化

李飞跃 2026-10-02 09:30 福建

以下文章来源于:中国社会科学网

中国社会科学网

繁荣中国学术 发展中国理论 传播中国思想

图片

数字人文是一种未来人文形态,它不是传统人文的对立面。我们固然要用新的技术手段来解决既有的人文研究问题,但更重要的是要提出和解决传统人文研究中不成为问题的问题。这些问题可能没有现成的经验可遵循,甚至需要我们打破传统观念,将数字人文研究看作一种可错的、不完备的和可更新的探索,以更好地面对未来。

图片

 “可错的”假设

图片

传统人文学术的基本循环模式是诠释循环,是文本与理解的相互深化的过程。随着解释越来越圆融,争议也就越来越被消解。我们要维护知识世界的开放性,就要允许别人用你的数据来证伪你的结论。模型越精密,越要反问什么证据会让它崩溃;研究框架越自洽,越要主动寻找反例。“可错的”,正是数字人文保持活力的前提。它意味着任何基于数据与算法得出的结论,都不应被视为终极真理,而只是暂时有效的假设。

数字人文通过将算法黑箱转化为可质疑、可反驳的透明结构,可能让旧范式的问题本身变得无关紧要。人文学科研究应该欢迎被证伪,因为那意味着触及了真正的知识边界。正如盲人摸象,只有悬置乃至否定原有认识,才能发现和接受新的知识,获得对大象的整体认知。当然,试错法淘汰的是可证伪的猜想,有关的价值与意义等不可形式化的部分不进入试错循环,也就不受其裁决。 

图片

 “不完备的”探索

图片

数字人文的核心工具是形式系统,当用算法分析算法本身,或试图用形式化方法研究形式化的局限时,就踏入了哥德尔式的自指领域。哥德尔认为,在任何足够强大且一致的形式系统中,必然存在一个既不能证明也不能证伪的命题。试图用单一算法解决未来的尝试,终将在某个节点遭遇不可计算性。应该承认,有些文本的意义是不可计算的,并不是因为算力不足,而是因为它们在形式系统的定义之外。意义、情感、审美体验、历史语境本质上不可形式化,同一文本在不同历史语境、读者群体中会产生截然不同的解读。审美判断无法被完全转译为可计算的特征向量,形式化必然留下剩余,将会遭遇不可判定的情况。

相对于历史上的文本总体而言,任何数据库都是残缺的样本。一部文本被标引本身就隐含了研究者的预设与局限。承认“不完备”,就是承认人文理解永远在途中。它拒绝将知识封闭于一个自足的系统之内,而是邀请我们在形式化的边界处驻足,在可计算与不可计算之间保持张力,从而让数字人文真正成为一种面向未来的、开放的探索实践。要承认有些问题在当下的不可判定,而继续探索才不失为一种负责任的学术姿态。单一系统内的不可判定性,或许在另一系统的视角下又变得清晰。正如我们没法看到自己的眼睛,但可以从镜子里看到。我们要承认现有研究的不完美和不完善,敢于质疑和批判,同时也要勇于承认无知和接受批评。数字人文的目标不在于计算一切,而在于精确地知道什么不可计算,并在此边界上与诠释学、叙事学等传统人文学科握手。 

图片

 “可更新的”循环

图片

贝叶斯定理的数学公式是:后验概率=先验概率×新信息调整系数。其基本逻辑是:先有一个假设,让证据说话,然后持续修正。开始的假设可以是错的,出发点存在误差是不可避免的,重要的是更新的速度和幅度,每一次新证据到来都要重新分配权重。人文数据通常面临小样本、高维度困境,有的数据集可能仅有几十篇样本,每个文本却有数千个特征维度。因此,贝叶斯定理让我们在数据稀缺时仍能进行稳健推断,通过不断寻找新的证据,实现从“几乎不可能”到“几乎确定”的推进。

人文学者的“先验”往往来自难以量化的信念经验、文献传统和历史语境,数字人文就是要将这些默会知识显式化。不是所有数据都等价,要区分证实偏好的证据与真正挑战假设的证据,同时让结论具有概率性、具有置信度并可更新。一旦证据足够强大,彻底改变信念并不是背叛,而是理性。可更新性让学术成果不再是一次性交付的成品,而是一个持续维护的对象。学术的基本单位从定本变成了“版本流”,从这个意义上说,学术史也是一部“修订史”。

图片

 “可迭代的”认知系统

图片

波普尔、哥德尔与贝叶斯,三位学者从不同维度揭示了数字时代科研的理性边界与未来可能。从中我们可以提炼出一套认知操作系统:首先,提出一个大胆的可证伪假设;其次,识别假设中不可形式化的核心;最后,对可形式化部分进行概率化建模。在此之后,用新数据证伪或修正模型,再次启动循环。每一次循环,都是在更高的层级上重建可错性、不完备性与可更新性。这不是数字人文对传统人文的取代,而是两种理性传统的对话。

在数字时代,信息差、认知差比智商和情商更能拉开人与人之间的差距。我们要勇于提出可证伪的假设,以谦逊的姿态划定当下的边界,以研究的韧性在证据流中校准航向。不断修正自己的理论,不断进行重新诠释,重新定义先验的设定。

数字人文不只是让人文学科的问题“可解”,更是让不可解的部分变得可见、可分析与可共存。因为“可错”,所以需要检验;因为“不完备”,所以永远有检验不尽之处;因为“可更新”,所以检验的结果能够沉淀为新的知识。但是,可错不等于相对主义,恰恰要求严格的检验标准;不完备也不等于任意,而是在严格形式化之后显露边界;可更新不等于善变,每次更新都留下了可审计的痕迹。数字人文通过引入发现错误、承认局限、修正自身的机制,把自身的认识论限度写进了方法论。不同于“向来如此”“到此为止”的不可逾越,数字人文是在计算与诠释、概率与叙事、可判定与不可判定之间的未命名疆域中写下的每一行代码和注释。

维特根斯坦的名气超过了罗素,有人问维特根斯坦,“罗素为什么落伍了?”他回答说,“因为他没有问题了”。未来不是将要发生,而是一种将现实重新问题化的方式,是让当下行动获得意义的一种视域。有未来,现在才有意义。在面向不确定性的未来探索中,你的数据集将过时,你的模型将被超越,你的先验将被修正——但你在形式与意义之间建立的连接,将帮助更多的人穿越认知裂缝和超越自我。


作者系清华大学人文学院教授

来源:中国社会科学报

责任编辑:唐萌

新媒体编辑:宗敏

转载自“中国社会科学网”公众号

阅读原文

跳转微信打开

  •  

当文学研究遇上计算批评——数字人文与计算批评实验室的“破圈”之路

任冠虹 2026-10-02 09:30 福建

以下文章来源于:中国社会科学网

中国社会科学网

繁荣中国学术 发展中国理论 传播中国思想

图片

从钱锺书先生以稿费资助的笨重微机,到2025年国内首个主攻“文学计算批评”的数字人文实验室正式挂牌——40余年,几代学人,一条数字技术与人文学科从试探、磨合到深度融合的道路,愈发明晰。

在这里,“远读”不再是莫莱蒂笔下单纯的语料统计,“计算”也不再是理工科的专利。当37万条新诗音组特征被用于机器学习模型训练,百年新诗史上聚讼纷纭的“散文化与格律化”命题获得了可验证的数据图景;当曹禺《日出》七个版本的异文借助算法自动完成比对,以往需数月手工对勘的文献工作被压缩到数秒;当“长安”意象的千年流变在检索框里一键呈现,百万首诗与一个时代的隐秘关联陡然显现——传统文学研究的边界正在被重新划定。一种属于数字时代的人文研究新范式呼之欲出。

图片

从工具焦虑到方法自觉:

计算批评的诞生逻辑

对普通大众而言,数字人文早已不是陌生概念。古籍数据库、AI续写诗词、文学地图可视化等应用早已渗入文化生活,但计算批评依然带着学术前沿的神秘感。

图片

数字人文与计算批评实验室负责人、中国社会科学院文学研究所副研究员赵薇的解释通俗却精准:“计算批评是数字人文在传统人文学科中‘落地’的主要形态。它以人的精神和观念领域为核心对象,承认人在运用技术过程中的主观性和主体性,不单纯追求实证效果,而是强调实证过程与人文阐释的结合——通过数字人文的实验设计,表达出建立在主体经验之上的批评性观点。”换言之,它不是用机器替代人,而是让人站得更高、看得更远。

这种定位背后,是对学科积弊的清醒回应。过去30年,全球数字人文发展始终面临一个悖论:新技术派沉迷于开发工具、优化算法,却离文学问题越来越远;而传统文学学者往往将量化研究视为“没有温度的统计”,觉得“数出《红楼梦》里出现了多少次‘笑’字,也说明不了曹雪芹的叙事高明在哪里”。

数字人文与计算批评实验室团队的选择是“两条腿走路”:一方面做基础设施建设——建造数据集、平台、工具、模型算法,解决“材料从哪里来、怎么处理”的问题;另一方面做“有反思的计算”——既用算法发现人靠细读难以察觉的规律,也用人文经验反过来检验模型的效用,“绝不把‘技术正确’等同于‘学术正确’”。赵薇举了一个代表性案例:2026年5月,团队发表《现代汉诗的节奏观念如何可能——对两种“新文体”关系的计算批评研究》,该研究成果建立在对37万个标注音组的特征抽取之上,利用机器学习对新诗和散文诗两种体式进行节奏观念建模,但最终目的不是为了区分“哪首是新诗、哪首是散文诗”。

赵薇说,真正的工作是在建模分类之后。团队聚焦模型误判文本和极值文本,跟随算法的指引返回具体历史语境中细读,回应新诗格律、新诗散文化、新民歌的民间形式基因、九十年代诗歌的口语与先锋性等一揽子诗学问题。“这些需要经由宏观、中观、微观层面的反复‘可变焦阅读’,调动文学研究者多年积累才能有所发现——这正是计算批评要解决的‘深水区’难题。”赵薇解释,“如果止步于远读或技术应用,那和图书情报信管领域的探索没有本质区别。”

通过构造“观念模型”来与传统诗学问题对话,而非像传统研究那样单纯聚焦于“新诗韵律”本身,正是计算批评的独特之处。随后,团队将研究的“副产品”——经过节奏精标的几千首新诗语料——发布到平台上,使之成为新诗研究的数字基础设施的一部分。

这种“以建设养研究,以研究带动建设”的文科实验室路径并非凭空而来。赵薇早在2014年就尝试将数字人文方法运用于比较文学的博士论文中。在美国芝加哥大学文本光学实验室做现当代文学研究期间,她注意到欧美文学实验室的独特活力:“一两位牵头学者,十几位来自不同学科却旨趣相投的年轻人,大胆引入量化方法,在密集的研讨中碰撞出有意思的想法,再花数年时间一点点实现。”但她也意识到,这些实验室多以西方语言和语料为主体,针对中国文学的研究几乎空白。“我参与过的ARTFL项目中的数字语文学平台‘PhiloLogic’收录了中国文学期刊和史集语料,但这类资源在国内鲜为人知,更别说自主开发了。”

2023年底,中国社会科学院启动哲学社会科学实验室孵化计划,赵薇牵头申报的“数字人文与计算批评实验室”终于落地——这颗酝酿了十年的种子找到了土壤。

一脉学统:

从钱锺书的“计算机室”到跨界融合实验室

很少有人知道,这家国内领先的文学数字人文实验室,根系扎在20世纪80年代的古籍整理工作中。

彼时,钱锺书先生在中国社会科学院文学研究所倡导创建计算机室,助手栾贵明带领团队在“仓颉码”基础上自建大型字库,录入古文献,尝试把计算机技术引入中国古典文献的搜集、整理和疏证中,先后完成“《论语》逐字索引”“诸子集成数据库”等古籍数字化系统,其中,“《全唐诗》速检系统”获得国家科技进步奖三等奖。

2004年,中国社会科学院文学研究所成立数字信息研究室(现更名为“数字人文研究室”),郑永晓、刘京臣等学者接续深耕,建成“元代文献数据库”“百年《红楼梦》数据库”等一批有影响力的数字文献学项目。2024年,该研究室被中国人民大学数字人文研究院认定为中国大陆第一个数字人文研究机构。

如今实验室依托的数字人文研究室,40余年来承袭一脉学统,未曾中辍。核心团队成员具有学科交叉背景:既有理科出身,投身现代文学、文学理论和比较文学研究的成熟学者,也有擅长自然语言处理且研究古代文学的青年技术骨干,还有本科和研究生阶段专修计算机与人工智能,却醉心于明清近代诗歌与诗学的跨学科人才;外围合作网络则延伸到清华大学、上海图书馆、中国社会科学院大学、美国芝加哥大学等机构。这种结构刚好适配数字人文的研究特性:以具体研究项目为牵引、以问题为中心完成跨学科协同攻关。

正在研发的“版本谱系智能体”就是典型例子。赵薇在与文学研究所现代文学研究室副研究员段美乔的交流中,确立了文本相似度计算和谱系树可视化的基本框架,由段美乔提供曹禺话剧《日出》的七个版本,实验室成员王子尧完成OCR识别,王鹭、许佳璐、陈纬宇等做文本校对,实验室技术负责人、中国社会科学院文学研究所助理研究员程宁调用生成式模型的学习推理能力,很快完成了开发。

“目前版本谱系智能体已经迭代到2.0版本,不仅印证了段美乔的一套版本谱系理论,更可以用异文的自动发现代替以往繁难艰巨的两两对勘工作,还能将版本之间的承续演化关系推断出来,并给出依据和置信区间,通过两层判断,为版本学家提供可检验的证据链。这个过程中既有对智能体的运用,也有人工规则的加入。”赵薇说。目前团队已将《随园诗话》《雷雨》等文本的多个版本纳入测试,并与同济大学中文系教授祝宇红及多位文献学家合作推进验证,未来这套流程或可推广至整个现代文学文献学领域,探求基础设施建设与计算批评研究的结合之道,特别是“作为计算批评的校勘批评”的可能。

拒绝“黑箱”:

技术要为人文主体性服务

国内数字人文项目曾长期陷入两个误区:要么止步于“建数据库”,把几百万册文献扫进电脑,仅供研究者查询之用;要么盲目追逐新技术,用复杂的深度学习模型跑出一堆没人能解释的结果,经不起推敲。赵薇认为,人文实验室的核心竞争力恰恰是“能够在建造中思辨”。

“计算批评是在实践中形成的方法论,其重点在于让量化建模构成推理、论证的重要环节,同时强调人文学者要有办法让自身的反思意识进入模型检验环节——不再是你建了一个什么样的模型,别人就要相信什么。”

这种理念最直观地体现在对读上。所谓对读,是指人文学者充分利用算法带来的洞察力,带着自己的真实感受,回到文本和问题发生的历史脉络里,与模型计算出来的结果反复碰撞。在这个过程中,或有新的发现,或激活曾经的话题——这恰是人的主体性的体现。实验室团队选择用审美感兴的细读经验去对读算法。

在一项对20世纪美国生态批评话语与小说写作关系的研究中,赵薇和当时还是清华大学人文学院本科生的康吉赢找出“最高泛生态性”段落做历史文化细读,继而不断放松相关性尺度,通过取差值的办法对“泛生态性”的表征本身做反观和检验,即对建模的再建模。“这种反思性的步骤对于人文研究极其重要,它打通了远读的宏观尺度和细读的具身经验,最终体现为‘数据→模型→细读→理论→数据’的阐释循环,在不断迭代中趋近于理想结果。”赵薇表示,这一阐释循环的提出建立在计算社会科学的方法论上,又加入了细读的关键环节,试图调和大数据带来的“数据驱动”与传统“假设—检验”之间的矛盾。

人工智能时代,高维向量计算往往带来前所未有的复杂度,使这类模型无法再充当“阐释工具”。为了避免此类“黑箱”效应,团队优先选用可解释性强的模型,而非一味追求复杂深度学习。“譬如在节奏观念研究中,更高级的模型或许能带来更好的分类效果,但每一个节奏特征究竟是什么,将不再是人能够理解的,人文学者也无法返回文本中对特征做细读,更谈不上反思。”赵薇提出,现有各种逆向工程技术,或通过变化输入、观察输出来推测生成式模型的内部机制,但从根本上看,这种可解释性和人文学者需要的可解释性完全不是一回事。“意义的获得是一个漫长的历史层累过程,不是一朝一夕的‘编码—解码’操作就可以完成的,这恰恰是文化的价值所在,是人文的存身之本。”

在文学阐释和批评这类“高级任务”上,建模的目的是促成对问题的理解。因此,团队在不需要了解中间过程的工具性任务上大胆使用人工智能,构建基于RAG架构的知识库,以应对大模型的“幻觉”问题,同时保证所有输出可溯源、可引证;在复杂任务上,让大模型成为提升推理能力的引擎,但必须给出依据和可信区间来辅助判断。

为避免数字人文沦为新自由主义的工具,推动领域生态健康发展,团队将“反黑箱”写入了实验室的生产规则:官网开设“项目公开”板块,展示数字人文项目协同攻关全过程,以工作日志的形式让外界了解每个人的分工和职责;平台所有模块标注合作开发者姓名;成果署名必须体现真实贡献。“现在很多纯文科老师不懂技术,学生承担了大部分数据和计算工作,最后署名却只能挂在老师名下。”赵薇说:“这本质上是学术劳动的隐形剥削。我们想打造一种全程透明、公开、可追溯的数字人文生产模式,让年轻人愿意投身这一领域,而不用担心自己的劳动被埋没。”

从“一平台”到“新基建”:

让文学研究长出数字翅膀

对普通研究者来说,实验室最具体的贡献是提供了一套日臻完善的数字基础设施。程宁介绍,目前团队已建立“平台+网站+多语料库+多工具”的整体架构。其中,数字人文与计算批评研究平台“文渊知能”是核心载体,主要承担数据汇聚、知识组织、智能应用和文献处理等功能;实验室网站则发挥成果展示、项目公开和学术交流作用。

“文渊知能”平台的功能围绕文学研究需求设计,层层递进。

第一层,语料库检索。平台的语料库检索模块充分吸收语料库语言学的基本方法,建设诗歌、近现代小说、文学期刊、古文、戏曲等文学语料库分析系统,供大规模、长时段文史研究之用。现阶段围绕古典诗歌和现代汉诗等重点资源,提供多维度检索、搭配分析、频率统计、时序分析与文本比较等远读功能。研究者可按作者、时代、体裁、关键词等条件进行自然语言的语义查询,观察特定词语意象或文体特征、文学观念在不同时期和群体中的分布变化。输入“长安”这一古诗中常见的地点意象,不仅能看到它出现的频次,还能按作者分布、时序做交叉统计,为“明代文人宗唐”等传统议题提供不同粒度、角度的新观察,或找出与“长安一片月”意境相近的历代诗句。

“很多人以为语料库就是把书扫进电脑,其实最难的是前面的数据清洗和标注。”王子尧说。以现代汉诗为例,从文献搜集、扫描识别,到文本校勘、数据清洗、格式统一,再到元数据精标,每一步都耗时费力。中国文学文献跨越数千年,不同时代的文本形态、出版状况与书写规范差异极大,几乎无法用统一标准处理,这决定了高质量专题语料库只能靠多年持续积累。“我们之所以坚持建设各体文学和文学期刊的大型语料库,是因为它们正在成为未来文学、文化研究不可或缺的基础设施。”

第二层,文本分析工具链。这一部分集成了古文断句标点、分词与词性标注、命名实体、关系抽取、文本比对等基本工具,并调用大模型实现自定义的实体发现、关系发现和小说对话角色标注、语义分析、文本比对,将线性历史叙述转化为知识图谱,实现了从“可检索”到“可分析”再到“可结构化”的升级。研究者还可以上传自有文献资料建库,选择汇聚共享或私用模式,调用各种工具,也可以自定义“意象”“叙事角色”“交游关系”等分析对象,由平台辅助完成识别、归类和关系型数据建构,缓解了人工标注成本高、标准难统一的问题。

第三层,知识库和智能体模块。依托专题语料库,可以对底层文献进行综合调用、总结归纳和进一步的知识组织和智能提升。其中,中国新诗编年史知识库充分利用刘福春的巨制《中国新诗编年史》中丰富的人、地、时、社群、活动、著作、引用等实体信息。“这同样是实验室与现代文学研究室合作的产物。只要提问巧妙,就有可能揭示出著者自己也未必意识到的潜在写作脉络,相当于把静态的工具书变成活的专家分身。”王子尧介绍。目前还在实现编年史与具体文本、文献的深度关联,希望有助于解决中国新诗史料分散、线索难以梳理的问题。

“总的来看,平台建设的目标是将文学研究中的数据资源、分析工具和智能服务勾连起来,并保持与外界息息相通的状态。”程宁总结道。

破局与前行:

数字人文的“马拉松”刚刚开始

尽管成果不断,实验室依然面临现实困境,最突出的难题是评价体系的滞后。

赵薇直言,数字人文在人工智能时代有望达到成果产出的高峰。然而,当数据与技术真正重塑证据链和底层方法论时,平台、软件著作、数字工具、模型以及跨学科论文等成果却仍然难以纳入评价体系。“一项合作研究往往历时五六年,从文献收集、OCR、语料清洗,到数据标注、实验设计、计算建模、模型检验、细读、再建模、再检验、数据分析、批评阐释,是从0到1的艰难摸索。最后按传统体式写成文学论文,却因署名规则限制或找不到合适的编辑、评审专家而被拒之门外,只能拆成碎片投向理工类刊物或海外期刊。”赵薇说。

更深层的问题是学科认知的隔阂。传统文学界对量化的接受度依然有限,部分学者觉得“用数据研究文学是不务正业”;技术圈又常常低估人文研究的复杂性,觉得“给点数据就能出结果”。“我们现在做的新诗节奏、唐诗语汇、生态批评、小说人物观流变等研究,都是前几年就开始布局的,不可能一蹴而就。”赵薇说:“数字人文本质上是一场马拉松式的科研攻坚战,而非短平快的百米冲刺。一个能切实推动人文问题的项目,往往历时数载,要求一支有准备、有实力、耐得住寂寞的队伍长期投入,更需要探索人文学科在体制机制方面的创新。”

2023年以来,实验室团队连续在ADHO国际数字人文大会、中国数字人文年会、东亚古籍数字人文会议以及海内外重要刊物上发表论文,关于新诗节奏建模、生态书写、古典诗歌互文性等方向的研究成果得到海外学者认可。“海外和中国港台地区的专家最看重的仍然是那些历时漫长、在文本表示和问题开掘深度上下了功夫的研究设计。”赵薇提到。

近两年,实验室在全力推进建设的同时,也在积极探索适应人工智能时代的哲学社会科学科研组织形态。值得欣慰的是,团队的坚持开始得到回应。2026年初,在中国社会科学院文学研究所党委推动下,实验室促成了国内文学顶刊署名规则的革新,为避免一人独占团队合作成果现象,首次将“新兴交叉学科成果”纳入独作署名规则的例外范畴,且允许标注多位作者的具体分工。“所里为我们开疆拓土给予了很大理解与支持。这种立足学术发展实际、锐意求新的改革,也是正确政绩观的体现。”赵薇感叹,这个过程异常艰难,这只是第一步,“接下来期待文学期刊界在审稿机制、文章写法、篇幅体量等方面探索出可行的兼容性原则,比如实行‘领域专家+数字学者’双审制”。

站在2026年的时间节点回望,实验室的“破圈”从来不是要取代传统文学研究,而是给它多准备一条观察和体认世界的路径。

当钱锺书先生当年构想的“计算机整理古籍”变成今天可检索、可计算、可阐释的智能平台,当80年代“仓颉码”的草创尝试进化为大模型的协同工作能力——这条路的终点不只是更高效的研究方法,更是一种适应数字时代的人文精神。技术永远在迭代,但对文学的热爱,对意义和机制的追问、反思与批判,始终是这一切的起点。

未来,实验室将继续与有关部门保持积极沟通,期待可以摸索出一套全周期、立体化、人性化的支撑保障机制,在人才、资金、有组织科研、成果发表与评价等各环节理顺关系、打通堵点,让更多科研成果在与传统学问的对话中产生真实、长远的影响力。“我们不求快,只求每一步都踩实,等到下一个时代的人回头看,会说我们这代人没有辜负这个节点——这就够了。”赵薇说。


中国社会科学报记者 任冠虹

来源:中国社会科学报

责任编辑:高莹

新媒体编辑:张雨楠

转载自“中国社会科学网”公众号

阅读原文

跳转微信打开

  •  

专题资讯 | AI4Culture平台:文物数字化AI工具集介绍

2026-09-27 08:30 福建

一、平台简介

AI4Culture 是由欧盟“数字欧洲计划”(Digital Europe Programme, DIGITAL)资助,2023年4月至2025年3月实施的科研项目,项目联合 12 家来自欧洲多国的机构,搭建了面向文化遗产领域人工智能应用的线上能力建设平台(ai4culture.eu)。

AI4Culture平台汇集了各类人工智能相关资源,其中包含可供人工智能模型训练、测试使用的开放标注数据集,同时配备一批可部署、可复用的工具与能力建设资料。

项目对平台组件进行了定制化开发,方便文化遗产机构在以下业务场景中复用:

  • 扫描文档的多语种文本识别

  • 多语种字幕生成与核验

  • 基于图像提取信息实现内容增值与语义关联

  • 面向文化遗产元数据的机器翻译

平台组件可与欧洲文化遗产公共数据空间实现互操作,既推动文化内容的数据共享与复用,也进一步强化该数据空间同各文化遗产机构之间的对接。

二、项目目标

  • 搭建线上能力建设平台,面向文化遗产领域提供人工智能工具、数据集与培训素材。

  • 推动文化遗产机构应用人工智能技术,优化元数据质量、藏品管理水平,提升馆藏资源的公开可见度。

  • 提供开放许可数据集以及可部署人工智能组件,支持面向文化遗产业务需求开展工具微调与二次复用。

  • 接入欧洲文化遗产公共数据空间,促进跨机构的互操作、数据共享与资源复用。

三、平台工具选介

1

AI4C PECAT

PECAT 是面向数据整理人员与文化遗产领域从业者、用于构建平行语料库的工具。该工具将 EuropeanaTranslate 的先进机器翻译技术与人工专业能力相结合,输出高质量、语义细腻的译文。其工作模式融合机器翻译与人工编辑:先由机器翻译引擎处理待译内容,再交由人工复核校对。机器翻译生成结果后,会展示在 PECAT 网页端工具中,注册用户可查看、审阅并优化译文。工具界面简洁易用,可高效完成译后编辑工作,保障最终译文在语气、行文风格与翻译准确度上均达到高标准。

2

SAGE

SAGE 是一款网页端工具,用于生成、丰富、发布与检索 RDF(资源描述框架)数据。该工具可完成文化遗产文本元数据的语义丰富化,完整覆盖从数据导入、语义注解自动生成,到人工校验、再到以 Europeana 兼容格式完成数据发布的全流程。SAGE 提供一套适配行业需求的注解模板,可对文本元数据开展解析,并依托维基数据、盖蒂艺术与建筑叙词表等关联开放数据集与叙词表,为元数据添加受控术语标注。

工具生成的自动化注解,可通过专属校验界面交由人工审核。SAGE 支持 Europeana 数据模型(EDM)等文化遗产元数据常用格式,能够与文化遗产数据空间内的其他组件实现元数据直接导入、注解导出交互,例如 Europeana.eu 平台以及多家 Europeana 聚合机构所使用的 MINT 元数据聚合平台。

3

Transcribathon

Transcribathon 一词由 “transcription marathon” 合成,是支撑公众科学项目 Europeana Transcribe 的众包协作平台。该平台通过文本转录、转录译文、内容标注与地理标签标注,对欧洲数字文化遗产进行内容增益。平台原始资料来源分为两类:一类来自公众贡献的私人藏品(众包征集),另一类经由 Europeana 汇聚档案馆、图书馆与博物馆馆藏资源。

平台旨在服务基础研究、技术开发,提升资源可检索性,并完成数据预处理以支持后续复用。平台可用于学术研究、新闻采编、谱系研究以及中小学与高校教育场景。平台集成多款来自 Transkribus 的手写文本识别(HTR)模型,同时接入开源光学字符识别引擎 PERO-OCR(通过 OCCAM 工具调用)。

4

MINT

MINT 全称为Metadata INTeroperability services(元数据互操作服务),是一款开源网页端数据聚合平台,供文化遗产内容提供机构管理元数据记录,并将元数据发布至欧洲数字文化平台(Europeana)。该平台是 Europeana 数据接入基础设施的组成部分,作为文化遗产数据空间的一部分持续维护。

MINT 通过对接 PECAT、SAGE、CrowdHeritage 以及目标检测、色彩检测等多款 AI4Culture 工具,提供多项人工智能增值服务。依托这套工具联动能力,MINT 用户可将 AI4Culture 各类标注、校验工具生成的内容增益成果(含机器自动译文、图像分析结果、文本元数据解析结论以及人工标注内容)嵌入自身常规业务流程,以此优化元数据质量,最终向 Europeana 输出品质更高的发布数据。

5

DANE

DANE 全称为Distributed Annotation ‘n’ Enrichment(分布式标注‑内容增强框架),用于为内容自动标注业务完成计算任务分配与文件存储工作。DANE 的设计场景主要针对计算算力资源与原始媒体馆藏分属不同设备这一现实问题。受限于算力条件或制度政策,将全部原始媒体资源批量迁移至计算设备,有时并不可行,也不符合实际需求;此外,部分原始馆藏处于持续扩充状态,仅支持按需处理。上述各类场景下,完整计算流程包含多个环节,任一环节都可能形成性能瓶颈,造成整体流程时延。

DANE 将整体业务拆解为若干独立任务,支持对各项任务分别调度,以此实现对现有资源的更优利用。以大型档案库的高负载视频分析任务为例,一次性将全部视频档案迁移至计算服务器并不现实。DANE 可分别设计服务器间数据传输、内容分析、事后数据清理等专项任务,对任务进行调度编排,使之能够并行执行。

开源仓库:https://github.com/CLARIAH/DANE#readme

6

Arkindex

Arkindex 具备工作流管理能力,可处理各类复杂度极高的文档处理任务。依托可自定义的工作流设计,你能够按需调整每一步流程,无论是文档版面分析、文档分类、光学字符识别 / 手写文本识别、命名实体识别、照片标注,还是元数据生成都可实现。该平台支持实时监控,你可以追踪每项任务的进度,并查看预计完成时间。它的处理节点具备高度灵活性,支持在多种环境部署,包括本地服务器、云端,或是采用 SLURM 调度的高性能集群。此外,Arkindex 能够无缝接入自研组件与开源组件,还可借助 Docker 进一步定制,适配种类繁多的基础设施与业务工作流。

项目 GitLab 地址:https://gitlab.teklia.com/arkindex

7

AI4C FBK‑subtitler

FBK‑subtitler 是一款面向音视频(AV)文档的自动字幕生成工具,支持八种语言。该工具由意大利布鲁诺・凯斯勒基金会(Fondazione Bruno Kessler,FBK)的机器翻译研究团队在 AI4Culture 项目框架下研发。

工具采用级联架构,全部组件均可免费使用,其中大部分为现成开源组件,其余为内部自研组件。整套组件包含:音频切分模块(SHAS)、语音识别系统(Whisper)、幻觉内容过滤模块(自研)、机器翻译系统(赫尔辛基大学 Opus‑MT)以及文本分句模块(自研)。

开源仓库:https://github.com/hlt-mt/FBK-subtitler

8

noScribe

noScribe 是一款整合多项开源技术并提供图形化操作界面的工具,用于生成文本转录稿与字幕。该工具采用 OpenAI 开发的 Whisper AI、Guillaume Klein 开发的 faster‑whisper 完成语音识别;说话人区分功能则依托 Hervé Bredin 开发的 Pyannote 库与 FFmpeg 实现。

工具支持视频或音频作为源文件,在开始转录前会自动生成一份源文件副本。noScribe 可支持约 60 种语言,识别质量受多重条件影响,用户可加载自定义模型,获得针对特定语言的优化效果。该工具能够识别多名说话人,并以 S00、S01、S02 等编号对说话人进行标记,转录结果附带精确时间戳。对于笑声、“嗯” 这类语气填充词,用户可选择是否转录输出,停顿会标记为 “(..)”。软件内置文本编辑器,使用者可在此审阅、修改文本,同步播放音频,定位转录稿中高亮对应的片段。全部转录处理均在本地设备完成,安装完毕后无需互联网连接。

9

MaLaNova

为破译已消亡语言或历史语言撰写的古代密码,需要一套专用处理流水线,帮助历史密码学研究者生成适配破译需求的自定义 n 元语法语言模型。现有的密码分析工具通常仅内置现代语言的语言模型,研究者无法使用预设列表之外的候选语言开展破译工作。MaLaNova 针对这一局限,提供一套完整的 Python 框架,覆盖历史语料预处理,直至生成可接入破译软件的 n 元语法模型。生成后的模型可直接导入开源密码分析工具 AZdecrypt;AZdecrypt 虽支持接入自定义 n 元语法模型,本身却并未内置对各类历史语言的支持。

该工作流对于研究数世纪外交密码的历史密码学场景尤为重要,基于当代语言特征构建的语言模型无法完成此类密码的有效破译。该流水线填补了历史密码分析的语言学需求与现代破译工具技术能力之间的关键缺口,让研究者能够运用计算手段处理原本无法开展自动化分析的密码。

10

HILDEGARD

HILDEGARD 是一款应用程序,用于引导文化遗产数据管理领域具备一定专业基础的用户构建轻量知识图谱,以此支撑自动故事生成(Automatic Story Generation,ASG)功能。为实现该目标,工具预先筛选出 CIDOC‑CRM 本体的部分类与属性,适配目标业务领域。程序的输入为从知识库选取的一个或多个遗产种子对象。在案例研究中,这些遗产种子对象通过 SPARQL 查询,取自意大利文化遗产关联开放数据库。

系统会对全部实体对在线执行最短路径算法;实体对由种子条目描述中提取的维基百科实体组合生成。检索得到的实体将关联至指定语言版本下对应的 DBpedia 或 YAGO 条目,实体之间的关联关系也会被自动获取。该工具同时解决多项知识缺口与现实社会需求:文化遗产领域缺少面向叙事场景的专用工具,例如需要为同一展室内的文物搭建叙事关联,这类叙事不仅要逻辑通顺、信息翔实,还应当具备趣味性与吸引力。该原型现已能够输出自动故事生成通用工作流后续环节所需的知识三元组;后续还将完善可视化交互能力,允许终端用户以交互方式引导知识图谱进行拓展。

11

Dribdat

Dribdat 是一套开源、支持自托管运行的创意构想与赛事管理看板工具,可用于开展代码冲刺、创意共创、趣味黑客日以及各类黑客马拉松活动。活动参与者与组织者能够将平台生成的全部数据,以开放的无摩擦数据(Frictionless Data)格式导出。该工具由瑞士开放文化数据社区(GLAMhack、数据学院、Opendata.ch 黑客日项目)联合开发。平台具备人工智能相关能力,可自动生成赛事议题、为参赛团队提供指导建议并完成项目成果评估;工具已完成 EUROLLM、Apertus 等多款开源大语言模型的适配测试。更多组件集成方案可查阅其官方网站。

项目官网:https://dribdat.cc/

12

RePAIR

RePAIR(全称:Reconstructing the Past: Artificial Intelligence and Robotics,即重构往昔:人工智能与机器人技术),该项目提供一套工具、模型与数据集,旨在高效解决考古研究中一项耗费大量人力、极具挑战的工作 —— 破碎文物的实体复原拼接。这套工具集成机器人、计算机视觉与人工智能领域的前沿技术,最终目标是打造一套智能机器人系统,使其能够自主完成大型破碎文物的处理、碎片匹配与实体组装,耗时仅为人工操作的一小部分。

13

spaCy

spaCy 专为大规模信息抽取任务而开发。它具备多语言能力:支持 75 种以上语言,配套预训练处理流水线,可完成分词、词性标注、依存句法分析、命名实体识别等任务。内置神经网络模型,用于标注、句法解析、命名实体识别以及文本分类;还可接入 BERT 等预训练 Transformer 模型开展多任务学习。

spaCy 提供可投入生产环境的训练系统,能够便捷地完成模型打包、部署与工作流管理。用户可以轻松扩展自定义组件与属性,同时支持 PyTorch、TensorFlow 等框架训练的自定义模型。

项目官网地址:https://spacy.io/

四、平台数据库选介

1

Pattern classification dataset

Pattern classification dataset(纺织品图案数据集)由一批图像构成,图像均标注有对应器物纺织品上印花或织造形成的图案标签。数据集内的主体对象可以是纺织品片段(例如布料样本、织物残片),也可以是连衣裙这类时尚服饰。服饰类对象的照片既可以为单品静物拍摄,也可以是场景实拍,例如时装秀上模特上身穿着的实拍画面。

该数据集可用于训练图像分类模型,实现依据图案对纺织品、时尚服饰图像做分类;同时也能够拓展应用至其他领域(例如设计行业)。

开源仓库:https://github.com/datable-be/AI4_C_datasets

2

V4Design

V4Design 是一个专注于开发艺术与建筑数字化工具的项目。这套绘画风格数据集旨在提供训练数据,用于构建深度学习模型,实现对绘画作品的不同风格分类 —— 在 V4Design 项目术语中将其称为 “美学特征(aesthetics)”。构建该模型的目的,是让非专业普通用户能够检索视觉艺术作品及其相关资料。

当前数据集共包含 1614 幅绘画作品,分为巴洛克、洛可可以及其他三大类别。图像通过欧洲数字文化平台 Europeana 的搜索应用程序接口获取,筛选取自艺术专题馆藏内的开放可使用藏品。项目最初获取 24000 张图像,本数据集由其中筛选衍生而来。数据集标签由 V4Design 团队通过自研标注工具完成添加。

根据项目文档记载,除巴洛克、洛可可之外原本还设置了其他类别。但为满足机器学习模型的训练要求,仅保留标注样本数量充足的类别。

图像可通过给出的网络链接下载;依托 Europeana 编号与统一资源标识符,即可跳转至 Europeana 的藏品详情页面,获取藏品出处等更多元信息。这些标识符也可以调用 Europeana 记录接口,以机器可读格式进一步调取相关资料。

Zenodo 数据集地址:https://zenodo.org/records/4896487

3

DEArt

DEArt(欧洲艺术数据集) 是一套面向目标检测与姿态分类的数据集,作为 12‑18 世纪欧洲绘画研究的基准参考数据集arXiv。数据集包含超过 15000 张图像,其中约 80% 为非圣像类绘画;配套人工标注框,使用边界框标注 69 个类别下的全部目标实例,同时对类人对象标注 12 种不同姿态。

在全部类别当中,有 50 余个类别属于文化遗产专属类别,在其他公开数据集当中均未出现;这些类别涵盖神话幻想生物、象征符号实体以及其他艺术相关题材。

Zenodo 数据集地址:https://zenodo.org/records/6984525

4

Europeana

Europeana包含选自 Europeana 平台的一批单语元数据。数据集涵盖英语、德语、西班牙语、拉脱维亚语、荷兰语(EN、DE、ES、LV、NL)。文本片段提取自 Europeana 数据模型下各类元数据字段,这些字段用于记录文化遗产藏品的各类信息,例如画作名称或藏品描述。

文本内容依据元数据中标注的语言标签筛选,随后经过文本切分与清洗处理。针对语言标签标注错误的元数据,系统借助语言检测工具自动修正,再通过自动分句工具切分为独立句子。数据集还经过进一步过滤,剔除低质量文本对。本数据集由欧盟资助的 EuropeanaTranslate 项目产出。

五、成果提交流程

参与者可通过 AI4Culture 平台助力塑造文化遗产领域的未来。参与者提交的成果,将对借助人工智能推动行业革新起到重要作用。该平台邀请各界人士共同参与,为多元文化遗产的保护、阐释与传承产生深远影响。

注册页面:https://ai4culture.eu/auth/register

1. 创建账户

用户可在 AI4Culture 平台注册并创建账号,加入由人工智能爱好者、文化遗产从业者及科研人员构成的社区。

2. 提交成果

用户可上传工具或数据集,撰写技能培训资料以分享专业知识与研究见解,依托平台资源编写分步实操方案。用户根据成果类型填写对应表单并提交。

3. 成果提交审核与审批流程

成果提交后,平台团队会对提交内容开展审核,核验内容是否符合平台标准与规范。若内容需要修改,团队将提供修改意见,并解答用户提出的各类问题。

六、项目合作方

  • 梅措翁理工学院(Ethnicon Metsovion Polytechnion)—— 希腊

  • 欧洲数字文化基金会(Europeana Foundation)—— 荷兰

  • Datoptron(Datoptron)—— 希腊

  • 布鲁诺・凯斯勒基金会(Fondazione Bruno Kessler (FBK))—— 意大利

  • 潘吉尼克公司(Pangeanic)—— 西班牙

  • Translated 公司(Translated)—— 意大利

  • 荷语鲁汶大学(Katholieke Universiteit Leuven (KU Leuven))—— 比利时

  • 欧洲时尚遗产协会(European Fashion Heritage Association (EFHA))—— 意大利

  • 荷兰影像与声音研究所基金会(Stichting Nederlands Instituut Voor Beeld En Geluid (NISV))—— 荷兰

  • 奥地利技术研究所(Austrian Institute Of Technology (AIT))—— 奥地利

  • Datable 公司(Datable)—— 比利时

  • CrossLang 公司(CrossLang)—— 比利时

以上内容来自项目官网

https://ai4culture.eu/

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编译 | 洪冰凤

校对 | 周柃妍

排版 | 魏翔

阅读原文

跳转微信打开

  •  

牛力:当数字人文遇见大模型

2026-09-19 08:30 福建

数字人文是数字时代人文研究、人文理念的简称。对数字人文的最直观理解,就是以数字化手段从事的人文研究,这是一个与传统人文研究相区别的新兴人文研究方式,也是对数字人文的狭义界定。

牛 力 

中国人民大学国家发展与战略研究院研究员

信息资源管理学院副院长、吴玉章特聘教授

图片

图片

      数字人文是数字时代人文研究、人文理念的简称。对数字人文的最直观理解,就是以数字化手段从事的人文研究,这是一个与传统人文研究相区别的新兴人文研究方式,也是对数字人文的狭义界定。正如哈佛大学教授包弼德所指出的:“数字人文和传统人文研究的不同,有四个方面:一是数字资源,二是数据,三是用计算性方法查找和提取数据,四是用计算性方法分析数据,把数据可视化,来创造新的信息。也可以说,数字人文是在数字环境下促成周期研究,一个研究周期包括找到研究问题、收集数据、查找资料数据信息,整理、分析数据等环节,这些环节都可以运用数字人文方法。”

  数字人文的广义界定,不是从数字时代人文研究的视角作出的定义,而是从数字时代的人文精神、人文处境以及人文前景角度作出的界定,这是一个与前面定义相联系的界定。由于数字人文是一个区别于传统人文的新学科、新方法,因此它不可避免地会被引入到所有人文研究领域,从而对整个人文领域、人文精神、人文处境、人文重构产生全面影响,进而会逐渐催生出一个全新的人文环境。这是对数字人文的广义理解,也是一个在含义上三次扩展的定位:从人文研究中的数字化方法,到数字化的人文研究理念,再到新的人文环境建构。于是,人们便需要从数字时代的时代特征、人文的时代处境与重构两个相关的视角,去审视“数字人文”的命名正当性与含义复杂性。总而言之,无论是作为一种融合计算技术的跨学科研究方法,还是一个随技术不断演进的动态学术领域,数字人文的核心都在于通过方法论的革新,重塑人文研究的边界与内涵,并致力于构建一个更为开放、共享的未来人文新生态。

图片

目前数字人文领域的经典案例

这里我分享一下目前国内数字人文领域的几个经典案例:

  其一是数字《清明上河图》,技术人员通过运用数字动画和交互技术,让北宋张择端的长卷名画《清明上河图》“动”起来。如今在故宫博物院的数字展厅中,观众甚至可以通过3D长卷投影、互动屏幕等方式“一步进入清明上河图”,亲历千年前的北宋汴京。

  其二是“丹青宝筏”董其昌书画艺术大展,这是上海博物馆2018年底举办的大型特展,通过数字技术增强了展览的学术性与互动性。在展厅中设置了董其昌生平年表的数字时间轴,观众可触摸屏幕查看他不同时期的代表作品,还可在数字地图上浏览其游历足迹。这是博物馆与数字人文结合的有益尝试。

  其三是唐宋文学编年地图,这是由中南民族大学王兆鹏教授团队研发的在线平台,对唐宋时期数百位诗人、词人的生平行迹与创作活动做了可视化处理。用户进入地图,点击任意诗人的名字,立即可以看到这位文人在中国地图上的迁徙路线;再点击某个地名,还能看到此人在该地留下的诗篇名句。王兆鹏教授在接受媒体采访时表示,“唐宋文学编年地图的初衷是方便教学和研究。目前看来,它既可以用于教学研究,也可引发普罗大众对古诗词的兴趣。”这一案例充分说明数字人文项目不仅能服务学术研究,也能以直观有趣的方式吸引公众参与。

  从目前情况看,数字人文服务涉及三类资源与服务空间,即物理空间、数字空间、知识空间,且这“三空间”是彼此交织互动、融合发展的。

图片

大模型的崛起及其特征

从某种程度来说,大模型可以喻为我们的“超级文化助手”,这类模型是在海量数据基础上训练的智能系统,具备感知、记忆、推理、创作四大能力。简单来说,大模型可以处理文本、图像、语音等多种信息形式,执行从自动翻译、知识问答到内容创作等复杂任务。它们往往拥有庞大的规模、万亿级的参数,呈现出很多超出预期的“涌现能力”,展现出一定的通用智能。当今,国内外已经涌现出诸如ChatGPT、PaLM以及“文心一言”“悟道”等模型。

  这里我们重点介绍目前较为典型的大模型具备的四大核心能力。

  感知能力:指大模型接收、识别和理解外部信息的能力,包括对文本、图像、音频、视频等多模态数据的“感知”和解析。AI的“感知”是通过训练得到的跨模态建模本领。例如,敦煌研究院开发了“壁画病害智能监测”系统,让AI学会识别壁画上的裂痕、掉色等病害情况;在博物馆领域,AI可以分析文物图像,认出年代、风格甚至辨别真伪;在考古领域,机器学习模型能从航拍影像中发现人工遗迹的蛛丝马迹。未来的大模型将朝着多模态融合方向发展,能够整合视觉、听觉等多种信号。

  记忆能力:指大模型存储和调用知识的能力。一方面,大模型在训练过程中通过参数记住了海量知识;另一方面,在实际对话或任务中,它还能记住用户先前提供的上下文,在多轮交互中保持对话连贯。这种记忆力让AI更像一个善于倾听和反馈的交流者。用户甚至可以设定“个性化”参数,让AI在对话中展现特定风格。这种上下文关联记忆,使得人机交互更加自然,也使AI能够提供个性化服务。强大的记忆力意味着大模型可以成为文化领域的“活资料库”和“智慧档案”。

  推理能力:指大模型基于已知信息进行逻辑分析和推导的能力。近年来,研究者做出了各种改进以增强AI的推理能力。这里我们用“维苏威火山卷轴挑战赛”(Vesuvius Challenge)为例,2023年参赛团队利用深度学习成功识别出公元1世纪因火山喷发被碳化的古罗马纸草卷内部隐藏的希腊字母和单词,实现了人类首次非侵入性解读烧焦古卷的突破。在中国,敦煌莫高窟出土的敦煌遗书中有大量残损卷子,科研团队正尝试用大模型补全残缺的文字内容。在古籍修复、历史推演等方面,AI的推理能力正大显身手。

  创作能力:指AI生成文字、图像、音乐、代码等全新内容的能力。生成式AI因此备受瞩目。大模型具有极强的跨模态内容生成能力,可以以文生图,也可以以图生文,甚至还能谱曲、作画、写代码。大模型就像一位才华横溢的创作者,为文化创意提供了前所未有的工具,让每个人都有机会参与内容生产。不过,AI的创作必须由人类引导,技术永远是为人所用,作品中蕴含的思想和情感还需要人的智慧来把关。

  感知让AI获取信息,记忆让AI储存知识,推理让AI解决问题,创作让AI生成新内容。这些能力的结合,使得AI在文化领域大有可为。那么,大模型与数字人文的结合,将如何重塑我们的文化未来呢?接下来的讲座重点,我们将聚焦AI对数字人文“三空间”的革命性重构。

图片

AI驱动的数字人文“三空间”新生态

人工智能,尤其是大模型技术,正在推动数字人文服务空间的重构与进化,形成物理、数字、知识三空间融合共生的新生态。

1

物理空间:从静态展览到沉浸互动

物理空间指的是传统的文化场所和现实场景。AI技术的引入,正改变过去静态陈列式的文化服务模式。

  大模型等新技术通过数字化、虚拟化、智能化手段,升级了用户的感官体验。例如,在国家图书馆,观众可以戴上VR眼镜,体验“古籍寻游记”:利用5G全景VR技术,馆藏典籍《永乐大典》的珍贵内容被全景式数字化,人们仿佛置身于古代书库。国家图书馆还联合有关机构打造了国内首部VR互动纪录片《古籍寻游记》,还原20世纪初古文献四大发现的场景。

  中国国家博物馆的虚拟数智人“艾雯雯”于2022年入职国博,成为该馆首个AI数字员工。由AI技术驱动实时交互,她可以在社交平台上发布短视频,化身文化宣传大使;又能在展厅的大屏幕上充当智能讲解员,与观众对话交流。“数智人”成为连接实体文物与数字叙事的“活化媒介”,还能通过AR技术“附身”于历史人物形象讲述故事,提高观众参与感。

  在文物保护方面,AI带来新范式。修复师可先建立高清数字模型,让AI算法尝试虚拟修补缺失部分,提出修复方案,再由人工审阅加工。这样不仅降低了文物原件受二次损伤的可能,还能提高公众参与兴趣。敦煌研究院尝试开发AI辅助系统,对莫高窟壁画的褪色部分进行数字补色和图像重建,并在数字展览中展示“修复前后”对比效果。

  物理空间的升级核心在于从过去静态、单向的文化展示,转向智能、互动、沉浸的体验逻辑。观众能够“玩”展览、参与其中;文化遗产通过数字分身与公众“面对面”交流。

2

数字空间:从搜索关键词到懂你所需

数字空间是指互联网上的虚拟信息环境。大模型和相关AI技术的应用,使数字空间经历从“信息仓库”到“智能伙伴”的蝶变。

  传统数字资源检索依赖关键词搜索,数据之间是孤立的“岛屿”。AI则可以改变这一现状。大模型擅长语义理解,分析用户查询意图,进行语义匹配。用户与数字空间的交互更类似于和一个博学的助手对话,而非翻阅目录索引。

  AI通过关键能力改造数字空间的体现包括:

  数据整合,打破孤岛:AI利用知识图谱技术和大模型的跨领域学习能力,把分散在多个数据库的资源关联起来,形成统一的“信息图谱”。例如,故宫博物院的“数字文物库”:自2019年上线以来,已公开超过186万件藏品信息,并精选10万余件文物的高清数字影像免费发布。利用知识图谱技术,观众可以按朝代、材质、用途等多种角度探索馆藏,让“搜索变成发现”,目前相关浏览量已超3300万次。可以说,正是AI打通了文化数据领域的一些壁垒。

  智能检索,语义理解:AI赋能的检索尝试理解用户意图。例如,搜索“明清时期北京的风俗”,AI可能推荐相关度高的《燕京岁时记》或研究论文。在博物馆官网检索“龙的吉祥寓意”,AI会返回知识解释并附带文物链接。这种转变提升了信息获取精准度。

  跨模态整合,丰富体验:AI使数字空间能够处理丰富模态信息并回应。例如,“数字敦煌”平台汇聚敦煌石窟高清图像和学术资料。借助AI,用户在全景漫游壁画时,点击任意人物或场景,系统即时弹出说明文字或语音讲解,并可进一步提问。这真正做到了所见即所得、所问即所知。

  AI赋能下的数字空间正朝着更“聪明”也更“体贴”的方向发展:理解数据、理解用户;让文化资源随时随地可获取、可互动。用户不需要精通检索技巧,一个强大的文化AI助手将为我们串起散落各处的知识珍珠。

3

知识空间:从“死知识”到“活流水”

知识空间指的是文化知识生产与传播的领域。在AI技术推动之下,知识空间正从静态封闭走向动态开放。

  首先,数据驱动发现新知,数字人文通过数据分析,发现以前无法观察到的隐含模式。例如,研究者用计算机分析了晚清名臣曾国藩的日记、书信等文本,绘制出其人际交往网络图,揭示了以往史书未详载的复杂关系。又如唐宋文学编年地图项目,通过GIS地理信息系统把古代诗人的活动投射到地图上,“让历史动起来”,清晰展现诗人迁徙路线、创作地点和群体互动,深化了对文学场域和文坛生态的认识。这正是数据驱动知识发现的典型例证。

  其次,参与知识重构与再创,AI能基于知识进行再创造,“让知识自己说话”。例如,交互式图像描述工具:用户用鼠标点击图像细节,触发AI用自然语言描述,并可指定风格或要求背景讲解。这启发我们,未来博物馆、美术馆里的文物和绘画,都可能配置类似功能。知识由此被重新组织、加工和传播,进入“动态智慧”新范式。

  再次,开放共创的知识平台,数字时代的知识生产更加开放。例如上海图书馆建立历史文献众包平台,招募志愿者在线抄录和标注馆藏档案,使市民成为文化知识生产者。这类协作在学术界也渐受重视。AI可助力校对、纠错或智能推荐任务。在AI支持下,知识生产将实现专业与大众的更紧密协作。

  我将知识空间的这种变化概括为“跃迁”,即由静态存量跃迁为动态增量,由少数人封闭研究跃迁为众人开放参与。AI让知识空间更加敏捷聪明、富有活力,知识被视为可以不断演化的“有机体”。这种变革要求学者具备利用新工具的能力并拥抱跨学科合作;同时,要求我们提升问题意识,因为大模型等通用人工智能可以帮助我们解决问题,但无法代替我们发现问题。拥有问题意识的我们才是指令的发出者和结论的决定者。

图片

文化创意新范式:共创、传播与体验的变革

大模型不仅影响文化研究与保存,也在改变文化内容的生产与传播方式。

  首先是共创模式兴起,专业创作者与普通大众的界限正变得模糊。博物馆策展团队可通过线上平台征集观众的“创意点子”;作家可邀请读者用AI绘图工具创作插画;非遗传承人可与数字艺术家合作,将传统纹样通过算法生成新设计。特别值得注意的是,大模型降低了创作技术门槛(如AI绘画、写作模型),让普通人也能参与。“专家+公众”的融合共创模式,为文化内容注入新鲜活力,拉近了文化与社会大众的距离。

  其次是传播策略的精准化,AI提供强大的分析和推荐能力,帮助文化产品突破圈层壁垒,实现千人千面的传播。博物馆可用AI分析观众行为数据,制定针对性推广方案;图书馆可借助算法推荐内容。更重要的是,AI能生成不同风格的内容版本以适应不同受众。例如,介绍敦煌艺术,可为学者、普通读者、小朋友生成不同版本。故宫博物院既有学术季刊,也发布萌趣文物表情包;国家图书馆举办高端讲座的同时推出科普短视频。精准传播旨在激发文化共鸣,让不同背景的人以合适方式接触文化内容。

  再次是沉浸式体验的发展趋势,随着VR、AR、全息成像等技术成熟,文化体验向沉浸化发展。AI在构建虚拟场景和实时交互中扮演重要角色:实现对用户动作的识别和反馈;根据观众反应动态调整内容。未来的博物馆可能同时存在“实体展厅”和“云展厅”,并可打通:在实体展厅用AR扫描文物可显示虚拟还原;在家通过VR参观能实时看到现场观众路线,甚至线上线下的观众可通过数字分身“相遇”交流。虚实融合让文化突破时空限制,渗透到日常生活场景。

  最后是服务路径的个性化,在AI帮助下,每个人可拥有专属“文化顾问”或“创意搭档”。观众走进图书馆博物馆时,可能有AI数字人导览,根据兴趣调整讲解;阅读古诗词时,AI助手可随时解释典故、提供译文或讨论诗意。大模型善于学习个人偏好,持续推荐用户感兴趣内容。学习技能时,AI可全天候提供教学和针对性训练方案。研究者可用AI助手筛选文献、起草报告;艺术家可用AI试验灵感。“数字文化管家”使文化服务越来越以人为本、因人而异,并努力拓展用户视野。

  总体而言,AI引领的文化创意新范式体现在“共创”带来内容生产者范围扩大,“精准”带来传播触达广泛化,“沉浸”带来体验方式革新化,“个性”带来服务供给定制化。这四股趋势相互叠加,塑造出活力无限的文化科技时代。文化机构和从业者需要主动拥抱变化。但无论技术如何发展,文化创意最核心的还是内容的品质与价值。AI可以辅助,但无法取代人对美的追求和对意义的思考。新范式下我们更需要强调人文精神的引领。

图片

人文责任与伦理边界:AI时代的深度思考

在观察并展望AI深入文化领域的同时,我们也需要意识到平衡技术进步与人文价值之间关系的重要性。

  技术与价值的协调:以伦理规范引导技术向善。AI技术本身无善恶,关键在于运用。文化领域潜藏风险需以伦理规范指引。AI生成内容可能出现错误或捏造,随之进入传播流程就会造成误导,文化机构采用相关内容时必须安排专家审核把关,以确保真实性;文艺创作中需要避免AI生成低俗不当内容;大模型训练依赖数据涉及版权问题,诸如AI“模仿”风格是否侵权、生成作品归谁所有等问题,以上都需要法律和伦理双重规范。业界应尽快建立标准和准则(如明确AI在博物馆讲解中的适用范围、强调不得编造历史;制定古籍修复技术规范并标注AI复原部分)。加强对从业人员培训,提高道德敏感度。

  人机共生的愿景:AI激发人的思辨与创意。我们应将AI视为人类思想的延伸和激发器。学术上,大模型可快速处理海量材料,但提出问题、洞察本质仍是人类的任务,AI的任务是促使研究向更深层推进。艺术上,真正扣人心弦的作品源自人类独特体验和情感。AI能激发灵感,画家用AI生成意象再创作;音乐家用AI分析曲谱汲取元素创作。这是“人机协作”的成功范例。我认为,未来的理想状态应是,AI承担烦琐重复工作,人类专注创造性部分;AI提供多种思路参考,人类做价值判断选择;AI像镜子一样反照盲点,促人拓展思维。大模型等通用人工智能可以帮助我们解决问题,但无法代替我们发现问题。人类保持好奇心和批判性思维,AI将成为激发思辨与创意的火花。

  各方共治:协力守护文化生态。AI赋能文化需要开发者、政策制定者、文化机构、公众等各方共治。技术社区需在算法设计中融入价值考量(如避免偏见,尊重多样文化);政府部门需制定政策,鼓励有益项目发展,防范滥用(如杜绝篡改历史、造假文物);博物馆、图书馆等要勇于尝试新技术,建立风险预案(如AI出错时及时必要的人工纠正机制);公众应提高媒介素养,理性看待AI信息。在运用AI的同时,我们需要精心“守护文化生态”。如果缺乏良好治理,AI可能放大谣言、一味迎合流量甚至引发认同冲突。多方应协力制定规则、运用技术手段和教育举措,确保AI赋能而非损害文化。中国应积极在国际舞台上为数字人文和AI伦理贡献智慧,合作应对全球性问题(如数字版权、AI偏见等),共创开放有序的文化科技环境。

图片

让文化“活”得更精彩

让文化“活”得更精彩,是我们共同的使命。从活字印刷到互联网,技术革新不断为文化传播开拓新天地。大模型浪潮是又一次划时代机遇。通过善加利用,AI将成为守护文化、传承文明的强大力量。想象未来的博物馆、图书馆,真实与虚拟交相辉映,藏品与观众深度互动;学术研究数据与灵感融会贯通;文化消费中人人既是享受者也是创造者,中华优秀传统文化焕发时代光彩。

  技术发展并非一帆风顺,但“凡事预则立,不预则废”。通过文化与科技界携手努力,有能力引导AI成为人类文明的“点灯人”而非“熄灯者”。当AI与大模型注入其中,尘封的历史将更鲜活,传统的文化将更青春——我们的文化未来,也将因此变得更加绚丽精彩。

图片

本文刊登于光明网《光明日报》2025年08月09日 10版,请参看原文。

文章转引自“人大国发院”微信公众号

阅读原文

跳转微信打开

  •  

新书推荐 | 《数字化中世纪:深度制图、第三维度与数据挖掘》

2026-09-12 08:50 上海

一、书籍简介

《数字化中世纪:深度制图、第三维度与数据挖掘》(Digitalizing the Middle Ages: Deep Mapping, Third Dimension and Data Mining)由 Meritxell Simó、Adriana Camprubí 和 Xavier Costa-Badia 主编,2026 年由兰培德国际学术出版集团(Peter Lang International Academic Publishers)出版。书中讨论数字人文技术如何进入中世纪研究,并关注这些技术对研究方法和知识生产方式带来的影响。编者将全书分为深度制图、第三维度和数据挖掘三个部分,共收录十章,涉及历史学、考古学、艺术史、语言学、文献学和文化遗产研究。

第一部分讨论深度制图。作者从空间转向出发,分析地理信息系统(Geographic Information System,GIS)在中世纪景观研究中的作用。研究者可将历史文献、考古材料、地形数据和地理位置纳入统一的分析框架,从而观察聚落分布、交通路线、资源范围、可视区域和不同地点之间的联系。书中还介绍了语义数据模型和社会网络分析方法,将历史人物、地点、事件和活动转换为结构化数据,并通过空间和网络关系重新组织。另有一章结合数据女性主义和网络分析,讨论档案记录中的女性及边缘群体。数字方法由此参与到史料偏差的识别之中。

第二部分聚焦三维技术。研究对象包括中世纪建筑、壁画、考古遗址和文化景观。书中介绍了激光扫描、激光探测与测距(Light Detection and Ranging,LiDAR)、运动结构恢复(Structure from Motion,SfM)摄影测量和三维点云等技术,可用于建立建筑和遗址的数字模型,并记录其尺度、结构、表面材质和颜色。这些模型服务于测绘、修复、保存、研究和公众展示,同时也能够保留一些传统图纸难以完整记录的信息。作者同时提醒读者注意技术选择。不同设备会产生不同精度的数据,模型处理过程本身也涉及诸多取舍,且最终结果仍受研究者判断、参数设置和记录方式的影响。

第三部分讨论数据挖掘。内容涉及艺术史数据库、数字文献学、手写文本识别和中世纪拉丁语词典。中世纪诗歌可采用 XML-TEI 进行编码。不同抄本中的词形、句子、增删和异文也可以进入数字分析。手写文本识别系统能够把大量档案转化为机器可处理文本。识别结果还可以继续用于命名实体识别、文体分析和社会网络分析。不过,机器学习存在透明度不足和“黑箱”问题,因此人工校对与专业知识仍然不可或缺。数字词典项目则通过标记人物、地点、年代、书吏和文献类型,使研究者能够进行传统纸本工具难以完成的组合检索。

全书的突出特色在于,编者将数字技术融入具体的中世纪研究实践中,而非泛论其可能性。GIS、三维建模、数据库和文本识别都服务于明确的历史问题。全书也持续讨论数据、模型和算法的局限。编者因此将数字化理解为一种研究方法的变化。它不仅改变史料的组织方式,也改变研究者提出问题、验证证据和呈现历史的方式。

二、作者介绍

Meritxell Simó

Meritxell Simó 是西班牙中世纪文学与数字人文研究学者,任职于巴塞罗那大学(University of Barcelona),研究领域主要包括罗曼语文学(Romance Philology)、中世纪文学、吟游诗人(troubadour)诗歌及数字人文。她曾担任巴塞罗那大学中世纪文化研究机构(Institut de Recerca en Cultures Medievals,IRCVM)的负责人,并长期参与跨学科中世纪研究团队的组织与协调。IRCVM 汇集历史学、文学、考古学、艺术史等不同领域的研究者,同时积极推动数字技术在中世纪研究中的应用。相关工作包括中世纪文本数字化、GIS 历史制图、数字数据库建设,以及历史空间和文化遗产的虚拟重建。

Simó 的主要学术方向之一是欧洲中世纪吟游诗人文学。她长期参与有关吟游诗人抒情诗传播、接受史和文本传统的研究,并参与“吟游诗人语料库”(Corpus des Troubadours)项目。该项目由国际学术联合会(Union Académique Internationale)发起,并由加泰罗尼亚研究所( Institut d’Estudis Catalans )管理。她还主持中世纪及现代时期吟游诗歌接受史相关研究,并发表了大量中世纪文学研究成果。

除个人研究外,Simó 具有丰富的学术项目与团队管理经验。她曾担任巴塞罗那大学语言与传播学院的质量委员会主席,也参与和主持多个国际研究项目。她同时从事中世纪研究成果的出版与传播工作,担任学术期刊 SVMMA 及多个中世纪研究出版系列的负责人,并参与多项国际会议的学术组织。2021 年,她曾主持以数字人文为主题的 IRCVM 第二届国际会议。

Adriana Camprubí Vinyals

Adriana Camprubí Vinyals 是西班牙中世纪文学、罗曼语文学与数字人文学者,目前任巴塞罗那大学罗曼语文学领域的兼职教授,并隶属于IRCVM。她所在的研究团队关注中世纪文学的语用研究,以及不同语言和文化之间的接触。Camprubí 的学术训练具有明显的跨学科特点。Camprubí 在巴塞罗那自治大学(Universitat Autònoma de Barcelona)获得文学理论与比较文学博士学位,博士论文研究十一至十三世纪新圣歌( nova cantica )的韵律和旋律传统,考察拉丁抒情诗向罗曼语抒情诗的发展。此前,她接受过音乐学、中世纪研究和比较文学方面的系统训练。她于 2013 年完成音乐学学位,并专攻罗曼文学与文化,2014 年获得圣地亚哥-德孔波斯特拉大学( University of Santiago de Compostela )的 中世纪研究硕士学位,2015 年获得庞培法布拉大学( Pompeu Fabra University )的 比较文学硕士学位。2021 年,她又于西班牙国立远程教育大学(Universidad Nacional de Educación a Distancia)获得数字人文硕士学位。

Camprubí 的主要研究方向集中在中世纪抒情诗,尤其关注比较韵律学、吟游诗人诗歌中的文本与音乐关系、宗教仪式相关的抒情传统,以及数字技术在中世纪文学研究中的应用。她参与了多个国际数字编辑和中世纪音乐研究项目,其中包括 Gruppo Thibaut 和 MedMus。她还参与了 MedMel 数字项目,对吟游诗人相关资料进行修订和整理。

数字人文已经成为她近年来研究的重要组成部分。她曾专门撰文介绍用于研究中世纪罗曼语抒情诗的数字资源,并关注 XML-TEI 数字编辑等方法。例如,她曾讨论数字项目“探索中世纪的玛利亚·抹大拉”(Exploring Medieval Mary Magdalene),该项目通过 XML-TEI 对中世纪抄本中的玛利亚·抹大拉传说进行数字编辑。

Costa-Badia, Xavier

Xavier Costa-Badia 是西班牙中世纪史学者,现任巴塞罗那大学历史与考古学系 Serra Húnter 讲师(Serra Húnter Lecturer,加泰罗尼亚政府资助的卓越人才引进计划教职),同时是IRCVM的研究人员。他的研究主要集中于中世纪早期的加泰罗尼亚,尤其关注修道制度、宗教机构、历史景观以及政治和社会空间的形成。

他的学术训练均在巴塞罗那大学完成。Costa-Badia 于 2013 年获得历史学学士学位,2015 年获得中世纪文化硕士学位,2019 年取得同一领域的博士学位。博士论文题为《修道景观:加泰罗尼亚诸伯国的早期中世纪修道制度(九至十世纪)》(Paisatges monàstics. El monacat alt-medieval als comtats catalans (segles IX-X)),主要研究九至十世纪加泰罗尼亚诸伯国的早期中世纪修道制度及其空间分布。该论文于 2020 年获得加泰罗尼亚研究所( Institut d’Estudis Catalans )颁发的普罗佩尔·德·博法鲁尔中世纪史奖(Pròsper de Bofarull Medieval History Prize)。

Costa-Badia 的研究特色在于把修道院置于更广阔的历史景观中加以考察。他关注修道机构如何参与领土组织,以及它们与政治权力、经济活动、社会关系和宗教生活之间的联系。因此,他的研究同时运用书面史料和考古材料。他近年来的研究还涉及从晚期古代( Late Antiquity )到加洛林时期( Carolingian period )的修道制度演变,以及伊斯兰征服前后伊比利亚半岛东北部宗教机构的发展。

数字方法也是他近年来研究的重要组成部分。他参与巴塞罗那大学中世纪考古实验室(Medieval Archaeology Laboratory)的相关项目,将 GIS、空间分析和数字考古方法用于中世纪景观研究。例如,利用GIS分析聚落分布、资源利用、交通路线和历史区域之间的关系。他还参与文化遗产数字重建项目,将历史文献、考古证据与虚拟现实和三维重建结合起来。

三、出版信息

四、章节目录

  • 第一部分:深度制图

    • 第一章:开辟新的研究路径:空间转向与 GIS 对中世纪景观研究的贡献

    • 第二章:语义数据建模及其拓展:通过深度制图与社会网络分析进行数据采集与利用的若干案例

    • 第三章:数据女性主义、网络分析与前现代档案

  • 第二部分:第三维度

    • 第四章:建筑遗产数字化:方济各会严规派景观的研究、传播与保护

    • 第五章:中世纪建筑与绘画研究、考察及保护中的数字模型

    • 第六章:三维记录能否改变历史与考古解释:巴塞罗那大学中世纪考古实验室 LAMUB 的数字三维工具应用

  • 第三部分:数据挖掘

    • 第七章:中世纪艺术史学者与数据库:一种矛盾的关系

    • 第八章:数字文献学交汇处的中世纪抒情诗

    • 第九章:手写文本识别系统在中世纪与近代早期公证登记簿中的应用:潜力与风险

    • 第十章:加泰罗尼亚中世纪的数字化:通过数字 GMLC 与 CODOLCAT 更新中世纪拉丁语词典学

五、章节简介

第一章:开辟新的研究路径:空间转向与 GIS 对中世纪景观研究的贡献

本章讨论空间转向如何改变中世纪历史与考古研究。作者认为,中世纪社会不能只沿时间线理解——聚落、道路、资源、山脉、河流、教堂和城堡共同构成历史活动的空间条件。研究因此需要同时处理时间、空间与社会关系。作者借助 Edward Soja 关于空间的理论,将考古空间区分为三个层次:可以观察和记录的物质空间、经过识别和分类的空间,以及由人的行动和经验构成的生活空间。在实际研究中,作者将数据库与GIS 结合起来。GIS 不仅能够制作专题地图,还可进行聚落范围、成本距离、最优路线和可视域分析。书中介绍了维诺图、聚落资源域分析、最小成本路径和可视域分析等方法。案例主要来自加泰罗尼亚。Baix Montseny 的研究利用地形、道路和聚落资料分析六至十世纪的人类活动。El Penedès 的案例考察居民点与教堂、城堡之间的距离。比利牛斯山地区的研究则利用移动时间分析医院和庇护地点的服务范围。作者强调,算法得到的是历史空间的模型。地形资料、植被和道路情况都可能发生变化,因此分析结果需要与文献和考古证据相互验证。数字方法的价值在于建立新的比较尺度,并将原本分散的证据纳入统一的空间框架。

第二章:语义数据建模及其拓展:通过深度制图与社会网络分析进行数据采集与利用的若干案例

本章关注历史资料进入数据库以后应当如何组织。作者首先讨论语义数据建模。历史研究中的人物、事件、地点、行动和时间都需要转换为能够被计算机处理的结构。作者采用 HORAI 语义数据模型,并以 GREYWARE 数据库作为主要案例。模型中的两个重要类别是“地形单元”(Unit of Topography)和“行动者”(Actor)。前者可以表示地点、事件、活动和具有空间属性的对象,后者主要表示参与历史行动的人。数据库同时记录不同单位之间以及人物之间的关系。这样一来,考古材料、书面文献、陶器分析和人物资料便可以进入同一数据环境。作者随后展示深度制图的用途。地点、生产活动、人口移动和时间能够同时出现在地图中。有关制陶业的案例尤其具体。对男性陶工的直接检索容易突出传统生产中心,而加入与陶工和作坊有关的女性资料以后,人口迁移和生产网络呈现出更复杂的格局。作者还使用社会网络分析研究陶工家族、婚姻关系和作坊继承。家族之间的联姻经常与行业竞争、资源维护和作坊延续有关。本章因此强调数据建模的重要性。分类方式会影响最终能够提出的问题。数字工具可以揭示新的关系,也要求研究者清楚说明数据如何被定义、连接和解释。

第三章:数据女性主义、网络分析与前现代档案

本章把数据女性主义与社会网络分析引入前现代历史研究,聚焦一个核心问题:历史档案本身带有选择性。留下记录的人、保存材料的人和编辑材料的人都会影响今天能够看到的历史。女性和边缘群体往往在这一过程中被削弱。网络分析可以帮助研究者重新检查这些沉默。作者指出,网络由节点和关系构成。人物、机构、城市、文本和物品都可以成为节点。研究者需要先决定哪些关系值得记录,因此任何历史网络都具有边界,也具有研究者的选择。书中介绍多个案例。其中一个案例研究玛丽一世时期的新教通信网络。传统殉道史突出被处死的男性,但网络中的中介中心性和特征向量中心性显示,一些女性承担了传递信息、提供金钱、衣物和食物以及给予情感支持的重要工作。另一个案例研究十四世纪朗格多克的贝格因派(Beguins)。宗教裁判档案容易突出被调查机构视为领袖的男性,但当研究者扩大数据采集范围以后,女性在网络中的连接程度和影响力明显提高。分析还显示,男性和女性的平均连接程度接近。作者因此主张谨慎处理所谓大数据。规模较小、人工整理且来源明确的数据同样能够产生复杂的历史解释。面对有偏差的档案,研究方法本身也需要针对沉默和缺失进行专门设计。

第四章:建筑遗产数字化:方济各会严规派景观的研究、传播与保护

本章以 F-ATLAS 项目为核心,讨论数字技术如何用于方济各会严规派建筑和文化景观研究。项目覆盖意大利、西班牙和葡萄牙,并把修道院置于周围的城市、乡村和自然环境中考察。研究团队首先进行建筑遗产的数字记录。主要方法包括地面激光扫描、运动恢复结构摄影测量、无人机摄影、GIS 和三维建模。这些技术能够生成高精度点云、正射影像、平面图、立面图和剖面图。研究人员还可以记录建筑材料、墙体层次和结构损坏情况。数字记录因此具有研究和保护两方面的意义。F-ATLAS 同时建立数据库、WebMap、移动应用和数字展示系统,并尝试使用 AR 和 VR 进行文化遗产传播。作者特别关注一些偏远地区的修道院。十九世纪宗教团体解散、长期废弃、自然灾害和环境变化使部分建筑面临严重保护问题。数字调查可以记录当前状态,也可以为维修和风险评估提供基础。作者还讨论数字遗产与公众之间的联系。远程访问、虚拟旅游、徒步路线和自行车路线可以扩大这些遗址的社会影响。与此同时,遗产管理仍然需要考虑当地文化背景和社区参与。数字模型最终需要回到建筑本身,并服务于长期保存和历史理解。

第五章:中世纪建筑与绘画研究、考察及保护中的数字模型

本章介绍 EHEM 项目如何利用数字模型研究中世纪建筑和壁画。项目选择了三个具有不同历史问题的遗址。其一是罗马的圣玛丽亚古董教堂(Santa Maria Antiqua),其壁画存在多层覆盖。其二是加泰罗尼亚的圣基尔泽·德佩德雷特教堂(Sant Quirze de Pedret),这座教堂经历了多次建筑改造,部分壁画后来被剥离并收藏于不同博物馆。其三是塞浦路斯圣涅奥菲托斯修道院(Agios Neophytos)的恩克莱斯特拉(Enkleistra),其中保存有多时期的拜占庭壁画。项目首先利用激光扫描和摄影测量制作三维模型,然后根据考古、建筑和艺术史资料重建不同历史阶段。研究内容包括墙体变化、绘画层次、原始色彩和室内光照。Pedret 的案例尤为充分地展示了数字技术的用途:研究团队把分散于博物馆中的壁画重新置入虚拟教堂,并开发数字色彩复原方法,以模拟颜色退化前的视觉效果。项目还将图像注释和历史解释嵌入模型,使用户可以在不同时间阶段之间切换浏览。用户测试表明,这种方式有助于理解建筑变化以及已分散壁画的原始布局。作者同时强调数字重建中的假设性——颜色、材质和建筑形态都需要依据证据判断。可靠的数字模型需要明确记录证据等级和解释过程。技术精度不能代替艺术史判断,长期保存数字数据本身也构成了新的遗产问题。

第六章:三维记录能否改变历史与考古解释:巴塞罗那大学中世纪考古实验室 LAMUB 的数字三维工具应用

本章从考古实践出发,讨论三维记录是否真正改变了历史解释。作者以巴塞罗那大学中世纪考古实验室(Medieval Archaeology Laboratory of the University of Barcelona,LAMUB)为核心,结合 Castellvell 遗址发掘和虚拟遗物库(Virtual Artifacts Library)两个项目展开分析。摄影测量已经可以快速生成遗址、地层和器物的三维模型。这些模型保存了形状、纹理、颜色和空间关系,也允许研究者在发掘结束以后重新观察已经被移除的地层。作者同时关注传统考古绘图的价值:手绘过程本身包含观察、筛选和解释,而数字摄影可以把解释过程推迟到实验室阶段。因此,技术改变的不只是记录工具,也改变了研究者与考古对象接触的方式。虚拟遗物库收集了不同类型的中世纪遗物,并为每件对象提供三维模型以及材质、功能、年代和来源等资料。作者主张把二维图纸与三维模型结合使用。三维模型可以补充体积、颜色和表面细节,二维图则在清晰表达结构关系方面仍具优势。本章还提出了一个经常被忽略的问题——摄影测量会产生大量照片、模型和衍生数据,需要持续的存储空间、硬件和维护经费。考古遗址一旦发掘,原有地层可能永久消失,因此这些数字记录本身可能成为唯一保存下来的证据。数字考古由此带来了新的数据保存责任。

第七章:中世纪艺术史学者与数据库:一种矛盾的关系

本章讨论中世纪艺术史与数据库之间长期存在的复杂关系。作者指出,艺术史一直依赖分类、目录、照片和图像比较,因此从研究性质看非常适合数据库方法。然而许多艺术史学者对计算机数据库仍然保持距离。原因包括技术训练不足,也包括艺术史更习惯从材料中建立叙事。作者从艺术史分类传统讲起,并讨论图像志(iconography)在二十世纪后期受到的批评。随后介绍 Timel、中世纪艺术索引(Index of Medieval Art)和图像分类系统(Iconclass)等图像分类与控制词表。这些体系说明,中世纪图像可以通过人物、主题、建筑和自然环境等类别进行结构化记录。作者还测试自动图像识别技术。现有算法面对中世纪图像时容易发生误判,因为训练数据和网络上的相关元数据不足。因此,图像主题的识别和索引目前仍需要大量人工参与。控制词表也仍然是保证检索质量的重要手段。后半章转向数据库设计。艺术品可以被建模为实体,并进一步记录地点、年代、人物和社会关系。数据库因此能够支持筛选、地图显示、数据导出和网络分析。作者同时提醒,数据库的分类结构本身已经包含了解释。艺术史学者需要理解基本的数据建模逻辑,并与计算机人员建立共同术语。数字工具只有进入实际研究流程,才能真正形成新的知识。

第八章:数字文献学交汇处的中世纪抒情诗

本章讨论数字文献学如何处理复杂的中世纪抒情诗传统。作者首先区分数字化文本与真正的数字学术版本。把纸本内容转换成 PDF 或网页只能解决访问问题。数字学术编辑还需要对文本结构、异文、抄本信息和语义进行编码,并建立可以持续检索和比较的数据。作者特别关注奥克语和加泰罗尼亚语吟游诗歌。中世纪抒情诗经常保存于多个抄本,同一首作品可能出现拼写、语音、形态、词语、句子、增删和篇章结构上的变化。过去的校勘学倾向于寻找接近原作的文本;数字环境则允许多个文本见证同时呈现,使异文自身成为研究对象。本章介绍了 DigiLiriTrob 项目。项目正在制作中世纪女性声音抒情诗的数字版本,并同时提供抄本转写版和解读版。文本采用 XML TEI 进行语义标记,并计划利用 EpiDoc 可视化工(EVT)展示。使用者可以把抄本图像、转写文本和不同见证并列查看。作者还讨论了 CollateX 等文本对齐方法。对于语言高度标准化的材料,自动对齐较为有效。中世纪语言存在大量拼写和形态变体,因此仅依赖字符串匹配会产生大量错误。数字文献学仍然需要扎实的语言学和校勘学知识,也需要研究者掌握编码、界面和数据结构的基本原理。

第九章:手写文本识别系统在中世纪与近代早期公证登记簿中的应用:潜力与风险

本章研究手写文本识别(Handwritten Text Recognition,HTR)在历史档案中的实际应用。案例来自意大利南部贝内文托(Benevento)保存的中世纪和近代早期公证登记簿。这些材料包含大量社会和经济史信息,但长期缺少完整整理。作者以同一位公证人的五册登记簿建立训练材料。HTR 属于监督式机器学习,因此首先需要真值数据(Ground Truth)。研究人员必须把手写页面与经过人工校对的转写文本对应起来,并保持转写规则一致。训练材料还需要覆盖不同类型的文书和书写状态。书中介绍了典型的 HTR 流程,包括图像上传、页面分区、文字识别和结果导出,并以 Transkribus 为主要平台。识别后的文本可以继续进行命名实体识别、文体分析和社会网络分析。大规模手稿由此能够进入远读(distant reading)的视野。作者同时详细讨论风险。机器学习模型存在黑箱问题。不同训练过程也可能产生不同结果,因此研究者必须记录参数和实验条件。数字图像及识别结果还涉及真实性问题。模型训练会消耗计算资源和能源,因此数据共享和模型复用也具有现实意义。作者最终认为这些风险可以控制。经过校正的 HTR 可以为全文检索、数字版本和大规模历史分析提供重要基础。

第十章:加泰罗尼亚中世纪的数字化:通过数字 GMLC 与 CODOLCAT 更新中世纪拉丁语词典学

本章讨论数字技术如何改变中世纪拉丁语词典编纂,并重点介绍 GMLC 与 CODOLCAT 两个项目。GMLC 是加泰罗尼亚中世纪拉丁语词汇研究项目,CODOLCAT 则为词典提供数字文献语料。研究人员在录入文书时,需要同时处理文本和元数据。信息包括法律行为类型、发文者、地点、年代、档案信息、抄写员、书写材料、字体以及现有版本。完成标记后,文书全文和摘要进入数据库,这一过程需要持续的文献判断和校勘。数字版 GMLC 于 2021 年上线。词典与语料库之间建立了直接联系。词典编者可以查看一个词出现的全部文本,也可以读取词源、语法类别和文献背景。数据库还允许根据书吏、文书类型、字体和地点进行组合检索。作者进一步介绍了伊比利亚半岛中世纪拉丁语文献语料库(Corpus Documentale Latinum Hispaniarum,CODOLHISP)。该平台把伊比利亚半岛多个地区的中世纪拉丁语数据库连接起来。到 2025 年,其第二版已经可以统一检索七个数据库中的三万五千余份文献,同时保留各项目原有的方法和数据结构。这一系统展示了数字词典学的发展方向:词典、全文语料、档案信息和历史数据开始形成可以互相查询的知识环境,研究对象也从单个词条扩展到中世纪社会、地理、书写文化和日常法律活动。

以上内容来自网站

https://directory.doabooks.org/handle/20.500.12854/178421

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编译|魏翔

校对|周柃妍

排版|洪冰凤

阅读原文

跳转微信打开

  •  

专业资讯 | 美国加利福尼亚大学洛杉矶分校(UCLA)成立全美首个数字人文系

2026-09-04 08:30 上海

美国加利福尼亚大学洛杉矶分校(UCLA)成立全美首个数字人文系

David Esquivel/UCLA

以人文视角审视技术:UCLA 全新的数字人文系,把人文研究方法应用于正在重塑世界的各类技术,同时运用这些技术去探索人类经验。

核心要点

1. 学科首创:UCLA 是美国第一所设立独立数字人文系的高校,也将成为全美首所授予数字人文学士学位的高校。

2. 跨学科范式:该院系融合人文学科、技术、数据科学及其他学科,探究数字工具如何改变社会与学术研究,以及如何让技术更高效、更负责任地服务于人。

3. 需求旺盛:学生对该领域的兴趣持续高涨 —— 数字人文目前是 UCLA 文理学院(UCLA College)规模最大的辅修专业,这也直接推动了新院系的成立。

UCLA 成为美国首家设立独立数字人文系的大学。此举让该校站在这一日益重要、需求旺盛的学科前沿;该学科有望在确立数字未来的准则与伦理规范方面发挥引领作用。

广义而言,数字人文包含两大相辅相成的研究方向:一方面,运用人文学科的研究方法理解数字技术,阐释其对个体、机构与社会产生的影响;另一方面,借助数字工具探索并记录“人之为人”的诸多面向,涵盖文学、语言、文化研究及其他人文研究领域。

数字人文在 UCLA 并非新兴学科。二十余年来,本校教师一直走在人文、社科与艺术领域数字导向研究的前沿。2010 年,学校设立数字人文项目,隶属于 UCLA 人文学院。该项目最初预计每年招收约 25 名学生,之后规模迅速扩张。上个学年,超过 200 名本科生选修数字人文辅修,使其成为人文学院规模最大的辅修专业,同时也是全校第二大辅修专业。

2025‑2026 学年,总计约 750 名本科生、30 余名研究生修读了数字人文相关课程。

随着新院系正式成立,UCLA(官网: https://www.dh.ucla.edu/)将成为全美首个授予数字人文学士学位的高校。

锤炼面向未来工作与研究的能力

“这不仅体现出 UCLA 认可数字人文作为本科专业的吸引力与就业市场价值,更认可它对于 21 世纪教育的现实意义。” 新任系主任、UCLA Madeleine L. Letessier 法语与法语区研究讲席教授 Dominic Thomas 表示,“我们需要思考并设计这样的课程,让毕业生在全球化世界中想象、塑造新的未来,同时帮助他们明确自己最终将从事怎样的工作。”

为此,院系的教学与研究覆盖技术与人文学科不断交融的诸多维度。学生将学习运用先进数字工具探究人类文化、历史与生命体验,同时习得批判性思维,辨析技术的研发与使用逻辑、技术背后所代表的立场,以及技术对人和社会造成的影响。

当下人工智能无处不在,社会也愈发担忧:人工智能的快速普及,已经跑在了有效安全保障机制的建设前面,在此背景下,该院系的成立恰逢其时。

“我们正处在十字路口。”Thomas 说,“如今,无论是专业讨论还是大众闲谈,没有哪个议题比人工智能相关问题讨论得更加热烈。”

正因如此,UCLA 数字人文学者的诸多研究议题,都与人工智能所带来的道德与伦理问题。“想要让技术服务人类、实现更加公平的社会,而不只是单纯追求利润、服务企业利益,就必须培养一批能够负责任地引导、管控技术的人才,这一点至关重要。” 欧洲语言与跨文化研究教授 Todd Presner 说道。他是院系建制工作的联合牵头人,也曾担任数字人文项目主任。“我们需要学生深刻理解这些技术的发展历史,理解这些模型如何表现、如何运作。”

Presner 补充道,拥有语言文学背景的人,对于理解和塑造人工智能将起到不可或缺的作用,尤其是因为大语言模型的训练数据来自数百年来人类创作的海量文本。

当然,数字人文教师的研究兴趣与课程设置远不止人工智能。本科专业课程涵盖用户体验与设计、社交媒体分析、数字制图与地理信息系统,以及利用三维建模复原古代城市等主题。

院系成立之初将拥有约18名来自相关院系、参与数字人文教学与研究的教师,研究方向十分多元。例如,信息研究教授 Miriam Posner 研究数据与技术如何塑造日常生活;其即将出版的著作Seeing Like a Supply Chain剖析供应链管理技术背后不为人知的历史。互联网研究学者、性别研究与非裔美国人研究教授 Safiya Noble,是知名学者,专攻商业搜索引擎算法如何固化种族与性别偏见等议题。

院系将承接 Presner、Danny Snelson 等教授领衔的前沿研究。Presner 正在开展研究,探究人工智能与社交媒体如何影响大屠杀叙事;英语与设计媒体艺术教授 Danny Snelson 借助数字媒介创作游戏、诗歌与艺术装置,以全新视角解读日常技术。

“UCLA 数字人文系以人文学科为内核,同时具备跨学科属性。” 人文学院院长 Alexandra Minna Stern 说道,“我们的教师不仅具备深厚多元的人文素养,还掌握数据科学、社会科学、信息研究以及诸多其他学科的专业能力。不同思想在此碰撞交融,为学生打造富有价值的学习机会,也推动这一重要学科向前发展。”

David Esquivel/UCLA

许多数字人文课程十分注重小组项目实践,往届毕业生表示,这为他们步入职场打下了极好的基础。

学生们也认可数字人文跨学科特质带来的益处。今年春季从 UCLA 毕业、辅修数字人文的 Kylie Bach 表示,这些所学的见解,助力她在摩根大通的市场营销岗位上开展工作。

“步入职场时,既掌握各类技术工具,又拥有人文与历史的学术底蕴,这一点非常重要。” 她说,“很多企业岗位看重各类技术与 AI 工具,但人们常常会忽略技术背后的人文影响,忘记我们可以借助工具解决人类社会的问题。数字人文带给了我更宏大的思考视角。”

Bach 还提到,数字人文课程很大一部分作业是小组项目,这份经历对于进入各行各业的毕业生都十分受用。

为学生搭建清晰的成长路径

项目科学家兼讲师 Wendy Perla Kurtz 主讲该项目 120 人规模的导论课及其他课程。她表示,数字人文课程面向全体学生开放,无论学生的主攻方向是技术、计算机科学,还是人文社科。

“这会为学生搭建一条清晰的成长路径,尤其适合那些本身技术基础不算扎实的同学,帮助他们把这些工具融入自己的学习与研究。” 她说,“同时也能给技术背景较强的学生带来全新视角,跳出固有舒适区。他们会接触不规整的数据,思考如何处理数据缺失、如何解读数据的构建逻辑。而在较为传统的课程中,学生往往很少会被要求这样思考和处理问题。”

Kurtz 表示,最终目标,是把 UCLA 的学生培养成能够审慎思考的当代及未来技术构建者。

“我们培养学生,不只是让他们合乎伦理地使用技术,更是要让他们步入职场后,批判性地去塑造技术。” 她说,“学生要去思考:是谁在搭建这些系统?技术承载了哪些立场?技术服务于谁?我们越是让学生树立起审视新技术对真实人群造成影响的意识,就越能够推动未来诞生更多合乎伦理的技术体系。”

引起招聘方注意

和 Bach 一样,辅修数字人文的往届毕业生表示,这段学习经历不仅对毕业后的职业发展大有裨益,部分情况下还能吸引招聘方的注意。

“我所有的求职面试,无论是微软、谷歌还是其他公司,面试官并不太关注我的计算机科学学位,反而看到我的数字人文辅修,会十分好奇:‘哇,这是什么?’”2022 届毕业生 Kedaar Sridhar 说道。他目前是哈佛大学人工智能研究员,同时也是 Grantlytics 平台联合创始人,该平台帮助寻求资助的机构匹配资助方与资助机会。

“申请我所感兴趣的这类岗位的人,都是计算机专业出身。” 他补充道,“招聘人员或招聘经理看到我辅修数字人文时,总会主动询问,这也就成了我自我介绍的一部分。”

David Esquivel/UCLA

数字人文系项目科学家、讲师 Wendy Perla Kurtz,引导学生探究数据与信息如何被构建、解读与运用。

Sridhar 表示,他会向潜在雇主说明,辅修课程教会他如何向不同利益相关方阐释技术概念、高效呈现数据,以及如何把研究成果融入产品开发流程。“面试官常会回应:‘这太贴合实际工作了,我们日常就是做这些事。’”

2023 届毕业生 Cynthia Gong,从事房地产私募股权投资,这份工作并非传统技术岗位,但数字人文的学习经历给她带来了意料之外的收获。举例来说,她在 UCLA 的一门课程学到面向残障用户的数据可视化技巧。当她得知一位上级存在色觉障碍,无法分辨演示文稿里的红色与绿色时,她便运用所学,采用对色觉障碍人群友好的配色方案。解决了问题。

“另外,在我的工作,乃至整个金融行业,我们需要处理海量数据。数字人文课程反复强调:数据从哪里来、由谁提供、存在哪些缺失,还要意识到数据可能存在偏差与偏见。” 她说,“这些理念在工作中不断浮现,我也会持续考量我们所用数据的有效性与质量。”

结语

以上种种经历,再加上丰富多元的课程、教师开创性的研究,都印证了一个观点:人文学科与技术不能相互割裂。

“数字人文系正式建制,反映出社会越来越认同:这两大领域应当放在一起研究。”Kurtz 说,“重塑世界的各类技术,同样在塑造我们的文化、历史,以及我们创造、传播知识的方式。学生需要兼具批判思维与技术功底,审慎地面对这些技术,并参与塑造未来。”

- End -

以上内容来自官方网站:https://newsroom.ucla.edu/releases/ucla-launches-first-digital-humanities-department-in-nation

更多详情请进官网查询

编译|洪冰凤

校对|魏翔

排版|周柃妍

阅读原文

跳转微信打开

  •  

学术前沿丨Nature人文社科类子刊《Humanities & Social Sciences Communications》论文荐读

2026-08-28 08:30 福建

Humanities & Social Sciences Communications(《人文社会科学通讯》)是Nature旗下唯一面向人文社会科学的期刊,致力于出版人文科学、行为科学和社会科学领域的高水平研究,并特别鼓励跨学科研究以及能回应新兴议题、重大社会挑战的研究。该刊同时被SSCI与A&HCI收录,2025年影响因子约为4.8,其期刊引用指数JCI在人文学科‑跨学科领域位列第1/408,是人文社科领域颇具影响力的期刊之一。本期内容将选取Humanities & Social Sciences Communications中的10篇论文进行介绍。

1. 绘制过去:地理空间分析作为《密释纳》与《托塞夫塔》的研究工具

Mapping the past: geospatial analysis as a tool for the study of the Mishnah and Tosefta

Avraham Yoskovich, Eyal Ben‑Eliyahu & Royi Zidon

摘要:公元2—3世纪的近东罗马帝国晚期,诞生了两部奠定犹太律法传统基石的核心文本——《密释纳》(Mishnah)与《托塞夫塔》(Tosefta)。这些正典著作系统编纂了整套拉比律法体系,将内容庞杂的律法论述按主题划分为六大卷(Sedarim)。这种结构化的编纂方式保存了犹太律法思想,也搭建了后世犹太律法讨论的文本框架。数百年来学界持续争论两部文本复杂的文学关系与成书过程。本文创新性使用统计、地理空间分析,挖掘文本内嵌的地名地理数据,推断文本及其各部分的地理背景,为成书的时间、地点提供线索。该方法可以实现文本的“现实处境 (Sitz im Leben)”分析,帮助理解两部文本内在空间意识,以及和更广泛区域历史的联系。数据分析表明:《托塞夫塔》成书时期,加利利与边缘地区犹太定居更加发达;而《密释纳》呈现相对有限的“加利利印记”。《密释纳》编纂于3世纪初,此时犹太知识中心已经不再完全局限于犹地亚高地;该空间特征的成因,可能来自成书时间差异,或是编纂者的编辑取舍。本研究方法可以迁移到其他古代、现代数据集,为各类历史语境提供地理空间统计分析框架。

Abstract: During the late Roman period in the Near East (2nd‑3rd centuries CE), two foundational Jewish texts emerged that would become cornerstones of Jewish legal tradition: the Mishnah and the Tosefta. These canonical works systematically codify the entire corpus of Rabbinic law, organizing their comprehensive legal discussions into thematic “Sedarim”. Their structured compilation preserved Jewish legal thought and established the textual framework that would shape Jewish legal discourse for generations to come. The complex relationship between these two texts and their literary development has been a subject of scholarly debate for hundreds of years. Our innovative study breaks new ground by applying statistical and quantitative analytical methods to examine geographic data embedded in Rabbinic literature in order to ascertain the geographic context of the particular texts and their component parts and perhaps to shed light on where and when the Mishnah and Tosefta were compiled. This methodological approach not only enables a ‘Sitz im Leben’ analysis of these works but also contributes to understanding the spatial consciousness underlying both texts and their connection to broader regional history. Our analysis of the data suggests that while the Tosefta was redacted at a time when Jewish settlement in Galilee and peripheral areas was more developed, the Mishnah reflects a more modest “Galilean fingerprint”. Given that the Mishnah was progressively assembled at the beginning of the third century CE, a generation or two after the Judean highlands had ceased to be the exclusive center of Jewish intellectual activity. We propose that this unanticipated reflection of the Mishnah spatial focus may be explained by the relative timing or by editorial preferences of the Mishnah compilers. The method used here can be applied to other fields and to both ancient and modern datasets. It offers a framework for applying geospatial statistics across a variety of historical contexts.

图 1:雷达图。(a) 原始地名计数,《托塞夫塔》对比《密释纳》;(b) 标准化地名计数;(c) 两部文本共同出现地点占比;(d) 独有地名数量;(e) 标准化独有地名;(f) 地理散布范围。

Figure 1. Radar charts. (a) Number of locations in the Tosefta vs. Mishnah; (b) Normalized locations; (c) Percentage of common locations appearing in both works; (d) Unique locations count; (e) Unique locations normalized; (f) Geographic spread.

图2:分六个卷册的地名分布 KDE 图,上排密释纳,下排托塞夫塔。

Figure 2 Mishnah (upper row) and Tosefta (bottom row) maps of settlements’ distribution (unique place names), divided by Sedarim.

2.当身体被移动:隐形控制下的游戏性

When the body is moved: playfulness under invisible control

Rakesh Patibanda, Elise van den Hoven & Florian ‘Floyd’ Mueller

摘要:传统游戏理论假设参与者保留对自身行动与身体运动的能动性。本文研究隐形控制(invisible control)现象:身体动作由计算系统驱动,并非出于使用者明确的主观意图。本文基于一项针对电肌肉刺激(EMS)交互的实地质性研究,证明即便身体控制权有所削弱,游戏感依然能够产生并维持。受试者并非依靠完整的运动自主权获得游戏感,而是通过意义模糊性、预期感,以及在“自主行动”与“旁观自身身体”之间来回切换来体验游戏感。

上述研究结论拓展了现有关于游戏感的理论阐释:当控制权的削弱是出于自愿、且具备伦理约束时,它可以成为一种创作资源,而非局限。我们认为,面向隐性控制的设计,需要关注游戏感如何在身体控制权重新分配、意义模糊性与自我旁观的过程中生成,同时必须保障用户的知情同意、安全性以及退出交互的能力。本研究最终对“游戏感依赖于自主身体控制”这一预设提出质疑,为理解亲密型人‑机交互中如何产生游戏体验开辟了新的研究路径。

Abstract: Play is commonly understood as voluntary and closely tied to bodily autonomy. This paper shows that human augmentation technologies can complicate this assumption by introducing the phenomenon of invisible control, where bodily actions are directed by a computational system without explicit user intent. Through an in‑the‑wild qualitative study of an EMS‑based interaction, we demonstrate that playfulness can emerge and be sustained even under diminished bodily control. Participants experienced playfulness through ambiguity, anticipation, and oscillation between acting and spectating their own bodies, rather than through full motor autonomy. These findings extend existing accounts of playfulness by showing how diminished control, when entered voluntarily and ethically framed, can become a resource rather than a limitation. We argue that designing for invisible control requires attending to how playfulness emerges through redistributed bodily control, ambiguity, and spectatorship, while ensuring that consent, safety, and the capacity to disengage are preserved. Ultimately, this work challenges the assumption that playfulness depends on voluntary bodily control, and opens new ways of understanding how playful experiences can emerge in intimate human‑technology interactions.

图 3:EMS 驱动手势、电极颜色,对应三款游戏含义。每个手势对应特定肌群与 EMS 通道,分别代表 Godai 游戏元素、Eptá 游戏数字数值、Ídio 游戏符号动作。

Figure 3. Mapping of EMS‑actuated hand gestures, electrode colours, and their corresponding meanings across the three games. Each gesture is linked to a specific muscle group and EMS channel, representing elements in Godai, numerical values in Eptá, and symbolic actions in Ídio.

图 4:Godai 游戏三轮对局。

Figure 4. Three rounds of the Godai game.

图 5:交互流程图,包含入门引导、游戏进行、结束退出三个阶段。

Figure 5. The interaction flow diagram illustrating the onboarding, gameplay, and offboarding phases.

3. ArchiveGPT:面向图像编目的视觉语言模型以人为中心的评估

ArchiveGPT: A human‑centered evaluation of using a vision language model for image cataloguing

Line Abele, Gerrit Anders, Tolgahan Aydın, Jürgen Buder, Helen Fischer, Dominik Kimmel, Markus Huff

摘要:摄影藏品规模快速增长,人工编目已经难以应对,催生使用视觉语言模型(VLM)自动生成元数据。本研究探究AI生成的编目描述能否接近人类撰写的质量,以及生成式AI如何融入档案馆、博物馆藏品编目工作流。研究使用VLM模型InternVL2为带有标签纸板装裱的考古照片生成编目描述;经过人在回路的筛选整理后,由档案、考古领域专家(含学生与从业者)与非专家受试者,基于以人为中心的实验框架开展评估。受试者需要区分描述是AI生成还是专家撰写,对质量打分,并报告AI工具的使用意愿与信任水平。受试者整体区分准确率高于随机猜测,但两组均低估自身识别AI文本的能力。OCR错误与模型幻觉拉低描述感知质量;准确度、有用性评分越高的AI描述,越难以被识别为AI产物。结果表明,即便经过人工筛选,开箱即用的模型输出仍需要额外人工复核,才能保障考古编目这类专业领域的准确度与质量。专家群体对采纳AI工具的意愿更低,他们更关注保存责任,而非单纯技术性能。本研究支持协作式工作模式:AI负责生成初稿,人类审核居于主导地位,保障编目产出契合馆藏保管价值观(来源溯源、透明性)。这一模式能否成功落地,既依赖领域微调等技术进步,也需要在从业者群体中建立信任;透明、可解释的AI流水线有助于实现上述目标。

Abstract: The accelerating growth of photographic collections has outpaced manual cataloguing, motivating the use of vision language models (VLMs) to automate metadata generation. This study examines whether AI‑generated catalogue descriptions can approximate human‑written quality and how generative AI might integrate into cataloguing workflows in archival and museum collections. A VLM (InternVL2) generated catalogue descriptions for photographic prints on labelled cardboard mounts with archaeological content. After a human‑in‑the‑loop curation process, they were evaluated by archive and archaeology experts (consisting of students and professionals) and non‑experts in a human‑centred, experimental framework. Participants classified descriptions as AI‑generated or expert‑written, rated quality, and reported willingness to use and trust in AI tools. Classification performance was above chance level, with both groups underestimating their ability to detect AI‑generated descriptions. OCR errors and hallucinations limited perceived quality, yet descriptions rated higher in accuracy and usefulness were harder to classify. This suggests that even further human review is necessary to ensure the accuracy and quality of the catalogue descriptions generated by the out‑of‑the‑box model and selected by humans, particularly in specialized domains like archaeological cataloguing. Experts showed lower willingness to adopt AI tools, emphasizing concerns on preservation responsibility over technical performance. These findings advocate for a collaborative approach where AI supports draft generation but remains subordinate to human verification, ensuring alignment with curatorial values (e.g., provenance, transparency). The successful integration of this approach depends on technical advancements, such as domain‑specific fine‑tuning, and on establishing trust among professionals. Both could be fostered through a transparent and explainable AI pipeline.

图 6 实验材料生成流程,展示素材如何用于正式实验。

Figure 6. Materials and experiment. Creation procedure of the experimental material and how it was integrated in the experiment.

图 7 实验整体设置,实验共分为三个阶段。

Figure 7. Experimental setup. The experiment consisted of three phases.

4. 中国古典诗歌山水意象当代转译新路径 —— 基于竹枝词深度学习自动识别模型

Innovative pathways for contemporary expression of landscape imagery in classical Chinese poetry: a deep learning‑based automatic recognition model for Zhuzhici

Siqi Gao, Xiwei Xu, Puaypeng Ho, Zijian Zhang & Ruier Chen

摘要:中国古典诗歌是解析历史景观特征、理解中国古代审美观念的重要基础。从诗歌中有效提取山水意象信息,是引导诗意氛围空间营造的前提与关键步骤。本文以江南地区竹枝词为研究对象,针对中国古典诗歌的文化特殊性与语言非标准化特征,引入深度学习技术构建山水意象自动识别模型。实验结果表明,本文所构建的 DA‑SikuRoBERTa‑BiLSTM‑CRF 模型精确率 87.87%、召回率 83.05%、F1 值 85.39%,显著提升各类山水意象要素识别精度,包括单字形式意象、地理专名、隐含情感内涵与行为活动类意象。此外,本研究还探讨了该模型的潜在应用路径,包括历史景观资源的数字化盘点与深度挖掘、地方性山水意象知识库的精细化构建,以及跨模态场景信息的快速协同复现。上述研究拓展了山水意象理论向空间规划实践转化的路径,为诗意栖居环境的营造提供支撑。

Abstract: Classical Chinese poetry provides a critical basis for revealing historical landscape characteristics and for understanding aesthetic concepts in premodern China. Effectively extracting landscape imagery information from poetry is therefore a prerequisite and key step for guiding the spatial construction of poetic ambience. This study focuses on Zhuzhici (bamboo‑branch poems), which is related to the Jiangnan region, and introduces deep learning techniques to develop an automated landscape imagery recognition model tailored to the cultural specificity and linguistic nonstandardness of classical Chinese poetry. The results indicate that the proposed DASikuRoBERTa‑BiLSTM‑CRF model achieves a precision of 87.87%, a recall of 83.05%, and an F1 score of 85.39%, significantly improving the recognition accuracy of landscape imagery elements, including those expressed in single‑character forms, functioning as geographically specific proper names, and embedded with implicit emotional connotations or behavioural activities. Furthermore, this study explores potential application pathways of the model for the digital inventory and in‑depth mining of historical landscape resources, the refined construction of a place‑based landscape imagery knowledge base, and the rapid collaborative reconstruction of cross‑modal scene information. These efforts broaden the avenues through which landscape‑imagery theories can be translated into spatial planning practices, thereby supporting the creation of poetic dwelling environments.

图 8 研究框架。展示本研究主要模块与相互关系。

Figure 8. Research framework. This framework outlines the key components and relationships involved in the study.

图 9 真娘墓历史场景想象复现图;基于识别得到的山水意象要素作为提示词,使用 Stable Diffusion 文生图生成。

Figure 9. Reconstructed imaginative depiction of the historical scene of Zhenniang’s Tomb. Text‑to‑image generation using Stable Diffusion, with text prompts derived from recognized landscape imagery elements.

5. 基于大规模图像分析的先秦青铜鼎形制演化新视角

New perspectives on the morphological evolution of bronze Ding in pre‑Qin China through large‑scale images analysis

Tong Wei, YouDuo Xu, Xiaoyong Yang, Shuwen Gu & Kai Lin

摘要:青铜鼎作为先秦(公元前 1600‑221 年)礼制体系的核心物质载体,其形制演化长期缺少清晰阐释,传统研究范式难以系统揭示时空演变规律与背后驱动因素。本文创新提出 OE2S(本体工程与语义分割)方法,融合本体工程与图像语义分割技术,对两部出版物来源的2716张青铜鼎图像完成特征提取与向量化。研究将形制演化划分为32个演化组;其中鼎的颈部变化最为频繁,其次为腹部、底部、器足、器盖。识别出两大演化高峰:商末至西周早期(公元前1200‑1000 年)、春秋早期(公元前770‑476 年)。青铜鼎形制类型存续时长与其传播范围呈显著正相关,河南、陕西为主要传播中心。借助AI定量分析,本研究为数字时代考古学提供互补研究路径,提供可拓展的技术范式,揭示形制演变与社会政治变迁之间潜在关联。

Abstract: The bronze Ding, as the core material carrier of the ritual system in the pre‑Qin period (1600‑221 BCE), has long lacked a clear explanation of its morphological evolution. Traditional research paradigms face limitations in systematically revealing spatiotemporal evolution patterns and underlying driving factors. This paper introduces the innovative OE2S (Ontology Engineering and Semantic Segmentation) method, integrating ontology engineering and image semantic segmentation techniques, to extract characteristics and vectorize 2,716 images of bronze Dings that were obtained from two publications. Our study categorizes the morphological evolution into 32 evolutionary group. During this process, the neck underwent the most frequent changes, followed by changes in the belly, bottom, legs, and lid. Two key evolutionary peaks were identified: the late Shang to early Western Zhou period (1200‑1000 BCE) and the early Spring and Autumn period (770‑476 BCE). A significant positive correlation was observed between the duration of a morphological type and its spread, with Henan province and Shaanxi province emerging as major dissemination centers. By incorporating AI‑driven quantitative analysis, this research presents a complementary approach to archaeological studies in the digital age, offers a scalable technological paradigm, and illuminates the potential correlations between morphological evolution and socio‑political changes.

图 10 OE2S 方法工作流程图。

Figure 10. Workflow of the OE2S methodology.

图 11 G21 演化组时空分布图。

Figure 11. Spatiotemporal distribution of evolutionary group G21.

6. 迷失于算法翻译?儿童文学经典《柳林风声》人工翻译与机器翻译情感差异的定量分析

Lost in algorithmic translation? A quantitative analysis of sentimental differences between human and machine translation of the children’s literature classic The Wind in the Willows

Yuhao Liang & Xiao Zhang

摘要:本研究对比英文原著与四版中文译本(两版人工译本、两版神经机器译本),考察肯尼斯・格雷厄姆《柳林风声》的情感可译性。研究整合NRC情感词典与大连理工大学中文情感词典(DUTIR),构建极性、强度、密度、复杂度四项核心指标,提出情感保真指数(SFI),量化译本对源文本情感结构的保留程度。结果表明不同翻译路径的情感保真度存在显著差异:人工翻译呈现两种不同策略,杨静远译本SFI得分最高,保留原著94%的情感复杂度,与各章节情感变化曲线高度契合;任溶溶译本采用情感放大策略,整体情感强度提升15%,但复杂度有所下降。两个机器译本均表现出系统性弱化效应,情感复杂度平均损失24%,倾向中和强烈情感表达。研究识别出情感可译性层级:喜悦保留度最高,厌恶保留度最低。尽管机器翻译在句法准确度方面已取得长足进步,但在处理情感细微差异方面仍存在短板。本研究拓展了儿童文学翻译的方法论边界,为面向情感敏感文本的机器翻译优化提供理论依据与实证证据。

Abstract: This study examines the sentiment translatability of Kenneth Grahame's The Wind in the Willows through comparative analysis of the English original and four Chinese translations—two by human translators and two by neural machine translation systems. By integrating the NRC emotion lexicon with the DUTIR Chinese sentiment dictionary, we construct four core metrics (polarity, intensity, density and complexity) to develop the Sentiment Fidelity Index (SFI), which quantifies how faithfully translations preserve the source text's affective structure. Results reveal substantial differences in sentiment fidelity across translation approaches. Human translations demonstrate distinct strategies: Yang's version achieves the highest SFI, maintaining 94% of the original's emotional complexity and closely mirroring chapter‑level emotional arcs, while Ren's translation adopts an emotion‑amplifying strategy, increasing overall sentiment intensity by 15% but reducing complexity. Both machine‑translated versions exhibit systematic weakening effects, with 24% average loss in emotional complexity and tendency to neutralize strongly affective expressions. The analysis reveals a hierarchy of sentiment translatability, with joy showing the highest retention and disgust the lowest. While machine translation has advanced in syntactic accuracy, it continues to lag in conveying emotional nuance. This study broadens methodological scope in children's literature translation research while providing theoretical grounding and empirical evidence for improving machine translation of sentiment‑sensitive texts.

图 12:情感类型分布与可译性

Figure 12. Emotion Type Distribution and Translatability

7. 大规模测绘文化生态系统服务:基于短语特征的中国国家森林公园画像研究

Mapping cultural ecosystem services at scale: a phrase‑driven profiling of China’s national forest parks

Wenjie Liu, Jiaxuan Li, Yuanyi Yang, Huan Li, Jiadong Shen & Dengkai Huang

摘要:理解多维文化生态系统服务(CES)在异质性大尺度景观中的分异特征,对综合保护地治理至关重要,但受制于方法论瓶颈。本研究构建一套可复现、以短语为驱动的分析框架,对全国836处国家森林公园开展八大类文化生态系统服务评估。研究基于携程大规模游客在线评论数据集,使用众包构建的短语词库实现上下文感知文本匹配,计算公园层面正向、负向CES强度指标。多维画像的无监督聚类识别出6种公园类型。结果表明游客叙事大多聚焦单一CES类别,共现现象有限;CES强度空间分布极不均衡,长尾特征显著,少数公园占据绝大部分高价值表达;负面感知整体占比低,但可作为服务缺陷的关键诊断信号。研究证实CES存在结构化时空分异:不同服务类别呈现明显季节峰值,在不同气候带、区域间存在系统性差异;识别的公园类型表现出显著空间集聚特征。该框架将非结构化公众感知转化为可规模化证据链,为公园差异化定位、季节性管理策略、精细化治理提供实用工具,推动在治理中将文化服务价值与生态目标统筹考量。

Abstract: Understanding how multidimensional cultural ecosystem services (CES) vary across large, heterogeneous landscapes is critical for integrated protected area governance but hindered by methodological constraints. This study develops a reproducible, phrase‑driven framework to assess eight CES categories across 836 National Forest Parks in China. Utilizing a large‑scale dataset of online visitor reviews from Ctrip, we employed a crowdsourced phrasal lexicon for context‑aware text matching and derived park‑level positive and negative CES intensity metrics. Unsupervised clustering of these multidimensional profiles revealed six distinct park typologies. Results demonstrate that visitor narratives are predominantly focused on single CES category, with co‑occurrence being limited. The spatial distribution of CES intensity is highly uneven, following a long‑tailed pattern where a small subset of parks accounts for most high‑value expressions. While negative perceptions are infrequent overall, they provide critical diagnostic signals for specific dissatisfactory services. Analysis confirms structured spatiotemporal differentiation, with clear seasonal peaks for different CES and systematic variation across climate zones and regions. The identified typologies exhibit significant spatial clustering. This framework translates unstructured public perception into a scalable evidence chain, offering a practical tool for supporting differentiated park positioning, seasonal management strategies, and refined governance that explicitly incorporates cultural service values alongside ecological objectives.

图 13:本研究整体分析框架

Fig. 13. Framework of this study.

8. 从汉字看水体认知:时空动态及其环境启示

Water‑body cognition through Chinese characters: spatiotemporal dynamics and environmental implications

Shuya Yang, Meihua Shuai, Guangliang Xie, Na Li & Wen Xiao

摘要:探究环境词汇的长期演化模式及其地理分布机制,能够深刻揭示在自然与社会变迁下人类环境认知如何被维系或重塑,也是当前生态语言学领域的重大难题。汉字作为世界沿用时间最长的书写系统,为考察环境词汇的时空演变提供独特材料。水是人类生存、生产与聚落形成的核心自然条件,在农耕文明中,水体也是最早被持续认知和命名的环境对象。基于此,本研究采集我国最早辞书与收字规模最大的现代辞书中全部水体汉字,结合地名数据,系统探究汉语水体汉字的时空演化特征与塑造因素。研究假设:从古至今,人类对水环境认知逐步丰富,水体汉字数量随之增长;地理层面,水环境丰裕地区人类认知更加丰富,体现为水体汉字多样性更高。结果表明:1)两千年间水体汉字净增加1226个,反映人类不断利用、治理水资源,水体认知分类趋于细化;近40年水体汉字减少432个,该现象可能与现代语言标准化、地方词汇萎缩、传统水环境经验弱化有关。2)地理上,我国水体通名总体呈现东南丰富、西北稀疏的分布格局(U = 8.5000, p = 0.0002);该格局受区域水文自然条件约束,同时与历史聚落发展、人类活动密切相关。研究证明水体汉字演化是水文环境、文化传播、社会制度三者共同作用的结果。对比全球各语言自然词汇萎缩趋势,汉字系统展现的长期增长与连续性,为跨文化环境认知研究提供重要案例。本研究提供一套可复现的基于词汇系统追溯环境认知的方法框架,为理解长时段人‑水关系提供历史视角,也为气候变化背景下语言生态保护与可持续管理提供语言学新依据。

Abstract: Investigating the long‑term evolutionary patterns of environmental vocabulary and their mechanisms of geographical spatial distribution can profoundly reveal how human environmental cognition is maintained or reshaped amidst natural and social changes. This also represents a significant challenge in current ecolinguistic research. As the world’s longest continuously used writing system, Chinese characters provide unique materials for examining the spatiotemporal evolution of environmental vocabulary. Water, as the core natural condition for human survival, production, and settlement formation, was among the earliest environmental objects to be continuously recognized and named, particularly within agrarian civilizations. Based on this, this study collected all water‑body characters from China’s oldest dictionary and the modern dictionaries with the most extensive character collections, integrating them with toponymic data to systematically investigate the spatiotemporal evolution characteristics of Chinese water‑body characters and their shaping factors. We propose the hypothesis: from historical times to the contemporary era, human cognition of the water environment has gradually enriched, accompanied by an increase in water‑body characters; geographically, regions with abundant water environments also exhibit richer human cognition, reflected in higher diversity of water‑body characters. The results indicate: 1) Water‑body characters increased by 1,226 over the span of 2,000 years, reflecting the gradual development of more detailed cognitive classifications of water bodies as humans continuously engaged with, utilized, and managed water resources; over the past 40 years, water‑body characters decreased by 432, possibly related to modern language standardization, the contraction of local vocabulary, and the weakening of traditional water environment experience. 2) Geographically, the distribution of water‑body types in China generally exhibits a pattern of being more abundant in the southeast and sparser in the northwest (U=8.5000, p=0.0002). This pattern is constrained by regional hydrological natural conditions and is closely related to historical settlement development and human activities. The research demonstrates that the evolution of water‑body characters is the result of the interplay among hydrological environment, cultural transmission, and social systems. Compared to the global trend of contraction in natural vocabulary across languages, the characteristic of long‑term growth and continuity exhibited by the Chinese character system provides an important case for cross‑cultural environmental cognition research. This study offers a replicable methodological framework for tracing environmental cognition through lexical systems and provides historically‑grounded insights for understanding long‑term human‑water relationships, and also a new linguistic perspective for language ecological protection and sustainable management in the context of climate change.

图 14 综合讨论示意图;长时段(约2000年):水体汉字持续增长;短时段(约40年):出现结构性缩减;空间维度呈现东南高西北低格局,受自然水文、社会历史双重驱动。

Figure 14. Discussion schematic diagram. Over the long term (ca. 2,000 years), water‑body characters show a continuous increase, reflecting the historical accumulation of hydrological knowledge; over the short term (ca. 40 years), they decline, indicating a structural shift toward functional and management‑oriented language. Spatially, water‑body generic names exhibit a “high in the southeast, low in the northwest” pattern, shaped jointly by natural hydrological conditions and historical social processes.

9. 怀旧色彩就是黑白吗?Z 世代旅行图像怀旧色彩的实验研究

Are nostalgic colors black and white? An experimental study of nostalgic color in Generation Z’s travel imagery

Lin Liu, Yuqing Guo, Shizhu Lu, Qi Wu & Runtao Lin

摘要:在研究与实践中,怀旧旅行图像常常依赖黑白或低饱和度视觉范式。但Z世代成长于高度数字化、色彩丰富的媒介环境。由此引出关键问题:他们的怀旧反应是否还遵循传统视觉范式?抑或是熟悉旅行图像里的当代色彩线索可以更有效地唤起怀旧?大量研究证实色彩影响情绪与行为意向,但针对怀旧旅行图像,尤其面向Z世代群体的研究尚不充分。

本研究以33名Z世代受试者为样本,考察了旅行怀旧图像中色彩对心理的影响。研究采用 8(图像色彩)×4(图像主题)的重复测量实验设计,测量指标包括怀旧情绪、积极情绪、消极情绪与访问意愿。结果显示,图像色彩对四个结果变量均存在显著主效应且效应量大。和灰度图相比,原始彩色图像可以唤起更强的怀旧情绪、积极情绪、访问意愿,同时消极情绪更低。图像主题显著影响怀旧情绪、消极情绪、访问意愿,但不影响积极情绪。四项结果变量均呈现出显著的色彩-主题交互效应,表明色彩效应会随主题情境发生变化;不过,这一交互效应的结果仅作探索性解释。本研究挑战了怀旧图像等同于黑白的固有认知;证明原始彩色图像对Z世代同样是有效的怀旧线索;研究同时凸显了怀旧相关反应的情绪复杂性,将色彩心理学与怀旧研究的应用范畴拓展至数字旅游传播领域。实践层面,研究结果建议目的地营销人员应当使用贴合情境的原生色彩,而非统一使用单色怀旧图像。

Abstract: Nostalgic travel imagery has often relied on black‑and‑white or desaturated visual conventions in both research and practice. However, Generation Z has grown up in a highly digitalized and color‑rich media environment, raising an important question: do their nostalgic responses continue to conform to traditional visual conventions, or can they be more effectively elicited by contemporary color cues embedded in familiar travel imagery? Although extensive research has demonstrated that color influences emotional responses and behavioral intentions, its role in nostalgic travel imagery, particularly among Generation Z, remains insufficiently understood. To address this gap, the study examined the psychological effects of image color in nostalgic travel imagery among 33 Generation Z participants. An 8 (image color) × 4 (image theme) repeated‑measures experiment assessed nostalgic affect, positive and negative affect, and visit intention. Image color produced significant main effects with large effect sizes across all four outcomes. In particular, compared with the grayscale condition, the original color condition elicited greater nostalgic affect, positive affect, and visit intention, as well as lower negative affect. Image theme significantly influenced nostalgic affect, negative affect, and visit intention, but not positive affect. Significant color × theme interactions were also observed across the four outcomes, suggesting that color effects may vary across thematic contexts; however, these interaction patterns are interpreted as exploratory. These findings challenge the exclusive association of nostalgic imagery with black‑and‑white visual conventions and show that original color imagery can serve as an effective nostalgic cue for Generation Z. They also highlight the emotional complexity of nostalgia‑related responses and extend color psychology and nostalgia research into digital tourism communication. Practically, the findings suggest that destination marketers should consider original and contextually meaningful color treatments rather than relying uniformly on monochromatic nostalgic imagery.

图 15:八种色彩条件下,(A) 怀旧情绪量表,(B) 积极情绪量表,(C) 消极情绪量表,(D) 访问意向量表。误差棒为均值标准误。

Figure 15. (A) Nostalgic affect scale, (B) Positive Affect Schedule, (C) Negative Affect Schedule, (D) Visit Intention Scale across the eight color conditions. Error bars indicate the standard error of the means.

图 16:四类图像主题下,(A) 怀旧情绪量表,(B) 积极情绪量表,(C) 消极情绪量表,(D) 访问意向量表。误差棒为均值标准误。

Figure 16. (A) Nostalgic affect scale, (B) Positive Affect Schedule, (C) Negative Affect Schedule, (D) Visit Intention Scale across the four image themes. Error bars indicate the standard error of the means.

10. 基于个人言语特征的文本特征作为作者归属鉴定的证据

Idiolect‑based textual features as evidence for authorship attribution

Jianjun Shi & Jingyin Tian

摘要:作者归属鉴定通常被当作最大化分类准确率的任务,但仅靠高准确率,并不能证明模型捕捉到的是作者写作风格,而非主题、情节或者语义相似性。本研究回归作者归属鉴定的证据基础,采用一套基于个人言语(idiolect)、面向多语言的方法,以高频常用词/字符频次为核心。研究利用中、英、日三种文学语料库,检验这类高频特征能否跨语言表征作者习惯性写作风格。实验一开展不同作者单部作品的两两分类;实验二针对同一作者多部内容、体裁各不相同的作品开展归属识别。研究主要使用轻量多层人工神经网络作为分类器,同时对比其他传统机器学习模型。本研究提出的特征取得良好效果,跨语言平均最终测试准确率高于98%。SHAP分析表明,区分性证据集中在功能词、助词、代词、标点符号,而非内容主题类词汇。研究证实文体学研究对作者归属工作的价值:经过筛选、具备理论意义的文体特征,既能实现较高归属准确率,又可以降低对高复杂度、资源消耗型模型的依赖。因此,可靠的作者归属鉴定,核心并不在于模型的复杂度,而在于能否以可解释的方式表征作者的写作习惯。

Abstract: Authorship attribution is often treated as a problem of maximizing classification accuracy, yet high accuracy alone does not show whether a model has captured authorial style rather than topic, plot, or semantic similarity. This study returns to the evidentiary basis of attribution through a multilingual, idiolect‑based method centered on the frequencies of commonly used words and characters. Using Chinese, English, and Japanese literary corpora, we test whether these high‑frequency features can represent habitual writing style across languages. The first experiment evaluates pairwise classification among single works by different authors; the second tests attribution across multiple works by the same authors with varied content and genre. A lightweight multilayer artificial neural network is used as the main classifier, alongside simpler machine‑learning models. The proposed features achieve high performance, with average final‑test accuracy above 98% across languages. SHAP analysis shows that discriminative evidence is concentrated in function words, particles, pronouns, and punctuation rather than content‑specific vocabulary. These findings demonstrate the value of stylistic scholarship for authorship research: carefully selected, theoretically meaningful stylistic features can support high attribution accuracy while reducing dependence on technically demanding, resource‑intensive models. Reliable attribution therefore depends less on model complexity than on interpretable representations of authorial habit.

图 17:实验一完整流程

Figure 17. The process of Experiment I.

图 18:实验二完整流程

Figure 18. The process of Experiment II.

以上内容来自期刊官网

https://www.nature.com/palcomms/

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编译 | 周柃妍

校对 | 洪冰凤

排版 | 魏翔

阅读原文

跳转微信打开

  •  

新书推荐 | 《机器翻译与翻译理论》

2026-08-21 08:40 福建

机器翻译系统如今已无处不在,正以历史性的规模改变着跨语言、跨文化的交流与理解。

01

书籍简介

机器翻译系统如今已无处不在,正以历史性的规模改变着跨语言、跨文化的交流与理解。本书作者奥姆里·阿舍尔(Omri Asscher)聚焦于神经机器翻译工具(如谷歌翻译)与生成式人工智能工具(如 ChatGPT),探讨机器翻译与形形色色、往往相互抵牾的人工翻译理论体系之间的交汇地带。他揭示了二者交集中的种种微妙之处:机器翻译在哪些方面与多年来围绕人类翻译所形成的观念相互契合,又在哪些方面似乎对翻译理论提出了挑战,甚至可能要求我们重新审视其某些基本假设。

《机器翻译与翻译理论》(Machine Translation and Translation Theory)一书旨在为该领域提供通俗易懂、全景式的解读。书中就若干理论议题展开了详尽讨论:翻译的定义、翻译中的对等、翻译美学、翻译伦理、作为跨文化交际的翻译,以及翻译的历史能动性。本书适合翻译研究领域的科研人员与学生研读,同样也可供研究人工智能中介传播的学者,以及关注机器翻译架构如何与人文学科中的翻译理解相对应的计算机科学家阅读。

02

作者介绍

奥姆里·阿舍尔(Omri Asscher)现任以色列巴伊兰大学(Bar-Ilan University)人文学院翻译与口译研究系副教授。他的研究聚焦于人工智能与机器翻译在当代跨文化交流中所产生的实践、理论与伦理影响。此外,他也关注文学翻译与神学翻译在“故土—流散地”(尤其是犹太语境)框架中的作用,并在更广的意义上探讨翻译与文化史之间的互动关系。阿舍尔在特拉维夫大学(Tel Aviv University)取得博士学位,此后赴美国加州大学洛杉矶分校(University of California,Los Angeles)从事博士后研究,2018至2019年间任该校尤尼斯 索拉亚・纳扎里安以色列研究中心(Y&S Nazarian Center)博士后研究员。

在机器翻译与人工智能研究方面,阿舍尔主持了多个研究项目,包括“人类对人工智能中介传播的认知”(2021—2023),本书所依托的“机器翻译与翻译理论”项目(2024—2025),以及目前正在进行的“基于人文学科的人工智能研究:理论与实践意涵”(2025年起)等。相关论文发表于《翻译空间》(Translation Spaces)、《新媒体与社会》(New Media and Society)等期刊。他还曾担任“机器翻译的大众使用与认知”国际研讨会的项目委员会主席(2021),并受邀为欧洲信息与传播科学技术长期挑战协调研究计划(CHIST-ERA)的挑战征集专家组担任顾问(2021)。

在犹太文化与翻译政治领域,他的专著《阅读以色列,阅读美国:犹太人之间的翻译政治》(Reading Israel, Reading America: The Politics of Translation between Jews, 2020)由斯坦福大学出版社出版,收入“斯坦福犹太历史与文化研究”丛书。迄今,他已发表各类研究成果三十余项,并多次获得荣誉,包括2021年入选以色列科学基金会(ISF)人文与社会科学青年学者论坛,2024年获巴伊兰大学卓越教学奖,以及2015年赫赫特奖(Hecht Prize)等。他就相关议题的观点曾被《国土报》(Haaretz)、TheMarker 及美国广播公司(ABC News)等媒体报道。

03

出版信息

首次出版:2025年

电子书出版:2025年7月17日

出版地:伦敦

出版社:Routledge

DOI:https://doi.org/10.4324/9781003607977

ISBN:9781003607977

04

书籍目录

第一章 机器时代的人类观念:翻译作为关键

第二章 定义:划定领域的边界

第三章 对等:目标语取向的解围

第四章 美学:源文本日渐消退的阴影

第五章 伦理:走向显性的伦理能动性?

第六章 跨文化交流:非人类中介的意涵

第七章 超越理论,走向历史

05

章节简介

第一章 机器时代的人类观念:翻译作为关键

This introductory chapter presents the rationale and goals of the book, and elaborates on why the case of machine translation [MT] is powerfully paradigmatic, and can be revealing for researchers from different fields interested in the junction of artificial intelligence [AI] and the human sciences. It is argued that there are few AI language applications like MT that are, concurrently, so widely and intensively used across dozens of languages and cultures, so quintessentially human in the practice they imitate, and, additionally, centered on a (relatively) compact concept and practice that has given rise to a flourishing academic field. It then explains the core dimensions of translation, whose theorizing will be brought to engage with contemporary MT in this book, each in a separate chapter: definitions of translation; equivalence in translation; aesthetics of the translation form; ethics of translation; translation as cross-cultural communication; and translation in history.

本导论章阐述了全书的写作缘由与目标,并详细说明为何机器翻译(MT)这一案例具有强大的范式意义,能够为不同领域中关注人工智能(AI)与人文科学交汇点的研究者带来启示。作者提出,在人工智能的各类语言应用中,很少有像机器翻译这样同时具备以下三重特性的对象:它在数十种语言与文化中被广泛而密集地使用;它所模仿的实践在本质上是人类独有的活动;而且它围绕着一个(相对而言)边界清晰的概念与实践展开,并由此催生出一个蓬勃发展的学术领域。随后,本章阐明了翻译的若干核心维度。书中将针对这些维度逐一展开理论探讨,分别对应独立章节并与当代机器翻译现象相互对照,具体包括翻译的定义、翻译中的对等、翻译形式的美学、翻译伦理、作为跨文化交流的翻译,以及历史中的翻译。

第二章 定义:划定领域的边界

This chapter considers how definitions of translation that preceded the machine translation era, and were formulated with human translation in mind, correspond with MT. The chapter engages with two influential definitional strands in translation studies: a priori objectivist prescriptive definitions, and flexible descriptive definitions focused on the socially contingent reception of translations. The general compatibility of both definitional approaches with MT, notwithstanding some empirical and moral criticisms pertaining to the first approach, encourages us to conceive of MT as a full-fledged translational object of inquiry, fully at home in translation studies. Finally, the chapter suggests that shifts in the professional status of human translators may lead to new definitions, aimed at differentiating human from machine translation by focusing on the notion of (conscious) agency.

本章考察那些形成于机器翻译时代之前、以人类翻译为思考对象的翻译定义,与机器翻译之间的契合程度。本章探讨了翻译研究中两条颇具影响力的定义脉络:先验的、客观主义的规定性定义,以及着眼于翻译在社会情境中被接受方式的、灵活的描写性定义。尽管前一种路径面临着某些经验层面与道德层面的批评,但两种定义路径与机器翻译总体上的兼容性,促使我们将机器翻译视为一个名副其实的翻译研究对象,在翻译研究学科中完全站稳了脚跟。最后,本章提出,人类译者职业地位的变化可能催生新的定义,这些定义将以(有意识的)能动性概念为核心,力图区分人类翻译与机器翻译。

第三章 对等:目标语取向的解围

This chapter deals with one of the most enduring concepts in Western thought about translation: equivalence. It begins by discussing the incongruences between data-driven MT algorithms and major paradigms of equivalence in human translation, such as natural equivalence and poststructuralist approaches. The chapter then argues that the branch of Descriptive Translation Studies [DTS], with its probabilistic emphasis on the translation norms of the target culture, charts the theoretical approach that best corresponds to the features of equivalence in today’s MT mechanisms and assessment processes. The chapter addresses the commonalities and differences in this respect between the two major forms of contemporary MT, Neural Machine Translation and generative AI tools. Taking both applications into account, it is suggested that, as far as the basic concepts of translation and translation equivalence are concerned, the target-oriented descriptivist tradition, informed by Skopos sensitivities to the translation purpose, provides the most fitting theoretical tools to capture the inherent characteristics and worldview of today’s MT systems.

本章讨论西方翻译思想中最为经久不衰的概念之一:对等。本章首先论述数据驱动的机器翻译算法与人类翻译中若干主要对等范式(如自然对等论和后结构主义路径)之间的不相容之处。随后,本章提出,描写翻译研究(DTS)这一分支,凭借其对目标语文化翻译规范的概率性关注,勾勒出了与当今机器翻译机制及其评估过程中对等特征最为吻合的理论路径。本章还讨论了当代机器翻译的两大主要形态——神经机器翻译与生成式人工智能工具——在这一方面的共性与差异。综合考虑这两类应用后,作者认为:就翻译与翻译对等的基本概念而言,以目标语为取向的描写传统,辅以目的论(Skopos)对翻译目的的敏感性,提供了最为契合的理论工具,足以把握当今机器翻译系统的内在特征及其世界观。

第四章 美学:源文本日渐消退的阴影

This chapter inquires into the conceptualization of aesthetics in translation. It draws on the long-standing tradition of typologies of translation solutions, where the formal correspondence of the translation with the source text and language (or lack thereof) constitutes a major yardstick for evaluation of the translation style and form. The chapter then examines the features of contemporary MT to argue that the relevance of the form of the source text, and its structural shining through in the translation, as a benchmark, has a largely diminished role in the automatic translation process and evaluation metrics of MT. The historical shadow cast by the source text on translation aesthetics, it is concluded, has somewhat receded in the new landscape of today’s MT. Finally, it is suggested that the increasing use of generative AI systems for translation, allowing users’ functional goals to take center stage in stylistic decisions, has further widened the above-mentioned gap, while implying the growing relevance of function-oriented theories of translation aesthetics as a possible conceptual bridge for this gap.

本章探究翻译美学的概念化问题。本章借助翻译方法类型学这一由来已久的传统。在该传统中,译文与源文本及源语言在形式上是否对应,构成了评价译文风格与形式的一项主要标尺。随后,本章考察当代机器翻译的特征,进而论证:源文本的形式,及其结构在译文中的透显,作为一项评价基准,在机器翻译的自动翻译过程与评估指标中已在很大程度上被削弱。本章由此得出结论:源文本长期以来投射在翻译美学之上的历史阴影,在当今机器翻译的新格局中已有所消退。最后,本章提出,生成式人工智能系统在翻译中的使用日益增多,使用户的功能性目标在风格决策中占据了中心位置,这进一步拉大了上述差距;与此同时,这也意味着以功能为导向的翻译美学理论,作为弥合这一落差的可能概念桥梁,正变得愈发重要。

第五章 伦理:走向显性的伦理能动性?

This chapter presents the major traditions of ethical theorizing on human translation, in order to ask how it may or may not intersect with MT ethics. It is first noted that the potential relevance and applicability of ethical frameworks of human translation to MT requires extending our deontological subject beyond the individual translator to include the various stakeholders shaping, governing and regulating the MT field. Complementing this view by focusing on MT as an ethical agent in itself, the chapter then asks how the multiplicity of ethical frameworks of translation can pertain to the algorithmic decision-making of MT as an autonomous ethical agent. The chapter suggests the merits of compartmentalizing MT ethics from general AI ethics by shining a light on regional ethical frameworks of translation, which stem organically from the inherent features of translation, in contrast to frameworks that endorse more universal goals that relate to translation but are not unique to it. The chapter then applies the notion of explicit ethical agency to MT, and suggests the conceptual need of introducing a wider array of competing translation ethics, as well as the goals and situation-specificities of translation, to the decision-making criteria of today’s MT.

本章梳理人类翻译伦理思考的各大传统,以追问它们与机器翻译伦理可能存在或不存在何种交集。本章首先指出,若要让人类翻译的伦理框架对机器翻译具有潜在的相关性与适用性,就必须将我们的道义论主体范围从个体译者扩展开来,纳入塑造、治理与规制机器翻译领域的各类利益相关方。在此视角之外,本章进而聚焦机器翻译本身作为伦理主体的一面,追问翻译伦理框架的多元性如何能够适用于机器翻译作为自主伦理主体所做出的算法决策。本章提出,将机器翻译伦理与一般人工智能伦理区隔开来是有其价值的,为此应当凸显那些从翻译固有特征中有机生发出来的局部性翻译伦理框架,以区别于那些虽与翻译相关、却并非翻译所独有的、主张更普遍目标的框架。随后,本章将显性伦理能动性这一概念应用于机器翻译,并提出在概念层面上有必要将更多样化的、相互竞争的翻译伦理路径,连同翻译的目标与情境特殊性,引入当今机器翻译的决策标准之中。

第六章 跨文化交流:非人类中介的意涵

This chapter draws on the theorizing on human translation and cross-cultural communication, in order to ask how it may or may not pertain to today’s MT – in both interpersonal and international/global contexts. We start by considering how the translation’s distinguishing communicative features, with special emphasis on its presentation as a translation – and the ensuing awareness of the fact of mediation and of the identity of the mediator – deeply inform the communication act and the level of trust it involves. With this in mind, the chapter turns to MT to ask how the features and effects of trust take shape in interpersonal communications mediated by a machine. We then take a broader, bird’s-eye view of human translation as cross-cultural communication, and examine translation’s role in the simultaneous maintenance and erosion of symbolic boundaries between cultures. The chapter asks how this boundary work may pertain to MT’s sprawling impact as an enabler and catalyst of today’s global exchange. Finally, we consider how theoretical approaches to human translation-as-communication may serve our understanding of MT in future thought and research.

本章借助关于人类翻译与跨文化交流的理论探讨,追问这些理论在人际语境与国际/全球语境中,是否以及如何适用于当今的机器翻译。本章首先考察翻译在交流上的独特之处,重点关注译文的文本属性,以及受众由此产生的中介行为认知与中介主体身份认知。

这些要素深刻影响着交流行为的整体形态,也决定了交流过程的信任程度。在此基础上,本章转向机器翻译,追问在由机器中介的人际交流中,信任如何在人际交流中生成与演变。随后,本章从更宏观的鸟瞰视角审视作为跨文化交流的人类翻译,考察翻译在同时维护与侵蚀文化间象征边界方面所扮演的角色。本章追问,这种“边界工作”与机器翻译作为当今全球交流的促成者和催化剂所产生的广泛影响之间有何关联。最后,本章思考人类翻译作为交流的各种理论路径,如何能够服务于我们在未来思考与研究中对机器翻译的理解。

第七章 超越理论,走向历史

With a bird’s-eye view on the theoretical juncture between human and machine translation, our concluding chapter ties together the book’s various points of inquiry. It emphasizes the strong strain of target-orientedness that arises from today’s MT, and argues that this defining trait corresponds best with the major target-oriented frameworks of human translation, namely, Descriptive Translation Studies and purpose-based Skopos theories. The chapter then refers to the underlying commonality revealed between the prevalent discourses of translation and of the AI world, and concludes that in the current historical moment, for better or worse, AI has shown inklings of emancipation from its human source in a way that parallels the emancipation of LLM-based MT from the constraints of its source text. Finally, the chapter posits that a natural next step in exploring the intersection between MT and translation studies is to move beyond theory, and toward the writing of contemporary translation history. Along these lines, the closing section suggests contemplating MT as a historical agent. It proposes using a comparative historical perspective that juxtaposes MT phenomena with their human precedents in past contexts, as a way to inform our understanding of the socio-historical roles and implications of MT in our time.

结论章以鸟瞰的视角审视人类翻译与机器翻译之间的理论交汇点,将全书的各个探讨线索加以整合。本章强调当今机器翻译中呈现出的强烈的目标语取向倾向,且这一核心特质与人类翻译研究中的主流目标导向理论体系高度契合,主要涵盖描写翻译研究以及立足翻译目的的目的论两大理论。随后,本章论及翻译话语与人工智能领域话语之间所揭示出的深层共通之处,并得出结论:在当下这一历史时刻,无论利弊如何,人工智能已显露出从其人类源头中获得解放的端倪,这与基于大语言模型的机器翻译摆脱源文本约束的解放过程正相平行。最后,本章提出,探索机器翻译与翻译研究交叉领域的顺理成章的下一步,是超越理论,转向撰写当代翻译史。循此思路,结语部分建议将机器翻译视为一种历史行为主体加以思考,并主张采用比较历史的视角,将机器翻译现象与过往语境中的人类先例并置比较,以此深化我们对机器翻译在当今时代的社会历史角色与影响的理解。

06

章节选读

第一章 机器时代的人类观念:翻译作为关键

人类思想史始终受到新技术登场的影响。随着新技术的发展,人们也产生了思考事物的新方式,其中最明显的是对那些与这些技术发生互动的人类实践领域产生了新的思考。翻译也不例外。例如,新型书写媒介的发明,使人们以不同的方式思考翻译意味着什么,或者翻译可能涵盖什么。新的书写媒介,无论是泥板刻写还是印刷术的发明,不仅改变了翻译的实践方式,也改变了人们对翻译的界定与概念化方式。译文对源文本“负有什么义务”,应当如何评价其审美价值和伦理价值,本土语言是否能够成为一种正当的表达载体,等等。沿着类似的思路,在现代翻译研究学科中,理论家也思考过计算机辅助翻译工具的兴起意味着什么。这些工具能够记录以前译文的片段,并使这些片段可以随时方便地调取,因此它们促使人们重新思考典型的翻译“单位”究竟是什么,是词、句子、段落还是其他单位;理论家也讨论过云技术如何促使人们以更加协作、却也更加去人格化的方式重新想象翻译。

本书希望沿着这一传统继续前行。它所面对的,是一种很可能成为翻译漫长历史中最具颠覆性的技术。在正在兴起的人工智能(Artificial Intelligence),AI 革命的背景下,本书把机器翻译(Machine Translation,MT),MT 与翻译理论之间的交汇作为研究对象。也就是说,我们所面对的是一种常见的 AI 工具,以及围绕这种工具试图模仿的人类实践所形成的学术知识体系。我们的目标,是揭示二者交汇处的细微之处:MT 在哪些地方与多年来围绕人类翻译发展出来的思想高度契合,又在哪些地方似乎对翻译理论构成挑战,甚至可能要求我们重新思考其中的一些基本假设。

为了实现这一目标,我们自然需要深入研究翻译这一特定领域所特有的问题。然而,在本书开篇、尚未进入这些具体细节之前,不妨先将我们的讨论置于一个更宏大的目标框架之中。因为,当我们聚焦于一种能跨越语言再生产文本的AI工具,并考察它与人类翻译的概念化思考之间存在何种契合或冲突时,我们实际上也在做另一件事。可以说,我们正在参与一项更为普遍的努力,即把 AI 的新现实纳入人文科学描述和概念化世界的方式之中。因此,我们对翻译的关注,是人文学科更广泛地介入当代 AI 并对其作出理论回应的一部分。

这里显然有许多事情需要回应。即使我们还没有一个长期的历史视角,也已经很清楚,AI 必然会重新定义我们的社会生活和个人生活中的许多方面。在越来越多的国家,AI 已经改变了我们与知识互动的方式、从事科学研究的方式、消费文化的方式、交流的方式,甚至改变了我们经营情感生活的方式。诚然,产生现代计算机的那些基本数学原理早在二十世纪中叶之前就已经被阐明,而现代计算机后来又进一步通向信息时代和 AI 算法。然而,直到不久之前,AI 工具能够在人类最具人类特征的活动中模仿人类,这种可能性仍然被视为一种幻想。尽管如此,今天的机器已经可以写笑话、创作音乐和艺术作品、提供医学诊断、根据面部表情分析情绪、识别蛋白质功能中的模式、提出科学假说、运用说服性修辞、理解反讽,诸如此类,不胜枚举。随着政府、商业机构和学术机构投入巨额资源研究和开发 AI 技术,这份清单每天都在变得更长。当然,使 AI 如此具有革命性的,并不只是那些在理解和决策过程中依赖 AI 的机构、公司和政府,还有全世界数十亿同样依赖 AI 的个人用户。

在这一背景下,近年来的科学研究已经开始超越 AI 工具的技术开发,转而思考它们更深层的意义和影响。人文科学的学者正在深入研究 AI 系统的社会、哲学、文化和政治后果。他们考察算法如何影响我们的心理,AI 如何重新定义媒体和政治格局,AI 如何重塑人际伦理,AI 工具对视觉和语言创造力产生了什么影响,以及教育和评价过程如何重新调整,以应对生成式 AI 带来的挑战,等等。在这些大量涌现的新研究中,本书所归属的,是人文学科中一个颇为新兴且仍主要处于萌芽阶段的研究传统:考察那些现存的、以人为导向的理论概念,在 AI 现象出现的新时代中是否仍然具有适用性和有效性。换言之,面对如今智能机器的兴起,以及机器的产出、过程和内嵌的世界观,我们正在重新思考那些原本以人为对象、在我们的学术学科中发展起来的理论究竟是否适合,是否仍然具有相关性。

这一特定研究路径的基本动机,植根于我们这个时代发生的两个具有重大后果的转变,而这两个转变在很大程度上也与近年来后人类主义研究与实践中的敏感性和批判相呼应。此处有必要将它们明确点出。第一个转变是,人类与机器之间的界限,或者更准确地说,人类能力与机器能力之间的界限,已经变得越来越模糊,以至于人们并非总是能够区分二者。第二个转变是,机器的决策在本质上已经变得具有自主性和不透明性。这意味着,我们常常无法预测机器的输出,也难以充分理解其产生该输出的内部过程,因为构成其“思维”的各个部分并不是以符号方式表征的。人类行动者与非人类行动者的产出之间越来越模糊的区别,以及自主 AI 的发展,这两个趋势共同构成了本书的背景和催化因素。

鉴于这些结构性巨变,也鉴于人类对 AI 产出的消费和使用已经达到极其庞大的规模,人文科学中的理论已经不能再满足于仅解释和描述人类的活动。相反,我们应该重新检验这些理论,以评估它们面对机器的新成就时是否仍然有效。毕竟,学术理论从定义上说就是要具有一般性的;尝试进行概括既是理论存在的理由,也是理论的目标。事实上,无论是在人文学科还是精密科学中,大多数理论化活动背后的冲动,都是建立关于世界的、能够推广的一般性命题或理论构造。因此,随着非人类能动性,或者彼此交织的人类与非人类能动性,变得越来越显而易见,我们也开始有必要理解,那些来自人文科学、长期存在、根深蒂固并以人为对象的理论概括,是否能够解释 AI 现象,以及它们以何种方式解释这些现象。

在那些其能力似乎最能唤起人们对人类精神和心智联想的 AI 工具中,语言工具占据着首要地位。会跳舞的机器狗或许更加有趣,重新创造已经去世的流行歌手的声音或许更加轰动,但很少有什么技术能够像较为复杂的 AI 语言工具那样,如此集中地体现我们一直认为从根本上属于人类的东西,也就是那些直到不久以前我们仍然相信为人类所独有的东西。ChatGPT、Claude 和 Gemini 等领先的生成式 AI 聊天机器人系统,已经把 AI 语言工具带入主流公共领域和我们日常的个人生活之中,甚至有人认为,它们已经处在通用人工智能(Artificial General Intelligence,AGI)的边缘,正在获得可以与人类相比的一般认知和智力能力。尽管这一说法仍然存在争议,当代 AI 语言能力的深度和复杂程度却并不存在这样的争议。除其他事情之外,AI 技术可以撰写文章、整合一篇文本中的论点、改变写作的语气或语域、讲述故事、把语音转换成文字,以及完善某种修辞风格。

AI 工具还能够执行跨越语言和文化的翻译这一极其复杂而深刻的行为。翻译是一项复杂且具有多重面向的任务,其已知历史可以追溯到古代美索不达米亚最早的书写系统时代,而今天,AI 已经能够在越来越多的语言对之间完成这种任务,并处理复杂程度越来越高的情况。无论采取什么形式,自动化文本翻译都是本书的焦点。无论它是由 Google Translate 或 DeepL 等专门用于翻译的应用程序完成,还是由 ChatGPT 或 Claude 等多任务生成式 AI 工具完成;无论它服务于理解、交流,还是其他任何一种目的;无论它翻译的是高级诗歌还是技术规格;无论其自动化性质被掩盖起来,还是被明确声明出来,情况无论如何,只要它是由机器产生的,它就属于我们的研究兴趣范围。在不专门讨论这些不同方面的时候,本书将始终使用“机器翻译”这一总称,简称 MT,来指代它们。

MT 系统已经无处不在,并且在全球范围内极大地改变了不同语言和文化之间的交流和理解。仅 Google Translate 每年就负责处理三十万亿个句子,涉及一百多种语言,每天处理的词语超过一千五百亿;其直接结果是,当今产生的译文中,绝大部分已经不再由人类译者创造,据估计这一比例超过 99%。一种新的文化现实已经出现,这既体现在翻译数量和即时性方面,也体现在生产这些译文的行动者身份方面。最重要的是,正是在这一意义上,我们可以说当代标志着翻译史上一个新时代的到来,即机器翻译时代(Machine Translation Era)。

以上内容来自网站

https://www.taylorfrancis.com/books/mono/10.4324/9781003607977/machine-translation-translation-theory-omri-asscher、https://cris.biu.ac.il/en/persons/omri-asscher/

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编译|魏翔

校对|周柃妍

排版|洪冰凤

阅读原文

跳转微信打开

  •  

会议征稿 | HKADH 2027: Model/Making: Toward Generative Humanities——模型/造物:迈向生成式人文学科

2026-08-14 08:30 福建

模型概念一直处于数字人文的核心,其形式涵盖标准、统计、原型及实践。立足于此深厚传统,HKADH 2027 将进一步探讨数字、计算与分析框架如何如何成为文化生产的引擎。

会议主题

模型作为文化生产的方法、媒介与引擎

Models as Methods, Media, and Engines of Cultural Production

模型概念一直处于数字人文的核心,其形式涵盖标准、统计、原型及实践。立足于此深厚传统,HKADH 2027 将进一步探讨数字、计算与分析框架如何如何成为文化生产的引擎。

与既有分析实践并行,本次会议也将关注正在显现的新兴研究视野。以“模型/造物”为主题,会议旨在涵括模型与建模的生成性、艺术性及应用性维度,从而拓宽本学科之边界。

重要日期

摘要投稿截止:2026年9月1日

结果通知:2026年10月1日

会议时间:2027年1月21日至24日

主旨演讲嘉宾

Maria Antoniak

科罗拉多大学博尔德分校

(University of Colorado Boulder)

研究方向:自然语言处理、文化分析学、医疗健康、线上社群与计算人文。

Hilde De Weerdt

鲁汶大学(KU Leuven)

研究方向:中国史、早期现代全球史、信息史、东亚文献的数字研究方法。

Richard Tzong‑Han Tsai(蔡宗翰)

中央大学

(National Central University)

台湾大学

(National Taiwan University)

中央研究院(Academia Sinica)

研究方向:自然语言处理、人工智能与计算语言技术。

征文启事

会议欢迎围绕任何相关主题的投稿,并征集多种形式的投稿,包括创意作品、实操工作坊、海报展示、个人论文、专题小组及圆桌会议。

(1)重点关注领域

• 运用模型创作叙事、音乐、艺术与游戏;将数据建模作为艺术实践;算法作曲;以及程序性修辞;

• 数字模型与物质性,涵盖印刷、编织、机器人技术、VR/AR环境及叙事形式;

• 事件、动态与空间的模拟与展演;人文学科语境下的合成数据;

• 数据模型、语料库构建、元数据标准、语义学与本体论对档案、遗产及保护的影响与意义;

• 在文化产物生产中的人机协同,以及数字人文从业者与学术界内外其他领域人员的跨界合作;

• 审视模型生成能力的理论视角,包括技术哲学、媒介理论与基础设施研究;

• 作者身份、所有权与知识产权,以及数据、数据建模和AI的社会影响(包括数字人文语境下对生成式媒介的依赖或过度依赖);

• 人文学科课程中的计算建模与生成式媒介。

(2)投稿类型与要求

• 海报展示

适合展示研究尚在进行中的研究并获得即时反馈

要求:请提交750词的摘要。无需提交完整海报

• 个人论文

用于分享研究成果。报告时间为10分钟,随后进行10分钟讨论。

要求:请提交750词的摘要。无需提交全文

• 工作坊

涉及技术、软件工具与项目的实操演示与练习,时长为半天或全天

要求:请提交1000词的摘要,描述参与者的贡献及活动环节

• 圆桌会议

通过集体投稿就共同主题进行专家讨论。时长为60或90分钟

要求:请提交1000词的摘要,描述参与者的贡献及活动环节

• 专题小组

专题小组采取联合投稿形式,由多篇围绕共同主题的论文组成。时长为60或90分钟

要求:请提交1500词的摘要,包含各篇论文的描述及总体概述

• 创意作品

欢迎提交任何媒介形式的作品,只要其与模型、建模或数字人文相关

要求:请提交500词的摘要,并提供至少部分作品的访问途径(例如演示视频)

(3)投稿指南

• 摘要与会议论文集

会议前将为参会者准备《摘要汇编》。HKADH 2027将不出版正式会议论文集。

• 投稿说明

请于2026年9月1日前通过 Microsoft CMT 系统提交。在系统中输入投稿标题与摘要,并上传一份PDF文件(包含标题、摘要、投稿者姓名及所属机构)

• 投稿评审

投稿将根据以下四个维度进行评估,各占25%:原创性、质量、重要性、主题相关性

• 参考文献

摘要应将所提交的研究置于既有研究脉络中加以定位,并在末尾附上参考文献。参考文献不计入规定词数。

会议日程

完整日程将于后续公布。

(1)艺术展示单元

特邀艺术家:Hung Keung,香港教育大学(The Education University of Hong Kong)

    本艺术展示为大会配套活动,与文化参访同步举办。展示将呈现 Hung Keung 的作品,也可能展出部分大会征集并入选的创意作品。

(2)文化参访

记忆建模:数字遗产、城市变迁与香港九龙城

    本次文化参访旨在探究数字人文如何将现实空间转化为数字模型,再由数字模型生成全新的文化知识。参访以九龙城为核心,参与者将走访九龙寨城公园、历史市集片区等地点,体验基于摄影测量、三维扫描与沉浸式叙事技术搭建的数字复原成果。

    参访依托香港教育大学主导的“数字九龙”项目,探讨如何借助数字技术,对正在消逝的商铺、实物遗存与城市空间开展记录、复原与重新阐释。

组织机构

“模型/造物”是香港数字人文协会的第三届年会。

会议由香港教育大学以下单位组织举办并提供赞助:

• 香港教育大学 人文学院

• 香港教育大学 文化与创意艺术学系

• 香港教育大学 文学及文化研究学系

• 香港教育大学 语言学及现代语言系

• 香港教育大学 面向文化专业人士的数字人文文学硕士课程

以上会议征稿内容来自HKADH 2027官方网站:

https://2027.hkadh.org/

更多征稿详情请进官网查询,如需转载请后台私信联系

编译|洪冰凤

校对|魏翔

排版|周柃妍

阅读原文

跳转微信打开

  •  

会议征稿 | DHNB 2027:Human(ities) in the Loop——人(文)在回路

2026-08-07 08:30 福建

DHNB系列会议聚焦于北欧、波罗的海地区及其他区域数字人文跨学科领域的研究、教育与交流。该会议历来汇聚了众多对将数字方法应用于人文、社会科学及艺术研究感兴趣的学者、研究人员、学生及专业人士。

01

DHNB数字人文会议简介

DHNB系列会议聚焦于北欧、波罗的海地区及其他区域数字人文跨学科领域的研究、教育与交流。该会议历来汇聚了众多对将数字方法应用于人文、社会科学及艺术研究感兴趣的学者、研究人员、学生及专业人士。DHNB欢迎来自数字人文所有领域的投稿。

02

2027会议特设主题

DHNB2027会议及会前活动将于2027年3月1–5日在瑞典于默奥大学(Umeå University)举行。本届特设主题为“人(文)在回路”(Human(ities) in the Loop),该主题借鉴了人工智能领域中“人在回路”(human in the loop)的概念,强调人类在AI技术工作流程中的关键作用,但进一步将视野拓宽,使人文学科在理解历史及当代技术与社会系统方面的重要贡献得以更充分地彰显。

围绕这一主题,会议鼓励投稿者探索人文学科与社会科学所扮演的角色,并将其置于技术发展的中心位置。

(1) 可选议题包括但不限于

  • 对数字与人工智能技术开发、应用及使用的批判性与伦理反思

  • 数字化及数字化转型的社会、文化与环境可持续性视角

  • 跨学科和/或实验性研究,例如数字方法与计算路径

  • 涉及技术的艺术反思、探索与贡献

  • 生成式人工智能虚假信息与政治参与

  • 算法透明度与机器学习的“黑箱”问题

  • 数据资本主义、人类劳动、数字榨取主义与非殖民化视角

  • 人工智能、人类遗产与记忆

(2) 参会赛道

在研作品赛道

  • 本赛道面向希望展示在研项目、获取建设性意见以推进后续研究的学者。每个报告单元时长30分钟:报告人最多用15分钟介绍研究主题,明确说明希望重点获得反馈的方向;剩余最多15分钟用于讨论,讨论期间报告人可按需补充展示额外材料。

  • 本赛道将以小型分组形式开展,保障深入、平等且互助的学术交流,同时与大会整体议程顺畅衔接。

  • 本赛道投稿需提交500-1000字摘要,投稿时作者需在材料中清晰列明希望重点获取反馈的内容。

博士生论坛

  • DHNB 2027延续2025年首次设立的博士生论坛赛道,旨在为博士生提供展示在研课题、获得资深学者指导的平台,论坛将于会前活动期间举办。

  • 为鼓励青年研究者参会,DHNB将提供最多6份参会资助,用于补贴参会产生的合理差旅与住宿费用(最高500欧元)。申请者可在提交提案时同步申请资助。欢迎各位向同事、友人及学生转发本信息!

  • 本赛道投稿需提交500-1000字摘要。

工作坊与教程

  • 工作坊形式灵活多样,既可以是社群协作实践活动,也可以是附属于主会议的主题微型研讨会;报告内容可由主办方预先筛选,也可通过工作坊组织者单独发布的征稿征集。教程则面向数字人文研究者,介绍相关工具、技术或实操练习。

  • 工作坊与教程可申请半天(最长4小时)或全天(最长8小时)场次。投稿篇幅为1000-2000字,内容需包含:工作坊/教程的主题与理念介绍、选题学术价值、目标受众说明,以及预期成果详情。

  • 程序委员会将对工作坊与教程提案进行快速评审,确保主办方有充足时间开展后续工作,例如发布工作坊单独征稿等。

通用赛道

本赛道为会议传统核心赛道,接收长论文、短论文、海报与演示、专题论坛四类提案。各类提案的界定标准如下:

  • 长论文(Long papers):需呈现成熟的研究成果,包含明确的研究问题、理论框架、研究方法、结果与讨论部分。报告时长20分钟,后续10分钟为问答环节。投稿可提交1000-1500字摘要(不含参考文献),或8-16页全文(不含参考文献)。

  • 短论文(Short papers):可呈现阶段性研究成果或创新研究方法,但仍需充分说明研究问题、研究材料与研究方法,保障评审可评判性。报告时长15分钟,后续5分钟为问答环节。投稿可提交500-1000字摘要(不含参考文献),或4-8页全文(不含参考文献)。

  • 海报与演示(Posters and demos):海报可呈现独立的小型研究、在研成果,或是项目整体介绍;演示为工具、服务或技术的互动性展示。相关成果将在会议海报环节展示,展示前需进行1分钟闪电报告。投稿可提交250-500字摘要(不含参考文献),或2-4页全文(不含参考文献)。

  • 专题论坛(Panels):为自由形式提案,需预先组建主题统一的论坛单元,时长60-120分钟,纳入大会正式议程,通常由多篇独立报告与联合讨论环节组成。

通用赛道的所有投稿,无论成果形式与研究成熟度如何,均需明确说明其学术贡献。所有提案将采用单盲同行评审机制,即评审专家知晓作者及合作者的姓名与所属单位。根据评审意见,作者可能需在出版前对稿件进行修改。

(3) 基本信息

  • 摘要提交截止日期:2026年10月16日

  • 会议日期:2027年3月1–5日

  • 会议地点:瑞典,于默奥

(4) 投稿方式

所有提案必须于2026年10月16日前通过 ConfTool 会议管理系统以英文提交。提交链接将在后续提供。(请注意:即使您之前已有 ConfTool 账户,也需重新创建新用户。)

(5) 时间表

  • 2026年8月21日:征稿通道开放

  • 2026年10月16日:征稿截止

  • 2026年10月16日 – 2026年11月30日:投稿评审阶段

  • 2026年12月11日:发送评审结果通知

  • 2027年第2周:开放会议注册

  • 2027年2月8日:早鸟注册截止

  • 2027年2月11日:修订后全文及摘要提交截止

  • 2027年2月19日:注册通道关闭

  • 2027年3月1–2日:会前会议、工作坊、博士论坛

  • 2027年3月3–5日:主会议

  • 2027年5月14日:会后论文集全文提交截止

(6) 组织者与合作单位

03

DHNB简介

(1) 关于DHNB

北欧与波罗的海地区数字人文(Digital Humanities in the Nordic and Baltic Countries, DHNB)是一个致力于在人文学科、社会科学及艺术领域内,推动学术界与文化遗产机构间跨境数字学术合作的协会。DHNB在共同的区域社群中汇集了广泛的研究路径——从解释性与理论性工作,到计算分析与文化分析。

DHNB是一个覆盖面广泛的综合协作平台,不偏重某一种传统或学科,会员的研究方向覆盖完整的研究谱系,包括:

  • 对数字文化的解释性与批判性路径

  • 计算人文学与大规模数据分析

  • 文化分析及文化变迁的定量研究

  • 创意实践以及研究与艺术交叉领域的工作

(2) 核心活动

①年会:年会是北欧—波罗的海数字人文社群的主要聚会场所。会议采用分专题赛道的议程设置,各细分领域社群既可深耕自身的研究方法,也能参与共同的跨学科对话。

②灵活的出版模式:不同类型的工作适合不同的出版节奏,DHNB会议录可兼顾两种方式:

  • 会前会议录:面向已完成的成熟研究成果,经同行评审的论文在会议召开前正式出版。

  • 会后会议录:面向可通过会议交流打磨完善的研究,作者会前提交摘要,会后提交完整论文。

  • 两种出版路径均被视为数字人文领域的正式学术成果。

(3) 区域工作组:

DHNB的工作通过聚焦于北欧—波罗的海背景下数字人文特定方面的工作组全年持续进行,例如数字人文教育和GLAM(美术馆、图书馆、档案馆、博物馆)。

(4) 定位

DHNB是北欧—波罗的海地区数字人文的区域性基础设施,欢迎为之做出贡献的研究人员、图书馆员、博物馆工作者、档案工作者及艺术家加入。

(5) 历史

北欧国家数字人文(Digital Humanities in the Nordic countries,DHN)于2015年4月21日在奥斯陆成立。首届DHN会议于次年3月举行。在2020年10月22日召开的年度全体会议上,DHN成员批准将名称更改为“北欧与波罗的海地区数字人文”(Digital Humanities in the Nordic and Baltic countries,简称 DHNB)。

以上会议征稿内容来自DHNB官方网站:

https://dhnb.eu/conferences/dhnb2027/

更多征稿详情请进官网查询,如需转载请后台私信联系

编译|周柃妍

校对|洪冰凤

排版|魏翔

阅读原文

跳转微信打开

  •  

“大哉言数:AI时代人文研究的范式重构与价值回归”学术研讨会暨2026年中国数字人文年会(CDH2026) 会议通知

2026-07-31 08:30 中国香港

会议概况

当前,人工智能与大数据技术持续革新人文领域的知识生产逻辑,重塑传统人文研究的价值评判体系。数字脉络自古绵延不绝:上古先民观天测地、以度量衡丈量天地万象,沉淀出朴素的数理智慧;而今数据赋能催生数字人文全新赛道,数字化转型既为文史哲等传统人文学科搭建起革新性研究范式,也促使学界依托数字工具,重新思辨文明发展脉络、文化赓续路径与社会治理现代化等核心议题。

立足数字人文深度融合人工智能的时代语境,在中国索引学会指导下,中国索引学会数字人文专业委员会联合内蒙古师范大学科学技术史研究院,共同筹办2026年中国数字人文年会(CDH2026),本次大会主题定为“大哉言数:AI时代人文研究的范式重构与价值回归”。

作为中国数字人文领域年度规模最大、影响力最广的学术盛会,中国数字人文年会自2019年起已成功举办七届,为数字人文相关领域的专家、学者、学生以及从业人员搭建了重要的学术交流和成果展示平台,已成为积极推动人文学科研究范式革新、凝聚跨学科融合发展共识、孵化创新研究与实践成果、促进政产学研用协同发展的重要品牌,在国内外具有广泛影响力。

本次大会汇聚海内外业内知名专家学者,设置主旨报告、分会场研讨、专题圆桌、实践案例分享、数字人文成果展演、学术海报展等多元交流板块,搭建多层次、立体化的学术对话平台,旨在探讨人工智能浪潮下人文研究范式转型路径,坚守人文内核、回溯学科本真价值,携手为国内数字人文事业高质量发展汇聚思想、注入全新发展动能。

图片

01

日程安排

图片

图片

02

会议议程

图片

01

开幕式

图片

02

主旨报告(一)

图片

论坛一

典籍重光:科技古籍与多民族文

献的智慧化整理

召集人:

陈镱文 西北大学科学史高等研究院教授;

朱锁玲 南京农业大学人文与社会发展学院教授

图片

论坛二

时空重构:GIS与时空大数据驱动的

文明演进研究

召集人:

邓 君 吉林大学商学与管理学院教授;

何 捷 哈尔滨工业大学(深圳)建筑学院城乡规划系教授

图片

论坛三

协智重塑:多智能体与具身智能的人

文社会仿真

召集人: 

王玉珏 武汉大学文化遗产智能计算教育部哲学社会科学实验室副主任、信息管理学院教授

陈 涛 中山大学信息管理学院副教授

图片

论坛四

谱系重绘:知识图谱与智能注释驱动

的知识重组

召集人:

苏日娜 中山大学图书馆副研究馆员

李永卉 江苏大学法学院副教授

图片

论坛五

记忆重塑:AIGC赋能下的文化遗产与

艺术创新

召集人:

徐孝娟 安徽大学管理学院教授;

陈 静 南京大学艺术学院副教授

图片

论坛六

数字人文学科建设与发展论坛(一)

召集人:

王晓光 武汉大学信息管理学院院长、文化遗产智能计算教育部哲学社会科学实验室主任、教授,中国索引学会数字人文专委会主任;

那日苏 内蒙古师范大学科学技术史研究院党委书记、教授

图片

图片

论坛七

视界重创:AIGC视频生成与数字创意

实践

召集人:

范学成 内蒙古自治区数融民族文化产业研究院数字内容生产中心主任;

艾胜英 中国传媒大学教授、北京漫画学会副会长

图片

论坛八

文脉重析:计量方法与主题模型的文

本深度挖掘

召集人: 

李 惠 南京农业大学人文与社会发展学院副教授;

严承希 中国人民大学信息资源管理学院讲师

图片

论坛九

伦理重思:数字人文中的算法批判与

负责任创新

召集人:

王 蕾 中山大学数字人文实验室主任、图书馆副馆长、国家文化遗产与文化发展研究院副院长、研究馆员,中国索引学会常务理事;

王 琳 杭州电子科技大学中国科教评价研究院副院长、教授

图片

论坛十

数字人文学科建设与发展论坛(二)

召集人:

王晓光 武汉大学信息管理学院院长、文化遗产智能计算教育部哲学社会科学实验室主任、教授,中国索引学会数字人文专委会主任;

那日苏 内蒙古师范大学科学技术史研究院党委书记、教授

图片

论坛十一

视觉重释:图像处理与文化图像的

智能分析

召集人:

位 通 北京大学信息管理系助理教授、数字人文研究中心研究员;

周树斌 内蒙古师范大学科学技术史研究院科技遗产与数字人文研究所所长、校聘研究员

图片

论坛十二

素养重育:数字素养提升与跨学科人

才培养

召集人:

赵宇翔 南京大学信息管理学院教授;

宋士杰 河海大学商学院副教授

图片

论坛十三

学刊重议:期刊编辑视野下的数字

人文前沿对话

召集人:

桑 海 《数字人文》编辑部副主编;

张艺蕾 Knowledge Organization责任编辑

图片

03

主旨报告(二)

图片

04

闭幕式

图片

03

 青年学者工作坊

图片

为促进数字人文领域青年学者之间的交流合作,拓展跨学科研究视野与学术联系,本届年会特别设置“数字人文青年学者工作坊”。工作坊聚焦数智时代青年学者的学术成长,围绕研究方向凝练、跨学科研究实践、学术成果发表与学术共同体建设等议题,为青年学者搭建开放、务实、充分交流的学术平台。

本次工作坊将由内蒙古师范大学科学技术史研究院主办的SSCI期刊Knowledge Organization(KO)开展专题分享,重点介绍期刊定位与选题方向、跨学科知识组织研究的选题策略、投稿流程及常见问题,并通过圆桌讨论与互动答疑,交流论文写作、成果发表和学术合作中的实践经验,助力青年学者提升研究与发表能力。

时间:2026年8月1日19:30

地点:内蒙古师范大学学术交流中心信息楼3号会议室

04

数字那达慕

图片

为集中展现近年来中国数字人文领域的创新探索与实践成果,本届数字人文年会于中华民族共同体建设与边疆治理智能实验室特别设立“数字那达慕”数字人文研究项目类成果展示区。该展区秉承数字人文“打破学科堡垒、促进技术与人文学科深度对话”的核心理念,旨在通过多元展示形式推动学术思路的碰撞与融合。数字那达慕荟萃了本届年会征集入选的优秀海报与项目,并呈现各参会单元在数字人文方面的前言探索与创新实践。

展区集中呈现本届年会征集入选的优秀数字人文项目,通过成果海报、平台演示、实物展示、互动体验与现场讲解等形式,展示数字技术在人文学术研究、知识组织、历史记忆、文化遗产保护、文学计算与公共文化传播等领域的创新应用。参展成果涵盖专题数据库、基础语料库、知识图谱、智能研究平台、大模型与智能体、数字孪生、可视化作品、互动游戏及文化创意产品等多种形态,集中体现数字人文研究的跨学科活力与多元实践图景。

时间:2026年7月31日至8月3日

地点:内蒙古师范大学中华民族共同体建设与边疆治理智能实验室    

图片

图片

05

会议须知

图片

1

注册报道

参会代表请于2026年7月31日16:00-20:00在蓝洋林顿酒店一楼大厅办理注册报到。

7月31日未办理注册报到的参会代表,请于2026年8月1日8:00-9:00在会议开幕式会场(内蒙古师范大学赛罕校区逸夫楼报告厅)现场办理注册报到。

报到注册后领取会议证件和材料,凭证参会,请妥善保管。

2

住宿安排

(1)蓝洋林顿酒店

地址:呼和浩特市赛罕区鄂尔多斯大街中段(内蒙古师范大学赛罕校区南门西侧)

总台电话:0471-3253666,3153807

联系人:白阿木18604888923

(2)宾悦大酒店

地址:呼和浩特市赛罕区昭乌达路52号宾悦大酒店

联系人:娜布其13474839901

3

用餐安排

会议期间,参会人员凭餐券在规定时间段内于指定地点就餐。

其中早餐地点为各代表所入住酒店餐厅,午餐、晚餐地点见餐券指引。

4

会议地点

(1)会议开幕式及主旨报告

地点:内蒙古师范大学逸夫楼报告厅(进南门,右转,右手边的最里面的建筑)

(2)会议闭幕式及主旨报告

地点:内蒙古师范大学学术交流中心信息楼报告厅

图片

(3)分论坛

分会场一:学术交流中心信息楼2楼会议室

分会场二:学术交流中心信息楼1号会议室

分会场三:学术交流中心信息楼2号会议室

分会场四:学术交流中心信息楼3号会议室

分会场五:学术交流中心信息楼4号会议室

分会场六:学术交流中心信息楼报告厅

分会场七:学术交流中心信息楼5号会议室

分会场八:学术交流中心信息楼2楼会议室

分会场九:学术交流中心信息楼5号会议室

分会场十:学术交流中心信息楼4号会议室

分会场十一:学术交流中心信息楼3号会议室

分会场十二:学术交流中心信息楼2号会议室

分会场十三:学术交流中心信息楼1号会议室

(4)青年论坛

地点:内蒙古师范大学学术交流中心信息楼3号会议室

(5)数字那达慕

地点:内蒙古师范大学中华民族共同体建设与边疆治理智能实验室    

图片

图片

5

交通指引

本次会议不安排大巴,请参会人员自行前往会场。
(1)蓝洋林顿酒店至会场:步行10分钟。

图片

(2)宾悦大酒店至会场:步行10分钟。

图片

6

温馨提示

(一)会议期间,请各位代表妥善保管好会议证件,凭会议证件出入校园。

(二)会议餐券附在代表证后,请凭餐券在规定时间内于指定地点就餐。

(三)因参会代表较多,为维持良好会议秩序,请各位代表提前10分钟入场。

(四)会场内禁止大声喧哗,手机调至静音。

如您在会议期间有任何问题和需求,请与会务组联系。我们将竭诚为您服务,祝您工作顺利,身体健康!

06

会议联络

图片

图片

07

组织机构

图片

l 主办单位

中国索引学会

内蒙古师范大学

l 承办单位

中国索引学会数字人文专业委员会

内蒙古师范大学科学技术史研究院

内蒙古师范大学中华民族共同体建设与边疆治理智能实验室

内蒙古自治区科技文化遗产认知智能重点实验室

内蒙古师范大学蒙古学学院

l 协办单位(按笔画顺序排列)

IMR Press

上海大学数字人文研究与发展中心

上海外国语大学中国国际舆情研究中心

上海师范大学数字人文研究中心

上海财经大学“中文+数智经济”研究中心

上海财经大学国际文化交流学院

上海社会科学院信息研究所

上海图书馆历史人文大数据中心

山西数字人文研究院

天津师范大学大数据科学研究院

云南大学历史与档案学院“数字人文”工作室

云南省图书馆数字资源与信息技术部

中山大学信息管理学院

中山大学数字人文实验室

中山大学数字人文联合研究院

中国人民大学中华文明研究院

中国人民大学数字人文研究院

中国社会科学院大学数字史学研究中心

中国社会科学院文学研究所数字信息研究室、数字人文与计算批评实验室

内蒙古师范大学中华民族共同体建设智能实验室

东华大学纺织遗产与数字人文实验室

北京大学数字人文研究中心

北京师范大学文理学院中文系

北京师范大学珠海校区图书馆数字人文中心

电子科技大学数字文化与传媒研究中心

包头师范学院历史文化学院

兰州理工大学文学院

华中科技大学汉籍数字化实验室

华东师范大学数字文化发展协同创新中心

齐鲁工业大学(山东省科学院)数字人文研究中心

启元实验室战略研究中心

武汉大学文化遗产智能实验室

武汉大学数字人文研究中心

阜阳师范大学皖北文化传播安徽省哲学社会科学重点实验室

南京大学中华文明数智创新实验室

南京大学高研院数字人文创研中心

南京师范大学语言大数据与计算人文研究中心

南京师范大学数字与人文研究中心

南京农业大学数字人文研究中心

复旦大学大数据研究院人文社科数据研究所

首都师范大学初等教育学院

桂林师范学院特色馆藏文献资源开发与应用研究中心

清华大学中国古典文献研究中心

淮阴师范学院文学院

琼台师范学院文学院

湖北中医药大学医学人文学院

湖南女子学院文学与传播学院

新疆医科大学人文学院

l 媒体支持(按笔画顺序排列)

《中国索引》集刊

《中国数字人文》

《文献保护与传承》

《古籍数字人文》

《成都大学学报(社会科学版)》

《全国报刊索引》

《图书馆杂志》

《南通大学学报(社会科学版)》

《信息与管理研究》

《烟台大学学报(哲学社会科学版)》

《数字人文》

《数字人文研究》

「DH数字人文」公众号

「DH数字人文动态」公众号

「IMR 图书情报学」公众号

「SHNU 数字人文」公众号

「三明学院学报」公众号

「上图汇智」公众号

「山东大学」公众号

「广东省国学学会」公众号

「比特人文」公众号

「中国索引学会」公众号

「文化科技交叉研究实验室」公众号

「古代汉语信息处理」公众号

「立行数字人文」公众号

「全国报刊索引」公众号

「京狮人文DH」公众号

「空间人文与场所计算」公众号

「科技古籍整理研究所」公众号

「科学人文在线」公众号

「域外汉籍与汉学研究」公众号

「揆古察今科史哲」公众号

「数字人文」公众号

「数字人文开放实验室」公众号

「数字人文研究」公众号

「数字人文资讯」公众号

AI & Innovation (《人工智能与创新》)

Digital Studies in Language and Literature(《数字语言文学研究(英文)》)

Digital Transformation and Society

Knowledge Organization

上海师范大学数字人文网

上海社科院信息所社科智能实验室(AI4SS Lab)

广东财经大学《智能高教》

社科大数字史学实验室

南京大学中华文明数智创新实验室

编辑 | 冯晶

初审 | 周树斌

复审 | 王鑫义

终审 | 董杰

阅读原文

跳转微信打开

  •  

学术前沿丨《数字人文学刊 (DSH)》2026年第2期论文荐读

2026-07-25 10:09 福建

本期内容将选取《数字人文学刊》2026年第2期(Volume 41, Issue 2 June 2026)中的10篇论文进行介绍。

《数字人文学刊》(Digital Scholarship in the Humanities,简称DSH)是一本国际性的、同行评审的期刊,发表关于人文学科中所有数字学术方面的原创研究,包括但不限于当前被称为数字人文学科的领域。主要发表长篇与短篇论文、研究报告,内容涵盖理论、方法、实验与应用研究,兼及书评等。本期内容将选取《数字人文学刊》2026年第2期(Volume 41, Issue 2 June 2026)中的10篇论文进行介绍。

01

重构神话景观:运用 AIGC 技术

实现《山海经》视觉化

Reimagining mythological landscapes: leveraging AIGC to visualize the Classic of Mountains and Seas (Shan Hai Jing)

Ziyun Zhao , Jisung Song

摘要:本研究探讨 AIGC 技术的应用路径,以 ChatGPT-4 与 MidJourney 6.0 为核心工具,针对中国神话典籍《山海经》开展视觉图像的设计与生成研究。通过系统化的实验设计,本研究构建了 ChatGPT 与 MidJourney 之间的双向人机协作机制,形成了一套标准化的生成工作流。研究结果表明,ChatGPT-4 与 MidJourney 6.0 能够生成兼具高度写实性与艺术表现力的视觉图像,忠实还原《山海经》的标志性元素。此外,本研究通过提示词权重调整、参数优化、多轮迭代等质量管控手段,将图像质量管理从事后修正转向全流程优化。但该方法在处理复杂神话文本与精细细节方面仍存在局限,需设计人员介入以提升生成准确度。本研究揭示了 AIGC 在神话艺术创作领域的应用潜力,也为传统文化的当代表达开辟了新路径。

Abstract: This study explores the application of AIGC technology, using ChatGPT-4 and MidJourney 6.0 as primary tools to design and generate visual imagery based on the Chinese mythological anthology, the Classic of Mountains and Seas (Shan Hai Jing). Through a systematic experimental design, this study established a bidirectional human–AI collaborative mechanism between ChatGPT and MidJourney, forming a standardized generative workflow. The results demonstrate that ChatGPT-4 and MidJourney 6.0 can produce highly realistic and artistically expressive visual images, faithfully reproducing the iconic elements of the Classic of Mountains and Seas. Moreover, through quality control measures such as prompt weight adjustment, parameter optimization, and multiple iterations, this study transformed image quality management from post-correction to process optimization. However, limitations persist in processing complex mythological texts and intricate details, requiring designer intervention to enhance accuracy. This study highlights the potential of AIGC in mythological art creation and offers new avenues for the modern expression of traditional culture.

图 1 蠃鱼最终生成视觉图像

Figure 1.Final Visual Image Generation of Luoyu.

02

面向文化遗产的多模态检索增强生成:

基于基诺族传统知识的技术探索

Multimodal RAG for cultural heritage: a technical exploration based on Jino traditional knowledge

Xiaoyu Zhou , Jing Lin

摘要:本文构建了一套多模态检索增强生成(RAG)系统,用于中国基诺族传统知识(TK)的数字化保护。基诺族是人口较少的原住民族群,其知识主要通过口耳相传、仪式实践与在地生态经验代代传承。该系统整合文本、音频与图像多类数据,采用 m3e-base 模型生成向量嵌入,依托 Facebook AI 相似度搜索工具(FAISS)实现语义检索。系统基于 Flask 框架搭建后端以支持跨模态查询,由 OpenAI 系列模型完成关键词提取与内容生成。系统通过 Docker 与 Cloudflare Tunnel 部署,嵌入 WordPress 界面面向公众开放使用。除技术实现外,本研究还探讨了数据采集、知识产权与文化真实性层面的挑战。研究结果表明,人工智能驱动的多模态检索能够为传统知识的可持续传承提供支撑,也可为未来数字遗产基础设施建设提供参考。

Abstract: This article presents a Multimodal Retrieval-Augmented Generation (RAG) system for the digital preservation of traditional knowledge (TK) from the Jino ethnic group in China, a small indigenous community whose knowledge is primarily transmitted through oral narratives, ritual practices, and place-based ecological experience. The system integrates text, audio, and image data, using the m3e-base model for embedding generation and Facebook AI Similarity Search for semantic search. A Flask backend supports cross-modal queries, with OpenAI models handling keyword extraction and generation. Deployed via Docker and Cloudflare Tunnel, the system is embedded in a WordPress interface for public access. Beyond implementation, the study addresses challenges in data collection, intellectual property, and cultural authenticity. Results indicate that AI-driven multimodal retrieval can support sustainable TK transmission and inform future digital heritage infrastructures.

图 2 蓝色边界内为基诺族主要聚居地 —— 基诺族乡地图。该区域位于云南省西双版纳州,生物多样性丰富,孕育了深厚的原住民生态知识体系。

Figure 2.Map of Jino Township, the primary settlement area of the Jino people, shown within the blue boundary. Located in Xishuangbanna, Yunnan Province, this region is characterized by high biodiversity and rich Indigenous ecological knowledge.

03

文化遗产领域的人工智能:构建面向中

国物产类文化遗产的领域专用大语言模

型系列

Artificial intelligence in cultural heritage: Constructing a domain-specific LLM series for Chinese local product heritage

Dongbo Wang , Chang Liu , Liang Zuo , Zhixiao Zhao , Xue Zhao , Yuhan Liu

摘要:传统方志中的中国物产记载是文化遗产的重要组成部分。近年来人工智能技术的发展,为这类遗产的保护与利用开辟了新路径。本文介绍了专为中国物产领域定制的大语言模型(LLM)系列,包含基座模型、对话模型与推理模型,统称为中国物产大语言模型系列。该系列模型验证了大语言模型应用于中国物产知识智能化处理的可行性,为文化遗产研究提供了技术范式与工具体系。

本文首先构建了规模达 10 亿字符的混合预训练数据集,数据来源于各类中国物产历史文献。基于该数据集,研究团队对通义千问(Qwen)开源基座模型开展领域适配性持续预训练,最终研发出中国物产知识专用模型,涵盖基座模型、对话模型与推理模型三类。后续模型以 API 服务与网页应用的形式部署,支撑中国物产相关的自动化文本处理与知识问答服务。

本文是首个面向物产类文化遗产领域开发专用大语言模型的研究尝试。研究进一步证实,持续预训练、指令微调、数据蒸馏、长思维链微调与检索增强生成等技术,能够有效提升物产信息服务质量。研究结果凸显了人工智能时代大语言模型推动文化遗产传承与保护的应用潜力。

Abstract: Chinese local product records in traditional gazetteers constitute a vital component of cultural heritage. Recent developments in artificial intelligence (AI) have opened up new avenues for the preservation and utilization of such heritage. This article introduces the large language models (LLMs) tailored to Chinese local products, comprising a base model, a chat model, and a reasoning model collectively referred to as the Chinese local product LLM series. These models validate the feasibility of applying LLMs to the intelligent processing of Chinese local product knowledge and provide both a technical paradigm and toolset for cultural heritage research. This article first constructs a hybrid pre-training dataset containing one billion characters, drawn from historical texts on Chinese local products. Leveraging this dataset, the Qwen open-source base models underwent further pre-training for domain adaptation, leading to the development of specialized models for Chinese local product knowledge, including a base model, a chat model, and a reasoning model. These models are subsequently deployed as API endpoints and web applications to support automated textual processing and knowledge-based question answering services related to Chinese local products. This article marks the first attempt to develop LLMs specifically for the domain of cultural heritage with a focus on local products. It further demonstrates the effectiveness of continued pre-training, instruction tuning, data distillation, long-chain-of-thought fine-tuning, and retrieval-augmented generation in improving the quality of local product information services. The findings underscore the potential of LLMs to advance both the preservation and protection of cultural heritage in the AI era.

图 3 中国物产大语言模型构建与应用框架

Figure 3.Framework for constructing and applying the Chinese local product large language models

04

基于章节情节波动与主人公情感变化的

中国小说高潮章节识别

Climax chapter recognition of a Chinese novel based on plot fluctuation of a chapter and sentiment changing of main character

Zhongbao Liu , Bowen Zhang , Guangwen Wan , Wenjuan Zhao

摘要:中国小说的高潮章节是冲突发展至紧张激烈阶段的内容。高潮章节决定了主人公的命运、情节的走向与故事的结局,在中国小说中占据核心地位。如何快速准确地识别高潮章节,对于激发读者阅读兴趣具有重要意义。

中国小说的高潮章节具备两个典型特征:剧烈的情节波动与显著的主人公情感变化。据此,本文以《射雕英雄传》为语料,基于一系列深度学习模型,提出了一种同时兼顾章节情节波动与主人公情感变化的高潮章节识别模型。章节情节波动与主人公情感变化可分别通过章节情节波动曲线与主人公情感变化曲线进行刻画;将两条曲线融合可得到章节差值曲线,以此为依据即可判定小说的高潮章节。

在实验语料上的对比实验结果表明,与现有模型相比,本文提出的模型性能更优,F1 值达到 87.50%。消融实验结果显示,纳入主人公情感变化特征的模型,其 F1 值比仅考虑章节情节波动的模型高出 9.41%。

Abstract: The climax chapter of a Chinese novel is the part where the conflict develops to be tense and sharp. Such a chapter determines the fate of the main character, the development of the plot, and the end of the story, which makes it crucial to a Chinese novel. How to quickly and accurately recognize the climax chapter is important to attract readers’ interest. The climax chapter of a Chinese novel has two distinctive characteristics: dramatic development of plot fluctuation and sentiment changing of the main character. Therefore, this paper tries to propose a model to recognize the climax chapter, which both considers the plot fluctuation of a chapter and the sentiment changing of the main character on the corpus The Legend of the Condor Heroes (射雕英雄传), based on a series of deep learning models. The plot fluctuation of a chapter and the sentiment changing of the main character can be, respectively, depicted as plot fluctuation curve of a chapter and sentiment changing curve of the main character. The chapter difference curve can be drawn by combining the above two curves and based on which the novel climax chapter can be determined. Comparative experimental results on the experimental corpus show that, compared to existing models, the performance of the model proposed in this paper is much better, its F1 value arriving at 87.50 per cent. Ablation experiment results show that the F1 value of the model considering sentiment changing of main character is 9.41 per cent higher than that of the model considering the plot fluctuation of a chapter.

图 4 研究框架

Figure 4.Research Framework.

05

中国媒体中的人工智能叙事探析:

一项混合方法的话语分析

Navigating artificial intelligence narratives in Chinese media: a mixed-methods discourse analysis

Yuhang Li , Danni Yu , Lisai Yu

摘要:随着人工智能技术的社会渗透不断加深,主流媒体通过新闻框架塑造公众认知的作用日益凸显。但现有研究长期受西方中心视角局限,非西方语境下的人工智能话语建构机制研究仍存在明显空白。

本研究以 2017—2024 年中国主流媒体的人工智能相关新闻报道为语料,采用主题模型网络分析、道德基础分析与语言学分析相结合的混合研究方法,系统解构中国语境下主流媒体的人工智能技术叙事策略。研究发现:第一,媒体构建了 “政治与经济““社会”“革新”“合作” 四大框架,其结构细节反映出技术话语与国家战略的深度耦合。第二,道德话语呈现出以 “权威 / 颠覆”“忠诚 / 背叛” 维度为核心的中国特征,其历时性演变与疫情治理、民族主义强化等语境因素相关。第三,媒体通过述谓与隐喻相结合的语言策略,将人工智能塑造为可调控的国家发展工具,同时弱化了技术的复杂性与风险。

本研究不仅揭示了技术社会化进程中意识形态与话语策略的互构机制,也以非西方视角为全球人工智能治理研究提供了中国经验参考。

Abstract: With the deepening social penetration of artificial intelligence (AI) technology, mainstream media’s role in shaping public cognition through news framing has become increasingly prominent. However, existing research has long been constrained by Western-centric perspectives, leaving significant gaps in exploring the discourse construction mechanism related to AI in non-Western contexts. This study seeks to systematically deconstruct the mainstream media narrative strategies on AI technology in the Chinese context, by employing a hybrid methodology combining Analysis of Topic Model Networks, Moral Foundation Analysis, and linguistic analysis and using AI-related news reports from 2017 to 2024 in Chinese mainstream media as a corpus. The findings suggest that, first, the media have constructed four frames of “Politics and Economy,” “Society,” “Revolution,” and “Cooperation,” whose structural details reflect the deep coupling between technological discourse and national strategies. Second, moral discourse demonstrates Chinese characteristics prioritizing dimensions of Authority/Subversion and Loyalty/Betrayal, whose diachronic growth correlates with contextual factors such as pandemic governance and nationalist reinforcement. Third, through the combined linguistic strategies of predication and metaphor, media narrate AI as a manipulable national development tool while downplaying technological complexity and threats. This study not only reveals the mutual-construction mechanism between ideology and discursive strategies in technological socialization, but also provides Chinese empirical references for global AI governance research through a non-Western perspective.

图 5 主题网络

Figure 5.The topic network.

06

中国外销水彩画的数字人文研究路径 

—— 以维多利亚与阿尔伯特博物馆馆

藏为个案

A digital humanities approach to Chinese export watercolours: a case study on the Victoria and Albert Museum Collection

Jin Gao , Yangming Zhang , Jiawei Liu , José Pedro Sousa

摘要:中国外销水彩画(CEW)是 18 至 19 世纪面向欧美市场创作的绘画品类,契合西方消费者的审美偏好。这类作品融合中西方绘画技法,细致描绘了晚清时期中国的传统职业、风俗民情、动植物、建筑与山水风貌,形成了独特的艺术风格。

本文介绍了维多利亚与阿尔伯特博物馆(V&A)与伦敦大学学院的合作研究成果。研究以 V&A 馆藏中国外销水彩画为核心对象,提出了一套研究中国外销艺术的新型数字人文研究模式,该模式由多个模块构成:第一,基于入藏档案与数字化图像,分析馆藏目录元数据与征集记录,梳理藏品的收藏历史与文献记载的流传脉络;第二,运用深度学习方法对 2350 幅画作进行主题分类;随后开展半自动图像标注与深度分析,探究图像志主题及其历史演变规律。图像志研究发现,1840 年前后 V&A 馆藏的图像图像志分布存在显著变化,为研究这一时期的中英文化互动与全球贸易史提供了基于藏品的新视角。该研究模式不仅助力 V&A 馆藏中国外销水彩画的深度分析,也为未来中国外销艺术及相关领域研究提供了新路径。

Abstract: Chinese Export Watercolours (CEW) is a type of painting created for export to European and North American markets during the eighteenth and nineteenth centuries, which catered to Western consumers’ aesthetic tastes. These paintings blend Chinese and European painting techniques, depict detailed traditional Chinese occupations, customs, plants, animals, architectures, and landscapes of the late Qing Dynasty, and they form a unique artistic style. This article introduces collaborative research between the Victoria and Albert Museum (V&A) and University College London. By focusing on the V&A CEW collection, this article presents a new digital humanities research model for studying Chinese export art, which comprises different parts. First, based on the acquisition archives and digitized images, the study analyses its catalogue metadata and acquisition records to trace the collecting history and documented provenance. Secondly, it classifies 2,350 paintings by themes using deep learning methods. It then conducts semi-automatic image annotation and in-depth analysis to explore the iconographies and their evolution in history. The findings reveal a changing iconography distribution before and after 1840 within the V&A holdings, offering new, collection-based insights into Sino-British cultural interactions and global trade history during this period. The model not only contributes to in-depth analysis of the V&A CEW collection but also provides a new way for future research on Chinese export art and beyond.

图 6 V&A 博物馆馆藏中国外销水彩画入藏方式的

年代分布

Figure 6.Chronological distribution of collection means for Chinese export watercolours in the V&A Museum.

07

多维特征与文化符号解码:中国传统剪

纸艺术的系统性研究

Decoding multidimensional features and cultural semiotics: a systematic investigation of traditional Chinese paper-cutting artistry

Pengpeng Cheng , Daoling Chen

摘要:本研究结合文献分析与量化数据挖掘方法(K-prototypes 算法、层次聚类),对中国剪纸的造型、技法、文化内涵等核心特征进行分类,揭示其内在分类规律与文化意蕴,为数字化保护与创新设计策略提供支撑。

研究结果表明,K-prototypes 算法能够有效整合剪纸技法与文化语义特征(轮廓系数 = 0.75),可将 128 份样本划分为三类:第一类(46 份)以高复杂度对称纹样为主,承载着儒家中庸的哲学隐喻;第二类(43 份)以阳刻表现生命主题为核心特征,体现了道家的自然观;第三类(39 份)以民俗符号为核心,凝聚着集体文化记忆。

研究成果既弥补了现有定性分析的不足,也为传统艺术数字化保护与文创产业发展提供了理论依据与方法支撑,同时推动了传统文化与现代科技的融合。

Abstract: This study integrates literature analysis and quantitative data mining (K-prototypes, hierarchical clustering) to classify Chinese paper-cutting’s core features (modeling, techniques, cultural implications), revealing inherent classification rules and cultural connotations for application in digital preservation and innovative design strategies. The results show that K-prototypes algorithm can effectively integrate paper-cutting techniques and cultural semantic features (silhouette coefficient = 0.75), and divide 128 samples into three categories: Class 1 (n = 46) is mainly composed of high-complexity symmetrical patterns, which carries the Confucian philosophical metaphor of the golden mean; Class 2 (n = 43) is characterized by the theme of life engraved in the positive engraving, which reflects the Taoist view of nature; Class 3 (n = 39) takes folk symbols as the core and embodies the collective cultural memory. The research results not only fill the shortcomings of the existing qualitative analysis, but also provide a theoretical basis and method support for the digital protection of traditional art and cultural and creative industries, and at the same time promote the integration of traditional culture and modern science and technology, and promote the development of cultural and creative industries.

图 7 二值化处理后的图像

Figure 7.The image after binarization.

08

串联视野:晚清与民国时期中国地理的

可视化研究

Link visions together: visualizing geographies of late Qing and Republican China

Qun Che , Shih-Pei Chen , Nungyao Lin , Calvin Yeh

摘要:空间研究方法融入历史学研究,将地理作为分析框架与认识论视角,重塑了传统历史叙事。本文将历史地理信息系统(HGIS)与空间认识论路径相结合,探讨异质性历史文献如何通过空间维度实现对齐与解读。

本研究借助 CHMap 与 LoGaRT 平台,将地方志、土地测绘图、基于 IIIF 的开放地图资源等多元史料进行空间化处理,并选取两个形成对照的案例展开分析:一是长江荆江河段的江心沙洲演变与洪水过程,二是浙江嘉兴儒学物质载体的时空分布。案例研究表明,空间对齐具有双向作用:既能还原史料中内嵌的空间属性,又能生成跨领域的新型关联性知识。

通过为异质数据建立统一的空间坐标系,本研究验证了空间作为知识对齐机制的方法论价值,并将空间重构确立为历史知识生产的认识论框架。

Abstract: The integration of spatial methodologies into historical research has reshaped traditional narratives by foregrounding geography as both an analytical framework and an epistemological lens. This paper combines Historical GIS (HGIS) with a spatial epistemological approach to investigate how heterogeneous historical sources can be aligned and interpreted through space. Using the CHMap and LoGaRT platforms, this study spatializes diverse materials, including local gazetteers, land survey maps and IIIF-based open map resources, and examines two contrasting case studies: the evolution of riverine sandbanks and flood processes along the Jingjiang section of the Yangtze River, and the spatiotemporal distribution of the material embodiments of Confucian learning in Jiaxing, Zhejiang Province. These cases demonstrate that spatial alignment operates bidirectionally: it both restores the spatial attributes embedded in historical sources and generates new relational knowledge across domains. By establishing a shared spatial coordinate system for disparate data, the study validates the methodological value of space as a mechanism of knowledge alignment and positions spatial reconstruction as an epistemological framework for historical knowledge production.

图 8 《湖北全图》(1862 年)与《湖北舆地图》(1901 年)中的长江河道

数据来源:《湖北全图》(1862 年),美国国会图书馆,数字编号:g7823h.ct002593《湖北舆地图》(全称《光绪湖北舆地图》,1901 年),柏林国家图书馆,链接:https://digital.staatsbibliothek-berlin.de/werkansicht?PPN=PPN334622922X&PHYSID=PHYS_0001。

本图通过 IIIF JSON 接口从美国国会图书馆获取 1862 年《湖北全图》,在 CHMap 平台完成空间配准后,与柏林国家图书馆藏 1901 年《湖北舆地图》进行对比,局部放大区域呈现了长江沿线沙洲分布的差异。

Figure 8.The Yangtze River channel in the Complete Map of Hubei Province (1862) and the Topographic Map of Hubei (1901). Data Sources: Complete Map of Hubei Province (1862), Library of Congress, Digital ID: g7823h.ct002593. Guangxu Hubei Yutu, Berlin State Library, https://digital.staatsbibliothek-berlin.de/werkansicht?PPN=PPN334622922X&PHYSID=PHYS_0001. The Complete Map of Hubei Province (1862), retrieved from the Library of Congress via IIIF JSON and spatially registered in CHMap, is compared with the Topographic Map of Hubei (1901) from the Staatsbibliothek zu Berlin. Enlarged sections highlight differences in sandbank distributions along the Yangtze River.

09

数字遗产与时尚:借助人工智能与虚拟

档案守护文化身份

Digital heritage and fashion: preserving cultural identity through AI and virtual archives

Sameera M Al-Ghamdi , Nadia Yusuf

摘要:人工智能图像生成技术的普及,为时尚遗产与文化身份的保护带来了机遇与挑战。本研究提出多维度保真度评估框架(MDFA),将计算感知相似度(以 LPIPS 指标衡量)与专家评分的文化特征一致性(CFC)相结合,以此评估 AI 复刻历史服饰的能力。

将该框架应用于 Gemini 与 ChatGPT 生成的 15 套服饰后,研究发现自动化指标与人工判断结果存在差异。AI 生成的内容通常能达到较高的感知相似度,但在文化核心细节的还原度上表现不稳定。因此,这类工具有导致文化扁平化与文化误读的风险,对非西方服饰的还原问题尤为突出。例如,AI 在还原清代服饰的象征纹样与印尼蜡染的纹理质感时表现不佳。

本文提出,应在虚拟档案建设中引入伦理调节机制,强调透明度、语境化与专家监督,确保 AI 成为守护多元时尚遗产的负责任工具。识别与修正 AI 生成内容的失实与伪造问题提供了思路,为数字遗产鉴证领域的未来研究指明了方向。

Abstract: The proliferation of artificial intelligence (AI) image generation presents both opportunities and challenges for preserving fashion heritage and cultural identity. This study aims to evaluate AI’s capacity to replicate historical fashion by introducing the Multi-Dimensional Fidelity Assessment (MDFA) framework, which combines computational perceptual similarity (LPIPS) with expert-scored cultural feature concordance (CFC). Applying MDFA to 15 ensembles generated by Gemini and ChatGPT, findings reveal a divergence between automated metrics and human judgment. While AI often achieves high perceptual similarity, fidelity to culturally significant details is inconsistent. Consequently, these tools risk cultural flattening and misrepresentation, especially for non-Western attire. For example, AI struggled with symbolic motifs on a Qing Dynasty robe and Indonesian batik textures. The paper argues for ethical mediation in virtual archives by emphasizing transparency, contextualization, and expert oversight to ensure AI serves as a responsible tool in safeguarding diverse fashion legacies. In turn, the findings provide insights into identifying and addressing falsifications and outline directions for future research in digital heritage forensics.

图 9 印尼传统服饰真品(左)与 ChatGPT(右)、Gemini(中)生成版本的对比。本图由作者整理,真品原图来自大都会艺术博物馆。

注:两款 AI 模型均难以复刻具有文化特异性的服饰廓形、蜡染纹理与标志性纹样,凸显了 AI 生成内容存在较高的文化误读风险。

Figure 9.Comparison of Authentic Indonesian Ensemble (Left) with AI-Generated Versions from ChatGPT (Right) and Gemini (Middle). Compiled by authors, the authentic original from the Metropolitan Museum of Art.

Note. Both AI models struggled to replicate culturally specific silhouettes, batik textures, and recognizable motifs, illustrating a high risk of cultural misrepresentation.

10

算法能否识别湮没的学术社群?—— 

基于网络方法的帝制晚期江南地区研究(1644–1912)

Can algorithms detect lost scholarly communities? A network-based study of the Lower Yangtze in Late Imperial China (1644–1912)

Hao Zhu , Shuyi Fang , Yuxin Liu , Linxu Wang

摘要:本文提出了一套基于网络方法的清代(1644–1912)学术社群分析框架,引入 “湮没的学术社群” 概念,用以识别那些结构上具有凝聚力、却被史学研究忽略的知识群体。

本研究以《清儒学案》为核心史料,辅以中国历代人物传记资料库(CBDB)与中国历史地理信息系统(CHGIS),重建了江南地区约 1300 位学者之间的 3000 余条学术交游关系。研究提取了师承、交游、书信往来等关系,对其进行结构化编码后,构建为动态时序网络。该研究框架结合动态聚类与静态 Louvain 社群发现算法:动态聚类用于追踪社群的长期聚合过程,静态 Louvain 算法用于揭示跨时空的潜在社群分组。

研究表明,清代知识社群并不总是与既定学派或地域流派一一对应;关系密度与互动结构更能解释学术凝聚力的形成。通过识别网络中的 “湮没社群”,本研究对传统的思想分类与谱系分类提出了挑战,并从关系视角对学术归属进行了重新定义。从更广泛的层面看,本研究为历史知识网络分析提供了一套可迁移的研究模型,可应用于其他时期与其他语料。该方法是对思想史领域文本与概念研究方法的补充,也拓展了数字人文在历史语境下绘制知识传播图谱的工具体系。

Abstract: This article proposes a network-based framework for analyzing scholarly communities in Qing China (1644–1912), introducing the concept of “lost scholarly communities” to identify structurally cohesive but historiographically overlooked intellectual groups. Drawing on Qingru Xue’an (清儒學案, Cases of Qing Confucian Learning) as the primary source, supplemented by China Biographical Database and China Historical Geographic Information System, the study reconstructs over 3,000 academic relationships among approximately 1,300 scholars in the Jiangnan region. These relationships—spanning mentorship, social interaction, and correspondence—are extracted, structurally coded, and transformed into a dynamic temporal network. The methodological framework combines dynamic clustering to track the longitudinal aggregation of communities with static Louvain-based detection to reveal latent groupings across space and time. The study demonstrates that Qing intellectual communities did not always align with named schools or regional factions; instead, relational density and interactional structure better account for the emergence of scholarly cohesion. By identifying “lost communities” within the network, the research challenges conventional ideological or genealogical classifications and offers a relational redefinition of academic affiliation. More broadly, it provides a transferable model for historical knowledge network analysis, applicable to other periods and corpora. This approach complements textual and conceptual methods in intellectual history while expanding the digital humanities tool kit for mapping knowledge circulation in historical contexts.

图 10 清代学术社群网络可视化图

每个节点代表一位学者,节点大小反映学者的连接数(度中心性);方形节点为全网络中度中心性排名前二十的学者;颜色对应 Louvain 算法识别出的社群聚类(C0–C15),与表 4 一致;连线代表学术关系(如书信往来、师承、合作),核心或代表性人物标注了姓名。

Figure 10.Network Visualization of Qing Academic Communities. Each node represents a scholar; node size reflects the scholar’s number of connections (degree centrality). Square nodes denote the top twenty scholars by degree across the full network. Colors correspond to Louvain-detected clusters (C0–C15), matching Table 4. Edges indicate academic relationships (e.g. correspondence, mentorship, collaboration). Names are labeled for central or representative figures.

以上内容来自《数字人文学刊(DSH)》官方网站:

https://academic.oup.com/dsh/issue?login=true

经数字人文资讯小编翻译整理而成如需转载,请后台私信联系

编译 丨 洪冰凤

校对 丨 魏翔

排版 丨 周柃妍

阅读原文

跳转微信打开

  •  

专业资讯 | 欧盟ECHOES首批资助12个文化遗产数据类项目公布

2026-07-18 08:30 福建

在欧盟“地平线欧洲”(Horizon Europe)科研创新框架计划资助下,欧洲文化遗产协作云(European Collaborative Cloud for Cultural Heritage,ECCCH)核心支撑项目欧洲开放科学遗产云于近日正式公布首批“数据”主题级联资助计划的获奖子项目名单。

在欧盟“地平线欧洲”(Horizon Europe)科研创新框架计划资助下,欧洲文化遗产协作云(European Collaborative Cloud for Cultural Heritage,ECCCH)核心支撑项目欧洲开放科学遗产云(European Cloud for Heritage OpEn Science,ECHOES)于近日正式公布首批“数据”主题级联资助计划的获奖子项目名单。本轮共遴选出12个优质项目,执行周期为2026至2027年,单个项目获6万欧元资助,重点围绕文化遗产数字化保护、数据标准化建设、智能技术应用、濒危遗产留存及文旅创新应用等方向,各项目成果将统一接入ECCCH平台,沉淀标准化数字化流程与可复用遗产数据,为欧洲文化遗产数字化的落地应用提供丰富的实践案例。

一、ECHOES项目概况

ECHOES项目的核心使命是搭建欧洲文化遗产协同云平台。这一共享平台旨在推动文化遗产领域从业者与科研人员开展协同合作,助力他们革新工作模式、优化业务流程。平台将为用户开放各类数据、前沿科研资源、培训资源以及先进的数字化工具,所有资源均由文化遗产行业各界主体联合研发,精准适配行业专属发展需求。目前,欧洲文化遗产领域的各类社群资源分散割裂,而ECHOES项目将整合各方力量,汇聚不同领域、不同学科的多元参与主体,打造一个聚焦数字公共资源建设的统一协作共同体。

ECHOES项目的独特之处在于其致力于推动文化遗产领域实现前瞻性的行业范式变革。该项目联盟汇聚了欧洲文化遗产行业的所有核心参与主体,旨在推动行业摆脱传统的实体文物导向模式。这种模式仅将文物实体数字化作为最终目标,转而对物质与非物质文化遗产开展全方位、整体性的数字化转型建设。项目将搭建专属数字生态体系,支持用户对文化遗产数字孪生模型进行交互调试、优化改造与内容拓展,依托多方协作共创全新的科研成果。这套数字生态体系将催生新一代文化遗产载体,即语义信息完善、由大众共建共享的数字公共资源,这也是项目所定义的“未来文化遗产形态”(the heritage of tomorrow)。在项目收尾阶段,ECHOES将推出一体化综合平台,全面整合欧盟及欧洲各国本土的文化遗产项目成果。同时,项目将在结题前组建具备包容性的独立法人机构,为欧洲文化遗产协同云平台的长期可持续运营提供坚实保障。

ECHOES项目的另一核心优势是,主动与欧洲各类相关专项计划开展协同联动,有效避免重复建设与资源浪费,协同合作的对象涵盖欧洲文化遗产公共数据空间(the common Data Space for Cultural Heritage)、欧洲开放科学云(EOSC)、欧洲文化遗产联合规划倡议(JPI—CH)、CHARTER 联盟(CHARTER Alliance)、ARCHE项目等多项欧洲重点项目与平台。

总体而言,ECHOES首次实现了文化遗产领域、人文社科领域全部参与主体的深度聚合,同时吸纳了计算机科学与数据科学领域的知名学术机构与民营专业机构。项目研发的各类垂直应用所配套的落地实践案例,充分彰显了这种跨学科、协作式的工作模式。此外,云平台设立的各国区域节点,为多层级、全方位的跨界协作提供了长效保障。

完善的项目联盟是ECHOES的核心核心竞争力,联盟具备极强的行业覆盖面与代表性,包含15家行业统筹机构,辐射欧洲超千家各类从业组织,覆盖多个学科领域。项目最终将搭建覆盖全欧洲的文化遗产机构核心利益相关方网络,构建成熟完善的科研与行业专业协作体系,并面向广大用户开放共建共享通道,汇聚全社会力量助力文化遗产数字化发展。

二、首批12个获奖项目概况

ECHOES级联资助计划将为多达50个项目提供资金支持,旨在增强文化遗产云中的数字参与、数据共享与协作能力。该资助面向由文化遗产机构牵头的联合体以及单独的文化遗产机构开放,共分三次征集批次,支持各类不同的举措,中小型、资源匮乏的文化遗产机构被重点鼓励申报。

第一次征集号召文化遗产领域各相关机构为文化遗产云平台提供数据集。申报方案需明确数据集的目标使用群体、应用用途(例如学术研究、教学科普、线上虚拟展览等)、预期成果以及广泛社会价值。此外,申报方需要阐述项目依托文化遗产云平台开展工作的应用场景,其中必须列明对文化遗产数据集开展分析、处理所需的全部实施步骤。最后,申报材料需附上完整详尽的数据集说明文档,涵盖数据集内容、技术参数、伦理规范、开放获取条件与版权许可条款。下面是首批12个获奖项目概况:

1. FinFair

  • 项目全称:芬兰—乌戈尔数据空间:ECCH框架下区域特色族群物质与非物质遗产互联互通项目

  • 牵头单位:拉脱维亚大学文学、民俗与艺术研究所

  • 参与单位:Reprex. B.V. 公司

  • 项目周期:2026年3月1日—2027年2月28日

  • 项目摘要:

    FinFair项目旨在搭建一套轻量化、可拓展的数字化工作流程,助力小型博物馆、档案馆及民间藏品收藏机构创建高质量文化遗产数字孪生体。该数字模型可实现物质遗产与非物质遗产的互联互通,并全面接入ECCH。

    当前众多小型文化机构拥有独特馆藏资源,但缺乏技术能力产出结构化、可复用的遗产数据,这是行业参与数字化共建的核心壁垒,FinFair项目精准聚焦这一痛点开展攻坚。项目依托文化遗产数字孪生本体库与维基库等开源工具,证明小型机构同样能够产出符合FAIR(可发现、可访问、可互操作、可复用)与CARE(善意、公正、责任、赋能)原则、可直接接入欧洲文化遗产云平台的标准化数据。项目设置三类可拓展应用场景:利沃尼亚语全维度遗产数据库,实现遗产微观尺度360°全景重构;初始元数据维度较精简的拉特加莱地区大型遗产数据库;跨边境整合分散芬兰—乌戈尔族群遗产资源的波罗的海—北欧联合数据库。

    项目结合社群策展目与严谨的语义建模技术,形成一套可复用、可复刻的技术方案,将碎片化的各地遗产馆藏整合为统一共享数据空间。持续扩充的馆藏将在finnougric.net平台开放获取,项目动态将在finnougric.substack.com同步更新。项目构建的数字孪生模型具备高度互操作性与合法复用性,可为云平台内的学术研究、数字叙事传播、人工智能创新应用提供坚实数据支撑。

2. Moher

  • 项目全称:马赛克遗产:人工智能驱动的捷克马赛克艺术品跨学科数据库

  • 牵头单位:捷克帕尔杜比采大学

  • 参与单位:无

  • 项目周期:2026年4月1日—2027年3月31日

  • 项目摘要:

    马赛克遗产项目是一项跨学科创新计划,旨在搭建捷克首个全面、开放获取的马赛克艺术品数字化数据库。项目完全对标ECCH建设标准,将艺术史研究、文物保护、材料科学三大领域的研究成果整合至统一数字平台。针对当前捷克马赛克艺术资料零散、缺乏系统化整理、难以长效保存的行业难题,Moher项目将碎片化的史料与藏品记录整合优化,打造符合FAIR准则、语义信息完善的优质遗产资源库。平台将集中收录高清影像、地理空间元数据、精细化材料分析报告以及文物修复档案等全套资源。

    平台内置人工智能工具,可实现语义检索、视觉检索、艺术风格与材质自动分类聚类、元数据智能增补等进阶功能,同时支撑学术科研与大众文化科普。该数据库严格遵循ECHOES概念模型搭建,是可复用、可互通的数字遗产系统标杆案例,能够保障资源在欧洲文化遗产云生态内长期有效使用。项目构建的结构化数据集覆盖19世纪以来中欧地区全部马赛克艺术成果,极大丰富了欧洲文化遗产研究资源。项目融合传统文博研究经验与前沿数字技术,守护区域文化记忆,推动多领域数字遗产应用创新发展。

3. LandArchIE

  • 项目全称:面向人工智能应用、符合FAIR准则的爱尔兰景观考古数据库建设项目

  • 牵头单位:爱尔兰探索计划考古与创新研究中心

  • 参与单位:斯洛文尼亚Bias Variance Labs有限责任公司、斯洛文尼亚科学院艺术研究中心

  • 项目周期:2026年4月1日—2027年3月31日

  • 项目摘要:

    LandArchIE项目致力于搭建爱尔兰首个规模化、标准化的景观考古数字化数据集,系统收录爱尔兰全国史前与中世纪早期的环形堡垒、古墓、围场等土筑古遗址资源。项目整合两大核心高精度数据来源:可精准识别地表细微地貌特征的激光雷达高精度扫描数据,以及哨兵一号、哨兵二号卫星遥感影像数据。

    通过融合两类数据,项目打造多层级、高维度的考古资源数据库,大幅提升计算机智能识别与人工考古研究对古遗址的探测、测绘与解读效率。项目将一万余条经过实地核验的古遗址档案,整理加工为适配机器学习的标准化数据包,包含栅格影像、训练标签、精细化语义元数据等核心内容。项目成果涵盖0.5米精度的数字地形模型、古遗址特征模型、七类考古可视化成果,以及总容量超400GB的大型科研基准数据集。

    为保障数据可检索、可复用、可关联,项目严格遵循国际通用标准编制元数据,全面落实FAIR数据准则。项目打通考古学、人工智能与文化遗产基础设施三大领域,助力欧洲数字遗产研究走向开放化、可持续化、互联互通化。

4. APACH

  • 项目全称:面向文化遗产的建筑保护与考古数字化创新

  • 牵头单位:法国埃克斯—马赛大学

  • 参与单位:无

  • 项目周期:2026年6月15日—2027年6月14日

  • 项目摘要:

    APACH依托TAIC2项目(埃克斯—马赛大学 Amidex 基金、法国国家科学研究中心,项目官网 https://TAIC.hypotheses.org/)的成果,基于对联合国教科文组织世界遗产奥朗日古罗马剧场长达八年的考古监测数据,提出一套遵循 FAIR 原则的文化遗产数字孪生构建与应用方案。

    项目以可互操作的历史建筑信息模型(HBIM)框架为核心,设计适配欧洲文化遗产云(ECCCH)的集成方案。在现有基础设施基础上 —— 即符合工业基础类(IFC,ISO 16739)标准、可通过 REST 网络服务与开放地理空间联盟(OGC)地理空间标准实现互操作的 HBIM 模型 ——APACH 将整合考古与建筑研究领域的异构数据,这些数据目前分散在不同存储库中,访问权限各有差异。。

    为实现数据高效融合,项目将研发三大核心创新技术:IFC标准与CIDOC CRM遗产本体模型的高级语义互通技术、IFC几何模型自动校验与纠错复用工具、支持多场景协同共建的数字孪生交互协作平台。项目最终形成一套可复刻、资料完备的标准化技术体系,并以白皮书形式汇总应用案例与技术规范。由此,已完成 HBIM 建模的古迹只需选用可互操作的开放格式,即可直接接入欧洲文化遗产云生态体系,无需进行复杂的数据转换。

5. M2M

  • 项目全称:从模型到内涵:依托副数据赋能文化遗产三维模型增值应用项目

  • 牵头单位:奥地利科学院下属奥地利考古研究所

  • 参与单位:德国7Reasons 有限责任公司、达姆施塔特工业大学数字设计研究所、德累斯顿应用科技大学计算机图形学研究所、土耳其伊斯坦布尔比尔基大学

  • 项目周期:2026年5月18日—2027年5月17日

  • 项目摘要:

    M2M项目将以科学考据为基础,完成以弗所古城核心古迹为对象的三维重建模型搭建,并将成果全面接入ECCH。项目将 IDOVIR 虚拟重建平台与ECCH对接,发布精选模型的同时,配套完整元数据与结构化过程元数据,记录每一项重建背后的证据、假设与阐释选择。

    这一模式让静态的三维可视化模型转变为透明可溯源、可引用的标准化科研资源。项目将筛选十组弗所古城代表性三维模型,完成长效保存处理,赋予永久唯一标识,通过语义映射、关联开放数据导出、标准化交互接口搭建,实现模型的跨平台互通复用。项目成果可广泛服务于考古研究、文博展览、教学科普、沉浸式文旅应用及文化创意产业,同时形成一套可复制的三维模型标准化处理流程,可供各类文博机构复用。通过将虚拟重建成果转化为符合FAIR准则、语义关联的数字知识资源,M2M项目有效推动欧洲高品质文化遗产数据的全域复用与创新应用。

图:M2M项目以弗所古建筑虚拟重建模型(© 7reasons/Michael Klein)

图:以弗所世界文化遗产数字重建模型及元数据、过程数据成果(© 7reasons/Michael Klein)

6. SMARTWAYS

  • 项目全称:历史廊道智慧文化遗产文旅资源开发管理项目

  • 牵头单位:欧洲罗马古道协会(AERS)

  • 参与单位:奥地利克恩顿州朝圣协会、拉脱维亚图雷达博物馆保护区、西班牙GVAM互动指南公司、欧洲圣雅各布古道协会

  • 项目周期:2026年4月15日—2027年4月14日

  • 项目摘要:

    SMARTWAYS项目旨在为欧洲理事会认证的罗马古道、圣雅各布古道两大文化廊道,搭建全覆盖、带地理定位的文化遗产兴趣点数据集,并接入ECCH。项目核心数据集依托rurAllure项目搭建,包含3000余条数字化遗产记录,配套专题标注、历史背景、多媒体资源与深度文化叙事内容。

    项目核心目标是将这套标准化、语义化的优质遗产数据接入ECCH,依托人工智能技术为文旅从业者提供精准的数据复用方案,助力定制化文旅体验打造、新型文化叙事创作与创新文旅内容开发。项目针对不同受众打造差异化特色文旅路线,将传统历史廊道升级为赋能乡村与小众城区发展的动态文旅资源,摆脱同质化大众旅游模式。SMARTWAYS项目实现多媒体叙事、场景化内容推送与地理定位遗产数据的深度融合,形成可复制的文旅数字化应用标杆,为各类文化遗产机构开发文旅导向数据资源提供参考,助力慢文化旅游产业长效可持续发展。同时,数据集具备极高的政策研究价值,相关研究成果已在欧洲层面引发政策研讨,可为各级文旅与文化政策制定提供数据支撑。

7. MOH

  • 项目全称:哈德良陵墓:传承千年历史,赋能未来发展

  • 牵头单位:罗马国家博物馆(圣天使堡与万神殿管理中心)

  • 参与单位:Paolo Vitti; Noémie Gabay; Dario Di Girolamo;Cluj-Napoca—纳波卡技术大学

  • 项目周期:2026年3月31日—2027年3月31日

  • 项目摘要:

    圣天使堡历经千年持续使用,层层叠加的历史遗存既遮蔽也保存了其核心原始建筑——古罗马哈德良帝王陵墓的风貌。MOH项目汇总十余年专项研究成果,系统梳理这座经典古迹的历史与遗存价值。项目创新融合前沿数字技术与实地考据解读方法,将遗产数字化建档打造为知识传播与长效保护的核心手段。项目整合多年实地调研成果,搭建一体化、可持续的数字生态体系,保障复杂的遗产数据集长期可访问、可复用,打通科研人员、行业从业者、场馆管理者、基层养护人员与普通大众、属地社区的沟通传播渠道。

    项目组建涵盖文物保护、遗产建档、数据管理、数字技术的多学科团队,搭建学术研究与遗产现场管理的衔接桥梁。依托古迹管理机构深度协作,项目将科研成果转化为公共共享资源,直接支撑遗产保护决策,强化长效管护能力,让哈德良陵墓不仅成为珍贵的历史遗存,更成为未来文化遗产创新发展的核心资源与战略抓手。

图:圣天使堡

8. SAVOR

  • 项目全称:传统食谱语义人工智能价值挖掘项目

  • 牵头单位:罗马尼亚科学院克卢日—纳波卡分院民俗档案馆

  • 参与单位:罗马尼亚科学院人工智能研究所、罗马尼亚克卢日—纳波卡农业科技大学食品科学与技术学院、意大利阿图西美食文化中心

  • 项目周期:2026年3月25日—2027年3月25日

  • 项目摘要:

    SAVOR项目构建罗意双语传统食谱语料库,收录约3300道传统美食配方,专为人工智能语义检索与饮食文化研究定制开发。语料库采用JSON、TXT、CSV、Markdowndown等开源通用格式,面向数字人文研究者、饮食史学家、教育工作者与自然语言处理科研人员,提供结构化、语义化的文本资源,包含多语言标题、适配食品本体库的食材标注、制作工序、地域、年代、民俗场景等全方位文化元数据。

    数据集支持复杂语义检索分析,例如适配宗教斋戒场景的素食菜品筛选、跨地域饮食文化特征对比等,同时可作为罗-意双语食谱检索与分类人工智能模型的权威基准数据集。项目结题前将完成语料库核验优化,构建包含约18万资源描述框架三元组的关联数据图谱,在Zenodo平台完成数字对象唯一标识符注册,实现与欧洲文化遗产云平台的无缝对接。项目同步开源人工智能应用工具包、数据标注规范与资源入库手册,保障技术方案可复用、可复刻。SAVOR项目为中小型文化遗产机构提供成熟范本,助力传统文本类馆藏转化为适配人工智能应用、可互联互通的标准化数字资源,推动欧洲饮食文化遗产的数字科研创新与大众传播普及。

9. SPARRK—UA

  • 项目全称:适配人工智能合规研究的乌克兰濒危文物语义溯源数据建设项目

  • 牵头单位:Web2Learn机构

  • 参与单位:敖德萨国立美术博物馆

  • 项目周期:2026年4月1日—2027年3月31日

  • 项目摘要:

    SPARRK-UA项目针对乌克兰应急保护场景下的濒危文化遗产,搭建关联开放数据架构与标准化数据集,重点记录文物在紧急疏散、馆藏移交、异地迁移等被动流转过程中的溯源信息,配套完善的辅助溯源数据与多语种灰色文献资料。

    项目依托维基库搭建协同知识库,通过国际图像互操作框架清单与永久唯一标识,结合低碳去中心化区块链技术完成数据存证备案。数据可通过应用程序接口、语义查询端点、数据包导出等方式开放获取,同步归档至开源科研库,保障资源互联互通与长效保存。为实现人工智能研究的合规复用,项目嵌入人工智能伦理分类标准,生成人机可读的资源使用规范。项目以乌克兰冲突影响严重的南部边境区域濒危遗产保护为核心试点,搭建可互通的文物溯源标准化数据体系。同时,项目将举办全国黑客松创新大赛,赋能更多受突发状况影响的文博机构落地应用SPARRK-UA案。项目成果数据集可直接接入ECCH,提供适配人工智能应用的关联开放溯源数据,实现文物流转信息的公开化、互通化、规范化,支撑数字人文科研与文化教育创新发展。

10. Sawubona

  • 项目全称:萨乌布纳公共遗产共建项目

  • 牵头单位:荷兰世界文化博物馆

  • 参与单位:Plimpton-322咨询工作室

  • 项目周期:2026年3月16日—2026年10月16日

  • 项目摘要:

    “Sawubona”源自祖鲁语,本义为“我看见你”,其深层内涵更为深远:不仅是看见对方的存在,更是认可个体的人格、历史与尊严。这一理念核心质朴而意蕴深刻:唯有被真正看见,价值方能全然彰显。它不仅是一句问候,更是一种平等共生的相处哲学——看见他人,即是接纳其人生故事、过往经历、价值视角与世间定位。Sawubona项目聚焦殖民时代数百年间流转、交易所得的馆藏文物,搭建专属数字化共享平台。殖民时代充斥着不公、压迫与不平等的资源掠夺与交易,殖民遗产并非少数国家的专属议题,泛欧洲范围内的文物贸易,导致大量文物散落欧洲各地。即便部分欧洲国家未直接开展海外殖民统治,也留存大量殖民时期流转的文物藏品,因此殖民遗产保护与溯源是全欧洲的共同责任。项目支持文物原生属地社群补充本土史料、地域视角与历史研究成果,相关内容可作为标注信息关联至现有文物档案,依托透明的溯源体系实现全程可追溯。Sawubona项目由荷兰世界文化博物馆与Plimpton-322数据架构工作室联合打造,聚焦殖民遗产的公正溯源、多元解读与共享传播。

11. RuDIHeritage

  • 项目全称:鲁普村数字化:乡村历史遗产保护与研究创新实践项目

  • 牵头单位:德国克林根贝格市政府

  • 参与单位:Apus Systems 合伙公司、德累斯顿应用技术大学(HTW Dresden)、德累斯顿萨克森州立与大学图书馆(SLUB Dresden)、鲁本多夫地方史工作组(克林根贝格市政志愿者社群)

  • 项目周期:2026年3月31日—2027年3月31日

  • 项目摘要:

    数字时代下,乡村小型村落如何实现本土文化遗产的长效保护与活化利用?RuDIHeritage项目为欧洲乡村遗产数字化提供了可落地、可复制的实践范本。项目落地于德国萨克森州克林根贝格市鲁普村,由属地居民、科研人员、公共机构与技术团队协同合作,系统完成乡村遗产的史料整理、数字化建档与价值解读。项目合作团队涵盖克林根贝格市政府及本土志愿地方志团队、负责地球物理探测与三维建模的德累斯顿应用科技大学、负责元数据整理与档案保存的德累斯顿州立图书馆,以及提供技术落地支撑的阿普斯系统科技公司。

    项目聚焦当地丰富的本土遗存资源,包括手写地方志、古地图、老照片以及中世纪鲁普水堡遗址。项目融合人工智能文字识别、地球物理勘探、无人机三维建档、结构化数字归档等前沿技术,让珍贵脆弱的乡村文化遗产得以面向科研、教育与大众开放共享。

    项目的核心特色是全民参与、模式可迁移,将民间本土认知、高校学术研究与前沿数字技术深度融合,证明文化遗产数字化创新并非大城市专属。项目有效挖掘乡村隐藏的历史遗存脉络,整合碎片化史料,搭建可持续的乡村遗产数字资源库。鲁普村的实践不仅是单一案例研究,更为欧洲各类小型村镇实现代际遗产传承、数字化保护与共享传播提供了标杆模式。

图:德国鲁彭多夫的水上城堡遗址

12. BLACKAXES.DH

  • 项目全称:黑斧史前文物数字遗产保护项目

  • 牵头单位:爱沙尼亚塔尔图大学历史与考古研究所

  • 参与单位:卢森堡史前学会

  • 项目周期:2026年3月31日—2027年3月31日

  • 项目摘要:

    卢森堡绍尔河谷留存着大量史前地表文物遗存,均由民间考古爱好者长期搜集整理,并由卢森堡史前学会汇总建档,是欧洲稀缺的区域性史前考古资源。数十年的田野调查累计发现数千件石质文物,但绝大多数资源尚未公开发布,科研价值未能充分挖掘。BLACKAXES.DH项目延续前期数据研究成果,以迪基希地区乔斯·赫尔档案为首批核心资源,启动这批史前遗存档案的系统化数字化整理与公开共享工作。

    项目将数千条带精准地理定位的文物记录、配套地图与文字描述,整理优化为符合FAIR准则、可公开访问、语义互联互通的标准化数据集。项目联合科研人员、学生与民间考古爱好者,完成文物资源的系统建档与深度解读,还原史前土地利用模式与石器原料加工产业格局。同时,项目针对空间建模、文物智能识别与分类等前沿人工智能应用场景,完成数据集的适配优化。项目成果数字资源库将依托互通型遗产基础设施全网公开,将卢森堡民间考古遗产资源接入欧洲文化遗产协同云体系。通过开放小众民间考古档案的科研与保护渠道,BLACKAXES.DH项目充分证明,地方基层实践与民间知识储备,可深度融入欧洲全域文化遗产生态体系,为欧洲数字遗产建设提供多元支撑。

整理自官方网站:

https://www.echoes-eccch.eu/

经数字人文资讯小编翻译整理而成

如需转载 请后台私信联系

编辑 | 周柃妍

校对 | 洪冰凤

排版 | 魏翔

阅读原文

跳转微信打开

  •  

《人工智能伦理与文化参与:全球成果与中国创新》征稿启事

2026-07-10 08:30 湖北

《数字人文与智能计算》是两年一度的开放获取丛书,由泰勒-弗朗西斯(Taylor & Francis)出版集团旗下的Routledge出版社出版,武汉大学文化遗产智能计算实验室策划。该实验室成立于 2021 年,致力于开展文化遗产数字化、智能化活化利用的前沿研究。丛书立足全球视野,呈现物质与非物质文化遗产领域数字人文与智能计算的最新进展和发展趋势,内容兼顾学术研究成果与文化机构实践案例。继 2024 年推出首卷《文化遗产智能计算》、2026 年出版第二卷《文化遗产领域的人工智能与智慧数据:全球进展与中国方案》(AI and Smart Data for Cultural Heritage: Global Achievements and China’s Innovations)后,丛书第三卷现以 “人工智能伦理与文化参与” 为主题,面向全球公开征稿。

人工智能正深度融入科研、教育、文化生产、遗产阐释与日常数字基础设施的各个层面,由此催生的根本性议题已超越技术性能本身。当前人工智能伦理的讨论多聚焦于公平、透明、问责、偏差消解等核心原则,这些议题固然至关重要,但往往停留在抽象层面,未能充分回应人工智能系统的文化嵌入特性。数字人文视角为此提供了互补的研究进路,其核心立场是:人工智能绝非文化中立的存在。该视角主张,在人工智能的设计、评估与应用全过程中,必须持续以批判性眼光审视其运行机制中内嵌的价值观念、阐释框架与社会责任。

本卷对人工智能采取广义界定,既涵盖新兴的生成式模型与大语言模型,也包括长期支撑数字人文与文化遗产研究的各类成熟技术,如自然语言处理、计算机视觉、分类、聚类、语义技术、知识图谱、推荐系统等。所有技术均为互补性工具,不存在层级高低之分。我们所定义的 “文化参与”,是将文化价值、伦理反思与社会责任有意识、持续性地嵌入人工智能驱动系统的全生命周期,覆盖数据治理、模型设计、人机协作、部署应用到批判反思的完整链条。因此,本卷关注的不只是前沿技术本身,更是智能计算、文化数据与人文阐释三者之间的持久关联与互动。

征稿主题

我们欢迎围绕以下方向的投稿,包括但不限于:

  • 数字人文与文化遗产领域的人工智能伦理

  • 人工智能辅助阐释与文化理解

  • 文化研究中的人机协作

  • 档案馆、图书馆、博物馆及遗产机构的负责任人工智能实践

  • 文化遗产虚拟复原

  • 物质与非物质文化遗产的数字化呈现与活化

  • 数字策展、数字叙事与公众参与

主编团队

  • 王晓光,武汉大学信息管理学院院长、教授

  • 曾蕾,美国肯特州立大学信息学院教授

  • 高瑾,英国伦敦大学学院信息研究系数字档案方向讲师

  • 赵珂,武汉大学信息管理学院、文化遗产智能计算实验室助理研究员

内容框架与收录范围

本卷分为两大板块:全球创新路径与中国实践探索。各国 / 各地区作者既可撰写行业整体综述,也可结合具体案例针对特定主题展开深度分析。

  • 全球创新路径:本板块收录海外学者的研究成果,呈现人工智能伦理与文化参与领域的前沿理论框架、方法创新与典型案例。

  • 中国实践探索:本板块聚焦国内人工智能伦理与文化参与的研究进展,以及国内顶尖图书馆、档案馆、博物馆等文化机构的优秀实践案例。

我们鼓励作者专为本书撰写原创性论文。已发表成果、会议或工作坊论文经大幅扩充(新增内容占比不低于 30%)后,同样符合投稿要求。稿件定稿时,作者需自行取得所有相关内容的授权许可。

投稿格式要求

摘要

  • 字数:100-300 字

  • 表述要求:采用第三人称(如 “本章探讨”),避免使用第一人称表述

  • 内容要求:完整自洽,不得包含缩写、脚注或不完整的参考文献

作者信息

  • 姓名、所属单位、所在国家、50 字以内的个人专业简介

  • ORCID 号

  • 联系邮箱

全文

  • 字数:6000-12000 字

  • 格式规范:遵循 APA 第 7 版格式

  • 投稿语言:英文

  • 更多投稿细则将另行通知

关于人工智能生成内容的规定

请勿使用大语言模型、生成式人工智能、聊天机器人(如 ChatGPT)等人工智能工具生成本书章节内容,此举不符合劳特利奇出版社的作者身份认定标准。相关细则可查阅泰勒-弗朗西斯(Taylor & Francis)出版集团官方人工智能政策。

暂定日程

  • 2026 年 10 月 10 日:提交论文摘要,发送至赵珂(邮箱:kezhao@whu.edu.cn)

  • 2026 年 11 月:公布摘要录用结果

  • 2027 年 4 月 10 日:全文提交截止,稿件发送至赵珂(邮箱:kezhao@whu.edu.cn)

  • 2027 年 5 月:公布全文录用结果并反馈修改意见

  • 2027 年 9 月:修改稿提交截止

  • 2027 年 10 月:终稿确认

  • 2028 年:正式出版

以上内容来自官网

https://www.ucl.ac.uk/arts-humanities/information-studies/research/ai-ethics-and-cultural-engagement-global-achievements-and-chinas-innovations

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

阅读原文

跳转微信打开

  •  

会议通知 | 2026年首届大学生国际数字人文节

RUC信息资源管理 2026-07-10 08:30 湖北

以下文章来源于:RUC信息资源管理学院

RUC信息资源管理学院

中国人民大学信息资源管理学院官方微信平台,发布学院动态,致力于为每一个信管人构建与学院沟通的桥梁。

为促进全球青年在数字人文领域的深度交流与创新实践,中国人民大学信息资源管理学院与数字人文研究院将于2026年9月18日至20日在中国人民大学中关村校区举办2026年首届大学生国际数字人文节。

2026年首届大学生国际数字人文节

The 1st International Digital Humanities Festival for University Students

(IDHFUS 2026)

主题:遗产·记忆·视界

Heritage · Memory · Horizon

数字技术正以前所未有的力量重塑人类文明的记忆与表达。从古籍善本的数字复原到非物质文化遗产的交互再现,从海量历史数据的智能挖掘到跨文化叙事的可视化构建——数字人文正成为这个时代最富活力的交叉学科之一。

如果你对技术与人文的碰撞充满好奇,如果你有一个关于文化遗产、历史记忆或人文数据的创意构想,首届大学生国际数字人文节(IDHFUS 2026)正是为你而来!

为促进全球青年在数字人文领域的深度交流与创新实践,中国人民大学信息资源管理学院与数字人文研究院将于2026年9月18日至20日在中国人民大学中关村校区举办本次盛会。我们诚邀全球在校大学生携作品参展,同时欢迎青年教师、研究人员及数字人文相关行业专家参会交流,共同探索数字文明的无限可能。

一

组织单位

主办单位:

中国人民大学信息资源管理学院

中国人民大学数字人文研究院

指导单位:

联合国教科文组织世界记忆项目教育与研究分委会

世界互联网大会文化遗产数字化专委会

世界顶级信息学院联盟iSchools联盟

世界绿色设计组织(WGDO)

亚太数字人文教育协作委员会

国家文化科技创新服务联盟

二

活动安排

时间:2026年9月18日—9月20日

地点:中国人民大学中关村校区(北京)

语言:官方语言为中英双语

三

参与对象

本次活动开放两类参与方式:

◆ 参展者:全球在校大学生(个人或团队均可),提交数字人文相关作品参加展览与评奖。

◆ 参会者:青年教师、研究人员及数字人文相关行业专家,欢迎莅临交流。

四

参展要求

1

作品形式

请将作品提交至活动联系邮箱 (idhfus@ruc.edu.cn)。提交须使用本次活动的格式模板(附件1)。

参展作品须具备数字人文属性,鼓励提交以下类型的数字作品:

◆ 数据可视化成果、扩展现实(XR)作品、交互式网站或应用

◆ 数据集、软件工具、动画、游戏、视频等数字创作

2

语言要求

参展作品须以中文或英文呈现。为便于国际交流,所有作品(无论中英文)均须同时提交一份300字以内的英文摘要。

3

基本规范

参展作品须为原创,内容健康积极,遵守中国及作者所在国家(地区)相关法律法规。提交时须填写作品原创性及著作权声明、既往投稿情况说明、AI使用情况说明,具体见报名表。

4

赛道设置

参展者可选择以下任一赛道:

◆ 赛道1:自选主题(围绕“遗产·记忆·视界”自由创作)

◆赛道2:企事业单位命题(题目持续更新中,新增题目将陆续公布;具体说明见附件2):

(1)清代档案数字化呈现与传播

(2)科技档案的数字人文创新:知识融合、故事化策展与文化传播

(3)面向文化遗产教育的西安城墙AI交互式研学课程开发

(4)杂技非物质文化遗产的数字化开发

(5)浦江县档案馆上山文化档案知识挖掘及AI工具开发

(6)面向企业数字人文研发项目的微信自动询价响应工具开发

(7)基于非遗文化基因的 AIGC 文创设计工具

(8)博物馆线上虚拟展览智能策展工作流设计

(9)特色文献的多模态数字资源智能加工工具设计与实现

五

获奖权益

本次活动设有多项奖项,评委团由全球知名数字人文专家学者组成,为获奖作品颁发获奖证书。其它获奖权益如下:

✦ 奖金支持  评选设置奖金奖励

✦ 专业资源  专业工具授权与算力资源支持

✦ 媒体曝光  学术媒体与公众媒体同步推介

✦ 专家辅导  学术+技术专家一对一指导深度打磨作品

✦ 成果转化  对接文化数字化落地场景与成果孵化平台

✦ 案例入库 优秀获奖作品将纳入数字人文优秀案例库

✦ 学术发表 优秀获奖作品的相关研究论文将在《数字人文研究》期刊发表

六

学术期刊支持单位

《数字人文研究》

七

重要时间节点

节点

时间

作品提交及挑战赛报名(延期至)

2026年8月10日

早鸟报名截止(参会优惠票)

2026年8月20日

普通参会报名截止

2026年9月8日

活动举办

2026年9月18日—9月20日

注:早鸟优惠适用于普通观众参会票,具体价格将于正式通知中公布。

八

初步日常安排

日期

主要内容

备注

9月18日

开幕式及主旨报告;

数字记忆联盟成立大会及联盟成员项目展演;工作坊1;闭门会;学生作品展

详细议程见正式通知

9月19日

工作坊2;数字人文实验室开放日;青年沙龙;学生作品展

详细议程见正式通知

9月20日

闭幕式及颁奖典礼;学生作品展

详细议程见正式通知

九

联系方式

联系人:胡老师

联系电话:13021941288

电子邮箱:idhfus@ruc.edu.cn

数字人文不仅是技术与人文的简单相遇,更是一代青年对文明传承与创新使命的主动回应。期待与你相聚北京,共赴这场数字人文的国际盛会!

中国人民大学信息资源管理学院

中国人民大学数字人文研究院

2026年6月

转载自RUC信息管理学院公众号

已获授权

阅读原文

跳转微信打开

  •  

新书推荐|《文化遗产领域的人工智能与智慧数据:全球进展与中国方案》

2026-07-02 14:20 湖北

《文化遗产领域的人工智能与智慧数据:全球进展与中国方案》作为《数字人文与智能计算》丛书的第二卷,由泰勒-弗朗西斯出版集团旗下的Routledge出版社以开放获取形式出版。

一、书籍简介

《文化遗产领域的人工智能与智慧数据:全球进展与中国方案》(AI and Smart Data for Cultural Heritage: Global Achievements and China’s Innovations)作为《数字人文与智能计算》丛书的第二卷,由泰勒-弗朗西斯(Taylor & Francis)出版集团旗下的Routledge出版社以开放获取形式出版。本书探究人工智能与智慧数据为数字人文(DH)研究带来的范式转型,汇集亚洲、欧洲、北美及南美多地的研究成果,以全球视野展现文化遗产领域的创新研究方法与实践路径。

从大数据演进至智慧数据、迈入人工智能时代的发展进程中,数字人文研究者持续开拓全新的研究概念、方法范式与实践形态。智慧数据可依托任意规模的可信、情境化、认知型、预测性且可直接应用的数据提炼研究洞见;在人工智能的协同赋能下,智慧数据将持续在本领域发挥核心价值。本书兼顾理论路径与实践应用,系统呈现数字人文领域中人工智能与智慧数据赋能文化遗产的前沿进展与发展趋势,同时也为文化遗产场景下运用此类技术的批判理论、方法体系与实践探索做出了重要学术贡献。

对于深耕技术与人文研究交叉领域的数字人文研究者、文化遗产专业从业者及人工智能技术实践者而言,本书是不可或缺的核心参考读物。

二、编者简介

王晓光,武汉大学信息管理学院院长、教授,同时担任武汉大学文化遗产智能计算实验室主任与数字人文研究中心主任,研究方向涵盖数字资产管理、知识组织、语义出版及数字人文。

曾蕾,美国肯特州立大学信息科学系教授,获美国匹兹堡大学博士学位。曾担任国际图联(IFLA)标引与分类法委员会主席、国际知识组织学会(ISKO)理事、国际信息科学与技术学会 (ASIS&T) 理事、都柏林核心元数据组织(DCMI)顾问委员会主席及执行委员会委员、W3C 图书馆关联数据(LLD)工作组特邀专家成员、国际联盟 iSchools 数字人文课程委员会(iDHCC)主席等。其研究领域包括知识组织系统、元数据、语义技术与数字人文,累计出版专著6部,发表学术论文百余篇。

高瑾,伦敦大学学院(UCL)数字人文研究中心(UCLDH)联合主任,伦敦大学学院信息研究系数字档案方向讲师,兼任维多利亚与阿尔伯特博物馆研究员。研究聚焦数字人文史、网络分析、数字化、来源研究与数据标准领域。

赵珂,武汉大学信息管理学院、文化遗产智能计算实验室助理研究员。她拥有武汉大学信息资源管理博士学位、伦敦大学学院数字人文理学硕士学位,以及分获中国与韩国院校的艺术学学士、工学学士学位,研究方向聚焦数字叙事、数字人文与人机交互。

三、出版信息

  • 书名:《文化遗产领域的人工智能与智慧数据:全球进展与中国方案》(AI and Smart Data for Cultural Heritage: Global Achievements and China’s Innovations)

  • 主编:王晓光,曾蕾,高瑾,赵珂

  • 电子书出版时间:2026年5月25日

  • 出版地:伦敦

  • 出版社:Routledge

  • DOI:https://doi.org/10.4324/9781003666530

  • 总页数:396页

  • 电子书ISBN:9781003666530

  • 开放获取资助方:武汉大学

四、书籍目录

第一部分 全球创新路径

第1章

人文学科的开放数据应用——来自《开放人文数据期刊》的观察

作者:Barbara McGillivray, Daniele Borkowski, Andrea Farina, Simon Mahony, Xiaoguang Wang

第2章

智能体人工智能在社科与人文数据发现中的应用

作者:Vassilis Routsis, Yujian Gan, Sagar Uprety, Antonis Bikakis

第3章

基于Arches平台的文化遗产资源管理——面向资源清单与概念型叙词表的智慧数据方案

作者:Dennis Wuthrich, Philip Carlisle, Kevin Kochanski

第4章

协同网络环境下的智慧数据:建筑与城市空间图像获取

作者:Artur Simões Rozestraten, Giselle Beiguelman, Vânia Mara Alves Lima

第5章

作为数据基础设施的馆藏资源——德国与澳大利亚的实践视角

作者:Marco Humbel, Julianne Nyhan, Nina Pearlman

第6章

泰国社区档案与文化遗产数字化技术

作者:Pimphot Seelakate

第7章

利用非完美AI成果深化佛教典籍研究——以SAT文本数据库为例

作者:Kiyonori Nagasaki

第8章

文化遗产项目开发中的伦理设计考量

作者:Lala Hajibayova

第二部分 中国创新实践

第9章

从故纸遗存到活态内核——人工智能时代文献遗产的智能化发展研究

作者:Li Niu, Chi Jin, Anrunze Li, Rundong Hu

第10章

面向中国古琴减字谱释读的知识增强多模态大语言模型

作者:Cuijuan Xia

第11章

基于大语言模型的非物质文化遗产文本自动词性标注

作者:Zhixiao Zhao, Dongbo Wang

第12章

数字化再现与活化——面向中国青铜器图像智能生成的扩散模型微调研究

作者:Xilong Hou, Xiaoguang Wang

第13章

中国古代科技文献数据库建设与知识挖掘

作者:Xiang Zheng, Mingjie Li

第14章

智慧元数据视角下价值增值驱动的北京传统村落本体建模

作者:Chunqiu Li, Jie Guo, Jiayi Wang, Wirapong Chansanam, Chen Chen

第15章

故宫博物院馆藏数据的重构与增益

作者:Yipei Ye

五、章节简介

第1章

人文学科的开放数据应用——来自《开放人文数据期刊》的观察

Open Data Adoption Across the Humanities:Insights from the Journal of Open Humanities Data

数字人文研究规模持续拓展,数据驱动研究方法与开放研究理念已逐步成为领域共识。开放数据与智慧数据是这一转型的核心支撑,与英国、欧盟及全球层面的研究数据开放出版行动方向一致。作为人文学科领域规模最大的跨学科数据期刊,《开放人文数据期刊》(JOHD)过去六年间发展迅速,折射出学界对开放数据的关注度持续上升。期刊内容展现了不同学科的多元实践路径,但开放数据的采纳程度与管理模式仍存在显著差异,也为数字人文社群带来了值得深入探讨的重要问题。

本章通过对JOHD刊载成果中的开放数据实践开展量化分析,探究人文学科各领域采纳、共享与出版开放数据的现状。研究发现,不同学科在数据集类型、规模与生成方式上存在明显的不均衡性,地理分布层面也存在代表性缺口。研究结论明确了领域未来发展的关键方向,对数字人文领域的开放数据建设具有广泛启示:尤其揭示了人工智能与智慧数据应用的不均衡现状,阐明了人工-自动化混合工作流在应对标注复杂度问题上的核心作用,同时指出部分学科与数据类型存在严重的代表性不足。

Digital Humanities (DH) research has steadily expanded, embracing data-driven methods and open research principles. Open and smart data play a key role in this shift, aligning with UK, European, and global efforts to publish research data openly. The Journal of Open Humanities Data (JOHD), the largest interdisciplinary data journal in the humanities, has grown rapidly over the past six years, reflecting a rising interest in open data. Its content reflects the range of approaches across disciplines, though adoption and management of open data still vary widely, raising important questions for the DH communities. This chapter explores how various humanities disciplines adopt, share, and publish open data with a quantitative analysis of open data practices in JOHD publications. Findings show significant disciplinary asymmetries in dataset types, sizes, and generation methods. We also identify gaps in geographical representation. These findings highlight critical areas for future development and have broader implications for open data in DH, particularly by revealing the uneven adoption of AI and smart data, the essential role of hybrid manual-automated workflows in managing annotation complexity, and the significant underrepresentation of certain disciplines and data types.

第2章

智能体人工智能在社科与人文数据发现中的应用

Agentic AI for Data Discovery in the Social Sciences and Humanities

大语言模型的最新进展推动了多智能体系统的发展,使其能够处理愈发复杂的领域专属任务。本章介绍CORDIAL-AI项目——这是一项结合检索增强技术、以API为核心驱动的研究项目,可通过自然语言交互访问高度复杂、粒度精细的英国人口流动普查数据。系统通过分层智能体解析用户意图、检索相关元数据并生成可执行查询,能够适配繁杂的代码表、层级嵌套的地理区划与多维度变量。研究重点关注可解释性、数据来源追溯与元数据整合三大维度。

通过低秩适应(LoRA)进行微调的实验表明,只要配备充足的合成数据与专家标注训练语料,小型开源大语言模型的数据检索表现可接近专有模型水平。初步实证基准测试显示,模型在变量选择、地理实体识别与API调用准确率上均有提升。本章将研究结论置于数字研究基础设施的更广泛方法论讨论中,强调批判性系统设计、严谨的数据治理与以用户为中心的评估,是推动数据密集型研究负责任发展的核心。CORDIAL-AI这类系统降低了复杂数据集的使用门槛,为社会科学与人文领域的研究开辟了新的可能。在注重语境、阐释与透明度的学科领域,此类工具能够帮助研究者提出更具深度的问题,更清晰地追溯研究结论的生成过程。

Recent advances in large language models have enabled the development of multi-agent systems capable of handling increasingly sophisticated and domain-specific tasks. This chapter explores CORDIAL-AI, a retrieval-augmented, API-driven project that provides natural language access to highly complex and granular UK census flow data. Layered agents parse user intent, retrieve relevant metadata, and generate executable queries that navigate extensive code lists, hierarchical and nested geographies, and multi-dimensional variables. Particular attention is given to explainability, provenance, and metadata integration. Fine-tuning via low-rank adaptation demonstrates that small open-source LLMs can approach the data retrieval performance of proprietary models when provided with sufficient synthetic and expert-annotated training corpora. Preliminary empirical benchmarks show improvements in variable selection, geographic recognition, and API-call accuracy. These findings are situated within broader methodological discussions on digital research infrastructures, emphasising the importance of critical system design, rigorous data curation, and user-centred evaluation in advancing responsible practices in data-intensive research. Systems like CORDIAL-AI make it easier to work with complex datasets, lowering technical barriers and opening new possibilities for research across the social sciences and humanities. In fields where context, interpretation, and transparency matter, such tools can help researchers ask more nuanced questions and more clearly trace how findings are produced.

第3章

基于Arches平台的文化遗产资源管理——面向资源清单与概念型叙词表的智慧数据方案

Managing Cultural Heritage Resources with the Arches Platform:Smart Data for Resource Inventories and Concept-based Thesauri

即便依托现代技术,对实物遗存、考古遗址等文化遗产资源进行记录登记依然是一项难题。文化遗产对象与场所的语境化描述复杂度高,遗产资源阐释本身存在固有不确定性,这都对主流数据管理平台的能力提出了挑战。本章阐述 Arches平台(www.archesproject.org)如何通过数据架构、知识表示标准、信息管理工作流与系统集成能力,应对文化遗产信息管理的诸多挑战,为可扩展、高性能的智慧数据系统建设提供支撑。

Arches采用CIDOC-CRM等本体构建文化遗产资源的语义数据模型,通过定义信息类与属性,搭建具备语境化、认知性与预测性的数据结构。平台的数据管理、发现、传播与集成能力,能够为学者与遗产资源管理者提供可信、相关且可直接应用的信息。Arches采用模块化、可扩展的架构设计,本章将重点介绍其在遗产资源清单、叙词表与受控词表等权威数据管理场景下的具体应用。

Documenting cultural heritage (CH) resources such as physical objects and archaeological sites, even with modern technologies, remains a challenge. The complexities of describing CH objects and places in context and the inherent uncertainties that come with interpreting heritage resources stretch the capabilities of most modern data management platforms. This chapter describes how the Arches platform (https://www.w3.org/1999/xlink" xlink:href="https://www.archesproject.org">www.archesproject.org) implements data schema, knowledge representation standards, information management workflows, and systems integration capabilities that meet the challenges of managing CH information and support the creation of scalable and fast smart data systems. Arches implements ontologies, such as the CIDOC-CRM, to create semantic data models of cultural heritage resources. These data models define the information classes and properties needed to structure contextualised, cognitive and predictive data. The platform’s data management, discovery, dissemination, and integration capabilities deliver the trusted, relevant, and consumable information demanded by both scholars and CH resource stewards. Arches is a modular and extensible platform, and this chapter will highlight specific Arches data management applications for heritage inventories and authority data such as thesauri and controlled vocabularies.

第4章

协同网络环境下的智慧数据:建筑与城市空间图像获取

Smart Data in Collaborative Web Environments to Access Architectural and Urban Spaces Images

十五年来,ARQUIGRAFIA项目持续建设智慧数据资源,致力于巴西建筑与城市空间文化遗产的保存与开放获取。项目对实体图像馆藏进行数字化处理,同时开放用户自由上传数字图像,在此基础上搭建了一整套摄影信息表示与检索工具体系。为引导用户细致观察图像、对照片中的建筑与城市空间形成自主判断,ARQUIGRAFIA构建了一套基于造型-空间二元属性的建筑主观阐释内部体系。与此同时,项目还研发了知识组织系统,明确了描述图像的术语定义与术语间关联关系。

项目也持续孵化各类试点项目,例如将音频讲解与地理标记摄影图像相关联的“露天博物馆”项目。目前,项目团队与数字馆藏研究组合作开展人工智能技术实验,测试多种计算机视觉模型对ARQUIGRAFIA馆藏图像的分析效果。这些实验提取了艺术与设计维度的相关数据,挖掘出原始编目体系中未能呈现的馆藏解读层次。

For fifteen years, the ARQUIGRAFIA project has been creating smart data to preserve and enable access to the cultural heritage of Brazilian architecture and urban spaces. This path provided a set of tools for representing and retrieving photographic information, as a result of the digitisation of physical collections of images as well as digital images freely uploaded by users. The ARQUIGRAFIA has thus developed an internal system of subjective interpretations of architectures based on binomials of plastic-spatial qualities in order to encourage users to closely observe images and formulate judgments about buildings and urban spaces represented in photographs. Additionally, a Knowledge Organisation System has been developed, considering the definitions of terms and their interrelationships that describe such images. Synchronously, it has functioned as an incubator for pilot projects such as Open Air Museum, that associates audio messages with georeferenced photographic images. Currently, experiments with AI resources in partnership with the Digital Collections and Research team have tested different Computer Vision models to analyse the set of images available in the ARQUIGRAFIA. These experiments have collected data on art and design, uncovering layers of the collection’s legibility that were not evident in its original cataloguing.

第5章

作为数据基础设施的馆藏资源——德国与澳大利亚的实践视角

Collections as Data Infrastructures;Perspectives from Germany and Australia

参与国家及国际数字基础设施项目的文化遗产机构(图书馆、档案馆、博物馆、高校馆藏与植物标本馆等)有着怎样的实践经验?哪些因素推动或制约了文化遗产机构打通分散的馆藏数据孤岛?不同国家的影响因素存在何种差异?

2020年代初,全球掀起“馆藏即数据”(Collections as Data)基础设施的建设热潮,例如英国的“迈向国家馆藏”计划、欧盟的“欧洲文化遗产共同数据空间”项目,以及澳大利亚研究数据共享平台等。然而,尽管文化遗产机构是数字基础设施的核心数据供给方,目前仍缺乏跨国比较的定性研究来呈现机构的实践视角。厘清这一视角,有助于更深入地理解机构推进馆藏数据框架建设时面临的潜在且关键的挑战。

本章首次就馆藏即数据基础设施建设的国际经验展开对话研究,在英国相关调研结论的基础上,补充德国与澳大利亚两国文化遗产机构的两组焦点小组访谈数据。研究结论涵盖基础设施项目的顶层设计路径、学科文化差异、职业发展体系不足与伦理问题等多个维度。

What are the experiences of cultural heritage organisations (libraries, archives, museums, university collections and herbaria) participating in national and international digital infrastructure projects? Which factors enable and impede cultural heritage organisations in unifying siloed collections? How do these factors differ between countries? The early 2020s were marked by a surge of investments in Collections as Data infrastructures, such as made by the United Kingdom’s Towards a National Collection programme, the European Commissions’ Common European Data Space for Cultural Heritage, or the Australian Research Data Commons. However, despite cultural heritage organisations’ key role as data providers for digital infrastructures there is a lack of qualitative research comparing their perspectives internationally. Ascertaining such a perspective is necessary to better understand the latent and yet potent challenges that are encountered by institutions as they seek to advance collections data frameworks. This chapter takes the first steps in bringing international perspectives on Collections as Data infrastructure developments in conversation. Findings from UK consultations are advanced with data gathered in two focus group discussions held with cultural heritage organisations in Germany and Australia. The findings address issues in the way infrastructure programmes tend to be set up, divergent disciplinary cultures, deficiencies in professional development and ethics.

第6章

泰国社区档案与文化遗产数字化技术

Community Archives in Thailand and Digital Technology for Cultural Heritage

本章梳理了泰国社区档案的发展简史,并提出界定泰国社会档案特征的概念框架。尽管社区档案在泰国的整体存在感较弱,但部分社区档案已成为泰国社会中最具创新性的档案实践形态。作者通过文献研究,梳理了泰国社区档案与文化遗产馆藏建设中技术应用的相关案例,揭示了数字时代泰国社区档案运用数字技术开展档案工作的动因与实践路径。

This chapter presents a short history of community archives in Thailand and a conceptual framework for defining the characteristics of archives in Thai society. Although it seems that community archives are under-represented in Thailand, some community archives are found to be among the most innovative archives in society. The author uses a literature review to explore some Thai case studies on the usage of technologies in the provisioning and analysis of community archives and cultural heritage collections. The findings reveal the motives and methods of Thai community archives to use digital technology for their archival practices in the Digital Age.

第7章

利用非完美AI成果深化佛教典籍研究——以SAT文本数据库为例

Enhancing Buddhist Scripture Research with Imperfect AI Outcomes:A Case Study of the SAT Text Database

本章探讨如何将高精度AI光学字符识别(OCR)技术与国际图像互操作框架(IIIF)相结合,部署以文献为核心的检索增强生成(RAG)系统,借助“存在瑕疵但具备实用价值”的AI输出,切实提升佛教典籍研究效率。

研究以SAT大藏经文本数据库与社群编目平台为基础,将日本国立国会图书馆的AI-OCR技术应用于大型木刻大藏经图像数据集,实现了OCR识别文本与SAT带行号基准文本的逐段对齐。文本到IIIF图像的点击跳转功能,解决了长篇典籍中段落定位的“最后一公里”难题——即便OCR结果仍有残余误差,也可作为高效索引指向原始文献证据。本章公布了不同版本OCR的准确率基准,介绍了逐行渐进修正OCR结果的编辑工作流,并探讨了符合文本编码倡议(TEI)规范的异文记录方案。

此外,研究还推出了“Bauddha AI”RAG服务,可整合通过Apache Solr检索到的领域文献结论,生成带文献来源与链接支撑的内容摘要。作者认为,将存在瑕疵的OCR结果与权威文本对齐、以精选文献约束生成内容,二者结合能够构建可靠、可供学者核验的研究工作流。尽管该方法仍存在覆盖范围有限、多语种扩展不足、大语言模型表现不稳定等局限,但可迁移至其他人文学科领域,降低文献溯源与文献综述的成本。

This chapter examines how “imperfect yet practical” AI outputs can measurably enhance Buddhist scripture research by integrating high-accuracy AI-OCR with IIIF and by deploying a literature-centred RAG system. Building on the SAT Daizōkyō Text Database and a community curation platform, this study applies the National Diet Library’s AI-OCR to large woodblock Tripiṭaka image sets and implements passage-level alignment between OCR text and SAT’s line-numbered main text. Click-through navigation from text to IIIF images closes the “last-mile” gap of locating passages within long volumes, turning OCR – despite residual errors – into an efficient pointer to material evidence. The paper reports accuracy benchmarks across OCR versions, describes an editing pipeline that incrementally corrects OCR at the line level, and discusses TEI-conformant strategies for recording variants. Complementarily, it introduces “Bauddha AI”, a RAG service that synthesises findings from domain papers retrieved via Apache Solr, enabling sourced, link-backed summaries. The author argues that (1) aligning imperfect OCR with trusted texts, and (2) constraining generation with curated literature, jointly produce reliable, scholar-auditable workflows. While limitations remain – coverage, multilingual expansion, evolving LLM behaviour – the approach is portable across humanities domains and lowers the cost of source verification and literature synthesis.

第8章

文化遗产项目开发中的伦理设计考量

Consideration of Ethical Design in the Development of Cultural Heritage Initiatives

本章提出,知识表示、组织与发现系统的设计必须纳入伦理考量,因为这类系统同时兼具技术属性与社会属性。基于其社会技术属性,本章重点探讨这类系统如何体现、支撑与约束价值敏感设计(Value Sensitive Design)的核心价值,包括个人隐私尊重、所有权与财产权、无偏见原则、普遍可用性、信任机制、知情同意与环境可持续性。在人工智能技术飞速发展的当下,要推动这些价值落地,需要通过实证研究与理论建构,全面评估价值敏感设计在弥合社会价值与技术进步分歧方面的潜力。

In this chapter it is argued that ethical considerations in the design of knowledge representation, organisation, and discovery systems are essential, as these systems encompass both technical and social dimensions. Given their socio-technical nature, the focus of the discussion is an examination of how these systems embody, support, and constrain core values central to Value Sensitive Design, including respect for individual privacy, ownership and property rights, freedom from bias, universal usability, trust, informed consent, and environmental sustainability. To promote these values in this era of rapidly advancing AI, empirical inquiry and theoretical development are needed for thorough assessment of the potential of Value Sensitive Design to mediate potential divergences between social values and technological progress.

第9章

从故纸遗存到活态内核——人工智能时代文献遗产的智能化发展研究

From Dusty Pages to Living Essence:A Study on the Intelligent Development of Documentary Heritage in the Era of AI

本章探讨人工智能时代文献遗产的智能化转型路径,阐释其在保存与活化集体文化记忆中的核心作用。研究以文化计算与语义技术相关理论为基础,构建了包含模式、能力、资源三个维度的三维发展模型。该模型强调文化基因提取、知识逻辑组织与情境化用户服务三大核心。

本章借助大语言模型等前沿工具,回应遗产获取、语义理解与公众参与层面的核心挑战。研究以入选《世界记忆名录》的苏州丝绸档案为案例,展示了如何对历史文献进行语义结构化处理、嵌入动态知识网络,并通过智能化服务面向多元受众传递价值。研究表明,人工智能能够弥合认知鸿沟、提升阐释能力,推动文献遗产的可持续发展与创造性转化。本章最终提出,未来的文化记忆不应仅停留在保存层面,更应借助数字智能实现主动活化,让人们能够与历史建立更深入、更具价值的联结。

This chapter explores the intelligent transformation of documentary heritage in the era of artificial intelligence, highlighting its role in preserving and revitalising collective cultural memory. Drawing on theories of cultural computing and semantic technologies, it constructs a three-dimensional development model comprising the model, capability, and resource dimensions. The model emphasises the extraction of cultural genes, logical organisation of knowledge, and contextualised user services. Through advanced tools such as LLMs (Large Language Models), the chapter addresses key challenges in heritage access, semantic understanding, and public engagement. Using the Suzhou Silk Archives in the Memory of the World as a case study, it demonstrates how historical documents can be semantically structured, embedded in dynamic knowledge networks, and delivered through intelligent services to diverse audiences. The study illustrates the potential of AI (Artificial Intelligence) to bridge cognitive gaps, enhance interpretability, and promote the sustainable development and creative transformation of documentary heritage. Ultimately, this chapter advocates for a future in which cultural memory is not merely preserved but actively revitalised through digital intelligence, enabling deeper, more meaningful engagement with the past.

第10章

面向中国古琴减字谱释读的知识增强多模态大语言模型

A Knowledge-enhanced Multi-modal Large Language Model for Chinese Guqin Subtractive Notation Interpretation

古琴是中国最古老的传统乐器之一,音色雅致、文化象征意蕴深厚,是典型的多模态文化记忆资源。多模态大语言模型的发展,为多模态文化记忆资源的知识服务提供了新的解决方案。然而,对于古琴减字谱相关的文本、图像、音视频等特殊文化记忆资源,现有多模态大语言模型的知识表示能力仍需优化,才能达到预期效果。

本研究以多模态古琴减字谱资源为训练数据,结合古琴减字谱知识图谱,探索多模态大语言模型在文化遗产领域的垂直应用路径。研究的最终目标是借助生成式人工智能技术,通过知识增强的多模态大语言模型,帮助更多人理解古琴减字谱。本研究搭建的释读应用场景表明,大语言模型在解决判别类问题时表现优异;但在自然语言交互的生成类问题中,结合知识图谱技术与人类专家构建的形式化知识,能够显著提升大语言模型在垂直任务中的准确率、可靠性与专业性。

Guqin is one of the oldest traditional Chinese musical instruments, known for its refined sound and deep cultural symbolism as a typical multimodal cultural memory resource. The development of multimodal large language models (MLLMs) provides new solutions for the knowledge service of multimodal cultural memory resources. However, for the knowledge representation of some special cultural memory resources such as text, images, audio, and video resources related to the Guqin Subtractive Notation, the existing MLLMs need further optimisation to achieve the expected results. This study uses multi-modal Guqin Subtractive Notation resources as training data, and combines them with the Knowledge Graph of Guqin Subtractive Notation to explore a vertical application path of MLLMs in the field of cultural heritage. The ultimate goal of this study is to use the knowledge-enhanced MLLMs to help more people understand the Guqin Subtractive Notation with the help of Generative AI technologies. The practical construction of the interpretation application scenario in this study demonstrates that LLMs perform better in solving discriminative problems, but in addressing generative issues in natural language interaction, combining Knowledge Graph technology and the formalised knowledge generated by human experts can significantly enhance the accuracy, reliability, and professionalism of LLMs in vertical tasks.

第11章

基于大语言模型的非物质文化遗产文本自动词性标注

Automatic Part-of-Speech Tagging of Intangible Cultural Heritage based on Large Language Models

大语言模型引发了自然语言处理领域的技术变革,也推动了各垂直领域应用的发展。本研究探索将大语言模型应用于非物质文化遗产领域的自动文本标注——该领域拥有专业词汇体系与独特文化语境。

研究分为三个阶段:第一,从中国非物质文化遗产官方网站采集非遗文本数据,通过人机协作方式构建高质量标注数据集;第二,针对非遗文本设计零样本、单样本、少样本等不同提示格式的微调数据;第三,采用低秩适应(LoRA)与全参数微调两种方式,测试Qwen与GLM模型在不同训练数据量下的表现。与低秩适应相比,全参数微调对提示一致性的要求更高,鲁棒性更弱。研究结论为优化大语言模型的精准文本标注能力提供了参考,对非物质文化遗产及其他专业领域均具有借鉴意义。本研究凸显了微调策略、数据准备与指令结构设计对提升模型表现的重要价值。

Large language models (LLMs) have revolutionised natural language processing, enabling advancements in domain-specific applications. This study explores the use of LLMs for automatic lexical annotation in intangible cultural heritage (ICH), a field with specialised vocabulary and cultural context. The research follows three phases: (1) Collecting ICH data from China’s official Intangible Cultural Heritage website and creating a robust annotation dataset through human-machine collaboration. (2) Developing fine-tuning data with various prompting formats (0-shot, 1-shot, 3-shot) for ICH texts. (3) Evaluating Qwen and GLM models using LoRA and full-parameter fine-tuning to assess performance across training data volumes. Compared to LoRA, full parameter fine-tuning has higher requirements for prompt consistency and poorer robustness. These results provide insights into optimising LLMs for precise lexical annotation, with implications for ICH and other specialised fields. The study highlights the importance of fine-tuning strategies, data preparation, and instruction structuring in enhancing model performance.

第12章

数字化再现与活化——面向中国青铜器图像智能生成的扩散模型微调研究

Digital Recreation and Revitalisation:Fine-tuning Diffusion Models for the Intelligent Generation of Chinese Bronze Vessel Images

生成式人工智能技术为文化遗产的保护、修复与传播带来了新机遇。本章以中国青铜器为研究案例,探究生成式人工智能在图像智能生成领域的变革潜力,及其在文化遗产领域的创新应用路径。

研究构建了中国青铜器领域本体,实现青铜器图像的多维度语义表示;提出一种大语言模型辅助的人机协同语义标注方法,提升语义标注效率。在此基础上,研究利用低秩适应算法对Stable Diffusion模型进行微调,实现了高质量、风格统一的中国青铜器图像生成。微调后的模型在生成内容的视觉质量与图文匹配度上均有显著提升,为文物保护、修复与文化传播提供了新的工具与技术路径。最后,本章探讨了人工智能驱动图像智能计算的底层逻辑与实现路径,阐明其在推动文化遗产数字化再现与活化中的作用。生成式人工智能不仅深化了对文化文物的语义理解与计算分析,也推动了文化遗产智慧数据资源的建设,进而促进文化遗产的创新复用与活化发展。

Generative AI technologies bring new opportunities for the preservation, restoration, and dissemination of cultural heritage. Focusing on Chinese bronze vessels as a case study, this chapter investigates the transformative potential of generative AI in intelligent image generation and its innovative application within cultural heritage domain. A domain ontology for Chinese bronze vessels is constructed to enable muti-dimensional semantic representation of bronze vessel images. A human-AI collaborative semantic annotation method, enhanced by large language models, is proposed to improve the efficiency of semantic annotation. Furthermore, by leveraging the LoRA algorithm to fine-tune the Stable Diffusion model, this study achieves high-quality and style-consistent image generation of Chinese bronze vessels. The fine-tuned model significantly enhances both the visual quality and text-image alignment of generated content, offering new tools and technical pathways for artifact preservation, restoration, and cultural communication. Finally, this chapter discussed the underlying logic and implementation pathways of AI-driven intelligent image computing, and highlighting their role in facilitating the digital recreation and revitalisation of cultural heritage. Generative AI not only strengthens the semantic understanding and computational analysis of cultural artifacts, but also facilitates the development of smart data resources for cultural heritage, thereby advancing the innovative reuse and revitalisation of cultural heritage.

第13章

中国古代科技文献数据库建设与知识挖掘

Database Construction and Knowledge Mining of Ancient Chinese Scientific and Technological Documents

为保存中国古代科技文献、盘活历史资源、支撑中国科技史研究,本章建设并研究了中国古代科技文献数据库(ACSTDD)。数据库收录了1912年以前(不含1912年)天文、地理、农业、水利、数学、物理、化学、生物、医药等多个科技领域的古代文献,提供分类浏览、组合检索等功能,同时配备辅助学术研究的相关工具。

基于该数据库,本章开展古代科技文献书目提要的知识挖掘实践,以清代蚕桑、棉花类农书为例,实现了作者、内容、地理分布等维度的知识重组与可视化呈现。本章弥补了中国古代科技文献组织程度不足的研究空白。通过数据库对分散的历史资源进行系统化整理,突破了古代科技文献碎片化分布导致无法开展大规模比较研究的局限,为科技史跨学科研究开辟了新路径。

To preserve ancient Chinese scientific and technological documents, utilise historical resources, and support research in the history of Chinese science and technology, this chapter constructs and studies the Ancient Chinese Scientific and Technological Documents Database (ACSTDD). The database contains ancient documents from various scientific and technological fields, including astronomy, geography, agriculture, hydraulics, mathematics, physics, chemistry, biology, and medicine before 1912 ce (excluding 1912 ce). It provides features, such as classification browsing and combination search. The system also provides tools to assist academic research. Based on ACSTDD, this chapter carries out the knowledge mining practice of bibliographic summaries of ancient scientific and technological documents. This chapter uses sericulture, cotton, and mulberry agricultural documents in the Qing dynasty as examples to achieve knowledge reorganisation and visual presentation related to authors, content, and geographical distribution. This chapter fills the gap and addresses the issue of the insufficient organisation of ancient Chinese scientific and technological documents. The systematic organisation of these scattered historical resources through ACSTDD enables large-scale comparative studies that were previously impossible due to the fragmented nature of ancient Chinese scientific and technological documents, opening new avenues for interdisciplinary research in the history of science and technology.

第14章

智慧元数据视角下价值增值驱动的北京传统村落本体建模

Value Addition-driven Ontology Modelling of Beijing Traditional Villages from the Perspective of Smart Metadata

传统村落蕴含古建筑、民俗等丰富的乡村文化资源,凭借其历史、文化与艺术价值备受学界与社会关注。本章阐释智慧元数据的核心内涵,提出价值增值驱动的北京传统村落本体建模方案。从智慧元数据视角出发,对传统村落的海量历史文化资源进行系统化组织,能够推动“数据—信息—知识—智慧”的层级转化,实现文化的代际传承与价值提升。

本章从官方平台“中国传统村落数字博物馆”采集北京市国家级传统村落的相关数据,从多格式资源中提取事件、民俗、故事、文化发展、历史沿革等知识实体粒度的信息。所构建的本体定义了村落信息、文化遗产、社会关系、历史发展、地理空间五大核心类,用于规范描述村落相关维度的内容。在智慧元数据的理论指引下,通过打通传统村落各类资源的关联链路,清晰呈现村落文化资源间的内在互动关系。本章研究为传统村落文化知识发现与文化的历时性传承提供了参考思路。

Traditional villages are rich in rural culture resources, such as ancient architecture and folklore, and have attracted attention due to their historical, cultural and artistic value. This chapter explains smart metadata and proposes value addition driven ontology modelling for traditional villages in Beijing. From the perspective of smart metadata, organising the abundant historical and cultural resources in a traditional village facilitates the transformation of “data-information-knowledge-wisdom”, enabling intergenerational cultural inheritance and value enhancement. This chapter collects data on national-level traditional villages in Beijing from the official website named “Traditional Chinese Village Digital Museum”. Events, folklore, story, cultural development, history, and other information at knowledge entity granularity will be extracted from the collected resources in various formats. The proposed ontology in this chapter defines core classes to describe village information, culture heritage, social relation, historical development, and geography. With the guidance of smart metadata and the interconnections of traditional village resources, interactive relationships between village cultural resources are expressed. This chapter offers insights for the discovery of traditional village cultural knowledge and cultural inheritance over time.

第15章

故宫博物院馆藏数据的重构与增益

Reconstruction and Enhancement of the Palace Museum's Collection Data

本文以故宫博物院为研究案例,回应数字时代博物馆面临的信息管理挑战。研究在CIDOC CRM框架下,构建了适配中国古代文物的专属本体模型——中国古代文物概念参考模型。通过编制受控词表、引入知识图谱技术,将馆藏编目数据重构为标准化、结构化的知识图谱。

这一转型优化了故宫博物院馆藏线上平台的检索服务,提升了检索效率与双语检索能力。此外,结构化数据可与大语言模型深度融合,提升机器理解、逻辑推理与内容生成效果。故宫博物院的实践实现了博物馆知识的创新组织与馆藏数据的价值挖掘,将传统编目数据转化为可计算的三元组结构,适配人工智能时代的数据处理需求。本研究不仅提升了故宫博物院的信息管理效率,也为其他文化遗产机构提供了可借鉴的实践经验。

This paper, taking the Palace Museum as a case, addresses museums’ information-management challenges in the digital age. It explores the development of an ontology model, Ancient Chinese Artifacts Conceptual Reference Model, tailored for ancient Chinese artifacts within the CIDOC CRM framework. Controlled vocabularies are compiled, and knowledge graph technology is introduced to restructure collection cataloguing data into a standardised and structured graph. This transformation enables enhanced search services on the Palace Museum’s collection online platform, including improved retrieval and bilingual search capabilities. Moreover, it facilitates the integration with large language models for better computer understanding, logical reasoning, and content generation. The Palace Museum’s practice innovatively organises museum knowledge and extracts value from collection data, converting traditional cataloguing data into a computable triple structure, thus meeting the AI-era’s data-processing demands. This research not only boosts the Palace Museum’s information-management efficiency but also provides valuable insights for other cultural heritage institutions.

六、学者评价

武汉大学副校长陆伟在本书的新书发布会视频致辞中向伦敦国王学院给予本次发布会的支持表示感谢。他表示,该书的出版是武汉大学信息管理学院和文化遗产智能计算实验室在国际数字人文领域研究的重要成果。未来,武汉大学将持续推进跨学科创新与国际学术合作,为全球文化遗产的数智化转型与人类文明的可持续发展贡献出中国智慧与力量。

Graham Wynn在致辞中表示,KCL高度重视国际学术交流,此次新书发布会是两校深化合作的重要契机,期待未来双方在教学、科研和人才培养上持续拓展合作空间。

Carolyn Kirby表示,该丛书的持续出版彰显了数字人文领域的蓬勃活力,泰勒-弗朗西斯(Taylor & Francis)出版集团将继续支持这一开放学术成果的发表,推动全球范围内的知识共享与学术对话。

信息管理学院院长、文化遗产智能计算实验室主任、丛书主编王晓光教授表示,人工智能技术的快速演进正在深刻重塑数字人文的研究范式与方法路径。文化遗产智能计算实验室紧抓学术前沿机遇,组织编写并出版此书,汇聚四大洲40位学者的学术贡献,标志着实验室在国际学术协作网络建设上的进一步发展。未来实验室将继续深化跨国、跨学科的合作机制,推动丛书向着更具前瞻性和包容性的方向发展,为数智赋能文化发展提供中国方案。

以上内容来自书籍官网

https://www.taylorfrancis.com/books/oa-edit/10.4324/9781003666530/ai-smart-data-cultural-heritage-xiaoguang-wang-marcia-lei-zeng-jin-gao-ke-zhao

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编辑丨洪冰凤

校对丨罗斯鹏

排版丨魏翔

阅读原文

跳转微信打开

  •  

学术前沿 | 《迈向数智时代的中国数字人文自主知识体系建设》

王晓光 2026-06-26 08:30 湖北

《图书与情报》2026年第3期荐读

导语

今年正值习近平总书记“5·17”重要讲话发表十周年,《图书与情报》于2026年第3期策划了“构建中国信息资源管理学科自主知识体系”专题,邀请多位专家学者探讨学科自主知识体系构建过程中的若干关键问题,特别对相关二级学科方向的独特角色和作用及构建中国信息资源管理学科自主知识体系的学科建设、方法创新、实践探索等进行了深度解读。

今天推送武汉大学信息管理学院王晓光教授在该专题刊发的《迈向数智时代的中国数字人文自主知识体系建设》笔谈文章。

1 价值意蕴

在百年之未有大变局的时代背景下,构建具有主体性与原创性的中国哲学社会科学自主知识体系已经成为各学科发展不可回避的时代命题。伴随着人工智能的蓬勃发展,作为多学科交叉的新兴研究领域,数字人文愈加受到学界关注,但从现实进路来看,目前的数字人文研究在基础理论、知识结构与话语体系上,仍面临众多挑战和困惑。在文化强国战略下,如何借助数字人文专业和学科建设,进一步促进文化建设数智化赋能和信息化转型,值得学界认真思考。

(1)数字人文自主知识体系是文化强国建设的重要任务。2016年,习近平总书记在哲学社会科学座谈会上提出“不断推进学科体系、学术体系、话语体系建设和创新,努力构建一个全方位、全领域、全要素的哲学社会科学体系”,2022年进一步指出 “加快构建中国特色哲学社会科学,归根结底是构建中国自主的知识体系”。中国自主知识体系建设已经上升为国家战略,是新时代文化自信与文化强国建设的重要任务。中国的数字人文自主知识体系建设不单要回应数字人文作为一个交叉性学科的规范化发展需求,更要回答人工智能时代科技与人文融合发展的中国实践方向与路径在哪里的问题。自主知识体系建设必须突破对西方既有理论的路径依赖和单一性学科的执念,形成能够回应中国实践、解释中国经验、提出中国方案并具有国际对话能力的学术表达。

(2)数字人文自主知识体系是文化建设数智化转型的重要支撑。数字人文一直以文化资源与人文知识的数字化生产为核心议题。数智技术迅猛发展、快速迭代,推动社会整体由数字化向数据化、智能化跃进。国家“十五五”规划纲要提出“推动文化建设数智化赋能、信息化转型,发展新型文化业态”。文化和科技的深度融合已成为文化事业与文化产业发展的重要引擎,对数字人文领域的期待不仅是工具层面的更新要求,更是体系层面的重构命题。以多学科融合的理论、方法与技术构建数字人文研究探索的知识体系,解决文化资源数智化创新中的问题,解析人文社会数字化转型中的内在机理与治理逻辑已经成为数字人文领域不可回避的历史责任与时代命题。

(3)数字人文自主知识体系是推动信息资源管理学科高质量发展的重要抓手。党的十九届五中全会提出了“建设高质量教育体系”的战略导向。随后教育部新文科建设工作组发布《新文科建设宣言》,要求发扬科学精神,在充分发掘社会科学与自然科学、人文科学内部各学科间内在逻辑关联的基础上,打破传统学科间的壁垒,实现知识体系的联结渗透,以此引领顶层设计、专业设置与人才培养模式创新发展。在此背景下,信息资源管理学科在守正的基础上创新二级学科发展,推进学科生态体系与边界重塑,凝聚合力促进学科高质量发展。数字人文作为一个新兴交叉研究领域,方兴未艾,其研究问题要求融合信息资源管理与文史哲等多学科的理论、方法与技术,这对于创新和发展信息资源管理学科自主知识体系,并拓展其应用交叉空间具有重要意义。

2 目标原则

中国数字人文自主知识体系建设应当体现中国特色,解决数智时代文化创新发展的现实问题,满足学科内涵式发展的时代需求。在数智技术引发知识生产方式深刻变革的背景下,中国数字人文自主知识体系构建需要以继承性、民族性、系统性、原创性与时代性为基本原则,确立学科主体性、话语显示度与现实解释力。

(1)厚植中华优秀传统文化根脉的自主性构建。从建构主义视角,知识生成具有情境与文化嵌入性。任何知识体系都不是脱离具体历史语境而存在的抽象产物,而是在特定社会实践、制度环境与文化传统中不断建构和重塑的。数字人文作为“舶来品”,虽然其理论框架与研究范式受到西方知识传统的影响,但其进入中国后,与中华优秀传统文化深度结合,产生了重要的化学反应。特别是近年来,在习近平文化思想指引下,面对中华优秀传统文化创造性转化与创新性发展的时代任务,中国数字人文学界自觉将古籍、文物、遗址等文化遗产研究与现代数智技术相结合,在图情、文学、历史、考古、哲学等众多学科领域,提出了许多主题、内容和形式都十分新颖的数字人文研究项目,在历史场景虚拟复原、传统文化基因挖掘、标识性符号提炼、智慧数据资源建设和智能化阐释等方面取得了一系列重要的原创性学术成果,不仅为建设历史文化大数据和全景展示中华优秀传统文化提供了重要支撑,也形成了文化遗产数智活化的中国示范性方案。

(2)依托信息资源管理学科的协同性构建。自1949年罗伯托·布萨(Roberto Busa)借助计算机成功为1100多万拉丁文作品编制索引开始,数字人文研究就与图情行业实践和信息资源管理学科研究密切关联。从全球的数字人文研究项目实践来看,数字人文研究大概可以分为三类:一类是人文类数据资源建设和数字工具开发,这类研究可以称得上是面向人文领域的数智基础设施建设研究;一类是面向传统人文问题的新技术、新方法,特别是数智建模类研究,这类研究可以称为人文建模型探索研究;还有一类主要是面向由新兴数字技术带来的新型人文现象和问题的研究,包括数字劳工、数字交往、人工智能伦理、AI价值观对齐等主题,这类研究可以说是人文进路的数字现象研究。这三类研究的同步推进,意味着数字人文研究并不是一个独立的学科,而是一个多学科交叉的领地,这一点在早期的数字人文先驱学者中就有一定共识。所以,数字人文自主知识体系建设必须关注交叉性和协同性,发挥多学科力量。特别是在人工智能大发展和广泛应用的今天,信息资源管理学科因其对信息技术的天然亲近性和对信息资源利用的先天优势,应该扮演比以往更加重要的角色,以其独特的信息实践优势和数智能力,成为数字人文研究的重要力量。

(3)跨越多层次堆栈结构的系统性构建。发展数字人文不是在人文研究中进行简单的技术植入和工具应用。数字人文知识体系的建设离不开多维度多层次的变革。在数字人文堆栈结构中,计算机学科提供了计算思维和知识表示技术的创新,图情学科提供了文献资源数字化转化的理论与方法,以及数据挖掘、知识建模和文本计量的数字研究方法,历史、文学、艺术、哲学等学科则提供了观察问题的视角和范式创新场景。技术方法在人文问题中的深入应用,还离不开数字学术基础设施的建设,方法库与数据集的扩展,以及新兴学术平台,如文科实验室、专业学术期刊、专业学术会议的建设与运营,它们共同构成了数字人文蓬勃发展所必须的学术社群和学术生态。在这些新兴学术基础设施上,深入挖掘学术问题,凝练学术概念,进一步明确数字人文的核心研究议题,是数字人文知识体系建设的关键。近些年来,在数字人文的体系性发展过程中,一批数字人文实验室和研究中心陆续建成,为我国数字人文研究的可持续发展夯实了平台基础。一批关键研究主题,如数字记忆、数字叙事、文化遗产活化等也逐渐得到学界认可。

(4)面向全球视野与标识性概念的原创性构建。概念是人类的思维形式与认识成果,界定人对经验世界的理解,按照体系化逻辑联结的诸多概念构成了本学科描述领域现象、问题、任务和活动的话语体系。标识性概念的意义在于凝练、鲜明地表达了学科的核心议题与研究范畴,是自主知识体系“活的灵魂”,具有学科专门性与独特性。以往的数字人文研究中术语创新并不丰富,这主要源于数字人文的实践性强于理论性,在某些方面还没有提出具有解释力的标识性概念。面对人工智能带来的巨大变革,数字人文急需提出标识性概念,并在重大社会文化现象与现实问题上提供解决方案和理论框架,方能在哲学社会科学数智化变革中树立标志性旗帜、确立学术地位,并在势不可挡的社会数智化转型浪潮中彰显其学术价值。

面向数智化和全球化交织的新情境,中国的数字人文自主知识体系建设,必须在关注主体性的同时,积极开展全球对话,在人文领域高质量数据集建设、AI驱动的文化遗产保护与活化、文化遗产可信数据空间建设、数字文化体验设计与传播等全球性新兴议题上,提出全球公认的原创性概念和解决方案。为此,中国学界需要在吸纳、借鉴与创新之间找到平衡点,从新问题、新实践出发,提炼规律性理论,形成兼具学理深度与学科辨识度的原创性概念,以此为突破口,完成数字人文知识体系全球引领性建设。

3 行动路径

中国数字人文自主知识体系建设离不开学科体系、学术体系与话语体系三者的协同发展。三大体系是自主知识体系的功能外化,通过持续实践、协同互动成为构建自主知识体系的内生动力,也是衡量学科成熟度的重要尺度。

(1)以学科体系建设为锚点。作为一个交叉学科,数字人文与多个人文学科都关系密切。目前,数字人文的学科化建制取得了一定进展。从学术源头来看,数字人文相关研究与信息资源管理学科有着天然联系,大量的数字人文项目都与文献资源数字化和数字平台建设有关。但其作为典型的交叉研究领域,数字人文知识体系建设与整合工作存在多学科间的内在张力,随着传统人文学科对计算机技术的深度采用和融合,数字人文的学科定位存在一定不确定性。目前,在信息资源管理一级学科下建设数字人文二级学科的现实选择具有合理性,这与当代数字人文研究项目关注人文与文化领域的数智基础设施建设现实状况相符,同时也与数字文化产业蓬勃发展的趋势相符。数字人文学科建设不能只满足学科建设内在需要,更应该响应社会发展现实需求。数字人文应在数字文化产业发展中发挥其学术引领价值和理论指导作用,通过“科技+文化”的融合性和探索性研究推动数字文化产业创新发展。目前,数字人文作为一个二级学科,已经进入社科基金目录体系,其学科建制化发展不仅能正向发挥信息资源管理学科的辐射价值,也能反向促进信息资源管理学科在新时代哲学社会科学中的战略支撑作用。

数字人文学科建设应支撑新文科专业发展。信息资源管理相关的专业是典型的新文科专业。以武汉大学信息管理学院的数字文化本硕博贯通制实验班为例。该专业是响应国家文化数字化战略、勇担文化强国使命的表现,也是新文科建设的典型实践。数字人文的学科化建制,有利于推动文化和科技的深度融合,培养兼具人文素养、数据思维与数智能力的拔尖创新型复合人才,形成文化建设数智化赋能、信息化转型的生力军。

(2)以学术体系建设为保障。数字人文研究的实践性与应用性特征明显。发展数字人文离不开学术生态的系统化建设,包括学术期刊、学术论坛、专业协会和委员会、专业实验室、学术联盟、研究中心等学术平台的建设。数字人文作为一个跨学科研究领域,其学术体系的建设可以在各个相关学科内同步推进。目前,在中国多个一级学会中都已经成立了数字人文专业委员会,如中国索引学会下设的数字人文专业委员会、中国科学技术史学会下设的数字人文专业委员会。此外,多个数字人文研究联盟也已经成立,如数字人文机构联盟、数字人文专业发展联盟等。数字人文类实验室也在蓬勃发展,如武汉大学文化遗产智能计算实验室、中国人民大学数字人文研究院、北京大学数字人文研究中心等。在专业期刊建设上,国内也已经成立了《数字人文》和《数字人文研究》两本专业期刊。这些新兴的数字人文学术平台为中国数字人文研究事业的创新性发展奠定了坚实的学术平台基础,也为其可持续发展提供了巨大空间。

(3)以话语体系建设为关键。话语体系的核心是概念与术语体系。作为新兴交叉领域,数字人文的知识体系中借鉴和交织使用了来自多个传统学科的概念与术语,自有的概念与术语还不丰富,这就意味着数字人文知识体系,特别是基础理论还不够丰富和成熟。因此,未来的数字人文研究在借鉴、吸收相关学科必要概念的同时,应围绕数字人文实践活动,提出具有原创性和标识性的独特概念,并努力构建具有连续性、解释力和影响力的理论和话语体系。在话语体系构建过程中,应着重注意话语的时代性和专业性,突出创新性特征。要统筹把握中国数字人文自主知识体系建设的历史逻辑、民族特征与时代语境,在继承的基础上,努力围绕信息哲学、智能计算、文化数据、数字批判、沉浸式体验等当代数字人文研究的关键议题和新兴方法,提炼学术概念和理论命题,形成经得起历史检验的理论体系。

*参考文献略,详见原文。

*本文原载于《图书与情报》2026年第3期13-16页,作者:王晓光,转载自“图书与情报”微信公众号,已获转载授权。

阅读原文

跳转微信打开

  •  

学术前沿丨《计算文化遗产期刊 (JOCCH)》论文荐读

2026-06-20 13:35 湖北

《计算文化遗产期刊》(ACM Journal on Computing and Cultural Heritage, JOCCH)是由美国计算机协会(ACM)于2008年创办的季刊,为计算技术与文化遗产交叉领域的国际权威专业期刊,被SCIE、Scopus等主流学术数据库收录,2025年影响因子约3.1,位列JCR计算机科学跨学科应用分类Q3区;期刊聚焦数字人文、遗产三维数字化、AI文博应用等方向,实行严格的同行评议,年发文量仅约30篇,在该细分交叉领域具备较高的学术认可度。本期内容将选取JOCCH中的10篇论文进行介绍。

1.《嫦娥:中国古典敦煌舞蹈高质量动作捕捉数据集》

Chang-E:A High-Quality Motion Capture Dataset of Chinese Classical Dunhuang Dance

Zeyu Wang, Chengan He, Zhe Yan, Jiashun Wang, Yingke Wang, Junhua Liu, Angela Shen, Mengying Zeng, Holly Rushmeier, Huazhe Xu, Borou Yu, Chenchen Lu, Eugene Y. Wang

摘要:敦煌舞蹈源自列入联合国教科文组织《世界遗产名录》的莫高窟壁画,具有独特的文化价值,但目前面临数字化与保护的现实难题。本文介绍了全球首个面向敦煌舞蹈的开源综合动作捕捉(motion capture)数据集“嫦娥(Chang-E)”,该数据集涵盖8大类全身动作数据,总计收录40分钟的专业舞蹈内容(预览可访问:https://cislab.hkust-gz.edu.cn/projects/chang-e/)。

数据集包含三种数据格式:通过动作捕捉获取的骨骼数据、基于骨骼数据用机器学习生成的人体网格数据,以及现场录制的多视角视频。该数据集可支撑敦煌舞蹈文化的各类创意应用,一场沉浸式新媒体展览已验证了其实际应用价值。在数据集构建过程中,团队采用动作插补(motion inbetweening)算法拼接不同舞蹈片段以完成编舞,再通过时序重排技术将重新演绎的舞蹈序列与音乐同步,增强了歌舞表演的韵律感与协调性。此外,团队还为数字舞者的重构动作序列添加了视觉特效,呈现出契合佛教禅修与身体认知理念的艺术化视觉效果。

嫦娥数据集为敦煌舞蹈的数字保护与创意重构提供了基础支撑,不仅输出了高质量数据,也为未来的图形学与文化遗产研究提供了跨学科协作框架。

Abstract:Derived from the mural drawings in the UNESCO-listed Mogao Caves, Dunhuang dance has unique cultural value but faces challenges of digitization and preservation. In this article, we introduce the first open comprehensive motion capture dataset of Dunhuang dance, Chang-E, including full-body movements documented across 8 categories, totaling 40 minutes of professional dance (preview available at https://cislab.hkust-gz.edu.cn/projects/chang-e/). This dataset contains three formats: skeleton data acquired from motion capture, body mesh generated from skeleton using machine learning, and multiview videos recorded on site. The dataset supports various creative applications for Dunhuang dance culture, as demonstrated by an immersive new media exhibition. Through the curation process, we applied motion inbetweening algorithms to concatenate different dance sequences for choreography. Also, these reinterpreted dance sequences are synchronized with music using retiming techniques, augmenting the rhythms and harmony between the music and dance performance. Furthermore, we applied visual effects on the regenerated motion sequences of digital dancers, achieving artistic and appealing visual results echoing Buddhist discourses of meditation and bodily cognition. The Chang-E dataset enables digital preservation and creative reimagination of Dunhuang dance, offering not only high-quality data but also an interdisciplinary collaboration framework for future graphics and cultural heritage research.

图:中国古典敦煌舞蹈(嫦娥)数据集的生成流程与应用场景。我们采用动作捕捉技术录制舞蹈演员的敦煌舞蹈表演,将三维动作数据适配为蒙皮多人线性模型(Skinned Multi-Person Linear, SMPL)格式,并基于该数据集进一步完成舞蹈再创作与视觉特效制作。壁画图像取自敦煌莫高窟第112窟。舞剧图像出自《丝路花雨》。

Fig.The generation process of the CHinese classical DunhuANG dancE (Chang-E) dataset and its applications. We captured dance artists performing Dunhuang dance using motion capture technology, fitted the 3D motion data into Skinned Multi-Person Linear (SMPL) format, and further created reinterpretations and visual effects based on the dataset. The mural image is from Mogao Cave 112 in Dunhuang. The stage drama image is from Silk Road, Flower, and Rain.

2.《DeepHadad:利用合成数据提升受损铭文可读性》

DeepHadad:Enhancing Readability of Damaged Inscriptions with Synthetic Data

Andrei C. Aioanei, Jonathan Klein, Konstantin M. Klein, Regine R. Hunziker-Rodewald, Dominik L. Michels

摘要:历经数百年自然侵蚀,古代铭文已出现不可逆的重要文字信息流失,严重阻碍碑铭学研究,也造成了历史知识的大量空白。字母磨损、物理损毁等因素,往往会大幅降低铭文的可读性。

本文提出DeepHadad神经网络模型,该模型基于程序化生成的合成数据训练,通过位移图(displacement maps,DM)与图像到图像翻译(image-to-image translation)技术,对受损严重的古代铭文进行数字修复,提升其可读性。该模型得名于公元前8世纪中期哈达德(Hadad)雕像上著名的帕纳穆瓦一世铭文——这座受损玄武岩雕像上,部分位置仅残留极淡的文字痕迹。

本研究的核心难点在于缺少保存完好与受损状态的字形配对训练数据:每一个字形实例都具有唯一性,不存在不同侵蚀程度的对应样本。对此,团队通过模拟侵蚀过程生成合成训练数据,使神经网络能够成功泛化至真实数据场景。通过提取补全图并叠加至三维模型上,我们显著提升了哈达德雕像上几乎无法辨认的亚拉姆语铭文的清晰度。

定量与定性实验均证实,该方法能够复原那些原本会永久遗失、或仅能通过耗时漫长的人工工作修复的文字内容。本研究为前沿人工智能技术应用于古代文字遗产可读性提升开辟了全新路径,所提出的方法可助力重要铭文的全面研究,也彰显了人工智能辅助技术在古代文物修复与碑铭学领域的应用潜力。

Abstract:The deterioration of ancient inscriptions over centuries has resulted in irrevocable loss of vital written records, hampering epigraphic analysis, and creating significant gaps in historical knowledge. Factors such as eroded letters and physical damage often compromise the readability of these inscriptions. We present DeepHadad, a neural network trained on procedurally generated synthetic data that use displacement maps and image-to-image translation to digitally restore severely damaged ancient inscriptions to a more readable state. The network’s name is derived from the famous Panamuwa (I) inscription on the mid-8th century BCE Hadad statue, where, at certain places, only faint traces of letters remain on the damaged basalt statue. A key challenge in this work is the lack of well-preserved and damaged glyph pairs for training, as each glyph instance is unique and therefore not found in different states of erosion. We address this by generating synthetic training data through simulated erosion processes, enabling our neural network to successfully generalize to real data. By extracting and overlaying completion maps onto the 3D model, we significantly enhance the legibility of the barely recognizable Aramaic inscription on the Hadad statue. Quantitative and qualitative experiments confirm that our approach can recover textual content that would otherwise be lost or recoverable only through time-consuming manual work. This research opens a pioneering avenue for employing state-of-the-art AI to enrich the readability of ancient textual heritage. Our methodology facilitates a more comprehensive analysis of significant inscriptions and demonstrates the potential of AI-assistive technologies to advance the field of ancient restoration and epigraphic studies.

图:DeepHadad 网络架构。生成器(上方)由初始卷积层、下采样模块、自注意力模块、SPADE 模块以及带跳跃连接的上采样模块组成,用于重建受损的位移图。判别器(下方)采用卷积模块、自注意力层与残差模块评估重建质量。图例以不同颜色标注了各类网络层。

Fig. DeepHadad network architecture. The generator (top) employs initial convolution, downsampling blocks, self-attention, SPADE blocks, and upsampling blocks with skip connections to reconstruct damaged DMs. The discriminator (bottom) utilizes convolutional blocks, self-attention layers, and a residual block to assess reconstruction quality. The color-coded legend details the various layer types.

3.《基于可微渲染技术对已佚祭坛屏的虚拟重建研究》

Towards the Virtual Reconstruction of Physically Lost Altarpieces through Differentiable Rendering

Anna Pagès-Vilà, Imanol Munoz-Pandiella

摘要:人类对艺术创作及其保护的关注贯穿整个人类历史。正因如此,我们如今才能欣赏到来自不同时期、不同地域的艺术作品。但并非所有艺术品都能完好留存,大量作品因各类原因永久消失。为弥补这一损失,已佚艺术品的虚拟重建是计算机图形学与文化遗产领域共同关注的前沿研究方向。

现有相关研究多基于人工建模,或依赖大量现代照片完成重建。而在这项跨学科研究中,我们提出了一种全新的重建方法:仅依托留存的唯一一张历史图像,结合可微渲染(differentiable rendering)技术,对已损毁的祭坛屏进行三维重建。

此外,我们以西班牙巴尔斯市毁于西班牙内战的圣施洗约翰祭坛屏为案例,对所提方法进行了验证。该方法实现了祭坛屏主体浮雕的部分三维重建,结果无论对专业研究者还是公众都具有实用价值,能够帮助人们更好地理解作品的立体感与空间关系,是已佚文物虚拟复原领域的一项重要进展。

Abstract:The interest of human beings in artistic creation, and its preservation, has been a constant throughout history. Thanks to this, today we can enjoy works from various moments and origins. However, not all works have been so fortunate, and many have disappeared for various reasons. To mitigate this loss, the virtual recreation of lost works of art is an open topic of interest for the computer graphics and cultural heritage communities. In the literature, we can find works along this line that are based on manual modeling or the use of numerous modern photographs. In this interdisciplinary work, however, we present a new methodology for reconstructing destroyed altarpieces for which only a single historical image is preserved, leveraging modern techniques of differentiable rendering. Additionally, we test our methodology in the reconstruction of the altarpiece of Sant Joan Baptista (Valls, Spain) destroyed during the Spanish Civil War. Our approach results in the partial 3D reconstruction of the main reliefs of the altarpiece. These results are truly useful, both for experts and for the public, as they allow for a better understanding of its volumetrics and its relationship with space, representing an important step forward in the virtual recovery of lost artifacts.

图:本研究调整后的工作流程:相机参数需与拍摄照片的参数对齐,环境贴图可采用HDR照片或合成图像,参考图像由初始渲染结果与祭坛屏历史照片合成得到。

Fig.Our adaptation of the workflow: Cameras must align with the photographs, environment maps can be HDR photos or synthetic images, and reference images are created by combining initial renderings with photographs of the altarpiece.

4《LanternOperAR:在混合文创产品中融入中国哲学,以互动体验传播越剧文化》

LanternOperAR: Engaging Yue Opera Culture with Chinese Philosophy in Hybrid Gift through Interactive Experience

Ningning Xu, Yifei Chen, Teng Ma, Qinglin Mao, Xinlie Huang, Haibo Zhou, Xu Sun

摘要:越剧是中国传统的全唱式叙事艺术,承载着中国文化思想与深厚历史底蕴。在此背景下,文化场馆开始应用增强现实(Augmented Reality, AR)技术,以打破被动观赏的体验模式,让观众成为主动参与者。

本文以“LanternOperAR”为探索案例,这是一款融合阳明心学中国哲学理念、用于推广越剧文化的混合文创产品。我们结合实体交互界面与虚拟内容,打造沉浸式文化互动体验。具体而言,我们首先开展田野调查,探究越剧文化传播的机遇与挑战;基于专家访谈与公众线上调研结果,提炼出一系列设计目标,指导产品的设计与开发流程。

该方案融合了AI图像处理、生成式AI、信息可视化与游戏化设计,结合AR技术,在AR叙事与互动过程中生成并呈现文化知识。我们邀请20名受试者对LanternOperAR进行评估,收获了关于系统可用性与整体体验的正面反馈,也收集到了后续优化的建议。研究结论可为文化产品与文化应用设计提供参考,为文化研究者与从业者提供借鉴。

Abstract:Yue Opera is a traditional Chinese through-sung storytelling style that conveys Chinese cultural ideologies and historical depth. In this context, Augmented Reality (AR) has been adopted in cultural venues to break the passive watching experience, turning the audience into active participants. In this article, we present an exploratory case study of LanternOperAR, a hybrid cultural gift to promote Yue Opera with the Chinese philosophy of Yangmingism. We incorporate the tangible interface and virtual content to create an interactive cultural experience. Specifically, we conducted a fieldwork study to investigate the promises and challenges of promoting Yue Opera. Based on expert interviews and an online survey with the public, we derived a set of design goals to guide the design and development process. Our approach incorporates the application of AI image processing, generative AI, information visualization, and gamification with AR technology to generate and visualize cultural knowledge in AR-based narratives and interactions. We evaluated LanternOperAR with 20 participants and acquired some positive feedback on system usability and overall experience, as well as some suggestions for further improvements. Our findings provide insights into the design of cultural products and cultural applications as guidance for cultural researchers and practitioners.

图:视觉设计概览与参考图像收集成果。

Fig. An overview of visual design with reference image collection results.

5.《故事灵感站:通过参与式阐释深化观众与博物馆藏品的联结》

Story Inspiration Station: Deeper Engagement with Museum Objects via Participatory Interpretation

Simon Bowen, Hattie Rowling, David Kirk

摘要:交互技术为文化遗产场所与藏品的新型互动形式提供了可能,包括实现参与式阐释、生成多元叙事,进而对官方遗产话语形成补充与反思。

为探索这一潜力,我们开发了“故事灵感站”交互式博物馆展项,利用数字化博物馆藏品激发观众的沉浸式思考。借此我们得以研究:交互式展项如何助力观众深化与藏品的联结,如何通过观众探索自身与他人对藏品的反馈,实现藏品阐释的民主化。

通过对系统使用数据与观众提交内容(1514份提交内容)的内容分析,以及对观众访谈(8人)与问卷反馈(6份)的主题分析,我们总结了深化遗产藏品互动、打破主流话语的相关策略,并为其他希望通过数字技术支持博物馆藏品多元叙事互动的从业者提供了设计参考。

Abstract:Interactive technologies offer the potential to support new forms of engagement with Cultural Heritage sites and collections, including the possibility of participatory interpretation and the production of polyvocal narratives that might challenge the Authorised Heritage Discourse. To explore this potential, we developed Story Inspiration Station, an interactive museum exhibit using digitised museum objects to prompt reflective engagement among visitors. This allowed us to investigate how an interactive exhibit can enable and scaffold deeper engagement with objects and democratise their interpretation through visitors’ exploration of their own and other’s responses to them. Through content analysis of system use and visitor responses (1,514 submissions) and thematic analysis of visitor interviews (n= 8) and survey responses (n= 6), we provide insights into strategies for deepening engagement with heritage objects and for challenging dominant discourses and provide design considerations for others seeking to digitally support polyvocal engagement with museum collections.

图:内容分析所用藏品:豹首、蛇石、香炉与格里芬首。

Fig.Objects used in the content analysis: Leopard Head, Snake Stone, Incense Burner and Griffin Head.

6.《拓展研究视角:通过多模态图像丰富化提升视觉档案的可及性》

Expanding Perspectives to Improve Access to Visual Archives through Multimodal Image Enrichment

Karina Rodriguez Echavarria, Myrsini Samaroudi

摘要:本研究针对文化遗产领域大规模视觉馆藏(尤其是博物馆与档案馆藏品)检索效率低的核心痛点展开。研究的核心贡献是提出了一套多模态内容理解方法,适用于缺少相关元数据、难以实现高效检索的图像馆藏。

该方法采用人工智能辅助图像分类与统一的视觉-语言理解技术,结合视觉特征与语义上下文,生成丰富且有价值的元数据。该方法支持专业人员为大规模图像数据集添加专业与非专业两类标签,完成数据丰富化与可视化处理,符合可发现、可访问、可互操作、可重用(FAIR)原则。这套全新的工作流程通过网页端的搜索与浏览界面,能够让不同受众更便捷地获取这些视觉资料。

研究以布莱顿大学设计档案馆的玻璃底片数据集为案例进行验证,该数据集包含约10000张数字化图像,记录了20世纪的历史设计作品,此前未完成分类。通过人工智能驱动的工作流程,该数据集补充了专业与非专业信息,用户可通过二维、三维可视化界面以及文本检索功能搜索、浏览数据集。

研究还探讨了当前可视化方案在为大规模文化遗产视觉馆藏打造更高效检索浏览功能方面的优势与局限。结果表明,尽管三维可视化比二维可视化具备更多功能特性,但用户仍需要更多辅助才能实现与大规模数据集的有效互动。因此,检索界面需要同时支持交互操作、视觉提示与文本检索,以优化用户的检索体验。

Abstract:The research tackles key challenges for improving the discovery of large-scale visual collections within the Cultural Heritage (CH) domain, particularly in museums and archives. Its contribution is a multimodal content understanding approach designed for image collections that lack relevant metadata, which hinders effective discovery. The proposed method utilises AI-assisted image classification and unified vision–language understanding, combining visual features with semantic context to generate rich and meaningful metadata. The proposed approach enables experts to enrich and visualise large-scale datasets of image collections by assigning both expert and non-expert labels, aligning with the Findable, Accessible, Interoperable and Reusable (FAIR) principles. Thus, the novel workflow broadens access to this visual material for diverse audiences through search and browse interfaces in a web browser. The proposed approach is demonstrated using the previously unclassified Design Archives’ glass plate negatives dataset, which consists of approximately ~10,000 digitised images depicting 20th-century historical designs. Through an Artificial Intelligence (AI) driven workflow, the dataset is enriched with expert and non-expert information. Users can search and browse results using 2D and 3D visualisations, as well as text-based search. The research also explores the advantages and current limitations of the proposed visualisation approach in creating more meaningful search and browsing functionalities for large Cultural Heritage (CH) visual collections. The results demonstrate that while 3D visualisations offer more affordances than their 2D counterpart, users require further support to interact with the large-scale datasets meaningfully. Hence, there is a need for discovery interfaces that support interactivity, visual cues and text-based search to enhance the users’ discovery journey.

图:(左上)编号U-360-178-O的图像,©布莱顿大学设计档案馆设计委员会馆藏;(右上)编号ODD-to-4-O的图像,©布莱顿大学设计档案馆设计委员会馆藏;(左下)编号GB-1837-DES-DCA-30-2-412.14-O的图像,©布莱顿大学设计档案馆设计委员会馆藏;(右下)编号GB-1837-DES-DCA-30-2-467.2的图像,©布莱顿大学设计档案馆设计委员会馆藏。

Fig.(Top-left) Image U-360-178-O, © Design Council Archive, University of Brighton Design Archives; (Top-right) Image ODD-to-4-O, © Design Council Archive, University of Brighton Design Archives; (Bottom-left) Image GB-1837-DES-DCA-30-2-412.14-O, © Design Council Archive, University of Brighton Design Archives; and (Bottom-right) Image GB-1837-DES-DCA-30-2-467.2, © Design Council Archive, University of Brighton Design Archives.

7.《一种用于敦煌古文献碎片两两匹配的自监督学习方法》

A Self-Supervised Learning Approach for Pairwise Matching of Ancient Dunhuang Fragments

MingKun Chen, YanPing Xiang, Yutong Zheng

摘要:在古文献拼接领域,尤其是敦煌文献修复中,传统方法往往聚焦于完整文献或真实配对的碎片,而对孤立碎片的关注不足——这类碎片对文献修复同样至关重要。受自然老化与保存方式不当的影响,绝大多数敦煌文献都以碎片形式留存。传统上,学者需依托过往拼接经验指导孤立碎片修复,这一过程往往耗时数年且成效有限。

本研究提出了一种全新的自监督两两匹配方法,用于辅助学者完成文献碎片的数字拼接。我们构建了包含完整文献、真实配对碎片与孤立碎片的数据集,并设计了精细化的预处理方案,将专家知识作为隐式约束融入其中,无需人工标注。

研究提出了全新的特征编码方式——带方位信息的二进制弗里曼编码(Binary Freeman Code with Azimuth Information,BFAz编码),可为匹配提供鲁棒的特征依据。针对正样本稀缺、碎片相似度标注难度大的问题,我们提出了自增强策略:通过学习碎片全局特征生成监督信号,构建碎片组以建立正负样本关系,再通过孪生网络(Siamese network)量化两两碎片的相似度。

实验结果表明,该方法能够高效筛选出高概率的正确拼接候选对象,彰显了计算机辅助修复技术在考古研究中的应用潜力。

Abstract:In the field of ancient manuscript rejoining, particularly for Dunhuang manuscripts, traditional approaches often focus on complete manuscripts or real paired fragments while overlooking orphan fragments, which are equally critical for restoration. Due to natural degradation and improper preservation methods, most Dunhuang manuscripts survive only as fragmented remnants. Scholars have traditionally relied on prior rejoining experience to guide the restoration of orphan fragments, a process that often takes years and achieves limited success. In this study, we propose a novel self-supervised pairwise matching approach designed to assist scholars in digital fragment rejoining. We construct a dataset comprising complete manuscripts, real paired fragments, and orphan fragments and apply a detailed preprocessing scheme that integrates expert knowledge as implicit constraints without requiring manual annotations. A novel feature encoding—BFAz encoding (Binary Freeman Code with Azimuth Information)—is introduced to provide robust matching cues. To address the scarcity of positive samples and the difficulty of annotating fragment similarity, we develop a self-augmentation strategy that generates supervisory signals by learning global fragment features, forming fragment groups to establish positive and negative sample relationships. Pairwise similarity is then quantified using a Siamese network. Experimental results demonstrate that our approach efficiently prioritizes correct rejoining candidates, highlighting the potential of computer-assisted restoration technologies in archaeological research.

图:古文献修复学者传统人工碎片拼接方式与本研究提出的两两匹配辅助修复方式对比。

Fig.Comparison between the traditional manual fragment rejoining experience of ancient manuscript restoration scholars and the pairwise matching strategy proposed in this study.

8.《西班牙克鲁尼亚罗马城出土伊西斯雕像的虚拟重建:用于交互式虚拟现实体验的三维模型》

The Virtual Reconstruction of a Statue of Isis Unearthed at the Roman City of Clunia (Spain): A 3D Model for Interactive Virtual Reality Experiences

Bruno Rodriguez-Garcia, Laura Corchia, María José Zaparaín Yáñez, Lucio Tommaso De Paolis

摘要:本研究旨在推动摄影测量(photogrammetry)、三维建模、虚拟主体(Virtual Agents)、虚拟现实(Virtual Reality,VR)等技术在文化遗产保护、修复与传播领域的应用。为此,研究以系统化的完整流程,完成了一尊伊西斯女神罗马雪花石膏雕像的虚拟重建并进行了效果评估。

该雕像出土于西班牙布尔戈斯省的克鲁尼亚罗马城,年代约为公元2世纪。虚拟重建基于雕像残件,并结合其他现存的伊西斯女神形象对比参考,还原了雕像现存与缺失的全部特征。生成的三维模型可作为虚拟主体应用于交互式体验中。

此外,对模型的差异分析、细节分析与顶点集中度分析均取得了理想结果。研究在布尔戈斯博物馆开展了交互式虚拟现实体验测试,邀请60名参与者体验三维模型可视化效果,参与者的评价整体高度正面。对参与者反馈的聚类分析显示,行为模式差异主要与年龄、虚拟现实使用经验相关。该虚拟重建三维模型为开源资源,可免费下载使用。

Abstract:This research aims to contribute to the advancement of technologies applied to the conservation, reconstruction, and dissemination of Cultural Heritage, such as photogrammetry, 3D modeling, Virtual Agents, and Virtual Reality. To this end, the virtual reconstruction process of a Roman alabaster sculpture of the Goddess Isis is presented and assessed in a comprehensive and systematic procedure. Unearthed at the Roman city of Clunia (province of Burgos, Spain), the sculpture dates back to approximately the 2nd c. AD. The virtual reconstruction depicts both existing and missing features, based on the remains and comparisons with other extant representations of the goddess. The generated 3D model was designed to function as a Virtual Agent in interactive experiences. Moreover, discrepancy, detail and vertex concentration analyses of the model yielded satisfactory results. The visualization of the 3D model was tested in an interactive Virtual Reality experience at the Museum of Burgos with 60 participants, whose evaluations were highly positive. Clustering of participant responses revealed behavior patterns that were primarily associated with age and previous experience with Virtual Reality. The 3D model of the virtual reconstruction is open access and free to download.

图:重建流程总览。

Fig.Summary of the reconstruction procedure.

9.《结合版面分析、光学字符识别与生成式 AI 实现大规模报纸语料结构化数据自动提取》

Automating the Extraction of Structured Data from Large Newspaper Corpora Using Layout Analysis, OCR and Generative AI

Nikos Kontonasios, Yannis Tzitzikas, Pavlos Fafalios

摘要:历史报纸是记录时代文化、社会、经济与政治面貌的珍贵资料,能够为研究历史事件与社会日常生活提供独特视角。但受限于传统研究方法(需人工逐页、逐篇查阅),这类档案的价值尚未得到充分挖掘。数字档案的出现一定程度上改善了资料的可及性,但由于缺少有效的内容解析与分析工具,仍难以支撑大规模历史研究。

光学字符识别(Optical Character Recognition,OCR) 技术是将扫描图像转换为可检索文本的基础,但仅靠OCR无法应对历史报纸的复杂情况——这类报纸往往存在图像质量退化、字体不统一、版面布局复杂等问题。同时,对报纸内容进行有效的分割与排序,是从特定报纸版面中提取结构清晰、逻辑有序数据的关键。

本文聚焦于一套完整技术管线(pipeline)的开发,以解决上述难题,并以法国《马赛信号报》(Le Sémaphore de Marseille)为案例(涵盖1827-1944年共35703期报纸)展开研究。所提出的系统整合了版面分析、OCR与生成式AI信息提取技术,从扫描图像中提取特定数据元素(本研究为船舶到港数据),并存储为机器可读格式以供后续分析。

结构化的输出结果能够帮助历史学家更高效、更大规模地分析历史贸易模式、经济趋势与区域互动情况。对系统核心组件的评估验证了方案的有效性:段落分割与信息提取的F1值达到96%,同时也指出核心的OCR模块仍有进一步优化的空间。

Abstract:Historical newspapers are invaluable resources that capture the cultural, social, economic and political dimensions of their time, providing unique insights into past events and daily life. However, the potential of these archives remains underutilised due to the limitations of traditional research methods, which rely on laborious manual examination of individual pages or articles. Digital archives have begun to address this issue by enhancing accessibility, but the lack of effective tools for parsing and analysing the contents still restricts their utility for large-scale historical research. Optical Character Recognition (OCR) technology plays a foundational role in converting scanned images into searchable text. However, OCR alone cannot adequately handle the complexities of historical newspapers, which often feature degraded image quality, inconsistent typography and intricate layouts. In parallel, the effective segmentation and ordering of newspaper content is essential for generating well-structured and logically ordered data from specific newspaper sections. This article focuses on the development of a pipeline that addresses these challenges, using the daily newspaper Le Sémaphore de Marseille as a case study (35,703 issues covering the period 1827–1944). The proposed system integrates layout analysis, OCR and Generative AI-driven information extraction techniques to extract specific data elements from scanned images, namely ship arrivals data, and to store them in a machine-readable format for further analysis. This well-structured output enables historians to analyse historical trade patterns, economic trends and regional interactions more efficiently and at a much larger scale. An evaluation of the key pipeline components demonstrates the effectiveness of the system, achieving an F1-score of 96% in paragraph segmentation and information extraction, while also highlighting the need for further improvement in the critical OCR component.

图:Arcanum系统识别出的版面区块示例。1850年1月11日的报纸版面(原始报纸图片来源:(retronews.fr))。

Fig.Example of the blocks identified by Arcanum. Issue of January 11, 1850 (source of original newspaper image: [retronews.fr]).

10.《基于扩散语言模型优化中国文物图像描述生成效果》

Improving Image Captioning for Chinese Cultural Relics with Diffusion Language Models

Chenggang Mi, Yu Li

摘要:精准详实的图像描述是中国文物记录与文化传播的核心基础,但受领域特殊性与“图像-描述”配对数据严重稀缺的限制,该任务发展受阻。尽管配对的图文数据有限,但相关文物领域的文本资料存量十分丰富。

本文提出了一套全新的中国文物图像描述生成框架,利用扩散语言模型(Diffusion Language Models,DLMs)有效挖掘海量领域文本的价值。该方法首先在大规模领域文本语料上预训练扩散语言模型,让模型习得领域专属的语言知识;再基于有限的配对图文数据,结合视觉特征对预训练模型进行微调。

实验结果表明,与未利用领域文本、或文本利用效率较低的方法相比,该策略显著提升了描述生成的效果。本研究彰显了扩散语言模型在利用现有领域文本、解决复杂视觉-语言生成任务数据稀缺问题上的优势,可为文化遗产文献记录及更广泛的自然语言处理应用提供有价值的工具支持。

Abstract:Accurate and detailed image captioning is crucial for documenting and disseminating knowledge about Chinese cultural relics, yet this task is severely limited by its domain-specific nature and the acute scarcity of paired image-caption data. While paired visual-text data is limited, substantial volumes of domain texts about these relics often exist. We propose a novel framework for Chinese cultural relics image captioning that effectively leverages this abundant domain texts using diffusion language models (DLMs). Our approach involves pretraining a DLM on the large corpus of domain texts to instill domain-specific linguistic knowledge, followed by fine-tuning the pretrained DLM on the limited paired image-caption data, conditioned on visual features. Experiments demonstrate that this strategy significantly boosts captioning performance compared to methods that do not exploit the domain texts or use them less effectively. This work highlights the power of DLMs in leveraging readily available domain text to overcome data scarcity for complex vision-language generation tasks, offering a valuable tool for cultural heritage documentation and broader natural language processing applications.

图:注意力模式可视化。(a)青铜礼器大克鼎的原始图像。该文物为上海博物馆馆藏。官方馆藏记录可查阅上海博物馆档案,文物图像的更多细节与社群整理资料可参考百度百科词条。(b)展示模型注意力集中在“饕餮纹”区域的情况。(c)展示模型注意力集中在“三足底座”的情况。完整描述为:“一件商代青铜鼎,用于祭祀仪式,以醒目的饕餮纹与三足底座为典型特征。”

Fig.Visualization of attention patterns. (a) is the original image of the bronze ritual vessel-Da Ke Ding. This artifact is part of the Shanghai Museum’s collection. For official museum records, see the Shanghai Museum documentation. For additional details and community-sourced documentation regarding this cultural relic image, please consult the Baidu Baike entry. (b) shows the model’s attention focused on the “Taotie designs” area. (c) illustrates the model’s attention concentrated on the “tripod base.” The full caption is: “A bronze Ding from the Shang Dynasty, used for ritual purposes, is characterized by its prominent Taotie designs and a tripod base.”

以上内容来自期刊官网

https://dl.acm.org/journal/jocch

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编译丨洪冰凤

校对丨罗斯鹏

排版丨魏翔

阅读原文

跳转微信打开

  •  

新书推荐|《中世纪手稿的数字化:圣查德福音书的物质性、复原与2D&3D再现》

2026-06-12 14:25 湖北

Bill Endres 的Digitizing Medieval Manuscripts: The St. Chad Gospels, Materiality, Recoveries, and Representation in 2D&3D 以八世纪 St. Chad Gospels 为核心个案,讨论中世纪手稿数字化如何服务于文本恢复、物质性研究、保存实践与知识再呈现。

一

内容介绍

Bill Endres 的《中世纪手稿的数字化:圣查德福音书的物质性、复原与2D & 3D再现(Digitizing Medieval Manuscripts: The St. Chad Gospels, Materiality, Recoveries, and Representation in 2D & 3D )》以八世纪 St. Chad Gospels 为核心个案,讨论中世纪手稿数字化如何服务于文本恢复、物质性研究、保存实践与知识再呈现。全书的研究目的在于说明,数字图像并非单纯的复制品,而是一种能够揭示手稿历史层累的研究工具。作者关注羊皮纸、墨水、颜料、磨损、擦除、褪色、装订变形等物质痕迹,试图通过光学成像与后期处理,重新读取肉眼难以辨识的信息,并由此推进古文献学、书籍史和数字人文之间的对话。

本书的创新点首先体现在方法整合上。作者将多光谱成像、替代色彩空间、反射变换成像、历史照片比对和三维呈现结合起来,展示不同技术如何分别处理文字恢复、表面细节观察、颜料损耗追踪和页面形态分析等问题。其次,作者强调开放源代码软件和可操作流程,使高级成像不只属于大型实验室,也能进入普通中世纪研究者的工作方法。最后,本书把技术问题放回手稿的宗教、文化和伦理语境中,讨论文物、开放获取、社区互惠和数字授权等问题,避免把数字化理解为纯粹技术工程。

从研究方向看,本书属于数字手稿学、计算古文献学和物质文本研究的交叉领域。它既面向损毁文本的恢复,也面向手稿长期保存和数字替代物的批判评估。作者尤其关心二维图像的限制,并进一步探索三维成像和虚拟现实作为新型知识空间的可能性。其价值在于提醒研究者,数字化手稿研究的核心并非追求更清晰的图像本身,而是通过图像、算法和物质性分析,重新理解手稿作为历史物、宗教物和知识媒介的复杂生命。

二

作者介绍

Bill Endres

比尔·恩德雷斯(Bill Endres),数字人文学者,2009年获亚利桑那州立大学博士学位,现任美国俄克拉荷马大学英语系副教授。其核心研究方向是用数字技术挖掘中世纪早期手稿的物质性,不只关注文字内容,更聚焦纸张、刻印、笔迹等肉眼难以察觉的实体特征。至今仍保留着诗歌与修辞学方向的研究兴趣,这也是其早期学术背景的重要组成部分。

研究主线:用数字技术挖掘中世纪早期手稿的物质性,不只关注文字内容,更聚焦纸张、刻印、笔迹等肉眼难以察觉的实体特征。

研究对象:主攻英国利奇菲尔德大教堂藏的公元 8 世纪《圣查德福音书(St Chad Gospels)》,同时覆盖公元 600-850年不列颠群岛产出的所有岛屿手稿(Insular manuscripts)。

研究技术:运用多光谱成像、反射变换成像和高精度 3D 捕获技术开展工作;其中 RTI 可识别无墨干刻的隐形文字,3D 扫描精度达 0.05 毫米,还会通过对比不同年代的数字化图像追踪手稿老化情况。

学术成果:出版专著《Digitizing Medieval Manuscripts: The St Chad Gospels, Materiality, Recoveries, and Representation in 2D & 3D》,并配套发布问答拓展文章《Collecting Light: Q&A with Bill Endres》;搭建学术网站Manuscripts of Lichfield Cathedral,免费开放《圣查德福音书》和《威克利夫圣经(Wycliffe Bible)》的知识共享资源;开发了《圣查德福音书》VR 体验测试版。

学术著作

专著

  • Digitizing Medieval Manuscripts: The St Chad Gospels, Materiality, Recoveries, and Representation in 2D & 3D, Arc Humanities Press, 2019.

期刊论文

  • “Digitization as Scholarly Intervention and Interpretive Act: A Case for 3D Capture in Studying the Agency of Materiality,” Manuscript Studies, 2025.

  • “The St. Chad Gospels: Ligatures and the Division of Hands,” Manuscripta, 2015.

  • “Imaging Sacred Artifacts: Ethics and the Digitizing of Lichfield Cathedral's St Chad Gospels,” Journal of Religion, Media & Digital Culture, 2014.

书籍章节与会议论文

  • (与Jenna Gorlewicz合著) “Haptics and Digital Codicology: Reimagining Tactile Experience in the Study of Manuscripts,” 收录于 Approaches to Digital Codicology: Interdisciplinarity and Intersections, 2025.

  • “A Manuscript Wanders into VR: Oh My!,” 收录于Insular Art at the Crossroads: Ninth International Insular Art Conference 2022, 2025.

  • “Oh Lord, make haste to help me: Prayer and Imagery Atop Canon Table II in the Book of Kells,” 收录于An Insular Odyssey: Manuscript Culture in Early Christian Ireland and Beyond, 2017.

  • “A Literacy of Building: Making in the Digital Humanities,” 收录于Making Humanities Matters, Debates in the Digital Humanities Series, 2018.

  • “More than Meets the Eye: Going 3D with an Early Medieval Manuscript,” 收录于Proceedings of the Digital Humanities Congress 2012, 2014.

三

出版信息

作者:Bill Endres

出版社:Arc Humanities Press

出版时间:2019年(电子书)/2023年(实体书)

丛书系列:Medieval Media and Culture

ISBN:9781802701227

四

书籍目录

导论 

视觉奇观的时代——物质性的数字化与光之解密

第一章 

复原:从多光谱成像到替代色彩空间

第二章 

反射变换成像:表面细节的增强观察

第三章 

原本不可知之物:历史照片的数字化与比较

第四章 

神圣器物:开放获取、权力、伦理与互惠

第五章 

知识空间的危机?——虚拟现实之展望

五

章节简介

导论 

视觉奇观的时代——物质性的数字化与光之解密

The Age of Visual Wonder: Digitizing Materiality and Unriddling Light

导论为全书建立理论框架和问题意识。作者从手稿随时间变化的物质状态谈起,指出羊皮纸、墨水、颜料、磨损、擦除、水损和褪色都使手稿成为有待重新辨读的历史对象。以 St. Chad Gospels 为核心案例,导论说明该手稿不仅保存了福音书文本,也保存了关于制作地点、书写者、艺术家、颜料层、边注、旅行经历和损毁过程的多重线索。作者的基本关切是,数字化不能停留在图像复制和在线开放层面,还应进一步进入手稿物质性分析。通过将视觉信息转化为数值,研究者可以运用数学处理、光谱成像和三维呈现来发现肉眼难以辨认的内容。导论同时批判二维图像的局限,强调手稿页面并非平面图像,而是具有厚度、弯曲、反光、纹理和损耗轨迹的三维物体。作者由此提出全书的主轴,即以数字成像技术恢复和保存手稿物质性,并在技术、伦理和知识空间三个层面重新理解中世纪手稿。

第一章 

复原:从多光谱成像到替代色彩空间

Recovery: From Multispectral Imaging to Alternative Colour Spaces

第一章集中讨论受损文本和图像的数字恢复方法。作者首先回顾早期使用化学试剂恢复褪色文字的传统,指出这类做法常常对手稿造成不可逆损害。随后,作者转向以光学性质为基础的非侵入式恢复路径,重点说明多光谱成像如何通过紫外、可见光和红外等不同波段捕捉页面反射信息。以 St. Chad Gospels 中水损文字、擦除文字和颜料残迹为例,作者展示了不同材料对不同波长光线的吸收和反射差异。铁胆墨、羊皮纸、碳基墨水和颜料层在光谱中的表现并不相同,恢复效果必须根据具体物质条件判断。本章的一个重要贡献是将高级成像与可操作的后期处理结合起来。作者讨论 ImageJ、替代色彩空间、数学运算、假彩色和去相关拉伸等方法,说明普通彩色图像甚至手机照片也可能通过适当处理产生有价值的恢复结果。此章的核心方向是建立一种可推广的恢复流程,使中世纪研究者能够理解图像、光线和材料之间的关系,并据此选择合适的数字方法。

第二章

反射变换成像:表面细节的增强观察

Reflectance Transformation Imaging: An Enhanced View of Surface Details

第二章讨论反射变换成像在手稿表面细节研究中的作用。与第一章重在恢复受损文字不同,本章关注页面表面起伏、压痕、刻写、墨迹隆起和颜料层状态。作者特别强调干笔书写的重要性。干笔书写通常用尖笔在页面上刻出痕迹,没有墨水,因此在普通光照下极难观察。RTI 通过从多个方向记录光线照射下的表面反应,使研究者能够在数字界面中改变虚拟光源方向,从而凸显细微凹凸。作者采用 highlight RTI 方法,以手持闪光灯模拟半球光源装置,这使该技术更易于实施,也降低了设备门槛。本章不仅说明 RTI 可用于辨认难读的干笔文字,还展示其对格线、压印、墨水和颜料隆起、页面局部损伤等问题的分析价值。其研究意义在于把手稿表面从被动背景转化为可读信息来源。页面的微小物理变化可以揭示书写过程、校订方式、使用痕迹和保存状态,因此 RTI 为古文献学、书籍史和保护研究提供了更细密的观察手段。

第三章 

原本不可知之物:历史照片的数字化与比较

The Otherwise Unknowable: Digitizing and Comparing Historical Photographs

第三章把历史照片纳入数字手稿研究,讨论早期摄影资料在追踪手稿老化和保护史方面的价值。作者指出,新的数字图像并不必然比旧照片包含更多历史信息,因为手稿在过去一百多年中可能已经失去颜料、文字痕迹或页面形态。早期照片记录了手稿在某一时刻、某种光照条件和某种摄影技术下呈现出的状态,因此可以成为分析长期变化的证据。本章以 St. Chad Gospels 的 1887 年照片、photostat 副本、彩色幻灯片、黑白照片和 2010 年多光谱成像项目为材料,说明如何将历史照片数字化、对齐、叠放和调节透明度,以观察颜料脱落、页面压平、边缘变化和过去修复处理的影响。作者也提醒读者,摄影本身具有技术限制,不同相机、镜头、光源和处理方式都会影响图像结果。因此,比较历史照片既能产生关于手稿老化的新知识,也能训练研究者批判性地看待图像证据。本章的研究方向是把摄影档案转化为时间序列材料,使数字化成为研究手稿生命史和保存状态的工具。

第四章 

神圣器物:开放获取、权力、伦理与互惠

Sacred Artefacts: Open Access, Power, Ethics, and Reciprocity

第四章转向数字化的人文和伦理维度,讨论开放获取、权力关系、版权、社区利益和互惠原则。作者认为,对于仍然服务于特定宗教共同体的手稿,研究者不能只把它看作文物资源或文化遗产。St. Chad Gospels 与 Lichfield Cathedral 的宗教生活、地方记忆和共同体身份相连,因此数字化工作本身也是一种社会关系。作者借用民族志中的互惠原则,强调研究者在追求开放获取和学术成果时,需要同时考虑保存机构、宗教共同体和公众使用者的需求与担忧。本章讨论 Creative Commons 授权、数字图像传播、开放数据的实际门槛、社区参与和长期信任关系等问题。作者指出,开放获取并不自动等于公平使用,因为高分辨率图像、多光谱数据和专业软件仍可能构成技术壁垒。真正有效的数字化应提供不同层次的访问方式,使普通观众、地方共同体和专业学者都能获得相应收益。本章的重点在于把数字人文从技术执行推进到责任实践,说明图像开放必须与伦理判断、社区协商和知识回馈结合起来。

第五章 

知识空间的危机?——虚拟现实之展望

A Crisis in Knowledge-Space? A Look Toward Virtual Reality

第五章讨论三维成像、虚拟现实和知识空间问题,是全书从图像处理走向媒介理论的一章。作者认为,二维照片虽然极大扩大了手稿访问范围,却容易削弱研究者对手稿三维属性的理解。手稿页面有弯曲、厚度、纹理、颜料隆起和装订约束,阅读手稿也包含身体姿态、距离、光线和触觉想象等经验。虚拟现实和三维渲染可以在一定程度上恢复这种空间感,使手稿重新作为可被环绕、接近和观察的物质对象出现。作者提出知识空间这一概念,用来理解不同媒介如何组织知识的生产、保存和传播。他梳理了从希腊辩证法、中世纪手稿、印刷书籍到 Web 2.0 的历史变化,说明每一种媒介环境都会塑造特定的认知方式。虚拟现实因此被视为新的知识空间,既提供沉浸式研究和教学的可能,也带来技术门槛、真实性、解释控制和感官替代等问题。本章的研究方向是探索数字手稿的未来形态,尤其是三维技术如何帮助研究者重新思考物质性、临场感和知识传递。

六

章节选读

第一章(节选)

水损与磨损文本的修复 

Recovery of Water-D amaged and Worn Text

如前所述,第 90 页在修复水损文本时面临诸多挑战。为评估相关方法与成像技术,我将相同方法应用于两张 RGB 图像,一张是大英图书馆于 2003 年通过高分辨率彩色相机拍摄,另一张是 Bill Endres 于 2010 年通过单色相机拍摄。我将示例限定在前两行的开头部分,因为这部分能有效呈现各类损伤情况。不过将两张图像并列对比后,能发现一处细微但关键的初始差异,2010 年图像中的羊皮纸看起来更偏灰色。对两张图像的颜色直方图进行分析后,这一观察结果得到了证实。按比例来看,2010 年的图像包含更多灰色,这是由红、绿、蓝频率的更大重叠所导致的。这一差异会对修复工作产生影响。

As mentioned, page 90 presents a range of challenges for recovering water-damaged text. To assess methods and imaging, I apply the same methods to two RGB images: one taken by a high-resolution colour camera by the British Library in 2003, and the other by a monochrome camera by Bill Endres in 2010. I limit examples to the beginning of the first two lines because they provide an efficient range of damage. Placing the images side-by-side, however, reveals a subtle but important beginning difference: the parchment in the 2010 image appears greyer. Examining colour histograms for each image affirms this observation. Proportionally, the 2010 image contains more grey, produced by a larger overlap of red, green, and blue frequencies. This difference affects recovery.

数码摄影并非一门精确的科学。不同的数码图像,其像素值存在差异,这会导致直方图的形状发生变化。对于 2010 年的图像,红、绿、蓝的绘图值范围更宽,进而影响了频率的重叠。直方图的谷值与峰值形状也略有不同。出现这类差异的原因在于,即便是高端相机,其传感器的灵敏度以及校准软件也存在区别。滤镜同样会造成差异。彩色数码相机配备拜耳滤镜(Bayer filter),它会阻挡所有频率,只保留每个光电探测器所需的红、绿、蓝频率。这些滤镜的灵敏度存在波动,因此需要不同的校准软件来合并频率,生成符合人眼视觉的彩色图像。不过对于 MSI 而言,当使用 LED 照明时,滤镜并非必要,这就消除了一个重要的变量。因此,不同相机拍摄的图像,所记录的反射光数值也不同。这不仅会导致直方图存在差异,更重要的是,它会使得数码修复的效果出现波动。

Digital photography is not an exact science. For different digital images, the values for pixels vary. This causes the shapes of histograms to vary. For the 2010 image, the graphed values for red, green, and blue are wider, affecting overlap. Valleys and peaks show slightly different shapes. Such differences occur because even in high-end cameras, the sensitivity of sensors and their calibrated software differ. But filters also cause variations. A colour digital camera has a Bayer filter blocking all frequencies except the red, green, or blue desired for each photodetector. The sensitivity of these filters fluctuates, requiring differently calibrated software to merge frequencies and produce a colour image that is realistic to the human eye. For MSI, when LED lighting is used, however, filters are unnecessary. This eliminates a significant variable. Therefore, different cameras produce images that record different values for reflected light. This causes histograms to differ, but importantly, it causes the success of digital recovery to vary.

对于第 90 页,使用 MSI 针对非可见频率拍摄的图像,最多只能实现有限的修复。紫外线光能够带来最佳效果,它能提升铁胆墨水(iron gall ink)书写的字母残留的可见度,这种墨水中的铁会吸收紫外线,而周围的羊皮纸则会反射更多紫外线。此外,由于羊皮纸反射的紫外线比渗透到透印文本中的更多,透印现象会逐渐消退。不过,水损导致变暗的羊皮纸会削弱这一积极效果。变暗的羊皮纸会吸收更多紫外线,因此对比度的提升十分微弱。虽然修复效果有限,但这些结果显示出像素值存在比例差异。这说明将可见与非可见频率的图像进行除法运算,可以增强墨水的痕迹,显现出受损文本的形态,这对于目前仍充满谜团的第一行文本而言意义重大。

For page 90, images taken with MSI for nonvisible frequencies produce, at best, minor recoveries. Ultraviolet light generates the best results. It increases the visibility of remnants of letters written in iron gall ink, the iron absorbing it while surrounding parchment reflects more of it. Furthermore, because parchment reflects more ultraviolet light than penetrates to the bleed-through text, bleed-through fades. However, parchment darkened by water-damage diminishes this positive gain. Darkened parchment absorbs more ultraviolet light. Contrast, therefore, increases only faintly. While recoveries are marginal, they indicate proportional differences for values of pixels. This suggests that dividing images of visible and nonvisible frequencies can enhance traces of ink and reveal patterns for damaged text, significant for the first line, still riddled in mystery.

在确认该墨水并非碳基墨水后,我们发现红外频率无法提供额外信息。例如,850 nm 的图像会让受损文本的残留痕迹消失,其更长的波长会穿透这些痕迹,反而将修复工作引向错误的方向。如前所述,铁胆墨水并不会像碳基墨水那样吸收红外光,因此这类频率最初无法提升对比度。不过,红外频率能够捕捉到比受损墨水更多的透印信息,这就带来了新的机会。通过数学运算,它们提供了另一种生成对比度的可能方式。

Confirming that ink is not carbon-based, infrared frequencies provide no additional information. For example, the image for 850 nm makes remnants of damaged text disappear. Its longer wavelengths pass through them, moving recovery in the wrong direction. As mentioned, iron gall ink does not absorb infrared light as carbon-based inks do; consequently, they are initially unbeneficial for increasing contrast. However, the ability of infrared frequencies to capture more bleed-through than damaged ink presents an opportunity. Through mathematical operations, they provide another possible way to generate contrast.

为尝试进行修复,并为数学运算筛选合适的频率,我将 RGB 多光谱图像分别除以其 638 nm 红、535 nm 绿和 465 nm 蓝通道。这一操作立刻得到了结果。这三个通道都大幅降低了透印带来的干扰,不过除以 465 nm 后,第一行的受损文本显现得最为清晰,即 tori suo。Latin Vulgate 证实了这一修复结果。第 90 页的内容是对 Matthew 20:8 的收尾,这则寓言讲述了工人们在不同时间开始工作,最终却获得相同报酬的故事。武加大译本中对应的预期词汇是 procuratori suo。第 89 页的结尾是 procura,因此 tori 补全了这个单词。suo 在三个结果中都清晰可见,在除以 465 nm 的 RGB 图像中最为明显。通过进一步的除法运算,465 nm 展现出了优化修复效果的潜力,也可用于修复其他存在水损文本的页面。不过 638 nm 和 535 nm 的结果同样有潜力,它们在不同的组合中可能会发挥作用。因此,MSI 拍摄的图像为修复工作提供了大量的可能性。不过,将 RGB 多光谱图像除以非可见频率的尝试并未成功。运算结果显示,850 nm 的像素值与 RGB 图像的像素值比例相似,完成除法后,受损文本的痕迹与透印现象都没有明显变化。在光谱的另一端,除以 365 nm 紫外线的结果同样令人失望,透印的干扰依然过强。不过受损文本显现为明亮的红棕色,这说明找到合适的配对进行除法运算或许能得到不错的结果。

To attempt recovery and identify further frequencies for mathematical operations, I divided the RGB multispectral image by its 638 nm (red), 535 nm (green), and 465 nm (blue) channels. This produced immediate results. All three dramatically decrease the interference caused by bleed-through; however, dividing by 465 nm makes the damaged text on the first line emerge most clearly: tori suo. The Latin Vulgate affirms this recovery. Page 90 begins by concluding Matthew 20:8, a parable about labourers starting their work at fluctuating times but all receiving identical pay. The expected Vulgate words are procuratori suo (his steward). Page 89 ends with procura; therefore, tori completes this word. The suo is evident in all three results, most clearly in the RGB image divided by 465 nm. Through further division, 465 nm shows promise for refining recoveries or producing them for other pages with water-damaged text. However, results from 638 nm and 535 nm also show promise. They could prove effective in different combinations. Therefore, images from MSI provide an excess of possibilities for producing recoveries. Dividing the RGB multispectral image by nonvisible frequencies, however, proved unsuccessful. Division demonstrates that 850 nm has proportionally similar values for pixels as the RGB image. Once divided, traces of damaged text and bleed-through remain relatively the same. At the other end of the spectrum, dividing by 365 nm (ultraviolet) produces likewise disappointing results. Bleed-through still interferes too strongly. However, the damaged text emerges as a bright reddish brown; therefore, finding the appropriate division partner might produce good results.

对于所有修复后的文本,生成伪彩色可以提升对比度。ImageJ 提供了许多颜色表(Look-Up Tables,luts)来实现这一功能。对于受损文本,伪彩色能够提升除以 465 nm、535 nm 和 638 nm 后的图像清晰度,对紫外线图像也有一定的改善作用。如前所述,应用 luts 需要进行实验,同一个 lut 并非总能为每一次修复都提升清晰度。

For any recovered text, generating false colour can increase contrast. ImageJ provides a number of luts for doing so. For the damaged text, false colour enhances clarity for dividing by 465 nm, 535 nm, and 638 nm, and some improvement for ultraviolet. As mentioned, applying luts requires experimentation. The same lut does not always add clarity to each instance of recovery.

无论是 e-Codices 还是 Digital Walters,随着可用的高分辨率手稿图像数量不断增加,中世纪研究者获得了前所未有的机会来深度修复文本内容。这也使得将 RGB 图像拆分为红、绿、蓝三个通道成为了一种极为重要的方法。拆分 RGB 图像本身通常无法直接完成修复,它往往只是第一步。例如,当我拆分大英图书馆拍摄的照片时,得到的三个通道并没有立刻呈现出结果。但将它们与彩色图像进行除法运算后就有了变化。三个通道的运算结果中,透印现象都有所减轻,其中除以红色和蓝色通道的两个结果中,出现了修复效果,分别是 tori 中的 to 和 suo 中的 su。生成伪彩色进一步优化了这些结果,在除以蓝色通道的结果中,我还修复出了 tori 中的 ri。

Whether e-Codices or the Digital Walters, because of the large and growing number of available high-resolution images of manuscripts, medievalists have unprecedented opportunities for recovering profound levels of content. This makes splitting RGB images into their red, green, and blue channels a highly significant method. Splitting RGB images tends not to generate recoveries in their own right. It tends to be the first step. For example, when I split the photograph taken by the British Library, the resulting three channels did not immediately provide results. However, dividing them into the colour image does. In all three, bleed-through lessens; in two, dividing by red and blue, recoveries occur: to of tori and su of suo. Generating false colour enhances these results. For dividing by blue, it leads to recovering ri of tori.

必要时,这些修复结果可以指导后续的数学运算。对于第 90 页的开头部分,虽然目前的结果已经可靠,但如果其他页面的字母更难修复,对单个频率进行除法运算或许能得到更精细的修复效果,并提供特定的处理方法。因此,在已有良好结果的基础上,比如除以 465 nm 的结果,进行下一步操作是合理的。由于 638 nm 的结果是第二好的,我也使用了这个频率,它与 465 nm 的差距足够大。对于铁胆墨水,我更倾向于用较高波长除以较低波长,这会让羊皮纸比修复后的文本更暗,我发现明亮的修复痕迹更容易辨认。不过作为测试,我也将它们反转了,看看更亮的羊皮纸是否能让结果更清晰。

When necessary, results from these recoveries can guide further mathematical operations. For the beginning of page 90, while the results are secure, dividing individual frequencies might produce refined recoveries and provide specific approaches if letters on other pages prove more resistant. Building off good results, such as dividing by 465 nm, therefore, provides a next logical step. Since 638 nm produced the second-best results, I also use this frequency. It provides a nice distance from 465 nm. For iron gall ink, I prefer to divide higher wavelengths by lower ones. This causes parchment to be darker than recoveries. I find bright recoveries more discernible. As a test, however, I reverse them: in case lighter parchment clarifies results.

对频率进行除法运算后,得到的结果通常是页面偏黑,可能只有微弱的可辨认文字行痕迹。对于第 90 页,当用 638 nm 除以 465 nm 时就是这种情况。不过调整直方图后,文本就显现出来了。此时像素值的范围大约在 0 到 3.4804 之间,当将这些值拉伸到完整的 0 到 255 范围后,文本就显现出来了。查看前两行的开头部分,可以发现修复效果十分显著。

Dividing frequencies normally produces results in which pages appear blackish, with perhaps faint hints of discernable lines of script. For page 90, this is the case when dividing 638 nm by 465 nm. Adjusting the histogram, however, reveals the text. In this case, values for pixels range from about 0 to 3.4804. When these values are stretched to cover the full range (0 to 255), the text emerges. A view of the beginning of the first two lines reveals strong recovery.

进一步的实验持续带来了良好的结果,将可见频率互相进行除法运算,都能得到修复效果。例如,用 535 nm 除以 505 nm,以及用 450 nm 除以 592 nm,都能清晰呈现受损文本。在第二个例子中,为了展示修复后的文本呈现为更暗的状态,我用较高频率作为除数。不过我还是更偏好更亮的文本。但羊皮纸的瑕疵或变色可能会让其中一种方式更有效。

Further experimenting continued to produce good results. Dividing visible frequencies into each other all generated recoveries. For example, dividing 535 nm by 505 nm and 450 nm by 592 nm provide good views of the damaged text. In the second example, to demonstrate recovered text appearing darker, I divide by the higher frequency. Again, lighter text is my preference. However, blemishes or discolouration of parchment can cause one or the other to be more beneficial.

紫外线频率的效果依然没有达到预期。将其他各个频率分别除以 365 nm 后,只有一个图像得到了不错的修复效果,即用 850 nm 除以 365 nm。不过这个图像的清晰度,还是比不上通过可见频率除法得到的结果。修复结果可能难以预测,有时手稿的材质与状态会以无法预期的方式影响反射光,导致我们无法获得预期的效果。因此,指导原则虽然重要,但也仅仅是指导而已。面对众多的选择,这些原则能够为我们的方法提供指引,使其系统化。但数码修复本身依然需要不断尝试与实验。

The ultraviolet frequency continued in its trend of not being as beneficial as expected. Dividing each of the other frequencies by 365 nm generates only one image that produces good recoveries: 850 nm by 365 nm. This image, however, provides less clarity than those derived from dividing visible frequencies. Results can be unpredictable. Sometimes, the materiality and condition of a manuscript affect reflected light in ways that do not provide the expected leverage. Therefore, guiding principles are important, but they are just that, guidance. For an otherwise overwhelming number of options, they direct and systematize the approach. However, digital recovery requires play and experimentation.

对于通过除法进行的修复,彩色相机拍摄的图像也提供了更多的机会。不过如前所述,拆分这类图像只能得到三个可用于除法运算的图像,每个通道对应一个,即红、绿、蓝。因此,可能的运算方式仅限于红除以绿、红除以蓝、绿除以蓝,如果需要也可以反转。拆分大英图书馆拍摄的照片后,绿色通道除以蓝色通道的结果得到了稳定的修复效果。应用不同的 luts 生成伪彩色,进一步优化了这些结果。另一种生成伪彩色并完成修复的方式,是合并与 RGB 图像预期不同的频率。例如,可以将绿、蓝和紫外线频率分别对应红、绿、蓝通道,合并生成伪彩色图像。

For recovery by division, images produced by a colour camera also provide further opportunities. However, as mentioned, splitting them produces only three images for division, one for each channel: red, green, and blue. Therefore, the possibilities are limited to dividing red by green, red by blue, and green by blue (and the reverse, if preferred). Splitting the photograph taken by the British Library generated solid recovery for the green-channel divided by blue. Applying different luts generates false colour, enhancing these results. Another way to generate false colour and recovery is to merge different frequencies than those expected for an RGB image. For example, a false colour image can be generated by combining green, blue, and ultraviolet frequencies for the red, green, and blue channels.

不过对于第 90 页,以各种组合合并频率都没有得到有益的结果。但依然存在其他的可能性,除法运算后的频率结果也可以进行合并。例如,将红外频率作为红通道,将一个除法运算后的频率作为绿通道,即 592 nm 除以 505 nm,再将紫外线作为蓝通道,合并后得到了极佳的结果。紫外线频率将更多受损文本的痕迹带入 RGB 图像中,而红外频率则淡化了透印现象。不过对于绿通道而言,用较高频率除以较低频率这一步十分关键,这会让修复后的文本比周围区域更亮,生成所需的对比度。如果将除数与被除数反转,铁胆墨水的痕迹就会变得更暗,不过在我看来,这会让它们的细节更难辨认。

For page 90, however, merging frequencies in various combinations did not generate beneficial results. Nonetheless, further possibilities exist: the results from divided frequencies can also be merged. For example, merging an infrared frequency for the red-channel, a divided frequency for the green (592 nm divided by 505 nm), and the ultraviolet for the blue produces excellent results. The ultraviolet frequency brings more traces of damaged text into the RGB image while infrared fades the bleed-through. However, for the green-channel, dividing the higher frequency by the lower frequency is significant. This causes recovered text to be lighter than its surroundings, generating needed contrast. When the divisor and dividend is reversed, the traces of iron gall ink become darker; however, to my eye, this makes their nuances more difficult to see.

最后,合并通道并不局限于只有一个通道包含除法运算后的频率,两个甚至全部三个通道都可以包含这类结果。在之前的合并图像中,蓝通道效果最好的除法运算结果是 535 nm 除以 465 nm。为了找到这个合适的除法组合,我最初在蓝通道的大致范围内测试结果,之后再逐步扩展。为了给红通道也加入一个除法运算后的结果,我发现 700 nm 除以 625 nm 是个不错的选择。再次说明,优化修复效果需要不断实验。将原始 RGB 图像分别除以三个通道,能让我们初步了解透印与受损文本是如何反射光线的。基于这些结果,我们可以开展有针对性的实验,提升得到有效结果的概率。

Finally, merging channels is not limited to a sole channel containing a divided frequency. Two or all three channels can contain them. In the prior merged image, one of the best divisions for the blue-channel turned out to be 535 nm divided by 465 nm. To find this division, I initially tested results within the general range of the blue-channel and then expanded them. To include a third divided result for the red-channel, I found that 700 nm divided by 625 nm was a good choice. Again, enhancing recoveries requires experimentation. Dividing the original RGB image by its three channels provides initial understanding about how bleed-through and damaged text reflects light. From these results, informed experimentation can proceed, increasing the chance of generating revealing results.

以上内容来自书籍官网与学者主页

https://www.arc-humanities.org/9781802701227/digitizing-medieval-manuscripts/

https://www.ou.edu/cas/english/people/bill-endres

经数字人文资讯小编翻译整理而成

如需转载,请后台私信联系

编辑 丨魏翔

校对 丨洪冰凤

排版 丨罗斯鹏

阅读原文

跳转微信打开

  •  

会议征稿 | DHd2027:Mind the Gap!—— 知识、不确定性与责任

2026-06-06 08:30 湖北

德语区数字人文协会“DHd2027:Mind the Gap!—— 知识、不确定性与责任”会议征稿

一

DHd2027介绍

德语区数字人文协会(DHd,Association for Digital Humanities in the German Speaking Areas)成立于2013年,主要为所有在德语国家数字人文领域从事研究和教学的各学科人士的平台和利益的正式代表。截至2026年4月,DHd共有528名研究人员。作为一个区域性协会,DHd既隶属于欧洲数字人文协会(EADH, European Association of Digital Humanities),也是数字人文组织联盟(ADHO, Alliance of Digital Humanities Organizations)的成员协会。DHd会员同时也是EADH的正式会员。

DHd2027是由马尔堡大学承办的德语区数字人文协会年度会议,会议主题为“Mind the Gap!——关注间隙:知识、不确定性与责任”。

“间隙”(gap)是知识构成中的重要组成部分。它们既标示出尚未被填补的空白,也提出新的问题,并推动认知过程的展开。对于数字人文而言,这一点尤为关键:当知识被数字化编码、建模,并转化为机器可读的形式时,翻译、简化与中介性的灰色地带便不可避免地出现。无论是将非数字对象转化为数据、模型或数字表征,还是处理原生数字材料,研究者都必须先对材料进行采集、组织、归档与整理,才能使其成为可分析的研究对象。在这一过程中,各种形式的“间隙”不断生成。

间隙DHd2027聚焦于这些具有生产性、问题性以及责任意义的间隙、不确定性与差异,并反思隐藏其中的关于数据完整性和确定性的理想化假设,以及支撑这些假设的解释过程。会议关注以下问题:

•空白如何成为知识生产的认识论前提?

•不确定性如何成为数字人文的方法论挑战?

•数据处理中的责任应如何承担?

•缺失与差异如何催生新的解释与理解?

重点讨论内容包括:

•物质和历史遗产中的缺失

•算法黑箱问题

•数据缺口

•建模决策

•知识与基础设施获取的不平等

二

会议背景与理念

(1)会议背景

与人类文化相关的数据往往是不完整的:文献可能残缺不全,资料可能已经散佚,原始语境可能不复存在,或仅以碎片化的形式流传下来。与此同时,数字化与建模过程本身也会产生新的筛选与简化。每一种数据表征(representation)、分类(classification)或可视化(visualization),都意味着研究者必须决定什么被展示、什么被强调,以及什么被省略。特别是在数据驱动方法与人工智能技术广泛应用的背景下,透明性、可解释性、不确定性与责任等问题变得愈发重要。

“Mind the Gap!”这一主题还进一步指向数字知识生产中的各种不平等现象。尽管数字技术具有促进知识民主化的潜力,但在数据获取、工具使用、基础设施建设和学术发表机会等方面,仍然存在显著差异。这些差异可能受到地理位置、机构背景、社会条件以及其他结构性因素的影响。因此,DHd2027会议希望为讨论数字人文领域中的参与、责任与可持续发展提供空间。

(2)会议理念

DHd2027会议强调,“间隙”(gap)并不只是知识生产中的缺陷,也可以被理解为反思、解释与批判得以发生的生产性空间。如果知识不是一个已经完成的最终成果,而是一个持续建构的过程,那么不确定性、空白与差异便构成了科学认识生成的重要前提。

DHd2027希望与学界共同探讨:

• 如何实现负责任的数字知识生产;

• 如何建立反思性的研究实践;

• 如何推动数字人文的可持续发展。

三

征稿主题

DHd2027欢迎数字人文及相关学科领域的研究者投稿,特别鼓励以下主题:

(1)文化遗产与历史资料中的空缺

  • 历史、文化和物质遗产中的空缺与不确定性

  • 来源(Provenance)研究

  • 碎片化(Fragmentation)

  • 去语境化(Decontextualization)

  • 元数据缺失

(2)不确定性的建模

  • 模糊性(Vagueness)建模

  • 不确定性建模

  • 多义性建模

(3)数字化与数据处理中的局限

  • 数字化过程中的选择机制

  • 数据建模中的筛选问题

  • 标注(Annotation)的边界

(4)数字化缺失问题

  • “数字暗场(Digital Dark Field)”

  • 未被数字化的文化资源

(5)人工智能与算法透明性

  • 黑箱问题(Black Box)

  • AI方法

  • 可解释人工智能(XAI)

(6)大模型中的知识偏差

  • 大语言模型训练数据缺陷

  • 图像模型训练数据偏差

  • 知识空缺与算法偏见

(7)数字重建

  • 数字复原

  • 推测与证据之间的平衡

(8)科研成果呈现中的不确定性

  • 可视化中的不确定性

  • 数据聚合中的误差

  • 研究成果展示中的风险

(9)数据伦理

  • FAIR原则

  • CARE原则

  • 数据伦理问题

(10)隐私与敏感数据处理

  • 匿名化(Anonymization)

  • 假名化(Pseudonymization)

  • 有意识的数据省略

(11)数字能力与基础设施

  • 数据素养

  • DH教育与培训

  • 基础设施不平等

(12)文化数据与社会责任

  • 后殖民主义视角

  • 文化数据治理责任

(13)方法论创新

  • 混合研究方法(Mixed      Methods)

  • AI与诠释学(Hermeneutics)

(14)机构协同

  • GLAM机构(Galleries, Libraries, Archives, Museums)网络化

  • 数字研究基础设施建设

(15)数字人文的未来角色

  • 技术与社会不确定时代中的数字人文反思

四

投稿类型与字数要求

类型

字数要求

学术报告(Vorträge)

1500–2000词

博士论坛(Vorträge im Doctoral Consortium)

500–750词

专题讨论(Panel)

1200–1500词

海报(Poster)

500–750词

工作坊(Workshop)

1200–1500词

五

投稿与评审

(1)投稿平台

投稿通过ConfTool提交。

作者需:

  • 注册ConfTool账户;

  • 使用FidusWriter撰写并提交dhc格式文件;

  • 填写100–150词摘要。

所有录用摘要将发布于DHd协会Zenodo社区,收录于会议论文摘要集,并发布于会议官网与会议手册。

(2)重要时间

时间

事项

2026年8月1日23:59(德国夏令时)

投稿截止

2026年11月初

录用通知

2026年12月5日

提交修改终稿

2027年3月1–5日

会议召开

注意:投稿截止日期不会延期。

(3)评审方式

此次会议采用开放同行评审(Open Peer Review)

  • 作者与评审人身份互相公开(Open Identities)

  • 评审意见不公开

联系邮箱:dhd2027@uni-marburg.de

(4)语言要求

DHd2027主要交流语言:德语、英语

投稿可使用:德语、英语

会议鼓励使用德语报告,但英语报告同样欢迎。

(5)参会要求

会议为:线下会议(In-Person Conference)

要求:

  • 录用论文原则上需作者本人到场报告;

  • 不设混合参会模式(Hybrid);

  • Keynote主旨报告将提供直播。

六

会议关注方向

对于文化遗产数字化、智慧数据资源建设、古籍数字人文研究领域的研究者而言,此次会议主题与以下研究高度契合:

  • 文化遗产数据缺失与不确定性表达

  • 古籍知识组织与语义建模

  • AI驱动的文化遗产知识发现

  • 文化遗产智慧数据资源建设

  • 数字重建与数字孪生遗产

  • 文化数据伦理治理

  • GLAM机构协同创新

  • 人工智能与数字人文方法论融合

涉及“文化遗产智慧数据资源建设模式”“古籍智慧数据平台”“文化遗产数字化—数据化—智慧化转型”等主题的研究将与DHd2027的会议议题具有很高的契合度。

以上会议征稿内容来自DHd2027官方网站:

https://digitalhumanities.de/en/2026/06/01/call-for-papers-dhd2027/

更多征稿详情请进官网查询,如需转载请后台私信联系

编译|罗斯鹏

校对|魏翔

排版|洪冰凤

阅读原文

跳转微信打开

  •