普通视图

Received yesterday — 2026年4月14日

Check Out Our Curated Fall 2026 Course List!

2026年4月14日 01:08

Fall course selection starts this month! Wondering what to register for? We've compiled a list of courses on media studies, technology, data and culture, and more.

This list includes both undergraduate and graduate courses. Grad courses are marked with an asterisk (*).

ANTHROPOLOGY

ANT 422 / EAS 422: Digital China: Technology and Society (Jamie Wong)

ARCHITECTURE

ARC 311 / STC 311: Building Science and Technology: Building Systems (Peter Pelsinksi)

*ARC 573: Pro Seminar: Computation, Energy, Technology in Architecture (Forrest M. Meggers)

ART & ARCHAEOLOGY

ART 248: Photography and the Making of the Modern World (Monica C. Bravo)

ART 320: Ink, Paper, Wood, Metal, Stone: The Printed Image in the Western World (Jun P. Nakamura)

*ART 577 / HUM 577: Seminar in Modern Art: Science and Its Fictions in the Long Nineteenth Century (Rachael Z. DeLue)

COMPARATIVE LITERATURE

COM 200: Who Are You Really? Authenticity in Life, Literature, and the Internet (Avram C. Alpert and Wendy Laura Belcher)

COMPUTER SCIENCE

COS 126 / EGR 126: Computer Science: An Interdisciplinary Approach (Adam Finkelstein, Maryam Hedayati, and Alan Kaplan)

COS 209: Algorithms in the Wild (Matt Weinberg)

COS 217: Introduction to Programming Systems (Christopher M. Moretti, Kevin Alarcón Negy, and Jaswinder P. Singh)

COS 226: Algorithms and Data Structures (Marcel Dall’Agnol and Kevin Wayne)

COS 240: Reasoning about Computation (Zeev Dvir, Iasonas Petras)

COS 302 / SML 305 / ECE 305: Mathematics for Numerical Computing and Machine Learning (Ryan P. Adams)

COS 324: Introduction to Machine Learning (Adji Bousso Dieng and Vikram Ramaswamy)

COS 326: Functional Programming and Formal Methods (David P. Walker)

COS 330: Great Ideas in Theoretical Computer Science (Pravesh K. Kothari and Pedro Paredes)

COS 333: Advanced Programming Techniques (Robert M. Dondero)

COS 424: Reasoning with Data (Manoel Horta Ribeiro and Xiaoyan Li)

COS 429: Computer Vision (Olga Russakovsky)

COS 436: Human-Computer Interaction (Parastoo Abtahi)

*COS 516 / ECE 516: Automated Reasoning About Software (Zachary Kincaid)

*COS 522 / MAT 578: Computational Complexity (Gillat Kol)

*COS 529: Advanced Computer Vision (Felix Heide)

*COS 597C: Advanced Topics in Computer Science: AI Agents (Karthik Narasimhan)

CREATIVE WRITING

CWR 213: Writing Speculative Fiction (Ed Park)

EAST ASIAN STUDIES

EAS 212 / COM 235: Embodied Visions: The Body in East Asian Film and Media (staff)

EAS 313: Japanese Horror: Cognitive and Embodied Approaches (staff)

EAS 328 / CDH 328: Building Qianlong’s World: Digital Worldbuilding and Cultural Heritage (Paul A. Vierthaler)

EAS 407 / CDH 407: Hacking Chinese Studies: An Introduction to Text Mining for Chinese Literature and Culture (Paul A. Vierthaler)

*EAS 529: Readings in East Asian Film and Media (Steven Chung)

ELECTRICAL & COMPUTER ENGINEERING

ECE 364: Machine Learning for Predictive Data Analytics (Niraj K. Jha)

ECE 435: Machine Learning and Pattern Recognition (Mengdi Wang)

ECE 488: Fundamental Image Processing: From Mars to Hollywood with a Stop at the Hospital (Guillermo Sapiro)

*ECE 535: Machine Learning and Pattern Recognition (Hossein Valavi)

ECONOMICS

ECO 202: Statistics and Data Analysis for Economics (staff)

ECO 326 / COS 206 / ECE 326: Economics of Digital Connectivity and Artificial Intelligence (Swati Bhatt)

ENGINEERING

EGR 200 / ENT 200: Creativity, Innovation, and Design (Alice Kogan)

EGR 361 / ENT 361 / URB 361 / AAS 348: The Reclamation Studio: Humanistic Design applied to Systemic Bias (Majora J. Carter)

ENVIRONMENTAL STUDIES

ENV 221: AI for Global Good (Jamie M. Caldwell and Jeffrey R. Smith)

GERMAN

GER 525: Studies in German Film: Media in Film (Joseph W. Vogl)

HISTORY

HIS 291: The Scientific Revolution (Matthew L. Jones)

JOURNALISM

JRN 414: Data Journalism: Investigative Journalism and Open Source Investigations (staff)

NEAR EASTERN STUDIES

NES 369 / HIS 251 / JDS 351 / CDH 369: The World of the Cairo Geniza (Marina Rustow)

PHILOSOPHY

PHI 312: Computability and Logic (John P. Burgess)

POLITICS

POL 345 / SOC 305 / SPI 211: Introduction to Quantitative Social Science (Nicolas Idrobo)

*POL 571: Empirical Research Methods for Political Science (Jonathan F. Mummolo)

*POL 573: Quantitative Analysis II (Rocío Titiunik)

PSYCHOLOGY

PSY 360 / COS 360: Computational Models of Cognition (Brenden M. Lake)

PSY 362 / CHV 362: Can Machines Be Moral? (Molly J. Crockett)

*PSY 503: Foundations in Statistical Methods for Psychological Science (Suyog Chandramouli)

*PSY 505: Current Issues in Statistical Methods and Research Methods for Psychological Science (Suyog Chandramouli)

STATISTICS & MACHINE LEARNING

SML 201: Introduction to Data Science (Daisy Yan Huang) (section 1 and section 2)

SML 301 / COS 301: Data Intelligence: Modern Data Science Methods (Derek E. Sollberger)

SOCIOLOGY

SOC 301: Statistical Methods in Sociology (Tod G. Hamilton)

*SOC 500: Applied Social Statistics (Brandon W. Stewart)

*SOC 505: Research Seminar in Empirical Investigation (Yu Xie)

*SOC 557: Technology Studies (Half-Term): Artificial Intelligence, Computation and Society (Zeynep Tufekci)

SPANISH

SPA 368 / TRA 368: Spanish into English Translation in the Age of AI (Catalina Arango)

PUBLIC & INTERNATIONAL AFFAIRS

SPI 352 / COS 352: Artificial Intelligence, Law, & Public Policy (Peter Henderson)

SPI 365: Tech/Ethics (Steven A. Kelts)

SPI 374: Challenges in Regulating AI: A Sociological Approach (Zeynep Tufekci)

*SPI 507B: Quantitative Analysis for Policymakers (staff)

*SPI 507C: Quantitative Analysis for Policymakers (Advanced) (Eduardo Morales)

SCIENCE AND TECHNOLOGY CENTER

STC 349 / ENV 349 / JRN 349: Writing about Science (Michael D. Lemonick)

URBAN STUDIES

URB 385 / SOC 385 / HUM 385 / ARC 385: Mapping Gentrification (Aaron P. Shkuda)

VISUAL ARTS

VIS 215 / CWR 215: Graphic Design: Typography (David W. Reinfurt)

VIS 216: Graphic Design: Visual Form (David W. Reinfurt)

VIS 218: Graphic Design: Image (Laura Coombs)

VIS 220: Animation I (Tim Szetela)

PRINCETON WRITING PROGRAM

WRI 139 and 140: How to Raise a Machine (Allen Durgin)

*WRI 501: Reading and Writing About the Scientific Literature (Andrea L. DiGiorgio)

*WRI 502: Writing a Grant Proposal in Quantitative Disciplines (Andrea L. DiGiorgio)

Introducing MuSE: Linking Music-Theoretical Concepts Across Languages

2026年4月13日 23:37

This past January, the CDH kicked off a new Collaborative Research Partnership with Anna Yu Wang (Assistant Professor of Music) and Jürgen Hackl (Assistant Professor of Civil and Environmental Engineering), the researchers behind the larger Music Theory in the Plural project. MuSE—short for Multilingual Semantic Embeddings—asks: when scholars write about music theory across languages, including Chinese, Japanese, Spanish, and Portuguese, are they talking about the same things? The project sets out to evaluate whether multilingual LLMs can translate the domain-specific discourse of music theory without flattening its nuance, and to test computational methods for discovering related concepts across those language traditions.

Led by RSE Laure Thompson, the CDH team is working with the scholar-translated articles in Music Theory Online volume 30, number 4, which presents articles written in Chinese, Japanese, Portuguese, and Spanish (among others) alongside their English translations. This resource allows the team to assess automated translation against expert scholarly ones. From there, the team will experiment with embedding models as tools for surfacing cross-linguistic connections across a broader corpus. The work aims not just to answer these questions for music theory, but to contribute broader, critically needed comparative research on how LLMs perform with specialized humanistic content.

Like all CDH Research Partnerships, MuSE begins with a project charter that defines the project's scope, deliverables, team roles, and terms of collaboration. The MuSE collaboration is one small part of the larger research agenda of the Music Theory in the Plural project, and it is through chartering that the project team and the RSE team define how the pieces will fit together. You can download the MuSE project charter here and follow the project's progress on its project page.

The Center for Digital Humanities is seeking proposals for innovative and computationally-engaged research partnerships from Princeton faculty. The next application cycle closes April 17, 2026. Apply now.

MuSE (Multilingual Semantic Embeddings)

Linking concepts in music-theoretical texts across languages

Built by CDH
music

Collaborative Research Partnerships

Faculty are welcome to apply to work with the CDH Research Software Engineering team!

collaborate_AdobeStock_429621181

讲座预告 | 饶高琦《从灵感到建设 —— 以BCC语料库系统为例》

2026年4月14日 09:00

徐惠 2026-04-14 09:00 江苏

山东大学翻译学院邀饶高琦副研究员开语料库建设专题讲座,探讨大模型时代发展前景。

讲座预告

语料库是语言生活的 “显微镜”,也是语言研究中最重要的经验主义方法之一。山东大学翻译学院特邀饶高琦副研究员,带来题为《从灵感到建设 —— 以BCC语料库系统为例》的专题讲座。本次讲座将介绍语料库建设的一般性流程与关键环节,以BCC语料库系统为例,阐释数据驱动方法在语言知识萃取中的应用,同时分享新型生成式语料库的建设案例,并探讨大模型时代语料库的发展前景。

讲座时间及其他

  • 时间:2026年4月15日(周三)19:00-21:00

  • 地点:线上腾讯会议

  • 会议号:970-641-445(入会请单位实名制)

主讲人简介

饶高琦副研究员:北京语言大学语言科学学院副研究员,硕士生导师,中国标准化委员会语言与术语技术委员会SAC TC62委员、中国中文信息学会青年工作委员会委员。主要研究领域为:语言资源建设、语言规划和数字人文等。在国内外期刊、会议发表论文五十余篇,起草多项团体和国家标准。创办并主编语言学公众号 “汉语堂”。

比特人文

投稿邮箱:dhbase@126.com

扫码关注 获取更多资讯

图片

阅读原文

跳转微信打开

《数字人文研究》2026年第1期目录及摘要

2026年4月13日 12:26

数字人文研究 2026-04-13 12:26 北京

第6卷,总第21期

批判性再谈“数字人文”

许喆

摘要

数字人文作为人文研究中的新兴领域,其学科属性迄今仍较为模糊,并伴随持续争议。文章从方法论视角出发,综合分析各国学者关于数字人文在克服传统人文研究局限方面的论述,并批判性地指出当前数字人文研究中“重数据建设、轻实质研究”的倾向。文章主张,数字人文本质上应被理解为人文研究的方法论,而非独立学科,并强调数据准确性、研究的科学性和论证逻辑的严密性。与此同时,文章批判了当前数字人文教育过分关注技术工具的使用,而忽视人文问题意识以及发现问题和解决问题能力的培养,因而有必要从“技术中心”转向“问题中心”和“批判思维”导向。

关键词

数字人文; 方法论; 学科建设; 批判性思维; 数据准确性; 研究范式

作者简介 

许喆(HEO Chul),韩国釜山大学佔毕斋研究所研究员,鲁东大学区域国别学院特聘教授。

叙事责任与人工智能——AI如何挑战人类的责任与意义理解

马克·科克尔伯格   易瑶琴  杨 璇/译

摘要

多数责任论述聚焦于一种责任,即道德责任,或对道德责任的特定方面展开探讨,如能动性。文章概述了一个更广泛的责任思考框架,涵盖因果责任、关系责任,以及作者称之的“叙事责任”——作为“诠释责任”的一种形式,并将这些责任概念与不同类型的知识、学科和关于人的存在的观点相联系,阐释此框架如何有助于绘制和分析人工智能以各种方式挑战人类的责任和意义构建。文章借助最新的诠释学方法研究技术,提出除了道德责任等类型的责任外,人类还承担着叙事责任和诠释责任——一般而言,也包括对技术的责任。例如,人类的任务是了解并运用人工智能,在必要时对其加以约束。虽然从后人类主义的角度来看,技术有助于意义构建,但人类是体验者和责任承担者,在涉及此类诠释责任时,人类始终占据主导地位。面对一个充满数据要素、相关性和概率的世界,注定要去做出合理解释。此外,这一工作还涉及规范层面,有时甚至是政治层面:倘若人类希望避免自己的故事被他人借助技术手段改写,那么承认并履行诠释责任尤为重要。

关键词 

责任;  叙事责任;  诠释责任;  人工智能;  诠释学;  技术哲学

作者简介 

马克·科克尔伯格(Mark Coeckelbergh),维也纳大学哲学系教授;

易瑶琴(译者),云南大学马克思主义学院硕士研究生,Email:18000289002@163.com;

杨璇(译者),云南大学讲师。

中共党史研究语料智能体的构建经验与思考

马思宇  王亚星  肖桐月  李庚辰

摘要

中共党史研究面临史料碎片化、传播形式单一、教育个性化不足等核心痛点。针对此,研究构建了中共党史研究语料智能体,其核心创新在于提出党史文献专属OCR适配方案与父子分段式知识库构建模式,形成“以OCR适配转化为基础、父子分段知识库为核心、四大功能模块(智能问答、词云图、知识图谱、思维导图)为支撑”的技术框架。文章剖析了语料智能体开发中的关键问题解决策略及功能模块实现机制,提炼技术适配、知识结构化、需求导向的构建经验,同时探讨了语料处理、校对工具、知识库发展等现存问题,为技术赋能党史研究深化提供参考。

关键词 

党史研究; 史料转化; 知识库构建; 数字人文

作者简介 

马思宇,南开大学历史学院副教授,Email:masynku@126.com;

王亚星,南开大学计算机学院副教授;

肖桐月,南开大学历史学院2022级本科生;

李庚辰,郑州大学电气与信息工程学院2024级硕士研究生。

《盛宣怀档案》智能分析系统的构建与史学应用——从检索增强到智能体推理

张光伟

摘要

面对浩如烟海且高度非结构化的历史档案,传统的数字化处理与关键词检索模式已难以满足日益复杂的史学研究需求,特别是在处理如《盛宣怀档案》这类涉及晚清政治、经济、外交等多维网络的复杂史料时,研究者常陷入查不全、理不清、关联难的困境。研究在回顾数字人文从数字化、结构化向智能化转型的技术背景的基础上,引入大语言模型前沿的思维链技术与推理一行动框架,构建了一个基于AgenlicRAG的“盛宣怀档案智能分析系统”。该系统突破了传统知识图谱预定义的局限,通过“意图理解、资料检索、资料总结、评估决策、内容撰写”五个智能体的协同工作,实现了对全量档案文本的语义向量化与动态推理。系统具备主动规划检索路径、多步逻辑推演、跨文档证据互证以及自我纠错的能力,能够模拟历史学家“提出假设一史料搜集一考证辨析一形成结论”的认知过程。文章通过微观、中观和宏观三个层面的典型案例展示了该系统的应用潜力。研究实践证明,AI时代这种“人机回环"(Human-in-the-loop)的协作模式,不仅能将历史学家从繁琐的信息搜寻中解放出来,更开启了以数字文献考古与全息逻辑增强为特征的历史研究新探索的可能性。

关键词 

盛宣怀档案; 大语言模型; ReAct框架; 思维链; Agentic RAG; 人机协作

作者简介 

张光伟,陕西师范大学历史文化学院讲师,Email:zhangguangwei@ snnu.edu.cn。

本地化智能史料管理系统的构建方法与实践

安高怡

摘要

在当前数字化背景下,传统中心化在线数据库在数据自主权、持续运营和海量资料协同方面面临结构性挑战。研究旨在提出并构建一套以“数据本地化”为核心,利用Obsidian笔记软件、开源OCR技术及自建私有云同步机制的综合方案,用以建立个人化、具备高可移植性与协作性的史料数据库。该方案通过Obsidian的纯Markdown架构和插件生态,解决了史料与笔记的割裂问题,并融入AI能力进行史料对话和分析。同时,通过自建高性能私有云,突破传统网盘的带宽限制,实现数据自主权和高效团队协作。该方案为个体研究者和小型学术团队提供了一种低成本、可持续、高安全性的数字人文研究工作流,有助于推动学术积累的开放和阶梯式发展。

关键词 

史学数据库; 数字人文; 数据本地化; Obsidian

作者简介 

安高怡,华中师范大学历史与文化学院硕士研究生,Email:205959586@qq.com。

文化遗产的“游戏化生存”

——兼论数字人文研究中的可玩性

王一楠

摘要

文章以“游戏化生存”为理论命题,系统探讨文化遗产在数字原生范式中的存在方式及其认识路径。将电子游戏界定为兼具拟真系统、具身界面、可能时空与情动媒介四重属性的程序化建模/模拟系统,并揭示出其在强化联觉体验、激活身体图式、延展想象空间及引导公共行动等方面的机制潜能。基于此,进一步提炼出“可玩性”作为数字人文研究中的关键概念,将其界定为操作可能性与生成开放性的统一,并阐发其在融合表示、具身认知、动态推演与能量汇聚四个维度的方法论价值。研究指出,可玩性不仅是数字文化遗产的存续机制,更是推动人文知识生产方式从文本阐释转向模拟与体验的关键路径。

关键词 

文化遗产; 游戏化生存; 电子游戏; 数字人文; 可玩性

作者简介 

王一楠,中国人民大学信息资源管理学院讲师、数字人文研究院研究员,Email:yinan.wang@ ruc.edu.cn。

提示词对AI文学创造力的激发机制研究

李倩  吴静

摘要

随着生成式人工智能深度介入文学创作,提示词已成为影响人机协同创作效果的关键因摘素。针对提示词如何激发其文学创造力这一问题,研究设计了五类提示词在DeepSeek模型上进行生成实验,并采用主客观结合评估体系并展开量化与质性分析。实验揭示:提示词通过“语义定向一认知修辞介入”机制,将人类意图转化为AI可执行创造操作;其中,抽象概念型激活跨域类比,多元融合型促进异质语义整合。AI文化寄生性既反映人类集体无意识,又提供陌生化表达契机,推动分布式创造力涌现。提示词设计与多轮生成策略在AI文学创作中的关键作用,为数字人文语境下人机协同创作提供理论与方法参考。

关键词 

提示词; 人工智能文学创作; 创造力评估; 数字修辞学

作者简介 

李倩,南京师范大学公共管理学院哲学系博士研究生、新疆财经大学中国语言文化学院语言文学系讲师;

吴静,华东师范大学哲学系教授。

水书文字数据库和智能识别平台构建

孙治弘  谢雨霏  刘凌  叶晨

摘要

水书是中国水族独有的文字文献,蕴含丰富的民族文化信息,被誉为水族的“百科全书”。然而,受限于数据资源稀缺、手写字形繁复且非标准化、语义解读高度依赖稀缺传承人等因素,其数字化保护与智能化识别面临巨大挑战。为此,研究构建了“水书文字数据库”与“水书智能识别平台”。水书文字数据库采用“书一篇一句一字”四级架构,整合水书字形图像、注音及释文信息,并提供多路径检索功能,有效汇聚并管理分散的水书文献资源。水书智能识别平台基于两阶段深度学习模型(DBNet文本检测+CRNN文本识别),通过引入Unicode私有区编码方案并采用数据增强策略,针对水书数据的低资源特性、长尾分布及复杂版式进行优化,实现了水书手写体文本的高精度识别。实验结果表明,该方法在水书文本检测与识别任务上的性能显著优于现有通用OCR方案。研究为水书等少数民族濒危文字的数字化保护提供了有效的技术解决方案,对相关古籍文献的数字人文研究具有重要参考价值。

关键词 

水书; 数字化保护; 智能识别; 文字数据库

作者简介 

孙治弘,同济大学计算机科学与技术学院,研究生;

谢雨霏,同济大学计算机科学与技术学院,本科生;

刘凌(通讯作者),华东师范大学中国文字研究与应用中心,副教授,Email:lingliu60@163.com;

叶晨(通讯作者),同济大学计算机科学与技术学院,教授级高级工程师,Email:yechen@tongji.edu.cn.

全球虚拟货币发展的历史空间进程研究——以比特币为核心

赵佳文

摘要

在当代电子信息技术迅速发展的背景下,虚拟货币诞生并席卷全世界,搅动了全球金融市场及传统治理体系。自中本聪发表“比特币白皮书”以来,比特币就成为代表性的虚拟货币,文章依托电子历史文献学、互联网考古方法,基于互联网原生电子史料,结合国内外最新研究,从全球、长时段的角度追溯比特币的发展史,比较不同国家的监管政策,发掘比特币作为去中心化时代、逆全球化时代的新型交易通货的重要价值,并指出虚拟货币的演变是技术协议、物质载体与社会应用三者交织的产物,由此提出“三元嵌套空间生产模型”假说。文章为理解当代金融史和互联网发展史提供了一个新的角度和路径。

关键词 

虚拟货币; 区块链技术; 金融史; 互联网考古; 互联网历史; 数字人文

作者简介 

赵佳文,延边大学人文社会科学学院历史系讲师,Email:21110760017@m.fudan.edu.cn。

阅读原文

跳转微信打开

数字人文时代的“新文献观”及其对文献学专业教育变革的启示 ——以中华书局“苏东坡数字人”为案例

2026年4月14日 10:09

原创 郭琳 王建 2026-04-14 10:09 北京

在中国传统文化中“文献”既有典章资料的含义(“文”),又指掌握典章之人(“献”),但后世的文献学在某种程度上缺失了“人”的维度。

教育与教学

2.png

郭  / 北京大学社会科学部

王 建 / 中华书局

要:在中国传统文化中“文献”既有典章资料的含义(“文”),又指掌握典章之人(“献”),但后世的文献学在某种程度上缺失了“人”的维度。为了提供一个更贴合“文献”概念原初含义,同时也更适合当下数字人文时代的理解框架,本文尝试引入文化哲学、技术哲学的新视角,来提供一种新的“文献观”,试图将“文”与“献”纳入一个整体框架来进行理解。从文化哲学的视角,人是符号的动物;从技术哲学的视角,符号是人的外化与延伸。人可以创造符号并以此创造文化,而文献也正是一个符号系统,它依赖于对应时代的符号书写与媒介技术。在全新的数字人文时代,数字文献的应用越来越广泛,数字文献技术使得历史文化名人数字人成为可能与必然。与此同时,符号技术的变迁必会引起文化形态与学术范式的升级转型,当下大学的文献学专业研究与教学模式变革需要试图做好专业与通识的结合、基础与应用的融合、传承与创新的综合,才能塑造未来大学教育的新形态,创造出越来越多像“苏东坡数字人”这样的优秀案例并切实推进落实中华优秀传统文化的创造性转化和创新性发展。

关键词:文化哲学 技术哲学 文献观 数字人 文献学 数字人文

一、文化哲学、技术哲学视角下的“文献观”

(一)“文献”概念溯源与新视角的引入

我国是一个史籍浩瀚、史学发达的国家,文献的产生、流传和研究已有悠久的历史。随着时代的发展,“文献”一词的含义在不断变化。《辞海》将“文献”释义为“专指具有价值或与某学科相关的图书文物资料”,《现代汉语词典》将“文献”解释为“有历史价值或参考价值的图书资料”。所以,现在人们通常所理解的“文献”是指图书、期刊、典章等所记录知识的总和。

而如果我们将考察的视线拉得更长可以发现,最早将“文献”一词用作书名的著作是元代马端临的《文献通考》,而“文献”一词的最早出处则可以追溯到《论语》。在《论语·八佾》中,孔子曾说:“夏礼吾能言之,杞不足征也;殷礼吾能言之,宋不足征也。文献不足故也,足则吾能征之矣。”何晏《论语集解》中引东汉经学大师郑玄的注云:“献,犹贤也。我不以礼成之者,以此二国之君,文章贤才不足故也。”这里用“文章”解释“文”,用“贤才”解释“献”。宋代朱熹在《四书章句集注》中解释道:“文,典籍也。献,贤也。”[1]“文”是指历史典籍、档案等文字资料,“献”是指博学多才、熟悉掌故的贤才。清代刘宝楠在《论语正义》中也沿用了这一说法:“‘文’谓典策,‘献’谓秉礼之贤士大夫。”[2]后来杨伯峻在《论语译注》中的注释为:“《论语》的‘文献’包括历代的历史文件和当时的贤者两项。今日‘文献’一词只指历史文件而言。”[3]

鉴于上述梳理可以看出,今天我们常用的“文献观”对于“文献”概念的理解,如果较之“文献”一词的原初含义而言,其实是只得其半,而缺失了对于“人”本身的理解。因此,为了提供一个更加贴合“文献”概念原初含义的新的“文献观”解释框架,本文尝试引入文化哲学、技术哲学的新视角,来探索一种新的“文献观”表达,试图将“文”与“献”纳入一个整体框架来进行理解,并从中发现人类“文献”发展史的规律与趋势。

(二)文化哲学的新视角——人是符号的动物

恩斯特·卡西尔(Ernst Cassirer,1874—1945)是德国著名的文化哲学家,被誉为“当代哲学中最德高望重的人物之一”。卡西尔在其代表作《人论》中概括表达了他的符号论文化哲学体系,他认为人类文化形式都是符号形式。因此,我们应当把人定义为符号的动物(animal symbolicum)来取代把人定义为理性的动物。[4]也就是说,人是能用符号去创造文化的动物。从而可以理解,人是创造符号并以此创造文化的动物,符号是人区别于动物的一个显著特点。人类拥有其他一切动物不具有的符号系统,人可以在创造符号的过程中获得自由与解放,成为真正意义上的人。

“符号”是卡西尔文化哲学思想体系中的核心观念。在卡西尔这里,“符号”不是具体的单个符号,而是一个整体的概念,具有极其丰富的内容和意义,他将人类文化的各种形式包括语言、神话、寓言、宗教、艺术、科学、历史等都看作符号形式。人与符号紧密相连,符号是人类创造文化的媒介。人具有符号化的思维模式,并通过符号创造文化,即创造一个符号世界,进而认识自我、发展自我。符号化的思维和符号化的行为是人类生活中最富于代表性的特征,并且人类文化的全部发展都依赖于这些条件,这一点是无可争辩的。[5]可见,符号是人和文化的共同本质,人—符号—文化构成了三位一体的存在。首先,符号可以理解为作为文化现象的符号形式;其次,符号体现了主体(人)本质的符号活动;另外,符号展现了被赋予的符号意义。

在卡西尔看来,“符号”(symbol)是与“信号”(sign)相对的,“信号是物理的存在世界之一部分,符号则是人类的意义世界之一部分。信号是操作者(operator),而符号是指称者(designator)”。[6]文化符号和自然界的信号有严格区别,这二者体现了“人禽之别”的关键,即动物只能对信号做出条件反射,只有人才能掌握和运用信号,并将信号改造成有意义的符号,所以“信号”与“符号”的核心差别在于“意义”。如图1所示,人和动物与客观世界的互动方式是不同的,动物与世界直接互动,往返的是信号,信号不具有意义,它是物理性的、实体性的存在;人与世界则通过符号进行互动,符号是意义的表达。符号是人类的创造物,人具有符号构形能力,不存在无意义的符号,也不存在无符号的意义。

图1.png

图1 人和动物与客观世界的互动方式差异

由此可以看出,基于“符号”这一视角,可以认为,主流“文献观”定义里的“价值”与“知识”等跟卡西尔最为强调的“意义”是内在相通的,因此,可以用“符号系统”这一概念来提炼与概括“文献”中“文”的内涵。符号系统成为连接人与文化的通道,构成整个人类文化世界。

从根本上说,人是符号的动物,符号揭示着人的本质,延伸着人的能力,人所创造的符号成为人与世界的中介,人所面对的世界也是符号世界。与此同时,卡西尔认为,符号具有二重性,即符号具有可感载体与普遍意义两个方面。人类可以像其他动物一样以各种感官与世界进行交往,依据物理信息与外界进行沟通,此时世界是可感知的。另一方面,人具有符号能力并进行符号活动,正是这种符号能力将自己与动物区别开来,当人类作为“符号”动物与世界交往时,人类是有意识的、有思想的、有理智的,此时“符号”成了载体与意义的统一。

需要指出的是,就历时性的角度而言,作为人与世界之中介的符号系统是具有历史性的,也就是说,一个个体所面对的符号世界从根本上说正是该个体之前全部的人类历史中所能留存下来的符号的整体。

(三)技术哲学的新视角——符号是人体感官的外化与延伸

从卡西尔把人定义为“符号的动物”来看,一方面,人是创造和发明符号的动物;另一方面,人是使用符号的动物。正是由于人的能动性与创造性,人能够制造和使用符号,人的意识、愿望、思维等精神能在具体实践活动中对象化到客观世界,实现客观世界的符号化,比如艺术是人类直觉或观照的客观化,语言和科学是人类概念的客观化,而这些符号可以将人体感官不断地外化和延伸。

其实在更早的德国技术哲学家恩斯特·卡普(Ernst Kapp,1808—1896)那里,曾更加明确地提出了工具和器物是人体“器官投影”(Organ Projection)的核心观点,在其被认为是技术哲学奠基性著作的《技术哲学纲要——从新观点看文化发生史》(1877)一书中,卡普试图用器官投影论的新观点,通过作为技术文化的工具发生历程来解释人类文化的演进历史,他认为,人体的外形和功能总是作为人类最理解的客观存在,当成创造技术的外形和功能的尺度,投影到外部环境;所有工具的源泉和本原的技术,都是建立在人的器官特别是手的基础之上的。因此,人是制造器物的尺度。[7]卡普的“器官投影”理论开创了一种分析技术的独特视角,某种程度上,我们可以说是他提出了技术生成文化理论,并从技术哲学范式内部对技术的本质进行思考。

作为卡普“器官投影”论在媒介时代延续的加拿大媒介理论家马歇尔·麦克卢汉(Marshall McLuhan,1911—1980)在他的名著《理解媒介:论人的延伸》一书中提出:媒介,即技术,可以是人的任何延伸。媒介带来一种新的技术尺度,人的延伸及其感知比率随之改变,就形成一定的后果。这就是“媒介即讯息”。[8]媒介是那些延伸人类器官的所有工具、技术和活动,一切技术都可以被看作是不同人体器官的延伸,比如,车轮是人类脚步的延伸,衣服是人类肌肤的延伸,报纸是人的言语和视觉的延伸,广播是听觉的延伸,等等。万物皆媒介,凡是能使人与人、人与事物或事物与事物之间产生关系的物质都是广义的媒介。半个世纪之后,美国学者凯文·凯利在《科技想要什么》一书中进一步认为“技术是思维的延伸”,将技术称为“第七王国”,并提出了“技术元素”(technium)的概念,这里的“技术元素”包括硬件、文化、艺术、社会制度以及各类思想。他认为科技是我们躯体的延伸,技术元素是生命的延伸,技术应该被理解为一种正在进化的生命。[9]

综上所述可以看出,就技术哲学的视角而言,作为人与世界的中介的符号及其能力也可以被视为“符号技术”,其本身就是人类感官与思维的外化与延伸。进一步的,再就符号的历史性而言,一个个体所面对的符号世界从根本上说正是该个体之前全部的人类历史中所能留存下来的前人们感官与思维外化与延伸的整体。因此,就其符号整体的所指而言,它指向的是前人们于四维时空、眼耳鼻舌身意全感官的所有真实而鲜活的生命经验,而就该符号整体的能指而言,它则是特定历史时代与对应的特定符号技术下对上述多维度、全感官生命经验的部分维度、部分感官的“投影”。

(四)双重视角下的新文献观

总体而论,从文化哲学的视角来看,人是创造符号并以此创造文化和进行文化实践的动物;从技术哲学的视角来看,符号是人体感官的外化与延伸,也可以理解为,人类的一切活动是借助于符号技术不断外化自身的过程。基于此,在文化和技术哲学的双重视角下,可以构建一种新的“文献观”表达,即“文献”是一个符号系统,是人类进行一切生命活动的符号化记录,其映射的对象其实是真实而鲜活的历史人物的生命体验所外化于四维时空形成的高维度、全感官的历史文化世界。

因此,作为总结,就作为人与世界的历史性的中介而言的符号世界对应着本文新文献观中“文”的内涵,而在客观世界的角度来看,人与历史性的符号世界构成的具有意义、价值、历史性的整体,则对应着本文新文献观中“献”的内涵,如图2所示。

图2.png2双重视角下的新文献观

可见,文献这一符号系统依赖于对应时代的符号书写与媒介技术,特定时代的符号书写与媒介技术的维度决定了文献的维度,它蕴含着人类活动、媒介技术(符号书写)、知识生成(符号世界)相互依存的关系。事实上,“文”与“献”本身就是一个整体的结构体系,遵循着人类历史文化发展的规律与趋势。

(五)人类符号技术发展趋势与数字人文的必然

如前所述,人类符号技术的发展史其实就是人类文化的发生史,是人类不断追求更有效、更丰富地去外化与延伸自身感官与思维的历史,因此,人类符号技术也在多维度与多感官两个角度呈现出了历史性的发展趋势。

在原始社会,人们通过结绳、绘画、雕刻等方式记载和传递信息,这些图形和符号逐步演变并形成最初的符号系统。当文字及印刷技术出现后,人类的视觉得到了延伸。其中,“文字”的产生打破了“口耳相传”的局限,成为人类用符号记录和表达信息的突破性进步,从最早的抽象图画,再到象形文字、指事文字、会意文字等。广播、电视等媒介技术的诞生,改变了人们的生活方式和文化体验。广播延伸了人的听觉,而电视结合着语言符号与非语言符号,更是综合了文字、声音、图像等多重符号,具有“声画合一”的特点,更全方位延伸了人们的视觉和听觉。21世纪以来,随着信息科技的迅猛发展,增强现实(AR)、虚拟现实(VR)以及混合现实(MR)等技术突飞猛进,让人类视觉的延伸逐渐从平面化的二维向立体化的三维拓展,如图3所示。与此同时,通过不断创新的数字技术的加持,人类的嗅觉、味觉、触觉等也得以被前所未有的数字化模拟,更进一步的,人工智能、脑机接口等颠覆性技术也逐渐显露了越来越多的曙光。

图3.png图3 符号技术发展简史与趋势

由此可见,作为与人类文化发生史相伴生的符号技术呈现出追求更高时空维度、更多感官意识维度的必然趋势,因此,数字文献技术这一作为人类思维与智能的外化与延伸的符号技术必然成为当今人类符号技术发展的大势所趋与时代主题。方兴未艾的数字化改变了传统文献的生产、存储、研究和使用方式,以印刷媒介为基础的传统文献生产体系正向以智能媒介为前提的数字文献生产体系转变。[10]数字化促进了知识形态的变革与演进。随着大数据技术的应用以及人工智能等数字技术的发展,古籍数字化、文献数字化已成为共同趋势,数字文献大量出现。数字人文数据以文本形式为主,兼有图片、音频、视频、3D等多元数据形式。文本资料有地方古典文本资料、图书、笔记、家谱资料等。图片有地图、画作、壁画等。3D数据有器皿、雕塑等。音频与视频数据包括访谈、纪录片等多媒体数据。[11]

与此同时,由于人类符号技术始终不断追求更高时空维度、更多感官意识维度的表达,因此,每当有一种新的、具有更高时空维度与更多感官意识维度的人类符号技术出现后,此前所记录下来的人类文化历史都将被这种新的符号技术“重新书写”,并被依托其更加丰富的维度与感官进行持续不断地“扩写”与“创写”。并且,这样的“重新书写”呈现出越来越多的高时空、跨学科、多模态、全场景等特点,为人类、文化、历史的全面延伸尤其是具有悠久历史文献传统的中华优秀传统文化的全面延伸提供了无限丰富的可能。

二、文献学的数字化应用——以中华书局“苏东坡数字人”为案例

习近平总书记曾强调,“要系统梳理传统文化资源,让收藏在禁宫里的文物、陈列在广阔大地上的遗产、书写在古籍里的文字都活起来”。让文物和文化遗产“活起来”……最终实现“让文物说话,让历史说话,让文化说话”。[12]为此,中华书局立足自身深厚的文化积淀与数字文献技术优势,首创研发了全国首位3D超写实历史文化名人——“苏东坡数字人”。

(一)从数字文献视角看古代历史文化名人数字人的研发特征

“数字人”是指通过计算机图形渲染、动画驱动、动作捕捉、语音合成、人工智能等技术打造的虚拟仿真人物,其产生本身就是文化与科技深度融合的产物。清华大学《2020—2021元宇宙发展研究报告》指出,2021年被产业界称为“元宇宙元年”。因此,作为未来元宇宙数字世界主体性存在的“数字人”,自2021年迎来了爆发式的发展。与此同时,随着我国经济社会的全面发展和国际地位的不断加强,中华优秀传统文化在作为互联网原住民的年轻人群中的认同度与影响力在不断提升。在这样的时代背景下,从2021年至今,各类国风数字人陆续发布,俨然已经成为中华优秀传统文化活化利用的标配。如2021年10月28日,中央戏剧学院与北京理工大学共同发布“梅兰芳”,2022年5月18日,中国文物交流中心发布“文夭夭”,2022年6月3日,新华网发布“筱竹”,同一天浙江卫视发布“谷小雨”,2022年6月15日,敦煌研究院发布“伽瑶”,2022年7月22日,国家博物馆发布“艾雯雯”,等等。

但纵观以上多位国风数字人,除了“梅兰芳”外,均属于“纯虚构型”数字人,即历史上并没有真实存在过这个人物,而对于古代的真实历史文化名人进行“复活”的超写实数字人,则一直是一个空白。究其原因,需要先从数字人的分类入手进行分析。

在中华书局“苏东坡数字人”之前,数字人行业内对于数字人的分类通常是采用两类方法。其一,是根据数字人的角色形象与建模技术进行分类,分为二次元数字人、2.5次元数字人、3D卡通数字人、3D写实数字人等。其二,是根据数字人的功能与应用场景进行分类,分为服务型数字人、身份型数字人等。其中,服务型数字人可用于替代真人服务,并作为多模态AI助手提供服务,如虚拟主播、虚拟教师、虚拟客服等;身份型数字人则可以实现虚拟IP、虚拟分身等功能。然而,这两种分类方法均无法解释和分析历史文化名人数字人的独有特征。为此,中华书局立足数字文献的全新视角,对数字人进行了全新的分类,并从文献不同特征的角度进行象限化分析,逐步探索出历史文化名人数字人研发的理论基础与方法论思路。

首先采用“有无文献依据”和“文献是否齐清定”两个指标来进行分析,可以得出如下的三个象限,如表1所示。第一类虚拟数字人对象是“在历史文化符号世界中曾经真实存在过的人”,这类数字人的研发是基于真实有效的文献资料,且文献具有“齐”(齐全)、“清”(清晰)、“定”(确定)等特点。第二类虚拟数字人对象是“正在活着的人”,他们虽然有文献资料记载,但其文献资料还处于不断创作和变化之中,所以具有不稳定性,还未成“定论”。第三类是纯虚拟数字人,这类数字人并无文献典籍的基础,在历史上未曾真实生活过。

图4.png1基于文献维度的全新数字人分类(一)

然后,可以采用“文献的维度”和“文献的感官”两个指标来对第一类数字人进行进一步分析,如表2所示,古代历史文化名人只有关于身体记录的抽象的文字文献(可视为一维文献),但现代历史文化名人具有三维立体身体数据(三维文献)和动态影像文献(四维文献)。另外,古代历史文化名人只有画像等“非完全真实”的视觉文献,无真实的听觉、嗅觉等文献,但现代历史文化名人具有真实的视觉、听觉文献,甚至可能留存有部分程度的嗅觉文献。他们留存有照片、音视频、使用过的器物等资料。

图5.png表2 基于文献维度的全新数字人分类(二)

最后,再通过“有无真实地理文献”这一指标,还可以将古代历史文化名人176分为两类,如表3所示。一类是以苏东坡、李白、李清照等中华先贤人物为代表的曾在历史上真实活过的人物,另一类是以苏小妹、林黛玉、孙悟空等为代表的在文学符号世界中存在的人物。

图6.png

表3 基于文献维度的全新数字人分类(三)

(二)中华书局古代历史文化名人数字人研发的方法论心得

综上所述可以看出,对于超写实的古代历史文化名人数字人的研发而言,可谓是一项几乎前无古人的工作,一方面要求数字人的开发技术本身必须达到与超写实纯虚拟数字人同样的行业前沿水准,另一方面又不允许像纯虚拟数字人那样天马行空地随意发挥,但与此同时,又缺乏像邓丽君、梅兰芳数字人那样的真实照片与动态视听影像的文献支撑,因此需要独辟蹊径、守正创新。为此,中华书局始终牢牢扎根“文献”这一关键基础,逐步摸索出了一些古籍文献数字化应用的全新方法论。

其一,要将重写与创写有机结合。

如前所述,每当有一种新的、具有更高时空维度与更多感官意识维度的人类符号技术出现后,此前所记录下来的人类文化历史都将被这种新的符号技术“重新书写”,并被依托其更加丰富的维度与感官进行持续不断的“扩写”与“创写”。就超写实古代历史文化名人数字人的研发而言,首先,必须要求是“重写”,而且是严格遵从古籍文献学术共识的“重写”,这是与纯虚拟数字人研发方法的根本区别——也因此,古籍文献数据的学术共识对于超写实古代历史文化名人数字人的研发来说是应该具有“一票否决权”的,即明显不符合古籍文献记载的古代历史文化名人数字人是应该被限制准入的。

以苏东坡数字人的“塑形”为例,中华书局在总字数超70亿字的古籍大数据中心中进行了海量搜索,通过一系列精心设计的关键词精准抓取到了一批涉及苏东坡容貌形象的古籍文本数据,与此同时,又通过图像搜索技术,抓取了由宋至清各个不同时期所作的涉及苏东坡的画作100余幅,既包括苏东坡单人画像,也包括如《西园雅集》《赤壁》等主题群像以及若干石刻画像拓片等,从而初步形成了对于苏东坡容貌形象之“古籍真实”的把握,然后再结合权威专业的专家系统进行校验,最终确定下来超写实苏东坡数字人的每一个细节并确保与历史文献资料不相违背,实现严格科学的“重写”。

然而,由于古代历史文化名人只有来自古籍文字记载的一维文献和非完全真实的画像类二维文献,缺乏像邓丽君、梅兰芳等人的真实三维立体身体数据和动态影像数据这样的四维文献,所以对于古代历史文化名人数字人的“塑形”而言,科学规范的“重写”只能做到“不错”(即没有古籍文献的反例),但无法证明“全对”(即只有如此才是唯一正确的),因此,在“不错”与“全对”之间的部分,需要进行一定程度的“创写”——这也正是古代历史文化名人数字人与邓丽君、梅兰芳等数字人研发方法的根本区别。

以苏东坡数字人为例,中华书局在深入挖掘古籍文献中对于苏东坡容貌形象的记载数据的同时,还致力于深度提炼苏东坡的精神气质。为此,中华书局通过“苏东坡专题数据库”与“苏东坡主题知识图谱”的深度挖掘,侧重提取苏东坡本人、同时代人、后代历史人物以及现当代专家学者对于苏东坡精神气质的凝练与概括,并且还对当前各大主要社交媒体上有关苏东坡的内容中反映的东坡气质进行了搜集与提炼,最终实现在“塑形”基础上进一步的“凝神”,让苏东坡数字人不仅形似,更加神似。

图4 全国首位3D超写实数字人苏东坡

其二,重写与创写都具有当代性。

正如前文所言,任何一个符号,就其能指而言,都是特定历史时代与对应的特定符号技术下对多维度、全感官生命经验的部分维度、部分感官的“投影”,“苏东坡数字人”作为当下时代产生的一个数字文献符号作品,它的“重写”与“创写”也都具有典型的“当代史”特征,即它在将古籍文字一维文献、画像类二维文献以及精神气质等的文字表达综合起来最终予以3D超写实、可动态交互的数字人表达时,其实已经不可避免地带进了“当代人们的精神”,一如意大利历史哲学家贝奈戴托·克罗齐(Benedetto Croce,1866—1952)在其《历史学的理论和实际》一书中指出的:“一切历史都是当代史。”在克罗齐看来,当代性不是某一类历史的特征,而是一切历史的内在特征。[13]真正的历史属于当代生活,当我们在思考过去的历史时,会把过去纳入我们当前的思想和精神之中,体现我们当前的思想活动和精神生活,历史时刻此时便与人们的思想或精神紧密相连,成了“活生生的历史”,也反映了当下人们的思考,因而从这一意义上来说一切历史都是当代的。由于实践的需要以及人们对历史事件的认识不断深化,历史上发生的事件会以新的形式再次“复现”。

其三,既要塑形、凝神,更要赋魂。

为了让古籍里的历史文化名人真正地“活起来”,让他们以数字人的身份真正走出古籍书本、走进当今时代、当下生活,我们需要将平面化的文学文本转变为立体化的虚拟场景。这不仅能带来视觉上的直观冲击,同时还能提供互动式体验和全新理解。[14]因此,在数字人“塑形”“凝神”的基础上,我们需要进一步为其进行“赋魂”。

以苏东坡数字人为例,“赋魂”主要体现为古籍大数据与人工智能技术的深度融合。在这一方面,中华书局一直在持续进行古籍人工智能技术的自主研发,通过对70亿字古籍大数据的深度机器学习与人工智能训练,目前中华书局开发的古籍智能处理系统已经可以自动给古籍断句标点、自动标记人名地名、自动核对引文、自动识别古籍文字等。[15]下一步,中华书局将在上述工作的基础上,基于与主流大模型的深度合作,使用苏东坡专题数据库对大模型进行专项人工智能训练,从而让苏东坡数字人越来越像真正的苏东坡一样去认知、去思考、去表达、去行动,最终实现苏东坡在元宇宙数字世界真正的“复活”,让苏东坡成为“中国式美好生活的代言人”,让他“活”在我们这个时代。

以人工智能版苏东坡数字人的现场实时自然语言交流为例,至少涉及如下的技术环节:(1)提问者自然语言自动转换成文字;(2)文字自动输入大模型(外挂专题数据库)并自动生成回答文字(该回答至少符合3个维度的要求:自然语言之通畅,史实学术之正确,符合苏东坡的身份与气质);(3)回答文字自动生成数字人的语音;(4)根据语音自动驱动唇形;(5)根据语义自动匹配表情;(6)根据语言和表情自动匹配肢体动作;(7)服饰等跟随肢体动作实时自动解算。

可见,要想真正给数字人“赋魂”,不仅涉及人工智能、边缘计算、虚拟现实、实时动捕等技术,还需要专业的专题数据库、匹配应用场景的深度知识图谱等大量数据挖掘与知识服务能力的支持——例如对于历史文化名人的古籍数据进行挖掘、梳理、加工并实现数据可视化,实现文化资源数据与文化数字内容的标识解析、提炼转化、搜索查询、匹配链接、传播利用等。

(三)中华历史文化名人数字人与中华文化元宇宙展望

元宇宙是数字技术与文化内容的双向融合、联动共生。元宇宙将会给内容产业带来新的进化,在内容生产、内容形态、内容衍生、内容体验等层面赋予新的定义。[16]“数字人”被视为未来人们进入“元宇宙”的入口,将广泛应用在元宇宙新生态中,作为元宇宙中“人”与“人”、“人”与事物、事物与事物之间产生联系或发生孪生关系的新介质,起着举足轻重的作用。可见,传统的中华文化内容产业将会被持续赋能、创新发展。人类经验对象有可能实现全面数字孪生化,线下物理空间将可能全面混合现实化,线上线下场景将全面人工智能化。

在这样的背景下,中华书局将继续发挥古籍数字化专业优势,以主题出版工程“中华先贤人物故事汇”为底本,持续研发系列化的“中华历史文化名人数字人”,如李白、李清照、陶渊明、戚继光等,逐步形成数字人矩阵,深入挖掘历史文化名人的古籍数据,在数字科技加持下进行现代化表达,形成“中华先贤数字人”IP矩阵,真正让“书写在古籍里的文字活起来”“把优秀传统文化中具有当代价值、世界意义的文化精髓提炼出来、展示出来”,让中华优秀传统文化融入时代、融入生活,更好地满足数字时代人们对于中华传统文化持续高涨的热情和需求。

进而,在全新的数字经济时代,中华文化内容产业基于古籍大数据,借助元宇宙数字科技,将有可能彻底突破传统媒介格局,构建全新数字内容生态,“创造性复原”书写在古籍里的“人、货、场”,实现中华文化的人、场景、叙事的全面数字孪生到数字原生再到虚实共生,最终实现中华文化元宇宙的宏伟愿景。

三、“新文献观”对文献学专业研究与教学模式变革的启示

如前所述,正因为每当有一种新的具有更高时空维度与更多感官意识维度的人类符号技术出现后,此前所记录下来的人类文化历史都将被这种新的符号技术“重新书写”,并依托其更加丰富的维度与感官进行持续不断地“扩写”与“创写”,这也直接导致人类符号技术的每一次变迁都引起文化形态与学术范式的升级转型。落实到当下的大学教育而言,数字人文可以被视为数智化时代人文与科技融合发展的前沿学术阵地,或许正可以塑造未来大学教育的新形态。

(一)文献学作为一门学科在近代中国的诞生

中国传统学问虽然也有分科,但主要是从研究主体而非客体乃至方法的角度来划分,是学派而非专业。清中后期汉学发达,开始出现专门化的倾向,如龚自珍在为《阮元年谱》作序时概括出了训诂之学、校勘之学、目录之学、典章制度之学、史学、金石之学、九数之学、文章之学、性道之学、掌故之学十个方面,但总体而言这些所谓的“专门”还处于萌芽的阶段。[17]

直至19世纪末以后,“中华民族到了最危险的时刻”,这引发了国人关于中西古今之争的深刻反思,也激发了从制度到思想的全面扬弃与重建。在学术和教育领域,古典的经学、礼教在现代学制中毫无生存空间,文以载道的圣人之学被彻底革除,西学东渐的大潮席卷而下,从自然科学到社会科学乃至人文学科,无不是建立在西方现代学科分类、研究范式和教育体系的基础之上的。在此“三千年未有之大变局”中,中国历代传统之学在大学体制中被摒弃,经史子集被肢解为文献学、语言学、哲学、史学等。1920年,梁启超在《清代学术概论》中首次提出“文献学”的概念;随后《中国文献学概要》的出版开始从学科的角度阐述文献学的内涵;陈垣、王国维、顾颉刚、罗振玉等一大批学者推动了文献学学科体系的创建。

(二)分科而治导致的“人”与“学”之分

在更广阔的历史和地理空间上考量,工业革命后职业教育对传统大学教育的冲击,以及以洪堡思想为代表的研究与教学相结合的新型大学潮流,使得德国逐渐成为当时世界教育和学术的中心。但与之相对的,作为“牛津运动”代表人物的英国主教纽曼在其著名的《大学的理念》中重新阐释了知识的分类,并在此基础上提出大学的本质在于心智的培养,从而提醒人警惕知识之恶。

与之遥相呼应的,清末新政中出台的我国第一个真正实行的现代教育体系——“癸卯学制”,其所设定的教育宗旨即为“端正趋向,造就通才”,即使是对立足于专门教育的大学堂,仍贯彻着“通”的理念。一方面,专门之学是通经致用的工具;另一方面,治学的目的是立人,学问只是成为“通人”的工具。[18]

正如钱穆先生所言:“在中国传统知识界,不仅无从事专精自然科学上一事一物之理想,并亦无对人文界专门探求某一种知识与专门从事某一种事业之理想。因任何知识与事业,仍不过为达到整个人文理想之一工具,一途径。若专一努力于某一特殊局部,将是执偏不足以概全,举一隅不知三隅反,仍落于一技一艺。”[19]他以此批评西方近代的学科分立时说道:“即就西方近代传授知识之大学言,分科分系,门类庞杂,而又日加增添。如文学院有文学史学哲学诸科系,治文学可以不通史学,治史学亦可不通文学。治文史可以不通哲学,治哲学亦可不通史学文学,各自专门,分疆割席,互不相通。……要而言之,则可谓之不明大体,各趋小节。知识领域已乱,更何论于人事。”[20]在前后断裂的历史大潮中,知识层面的整理国故,以及西方导向的分科而治,目光指向的只能是专精而非博通、保存而非应用、批判而非创新。

(三)新时代提供了“文”与“献”合璧的可能性

时至今日,变局再现。这一次,工业文明经历了几十年的后工业过渡,终于开启了数字智能时代的大门。人类信息环境正在发生根本性的改变,人类文明记录和传播方式的大规模变革势必引发文明本体的重建和知识谱系的改写。以本文“新文献观”的视角来看,人与世界是一个具有历史性和当代性的整体,“文”正呈现出对“立人”的重视与回归,“献”则经历了知识生产方式的不断迭代,不论是对于文献学专业的研究和教学,乃至更广阔范围上的大学教育,都具有深刻的启发意义。为此,本文认为应该努力做好如下“三合”。

第一是专业与通识的结合。工业时代,专业教育的重要性毋庸置疑,大学为工业化的全面胜利贡献了最重要的人力基础和技术创新。同时,相伴而生的通识教育也一直在呼吁人本主义的回归,抵抗着过度专业化给人带来的异化和禁锢。但近年来,数字鸿沟、算法黑箱和信息孤岛似乎进一步强化了专业教育的卓越性,数字智能时代的技术主义与全球主义对通识教育带来了巨大的冲击和挑战。[21]因此,大学的通识教育更应与专业相结合,走出一条专业基础上的通识之路。这不仅是因为专业教育本身已经从工业文明的摇篮跃迁为智能社会的航母,更是源于通识教育开始卸下西方“普世价值”的面具,转而深入探讨数字智能时代的“人”的本质属性。

具体而言,通识教育模式的重心在于对经典文献的研读,这恰是对一个时代经典问题的凝练、思考和解答。数字化时代的文献学更强调对于文献的跨时空、跨学科理解,不仅是知识形态的改变,更激活了其内涵的文化精神,建构出“历史—当代”相连接的当代性意义世界。这就使今日的通识教育不再局限于一般的或者说以西方价值为内核的公民教育和批判精神,转而推动个体的社会化、本土化,高扬科技与人文的交叉,塑造一种具有超越性的共同体意识,最终培养出符合“君子不器”的、可以创造和驾驭“苏东坡数字人”这一类新型成果的复合式、高层次、战略性未来人才。

第二是基础与应用的融合。2023年2月,习近平总书记在主持中共中央政治局第三次集体学习时,着重阐述了强化基础研究的重要性,强调要有组织推进“战略导向的体系化基础研究、前沿导向的探索性基础研究、市场导向的应用性基础研究”[22]三种基础研究。尤其是“应用性基础研究”的提法更是直指“学”与“用”相分裂的痼疾——而这一点在传统的人文领域更是以“无用即大用”为由成了一种自傲。实际上,基础是源头,应用是牵引,从“文”到“献”的内化正是在应用转化的过程中实现的。尤其对于人才培养来说,如果没有(广义上的)就业前景,这个学科几乎就丧失了存在的合法性。以应用为导向的基础研究和人才培养,更加明确了目标指向和评价标准,倒逼综合改革的落地,打通了大学与社会的互动链条。

因此,一方面,数字文献学是应用数字技术来研究文献,另一方面,这也是数字技术为文献学开创了广阔的应用空间,促使其更好地服务于学术研究和社会大众,从而激活其生命力和生产力。从前述“苏东坡数字人”案例就可以看出,权威的古籍数据与专业的学术研究是基础、是源头,但如果没有数字科技的应用转化与产业赋能,这些数据就无法成为生产资料,最终也就无法形成生产力;与此同时,“苏东坡数字人”在媒体传播、城市IP发展、展览展示、文旅商融合以及人工智能驱动等方面面临的新场景、新机遇,也反过来对古籍数据的数据挖掘与知识服务、数字人人工智能的情感模型等新领域提出了更多更新、前所未有的技术与理论需求,这又引导和推动了对应学术研究的发展与创新,最终形成基础与应用融合的正反馈循环。

第三是传承与创新的综合。从推动中华优秀传统文化创造性转化、创新性发展,到把马克思主义基本原理同中国具体实际相结合、同中华优秀传统文化相结合,再到建设中华民族现代文明,习近平文化思想不断将文化传承与创新的理念推向新高度。《中庸》讲“父作之,子述之”,《论衡·对作》有“圣人作,贤者述”,“作”为创新,“述”为传承。创新需要积累,需要专业的、跨学科的、跨文明的视野,需要发现问题,更需要具有使命感。创新与传承互促共生,创新因传承而生机绵延,传承因创新而波澜壮阔。这不仅是历史与未来相逢于当下,更是作者与读者、师与生、数与文的相互成就。大学教育的本质即在于人类文明基因的复刻和进化,既追求永恒不变的“形而上者谓之道”(《易经》),又以求新求变的“圣之时者”为典范(《孟子》)。

于“苏东坡数字人”而言,它既是对历史文化名人苏东坡的“复原”,又要努力实现文化意义上的“复活”,前者是传承,后者是创新,二者缺一不可。所谓“复原”意味着“苏东坡数字人”拥有苏东坡的全部知识、记忆、史实、精神等,所谓“复活”意味着“苏东坡数字人”要融入当今的时代,用他独特的精神面貌、思想深度、批判视角和人文情怀去对当下时代、当今世界进行活生生的观察、判断、表达乃至行动、实践,进而用苏东坡的文化精神来产生现实的影响和改变。

四、结语

随着时代的发展,“文献”一词的含义在不断变化。本文立足于“文献”概念原初含义的理解框架,将“文”与“献”纳入一个整体框架来进行理解,通过引入文化哲学、技术哲学的新视角探索一种新的“文献观”表达,即“文献”是一个符号系统,是人类进行一切生命活动的符号化记录。从文化哲学的视角,人是符号的动物,符号是人区别于动物的一个显著特点;从技术哲学的视角,符号是人体感官的外化与延伸,作为人与世界的中介的符号及其能力也可以被视为“符号技术”。

人类符号技术的发展史其实就是人类文化的发生史,数字文献技术这一作为人类思维与智能的外化与延伸的符号技术已成为当今人类符号技术发展的大势所趋,并使得数字人文成为必然。中华书局立足自身深厚的文化积淀与数字文献技术优势,首创研发了全国首位3D超写实历史文化名人“苏东坡数字人”,并从中摸索出了一些古籍文献数字化应用的全新方法论——这也必然伴随着人才培养的探索与创新。

落实到当下的文献学专业研究与教学而言,为了避免近代以来分科而治所导致的“人”与“学”之分,培养出既具有文史知识积淀和传统淑世情怀、又具有现代科技视野和基本数字素养的新生代学人,就需要做好专业与通识的结合、基础与应用的融合、传承与创新的综合,最终,在数字人文时代的新视野下,抓住机遇、守正创新,塑造未来大学教育的新形态。

The “New Document Perspective” in the DigitalHumanities Era and Its Implications for the Reform ofDocumentary Studies Education: A Case Study of ZhonghuaBook Company’ s “Su Dongpo Digital Human”

Guo Lin, Wang Jian

Abstract: In traditional Chinese culture, the concept of “wenxian” encompasses both the meaning of ancient classics and records (“wen”) and the scholars who master these classics (“xian”). However, the later discipline of documentary studies has, to some extent, lost the “human” dimension. To provide an understanding framework that is more aligned with the original connotation of “wenxian” and better suited to the current era of digital humanities, this paper attempts to introduce new perspectives from cultural philosophy and technical philosophy to propose a new “view of wenxian”, striving to integrate “wen” and “xian” into a holistic framework for interpretation. From the perspective of cultural philosophy, humans are the animals of symbols; from the perspective of technical philosophy, symbols are the externalization and extension of humans. Humans can create symbols and thereby create culture, and “wenxian” is precisely a symbolic system that relies on the symbolic writing and media technologies of the corresponding era. In the new era of digital humanities, the application of digital documents has become increasingly widespread. Digital document technologies have made the creation of digital humans of historical and cultural celebrities not only possible but also inevitable. At the same time, changes in symbolic technologies will inevitably lead to the upgrading and transformation of cultural forms and academic paradigms. Currently, the reform of research and teaching models in university documentary studies programs needs to strive to integrate professionalism with general education, basic theory with practical application, and inheritance with innovation. Only in this way can we shape a new form of future university education, create more outstanding cases like the “Su Dongpo Digital Human,” and effectively promote the creative transformation and innovative development of China’s excellent traditional culture.

Keywords: Cultural Philosophy; Technical Philosophy; Document Perspective; Digital Human; Documentary Studies; Digital Humanities

编辑 | 耿弘明

向上滑动 查看注释

[1]朱熹:《四书章句集注》,北京:中华书局,1983年,第63页。

[2]刘宝楠:《论语正义》卷3,北京:中华书局,1990年,第92页。

[3]杨伯峻:《论语译注》,北京:中华书局,2017年,第27页。

[4]恩斯特·卡西尔:《人论》,甘阳译,上海:上海译文出版社,2004年,第37页。

[5]恩斯特·卡西尔:《人论》,第38页。

[6]恩斯特·卡西尔:《人论》,第44页。

[7]郭明哲:《恩斯特·卡普:技术哲学奠基者》,《理论界》2008年第7期。

[8]黄旦:《延伸:麦克卢汉的“身体”——重新理解媒介》,《新闻记者》2022年第2期。

[9]赖黎捷、李明海:《从“人体延伸”到“思维延伸”:麦克卢汉与凯文·凯利技术哲学述评》,《重庆师范大学学报(哲学社会科学版)》2014年第6期。

[10]刘石:《文献学的数字化转向》,《文学遗产》2022年第6期。

[11]王军、张力元:《国际数字人文进展研究》,《数字人文》2020年第1期。

[12]习近平:《加强文化遗产保护传承弘扬中华优秀传统文化》,《求是》2024年第8期。

[13]贝奈戴托·克罗齐:《历史学的理论和实际》,傅任敢译,北京:商务印书馆,1997年,第3页。

[14]刘石:《文献学的数字化转向》,《文学遗产》2022年第6期。

[15]俞国林、王建:《数字人:用科技激活传统文化之美》,《光明日报》2023年1月4日第13版。

[16]王建、付小艳、张建丽:《从数字出版到数据产业再到内容元宇宙——传统数字出版的新型破局之路》,《出版人》2022年第11期。

[17]张寿安:《龚自珍论乾嘉学术:专门之学——钩沉传统学术分化的一条线索》,《学海》2010年第2期。

[18]郭琳:《新教育下的宗经与存古——从〈劝学篇〉和“癸卯学制”看张之洞的经学教育变革》,博士学位论文,北京大学,2017年。

[19]钱穆:《中国知识分子》,《国史新论》,北京:生活·读书·新知三联书店,2018年,第139页。

[20]钱穆:《现代中国学术论衡》,北京:生活·读书·新知三联书店,2001年,第94—95页。

[21]强世功:《数字智能时代的大学通识教育》,《复旦教育论坛》2023年第2期。

[22]习近平:《加强基础研究实现高水平科技自立自强》,《求是》2023年第15期。

点击下方链接,下载原文

数字人文时代的“新文献观”及其对文献学专业教育变革的启示——以中华书局“苏东坡数字人”为案例.pdf

如需购买《数字人文》期刊,请扫描下方二维码

封面.jpg

校对  |   肖爽

美编  |  王秀梅

图片

数字使人文更新

投稿:https://szrw.cbpt.cnki.net

数字人文门户网站:www.dhcn.cn

阅读原文

跳转微信打开

第七届清华数字人文国际论坛“未来学者”专场报名通知

2026年4月14日 10:09

2026-04-14 10:09 北京

在人工智能技术迅猛发展的今天,数字人文领域正经历前所未有的变革。数据驱动的研究方法、跨学科的技术融合以及人工智能在文化遗产、文本分析和数据可视化等领域的应用,为学术研究带来了全新的可能性。

“未来学者”专场

人文学术的未来,寄托于未来的人文学者;也即是当下正致力于研究和探索的青年学子。为鼓励和支持本、研阶段学生投入数字人文研究,结合数字时代新方法、探索人文学术新方向,《数字人文》学术集刊持续举办第七届“未来学者”论坛,诚邀国内外的本科生、硕士生、博士生在读学生(不含博士后)投稿并参会。

期待来稿面向人文问题、结合数字方法,给出来自文学、历史、哲学、社科、艺术、教育、传播乃至政治学、图情档案等各个领域的回答和发现。

本届入围者将受邀参与第七届清华大学数字人文国际论坛“未来学者”专场,获得专家指导评议及进一步研究支持,并于本刊择优刊发。

投稿须知

摘要提交截止日期:2026年5月22日

全文提交截止日期:2026年6月12日

投稿地址:

https://szrw.cbpt.cnki.net 

入围名单及参会事宜请参见后续通知。

时间地点

2026年7月10日-13日    共4天

报到7月10日

会议 7月11日—12日

赋归7月13日

上海大学宝山校区(上海市上大路99号)

合作酒店

上海衡山北郊宾馆

:上海市宝山区沪太路4788号

总机: 021-56040088

(注:若实际报名人数超过酒店接待上限,会务组可能新增其他酒店安排接待)

我们期待您的参与,共同探讨数字人文的前沿议题,推动学术研究的创新与发展!

论文格式模板及要求-中文.pdf

论文格式模板及要求-中文.pdf

会议时间地点

2026年7月10日-13日    共4天

报到  7月10日

会议  7月11日—12日

赋归  7月13日

上海大学宝山校区(上海市上大路99号)

会议合作酒店

上海衡山北郊宾馆

地址:上海市宝山区沪太路4788号

总机: 021-56040088

(注:若实际报名人数超过酒店接待上限,会务组可能新增其他酒店安排接待)

论文格式模板及要求-中文.pdf

END

公号二维码-1.jpg

数字使人文更新

投稿:https://szrw.cbpt.cnki.net

数字人文门户网站:www.dhcn.cn

阅读原文

跳转微信打开

Workshop „Von digitalen Korpora zu Forschungsdaten in der KMW“ am 29.05. in Leipzig

2026年4月14日 15:49

Am 29. Mai 2026 veranstaltet der FID Media einen Workshop für die Forschungscommunity in Leipzig. Die Teilnahme ist offen für alle Interessierten und – wie alle Angebote des FID Media – kostenlos. Registrieren Sie sich jetzt unter diesem Link!

Titel: Von digitalen Korpora zu Forschungsdaten in der Kommunikations- und Medienwissenschaft: Verantwortung, Methoden, Infrastrukturen
Datum und Ort: 29. Mai 2026 von 10 bis 16 Uhr im Vortragssaal der Bibliotheca Albertina (Beethovenstr. 6, 04107 Leipzig)

Der Workshop steht unter der Leitfrage: Was bleibt von digitalen Kommunikationskorpora nach Projektende und wie kann ihre wissenschaftliche Nachnutzung verbessert werden?

Beschreibung: Digitale Kommunikationsräume, von Social-Media-Plattformen über Messenger-Dienste bis hin zu digitalen und digitalisierten Zeitungsarchiven, erzeugen eine Vielzahl potenzieller Forschungsdaten für die Kommunikations- und Medienwissenschaft. In vielen Projekten entstehen daraus umfangreiche digitale Korpora. Nach Projektende bleiben diese jedoch häufig schwer auffindbar und nur eingeschränkt nachnutzbar, etwa aufgrund urheber- und datenschutzrechtlicher Rahmenbedingungen sowie komplexer technischer Anforderungen an ihre Reproduzierbarkeit. Der Workshop nimmt diese Herausforderungen zum Ausgangspunkt und diskutiert, wie digitale Kommunikationskorpora erhoben, dokumentiert und wissenschaftlich nachnutzbar gemacht werden können. Dabei sollen sowohl methodische als auch epistemische Fragen der Datafizierung von Kommunikation behandelt werden. Ein besonderer Fokus liegt auf den Bedingungen, unter denen digitale Korpora – auch wenn sie häufig nicht vollständig archiviert werden können – durch einheitliche Dokumentation und Vernetzung noch größere analytische Mehrwerte für die Kommunikations- und Medienwissenschaft liefern können, sowie auf der Frage, welche Rollen Forschungsinfrastrukturen dabei künftig spielen können.

Programm:

Registrierung, Kaffe (9:00-10:00)

Begrüßung (10:00-10:15)

Panel 1 (10:15-12:15)
Titel: „Von digitaler Kommunikation zu Korpora für die Forschung“
Leitfragen: Wie werden Spuren digitaler Kommunikation und digital(isiert)e journalistische Inhalte zu Forschungsdaten – wie prägen methodische, epistemische und praktische Entscheidungen diesen Prozess und welche Potenziale für neue Perspektiven birgt er?
Referent:innen:
Katharina Kinder-Kurlanda (D!ART Universität Klagenfurt; CAIS): Titel folgt
Eric Koenen (ZeMKI Bremen) zu epistemischen Fragen der Digitalität und Digitalisierung ;
Vanessa Angenendt (Universität Duisburg-Essen) zu Datenspenden und Misogynie in Chat-Kommunikation

Mittagsbuffet im Vorraum (11:45-12:45)

Panel 2 (12:45 – 14:15)
Titel: Vom Korpus-Silo zur nachnutzbaren Forschungsdatenlandschaft
Leitfragen: Warum verschwinden digitale Korpora nach Projektende und wie kann ein nicht vollständig teilbarer Korpus trotzdem auffindbar, zitierbar und für Synergien nutzbar werden?
Referent:innen:
Vincent Fröhlich (Universität Erlangen-Nürnberg): Infrastrukturelle Bedarfe der Social-Media-Forschung zu Rechtsextremismus und Verschwörungstheorien
Birte Kuhle (CAIS): Titel folgt
Philipp Knöpfle (IfKW der LMU München) zu Replizierbarkeit von CCS-Studien

Kaffepause (14:15-14:30)

Panel 3 (14:30 – 16:00)
Titel: Vernetzte Kommunikationskorpora analysieren – neue Erkenntnispotenziale und Fallstricke für die KMW
Leitfragen: Welche Voraussetzungen müssen Daten erfüllen, damit CCS Analysen überhaupt valide sind? Welche neuen Analyse- und Erkenntnispotenziale entstehen, wenn digitale Kommunikationskorpora auffindbar, gut dokumentiert, und verknüpfbar werden?
Referent:innen:
Marko Bachl (FU Berlin, Weizenbaum Institut) zu Bias und epistemische Konsequenzen von CCS;
Jakob Jünger (IfK der Universität Münster) Titel folgt
N.N.

Abschlussdiskussion (16:00-16:15)

Online-Vortragsreihe „FID Media Bites“ im SoSe 2026

2026年4月14日 15:18

Die FID Media Bites bieten praxisnahe Wissenshappen für die Kommunikations- und Medienwissenschaft. Zu jedem Termin steht ein Thema aus den Bereichen wissenschaftliches Publizieren, Urheberrecht, Open Science, Tools oder Forschungsdaten im Mittelpunkt, und zwar jeweils mit dem Fokus auf den fachspezifischen Rahmenbedingungen der Kommunikations- und Medienwissenschaft.

Die FID Media Bites finden während der Vorlesungszeit freitags von 11 bis 12 Uhr via Zoom statt. Im ersten Teil der Veranstaltung wird es einen thematischen Input geben und im zweiten Raum für Diskussion und Fragen.

Im Sommersemester setzen sich die FID Media Bites mit Predatory Publishing, digitalen Zugangsmöglichkeiten und aktuellen (KI-)Anwendungen von/für Archivbeständen sowie manueller und KI-assistierter Annotation auseinander. Die Inhalte basieren auf Themenwünschen der Teilnehmenden des Wintersemesters.

Die FID Media Bites richten sich an Forschende aller Karrierestufen, Mitarbeitende aus Infrastruktureinrichtungen in den entsprechenden Fachgebieten, Studierende sowie Interessierte. Organisiert und moderiert werden die FID Media Bites durch das Koordinationsteam des FID Media.

Die „FID Media Bites“ finden in diesem Zoom-Raum statt. Es ist keine Anmeldung nötig.

8. Mai 2026, 11:00 bis 12:00 Uhr

Maximilian Heimstädt (Hamburg): Predatory Publishing. Ein kleines Bestiarium des Raubtierverlegens

12. Juni 2026, 11:00 bis 12:00 Uhr

Götz Lachwitz (Potsdam): Bestände des Deutschen Rundfunkarchivs

3. Juli 2026, 11:00 bis 12:00 Uhr

Josephine Diecke und Eric Müller-Budack (Zürich/Hannover): Zwischen manueller Annotation und generativer KI. Hybride Workflows für audiovisuelle Analysen mit VIAN & TIB-AV-A 

Einladung zum TCDH-Forschungskolloquium „Perspektiven der Digital Humanities“

2026年4月13日 15:49

Vorträge des TCDH-Forschungskolloquiums im Sommersemester 2026

Alle Informationen und Zoomlink unter: https://tcdh.uni-trier.de/de/event/programm-des-tcdh-forschungskolloquiums-perspektiven-der-digital-humanities-1

Im Sommersemester 2026 setzen wir unsere Vortragsreihe im Rahmen des TCDH-Forschungskolloquiums fort. Das Spektrum reicht in diesem Semester von Fragen der digitalen Erschließung und Vernetzung historischer Texte und Wörterbücher über rechtliche und ethische Herausforderungen im Umgang mit Forschungsdaten bis hin zu digitalen Editionen und Plattformlösungen für die geisteswissenschaftliche Forschung.

Sie sind herzlich eingeladen, teilzunehmen und mitzudiskutieren!

Programm:

23.04.2026

  • Anne Klee (Universität Trier / TCDH): „Klassische Verfahren oder (Large) Language Models? Wie historische Dialektwörterbücher zu Linked Open Data vernetzt werden können”

07.05.2026

  • Selina Galka (Universität Graz): „Die Memoiren der Gräfin Schwerin: Digitale Erschließung eines einzigartigen Selbstzeugnisses”

21.05.2026

  • Zita Baronnet (Universität Trier / TCDH): „Urheberrechtlich geschützte Texte online veröffentlichen: Ein Versuch, das Paradoxon zu lösen”

11.06.2026

  • Irakli Khvedelidze (Shota Rustaveli Institute of Georgian Literature, Tiflis): „Korrespondenzforschung in Deutschland und ihre Relevanz für die Erschließung des georgischen schriftlichen Nachlasses: Ein Pilotprojekt”

25.06.2026

  • Edda Schwarzkopf (Digital Humanities Center, Universität Tübingen): „Der OMnibus of MANTRAMS: Entangled Data in a Minimalist Computing online platform”

02.07.2026

  • Frank Queens (Universität Trier / TCDH), Michael Scheffel (Universität Wuppertal), Anne Schittek (Universität Wuppertal), Olivia Varwig (Universität Wuppertal): „,kein Traum ist völlig Traum’. Die Genese der ,Traumnovelle’ in der digitalen Arthur Schnitzler-Edition”

Received before yesterday

DH2025 Book of Abstracts 공개

作者김병준
2026年4月12日 19:32

2025년 포르투갈 리스본에서 열린 세계 디지털인문학 학술대회인 <DH2025>의 초록집(The Book of Abstracts)이 공개됐습니다.

천페이지가 넘는 PDF 파일입니다. 본인 발표 및 각종 발표를 살펴볼 수 있는 기회입니다.

https://doi.org/10.5281/zenodo.19494801

게시물 DH2025 Book of Abstracts 공개KADH / 한국디지털인문학협의회에 처음 등장했습니다.

讲座预告 | 冯志伟《从符号处理到智能未来——大数据时代的语言学研究》

2026年4月13日 09:00

徐惠 2026-04-13 09:00 江苏

首图讲坛尚读沙龙第三讲,冯志伟5月16日主讲大数据时代语言学研究,可扫码预约。

讲座预告

首图讲坛尚读沙龙第三讲特邀冯志伟研究员,带来题为《从符号处理到智能未来——大数据时代的语言学研究》的专题讲座。

讲座时间及其他

  • 时间:2026年5月16日(周六)14:00

  • 地点:首都图书馆 A 座报告厅(东侧玻璃门入口)

  • 主办:首都图书馆、商务印书馆

主讲人简介

冯志伟研究员:国家教育部语言文字应用研究所研究员、博士生导师、学术委员会委员,新疆大学天山学者。

比特人文

投稿邮箱:dhbase@126.com

扫码关注 获取更多资讯

图片

阅读原文

跳转微信打开

会议丨我用AI校古籍——我是“校书官”古籍大众智能整理计划(2026年)启动仪式暨海外汉籍资源汇聚与典籍活化前沿论坛

2026年4月12日 09:00

徐惠 2026-04-12 09:00 江苏

2026年4月10、11日,AI古籍整理计划启动暨海外汉籍论坛在山东大学举办。

转载自“古典文献学微刊”

感谢会务组授权发布!

排版:拊石

比特人文

投稿邮箱:dhbase@126.com

扫码关注 获取更多资讯

图片

阅读原文

跳转微信打开

DHARTI Roundtable: India’s Space in Global Digital Humanities

作者DHARTI
2026年4月12日 00:14
Friday, April 17, 2026 | 7:00 PM IST | Virtual The DHARTI Governing Body invites scholars, faculty, and practitioners to a strategic conversation on India’s evolving role in the international DH community and how DHARTI can deepen digital humanities work across India. The recent ADHO decision to adopt double-blind review for DH2026 has sparked essential […]

“《语言文字应用》青年学者论学”第七期即将举办

2026年4月11日 09:01

徐惠 2026-04-11 09:01 江苏

《语言文字应用》青年学者论学第七期在长沙举办,聚焦语言文字与国家安全和发展战略。

转载自“语言文字应用杂志”

 青年学者论

“《语言文字应用》青年学者论学”第七期定于2026年4月10日~11日在国防科技大学军政基础教育学院举办,由《语言文字应用》杂志、国防科技大学军政基础教育学院联合主办。

1

论学主题

语言文字与国家安全和发展战略

2

主要环节

环节一:开学式

领导致辞

环节二:专家释讲

青年学者与专家就讲座内容交流释疑

环节三:青年论学

专家与青年学者就报告内容讨论交流

环节四:集体研讨

专家组织讨论交流并给予点评指导

环节五:对话辨析

专家与青年学者围绕主题自由对话

环节六:论学述评

专家对本期论学作述评总结

3

日程安排

0409下午(2)(再版)《语言文字应用》青年_08.png

0409下午(2)(再版)《语言文字应用》青年_09.png

 4

集体研讨环节分组

0409下午(2)(再版)《语言文字应用》青年_10.png

0409下午(2)(再版)《语言文字应用》青年_11.png

0409下午(2)(再版)《语言文字应用》青年_12.png

5

专家简介
(按发言顺序排列)

图片.png

刘正江新疆大学党委常委、副校长,教授、博士生导师。新疆文化名家“天山英才”暨“四个一批”人才,国家语言文字推广基地(新疆大学)主任。兼任新疆维吾尔自治区名词术语译文规范化委员会委员、教材审读专家组成员、出版物审读专家组成员,《新疆大学学报(哲学社会科学版)》(维吾尔文、哈萨克文)编委会主任,新疆民汉语文翻译研究中心及教育部人文社科重点研究基地“西北少数民族研究中心”兼职研究员。长期从事语言安全、语言政策与规划、民族问题等领域研究,2025年入选教育部“国家语言文字关键领域领航计划”,担任“语言与国家安全”创新团队负责人。出版专著2部,主编出版新疆维吾尔自治区规划教材“高等院校中国少数民族语言文学专业(维吾尔语言)本科系列教材”;在《光明日报》《中国社会科学报》《新疆大学学报(哲学社会科学版)》等报刊发表学术论文50余篇;主持国家社会科学基金项目及省部级科研课题多项,其中国家重大委托项目1项;多份咨询要报获中央级及自治区主要领导批示。

图片.png

胡键同济大学当代中国马克思主义研究院副院长、长聘教授、博士生导师。主要从事全球化、全球治理、马克思主义与当代等研究,尤其擅长跨学科研究;兼任上海市社会科学普及研究会副会长;曾长期担任《社会科学》杂志社社长、总编;出版个人专著《中国式现代化的城市软实力建设》《“一带一路”倡议与提升中国文化软实力研究》《中国和平发展崛起进程中的软实力建设方略》《资本的全球治理》等10部;在《中国社会科学》《世界经济与政治》《世界社会科学》等重要刊物上发表论文170余篇,其中70余篇被《新华文摘》《中国社会科学文摘》、人大复印资料转载;主持了国家社科基金重点项目、后期资助项目、重大项目子课题,以及上海市社科规划项目等10余项。

梁晓波国防科技大学军政基础教育学院军事外语系教授、博士生导师。国务院政府特殊津贴专家,湖南省优秀青年社科专家,军队国防语言、军语建设、心理与认知域等领域专家,国防科技大学教学名师。主要从事国防语言、军事话语、国际传播和认知语言学的研究。主持国家社科基金重大项目等省部级项目10余项,出版著作等10余部,发表论文百余篇,获湖南省优秀社科成果一等奖。

图片.png

刘洪东山东大学外国语学院副院长、教授。文学博士,国家一流专业法语和法语语言文学学位点带头人,国际组织与全球治理新文科专业和国际组织与跨文化交流微专业负责人,外国语学院国别区域研究团队负责人,现任外国语学院副院长、教育部高等学校大学外语教学指导分委员会委员,英国谢菲尔德大学、比利时列日大学和法国雷恩政治学院访问学者,主要研究方向为法语教学法、语言政策与语言规划、法语国家与地区研究、国际化人才培养等。主持国家级和省部级研究等项目十余项,主编或参编国家级规划教材7册,主持开设慕课5门,出版著作4部,发表期刊论文和智库成果三十余篇,获得山东省教学成果奖特等奖和一等奖。

图片.png

马晓雷国防科技大学军政基础教育学院军事外语系主任、教授、博士生导师。北京外国语大学外国语言学及应用语言学博士。军队院校外语协作联席会委员、中国语文现代化学会-语言治理研究会常务理事、湖南省教学指导委员会委员、湖南省学位委员会学科评议组委员、湖南省翻译协会常务理事、国防科技大学学科领军人才培养对象、国防科技大学学术委员会专家库成员、国防科技大学首批青年拔尖人才培养对象。主要从事国防语言、军事语言技术、军事外语教育等领域研究。曾获湖南省社会科学成果一等奖、湖南省教学成果二等奖、三等奖。2010年获评北京市优秀博士学位论文,2011年获评全国优秀博士学位论文提名。立三等功1次。

END

比特人文

投稿邮箱:dhbase@126.com

扫码关注 获取更多资讯

图片

阅读原文

跳转微信打开

Movers and haters: dynamic network visualization and analysis of an historical French controversy

2026年1月13日 08:00
Abstract
This article presents the results of a novel, mixed-methods project that studied an eighteenth-century French debate about education reform using approaches from Social Network Analysis and contemporary Controversy Mapping, alongside traditional humanities methodologies. Toggling between close reading of over 200 texts, and distant reading of the whole debate as a network, revealed that this little-known polemic—which we call the Querelle des collèges—was one of many early modern quarrels, and that its central actors were not straightforwardly those one might have expected. SNA uncovered the paradoxical role in the debate of the celebrity philosophe, Jean-Jacques Rousseau, as well as the previously overlooked participation of politicians, little-known teachers, and chronologically unexpected points of reference in this late-Enlightenment debate. Moreover, we underscore the value of analysing an historical controversy not just as a static network, considered at its end state, but as a dynamic entity that develops and changes over time. We show how a network can be dynamically visualized, to serve both exploratory and communicative ends. Ultimately, this article proposes a ‘bifocal reading’ method for historical controversy mapping, and identifies directions for future comparative research that might help us understand the dynamics of controversies from the past to the present.

From romance to reality: lexical and topic evolution in Chinese popular lyrics through digital humanities approaches

2026年1月13日 08:00
Abstract
This study explores the lexical and topic evolution of Chinese popular music lyrics from 2000 to 2025, reflecting changing public sentiments and broader socio-cultural transitions. While prior research has largely overlooked non-Western lyric corpora, this study addresses that gap by constructing the Chinese Popular Music Diachronic Corpus, comprising 1,560 representative popular songs sampled across twenty-five years. Using digital humanities approaches, it integrates word frequency analysis, readability metrics, and BERTopic-based topic modelling to trace lexical and topic evolution of lyrics over time. Findings reveal that high-frequency words consistently revolve around emotional expression, individual introspection, and interpersonal dynamics. Type-token ratio (TTR) has increased significantly, indicating growing lexical diversity, while textual complexity shows fluctuation, reflecting stylistic shifts in song writing. Topic analysis identifies twelve major topics, including romantic love, future aspirations, and urban life, with topic structures evolving from natural and temporal abstraction to emotional concreteness and psychological introspection. Recent years show a significant rise in negative emotional topics and self-referential artistic motifs. This study contributes a novel methodological framework for interdisciplinary research at the intersection of music, language, and society, and underscores the value of digital humanities tools in mapping collective emotions and cultural change through large-scale lyric analysis.

Investigating the structural formation system of modern simplified Chinese characters from a complex network perspective

2026年1月13日 08:00
Abstract
Chinese characters hold pivotal significance in the development of Eastern civilization. While their structural formation exhibits a systematic nature, system science approaches are seldom seen in analyzing the formation system. Therefore, based on complex network methods, this study aims to examine macro-scale network features and the essential system properties of modern simplified Chinese characters. Specifically, three types of networks were constructed: co-occurrence, directed, and weighted networks, along with their random counterparts. In these networks, primitive components served as nodes, and their relationships as edges. Subsequently, seventeen general network metrics were measured to analyze the network features, enabling deeper discussion of the system properties. Research results show that component networks exhibit five distinct network features compared to their random counterparts, including small-world feature, scale-free feature, disassortative mixing, high centrality, and hierarchical organization. These features demonstrate that the formation system displays three properties, namely complexity, robustness, and economy, which emerge respectively from organized, close-knit, and efficient component combinations. These findings serve as a significant supplement to the empirical research on the structural formation system of Chinese characters.

Topic counts and quality in topic models for historic corpora

2026年1月13日 08:00
Abstract
Topic modelling methods enable the identification of potential topics within a corpus of historical texts; in particular, they enable the identification of latent topics that are not described just by a single word. Like so many computational methods for the automatic processing of historical text corpora, they come with a number of parameters with which the method can be tuned and adapted. Each change in the settings of any of these parameters will generate a new set of topics that will differ in larger or smaller ways and which may be qualitatively better or worse. One of the main parameters for tuning topic models is setting the number of topics to be generated. In this article, we present an analysis of the impact of the number of topics on the quality of topic models for two historical text corpora. Two manual evaluation approaches are combined with an automated evaluation metric, and based on the results, we propose a formalized process for choosing the final set of parameters for a topic model. The process ensures the quality of the final model, while minimizing the amount of manual evaluation work. The more structured process also allows for better documentation of the parameter choices and in that way enables better replicability of any research using topic models.
❌