阅读视图

DADH 2026 Call for Paper 延期至8月10日,歡迎投稿!

「第十七屆數位典藏與數位人文國際研討會(DADH 2026)」徵稿啟事
CFP: The 17th International Conference of Digital Archives and Digital Humanities (DADH 2026)

DADH 2026 Poster

時間:2026年10月31(六)~11月1日(日)
地點:國立中山大學

摘要截稿:7月31日(五) 延期至8月10日(一) 17:00 (任何時區)
審查通知:8月15日(六)
全文截止:10月2日(五)

歡迎踴躍投稿!
會議網站:https://sites.google.com/view/2026dadh/

  •  

Call for Hosts DHd2029

DHd20xx ist die jährliche, internationale Fachtagung der Digital Humanities im deutschsprachigen Raum (DHd, https://digitalhumanities.de) und die führende wissenschaftliche Konferenz für die Digital Humanities im deutschen Sprachraum (Vergangene Konferenzen: https://digitalhumanities.de/vergangene-konferenzen/). Der Fachverband Digital Humanities im deutschsprachigen Raum bittet nun um Bewerbungen um die Ausrichtung für die fünfzehnte Tagung (DHd2029). Da der Fachverband anstrebt, die Konferenz wechselnd in Deutschland und außerhalb Deutschlands zu veranstalten, freuen wir uns besonders über Bewerbungen von Einrichtungen aus dem deutschsprachigen Raum außerhalb Deutschlands.

Bisherige Konferenzen haben bis zu 650 Teilnehmer:innen aus dem deutschsprachigen Raum und angrenzenden Ländern angezogen. Die Tagungsprogramme sahen jeweils zwei Tage für Workshops und drei Tage für das Hauptprogramm bestehend aus Keynotes, parallelen Sektionen mit wissenschaftlichen Vorträgen, Paneldiskussionen, Posterpräsentationen und Doctoral Consortia vor. Die Einführung neuer Formate ist in Abstimmung mit dem Verband und dem Programmkomitee möglich.
Das wissenschaftliche Programm der Tagung wird durch ein vom Fachverband eingesetztes internationales Programmkomitee auf Grundlage eines Call for Papers und eines anschließenden Review-Verfahrens erstellt. Das Konferenzprotokoll des DHd-Verbands muss berücksichtigt werden (https://digitalhumanities.de/konferenzprotokoll/).

Die Tagung finanziert sich über Teilnahmegebühren und von der ausrichtenden Institution bereitgestellte oder über Partner:innen oder Sponsor:innen eingeworbene finanzielle Mittel. Die erhobene Tagungsgebühr ist mit dem Vorstand des Fachverbandes abzustimmen und soll vier Kategorien umfassen: reguläre und ermäßigte Mitglieder des DHd (letztere im Sinne der Regelung zur ermäßigten Mitgliedschaft im DHd-Verband) sowie reguläre und ermäßigte Nicht-Mitglieder des DHd.

Die Bewerbung um die Ausrichtung der DHd2029 soll umfassen:

  • einen Vorschlag für ein Tagungsmotto sowie zwei Terminvorschläge (bevorzugt im Zeitraum Februar bis März). Bei der Terminplanung soll auf potentiell konkurrierende Konferenzen, Semesterzeiten und Feiertage sowie Schulferien geachtet werden.
  • einen Überblick über die für die Konferenz bereitgestellte Infrastruktur (vor allem Tagungsräume für Workshops, AG-Sitzungen, parallele Sektionen und Plenarveranstaltungen)
  • Aussagen über die Unterstützung der Ausrichtung vor Ort (z.B. durch die Universitätsleitung)
  • eine Aussage über die Verwendung von Management- und Bezahlsystemen (das System Conftool ist dafür etabliert und soll zumindest für die Einreichungen genutzt werden)
  • eine Aussage über die Unterstützung der Publikation der Tagungsbeiträge in Kooperation mit dem Data Steward des DHd-Verbands
  • Angaben zur Erreichbarkeit des Tagungsortes (bzw. ggf. der Tagungsorte) und die Verfügbarkeit von Unterkünften (inkl. Preisschätzungen)
  • eine Einschätzung zu den Möglichkeiten einer teilweisen virtuellen Partizipation
  • Ideen für Social Events
  • Vorschläge zur Erreichung einer hohen Sichtbarkeit der Tagung
  • Maßnahmen zur Förderung von Nachwuchswissenschaftler:innen (inkl. Studierende)
  • eine vorläufige Kostenkalkulation und Vorstellungen über die Tagungsgebühr
  • ggf. Preiskonzept bei Planung einer vollständigen Hybridkonferenz
  • eine Erklärung, dass die Konferenz entsprechend der im Konferenzprotokoll dargelegten Bedingungen ausgerichtet wird.

Der Verband begrüßt Maßnahmen, die auf Inklusion und Minimierung des Ressourcen-Fußabdrucks abzielen.

Bewerbungen werden bis 31.10.2026 entgegengenommen (formlos per E-Mail an den Tagungskoordinator im Vorstand des Fachverbandes, Nils Reiter: nils.reiter@uni-koeln.de). Interessierte Ausrichter:innen werden gebeten möglichst frühzeitig, in jedem Falle aber vor Einreichung ihrer Bewerbung, mit Nils Reiter Kontakt aufzunehmen. Die Bewerbung sollte zehn Seiten möglichst nicht überschreiten. Die Vergabe der Tagung erfolgt durch den Vorstand des Fachverbandes bis spätestens 31.01.2027.

  •  

Open Access journals published in Belgium without author fees

This blog post was written by Demmy Verbeke and Laura Mesotten.

A first version of the dataset dedicated to the landscape of Belgian Open Access (OA) journals which do not charge author fees has been published with DOI 10.5281/zenodo.20760254.

This overview, compiled by Laura Mesotten and Demmy Verbeke, provides a comprehensive list of Belgian Diamond OA journals – defined as journals that are published in OA without charging author fees and that are governed by the academic community. The dataset includes a range of bibliographical, editorial, and technical details, such as ISSNs, publishing software used, funding sources, and peer review status. In addition, the dataset documents the operational Diamond OA criteria for journals as developed in the context of the DIAMAS and CRAFT-OA projects. As such, it serves as a practical tool for identifying journals that are eligible for inclusion in the Diamond Discovery Hub maintained by the European Diamond Capacity Hub.

The “About” section of the dataset outlines the methodological choices and scope. For instance, it specifies the criteria used to determine whether a journal qualifies as Belgian. For the purposes of this dataset, a journal is considered Belgian if its publisher or publishing entity (i.e., the institution or society responsible for the journal) is legally based in Belgium. In cases of co-publishing, a journal is also considered Belgian if at least one co-publisher or publishing entity is legally based in Belgium, even if the registered publisher is located elsewhere. By contrast, indicators such as the nationality or institutional affiliations of editors, funding from Belgian institutions, or distribution via Belgian platforms are not considered as sufficient grounds for classifying a journal as Belgian.

The dataset further includes a “Belgian delayed OA journals” tab, which provides information on journals whose content is made openly available after an embargo period. Inclusion in this category is restricted to journals where OA applies to the issue as a whole (rather than to individual articles) and where such access is unconditional – that is, authors can be assured that their publication will become openly accessible after a defined embargo period. No restrictions are imposed on the length of the embargo, and, where identifiable, the duration of embargo period is explicitly recorded in the dataset. Journals are excluded from this category if it is not clearly stated that they provide delayed OA, or if it remains uncertain whether the availability of open content reflects an established embargo policy or merely the opening up of the journal’s archive, without reassurance that newly published material will become openly accessible over time. This section should be viewed as an initial exploratory effort to map delayed OA journals in the Belgian context. While distinct from Diamond OA, delayed OA regularly shares certain features with it, notably the absence of author-facing fees. Further research will be required to validate and refine the identification of such journals. Including them at this stage enables their separate documentation and supports the monitoring of changes in access conditions over time.

As a first release, the dataset should be regarded as a living resource rather than a definitive inventory. It is intended to support research and analysis on scholarly communication and Diamond Open Access publishing in Belgium, while also facilitating the visibility and monitoring of community-led journals. The dataset will be periodically updated to reflect changes in journal policies, platforms, and indexing statuses. Users are encouraged to consult the most recent version and to share additions, corrections, or comments with the authors.

  •  

Call for Nominations to EADH Executive Committee

Call for Nominations to EADH Executive Committee

The nomination period for EADH Elections is officially open. We are currently seeking four (4) new members to join our Executive Committee. This is an exciting opportunity to actively contribute to the development of a newly relaunched EADH from 2026-2029!

When does the nomination and election period open and close?

The nomination period opens on 10 July 2026 and closes on 7 August 2026. The Elections will be held from 12 August to 9 September 2026. Elected EADH Executive Committee Members will be announced when the election period ends, and formally inducted in September 2026 during the General Meeting of EADH Members at the EADH Conference in Krakow, Poland. More information about the conference can be found here: https://eadh2026.confer.uj.edu.pl/ 

What does an EADH Executive Committee Member do?

Members of the Executive Committee regularly support EADH by acting in a number of roles, including by serving on the ADHO Constituent Organization Board and the yearly Programme Committee for the ADHO conference, by lobbying the European Commission for more funding through representation in the European Alliance of Social Science and Humanities (EASSH) organization, etc. We also have members who take on the responsibility for distributing bursaries and other funded awards to members of our community. Any member who wants to take action on their own initiative relevant to their interests and the goal of EADH is welcome to propose new lines of action. The work of EADH is supported by infrastructure run and maintained by the EADH exec, and is informed by a series of close relationships with our Associate Organizations (AIUCD [Associazone Informatica Umanistica e Cultura Digitale], CzADH [Czech Association for Digital Humanities], DHd [Association for Digital Humanities in the German Speaking Countries], and DHNB [Digital Humanities in the Nordic and Baltic Countries]). Executive Committee Members shape and execute this work on behalf of the organization. 

What is the time commitment for this position?

We expect EADH Executive Committee Members to take an active part in our organization by serving in a variety of specific roles, which can include (but are not limited to) our Small Grants Committee, Outreach Committee, Infrastructure Committee, Governance Committee, and Elections Committee. These committees are cyclical, meaning that at certain times they become more active and at other times of the year they can be dormant. Normally, the Executive Committee holds monthly online all-hands 1.5 hour meetings to update each other on progress within specific committees, and we also have designated, smaller group meetings to work within these committees when they are active. At times of the year when we are planning workshops, seminars and conferences, Executive Committee members from relevant subcommittees can spend ca. 5 hours per week working communally on EADH business. Executive Committee members also have a Mid Term meeting once per year which is typically a one to two day in-person event, and we also organize an in-person General Meeting each summer at the ADHO Conference that lasts ca. 1.5 hours. The attendance of all Executive Committee Members at the Midterm Meeting is funded by EADH, and the attendance of the Officers (Chair, Treasurer, Secretary, etc.) at the ADHO General Meeting is funded by EADH. Where attendance in person is not possible, the meetings can be run in a hybrid format.

Who is eligible to be in EADH Executive Committee Member?

EADH members and members of Associated Organizations of EADH are eligible to become members of the EADH Executive Committee. This means that those wishing to take part during the nominations period as either nominees or proposers (explained below) must have been Members in Good Standing (i.e. have paid their membership fees) by 3 July 2026, whether as a direct or joint member of EADH, or through one of its Associate Organizations.

What are we looking for in an EADH Executive Committee Member?

EADH encourages a diverse and representative Executive Committee, and welcomes candidates from all backgrounds. For further information, please see our diversity and inclusivity statement <https://eadh.org/about/diversity-and-inclusivity>. We welcome candidates working at every level of professional and educational development  and every area in which aspects of DH are practiced, including archives, galleries, libraries, museums, universities, independent scholars, and any other public or private organizations invested in promoting DH activities across Europe. More important than a particular academic or professional degree is a candidate’s willingness to work actively and communicate openly with and for our community. 

How do nominations work? 

Potential candidates can self-nominate with the support of two current members of EADH.* Each person wishing to be nominated to stand for election to the EADH Executive Committee must submit the following three documents:

  • two nomination statements by EADH members (here, the proposers), stating the name of the person they wish to nominate (that is, the nominee). The names of the proposers and their respective nomination statements will not be made public.
  • a statement by the nominee of no more than 200 words (links excluded), expressing the willingness to stand for election. Statements longer than 200 words will be disregarded. Statements by the nominees will be a matter of public record during and after the election.

The statements of the proposers and the statement of the nominee (three documents in total) must be sent by the nominee to the Chair of the Elections Committee, Joëlle Weis (elections@eadh.org) no later than midnight on 7 August (GMT).

*If you wish to stand for EADH elections in 2026 but do not know two other members of EADH, please be in touch and we can help you to find two supporting members. 

About EADH

EADH is the umbrella organization for researchers interested in Digital Humanities across Europe. We have direct membership options for EADH, as well as membership options for our Associate Organizations (AIUCD [Associazone Informatica Umanistica e Cultura Digitale], CzADH [Czech Association for Digital Humanities], DHd [Association for Digital Humanities in the German Speaking Countries], and DHNB [Digital Humanities in the Nordic and Baltic Countries]). We also collaborate with other European DH organizations, such as our participating organization, Digital Humanities BeNeLUx, and the external UK-Ireland Digital Humanities Association. Members of the Executive Committee of EADH coordinate the DH community across Europe through monthly seminars, occasional workshops, and bi-annual conferences. EADH advocates for and supports all of our members in their digital humanities work. 

Contact

Questions about nominations and elections can be directed to Joëlle Weis, Chair of the 2026 EADH Elections Committee (elections@eadh.org). Questions about membership can be directed to Jiří Kocian, Secretary of EADH (secretary@eadh.org).

  •  

[Conference] HKADH2027 -Model/Making: Toward Generative Humanities

作者Baro

https://2027.hkadh.org

1. 행사 개요

  • 행사명: HKADH 2027 (Hong Kong Association for Digital Humanities Annual Conference)
  • 대주제: “Model/Making: Toward Generative Humanities” (모델/만들기: 생성형 인문학을 향하여)
  • 개최 기간: 2027년 1월 21일(목) ~ 1월 24일(일)
  • 개최 장소: 홍콩 (홍콩교육대학교 주최)
  • 기조연설자:
    • Maria Antoniak (콜로라도 볼더 대학교 / NLP, 문화 분석, 계산 인문학)
    • Hilde De Weerdt (루벤 대학교 / 동아시아 텍스트 디지털 방법론, 정보사)
    • Richard Tzong-Han Tsai (국립중앙대학교·국립대만대학교·중앙연구원 / NLP, 인공지능)

2. 주요 일정

  • 초록 제출 마감: 2026년 9월 1일
  • 심사 결과 발표: 2026년 10월 1일
  • 본 학술대회: 2027년 1월 21일 ~ 24일

3. 핵심 세부 주제

디지털 인문학(DH)에서의 모델 및 모델링과 관련하여 다음과 같은 주제를 집중적으로 다룹니다.

  • 문화·예술 생산 엔진으로서의 모델: 내러티브, 음악, 예술, 게임을 생성하는 모델 활용 및 예술적 실천으로서의 데이터 모델링
  • 디지털 물질성: 3D 인쇄, 위빙, 로보틱스, VR/AR 환경 및 새로운 스토리텔링 방식
  • 시뮬레이션 및 합성 데이터: 인문학적 맥락에서의 공간·사건 시뮬레이션 및 합성 데이터 활용
  • 아카이브 및 디지털 유산: 데이터 모델, 메타데이터 표준, 온톨로지 등이 보존 및 유산 관리에 미치는 영향
  • 협업 및 사회적 영향: 문화재 생산 과정에서의 인간-AI 협업, 저작권 및 지적 재산권 문제, 생성형 미디어에 대한 과도한 의존 문제 검토

4. 발표 유형 및 제출 안내

모든 제출물은 Microsoft CMT 시스템을 통해 제목, 초록, 저자 정보 및 소속이 포함된 PDF 파일로 제출해야 합니다. (참고문헌 목록은 단어 수 계산에서 제외됩니다.)

  • 논문 발표 (Papers): 750단어 초록 제출 (10분 발표 + 10분 질의응답)
  • 포스터 (Posters): 750단어 초록 제출 (진행 중인 연구 공유 및 피드백에 적합)
  • 조직 패널 (Organized Panels): 1,500단어 초록 제출 (개별 발표 설명 및 전체 요약 포함, 60분 또는 90분)
  • 워크숍 및 라운드테이블 (Workshops / Roundtables): 1,000단어 초록 제출
  • 창작 작품 (Creative Work): 500단어 초록 제출 (영상 워크스루 등 작품의 일부를 확인할 수 있는 링크 포함 필수)
  • 평가 기준: 독창성(25%), 품질(25%), 중요성(25%), 주제 관련성(25%)

5. 특별 프로그램

  • 구룡성채(Kowloon Walled City) 문화 투어: 홍콩교육대학교의 “Digital Kowloon” 프로젝트와 연계하여, 3D 스캐닝, 포토그래메트리, 실감형 스토리텔링을 통해 도시의 변화와 사라져가는 공간들이 어떻게 디지털 유산 모델로 재구성되는지 탐방합니다.
  • 아트 쇼케이스: 주최 측 미디어 아티스트(Hung Keung)의 작품 및 학술대회에 출품된 우수 창작 작품들을 전시합니다.

게시물 [Conference] HKADH2027 -Model/Making: Toward Generative HumanitiesKADH / 한국디지털인문학협의회에 처음 등장했습니다.

  •  

【转载】DH教育|大连理工大学人文学院全力推进数智时代人文教育转型

2026-07-07 17:00 北京

文科综合国家级实验教学示范中心立足学校数智变革发展战略,积极探索数智时代人文素质教育改革新路径。

当前,人工智能引领的科技革命与产业变革持续重塑教育形态,高校育人重点正从知识传授转向能力培养、从单一专业转向交叉融合。人文学院深入贯彻落实学校“数智变革年”重要工作部署,持续深化新优势锻造,紧密结合学校“四类人才”培养目标,深入推进课程内容、教学场景、教学形态重塑,全力提升教育教学质量。作为承担全校人文素质教育的重要实践平台之一,文科综合国家级实验教学示范中心立足学校数智变革发展战略,积极探索数智时代人文素质教育改革新路径。

锚定数智主线  迭代升级育人教学体系

中心秉持“科技赋能人文、人文引领科技”理念,系统性重构育人教学体系,着力培育学生数智、文化、美学与伦理四大核心素养。以课程改革为牵引、实验平台为支撑、项目实践为载体,搭建数智创新、文化传承、美育实践、价值引领四大实验平台,将人工智能、数字人文、传统文化、科技美学、数字文化创意、科技伦理等前沿内容深度融入人文素质教育全过程,构建起“课程学习—项目实践—成果转化”的一体化人文素质教育新体系。

革新育人模式  场景实践锤炼数智能力

在育人模式上,中心推行项目式、场景化教学,倡导“干中学”的实践育人理念。聚焦数字文化传播、文化遗产数字化保护、数字创意设计、沉浸式场景搭建、AIGC人文内容创作等领域,将真实产业项目、社会服务任务嵌入日常教学,实现课堂与数智实践场景无缝衔接。依托《AIGC虚拟影像制作》《新媒艺术表现》《数字技术创作》等课程,引导学生围绕文化遗产主题,综合运用AIGC、UE引擎等数智工具开展数字内容创作与实践。

同时,教师分层分类设计跨学科实践任务,组织学生以团队形式参与全流程实践。在《文物美学数字呈现》《文物IP衍生设计》等课程中,学生以《山海经》等中华经典作品为创作素材,运用AI技术开展角色创意设计,探索传统文化数字化创新表达。

深耕校地联动  需求牵引激活数智实践育人动能

中心坚持以需求牵引项目、以项目带动教学、以实践培养能力,深化校企、校地合作,共建数智实验教学项目。依托学校重大文化传播项目,中心联合学校新闻中心打造大型历史纪录片《争气港》,承担AI数字内容制作,形成“需求导入—项目实践—成果培育”的常态化数智实践育人机制。

聚焦成果落地  闭环育人凸显数智价值

中心以实践成果和社会应用检验育人实效,全力推动课堂作品、实验项目、学生科创成果走出实验室、落地真实场景、服务校园与社会发展。持续拓宽数智人文实践应用赛道,将学生数字化创作成果、文化创新作品、科创实践项目广泛应用于校园文化数字化建设、区域数字文化传播、公共文化服务升级、传统文化数字化活化等多元场景,真正实现从“课堂实验作品”到“实用创新成果”、从“单一教学项目”到“社会服务载体”的有效转化。

未来,文科综合国家级实验教学示范中心将持续紧扣学校“数智变革年”工作部署,融入“环大工创新创业生态圈”建设,完善“教育—实践—创新—转化”育人体系,形成教育链、人才链、创新链与产业链深度融合的人文素质教育新模式,为学校数智变革和新时代高校人文素质教育改革贡献具有大工特色的实践经验。

END

阅读原文

跳转微信打开

  •  

【周年福利】中华书局天文历法训练营优惠活动开启

2026-07-07 17:00 北京

欢迎各位读者报名。

中华书局古籍整理训练营之

天文历法专题班

优惠活动开启

2026.7.6-8.31

我国古籍中蕴含着丰富的天象及时间记载。古代天文历法知识既是中华传统文化的璀璨瑰宝,也是古籍阅读、整理与研究路上绕不开的重难点。看不懂历日、辨不清天象、不会推算历法,常常令众多古籍爱好者、研究者止步不前。

为了帮助大家攻克这一难题,籍合学院去年6月推出中华书局古籍整理训练营(天文历法专题班)。如今课程上线已满周年,直播答疑课程即将开启,今特推出优惠活动,欢迎关注。

点击报名天文历法训练营

训练营

背景简介

自 2022 年 8 月首期古籍整理训练营开营以来,籍合学院围绕古籍整理,先后打造基础班、文字音韵训诂专题班、版本鉴定专题班、佛教文献整理专题班、简帛文献专题班等多门专项训练营。

天文历法作为古籍整理的重难点问题,筹备已久。本期专题班聚焦实战应用,拒绝纯理论科普,手把手引导学员吃透古代天文历法知识,掌握历日推算、天象校勘等实用技能,争取彻底解决古籍研读中的历法难题。

训练营

基本信息

名称:中华书局古籍整理训练营(天文历法专题班)

开营时间:随报随学,有效期一年

培训形式:线上培训

基本信息

培训对象

◆ 古籍整理训练营有进阶需求的学员

◆ 对天文历法感兴趣的读者。

◆ 传统文化爱好者

考核认证学习有效期内完成全部必修课程及实践练习即可领取中华书局签章电子证书。纸质证书自愿申领(需支付工本费)。

费用699元/人

可提供电子发票(普票)及签章课程单。

(集体团购请咨询工作人员)

学习计划

本期目标:了解天文历法的基本概念与常识,初步掌握基本技能,解决古籍阅读、研究、整理中的天文历法问题。

天文历法通识

中国古代天文历法漫谈

黎耕

中国科学院国家天文台副研究员、中国科学院大学副教授

3课时

古籍整理与天文

古籍中天象记录的校勘与利用

唐宸

清华大学人文学院副教授

3课时

古籍整理与

历史年代

古籍整理中的历史年代学

邱靖嘉

中山大学历史学系教授

5课时

古籍与

历法计算

古代历法计算法入门

郜积意

湖南大学岳麓书院教授

9课时

诗词与

天文历法

诗词中的天相与真相

简锦松

台湾中山大学特聘教授

2课时

选修

直播答疑

根据学员反馈,安排直播答疑课程。

d

训练营

优惠活动

费用及报名

原价:699元/人

限时拼团价:

  • 双人团629元/人

  • 三人团599元/人

  • 五人团499元/人

↑ 点击图片报名,探索古籍中的天文历法

以上信息如有未尽者,可通过以下方式联络咨询:

  • 邮箱:training@ancientbooks.cn

配套课程推荐

● 古籍整理基础:中华书局古籍整理训练营(基础班)第5期

training.ancientbooks.cn

用更优质的内容和更卓越的体验

为热爱古籍的你提供最好的成长通道

阅读原文

跳转微信打开

  •  

2026年北大可视化暑期学校第四讲 - 走向可信任的可视化设计 - 蓝星宇

原创 可视分析 2026-07-07 14:51 北京

2026年7月3日上午是北京大学可视化发展前沿研究生暑期暨首届人文智能暑期学校的第四讲,由复旦大学新闻

    2026年7月3日上午北京大学可视化发展前沿研究生暑期暨首届人文智能暑期学校的第四讲,由复旦大学新闻学院的蓝星宇老师主讲,主题为《走向可信任的可视化设计》。

会说谎的地图,如何制造事实感

蓝老师首先从地图谈起,指出地图并不总是现代意义上的精确测量工具。中世纪地图常受宗教世界观影响,世界中心可能是耶路撒冷,东方被视为神圣方向,越远离中心的地方越容易混入神话、传说和想象。到了近代,地图依然可能成为误导工具:有人把误判出的“桑尼科夫地”长期标注在北冰洋地图上,有航海者将虚构岛屿画进航海图,也有人编造“波亚斯国”,用地图、小册子、国债和移民船票包装骗局。地图在这些案例中不只是描摹世界,而是在制造一种看似可靠的事实感。一个不存在的地方,一旦被画出边界、河流、山脉和航线,就可能比口头谎言更容易被相信。

中世纪世界地图案例

政治图表如何把数字变成立场

在政治传播场景中,图表常常披着数据外衣表达立场。蓝老师展示了多个政治竞选图表案例:有的柱状图中,9.4% 的柱子被画得比 14% 更高;有的图表把 37% 和 33% 的微小差距拉大到像是压倒性胜利;还有的图表通过截断坐标轴、改变比例、强化颜色和构图,让特定阵营看起来更有优势。这些图表的问题并不只是“不美观”,而是用视觉比例替代真实比例,用设计语言制造情绪和判断。讲座由此提出一个底线:装饰不是原罪,可视化可以有风格、叙事和审美,但不能破坏数据的真实和准确。一旦为了好看或好传播而扭曲坐标、比例和趋势,图表就从解释事实滑向了服务立场。

政治传播中的误导性呈现

从“图表垃圾”到“章鱼地图”,装饰何时成为说服机制

   蓝老师介绍了团队关于可视化缺陷的研究。他们从公众吐槽问题图表的网站中收集案例,并将缺陷归纳为误导性信息、信息无效和社会不适切三类。问题图表的来源并不单一:有些来自刻意操纵,有些来自设计者信息素养不足,有些来自过度追求美观、工具限制、甲方压力或团队协作失效。讲座进一步以“章鱼地图”为例,说明装饰有时并不是图表旁边的点缀,而会成为说服机制的核心。章鱼地图把国家、政权或力量画成巨大的章鱼,用触手表现侵略、扩张、控制和压迫。团队收集到的 90 张章鱼地图跨越 19 世纪至今,在一战和二战前后出现明显高峰。章鱼的头部代表压迫者,触手代表扩张和控制,被触及的地区代表受威胁对象。读者几乎不需要文字解释,就能读出敌意、恐惧和道德判断。这说明可视化不只是呈现数据,也是一种修辞。

装饰性表达与数据准确性的边界

说服性地图中的强修辞视觉装置

AI 换脸与 AIGC 图表,如何改变公众对数据的信任

讲座最后讨论了 AIGC 时代的新问题:过去我们主要担心图表本身造假,现在即使图表没有被直接篡改,“谁在讲述这张图”也可能影响公众对数据的信任。蓝老师团队研究了 AI 换脸在数据视频中的作用。当数据视频中的讲述者、主播、老师或博主可能是 AI 换脸时,观众对人脸真实性和图表真实性的判断会相互影响。实验发现,在未提前告知的情况下,很多观众看不出 AI 换脸;提前告知虽然能提高警惕,却也会让观众更加多疑,甚至把真实人物误认为假人。更重要的是,观众对讲述者的信任和对图表的信任高度联动,很多人并不会仔细检查坐标、比例和数据逻辑,而是先凭讲述者形象、声音、专业感和第一印象判断内容是否可信。与此同时,文生图工具虽然能生成看起来像图表的画面,却常常无法准确映射数据。相比直接生成图表图片,更稳妥的路径是让 AI 辅助写代码,再由代码渲染图表,保证数据、坐标、标签和视觉比例可检查、可复现。

ai换脸影响统计图

结语

    这场讲座最有价值的提醒,也许是:我们不能因为一张图看起来专业,就自动相信它。

    今天,我们每天都在刷到图表、地图、排行榜、信息图、视频解说和 AI 生成内容。图像越来越精美,传播越来越快,技术门槛越来越低,但真实并没有因此自动变得更容易获得。对设计者来说,好的可视化不只是把图画漂亮,而是让数据被诚实地表达,让读者能够合理地理解。对读者来说,好的信息素养也不只是“看懂图”,而是敢于追问:这张图的数据从哪里来?坐标轴有没有被截断?比例有没有被夸大?颜色和面积是否在暗示某种立场?装饰是否改变了我对数据的判断?讲述者的形象是否影响了我对内容的信任?图表不是事实本身,它只是事实的一种表达方式。越是精美的表达,越需要被认真地观看。在后真相时代,学会看图,也是在学习如何重新相信真实。

Image

欢迎大家关注北京大学可视分析微信公众号(VisualAnalytics)

获取最新消息

阅读原文

跳转微信打开

  •  

2026年北大可视化暑期学校第五讲 - 可视化案例分析和设计的思考 1 - 陈慰平

原创 可视分析 2026-07-07 14:51 北京

2026年7月3日下午,北京大学可视化暑期学校第五讲,中央美术学院陈慰平 -《可视化案例分析和设计的思考1》

    7月3日下午,第十七期北京大学可视化暑期学校第五讲正式开始。本讲邀请到来自中央美术学院的陈慰平老师。陈老师是中央美术学院教授,同时担任香港北京高校校友联盟副会长,兼任国际人机交互委员会委员。研究方向聚焦于信息可视化设计、图像体验设计及数字媒体研究三大领域。 

可视化的认知基础

    陈慰平老师以穆里尔·库珀的名言开篇:“信息只有在被理解时才有用”,并引用格式塔心理学家考夫卡的观点“整体不同于其部分之和”,指出人类视觉系统天然具有将零散元素组织为整体的倾向,这正是可视化设计的心理学根基。

可视化的认知基础

经典可视化

    陈老师带领大家回顾了William Playfair在1786至1801年间的开创性工作。Playfair在没有美术背景的情况下,凭借“让数据易于理解”的朴素愿望,先后发明了折线图,条形图,饼图。陈老师特别指出,这些今天看来理所当然的图表形式,在当时是不经意的创造,却奠定了现代统计学可视化最基本的视觉规范。

William Playfair创作的折线图

    拿破仑东征图不仅包含了军队数量变化、地理位置、行军路线、时间轴等信息,还标注了温差等环境因素。“它不仅是内容丰富,更重要的是将内容变成了一种叙事。” 图片元素繁多但不杂乱,还隐含了作者对这场战争的情感判断。此外,死亡人数与严寒天气的直观关联,让可视化不再仅仅是呈现结果,更成为一种论证工具和推理工具。

拿破仑东征图

    对于南丁格尔的玫瑰图陈老师指出,该图用直观的扇形面积对比,清晰地展示了克里米亚战争中因缺乏护理而导致的死亡人数远超战死人数(蓝色代表本可缓解的死亡、红色代表战争伤亡、黑色代表其他原因)。

南丁格尔玫瑰图

视觉思维与信息组织

   在讲解经典案例之后,陈老师深入阐述了可视化设计的核心原则。陈老师引用Edward Tufte的观点强调:“混乱不是信息的属性,而是设计的失败。” 视觉问题不应通过减少内容(如删除数据标签)来解决,而应通过改进设计来化解。随后,陈老师展示了如何将抽象的数据点转化为具象的图像,用动物自身的形象替代抽象的点,让数据与语义自然融合。

动物脑质量与总质量可视化

    紧接着,在河流与湖泊地图的案例中,陈老师展示了如何通过直线化处理、清晰的视觉层次、数据密度平衡等手法,对复杂的地理信息进行空间重构与秩序化。“长度、方位、位置同时考虑”,让数据的空间分布规律一目了然。

与湖泊地图

面向公众的可视化

    陈老师介绍了Isotype(国际图形文字教育系统) 。这一系统旨在用简洁的图形符号构建一种“没有文字的世界语言”,让不同国家、不同性别、不同文化背景的人都能理解复杂的统计信息,例如汽车工业的流水线与手工生产对比。

汽车工业的流水线与手工生产对比图

    在艺术流派谱系图案例中,陈老师强调了箭头等连接符号的重要性:“把箭头取消,就看不出元素之间的联系,看不到流派传承或演变历史。” 可视化不仅是数据和美学的组合,更是知识叙事与逻辑构建之间的关系性工具。

艺术流派谱系图

    在越战纪念碑案例中,这座纪念碑下沉于大地,设计理念是“只有悲伤,没有值得宣扬的战争”。名字按照伤亡时间排序,战争中期名字最多,亲属在悼念时会发现来自同一旅、同一连的名字排列在一起,间接揭示了伤亡的空间聚集性。设计中的视觉符号同样富有深意:十字架代表未找到尸体或铭牌;如果确认死亡,则将十字架改为菱形。陈老师将这一设计称为“可视化 = 身体与空间体验的叙事。”

越战纪念碑案例

当代方法:Horizon Graph与历史网络

    在处理大规模时间序列数据时,陈老师介绍了Horizon Graph(地平线图)。通过颜色深浅表示涨跌幅度,在有限的平面空间内实现高密度时序数据的空间折叠,让大数据量在有限画幅中依然可读。

地平线图

    在字体设计史的案例中,陈老师展示了如何构建一个非线性历史关系网络:用户在交互探索中灰色代表关联但未被选中,点击后显示实线表示直接关系、虚线表示衍生关系。

字体设计史案例

总结

    讲座最后,陈老师借用了爱德华·塔夫特提出的六项分析设计基本原则,作为整场讲座的总结与升华:

  1. 明确对照物——最基本的分析行为就是问:“与什么做比较?”

  2. 明确因果关系——回答:“为什么?”

  3. 明确各种变化因素——我们所探索的世界是多元的

  4. 整合各种迹象——把文字、数字、图像和图表完全整合在一起

  5. 将现象记入文档——提供详细标题、数据源、完整测量比例

  6. 内容决定一切——分析结果的好坏最终依赖于内容的质量、实用性和完整性

Image

欢迎大家关注北京大学可视分析微信公众号(VisualAnalytics)

获取最新消息

阅读原文

跳转微信打开

  •  

2026年北大可视化暑期学校第六讲 - 可视化案例分析和设计的思考 2 - 陈慰平

原创 可视分析 2026-07-07 14:51 北京

2026年7月6日上午,北京大学可视化暑期学校第六讲,中央美术学院陈慰平 -《可视化案例分析和设计的思考 2》

    7月6日上午,第十七期北京大学可视化暑期学校第六讲正式开始。本讲邀请到来自中央美术学院的陈慰平老师,继续带来关于可视化案例分析和设计的思考。陈老师是中央美术学院教授,同时担任香港北京高校校友联盟副会长,兼任国际人机交互委员会委员。研究方向聚焦于信息可视化设计、图像体验设计及数字媒体研究三大领域。 

尺度与认知

首先,陈老师用多个案例给大家解释可视化设计中的尺度与认知。当数据尺度超出人的日常直觉,设计师要敢于“收”,也要敢于“放”,一收一放之间,才看得出设计功力。“收”是用统一简约视觉压缩海量信息”则是“超长滚动+沉浸式缩放节奏,用页面物理空间、视野落差放大体量差距,让读者真实感知宏大尺度。在案例IF THE MOON WERE ONLY 1 PIXEL中,整站依靠超长纵向滚动打造沉浸式尺度感知,以1像素代表月球直径,用页面长度直观展现太阳系天体间空旷的距离,完美诠释的叙事手法全程只用极简像素图形承载天体信息,是的符号化表达典范。在案例EYES ON ASTEROIDS(NASA 小行星可视化)中,统一极简圆点符号收纳亿万颗小行星数据完成收束,全域缩放交互自由切换星系全景与单颗星体细节,尺度切换自如,平衡宏观宇宙与微观天体。再看Ben Fry上的经典作品——isometricblocks/The Fortune 500以标准化等距方块作为极简视觉符号收拢企业、基因海量数据纵向长滚动页面分层展示行业全貌、单企业详情,依靠页面延伸放大体量对比,收放结合。

结构与秩序

 陈老师提到,画面的秩序感来自设计师的克制,做可视化要先建立一套完整视觉语法规则,再让数据在规则里自由表达,有统一框架约束,才能从根源避免信息堆砌、画面杂乱。案例Codex Atlanticus 达芬奇数字手稿档案记录了卷轴式超长滚动复刻完整手稿尺度,以极简标注符号收纳海量手稿图文注释,用空间拉长历史体量,同时用简洁图形收拢繁杂文本信息。Global Metro Line Development History 全球地铁演化图谱是一部课程示范典型结构化作品,通过提前统一轨道线条、时间轴色块、城市节点三套视觉语法,上百座城市、百年跨度的海量线路数据在统一规则下有序排布

网络与关系

在第三部分,陈老师归纳总结了文本秩序与视觉动线设计的重要性。设计师要提前规划读者视线:目光先落在哪一个核心节点、顺着哪一条线条推进,这套视线路径决定观众能否读懂数据里隐藏的关联结构,本质是文本叙事逻辑与视觉动线的匹配。案例Culturegraphy通过固定节点、连线、分类色块编码规则,用标准化视觉语法梳理全球文化关联脉络,多维度文化数据整齐有序。Tudor Networks都铎王朝人物网络通过全程统一人物节点、关系线条规范,描述了书信往来的时间线和空间分布范围,上万条历史人际脉络分层呈现,依靠固定视觉结构消解海量数据的杂乱感。案例Artificial Worldviews中,GPT可视化分为Power和knowledge两大体系,严格统一图形、色彩、排版语法,观看AI世界观多维度数据有序陈列克制的设计语法带来清晰稳定的阅读秩序。

探索与协同

    在第四部分,陈老师通过多个案例说明图文协同的交互可视化——图形负责搭建整体数据结构、呈现宏观趋势,文字与交互弹窗负责补充细节、背景叙事,二者互为支撑,实现分层探索。案例Selfiexploratory全球城市自拍研究先展示城市整体样本总图,体现出分层清晰动线再逐层下探年龄、五官、情绪细分特征,视线由宏观群体自然过渡到微观人像,引导观众循序渐进读懂人像特征关联。Visuelle Exploration博物馆藏品可视化遵循固定视线路径——“全局馆藏聚类总图→细分藏品集群→单件文物详情→相似文物关联链路”,串联材质、出土地、馆藏流转多层关系,动线贴合历史叙事顺序。陈老师提到,最有趣的部分Coins以钱币年代作为视觉起点,向外辐射贸易、铸造、地域多层关联,顺着预设视线路径,就能理清古代钱币流通网络。整套视线路径贴合钱币铸造、流通的历史叙事逻辑,将零散孤立的文物串联成清晰的多维关系,完美解决文物类关系数据杂乱难读的问题。TheAbortion Mazes是关于美国堕胎政策迷宫数据新闻通过创新迷宫式视觉动线,用迷宫路径模拟普通人政策选择流程,观众在走“迷宫”的同时阅读个案的故事线,直观读懂各州政策限制的复杂因果关系,动线完全服务叙事逻辑。

记忆与档案

    最后,陈老师通过两个案例强调可视化的展示与收纳功能。可视化设计中除了完成大众层面宏观展示的要求还要收纳海量原始明细数据具备缩放、检索、筛选交互功能,满足专业人群深度查阅需求Black Lives Matter2020年弗洛伊德事件爆发后全球涌现的反种族主义街头壁画为记录对象,交互式地图作为核心视觉框架,用点位直观呈现壁画在各国、各城市的空间分布全貌,一眼看清这场公共艺术运动的传播规模;点击地图上任意点位会弹出详情弹窗,能看到壁画实拍影像、创作者信息、创作时间、当地社会背景与标语内涵。Menu百年餐饮菜单数据报道(The Pudding)中,图表可视化食材、菜系、价格百年变化趋势,正文文字解读饮食变迁背后的移民、经济文化背景,是数据新闻图文协同的标杆范本。

总结

    整场案例课,陈慰平老师跳出软件操作、配色美化、图表样式等流于表面的技术技巧,锚定人的认知规律、信息架构逻辑与数据叙事内核展开剖析提炼出五条可通用的可视化底层创作逻辑:

1、收放有度:张弛之间见功力

2、结构有序,避免信息堆砌

3、文本秩序与视觉动线

4、图文协同,互为支撑

5、展示与收纳并重

    这套思考框架适配绝大多数创作场景,交互长图、数字文博档案、数据新闻、人文叙事可视化均可直接复用,是本次课堂含金量最高的核心干货。课上陈老师引用穆里尔的观点点明设计本质:信息只有被理解时才有用”,而一套成熟完整的可视化设计思维,正是打通数据与观者认知、让抽象信息真正被读懂的关键。

Image

欢迎大家关注北京大学可视分析微信公众号(VisualAnalytics)

获取最新消息

阅读原文

跳转微信打开

  •  

孙茂松 | 大模型时代中文语料库的破局之路

孙茂松 孔存良 2026-07-07 00:00 江苏

以下文章来源于:语情局

语情局

语言之妙 妙不可言

随着数字化、网络化,尤其是智能化的持续深入发展,数据已成为国家关键战略资源。“十五五”规划纲要提出,“迎接数字时代,激活数据要素潜能,推进网络强国建设,加快建设数字经济、数字社会、数字政府,以数字化转型整体驱动生产方式、生活方式和治理方式变革。”语言资源作为重要的数据资源,对推动学科交叉创新、支撑智能社会构建、维护国家安全及提升国家文化软实力具有深远意义。

中文语料库建设是我国语言资源建设的基础性工作。近日印发的《教育发展“十五五”规划》提出,加强数字中文建设。推进新型国家语料库建设和应用。实施国家关键领域语言科技赋能计划。此外,《教育强国建设规划纲要(2024—2035年)》也提出了“建设新型国家语料库”的任务。《关于加强数字中文建设 推进语言文字信息化发展的意见》要求:“推动基础性语言资源建设,实施国家关键语料库共建共享计划,重点支持建设大规模中文语料库。”

语料库建设是一个“老”话题,英文语料库建设可回溯至20世纪60年代。中文语料库建设比英文晚了大约20年。那么,当人工智能发展到大模型时代,语料库建设呈现哪些新的特点?面临哪些主要挑战?又应该有哪些应对之策?这些基本问题都需要我们认真思索并回答。

语料库建设走过的路程

语料库建设的“初心”是面向语言教学和研究,同时面向自然语言处理技术研发。在其发展过程中,始终强调两点:一个是语料库的“大规模”,另一个是对大规模“生”语料库的“精加工”。

20世纪60年代,美国布朗大学建立了约100万词的BROWN语料库;70年代,英国兰卡斯特大学、挪威奥斯陆大学和卑尔根大学联合建立了规模相近的LOB语料库。

1995年,规模达1亿词的英国国家语料库(The British National Corpus, BNC)面世,其中书面语文本9000万词次,口语文本1000万词次。这在当时绝对属于名副其实的“大规模”了。早期语料库通常只进行词语切分、词性标注等基本加工。

90年代初,美国宾夕法尼亚大学构建的宾州树库(Penn Treebank, PTB)对300万词英语句子进行了深层次加工——句法标注,随后又构建了首个中文树库(Chinese Treebank, CTB),规模为10万词。

至2016年,CTB 9.0完成了200万词中文语料的标注。

2014年,斯坦福大学提出通用依存句法标注方案(Universal Dependency, UD),试图以统一标注规范对全世界任何语言标注依存句法结构。

据其官网统计,目前已完成逾3700万词的加工,涵盖186种语言。“精加工”多倚重人工完成,因此通常是浩繁的工程。

我国自20世纪80年代前后启动中文语料库建设,基本上是参照国外上述“大规模”及“精加工”的路数来做。部分具有代表性的语料库建设成果包括:北京大学基于《人民日报》构建的现代汉语标注语料库,规模约2700万字,进行了分词、词性、专有名词、多音词等标注;国家语委牵头建设的现代汉语通用平衡语料库,规模约1亿字,其中5000万字经分词和词性标注;北京语言大学BCC语料库(Beijing Language and Culture University Corpus Center),规模约62亿字,覆盖报刊、微博等载体和文学、科技等领域,并进行了适当加工。

2010年起,人工智能进入石破天惊的深度学习时代,并在2020年前后快速推进至大模型时代。语料库在大模型发展中起着关键作用,已演变为支撑人工智能基本能力迭代并迈向通用人工智能的核心要素。毫不夸张地说,没有语料库就没有语言大模型。在大模型时代,语料库建设的内涵和外延都发生了急剧变化,如对大规模“生”语料库的需求呈爆炸式上升,以人工标注手段为主的语言“精加工”则从语料库建设的主导地位退居至“不太起眼”的位置。

新型语料库建设的基本特点

第一,规模极其浩大。2020年,美国开放人工智能研究中心(OpenAI)提出语言大模型的规模法则(Scaling Law),指出模型的训练损失随数据的指数级增加而线性下降。在此驱动下,训练用“生”语料库规模大到无所不用其极。如2020年ChatGPT-3训练语料库约含3000亿词;至2025年,DeepSeek-V3的训练语料库已达约14.8万亿词。典型的开源语料库如C4(约1750亿词)、The Pile(约2000亿词)、RedPajama(约1.2万亿词)等,其规模与传统语料库相比有天壤之别。值得注意的是,传统语料库由于规模限制需要均衡采样,新型语料库则致力于收录“全空间高质量”内容。

第二,范围极其广博。传统语料库多集中于新闻、文学作品等典型类型,新型语料库则广泛纳入网页、杂志、百科全书、科技图书、学术期刊、辞典乃至代码等多源类型,如维基百科、ArXiv等平台的开放获取论文和GitHub等平台的代码数据等。

第三,语言极其多样。传统语料库多以单语或双语为主,新型语料库则试图打通所有语言,构建覆盖数以百种语言的多语言语料库,如CC100、mC4、OSCAR等。Meta发表于《自然》杂志的NLLB项目,构建了涵盖200多种语言、规模约450GB的多语语料。此外,古籍、方言、手语、盲文等特殊语言类型,也会一定程度上被新型语料库所收录。

第四,模态极其丰富。以文本模态为枢轴,将声、图、视频等相关模态数据对齐、融通,形成多模态语料库。近年来,图文对齐数据发展尤其迅速,如OpenAI的CLIP语料库含4亿图文对,LAION-5B多达58.5亿对,DataComp更扩展至128亿对。语音文本对齐数据规模也持续增长,如WaveCaps含约40万语音—文本对、VSDial-CN含约120万对等。视频作为融合文本、语音、图像的复合媒介也备受关注,如WebVid含1000万视频—文本对,VTP含2700万对。这些多模态数据构成了新型语料库的生力军,赋予人工智能多角度理解、“生成”大千世界的能力。

第五,加工极其专精。针对大模型训练的各类新型数据被不断构造出来,如文本问答数据集、图文问答数据集、大规模指令数据集等。此外,从浩瀚无比的语料库中筛选出高质量语料,对大模型训练越来越重要,同时极具难度,需要研发相关的数据治理技术。借重大模型技术构造大规模合成数据也成为常态。

中文语料库建设的主要挑战

上述特点为大模型时代中文语料库设计指明了方向。建设规模浩大、范围广博、语言多样、模态丰富、加工专精的中文语料库体系,理应成为推动我国人工智能发展、赋能智能社会建设的基础性工程。显然,这个工程极其艰巨。我们将主要面临来自数据供给、体系构建与合规治理三方面的严峻挑战。

一是中文语料相对匮乏。当前,主流开源语料库仍以英文为主。据阿里研究院《大模型训练数据白皮书》,全球网站英文内容占比约59.8%,中文内容仅占约1.3%,差距悬殊。在大模型训练广泛使用的Common Crawl网页语料库中,中文占比也仅为约4.8%。

二是中文语料库体系远未建立。面向大模型时代的“全空间高质量”中文语料库体系尚处于雏形。如中文百科全书、科技图书、学术期刊、辞典等高知识密度的语料在现有中文语料库中几乎难觅踪迹,高质量的多模态数据也十分稀缺。

三是数据治理机制亟待完善。当前语料数据治理仍较为粗放,缺乏顶层设计。具体表现为三点:第一,版权保护与数据共享难以平衡。图书、辞典、影视作品等是天然的高质量语料,理应成为国家语料库的重要组成部分。然而,其合规共享面临版权保护壁垒,国际上已有相关纠纷案例。例如,Anthropic公司在训练Claude模型时因不当使用版权数据,向作者及出版商支付了高达15亿美元的和解金。第二,标准缺失导致“数据孤岛”。各单位加工的语言数据格式不一、质量参差,阻碍了数据要素的流通与协同利用。第三,隐私与安全风险突出。在数据采集、加工和训练过程中,如何有效防范信息泄露,确保内容符合伦理与价值规范,是语料库建设中必须严守的安全底线。

上述挑战都是全局性的、深层次的。应该采取怎样的应对之策?需要我们知难而上、持续探索

中文语料库的建设路径

一是拓宽数据来源,突破数据供给瓶颈。系统推进出版物、古籍文献、地方志、历史档案等优质线下资源的数字化转化,激活存量语言资源。大力发展数据合成与增强技术,实现数据规模的跃升。

二是完善体系设计,整合全空间高质量数据。系统规划中文语料库的整体架构,重点推动图书、辞典、影视作品等高质量数据入库。同时,拓展多模态数据的来源与形态,鼓励各级图书馆、博物馆采集音频、图像、视频等多模态数据。此外,将方言、少数民族语言、手语、盲文等纳入建设范畴。

三是创新版权机制,整合关键语言资源。由国家相关部门牵头,探索建立关键语料的授权使用机制。依法合规构建解决了版权问题的国家关键语料资源。建立分级开放机制:基础共性数据向社会开源,高价值专业数据实行授权使用,保障建设者权益,形成可持续生态。

四是推动标准建设,强化全流程治理。加快制定国家或行业层面的语料采集、清洗、标注、质检与交换标准,打破“数据孤岛”。研发高效、智能、可复用的数据处理工具链。同时建立覆盖数据全生命周期的治理框架,明确隐私保护、安全审核、伦理审查等环节的责任与流程,筑牢语料库建设的安全底线。

大数据时代中文语料库的建设具有高度的紧迫性,但又难以一蹴而就。不行不至,行于当行。相信通过坚持不懈的群策群力、攻坚克难,中文语料库建设的新格局将逐渐形成,从而对我国人工智能的发展作出历史性的新贡献。


作者:孙茂松 孔存良,分别系清华大学教授、助理研究员

图片:光明图片/视觉中国

编辑:覃冬宇

阅读原文

跳转微信打开

  •  

2026年北大可视化暑期学校第二讲 - 诗歌中的文物举例 - 廉萍

原创 可视分析 2026-07-06 10:27 北京

2026年7月1日下午,北京大学可视化暑期学校第二讲,人民文学出版社廉萍 -《诗歌中的文物举例》

    7月1日下午,暑期学校第二讲由人民文学出版社编审廉萍老师带来“图文互证读古诗——诗歌中的文物举例”讲座。本次讲座围绕诗歌中的文物展开,廉萍老师指出,古典诗词距今年代久远,其中涉及的器物、花木、禽兽往往不为今人所熟悉——若不知诗中"物"为何物,便难真正读懂诗的情境与深意。她援引恩师杨之水定义:"名"是文献记载的名称,"物"是实物本体,二者随时代流变常错位(同名异物或同物异名),将诗中的名物与出土文物一一对应,即为"名物考证"的核心工作。讲座倡导以考古出土文物与文献互证(图文互证),为读诗提供"脚踏实地的着力点"

首饰与植物的诗意溯源

    廉老师以南宋时期的一个云月纹金钱镯为例,展示了首饰纹样与诗词名篇的奇妙联系。这只手镯在云月图案的圆圈内别具匠心地錾刻了“人”“月”二字,结合外围代表圆满的圆圈,巧妙构成了当时极为流行的吉祥语及词牌名“人月圆”。这一发现不仅解开了文物设计的巧思,也让诸如“人月圆时”等宋词名句有了实物依托,更印证了后世“花好月圆”这一说法的历史渊源。在植物方面,廉老师以张九龄的名句“兰叶春葳蕤”为例,澄清了古今兰花的差异。唐代及唐以前诗文中的“古兰”实为菊科的大泽兰,具有茎干发紫、花朵偏红的特征,并非宋代以后文人偏爱且流传至今的细长叶片的兰科“春兰”。如果不了解这一植物演变史,单纯用现代兰花的形象去给唐诗配图或作注,便难免产生张冠李戴的谬误。

古兰与今兰之辨

动物与日常器物的历史原貌

    在解读虞世南名篇《蝉》中“垂緌饮清露”一句时,廉老师指出,许多权威工具书将“垂緌”误注为蝉头部的触须。结合古代文献与名物考证,古代的“緌”本指系在下巴上的帽带,在诗中比喻的是蝉腹下长长的管状口器(蝉喙),而非头顶的触须。虽然这种细节的误解不影响对全诗精神的感悟,但还原真实的细节无疑能带来更精确的阅读喜悦。随后,廉老师又探讨了古诗词中常见的“携弹小儿”与二郎神“腰挎弹弓新月样”的形象。现代人常以为古代弹弓是今天带橡皮筋的Y字形树杈,但大量古代绘画与正仓院传世文物表明,古代的弹弓本质上就是一张真正的弓,只是在弓弦中央加了一个皮囊用于发射弹丸。这种形似新月的真正“弹弓”,直到百年前仍在使用,了解这一点,古书中的诸多描写便豁然开朗。

"垂緌饮清露"之垂緌

马具与文房的跨界错位

    廉老师通过白居易和元稹诗中提到的“杏叶鞍”与“借骑银杏叶”,纠正了过去工具书中“马鞍形状像杏叶”的错误解释。结合唐三彩马及陈国公主墓出土的马具可以看出,“杏叶”其实是古代马具上垂挂的叶片状金属装饰物,古人常借用这一标志性配件来代指马匹或马具整体。更有趣的是,明代文人高濂在《遵生八笺》中记载自己曾用一件底部平滑、带有三个圆耳的“玉贝光”来压平宣纸,但他本人并不知晓该物件的来历。廉老师通过对比出土文物,指出这件被明代江南文人放在书房里当作镇纸的精美玉器,实则是一千多年前北方游牧民族马具上用于连接交叉皮带的“玉节约”。这种从马背走向书桌的器物错位,生动反映了不同时代与地域间的生活变迁与认知断层。

杏叶鞍与马具节约

饮酒器具与宴饮场景的还原

    酒是唐诗中不可或缺的元素,廉老师详细梳理了唐代“樽”与“杯”的区别。在唐代中前期,古人饮酒并非像后世那样使用酒壶(注子)斟酒,而是将酒盛放在盆状或筒状的大“樽”中,再用长柄的“勺”(如鸬鹚勺)舀入个人的小“杯”(如鹦鹉杯、金船)中饮用。因此在李白的诗中,“樽”和“杯”是界限分明的两类器具,不可混用。了解了这一饮酒方式,便能准确想象元结《石鱼湖上醉歌》中“长瓢坐巴丘”的实景,也能明白“酒舫”并非供人乘坐的舟船,而是能漂浮在水面上形似小船的酒杯。此外,廉老师还结合镇江出土的唐代《论语》酒筹,解释了唐诗中频繁出现的“十分”一词。在当时的酒令中,“十分”指代满杯罚酒或满杯劝酒,明确了这一名物背景,白居易诗中“百忧无奈十分何”的借酒消愁之意便十分清晰了。

唐风饮酒制式

文物图像的辨讹与考证

    讲座最后,廉老师分享了如何通过诗歌与文献的结合来纠正文物图像的误读。例如湖北省博物馆著名的“元青花四爱图梅瓶”,长期以来被部分资料解读为“王羲之浇水赏兰”。廉老师通过还原唐宋饮酒图式指出,画面中人物身旁的荷叶盖罐实为酒瓮,缸中还配有酒勺,这分明是一幅饮酒赏花图。再结合元代文坛“四爱”题咏的明确文献记载,该图描绘的绝非王羲之,而是提出“兰有国香”的黄庭坚在饮酒赏兰。同样,各大博物馆中常被命名为“达摩渡海”的宋金铜镜,其画面主角踩着椭圆形木杯、背着芦编行囊,完全契合南朝“杯渡禅师”的特征。宋代诗词中也有对“杯渡镜”的细致描写,这一考证成功将原本散落的器物、图像与文学文本完美串联在了一起。

元青花四爱图

总结

    廉老师强调,名物考证须以公立博物馆馆藏出土文物、考古简报、可信古籍为第一手依据,慎用网络二手资料。她回顾自身自2016年随杨之水系统研习名物,以"先读诗、再见物、后互证"的积累过程才偶有发现,坦言新见具偶然性,难按课题周期预设。

    这场历时两小时的分享,通过对十余组诗词—文物对应关系的细致梳理,生动展现了"图文互证"如何让古典诗歌从模糊意象变为可触摸的历史现场。正如廉老师所言:"知道一点名物的渊源,天马行空的读诗想象就有了脚踏实地的着力点,是别有一番领会的阅读喜悦。"

Image

欢迎大家关注北京大学可视分析微信公众号(VisualAnalytics)

获取最新消息

阅读原文

跳转微信打开

  •  

2026年北大可视化暑期学校第三讲 - 人文智能交互系统的研究方法与挑战 - 张小龙

原创 可视分析 2026-07-06 10:27 北京

2026年7月2日下午,北京大学可视化暑期学校第三讲,宾夕法尼亚州州立大学 张小龙 -《人文智能交互系统的研究方法与挑战》

    2026年7月2日下午北京大学可视化发展前沿研究生暑期暨首届人文智能暑期学校的第三讲,由美国宾夕法尼亚州州立大学的张小龙老师主讲,主题为《人文智能交互系统的研究方法与挑战》。

人文智能交互系统项目的指导思想与研究框架

    张老师了解同学们将在暑期学校开展人文智能相关的可视化项目,开篇即强调了做项目时的几个重要问题:项目的最终目的是什么?项目的创新点是什么?对标的用户是谁?这些问题将贯穿讲座始终,并为后续同学们的实践提供指导思想。此外,张老师向大家介绍了通过设计之研究(reasarch through design,RTD)的思想,即设计的过程本身就是一种开展研究的方法,帮助大家深入理解设计项目和研究的关系。

    随后,张老师介绍了Creswell在Research Design一书中提出的搭建研究框架的方法论,包含三个关键要素:世界观、研究设计与研究方法。

设计研究框架需要考虑的三个方面:世界观、研究设计与研究方法

    其中,研究中可以采取的世界观包括后实证主义、构建主义、演变主义、实用主义等。研究的设计可以是定型研究,定量研究或混合型研究。当开始一项研究时,应当分别从这三个方面进行考虑以制定完整的研究计划。

交互设计的目的与范式的演变

    接下来,张老师详细介绍了交互设计的目的与范式的演变过程。

    最初,交互设计的目的是让计算机成为工作中的有效工具。早期有许多不同的技术探索,结果多样但缺乏理论依据。后来,奠基性的人机处理器模型被提出,描述人通过感觉、认知、记忆等系统的配合完成交互。

人机处理器模型的图示

    随着计算机的普及,交互设计出现了新目的,即让计算机成为大众生活中的工具。此时所需要的理论从描述个人的认知,扩展到描述人群、社会等层面。随着目的的变化,交互系统的研究范式也随之变化。

交互系统研究的各个环节

    张老师给出了交互系统研究的一种方法范式,分为五个步骤:明确研究对象,包括数据、任务及目标用户;分析设计需求,可通过用户调研等方式;明确设计目标,即需要哪些交互部件、视图、算法等;设计系统,即按照设计目标进行开发实现;评估系统,即验证系统是否达到目的。

    这一过程中存在一些常见的问题和挑战:需求是否可靠?设计结果是否合适?评估过程是否合理?这些问题需要仔细考虑,否则可能导致设计与用户需求不匹配、拘泥特定技术系统不知变通、结论难以令人信服等问题。.

    关于设计需求的确认,张老师结合具体研究介绍了访谈、实地调查等定性分析方法,以及问卷调查等定量分析方法。

张老师用图示介绍定性分析的过程

交互设计的原则

    张老师重点介绍了交互系统的一些设计原则。如诺曼提出的核心设计基本原则包括:可见性,反馈,约束,一致性,示能,映射与防错。另有施耐德曼提出的黄金法则也十分重要。这些指导原则的最终目的是降低用户认知负荷,让操作更高效。

    张老师进一步指出,诺曼和施耐德曼提出的通用交互设计原则解决的是普适性问题,然而,在人文智能交互系统的复杂分析任务面前,这些通用准则远远不够。可视化设计必须深入理解人类视觉感知的特殊规律。视觉系统对信号之间的相对差异极为敏感,而对绝对值并不精确,这意味着在数据编码时,背景色块会影响目标颜色的主观判断,饱和色的过度使用会干扰对浅色区域的识别,视觉错觉并非简单的物理偏差,而是大脑加工后的结果,设计时必须予以正视。此外,凸显效应在可视化中是把双刃剑,利用颜色、形状差异可以快速引导用户注意到关键信息,但动画的滥用则会严重干扰注意力,在实际设计中需要审慎权衡。

凸显效应的一个简单例图

可视化设计的约束

    接下来,张老师强调,可视化设计必须服务于用户的模式识别能力,并充分考虑任务与文化的特异性。研究表明,专业棋手对真实棋局的复盘能力远超新手,但对随机棋局则无明显优势,这说明专业用户依赖长期训练形成的模式识别能力。可视化设计应当顺应这种认知规律,通过有规律的布局、清晰的分类和明确的视觉分隔来帮助用户快速组织信息,北京地铁图的横平竖直设计就是典型案例。

与左侧相比,右侧的布局能够帮助观看者快速组织信息

    同时,设计不能脱离具体任务,拍类运动视频分析的需求各异,网球最关注球的位置,乒乓球更重视回合胜负,这种任务差异直接影响可视化功能的优先级。通用原则无法覆盖任务特异的定制化需求,但定制化工具的可扩展性差,当数据类型或任务发生变化时,现有方案可能完全失效,这是可视化研究面临的实际矛盾。此外,颜色在不同文化中承载截然不同的含义,国内股市红色代表上涨,美国则代表跌势,跨文化的可视化设计必须谨慎配色,避免触犯用户的文化或宗教价值观念。

东西方文化对红色的不同理解

互设计中的认知结构

    张老师指出,传统交互设计聚焦于秒级的认知频段,追求系统一的直觉流畅性,让用户用最少认知资源完成任务。然而,人文分析属于分钟到小时级的理性频段,依赖系统二的理性分析,追求正确性而非流畅性,用户时刻需要元认知的介入,对任务进行定向、规划策略、执行监控并评估结果。

    张老师因此提出了双环模型,将元层与目标层整合起来。在需求分析阶段,要侧重用户对问题的定位方式、决策中的认知偏差以及学习中的策略缺失;在系统设计阶段,交互视图不仅要作用于数据,还要帮助用户理解任务策略、兼顾执行步骤是否达成目标;在评估阶段,除了传统的效率与正确率之外,还需增加元认知层面的度量,如用户对答案的信心水平、对正确与错误的辨识度等。这个模型的意义在于,将支持复杂认知任务的可视化设计,从单纯的界面优化提升到了对用户思维过程进行有效支持的层面。

将双环模型与人工智能结合进行分析

结语:人文可视化面临的挑战与研究范式的反思

    课程结尾,张老师总结,传统人机交互的研究方法与评估范式基于简单认知行为,而人文可视化要支持的是问题求解、决策、学习等复杂的认知行为。

    张老师强调,案例分析和实地部署适用于评估复杂系统,让用户在真实场景中使用并收集长期数据,但这类方法无法证明系统的因果有效性,有效性只能通过对照实验来完成。然而,人文可视分析系统的任务和过程往往具有不确定性,实验方法实施难度大。因此,作为一个多学科交叉的研究领域,人文可视化沟通了两个研究目的和方法完全不同的学科——人文学科的问题为可视化研究提供了独特的研究问题,可视化手段则为人文学科提供了新的研究工具。设计人员需要在需求分析、系统设计和效果评估等各个阶段深入融合人文学科的需求,清楚地认识技术手段的目的及其关系,在需求、设计与评估三者之间取得平衡,有意识地提高对用户理解和评估层面的技能,真正实现技术与人文的有机结合。

Image

欢迎大家关注北京大学可视分析微信公众号(VisualAnalytics)

获取最新消息

阅读原文

跳转微信打开

  •  

《数字人文研究》2026年第2期目录及摘要

数字人文研究 2026-07-06 09:01 北京

第6卷,总第22期

数字人文中的形式化偏向:

形成、影响及方法反思

赵皓玥

摘要

文章聚焦数字人文中的数据结构化与算法分类方法,讨论“形式化偏向” 如何形成、发挥作用及其后果。首先区分了形式化逻辑、形式化操作和形式化偏向三个层面,将形式化偏向界定为可编码、可比较和可计算的材料属性在研究设计、证据建构和解释判断中持续获得优先地位的倾向。继而从技术入口、方法适配和知识产出激励三个方面分析形式化偏向如何形成,并结合文本分析和空间分析案例,说明其如何作为一种结构性机制影响研究对象边界、证据权重和知识组织方式。研究认为,形式化偏向的讨论有助于揭示数字方法参与人文学知识生产时形成的选择机制和解释边界;对数字人文的方法反思,需要进一步通过容纳不确定性的数据库结构、反思性元数据和失败透明化等路径,说明数字成果的生成条件、适用范围与解释责任。

关键词 

数字人文; 形式化偏向; 数据结构化; 算法分类; 证据建构; 方法反思

作者简介

赵皓玥,南京大学历史学院博士研究生,Email:haoyue.zhao@smail.nju.edu.cn。

“细读” 之后,如何“远观”:

数据驱动语言学对文学研究的方法论启示

——刘海涛教授访谈

刘永强 陈子轩 刘海涛

摘要

近年来,语言学在计量语言学基础上逐渐发展出数据驱动语言学,致力于从大规模语言数据中发现模式、提炼规律。以细读为主要传统的文学研究,是否也可能走向数据驱动? 国内数据驱动语言学的重要代表学者刘海涛教授认为,文学研究并非不能谈论“ 模式” 与“规律”,相反,数据驱动的文学研究已是一种现实趋势。数智时代文学研究的关键,不是用“远观” 取代“细读”,而是根据研究问题重新组织二者的关系。在大语言模型迅速发展的背景下,数据驱动文学研究的意义也不只是方法更新,而是促使人文学者重新理解文本、数据、知识、智能与主体性之间的关系。由此,文学研究面临的不是一次简单的技术转向,而是一场从观念、材料到方法的整体性变革。

关键词 

数据驱动语言学; 模式; 规律; 计量语言学; 文学计算批评

作者简介 

刘永强,浙江大学外国语学院教授; 陈子轩,浙江大学外国语学院博士研究生; 刘海涛,复旦大学文科资深教授。

杜甫《秦州杂诗》之秦凤驿路现地研究

——兼论唐陇右道入京驿路兰州至上都南北二道之数字化

简锦松 廖泫铭 王 勇 黄金文

摘要 

杜甫诗注量大质精,久为学界共识。但是,传统的注诗方式不符合现代学术的需要。杜甫《秦州杂诗》“迟回度陇怯,浩荡及关愁” 二语,如果了解唐代凤翔至秦州的秦凤驿路,便知道此诗并不作于秦州,而是写于驿路中途的凤翔府陇州。这组诗中大量篇章在遥望秦州西北的军事,本意是担心吐蕃入侵,其深入的原因,便因为秦州是陇右道入京驿路的南路屏障。文章以现地研究法,将杜甫所行经之秦凤驿路数字化,对于度陇、大震关、吴岳等重要地点,皆作了解说。陇右道入京驿路有南北二道,北线由兰州经原州入萧关至长安,南线由兰州取道临州,经秦州入大震关至长安,也全程作了数字化,由此确定了丝绸之路的精华路段———西安到兰州的具体路线。

关键词 

杜甫诗; 秦州杂诗; 陇右道入京驿路; 现地研究; 数字化

作者简介 

简锦松,台湾中山大学中文系研究员; 

廖泫铭,台湾中研院人社中心GIS 专题中心研究副技师; 

王勇,东莞理工学院中文系特聘副教授; 

黄金文,台湾暨南国际大学中文系副教授。

“文” 何以“载道” :基于知识图谱的

古文运动转型研究

闫力元

摘要 

通过对数字化《全唐文》《全宋文》中226 位唐宋士人的57 043 篇文章进行语体、文体与知识类型标注与关系分析发现:古文运动不仅是“由骈向散” 的语体变化,也表现为文体功能与知识组织方式的重构。数据表明,语体散化趋势较为稳定;赋类的式微、书信与论辩等文体的上升,以及经学、史学论述的集中,显示唐宋士人逐渐拓展了文章经世的表达方式。以唐宋八大家为代表的古文家,尤其倾向于通过散体及论辩、序跋、书信等文体组织经史知识、阐发政治与伦理判断。思想史上,这一变化可与新儒家对现实“物事”的关注及“文—物—道”结构相互参照,显示“文以载道” 逐渐转向以知识论辩介入现实、影响思想的文章经世方式。

关键词 

古文运动; 数字人文; 知识图谱; 文道关系; 文体; 唐宋八大家

作者简介

闫力元,复旦大学古籍整理研究所博士研究生,Email:yanliyuanleopard@gmail.com。

西班牙语地区数字人文研究演进

(1998—2023)

——兼与中国的对比考察

马玄霖 杨泽坤

摘要 

西班牙语是全球第二大语言,西班牙语地区数字人文发展对于全球数字人文的语言和文化多样性而言具有重要意义。在对该地区数字人文发展历史进行概览的基础上,研究使用文献计量学方法与大语言模型工具,系统分析了主要西语国家的研究者1998—2023 年发表的数字人文论文,并将其与中国进行对比,以获得对两个区域数字人文研究特征与发展道路的深入认识。研究发现,西语世界的数字人文有区域内协作密切、关注当代研究对象、偏向于社会文化议题等特点,其发展主要由人文学科驱动;相较而言,中国数字人文研究偏向人文资源的数字化处理和智能应用,主要由文化资源与技术驱动。两者的发展经验对于理解发展中国家数字人文的多元实践路径具有参考价值。研究创新性地将非英语地区的数字人文发展进行比较,并引入大语言模型提取论文研究对象,增强了学科文献综述的方法论新意。

关键词

数字人文; 西班牙语; 文献计量; 大语言模型

作者简介

马玄霖,中国人民大学信息资源管理学院硕士研究生; 

杨泽坤( 通讯作者),中国人民大学信息资源管理学院讲师,中国人民大学数字人文研究院研究员,Email:zekunyang@ruc.edu.cn。

数字文化遗产治理视域下

传统地方戏曲数据库的著作权保护

左梓钰

摘要

传统地方戏曲是集体智慧的结晶,因而具有民间文学艺术的族群性、传承性和文化性特征。著作权法中作为戏剧作品示例之一的地方戏应解释为已满足法定作品构成要件的地方戏曲。地方戏曲数据汇编(数据库)作为数字文化遗产的代表之一,是关于构成作品或不构成作品的地方戏曲数据的集合,其受著作权保护的前提是构成汇编作品。基于地方戏曲数据库亦具有民间文学艺术的性质,所以地方戏曲数据库的使用可能引发权属、利用及获益分配的争议。为了完善地方戏曲数据库的著作权保护并抑制数据库对著作权公有领域的侵蚀,宜细化数据库的权属和利用规则,构建关于数据库的集体管理制度和惠益分享机制。以地方戏曲数据库的著作权保护为切口,冀望为更广泛的数字文化遗产善治提供法律基石。

关键词 

传统地方戏曲; 著作权; 数据汇编( 数据库); 民间文学艺术; 惠益分享; 数字文化遗产

作者简介 

左梓钰,四川师范大学法学院讲师,四川师范大学互联网法治研究中心研究员,Email:zuoziyu33@163.com。

排版:覃子椿

初审:徐碧姗

复审:段婧怡

终审:夏翠娟

阅读原文

跳转微信打开

  •  

Call for papers – DHNB 2027: Human(ities) in the Loop

We are excited to announce that the 2027 edition of the Digital Humanities in the Nordic and Baltic Countries (DHNB) conference will be hosted by Umeå University, March 1–5, 2027.

The special theme of DHNB2027 is Human(ities) in the Loop and draws on the concept of “human in the loop”, that highlights the role of humans in the workflow of AI technologies, but broadens the perspective to better include the important role that the humanities play in understanding historical, contemporary technological and societal systems. With this theme, we encourage contributions that explore the role of the humanities and social sciences and place them at the center of technological development, rather than the other way around.

📅 Conference dates: March 1–5, 2027 | 📍 Umeå, Sweden
🗓 CfP opens: August 21, 2026 | ⏱ Submission deadline: October 16, 2026 |

The conference is organized by Humlab at Umeå University in collaboration with DIGSUM, Umeå University. For inquiries, please contact: dhnb2027.humlab@umu.se

For submission guidelines and full details:
🔗 Visit the DHNB Website: https://dhnb.eu/conferences/dhnb2027/
🔗 Read the full CfP here: https://dhnb.eu/conferences/dhnb2027/call-for-papers-dhnb-2027/


We warmly welcome researchers, developers, and institutions across the Nordic and Baltic regions who engage with digital methods in the humanities to join us in Umeå.

  •  

第十七期北京大学可视化发展前沿研究生暑期暨首届人文智能暑期学校开幕

原创 可视分析 2026-07-04 13:06 北京

2026年6月30日,第十七期北京大学可视化发展前沿研究生暑期暨首届人文智能暑期学校在线上正式开幕。

    暑期学校项目负责人北京大学袁晓如老师在开幕式中首先介绍了暑期学校的发展历程。北京大学于2009年国内首次在教育部研究生创新项目和北京大学研究生院的支持下举办可视化暑期学校,2026年举办第十七期活动。多年来,暑期学校为可视化社区培养了大量杰出的人才,很多已经成为国内学术界和工业界的中坚力量。

    本届暑期学校在原有可视化的特色基础上,首次增并举办“人文智能”暑期学校。在既有可视化与可视分析基础上,进一步面向历史文化遗产、博物馆展陈等人文场景,探讨如何通过可视化、交互、智能计算和人机协同的方法,连接不同类型的人文数据,以支持人文研究从个案走向规律,同时为面向公众的文化传播和展陈创新提供新的可能。

今年暑期学校继续采用线上讲座与线下课程设计相结合的方式,邀请来自可视化、人机交互、设计、历史、博物馆等领域的多位专家学者授课。课程内容涵盖可视化与人文智能、可信任的可视化设计、历史地理信息设计、AIGC叙事、文化遗产数字化演绎、数据标注与策展实践等主题。

    按照往年惯例,本期暑期学校继续通过线上直播向非正式学员开放部分讲座内容,使更多关注可视化与人文智能交叉研究的师生能够参与学习与交流。正式学员将根据计算机、设计、人文等不同专业背景进行分组,围绕唐代历史主题,从考古发现与史料关联、墓地与随葬品分析、服饰文物文献、古今城市空间对照、墓志与史料人物等具体方向开展课程设计,最终形成交互式可视化作品,并讲在结课汇报中展示跨学科协作成果。

开幕式结束后,由北京大学袁晓如老师带来了本期暑期学校的第一讲,主题为《可视化、可视分析与人文智能》。

Image

欢迎大家关注北京大学可视分析微信公众号(VisualAnalytics)

获取最新消息

阅读原文

跳转微信打开

  •  

2026年北大可视化暑期学校第一讲 - 可视化、可视分析与人文智能 - 袁晓如

原创 可视分析 2026-07-04 13:06 北京

2026年6月30日下午,北京大学可视化暑期学校第一讲,北京大学袁晓如 -《可视化、可视分析与人文智能》

2026年6月30日下午是北京大学可视化发展前沿研究生暑期暨首届人文智能暑期学校的第一讲,由北京大学的袁晓如老师主讲,主题为《可视化、可视分析与人文智能》。

什么是可视化和可视分析

    在开始具体内容前,袁老师简单介绍了什么是可视化和可视分析。袁老师提:从信息学科的角度上讲,可视化是通过计算机将想要了解和研究的数据转化成可以看到的视觉表达形式,帮助人更有效地完成特定任务;可视分析是一门用交互可视界面支持的分析推理的学科,它帮助人与机器协同完成复杂的情报分析推理工作。

    袁老师将人文类数据拆解为几种基础类型:表格数据、网络数据和空间数据。表格数据可以转化为时间曲线、条形图等;网络数据用于表示关系,如古代诗人之间的唱和关系;空间数据则对应各种地图形式。另外,袁老师指出随着AI能力的增强,人在可视化工作中的重要性仍然非常重要——AI推动人类用户去发现、探索、验证和知识总结,既要发动人类的主观能动性,也要发挥计算机的高效性。

可视化案例分析:全国十大考古新发现的可视化

    袁老师以2021年暑期学校的课程设计作品为例,展示了如何从文字信息到交互可视化的完整流程。同学们将历年"全国十大考古新发现"的文字介绍转化为结构化表格,提取时代、地点、发掘单位等属性,并衍生出单位性质(国家级、省级、高校等)等新字段。在此基础上制作了空间分布地图和合作网络图:地图可筛选特定朝代,直观展示考古发现的地理集中区域;网络图以节点大小表示获奖次数、颜色区分单位性质、连线宽度表示合作频次。多视图之间支持联动交互,配合图例中的统计数字,帮助用户快速把握全貌并深入探索细节。

全国十大考古新发现的可视化

可视化案例分析:书法风格的量化分析

    袁老师展示了如何通过可视化将书法专家的经验知识转化为可计算的维度。团队参考书法理论中的"平画宽结、斜画紧结"等概括,建立了整体性、倾斜度、紧凑度、粗细度等11项指标。用户可在时间线上排列碑帖,选择特定汉字(如"之"字)进行投影分析,系统计算不同书例在11个维度上的距离并投影到二维平面,相近的书例自然聚集;配合雷达图展示各维度差异,将原来依赖"美学眼光"的感性判断变为可解释、可比较的理性分析。

书法风格的量化分析

可视化案例分析:彩陶花纹的演变溯源

    彩陶花纹是研究史前文明的重要依据,但寻找花纹间的演变链路极为耗费人力。团队开发的可视分析系统通过计算纹饰相似性,在以横轴为时间、纵轴为相似度时空投影图上为用户自动推荐可能有关联的花纹,优先推送时空相近的候选。用户将花纹对应起来、标注变化类型后,可映射到地图上观察传播路径。这种方式在准确率的同时,还可以提高研究效率,是人机协同完成研究任务的典型范例。

彩陶花纹的演变溯源

总结

    除上述内容外,袁老师还讨论了中国古代可视化的发展,展示了唐代中外文明互鉴的可视化案例。界面以左右两条时间轴分别呈现唐代与国外的文物,实心标记唐代器物,空心标记海外对比物,通过分类对比可以直观看到中外文物之间的相似性与传承关系——如唐三彩凤首壶与中亚类似器物在造型上高度呼应,尽管相隔数百年。这类可视化既支持学术探索,也直接服务于博物馆展陈。

中国古代可视化

    讲座最后,袁老师从两个维度总结了可视化与人文历史结合的价值:一是面向学术的分析探索,二是面向大众的展陈传播。他指出,AI与智能体技术的发展正推动人文研究从传统的"一本书"式个例分析,扩展到"几万种文献"的规律发现;本期暑期学校来自不同领域的同学,他鼓励大家借助可视化工具,在课程设计中尝试从个例走向规律、从研究走向展陈,充分利用跨学科协作的优势,探索人文数据可视化的更多可能。

Image

欢迎大家关注北京大学可视分析微信公众号(VisualAnalytics)

获取最新消息

阅读原文

跳转微信打开

  •  

大社科工作坊 | “智汇人文:大模型与智能体应用” 数字人文青年学者论坛暨第三届信管数字人文工作坊 (3 号通知)

2026-07-03 09:00 广东

“智汇人文:大模型与智能体应用” 数字人文青年学者论坛暨第三届信管数字人文工作坊(大社科工作坊·创新文会 第37期)将于 2026 年 7 月 4 日至 5 日在中山大学东校园举办。

尊敬的各位参会代表:

“智汇人文:大模型与智能体应用” 数字人文青年学者论坛暨第三届信管数字人文工作坊(大社科工作坊·创新文会 第37期)将于 2026 年 7 月 4 日至 5 日在中山大学东校园举办。为确保会议顺利进行,保障各位代表参会体验,现将报到、日程、交通及参会注意事项等相关事宜通知如下:

01

会议基本信息

会议主题

智汇人文:大模型与智能体应用

举办时间

2026年7月4日—7月5日

举办地点

中山大学东校园行政楼 B101

东校园公共教学楼

主办单位

中山大学社会科学学部

中山大学信息管理学院

中山大学数字人文实验室

承办单位

中山大学国家文化遗产与文化发展研究院

中山大学信息管理学院研究生会

02

报名确认说明

本次会议报名结果确认邮件已向所有成功报名的参会人员统一发出。若您已完成报名但未收到确认邮件,可能是报名时填写的邮箱信息有误,或邮件被系统拦截至垃圾邮件文件夹,请您先核查邮箱收件设置;仍无法确认的,可通过文末会务咨询邮箱与我们联系核实参会资格。

03

报到安排

报到时间

2026年7月4日 8:00—9:00

报到地点

中山大学东校园行政楼门口

报到须知

请参会代表现场完成签到,领取会议资料与参会凭证。请合理安排行程,尽量在开幕式前完成报到。

04

会议日程

05

住宿指引

本次会议不统一安排住宿,参会人员交通、食宿费用自理。结合会场周边条件,推荐参会代表入住以下酒店:

  • 推荐酒店:广州大学城南国会国际会议中心

  • 酒店地址:广东省广州市番禺区大学城外环东路 280 号

06

交通指引

01

交通枢纽前往中山大学广州校区东校园

  1. 广州白云国际机场出发:乘坐地铁3号线(体育西路方向)至广州东换乘地铁11号线内环(龙口西方向)至赤沙站,换乘12号线(大学城南方向)至大学城北站A口出站,步行约7分钟抵达中山大学东校园教学区西门

  2. 广州南站出发:乘坐地铁7号线(燕山方向)至大学城南站,换乘地铁4号线(黄村方向)至大学城北站A口出站,步行约7分钟抵达中山大学东校园教学区西门

02

推荐酒店前往到中山大学广州校区东校园

广州大学城南国会国际会议中心:乘坐387路公交在华工北路上车至综合商业北区站下车,步行约7分钟抵达中山大学东校园教学区西门

03

校门至行政楼会场校内指引

中山大学广州校区东校园教学区西门到行政楼:

中山大学广州校区东校园南门到行政楼:

中山大学广州校区东校园北门到行政楼:

04

打车与自驾提示

若选择打车或自驾前往,建议定位至中山大学东校园教学区南门或北门,入校更为便利。

07

参会注意事项

本次工作坊以线下实操培训为核心环节,请所有参会人员自备笔记本电脑。部分培训模块需提前安装配套工具软件,相关安装指南与准备要求将通过会议联络群发布,请各位代表留意通知,提前完成部署,确保培训体验。

请参会人员遵守会场秩序,进入会场后将手机调至静音或震动状态,共同维护良好的学术交流环境。

本次会议不收取任何会务费用,参会人员的交通、住宿及餐饮费用均由个人自行承担。

08

咨询方式

如有其他未尽事宜,可通过以下邮箱联系会务组:

咨询邮箱:

625891987@qq.com

110014982@qq.com

期待与您相聚中山大学,共同探索智能技术赋能人文研究的新范式与新路径!

主办单位:

中山大学社会科学学部

中山大学信息管理学院

中山大学数字人文实验室

内容来源:中山大学InformationWorld

编辑:陈旖旎

初审:蔡一峰

复审:林  耿、陈诗诗、王蕾

审定发布:张  伟

阅读原文

跳转微信打开

  •  

武汉大学“文化遗产数字化保护与智能计算”暑期学校顺利开幕

2026-07-03 13:05 湖北

2026 年 7 月 1 日上午,由武汉大学历史学院、长江文明考古研究院、文化遗产智能计算实验室、测绘遥感信息工程全国重点实验室联合举办的“文化遗产数字化保护与智能计算”暑期学校在武汉大学正式开幕。

👆👆👆点击蓝字 · 关注我们

图片

2026 年 7 月 1 日上午,由武汉大学历史学院、长江文明考古研究院、文化遗产智能计算实验室、测绘遥感信息工程全国重点实验室联合举办的“文化遗产数字化保护与智能计算”暑期学校在武汉大学正式开幕。本次暑期学校共招收学员 145 名,其中包括 35 名国际学员和 110 名国内学员。开幕式由武汉大学历史学院副院长李英华教授主持,湖北省文旅厅文物局考古处处长杜杰出席并致辞。

开幕式上,李英华教授代表主办方对来自全国各地的学员表示热烈欢迎,系统介绍了暑期学校的课程安排,鼓励学员在课程中拓展研究视野、提升问题意识与创新能力。

历史学院副院长李英华教授致欢迎辞

杜杰处长在致辞中对暑期学校的举办表示祝贺。他表示,文化遗产保护日益需要智能技术的深度支撑,跨学科人才培养对于推动文物保护、考古研究与文化传播具有重要意义。希望学员们在课程中深化对文化遗产保护事业的理解,为未来相关领域研究与实践积累扎实基础。

湖北省文旅厅文物局考古处杜杰处长致欢迎辞

开幕式后,武汉大学黄先锋教授作题为《摄影测量技术最新进展及在文化遗产领域的应用》的专题讲座,系统梳理了文化遗产数字化采集的技术体系,介绍了传统测绘设备与激光雷达技术的原理与应用。讲座涵盖“数字敦煌”“数字武当山”等实践案例,分析了摄影测量、激光雷达与三维建模技术在文化遗产保护中的融合应用,并介绍了 3D Gaussian Splatting 等新型三维表示方法。最后,黄教授展望了文化遗产数字化“可计算研究”的未来方向以及在数字博物馆和版权保护等领域的应用空间。互动环节中,学员们围绕历史影像辅助重建、纺织品与动物骨骼建模、石器模型自动化分析等问题与黄教授展开交流,讨论气氛热烈。

黄先锋教授讲座

暑期学校讲座现场

下午的课程环节中,香港科技大学信息枢纽计算媒体与艺术学域佟馨教授作题为《跨越时空的共鸣:探索中国古代壁画与绘画的视觉及叙事重构路径》的专题讲座。佟教授以敦煌壁画、《韩熙载夜宴图》等为例,介绍了古代图像资源的数字化重构方法基于大语言模型的智能叙事体系。佟教授还介绍了团队研发的 Lumina 系统以及面向非遗活态传承的系列 AI 辅助工具。在交流环节,学员们就 AI 应用路径、历史真实性检验、非遗传承断代等问题与佟教授展开讨论,亦有学员就游戏化案例的沉浸体验提出优化建议,佟教授逐一回应,并鼓励大家从自身专业出发,积极探索数字技术与人文研究的交叉融合。

佟馨教授讲座

学员提问

本次开幕式及首日课程内容紧密围绕文化遗产数字化保护与智能计算的核心议题展开,后续课程将继续围绕文化遗产数字化采集智能分析交互展示跨学科研究方法等主题展开,助力学员在理论学习与实践交流中深化认识、拓展视野。

END

编辑|文化遗产智能计算实验室

审校|刘争

武汉大学人文社科楼

阅读原文

跳转微信打开

  •  

会议通知 | 首届大学生国际数字人文节(IDHFUS 2026)

RUC信息资源管理 2026-07-03 13:08 北京

以下文章来源于:RUC信息资源管理学院

RUC信息资源管理学院

中国人民大学信息资源管理学院官方微信平台,发布学院动态,致力于为每一个信管人构建与学院沟通的桥梁。

报名截止:2026年8月10日

人大信管网络新闻中心出品

2026年首届大学生国际数字人文节

The 1st International Digital Humanities Festival for University Students

(IDHFUS 2026)

主题:遗产·记忆·视界

Heritage · Memory · Horizon

数字技术正以前所未有的力量重塑人类文明的记忆与表达。从古籍善本的数字复原到非物质文化遗产的交互再现,从海量历史数据的智能挖掘到跨文化叙事的可视化构建——数字人文正成为这个时代最富活力的交叉学科之一。

如果你对技术与人文的碰撞充满好奇,如果你有一个关于文化遗产、历史记忆或人文数据的创意构想,首届大学生国际数字人文节(IDHFUS 2026)正是为你而来!

为促进全球青年在数字人文领域的深度交流与创新实践,中国人民大学信息资源管理学院与数字人文研究院将于2026年9月18日至20日在中国人民大学中关村校区举办本次盛会。我们诚邀全球在校大学生携作品参展,同时欢迎青年教师、研究人员及数字人文相关行业专家参会交流,共同探索数字文明的无限可能。

组织单位

主办单位:

中国人民大学信息资源管理学院

中国人民大学数字人文研究院

指导单位:

联合国教科文组织世界记忆项目教育与研究分委会

世界互联网大会文化遗产数字化专委会

世界顶级信息学院联盟iSchools联盟

世界绿色设计组织(WGDO)

亚太数字人文教育协作委员会

国家文化科技创新服务联盟

活动安排

时间:2026年9月18日—9月20日

地点:中国人民大学中关村校区(北京)

语言:官方语言为中英双语

参与对象

本次活动开放两类参与方式:

◆ 参展者:全球在校大学生(个人或团队均可),提交数字人文相关作品参加展览与评奖。

◆ 参会者:青年教师、研究人员及数字人文相关行业专家,欢迎莅临交流。

参展要求

1

作品形式

请将作品提交至活动联系邮箱 (idhfus@ruc.edu.cn)。提交须使用本次活动的格式模板(附件1)。

参展作品须具备数字人文属性,鼓励提交以下类型的数字作品:

◆ 数据可视化成果、扩展现实(XR)作品、交互式网站或应用

◆ 数据集、软件工具、动画、游戏、视频等数字创作

2

语言要求

参展作品须以中文或英文呈现。为便于国际交流,所有作品(无论中英文)均须同时提交一份300字以内的英文摘要。

3

基本规范

参展作品须为原创,内容健康积极,遵守中国及作者所在国家(地区)相关法律法规。提交时须填写作品原创性及著作权声明、既往投稿情况说明、AI使用情况说明,具体见报名表。

4

赛道设置

参展者可选择以下任一赛道:

◆ 赛道1:自选主题(围绕“遗产·记忆·视界”自由创作)

赛道2:企事业单位命题(题目持续更新中,新增题目将陆续公布;具体说明见附件2):

(1)清代档案数字化呈现与传播

(2)科技档案的数字人文创新:知识融合、故事化策展与文化传播

(3)面向文化遗产教育的西安城墙AI交互式研学课程开发

(4)杂技非物质文化遗产的数字化开发

(5)浦江县档案馆上山文化档案知识挖掘及AI工具开发

(6)面向企业数字人文研发项目的微信自动询价响应工具开发

(7)基于非遗文化基因的 AIGC 文创设计工具

(8)博物馆线上虚拟展览智能策展工作流设计

(9)特色文献的多模态数字资源智能加工工具设计与实现

获奖权益

本次活动设有多项奖项,评委团由全球知名数字人文专家学者组成,为获奖作品颁发获奖证书。其它获奖权益如下:

✦ 奖金支持  评选设置奖金奖励

✦ 专业资源  专业工具授权与算力资源支持

✦ 媒体曝光  学术媒体与公众媒体同步推介

✦ 专家辅导  学术+技术专家一对一指导深度打磨作品

✦ 成果转化  对接文化数字化落地场景与成果孵化平台

✦ 案例入库 优秀获奖作品将纳入数字人文优秀案例库

✦ 学术发表 优秀获奖作品的相关研究论文将在《数字人文研究》期刊发表

学术期刊支持单位

《数字人文研究》

重要时间节点

节点

时间

作品提交及挑战赛报名(延期至)

2026年8月10日

早鸟报名截止(参会优惠票)

2026年8月20日

普通参会报名截止

2026年9月8日

活动举办

2026年9月18日—9月20日

注:早鸟优惠适用于普通观众参会票,具体价格将于正式通知中公布。

初步日常安排

日期

主要内容

备注

9月18日

开幕式及主旨报告;

数字记忆联盟成立大会及联盟成员项目展演;工作坊1;闭门会;学生作品展

详细议程见正式通知

9月19日

工作坊2;数字人文实验室开放日;青年沙龙;学生作品展

详细议程见正式通知

9月20日

闭幕式及颁奖典礼;学生作品展

详细议程见正式通知

联系方式

联系人:胡老师

联系电话:13021941288

电子邮箱:idhfus@ruc.edu.cn

数字人文不仅是技术与人文的简单相遇,更是一代青年对文明传承与创新使命的主动回应。期待与你相聚北京,共赴这场数字人文的国际盛会!

中国人民大学信息资源管理学院

中国人民大学数字人文研究院

2026年6月

阅读原文

跳转微信打开

  •