普通视图

Received today — 2026年8月5日4 - 德语区数字人文研究协会博客(DHd-Blog)

Women Playwrights in Digital Corpora: a DraCor Hackathon

作者Erik Renz
2026年8月4日 23:12

Literary historians maintain that women have never contributed significantly to the German drama. Facts, however, point clearly to the opposite. Indeed, the first known German dramatist (10th century) was a woman! Two major causes for the lack of historic recognition are: (a) prejudice that women are incapable of good dramatic production, (b) underrating of plays because professional critics—traditionally men—have used male psychology as the criterion for judging female characters in plays by women. A revaluation of women’s contributions to drama is imperative.
(Scholtz Novak 1972, 47)

When the German-born American scholar of German literature Sigrid Scholtz Novak issued her call for greater recognition of women playwrights in the early 1970s, she was responding to a literary historiography that had either largely overlooked women’s extensive dramatic production or fundamentally questioned its aesthetic and historical significance. More than five decades later, scholarly engagement with women playwrights has expanded considerably. Nevertheless, the problem of accessibility identified by Scholtz Novak remains unresolved. Many plays by women are still available only in historical print editions, are dispersed across libraries and archives, or are absent from the digital text collections that increasingly underpin literary-historical scholarship and computational research.

Within the Digital Humanities, accessibility entails more than the provision of a digital surrogate. For literary works to be discoverable, systematically analysable, and reusable across different research contexts, they must be represented in structured and interoperable formats, documented with reliable metadata, and integrated into sustainable research infrastructures. Digital corpora therefore are not neutral representations of literary history. Their composition reflects historical processes of publication, preservation, canon formation, scholarly reception, selection, and digitisation. As a result, works by women remain substantially underrepresented in many digital collections.

Against this background, the University of Rostock will host the hackathon Women Playwrights in Digital Corpora from 7 to 9 September 2026. The event will address both the digital representation and computational analysis of plays by women, with particular attention to their integration into the DraCor research infrastructure.

DraCor (short for Drama Corpora) is an open and multilingual research infrastructure for the computational study of drama from antiquity to the twentieth century. Its corpora are encoded according to the guidelines of the Text Encoding Initiative (TEI) and made available through a web interface and an application programming interface (API). DraCor currently comprises 33 drama corpora containing more than 4,000 annotated full-text plays in 24 languages. As a community-driven project committed to open-science principles, it supports a broad international research landscape in computational drama analysis and theatre history.

About the Hackathon

The hackathon will take place in Rostock from 7 to 9 September 2026. Hosted by the Professorship for Digital Humanities at the University of Rostock, the three-day event will bring together researchers from computational literary studies, cultural analytics, digital scholarly editing, theatre studies, and related fields.

The program will combine introductory training sessions on encoding dramatic texts in TEI and working with DraCor data with scholarly presentations, collaborative working sessions, and discussion formats. During the working sessions, participants may either pursue projects of their own or contribute to prepared thematic work packages.

Program

Monday, 7 September 2026

13:00–13:15
Welcome and Introduction
13:15–14:45
Beginners’ Training Session I: From Dramatic Text to DraCor TEI
Tutors: Julia Jennifer Beine and Aşina Aleyna Yıldız (both Würzburg)
14:45–15:15
Coffee Break
15:15–16:45
Beginners’ Training Session II: Analyses with DraCor Data
Tutor: Frank Fischer (Berlin)
16:45–17:15
Coffee Break
17:15–18:45
Opening Keynote
19:30
Informal Dinner

Tuesday, 8 September 2026

09:00–10:30
State of the Art: Women Playwrights in Digital Corpora
Speaker 1: Anna Axtner-Borsutzky
Speaker 2: TBA
Speaker 3: TBA
10:30–11:00
Coffee Break
11:00–12:30
Collaborative Working Session I
12:30–13:30
Lunch Break
13:30–15:00
Collaborative Working Session II
15:00–15:30
Coffee Break
15:30–17:00
Battle of the Plays World Championship 2026
Moderators: Frank Fischer and Antonio Rojas Castro (both Berlin)

Wednesday, 9 September 2026

09:00–10:30
Collaborative Working Session III
10:30–11:00
Coffee Break
11:00–12:00
Round Table Discussion
12:00–12:30
Closing Remarks

The hackathon is conceived as an open and collaborative environment for exploring methodological and practical questions relating to digital drama analysis, text encoding, corpus development, metadata modelling, and data enrichment. Rather than focusing exclusively on completed research results, the event invites participants to develop and test new approaches, exchange expertise, and collaborate on concrete textual and data-based materials. Possible topics may include:

  • the encoding, documentation, and enrichment of plays by women;

  • the integration of new plays into existing or newly established DraCor corpora;

  • the digital modelling and analysis of characters and gendered patterns of representation;

  • the computational analysis of character networks, speech distribution, scene structures, and stage directions;

  • comparative analyses across languages, historical periods, dramatic genres, and theatrical traditions;

  • the reconstruction of reception and transmission networks through authority data and linked open data;

  • the development of methods for linking plays, authors, characters, performances, translations, adaptations, and other forms of reception.

The event is open both to participants with previous experience of DraCor or TEI and to interested newcomers. No prior technical knowledge is required.

Registration

The event will take place on site at the University of Rostock. Participation is free of charge and limited to 35 participants. To register, please send an email to phf.dh@uni-rostock.de. When registering, please indicate whether you would also like to attend either or both of the following accompanying events:

  • Monday, 7 September 2026, from 7:30 p.m.: Informal dinner at L’Osteria Rostock. Participants are responsible for covering their own expenses.

  • Tuesday, 8 September 2026, 3:30–5:00 p.m.: Battle of the Plays World Championship 2026

Venue

Seminar Rooms 105 and 116
Philologicum
Universitätsplatz 3
18055 Rostock
Germany

Local organisers: Erik Renz and Ulrike Henny-Krahmer

Contact: phf.dh@uni-rostock.de

The event is organised with the support of the team of the Professorship for Digital Humanities at the University of Rostock. It forms part of the activities of the Rostock Working Group for Digital Humanities (RosDH) and is funded by the Department “Wissen – Kultur – Transformation” of the Interdisciplinary Faculty and by the Faculty of Humanities at the University of Rostock.

Received before yesterday4 - 德语区数字人文研究协会博客(DHd-Blog)

Lecture: Tackling Data Gaps in Digital Humanities, 09.09.26, online

2026年7月28日 17:29

We invite you to the online lecture by Dr. Sarah Lang (Max Planck Institute for the History of Science) on 09.09.2026 from 10:00 to 11:30, organised as a part of the seminar series ‘Legal History Meets Digital Humanities’ at the Max Planck Institute for Legal History and Legal Theory.

Digital humanities (DH) has long presented itself as a field committed to openness, collaboration, and innovation. Yet, alongside its many achievements, it also exhibits a number of persistent „dark sides“, ranging from infrastructural inequalities and invisible forms of labour to exclusionary data practices and the reproduction of historical and contemporary biases through digital methods. This chapter argues that one of the most pressing challenges currently facing the field is the persistence of data gaps, understood not merely as missing information but as the result of social, historical, and technical processes that systematically privilege some forms of knowledge while marginalising others. Building on work in critical digital humanities, critical archival studies, critical data studies, critical code studies, and feminist scholarship (including feminist AI ethics), the chapter examines how these traditions have conceptualised and addressed such absences, and considers how their insights can be mobilised more systematically within DH research and practice. It further situates these discussions within the recent shift towards data-centric approaches in artificial intelligence (DCAI), where the quality, documentation, and representativeness of datasets have become central ethical and technical concerns. By bringing these conversations into dialogue, the chapter argues that DH can benefit from engaging more directly with emerging debates on datasets while simultaneously contributing its own long-standing expertise in historical sources, documentation, and critical interpretation.

Please register here: https://plan.events.mpg.de/event/802

KI als Belastungsprobe für das offene Internet? Bericht vom Panel bei der DHd 2026 in Wien

2026年7月16日 23:58

Autor*innen (in alphabetischer Reihenfolge): David Maus, Staats- und Universitätsbibliothek Hamburg, https://orcid.org/0000-0001-9292-5673; Sarah Oberbichler, Luxembourg Centre for Contemporary and Digital History (C²DH), https://orcid.org/0000-0002-1031-2759 ; Grischka Petri, FIZ Karlsruhe – Leibniz-Institut für Informationsinfrastruktur ,https://orcid.org/0000-0002-2548-449X; Cindarella Petz, Leibniz-Institut für Europäische Geschichte (IEG) Mainz, https://orcid.org/0000-0002-6178-7332Klaus Rettinghaus, Sächsische Landesbibliothek — Staats- und Universitätsbibliothek Dresden (SLUB), https://orcid.org/0000-0003-1898-2543; Ulrike Wuttke, Fachhochschule Potsdam. Fachbereich Informationswissenschaften, SeDOA, https://orcid.org/0000-0002-8217-4025 

Hintergrund des Panels auf der DHd 2026

Am 25. Februar 2026 fand bei der DHd 2026 in Wien das Panel “KI als Belastungsprobe für das offene Internet” (Link zum Abstract auf Zenodo: https://doi.org/10.5281/zenodo.18696199) statt. Organisiert wurde das Panel von Ulrike Wuttke (Fachhochschule Potsdam, Fachbereich Informationswissenschaften, SeDOA), David Maus (Staats- und Universitätsbibliothek Hamburg), Fabian Rack (FIZ Karlsruhe – Leibniz-Institut für Informationsinfrastruktur, NFDI4Culture), Klaus Rettinghaus (Sächsische Landesbibliothek – Staats- und Universitätsbibliothek Dresden), Sarah Oberbichler (Luxembourg Centre for Contemporary and Digital History (C²DH), und Cindarella Petz (Digital Historical Research | DH Lab, Leibniz-Institute of European History (IEG)). Moderiert wurde das Panel von Ulrike Wuttke, Klaus Rettinghaus und Cindarella Petz. Da Fabian Rack zum Termin leider verhindert war, nahm an seiner Stelle für die NFDI4Culture Grischka Petri (FIZ Karlsruhe – Leibniz-Institut für Informationsinfrastruktur) neben David Maus und Sarah Oberbichler einen Sitz als Panelist*in ein. 

Im Mittelpunkt des Panels stand der Umgang mit den durch die momentanen KI-Entwicklungen verursachten Herausforderungen für offene Informationsinfrastrukturen, wie z. B. KI-Bot-Aktivitäten, sowie der Umgang mit aktuellen rechtlichen Herausforderungen und methodische Implikationen, insbesondere für die Digital Humanities (Shearer und Walk 2025 (COAR-Umfrage), Berg-Weiß 2025, COAR 2026). Die Paneldiskussion adressierte neben technischen und rechtlichen Lösungsansätzen Chancen und Herausforderungen des aktuellen Paradigmenwechsels im Umgang mit offenen Informationsinfrastrukturen und hinterfragte, wie sich der aktuelle KI-Trend mit den Prinzipien offenen Wissens und ethischen Prinzipien in den Digital Humanities und darüber hinaus vereinbaren lässt. Dabei wurden von den Panelist*innen technische, ethische und rechtliche Aspekte beleuchtet.

Einleitung KI und offenes Internet

Eingeleitet wurde das Panel durch Klaus Rettinghaus mit einer thematischen Einführung zum Thema KI und offenes Internet. Er führte aus, dass als OpenAI im November 2022 ChatGPT vorstellte, einerseits das Interesse an dieser neuen Technologie auf Benutzerseite groß war; andererseits die Sorgen bei den Tech-Giganten viel größer waren, nun unter Zugzwang gesetzt zu sein, um schnell zu handeln. Dies führte dazu, dass viele eifrig mit dem Training eigener Modelle begannen, um nicht den Anschluss zu verlieren (Hao 2026).

Ein Problem bei dieser Entwicklung ist, dass die KI-Modelle immer mehr Trainingsdaten benötigen, die sie sich ungefragt und oftmals ohne Erlaubnis überall besorgen und damit den Internet-Traffic in ungeahnte Höhen treiben (Heise 2025a). Das führt dazu, dass inzwischen zahllose KI-Bots das gesamte World Wide Web “abgrasen” und sich dabei als „normale“ Benutzer tarnen (Heise 2025b). Viele „Hüter“ des freien Wissens (wie z.B. Bibliotheken, Wikipedia) werden von Stiftungen oder der öffentlichen Hand finanziert und sind technisch weder für diesen gigantischen Anstieg des Verkehrs ausgelegt noch vorbereitet (Bsp. Thread Fitzpatrick 2026). Sie versuchen, dem Treiben Herr zu werden, indem sie Schranken aufbauen und sich immer mehr abschotten. Klaus Rettinghaus stellte diese Punkte dem Plenum und den Panelist*innen zur Diskussion, denn noch ist kein Ende dieses “Spuks” vorhersehbar und wirft diese neue Realität viele Fragen auf.

Paneldiskussion

Ziel der Paneldiskussion war es, grundlegende Aspekte der aktuellen KI-Entwicklungen in Bezug auf das offene Internet zu diskutieren. Mit Sarah Oberbichler, David Maus und Grischka Petri waren drei Expert*innen der Einladung auf das Panel gefolgt, um die verschiedenen Perspektiven der Akteursgruppen Forschung, Infrastruktur/Bibliothek, Rechtswissenschaft, zu vertreten. 

Mit kurzen Referaten von jeweils 5 Minuten und den jeweils anschließenden Gelegenheiten zur direkten Nachfragen und Kommentaren stellten die drei Panelist*innen ihre Sichtweisen vor. 

Sarah Oberbichler (C²DH, Luxemburg) näherte sich der Problematik aus der Perspektive der Forschungsdatenpraxis in den Digital Humanities und stellte dabei eine grundlegende begriffliche Unterscheidung in den Mittelpunkt: Was bedeutet „offen“ überhaupt? Und für wen? Offene Daten umfassen mindestens zwei Dimensionen, die in der Praxis nicht immer klar unterschieden werden: öffentliche Verfügbarkeit (technische Offenheit) im Sinne des freien Internetzugangs und rechtliche Offenheit durch Lizenzen, die Weiterverwendung für Forschung und Lehre erlauben, auch wenn Inhalte hinter einem Login liegen. Eine wesentliche Frage für Forschende lautet deshalb nicht: Sind die Daten zugänglich? Sondern: Sind sie auffindbar, nutzbar und nachnutzbar?

Am Beispiel des Internet Archive lässt sich zeigen, wie das massenhafte Scraping das offene Internet selbst verändert, und damit die Archivierung historisch bedeutsamer Quellen gefährdet. Da KI-Unternehmen das Internet Archiv als kostenlose Datenquelle nutzen, hatten im April 2026 241 Medienhäuser den Zugang für das Archiv blockiert, gleichzeitig schließen dieselben Häuser aber Lizenzdeals mit KI-Firmen ab (Muno 2026). Das Ergebnis ist eine strukturelle Verzerrung des digitalen Gedächtnisses: Qualitätsjournalismus verschwindet aus dem Archiv, während Blogs, Verschwörungsseiten und Content Farms übrig bleiben. Und da Medienhäuser nicht immer selbst archivieren und das Internet Archive blockiert wird, archiviert am Ende niemand.

In diesem Kontext gibt es keine klare Lösungen, jedoch mögliche Neuausrichtungen: (1) ethische KI-Implementierung statt Massenscraping; (2) öffentliche Dokumentation von Datensätzen statt unbegrenztem Datenzugang, etwa durch sogenannte Data Envelopes (Luthra & Eskevich, 2024), die Auffindbarkeit gewährleisten, ohne unkontrollierten Zugriff zu erzwingen; und (3) gemeinsame KI-Entwicklung, bei der Kultureinrichtungen, Forschende und KI-Entwickler:innen zusammenarbeiten und einen Paradigmenwechsel von Quantität zu Qualität vollziehen. 

David Maus nahm eine Einschätzung aus der Perspektive eines Infrastrukturanbieters vor. Aus der praktischen Arbeit an forschungsnaher Infrastruktur, den Bibliothekskatalogen und den daran angeschlossenen Informationssystemen, stellen sich die massenhaften Zugriffe auch als Angriff auf die Infrastruktur dar. Weil die Bots die etablierten Steuerungsmechanismen (Robots Exclusion Protocol, aka robots.txt) schlicht ignorieren und gnadenlos aus allen Richtungen die verfügbare Bandbreite verbrauchen, legen sie regelmäßig Teile der Infrastruktur lahm. Sei es, dass die Systeme unter der Last zusammenbrechen oder sei es, dass die Betreibenden ihre Dienste einstellen oder nur noch restriktiv zugänglich machen.

Als Konsequenz drückte er seine Erwartung einer stärkeren Zentralisierung und Homogenisierung der online verfügbaren Angebote aus. Der Schutz vor aggressiven Bots erfordert eine Infrastruktur, die Angebote von engagierten Einzelpersonen oder kleinen Facharbeitsgruppen nicht aufbringen können. Infrastrukturanbieter wiederum skalieren ihre Dienste darüber, dass sie Plattformen mit einer einheitlichen Grundstruktur anbieten. Angebote, die selbst keine Ressourcen für einen Bot-Schutz haben, verschwinden aus dem Netz oder müssen sich den Plattformen der Infrastrukturanbieter anpassen.

Grischka Petri führte aus, dass es aus rechtlicher Perspektive ernüchternd ist, nach Maßnahmen zu suchen, mit denen man gegen die Verursacher der Server-Sonderbelastung juristisch vorgehen könnte. Die Auswirkungen gleichen einem DoS-Angriff, dafür ist eigentlich das Computerstrafrecht zuständig. Allerdings ist es in den Bot-Downloads nicht vorgesehen, dass die besuchten Server in die Knie gehen sollen – im Gegenteil, man will sie ja nutzen. Der Ansatz scheitert also schon am Vorsatz. Das Urheberrecht bietet attraktive Kategorien an, um Nutzungen zu regeln – allerdings besteht das Problem ganz unabhängig vom urheberrechtlichen Status der Daten. Womöglich ist es für Anbieter gemeinfreier Inhalte sogar noch größer. Das Prinzip Lkw-Maut erscheint erfolgversprechender. Das ist eine Infrastrukturabgabe für eine Sondernutzung. Abseits einer staatlichen Regulierung hat die Wikimedia Foundation mit Wikimedia Enterprise einen solchen Weg eingeschlagen und bietet entsprechende Sondernutzungsverträge an.

Letztlich zeigt sich aber, dass mit rechtlichen Instrumenten keine Betriebssicherheit zu erlangen ist, weshalb am Ende die Empfehlung für technische Maßnahmen übrig bleibt. Initiativen wie die CC Signals, die sich selbst als “a technical and legal tool and a social proposition” beschreiben, sind vom guten Willen der beteiligten Akteure abhängig.

Nach dem Austausch auf dem Podium zwischen den Panelist*innen wurde die mit allen Teilnehmenden im Plenum von Cindarella Petz mit einer digitalen Intervention eingeleitet, in welcher die zu diskutierenden Fragen mithilfe von Wooclap zur Abstimmung gebracht wurden. 

Umfrageergebnisse mit Wooclap.

Mithilfe eines webbasierten Etherpads hatte das Publikum die Möglichkeit, anonym Fragen zu stellen und interessante Aspekte zu kommentieren. Im Pad wurden konkrete Standards und unterschiedliche Granularitäten von Nutzungslizenzen diskutiert, Ansätze zur Umleitung von Webcrawlern durch beispielsweise “LLMs.txt” oder “MCP” aufgeworfen, partizipatorische Elemente der Organisation von Wissenschaften, Forschung und GLAM-Institutionen angeregt und die ethische Nutzung von gecrawlten Datensätzen wie “Common Crawl” hinterfragt und welche rechtliche Rahmenbedingung geschaffen werden müssten, um eine Haftbarmachung von Massencrawlern und Stör-Bots zu erreichen.

Fazit und Ausblick

Die Diskussion zeigte deutlich, das wissenschaftsadäquate Lösungsszenarien für die komplexe Herausforderung durch die aktuellen KI-Entwicklungen nur mittels einer diversen Perspektive – unter Einbeziehung verschiedener Akteure und der Einbeziehung fachlicher, rechtlicher, technologischer und ethischer Aspekte herausgearbeitet werden können. Es wurde deutlich, dass es notwendig ist, dass die kritischen Stimmen lauter werden müssen. Letztendlich “befüttert” der KI-Einsatz in der Forschung in vielen Fällen (zumindest implizit) genau die gleichen Akteure, die für den im Panel kritisch betrachteten “ruchlosen” Umgang mit den digitalen Commons und Infrastrukturen insbesondere aus dem Kulturerbebereich (CHI) verantwortlich sind. 

Zusätzlich stellt sich die Frage, welche Expertise und Kompetenzen Digital Humanist(a)s in die Herausarbeitung von “Leitplanken” (Werten, Richtlinien, Forschungsethik) für den KI-Einsatz einbringen könnten bzw. sollten. In dieser neuen Phase des offenen Internets gibt es keine einfachen Lösungen. Alles “wegzuschließen” (d.h. technologische oder rechtliche Sperren) würde vor allem auch der Forschung selbst schaden. Was nützt es, wenn mensch alles finden kann, aber nicht mehr damit arbeiten kann. Wichtiger scheint es, den großen kommerziellen KI-Akteuren (Tech-Giganten) Einhalt zu gebieten bzw. ihr Handeln und die Nutzung ihrer Tools kritisch zu hinterfragen. Das Feedback im Saal bestärkte auf jeden Fall das große Potenzial von Digital Humanist(a)s und der LIS-Community (Library and Information Science) in der Politikberatung und der Herausarbeitung kritischer Punkte. Die Zeit ist reif, den Finger in die Wunde zu legen.

Quellen 

Berg-Weiß, Alexander. “Offen für manche Menschen oder doch für alle(s)? KI-Bots und ihre Auswirkungen auf den Betrieb von Repositorien.” BuB 77 Nr. 7(2025), S. 372-75. 

COAR, Navigating the Uneasy Interdependence of AI and Open Science, A COAR Statement, 3.3.2026

https://coar-repositories.org/news-updates/navigating-the-uneasy-interdependence-of-ai-and-open-science/ 

Fitzpatrick 2026, “Just FYI: this is part of the damage being done by extractive AI companies. Their scraper bots routinely DDOS us, and they multiply to take up as much bandwidth as is available. We are having to put a huge percentage of our developers’ time into just keeping the site alive rather than building its future. They are actively destroying everything worthwhile about the internet.” https://hcommons.social/@kfitz/115854657278743117, Mastodon, 7.1.2026, 17:02.  

Hao, Karen. 2026. Empire of AI: dreams and nightmares in Sam Altman’s OpenAI. New York: Penguin Books.

Heise (2025a), „Besorgniserregender Trend“: KI verursacht immer mehr Traffic, 21.08.2025 https://www.heise.de/news/Analyse-KI-Crawler-koennen-Server-ueberlasten-10560038.html (Achtung ohne Pur-Abo: Tracking)

Heise (2025b), Wikipedia: Bot-Traffic tarnt sich zunehmend als menschlich, 19.10.2025 https://www.heise.de/news/Wikipedia-Bot-Traffic-tarnt-sich-zunehmend-als-menschlich-10778492.html (Achtung ohne Pur-Abo: Tracking)

Luthra, Mrinalini und Maria Eskevich. „Data-Envelopes for Cultural Heritage: Going beyond Datasheets.“ Proceedings of the Workshop on Legal and Ethical Issues in Human Language Technologies @ LREC-COLING 2024, S. 52–65. Torino, Italia: ELRA and ICCL, 2024. https://aclanthology.org/2024.legal-1.9/  

Muno, Martin. „Internet-Archive: Unser digitales Gedächtnis ist bedroht.“ Deutsche Welle, 21. April 2026. https://p.dw.com/p/5CKXK

Shearer, Kathleen und Paul Walk. „The impact of AI bots and crawlers on open repositories: Results of a COAR survey.” April 2025, aufgerufen am 30.07.2025, https://coar-repositories.org/wp-content/uploads/2025/06/Report-of-the-COAR-Survey-on-AI-Bots-June-2025-1.pdf.

Wuttke, U., Maus, D., Rack, F., Rettinghaus, K., Oberbichler, S., & Petz, C. (2026, Februar 20). KI als Belastungsprobe für das offene Internet?. DHd 2026 Nicht nur Text, nicht nur Daten (DHd2026) (DHd2026), Wien, Österreich. https://doi.org/10.5281/zenodo.18696199

Virtuelles DH-Kolloquium an der BBAW, 29.06.2026: „Was ist das für 1 struggle ey 🙈“ – Autorenerkennung im Instant Messaging

2026年6月22日 18:23

Im Rahmen des DH-Kolloquiums an der BBAW laden wir Sie herzlich zum nächsten Termin am Montag, den 29. Juni 2026, 16 Uhr c.t., ein (virtueller Raum: https://meet.academiccloud.de/gl/lou-eyn-nm6-t6b):

 Gaby Axer (Universität Mannheim)
über
„Was ist das für 1 struggle ey 🙈“ – Autorenerkennung im Instant Messaging

***

Die Forensische Linguistik im engeren Verständnis befasst sich mit der Frage der Autorschaft eines Textes und konzentriert sich dabei auf zwei Hauptfragen:

  • Was kann ich über den Autor eines anonymen Textes anhand der sprachlichen Merkmale ableiten?
  • Stammen zwei oder mehr Texte von demselben Autor?

Der Beantwortung dieser Fragen liegt bei der qualitativen Autorenanalyse stets eine Fehler- und Stilanalyse zugrunde. Um eine Einschätzung der Aussagekraft gefundener Merkmale treffen zu können, bedarf es eines Wissens zur Verteilung solcher Merkmale in der relevanten Vergleichspopulation. Diese sind zwar für „klassische“ forensisch relevante Textsorten wie Drohbriefe, Erpresser- und Bekennerschreiben gut erforscht, allerdings liegen für neuere Textsorten wie Forenposts oder Instant Messaging wenige Studien und Korpora vor, die für die Bedarfe der Forensischen Linguistik ausgelegt sind. Zudem bilden viele Studien außerhalb der klassischen Textsorten die Realität des alltäglichen Sprachgebrauchs vieler deutschsprachiger Personen nicht adäquat ab, vor allem im wenig regulierten Genre des Chats. Um diese Lücke zu füllen, soll ein für die Autorenanalyse aufbereitetes Referenzkorpus der Alltagssprache des Deutschen (RAD) mit Hauptfokus auf Instant Messaging erstellt werden und die Belastbarkeit verschiedener Merkmale/Merkmalskombinationen getestet werden.

Der Vortrag stellt die Bedarfe und Herausforderungen der forensischen Autorenerkennung dar und versucht, die Variationsbreite deutschsprachiger Autoren abzubilden. Darüber hinaus gibt er einen Einblick in die rechtlichen, technischen und ethischen Hürden des Promotionsziels, das RAD neu zu erfinden.

***

Die Veranstaltung findet virtuell statt; eine Anmeldung ist nicht notwendig. Zum Termin ist der virtuelle Konferenzraum über den Link https://meet.academiccloud.de/gl/lou-eyn-nm6-t6b erreichbar. Wir möchten Sie bitten, bei Eintritt in den Raum Mikrofon und Kamera zu deaktivieren. Nach Beginn der Diskussion können Wortmeldungen durch das Aktivieren der Kamera signalisiert werden.

Der Fokus der Veranstaltung liegt sowohl auf praxisnahen Themen und konkreten Anwendungsbeispielen als auch auf der kritischen Reflexion digitaler geisteswissenschaftlicher Forschung. Weitere Informationen finden Sie auf der Website der BBAW.

DH-Tag 2026 der Universität Münster – Programm online!

2026年5月22日 00:15

Der diesjährige DH-Tag der Universität Münster steht vor der Tür. Am 10. Juli 2026 wartet ein abwechslungsreiches Format zum Thema „Digital Humanities: Human Autonomy?“ auf Sie – das offizielle Programm ist nun online.

Plakat zum DH-Tag der Universität Münster: An einer roten Backsteinmauer prangen die metallisch glänzenden 3D-Buchstaben „DIGITAL HUMANITIES", wobei das Wort „HUMANITIES" zusätzlich mit roter Sprühfarbe überdeckt ist. Darunter steht in roter Graffiti-Schrift die Frage „AUTONOMY?". Vor der Mauer steht ein Aufsteller mit der Aufschrift „DH-Tag der Universität Münster, Freitag, 10. Juli 2026" sowie einem QR-Code. Auf dem gepflasterten Boden liegen zwei gebrauchte Sprühdosen. Oben rechts befindet sich das Logo der Universität Münster, unten links das Logo des Center for Digital Humanities Münster und unten rechts das Logo des SCDH (ULB Münster). Am linken Bildrand steht vertikal der Hinweis: „Grafik erstellt mit KI-Unterstützung".

 

Ganz besonders freuen wir uns, mit Prof. Dr. Tobias Hodel von der Universität Bern einen ausgewiesenen Experten auf dem Gebiet KI-gestützter Arbeitsweisen als Keynote Speaker gewonnen zu haben. Sein Vortrag „Denken trotz Prompt? Epistemologische Souveränität als Aufgabe der Digital Humanities“ richtet den Blick nicht nur auf konkrete digitale Werkzeuge, sondern stellt vor allem das praktische Arbeiten sowie die dabei betroffenen Reflexionen und Denkweisen in den Mittelpunkt. Eine ausführliche Beschreibung des Vortrags und alle Details zu Programm sowie Hinweise zur Ameldung (bis zum 29.6.2026 möglich) finden Sie auf unserer Seite zum DH-Tag 2026.

Bitte beachten Sie, dass der DH-Tag in Präsenz stattfinden, die Keynote allerdings live online übertragen wird.

Datum: 10. Juli 2026
Ort: Universität Münster, Hörsaal JO 1
Details & Programm: https://www.uni-muenster.de/DH/cdh/dh-tage/2026.html

Herzliche Grüße im Namen des gesamten Organisationsteams
   Christian Wachter

Einladung zum morgigen Online-Vortrag von Zita Baronnet im Rahmen des TCDH-Forschungskolloquiums

2026年5月20日 18:05

Gerne möchten wir Sie zum morgigen Online-Vortrag (16–18 Uhr (c.t.)) im Rahmen des TCDH-Forschungskolloquiums einladen:

Zita Baronnet (Universität Trier / TCDH): „Urheberrechtlich geschützte Texte online veröffentlichen: Ein Versuch, das Paradoxon zu lösen”

Wie kann man urheberrechtlich geschützte Texte online zugänglich machen, ohne gegen das Urheberrecht zu verstoßen? Wenn urheberrechtlich geschützte Texte als Klartext online verbreitet werden, wird das Urheberrecht verletzt. Andererseits sind komplett verschlüsselte Texte nutzlos für Forscher, da keine computergestützten Analysemethoden wie Sentiment Analysis auf ihnen verwendet werden können. Ziel des DFG-Projekts ‚Forschen mit Derivaten‘ – das im Vortrag vorgestellt wird – ist die Entwicklung eines Ansatzes, mit dem urheberrechtlich geschützte Texte online veröffentlicht und trotzdem analysiert werden können, ohne das Urheberrecht zu verletzen. Wir untersuchen verschiedene Methoden, von der Randomisierung bis zur homomorphen Verschlüsselung, um dieses Problem zu lösen.

Im Sommersemester 2026 setzen wir unsere Vortragsreihe im Rahmen des TCDH-Forschungskolloquiums fort. Das Spektrum reicht in diesem Semester von Fragen der digitalen Erschließung und Vernetzung historischer Texte und Wörterbücher über rechtliche und ethische Herausforderungen im Umgang mit Forschungsdaten bis hin zu digitalen Editionen und Plattformlösungen für die geisteswissenschaftliche Forschung. 

Sie sind herzlich eingeladen, teilzunehmen und mitzudiskutieren!

Alle Informationen und Zoom-Link gibt es unter: https://tcdh.uni-trier.de/de/event/vortrag-von-zita-baronnet-universitaet-trier-tcdh-leonard-schild-cosic-ku-leuven

Virtuelles DH-Kolloquium an der BBAW, 18.05.2026: Introducing Playfair: An Integrated Scholarship Environment

2026年5月11日 15:58

Im Rahmen des DH-Kolloquiums an der BBAW laden wir Sie herzlich zum nächsten Termin am Montag, den 18. Mai 2026, 16 Uhr c.t., ein (virtueller Raum: https://meet.academiccloud.de/gl/rooms/lou-eyn-nm6-t6b/join)

Dr. Jeffrey Wolf (Vrije Universiteit Brussel)

Humanities researchers today work across a fragmented landscape of digital tools. Citation managers know nothing about manuscript images. Transcription software has no connection to the writing environment. Collection metadata lives in spreadsheets that no other application can read. The result is not merely inconvenience; it is a structural barrier to the kind of cross-referencing, discovery, and synthesis that scholarship demands.

The prototype (early stage) Playfair Suite takes a different approach: a family of desktop applications for collection and source management (Playfair), academic writing (Scribe), manuscript analysis (Quire), OCR and transcription (Almanak), and prosopographical work (Proso), all built on a shared data layer. At the centre sits Playfair, which manages sources, entities, and metadata across the entire research lifecycle, and makes them available to every other application through embeddable views and a common interface. A citation entered in Playfair is immediately accessible while writing in Scribe. A manuscript catalogued in Playfair carries its metadata into analysis in Quire.

This talk introduces the architecture and vision of the Playfair Suite, demonstrates the integration between Playfair and Scribe, and asks what a truly integrated research environment could mean for humanities scholarship.

***

Die Veranstaltung findet virtuell statt; eine Anmeldung ist nicht notwendig. Zum Termin ist der virtuelle Konferenzrraum über den Link https://meet.academiccloud.de/gl/rooms/lou-eyn-nm6-t6b/join erreichbar. Wir möchten Sie bitten, bei Eintritt in den Raum Mikrofon und Kamera zu deaktivieren. Nach Beginn der Diskussion können Wortmeldungen durch das Aktivieren der Kamera signalisiert werden.

Der Fokus der Veranstaltung liegt sowohl auf praxisnahen Themen und konkreten Anwendungsbeispielen als auch auf der kritischen Reflexion digitaler geisteswissenschaftlicher Forschung. Weitere Informationen finden Sie auf der Website der BBAW.

Lecture: Embedding the Past: From Visual Artefact to Semantic Data – AI-Supported Workflows in Digital Scholarly Editing, 22.05.2026, online

2026年4月30日 18:06

We invite you to the online lecture by Prof. Dr. Michael Schonhardt (TU Darmstadt) on 22.05.2026 from 10:00 to 11:30, organised as a part of the seminar series ‘Legal History Meets Digital Humanities’ at the Max Planck Institute for Legal History and Legal Theory.

The presentation will focus on the AI-driven datafication of historical sources, ranging from medieval manuscripts to early modern correspondence, into structured and semantic data. It will explain the Digital Editing Toolkit, a modular AI-based editorial workflow, and discuss the potential of vector embeddings and entity linking for new heuristic approaches to digitised source corpora. Finally, it will evaluate how these methods reshape the role of the editor in the age of large-scale datafication

Registration and more information here: https://plan.events.mpg.de/event/762

Warum digitale Methoden unsere Wissenschaft herausfordern: SHareDH-Vortragsreihe „Produktive Ambivalenz – Digitale Methoden und Meistererzählungen“

2026年4月21日 01:58

Digitale Methoden haben die Geisteswissenschaften in den letzten Jahren grundlegend verändert. Sie eröffnen neue Wege der Analyse, ermöglichen große Datenmengen zu erschließen und stellen etablierte Forschungsfragen in ein neues Licht. Doch mit diesen Möglichkeiten entstehen auch neue Herausforderungen: Welche Narrative prägen unser wissenschaftliches Denken? Welche Perspektiven werden sichtbar – und welche bleiben unsichtbar?

Die Vortragsreihe „Produktive Ambivalenz – Digitale Methoden und Meistererzählungen“ setzt genau hier an. Sie versteht Digitalisierung nicht nur als technischen Fortschritt, sondern als epistemologische Herausforderung. Digitale Werkzeuge können dazu beitragen, lange etablierte Meistererzählungen und Korpora zu hinterfragen. Gleichzeitig können sie selbst neue Normen, Standards und Narrative erzeugen – etwa durch algorithmische Auswahlprozesse, Datenstrukturen oder softwarebasierte Voreinstellungen.

Im Zentrum der Vortragsreihe stehen daher Fragen wie: 

  • Wie verändern digitale Methoden die Art und Weise, wie Wissen entsteht?
  • Welche Rolle spielen Prozesse von Auswahl, Kanonbildung und Datenstrukturierung?
  • Inwiefern schaffen digitale Technologien neue wissenschaftliche Selbstverständnisse?
  • Und wie lässt sich diese Ambivalenz produktiv für Forschung und Lehre nutzen?

Die Vortragsreihe bringt Expert:innen aus unterschiedlichen Disziplinen zusammen und lädt dazu ein, die Zukunft der Geisteswissenschaften kritisch und konstruktiv zu diskutieren. Sie richtet sich an Forschende, Studierende und alle Interessierten, die sich mit den Auswirkungen digitaler Technologien auf Wissenschaft und Gesellschaft auseinandersetzen möchten. Veranstaltet wird sie im Rahmen des Projekts SHareDH, einem gemeinsamen Projekt von UB Kiel und Europa Universität Flensburg zur Förderung der Digital Humanities in Forschung und Lehre an den beiden Universitäten in Kiel und Flensburg.

Termine

28.04.2026, digital: Wahlverwandtschaften 2.0? Statistische Narrative in den Digital Humanities
Jun.-Prof.  Dr. Rabea Kleymann (TU Chemnitz)

05.05.2026, digital: Edition als Mnemotechnik – Multimodale Quellen jenseits linearer Wissensordnungen
Jun.-Prof. Dr. Elisa Cugliana (Universität zu Köln)

19.05.2026, Kiel, OS75 – Hörsaal 1 und digital: Unsere breite Gegenwart und ihre algorithmische Zukunft: LLM-Epistemik beim Aktualisieren historischer Narrative
Dr. Christopher Nunn (Universität Heidelberg)

26.05.2026, Flensburg, Gebäude Helsinki, Raum HEL 067 und digital: Digitale Praktiken und digital-analoge Daten zwischen Ausprobieren, Explorieren und Infrastrukturieren in den Digital Humanities
Prof. Dr. Lina Franken (Universität Vechta)

09.06.2026, Kiel, OS75/S3 – R.177 und digital: Erzählforschung als Messverfahren? Zu den methodologischen Chancen und Herausforderungen computationeller Zugänge
Prof. Dr. Evelyn Gius (TU Darmstadt)

23.06.2026, digital: Kanonkritik durch Distant Reading, Zoom und Close Reading oder De arte venandi per algorithmum
Prof. Dr. Peter Bell (Philipps-Universität Marburg)

07.07.2026, tba.: Über die epistemische Gewalt der Digitalität: Plädoyer für eine grundlegende Datenkultur in den Geisteswissenschaften
Dr. Till Grallert (Humboldt Universität zu Berlin)

Zeit: Dienstags, 16:15 Uhr

Digitale Teilnahme via https://uni-kiel.zoom-x.de/j/69649547724?pwd=rxlaUZ5lO4yKxylnUshz1afWqoS8rq.1 ohne Anmeldung möglich.

Das Plakat zur Vortragsreihe ist hier zu finden. 

Kontakt: Patrick Nehr-Baseler

Virtuelles DH-Kolloquium an der BBAW, 27.04.2026: Historische Fremdsprachenlehrwerke digital. Erschließung historischer, mehrsprachiger Quellen: Kontext und Herausforderungen

2026年4月17日 21:16

Im Rahmen des DH-Kolloquiums an der BBAW laden wir Sie herzlich zum nächsten Termin am Montag, den 27. April 2026, 16 Uhr c.t., ein (virtueller Raum: https://meet.academiccloud.de/gl/rooms/lou-eyn-nm6-t6b/join)

Janine Rauchmann (TU Darmstadt), Dr. Kerstin Roth (Universität Hamburg),
Lisa Scharrer (TU Darmstadt), Dr. Josephine Ulbricht (BBAW)

Das Akademienvorhaben „Historische Fremdsprachenlehrwerke digital“ (FSL digital) widmet sich erstmalig der Volltexterschließung, korpuslinguistischen Aufbereitung, Annotation, digitalen Vernetzung sowie der sprach-, kultur- und wissenshistorischen Auswertung von mehrsprachigen Fremdsprachenlehrwerken aus der Frühen Neuzeit (15. – 17. Jahrhundert). Fremdsprachenlehrwerke der Frühen Neuzeit, die bis zu zehn Vernakularsprachen parallel abbilden, stellen eine genuin mehrsprachige Textsorte mit komplexem Layout dar. Somit bringen diese Quellen besondere Herausforderungen bei ihrer digitalen Aufbereitung mit sich. Um der inhaltlichen und strukturellen Heterogenität der Lehrwerke gerecht zu werden, bedarf es eines geeigneten Ansatzes zur (automatisierten) Texterkennung, der auch zukünftige Aspekte der Text- und Layoutannotation frühzeitig mitdenkt. In diesem Zusammenhang möchten wir die Quellengruppe und den aktuellen Workflow im Projekt vorstellen, welcher angesichts der großen Datenmenge einen Work-in-Progress darstellt und neben Text- und Layouterkennung auch das Postprocessing des OCR-Outputs sowie erste Ansätze zur Textannotation umfasst.

 

***

Die Veranstaltung findet virtuell statt; eine Anmeldung ist nicht notwendig. Zum Termin ist der virtuelle Konferenzrraum über den Link https://meet.academiccloud.de/gl/rooms/lou-eyn-nm6-t6b/join erreichbar. Wir möchten Sie bitten, bei Eintritt in den Raum Mikrofon und Kamera zu deaktivieren. Nach Beginn der Diskussion können Wortmeldungen durch das Aktivieren der Kamera signalisiert werden.

Der Fokus der Veranstaltung liegt sowohl auf praxisnahen Themen und konkreten Anwendungsbeispielen als auch auf der kritischen Reflexion digitaler geisteswissenschaftlicher Forschung. Weitere Informationen finden Sie auf der Website der BBAW.

Einladung zum TCDH-Forschungskolloquium „Perspektiven der Digital Humanities“

2026年4月13日 15:49

Vorträge des TCDH-Forschungskolloquiums im Sommersemester 2026

Alle Informationen und Zoomlink unter: https://tcdh.uni-trier.de/de/event/programm-des-tcdh-forschungskolloquiums-perspektiven-der-digital-humanities-1

Im Sommersemester 2026 setzen wir unsere Vortragsreihe im Rahmen des TCDH-Forschungskolloquiums fort. Das Spektrum reicht in diesem Semester von Fragen der digitalen Erschließung und Vernetzung historischer Texte und Wörterbücher über rechtliche und ethische Herausforderungen im Umgang mit Forschungsdaten bis hin zu digitalen Editionen und Plattformlösungen für die geisteswissenschaftliche Forschung.

Sie sind herzlich eingeladen, teilzunehmen und mitzudiskutieren!

Programm:

23.04.2026

  • Anne Klee (Universität Trier / TCDH): „Klassische Verfahren oder (Large) Language Models? Wie historische Dialektwörterbücher zu Linked Open Data vernetzt werden können”

07.05.2026

  • Selina Galka (Universität Graz): „Die Memoiren der Gräfin Schwerin: Digitale Erschließung eines einzigartigen Selbstzeugnisses”

21.05.2026

  • Zita Baronnet (Universität Trier / TCDH): „Urheberrechtlich geschützte Texte online veröffentlichen: Ein Versuch, das Paradoxon zu lösen”

11.06.2026

  • Irakli Khvedelidze (Shota Rustaveli Institute of Georgian Literature, Tiflis): „Korrespondenzforschung in Deutschland und ihre Relevanz für die Erschließung des georgischen schriftlichen Nachlasses: Ein Pilotprojekt”

25.06.2026

  • Edda Schwarzkopf (Digital Humanities Center, Universität Tübingen): „Der OMnibus of MANTRAMS: Entangled Data in a Minimalist Computing online platform”

02.07.2026

  • Frank Queens (Universität Trier / TCDH), Michael Scheffel (Universität Wuppertal), Anne Schittek (Universität Wuppertal), Olivia Varwig (Universität Wuppertal): „,kein Traum ist völlig Traum’. Die Genese der ,Traumnovelle’ in der digitalen Arthur Schnitzler-Edition”

Ringvorlesung „Digital Humanities im Fokus“

作者Erik Renz
2026年4月5日 17:35

Im Sommersemester 2026 wird die Ringvorlesung „Digital Humanities im Fokus: Methoden, Anwendungen und Perspektiven“ an der Universität Rostock fortgesetzt. Die Veranstaltung wird von der Juniorprofessur für Digital Humanities in Kooperation mit dem Rostocker Arbeitskreis Digital Humanities (RosDH) organisiert.

Die Vorträge finden im hybriden Format statt. Eine vorherige Anmeldung für die einzelnen Termine ist nicht erforderlich.

Programm für das Sommersemester 2026:

13.04.2026
Julia Hintersteiner, Dr. Alan van Beek und Dr. Katharina Zeppezauer-Wachauer (alle drei Universität Salzburg)
Die Evolution der Mittelhochdeutschen Begriffsdatenbank

27.04.2026
Prof. Dr. Franz Fischer (Università Ca’ Foscari di Venezia)
Unreadable, Unstable, Uneditable – Critical, Genetic, and Constellational Editions of Difficult Texts and Their Transmission

18.05.2026
Dr. Bart Holterman und Dr. Angela Huang (beide FGHO)
Ein NER-Schema für die Hanseforschung: Überlegungen und Herausforderungen

01.06.2026
Hellmut Braun (Universität Rostock), Dr. Anne Gessing (Universität Bonn), Karsten Labahn und Robert Stephan (beide UB Rostock)
Künstlike Werltspröke und Eyn schön rimbökelin. Digitale Edition mittelniederdeutscher Spruchsammlungen des 16. Jahrhunderts

15.06.2026
Jannik Franz, Tim Kuhlmann und Marie Luise Voß (alle drei hmt Rostock)
„Between Two Worlds“ – Hybride Musikedition am Beispiel der Erich Wolfgang Korngold Werkausgabe

06.07.2026
Dr. Frederike Neuber und Tim Westphal (beide BBAW)
Wer hat hier ediert? Autorschaft, Transparenz und Dokumentation in maschinell unterstützten Editionsprozessen

Veranstaltungszeit

Immer montags an den ausgewiesenen Terminen, ab 17:15 Uhr.

Kontakt

Bei Fragen zur Ringvorlesung wenden Sie sich gerne an das Team der DH-Juniorprofessur: phf.dh@uni-rostock.de.

Weitere Informationen finden Sie fortlaufend aktualisiert auf den Seiten des RosDH: https://www.germanistik.uni-rostock.de/forschung/digital-humanities/rosdh/ringvorlesung/2026/.

Organisation: Ulrike Henny-Krahmer und Erik Renz.

Virtuelles DH-Kolloquium an der BBAW, 16.02.2026: Die KI beschreibt mein Objekt? – Anwendungsszenarien und Ausblicke für die Museumsdokumentation in Zeiten von KI

2026年2月12日 17:04

Im Rahmen des DH-Kolloquiums an der BBAW laden wir Sie herzlich zum nächsten Termin am Montag, den 16. Februar 2026, 16 Uhr c.t., ein (virtueller Raum: https://meet.gwdg.de/b/lou-eyn-nm6-t6b):

Joshua Ramon Enslin (Freies Deutsches Hochstift | museum-digital)

Spätestens mit dem Aufkommen und der Popularisierung von KI-Chatbots wie ChatGPT hat die Diskussion um die Möglichkeiten des Einsatzes von Künstlicher Intelligenz auch die Museumsdokumentation erreicht.

In diesem Vortrag wird auf Basis eines generalisierten Lifecycles von Erschließungsdaten zu Museumsobjekten erst ein kurzer Überblick über bisherige Einsatzszenarien von KI mit dem Versuch einer Klassifikation präsentiert. Im Folgenden werden zwei im Rahmen der Initiative
museum-digital entwickelte Einsatzszenarien im Detail beleuchtet.

museum-digital (https://www.museum-digital.org/) wurde 2009 in Bitterfeld von Museen gegründet, um gemeinsam die Bestände der Museen im Netz zu präsentieren. Ausgehend von der Publikation erweiterten sich die Aktivitäten und Softwarelösungen bald in andere, verwandte digitale Arbeitsfelder von Museen, besonders das Sammlungsmanagement und die Erstellung digitaler Ausstellungen. Heute arbeiten ca. 1700 Museen primär aus Deutschland, Ungarn und der Ukraine mit museum-digital, von denen bisher 1231 Objekte über die Plattformen veröffentlicht haben.

Die beiden Werkzeuge im Fokus des Vortrages sind Versuche, die  Erschließungsarbeit der Museen weiter zu vereinfachen. Einerseits werden hierzu etwa bei Gemälden, Graphiken und Fotographien abgebildete Elemente automatisch erkannt und zur Verschlagwortung auf Basis des entsprechenden kontrollierten Vokabulars von museum-digital vorgeschlagen. Zentrale Fragen waren bei der Implementation einerseits die Anbindung bisher nicht auf die Arbeit mit Normdaten und kontrollierten Vokabularen ausgericheter Modelle an ein kontrolliertes Vokabular und die Frage, wie eine Klassifikation im Rahmen einer finanziell und in Bezug auf die zur Verfügung stehenden (Server-)Hardware stark eingeschränkten Community-Initiative umgesetzt werden können.

Das zweite hervorgehobene Werkzeug synthetisiert auf Basis bestehender, strukturierter Objektmetadaten Prosa-Objektbeschreibungen, die sowohl im Sinne der Barrierefreiheit als auch für die Auffindbarkeit der Objekte (besonders durch Suchmaschinen) bei museum-digital für die Publikation von Objekten verpflichtend vorausgesetzt werden. Hierzu werden die strukturierten Objektdaten auf Anfrage der Nutzenden in eine Prompt-Vorlage eingefügt. Auf Basis der Objektart werden ausgewählte, vorher als gut bewertete Beispielobjektbeschreibungen möglichst ähnlicher Objekte mitgegeben (Few-Shotting). Um Nutzende zu einer tatsächlichen kritischen Auseinandersetzung der generierten Texte zu bewegen, werden je drei, von verschiedenen Large Language Models generierte, Vorschläge generiert und angezeigt. Ist einer ausgewählt, werden Nutzende aufgefordert, den Text zu redigieren. Das Tool entstand experimentell im Rahmen einer Kooperation des Freien Hochstifts, des Zuse-Instituts Berlin, digiS‘ und von museum-digital. In diesem Kontext wurde für das Werkzeug ein engmaschiges Logging der generierten Daten und der Nutzerinteraktion implementiert, das tiefere Auswertungen zulässt – etwa, inwiefern die Texte tatsächlich redigiert wurden, und ob bestimmte Modelle, Textlängen, etc. von den Nutzenden präferiert wurden.

Der Vortrag schließt mit einem Ausblick auf die weiteren Potentiale und die durch die durch dank KI veränderte Umgebung aufgekommenen neuen Herausforderungen in der (digitalen) Erschließung und Publikation von Museumsbeständen.

***

Die Veranstaltung findet virtuell statt; eine Anmeldung ist nicht notwendig. Zum Termin ist der virtuelle Konferenzrraum über den Link https://meet.gwdg.de/b/lou-eyn-nm6-t6b erreichbar. Wir möchten Sie bitten, bei Eintritt in den Raum Mikrofon und Kamera zu deaktivieren. Nach Beginn der Diskussion können Wortmeldungen durch das Aktivieren der Kamera signalisiert werden.

Der Fokus der Veranstaltung liegt sowohl auf praxisnahen Themen und konkreten Anwendungsbeispielen als auch auf der kritischen Reflexion digitaler geisteswissenschaftlicher Forschung. Weitere Informationen finden Sie auf der Website der BBAW.

Auftakt des neuen Podcasts “Die Wissensarchitekt*innen” mit Staffel zum Datentracking, Folge 1 mit Renke Siems und Yuliya Fadeeva!

2026年2月4日 00:42

Ich freue mich Ihnen mitzuteilen, dass zum 2. Digital Independence Day die Auftaktfolge meines neuen Podcasts „Die Wissensarchitekt*innen“ online gegangen ist.

Der Wissenschaftspodcast “Die Wissensarchitekt*innen” erkundet die Welt hinter den Daten und was Bibliotheken, Forschung und Algorithmen miteinander verbindet. In Gesprächen über das Wissen von morgen werden kritische Aspekte der Informationsgesellschaft und ihre politischen und gesellschaftlichen Folgen diskutiert. 

In jeder Folge sind Gäst*innen aus unterschiedlichen Bereichen der Informations- und Wissenslandschaft zu Gast, um über ihre Arbeit und Themen zu sprechen. In der ersten Staffel von “Die Wissensarchitekt*innen” steht das Thema Datentracking mit Fokus Science Tracking (d.h. das nicht datenschutzgerechte Erheben und Nachnutzen von Nutzungsdaten auf kommerziellen wissenschaftlichen Webseiten) zentral.

Mehr zur Auftaktfolge mit Dr. Renke Siems und Dr. Yuliya Fadeeva unter dem Titel „Was ihr schon immer über Datentracking in der Wissenschaft wissen wolltet“ lesen Sie hier:  https://ulrikewuttke.wordpress.com/2026/02/01/auftaktfolge-meines-podcasts-die-wissensarchitektinnen-mit-renke-siems-und-yuliya-fadeeva-was-ihr-schon-immer-uber-datentracking-in-der-wissenschaft-wissen-wolltet-live/  

Die Folgen der ersten Staffel werden monatlich am ersten Sonntag jeden Monats, parallel zur Initiative Digital Independence Day mit freundlicher Unterstützung von Podcasts.homes erscheinen. Den Podcast kann mensch ohne Spotify abonnieren, hier gehts zum Wechselrezept: https://ulrikewuttke.wordpress.com/2026/01/27/wechselrezept-podcasts-horen-ohne-spotify/

Der Podcast wird von mir, Ulrike Wuttke, im Rahmen meiner Transferprofessur an der FH Potsdam mit dem Projekt T.R.A.C.K.S. “Training on Analytics, Compliance, Knowledge, and Security” produziert.

[Link] zur Folge vom 01. Februar 2026.

[Link] zur Episodenübersichtsseite des Podcasts auf Podcasts-Homes.

[Link] zum RSS-Feed

Mit freundlichen Grüßen und viel Spaß beim Reinhören!

Ulrike Wuttke

 

 

Prof. Dr. Ulrike Wuttke

Bibliothekswissenschaft – Strategien, Serviceentwicklung und Wissenschaftskommunikation  | Library Science – Strategies, Service Development and Scholarly Communication

E-Mail: ulrike.wuttke@fh-potsdam.de | Phone: +49 331 580-4533

Mastodon: @uwuttke@fedihum.org | ORCiD: 0000-0002-8217-4025

FH Potsdam | University of Applied Sciences Potsdam
Fachbereich Informationswissenschaften | Department of Information Sciences
Kiepenheuerallee 5 | 14469 Potsdam
http://www.fh-potsdam.de/ | https://ulrikewuttke.wordpress.com/

Virtuelles DH-Kolloquium an der BBAW, 26.01.2026: „Vertrauen in Daten und Code: Software-Engineering Praktiken zwischen Refactoring, Feature-Wünschen und Publikationsdruck“

2026年1月15日 17:22

Im Rahmen des DH-Kolloquiums an der BBAW laden wir Sie herzlich zum nächsten Termin am Montag, den 26. Januar 2026, 16 Uhr c.t., ein (virtueller Raum: https://meet.gwdg.de/b/lou-eyn-nm6-t6b):

Bastian Politycki & Alexander Häberlin (Sammlung Schweizer Rechtsquellen (SSRQ))

Die Entwicklung nachhaltiger Forschungssoftware in den Digital Humanities ist kein rein mechanisches Unterfangen, sondern ein ständiger Aushandlungsprozess zwischen technischen Anforderungen, wissenschaftlicher Arbeit und Pflege der Codebasis. Am Beispiel der „Sammlung Schweizerischer Rechtsquellen“ (SSRQ) beleuchtet dieser Vortrag die Herausforderungen, eine komplexe, historisch gewachsene Editionsinfrastruktur technisch zukunftsfähig zu halten.

Im Zentrum steht die Adaption des professionellen Research Software Engineering (RSE) für den geisteswissenschaftlichen Alltag. Methoden wie Test-Driven Development (TDD) werden nicht nur zur Validierung von Code, sondern auch zur Qualitätssicherung historischer Daten eingesetzt, womit das notwendige „Vertrauen“ in die gedruckte und digitale Edition geschaffen wird. Gleichzeitig erfordert die langfristige Wartbarkeit ein kontinuierliches Refactoring der Codebasis.

***

Die Veranstaltung findet virtuell statt; eine Anmeldung ist nicht notwendig. Zum Termin ist der virtuelle Konferenzrraum über den Link https://meet.gwdg.de/b/lou-eyn-nm6-t6b erreichbar. Wir möchten Sie bitten, bei Eintritt in den Raum Mikrofon und Kamera zu deaktivieren. Nach Beginn der Diskussion können Wortmeldungen durch das Aktivieren der Kamera signalisiert werden.

Der Fokus der Veranstaltung liegt sowohl auf praxisnahen Themen und konkreten Anwendungsbeispielen als auch auf der kritischen Reflexion digitaler geisteswissenschaftlicher Forschung. Weitere Informationen finden Sie auf der Website der BBAW.

Workshop: Digitale Editionen der Zeitgeschichte zwischen KI und Linked Open Data

2025年11月7日 20:43
Das aktuelle Bild hat keinen Alternativtext. Der Dateiname ist: KGParl_titel_L.png

Datum: 4.–5. Dezember 2025
Ort: Kommission für Geschichte des Parlamentarismus und der politischen Parteien (KGParl), Schiffbauerdamm 40, Berlin
Veranstalter: Kommission für Geschichte des Parlamentarismus und der politischen Parteien (KGParl)

Beschreibung

Am 4. und 5. Dezember 2025 findet in den Räumen der Kommission für Geschichte des Parlamentarismus und der politischen Parteien (KGParl) in Berlin der Workshop „Digitale Editionen der Zeitgeschichte zwischen KI und Linked Open Data“ statt.

Der Workshop widmet sich den aktuellen Herausforderungen und Chancen, die der Einsatz von Künstlicher Intelligenz (KI), Großen Sprachmodellen (LLMs) und Linked Open Data (LOD) für digitale Editionen historischer Quellen mit sich bringt. Im Fokus stehen insbesondere zeitgeschichtliche Materialien mit politischem, verwaltungsbezogenem und diplomatischem Charakter – etwa parlamentarische Quellen, Kabinettsakten und Verordnungen.

Ziel der Veranstaltung ist es, Potenziale und Grenzen neuer Technologien in der digitalen Editorik zu beleuchten und zu diskutieren, wie sich diese auf editorische Standards, Workflows und die wissenschaftliche Nutzung auswirken. Dabei wird die Frage in den Mittelpunkt gerückt, welche methodischen und technischen Innovationen geeignet sind, um digitale Editionen langfristig nachhaltig, interoperabel und anschlussfähig an wissenschaftliche Infrastrukturen zu gestalten.

Der Workshop bringt internationale Expertinnen und Experten aus Editionswissenschaft, Digital Humanities und Informatik zusammen, um Perspektiven für die Zukunft editorischer Arbeit im Kontext KI-gestützter Analyse und semantisch vernetzter Daten zu entwickeln.


Programm

Donnerstag, 4. Dezember 2025

13:00–13:30 Uhr – Begrüßung (KGParl): Grußworte und Einführung

13:30–14:30 Uhr – Max-Ferdinand Zeterberg (SUB Göttingen): Eine digitale Edition auf Basis von Labeled-Property-Graph

14:30–15:30 Uhr – Stephan Kurz (Österreichische Akademie der Wissenschaften, Wien): Wir fangen die Kalender ein! Datenmodellierung zum Austausch von (Protokoll-)Editionen

15:30–16:00 Uhr – Pause

16:00–17:00 Uhr – Michael Schonhardt (Technische Universität Darmstadt): „Diese Anfrage verstößt gegen die Inhaltsrichtlinien“: LLMs und RAG in der editorischen Praxis

17:00–18:00 Uhr – Daniela Schulz (Herzog August Bibliothek Wolfenbüttel): KI und die „Edition der fränkischen Herrschererlasse“ – Warum (noch) nicht!

Freitag, 5. Dezember 2025

09:00–10:00 Uhr – Hennie Brugman (KNAW Humanities Center, Amsterdam): Publication of historical parliamentary resolutions using automatic text recognition and modern web standards

10:00–11:00 Uhr – Dimitra Grigoriou (Österreichische Akademie der Wissenschaften, Wien): Overcoming Historical NER Challenges: A Case Study of the Austrian Ministerial Council Protocols

11:00–11:30 Uhr – Pause

11:30–12:30 Uhr – Monika Jantsch, Peter Land (Deutscher Bundestag): Das Dokumentations- und Informationssystem für Parlamentsmaterialien und seine API

12:30–13:30 Uhr – Maximilian Kruse (KGParl): Open by Default? Warum viele digitale Editionen nicht so offen sind, wie sie scheinen


Kontakt:
Kommission für Geschichte des Parlamentarismus und der politischen Parteien (KGParl)
E-Mail: kruse@kgparl.de, juengerkes@kgparl.de

Hinweis:
Der Workshop wird zusätzlich über Zoom übertragen. Eine digitale Teilnahme ist möglich.
Eine Anmeldung wird per E-Mail an kruse@kgparl.de erbeten.

________________

Von Texten zu Themen – ein Online Bring-Your-Own-Data-Lab zu Topic Modeling

2025年10月14日 20:16

Am 24.11.2025 lädt HERMES ein zu einem virtuellen Bring-your-own-data-Lab zum Thema „Topic Modeling“!

Mit Hilfe der Methode Topic Modeling lassen sich aus einem Korpus an Texten Themen einzelner Texte erschließen. Dies hilft, Korpora zu gruppieren, zu analysieren und zu interpretieren.

Das Lab wird aus zwei Teilen bestehen: Vormittags werden nach einer Einführung in das Thema Anwendungsbeispiele gezeigt und diskutiert. Es erwarten Sie zwei spannende Vorträge, durch die Sie Einblicke in die Arbeit mit unterschiedlichen Topic Modeling-Verfahren und Use Cases in der Forschung erhalten.

Am Nachmittag haben Sie die Möglichkeit, mit der Software Mallet Ihr eigenes Korpus zu analysieren und Topics zu generieren. Unter Aufsicht des Experten Dr. Keli Du (Universität Trier) wird Ihnen gezeigt, welche Einstellungen gewählt werden sollten und wie die Ergebnisse interpretiert werden können.

Vorgesehen ist, dass Teilnehmende eigene Forschungsdaten mitbringen. Diese sollten im txt-Format vorliegen. Falls dies nicht möglich ist, können wir Ihnen aber auch gerne ein Beispielkorpus zur Verfügung stellen. Gerne können Sie uns auch schreiben, sollten Sie Hilfe bei der Umwandlung Ihrer Daten benötigen.

Die Veranstaltung findet online über Zoom statt. Eine Anmeldung ist für beide Teile getrennt möglich.

Anmeldeschluss ist der 20.11.2025. Für die Anmeldung nutzen Sie bitte folgendes Formular: https://nocodb.nfdi4culture.de/dashboard/#/nc/form/d02dce5e-2770-40ae-b2e0-564bee591736

Bei Fragen melden Sie sich gerne bei konstanciak@uni-trier.de

Weitere Informationen finden Sie auf https://hermes-hub.de/aktuelles/events/byodl-2025-11-24.html

Virtuelles DH-Kolloquium an der BBAW, 27.10.2025: „Vom Gelehrten zum Problem – Maschinelle Datierung von Leibniz-Handschriften: Die Anwendung von Deep-Learning-Verfahren zur Unterstützung der historisch-kritischen Editionsarbeit“

2025年10月13日 21:28

Im Rahmen des DH-Kolloquiums an der BBAW laden wir Sie herzlich zum nächsten Termin am Montag, den 27. Oktober 2025, 16 Uhr c.t., ein (virtueller Raum: https://meet.gwdg.de/b/lou-eyn-nm6-t6b):

Tim Westphal (BBAW, TELOTA), Marco Santi (BBAW), Mario Tormo Romero (Hasso-Plattner-Institut, Potsdam)

Seit Beginn der Arbeit an einer historisch-kritischen Edition Gottfried Wilhelm Leibniz im Jahr 1901 bildet die Datierung des umfangreichen handschriftlichen Nachlasses eine große editorische Hürde. Rund 100.000 Blätter aus der Hand des letzten Universalgelehrten dokumentieren eine über fünf Jahrzehnte reichende intellektuelle Entwicklung, wobei einem Großteil der Schriftstücke eine zeitgenössische Datierung fehlt. Traditionelle Methoden der Datierung sind für einen Korpus dieser Dimension unzureichend: Die manuelle Bestimmung durch Expertinnen ist angesichts der Materialmenge praktisch nicht zu bewältigen, und auch die Wasserzeichenanalyse erlaubt nur grobe Annäherungen im Bereich von Jahrzehnten.

Der Beitrag erprobt, inwieweit bildgestützte Deep-Learning-Modelle diese Lücke schließen können und ob diese dabei eine editorisch nutzbare Genauigkeit erreichen. Wünschenswert ist eine maximale Abweichung von ±1 Jahr. Im Mittelpunkt steht die Frage, ob Deep-Learning-Modelle die feinen intra-personalen Schreibdrifts eines einzelnen Autors über fast fünf Jahrzehnte abbilden können. Anders als bestehende Arbeiten, die meist das Alter verschiedener Schreiber klassifizieren, zielt der Ansatz auf die Detektion des schreibereigenen Stilwandels innerhalb Leibniz‘ Werk. Der weitläufige Nachlass von Leibniz bietet hierfür eine geeignete Grundlage.

Es wird bewusst auf Transkription oder OCR verzichtet, so werden die besonderen Herausforderungen von Leibniz‘ Schriftbild (Überarbeitungen, Streichungen, wechselnde Sprachen) umgangen. Um sicherzustellen, dass die Modelle schriftbezogene und nicht materialbedingte Merkmale lernen, werden verschiedene Normalisierungsschritte durchgeführt: Zeilenweise Segmentierung und Binarisierung eliminieren Papierstruktur und Tintenintensität als Faktoren.

Als Datenbasis dienen ca. 600 Seiten aus dem Zeitraum 1669-1716: 400 datierte Briefe sowie 200 Seiten wissenschaftlicher Ausarbeitungen. Das Material wurde so gewählt, dass für jedes Jahr Vorlagen verfügbar sind. Es werden verschiedene Deep-Learning-Architekturen entwickelt und evaluiert, die relevante Merkmale direkt aus den Bilddaten lernen. Anders als klassische Ansätze der digitalen Paläographie mit manueller Merkmalsextraktion wird auf ein Ende-zu-Ende-Lernverfahren gesetzt. Ziel des Projekts ist die Entwicklung von Ansätzen zur hochauflösenden Datierung frühneuzeitlicher Gelehrtenhandschriften für den Einsatz in der alltäglichen editorischen Praxis. Die entwickelte modulare Pipeline ermöglicht flexibel konfigurierbare Experimente und legt besonderen Wert auf Visualisierung und Erklärbarkeit der Ergebnisse.

Das Projekt positioniert sich an der Schnittstelle von Digital Humanities und Computer Vision und zeigt, wie klassisches maschinelles Lernen die traditionelle editorische Arbeit ergänzen kann. Es entsteht in Kooperation zwischen der Leibniz-Arbeitsstelle der BBAW, dem DH-Referat TELOTA und dem KI-Servicezentrum des Hasso-Plattner-Instituts in Potsdam.

 

***

Die Veranstaltung findet virtuell statt; eine Anmeldung ist nicht notwendig. Zum Termin ist der virtuelle Konferenzrraum über den Link https://meet.gwdg.de/b/lou-eyn-nm6-t6b erreichbar. Wir möchten Sie bitten, bei Eintritt in den Raum Mikrofon und Kamera zu deaktivieren. Nach Beginn der Diskussion können Wortmeldungen durch das Aktivieren der Kamera signalisiert werden.

Der Fokus der Veranstaltung liegt sowohl auf praxisnahen Themen und konkreten Anwendungsbeispielen als auch auf der kritischen Reflexion digitaler geisteswissenschaftlicher Forschung. Weitere Informationen finden Sie auf der Website der BBAW.

Ringvorlesung „Digital Humanities im Fokus“

2025年10月7日 18:19

Im Wintersemester 2025/2026 laden der Rostocker Arbeitskreis Digital Humanities (RosDH) und die Juniorprofessur Digital Humanities zum sechsten Mal zur Ringvorlesung „Digital Humanities im Fokus: Methoden, Anwendungen und Perspektiven“ ein.

Interessierte aus allen Fachgebieten sind herzlich eingeladen, sowohl in Präsenz als auch online an der Veranstaltung teilzunehmen. Eine vorherige Anmeldung für die einzelnen Termine ist nicht erforderlich.

Programm für das Wintersemester 2025/2026

20.10.2025
Jun.-Prof. Dr. Rabea Kleymann (Universität Chemnitz)
Theoriearbeit in den Digital Humanities: Begriffe, Methoden, Kritik

27.10.2025
Dr. Sarah Lang (Max-Planck-Institut für Wissenschaftsgeschichte)
Making the Digital Humanities More Diverse and Inclusive: Theories and Practices

03.11.2025
Jun.-Prof. Dr. Anastasia Glawion (Friedrich-Alexander-Universität Erlangen-Nürnberg)
Netzwerkbasierte Zugänge zu postpandemischen Harry-Potter-Interpretationen auf Fanfiktion.de

10.11.2025
Jun.-Prof. Dr. Dennis Ried (Martin-Luther-Universität Halle-Wittenberg)
Mit wenig viel erreichen: Kreative Infrastruktur-Lösungen für große und kleine DH-Projekte

17.11.2025
Veronica Wassermayr (Universität Trier)
Moselwein, LLMs und LOD – Kulturerbe mit KI analysieren

24.11.2025
Dr. Elias Zimmermann (Universität Zürich / Universität Genf)
Ambivalenzen Edieren. Mediale und postkoloniale Herausforderungen in der digitalen Edition Annemarie Schwarzenbach

01.12.2025
Deborah Ehlers (Universität zu Lübeck)
Unsicherheit als Erkenntnisquelle: Virtuelle Rekonstruktionen historischer Ausstellungen

08.12.2025
Prof. Dr. Aline Deicke (Philipps-Universität Marburg)
Disiecta Membra als disiecta data? Herausforderungen in einem archäologischen Langzeitvorhaben

15.12.2025
Dr. Dîlan Canan Çakir und Viktor J. Illmer (beide Freie Universität Berlin)
Metadaten lesbar machen: Genre, Inferenzstatistik und Replizierbarkeit in der Digitalen Einakter-Datenbank

12.01.2026
Sebastian Flick und Peter Dängeli (beide Universität Bern)
Kein Backend, kein Problem! Wie bringen wir Inhalte lange ins Netz?

19.01.2026
Laura Vawter (Universität Rostock)
Authority, Hierarchies and Games. An overview of multilingual language practices in Final Fantasy, Minecraft and PUBG in Twitch and live gaming scenarios

Veranstaltungszeit
Immer montags an den ausgewiesenen Terminen, jeweils von 17:15 bis 18:45 Uhr.

Kontakt
Bei Fragen zur Ringvorlesung wenden Sie sich gerne an das Team der DH-Juniorprofessur unter: phf.dh@uni-rostock.de.

Weitere Informationen finden Sie fortlaufend aktualisiert auf den Seiten des RosDH unter: https://www.germanistik.uni-rostock.de/forschung/digital-humanities/rosdh/ringvorlesung/2025-26/.

Organisation: Ulrike Henny-Krahmer und Erik Renz.

Virtuelles DH-Kolloquium an der BBAW, 29.09.2025: „Exploring Social Interactions in Letters through Social Network Analysis: The Zenon Archive as a Use Case“

2025年9月12日 21:39

Im Rahmen des DH-Kolloquiums an der BBAW laden wir Sie herzlich zum nächsten Termin am Montag, den 29. September 2025, 16 Uhr c.t., ein (virtueller Raum: https://meet.gwdg.de/b/lou-eyn-nm6-t6b):

Fernanda Alvares Freire (BBAW, TELOTA)

This presentation explores how Social Network Analysis (SNA) can be applied to study social interactions as represented in historical letter corpora. By combining qualitative text analysis with Social Network Analysis (SNA), the approach models and visualizes interpersonal relations to investigate patterns of interaction, the roles of key actors, and the structure of historical communities. As one of the largest collections from the Hellenistic period, the letters and documents of the Zenon archive provide rich information about administrative, economic, and personal networks and serve as an exemplary use case to the approach. Applying SNA to this corpus highlights the potential and challenges of working with large corpora of written communication and serves as an example of how this framework can be extended to other epistolary datasets.

***

Die Veranstaltung findet virtuell statt; eine Anmeldung ist nicht notwendig. Zum Termin ist der virtuelle Konferenzrraum über den Link https://meet.gwdg.de/b/lou-eyn-nm6-t6b erreichbar. Wir möchten Sie bitten, bei Eintritt in den Raum Mikrofon und Kamera zu deaktivieren. Nach Beginn der Diskussion können Wortmeldungen durch das Aktivieren der Kamera signalisiert werden.

Der Fokus der Veranstaltung liegt sowohl auf praxisnahen Themen und konkreten Anwendungsbeispielen als auch auf der kritischen Reflexion digitaler geisteswissenschaftlicher Forschung. Weitere Informationen finden Sie auf der Website der BBAW.


❌