Der 7. Berliner Archivtag stand unter dem Titel „KI im Archiv: Chance oder Risiko?“ und fand am 20. November 2024 im Tagungszentrum Franz-Mehring-Platz 1 statt. Das Thema stieß auf große Resonanz und etwa 300 Leute fanden sich ein. Es gab sogar eine Videoübertragung in einen Nebenraum. Das zeigt vor allem, dass das Thema für viele von großem Interesse ist, aber vermutlich auch, dass viele sich auch etwas überfordert fühlen und durch Weiterbildung die Kontrolle zurückerlangen möchten.
Begrüßung und Eröffnung
Nach der Begrüßung durch Dr. Torsten Musial, den Vorsitzenden des VdA-Landesverbands Berlin, richtete Peer Mock-Stürmer, der Vorsitzende des Kulturausschusses im Berliner Abgeordnetenhaus, ein Grußwort an die anwesenden Archivarinnen und Archivare. Beide betonten die zentrale Rolle der Archive in der digitalen Gesellschaft und die Herausforderungen und Chancen, die der technologische Wandel mit sich bringt.
Der Eröffnungsvortrag von Matteo Valleriani, Honorarprofessor an der TU Berlin und Forschungsgruppenleiter am Max-Planck-Institut für Wissenschaftsgeschichte, bot spannende Einblicke in die praktische Anwendung von KI in der Praxis. Valleriani schilderte, wie selbstentwickelte Modelle genutzt werden, um frühneuzeitliche Quellen zu erschließen und miteinander zu verknüpfen. Die Ergebnisse zeigen, dass KI nicht nur Zeit spart, sondern auch neue Erkenntnisse ermöglicht, die ohne den Einsatz solcher Technologien kaum erreichbar wären. Sehr von Interesse war seine klare Fokussierung auf Explainable Artificial Intelligence (XAI), womit für mich auch herausgestellt werden konnte, dass ein vergleichbarer Ansatz von kleinen aber nachvollziehbaren Programmteilen im Archiv die einzig vertretbare Lösung ist, um sich in Zukunft bei Routineaufgaben unterstützen zu lassen, etwa bei einer intelligenten automatisierten Laufzeitermittlung.

Vormittag: Rechtliche und ethische Perspektiven
Im ersten Panel wurden die rechtlichen und ethischen Fragestellungen rund um den Einsatz von Künstlicher Intelligenz in Archiven umfassend beleuchtet. Paul Klimpel von iRIGHTS gab einen Überblick über verschiedene juristische Aspekte, die mit der Nutzung von KI einhergehen. Besonders ging er auf das Urheberrecht ein, insbesondere auf die Rechtsfragen, die beim Training von KI-Modellen auftreten. Darüber hinaus thematisierte er auch datenschutzrechtliche Herausforderungen, die Transparenzanforderungen bei KI-Anwendungen sowie die Bedeutung von Datenfreiheit für die wissenschaftliche Forschung. Sein Beitrag zeigte eindrücklich, wie vielschichtig und anspruchsvoll die rechtlichen Rahmenbedingungen für den Einsatz von KI im Archivwesen sind.
Jessica Heesen von der Universität Tübingen widmete sich der ethischen Dimension des KI-Einsatzes. Sie räumte zunächst mit der aus der Science-Fiction stammenden Vorstellung einer „Superintelligenz“ auf, die schief laufe und zur Auslöschung des Menschen führe. Gleichzeitig wies sie jedoch auf die Risiken hin, die im Einsatz künstlicher Intelligenz stecken. Besonders spannend war ihr Hinweis darauf, dass gerade die Profiteure von KI häufig vor ihren Risiken warnen, um sich zugleich als Problemlöser zu inszenieren. Ihrer Ansicht nach gibt es zwei zentrale Problemfelder: Zum einen die Reproduktion unerwünschter menschlicher Muster durch KI-Systeme, die beispielsweise Vorurteile verstärken können, und zum anderen die intransparente menschliche Anmutung von KI, die zu Fehlwahrnehmungen und einem Mangel an Vertrauen führen kann. Für mich persönlich sehr gruselig ist die Möglichkeit, Verstorbene als KI-Avatar „auferstehen“ zu lassen. Ich finde das auf so vielen Ebenen falsch, dass ich lieber gar nicht davon anfange.
Beide Vorträge jedenfalls verdeutlichten, dass der Einsatz von KI im Archivwesen nicht nur technologische, sondern auch normative Fragen berührt, die gesamtgesellschaftlich beantwortet werden müssen.
Mittag: Projekte und Vorstandswahl
Die „Aktuelle Stunde“ bot kurze Gelegenheit, aktuelle Projekte vorzustellen. Jana Bertels vom Büro des Berliner Beauftragten zur Aufarbeitung der SED-Diktatur präsentierte die Ergebnisse der zweiten Teilstudie zur Archivierung und Dokumentation von Beständen mit SED/DDR-Provenienz. Es wurde deutlich, dass noch viel Handlungsbedarf besteht, was Erschließung und Bestandserhaltung anbelangt.
Nico Beyer und Felix Gericke von der Freien Universität Berlin stellten ihre Software „EMILiA“ vor, die eine effiziente Archivierung und Bewertung von E-Mails ermöglicht. Spannend war auf jeden Fall eine Auswertung, wie viele Dubletten und uninteressantes Material so ein Postfach wirklich enthält. Dass die Technik diese Massen sinnvoll reduzieren kann, ist auf jeden Fall eine gute Perspektive. Ich wünsche weiterhin viel Erfolg für die Fertigstellung der Software!

Ein weiteres Highlight war die Kandidatenrunde zur Vorstandswahl des VdA-Landesverbands Berlin. Unter der Moderation von Dirk Ullmann stellten sich die Kandidatinnen und Kandidaten verschiedenen Fragen und warben für Stimmen. Aufgrund pandemiebedingter Verzögerungen war dies die erste Vorstandswahl seit sechs Jahren, was das Ereignis besonders relevant machte.
Nachmittag: Praktische Anwendungen von KI
Das Nachmittagspanel widmete sich praxisnahen Anwendungen von Künstlicher Intelligenz im Archivwesen. Dominic Eickhoff vom LWL-Archivamt für Westfalen bot einen Überblick über die technischen Grundlagen und vielfältigen Einsatzmöglichkeiten von KI, die weit über bekannte Ansätze wie ChatGPT hinausgehen. Er stellte recht anregend die verschiedenen Bereiche dar, für die im Archiv ein Einsatz von KI in Frage kommen und zeigte aber auch auf, wo dabei Grenzen und Probleme auftreten können.

Karen Tieth und Stefan Geiser (bpk Bildagentur) stellten den Einsatz von KI bei der Bearbeitung und Erschließung von Bildbeständen vor, wobei deutlich wurde, dass KI in einigen Einsatzbereichen jetzt schon eine deutliche Hilfe darstellt, während man in anderen Bereichen weiterhin nur auf eine Weiterentwicklung der Qualität hoffen kann.
Esther Lemmerz (Bundesarchiv) zeigte, wie KI bei der Erschließung von Karteikarten eingesetzt wird. Das verdeutlichte, dass KI momentan noch einen sehr hohen Entwicklungsaufwand bedeutet. Bei leichtesten Verschiebungen der Positionen innerhalb Textvorlagen ist momentan eine sinnvolle Verarbeitung noch nicht möglich. Langfristig wird sich der Wert solcher Vorreiterprojekte sicherlich zeigen.
Alexander Wolff und Joanna Bars (Deutsches Rundfunkarchiv) berichteten von der Unterstützung durch KI bei der Erschließung von Audiodateien. Dabei konnten große Fortschritte erzielt werden, insbesondere bei Voice Activity Detection und Transkription, aber auch automatisierter Metadatenextraktion. Sie sprachen darüber hinaus über die Nutzung bei ihren Videobeständen. Dabei wurde deutlich, dass es noch nicht praktikabel ist, wenn KI-Funktionen nicht in die Software eingebunden sind, die eine Institution verwendet.
Abschlussdiskussion
Die abschließende Podiumsdiskussion bot den Teilnehmenden die Möglichkeit, ihre Fragen zu Chancen und Risiken von KI direkt an die Experten zu richten. Moderiert wurde die Diskussion von Matthias Buchholz und Rebecca Hernandez-Garcia. Die Diskussion unterstrich, dass der Einsatz von KI im Archivwesen enorme Potenziale birgt, aber auch klare Rahmenbedingungen, insbesondere im Bereich Datenschutz und Transparenz, erfordert.
Auch wurde klar, dass viele Archive noch viel eher mit den Herausforderungen der Digitalisierung an sich beschäftigt sind. An vielen Stellen werden großartige Neuerungen im Bereich KI wohl durch die Hersteller der üblichen Softwareprogramme erfolgen (müssen).
Text: Felix Ulrich

