Das ZB-Lab ist ein interdisziplinäres Team aus Data Librarians, Softwareentwickelnden und Machine Learning Engineers. Wir sind in der Abteilung Innovation angesiedelt und arbeiten eng mit der Bibliotheksinformatik der ZB zusammen. Um das Potenzial neuer Datenanwendungen – insbesondere den Einsatz von Künstlicher Intelligenz – auszuloten, sind wir im Austausch mit Forschenden und führen gemeinsame Projekte mit Partnerinstitutionen durch.

Im ZB-Lab verfolgen wir das Ziel, die Sichtbarkeit und Zugänglichkeit der digitalen Sammlungsdaten der ZB zu verbessern. Wir möchten erreichen, dass Forschende die Metadaten und Digitalisate unserer Quellen noch intensiver nutzen. Dafür experimentieren wir mit unseren Daten, bauen Prototypen und entwickeln neue Services. Wir unterstützen Forschende darin, relevante Daten zu finden, Datenkorpora zusammenzustellen und Daten in geeignete Formate zu überführen.

Für die Datenbearbeitung setzen wir Machine Learning-Verfahren ein. Besonders im Fokus haben wir dabei, die Ergebnisse genau zu überprüfen und die Qualität zu sichern. Wir arbeiten offen, engagieren uns aktiv für Open Science und teilen unsere Daten und Lösungswege auf GitLab.


Aktuelles

GLAMhack 2026

Auch dieses Jahr nimmt das ZB-Lab am GLAMhack teil, der am 13./14. November an der Stiftung für Kunst, Kultur und Geschichte in Winterthur stattfinden wird. Auch wenn die Reise nach Winterthur nicht sehr lange ausfällt, sind wir bereits am Kofferpacken. Denn wir wollen ein Datenset aus der Graphischen Sammlung mitbringen, das zeigt, wie die Welt im Zürcher Photochrom Verlag repräsentiert wurde.

Dem Zürcher Nachtschreiber mit KI auf der Spur

Was verraten alte Gästelisten über das Zürich des 18. Jahrhunderts? Das ZB-Lab hat die sogenannten Nachtzedel mit KI erschlossen und tausende Gäste-Einträge strukturiert ausgelesen. Nun ist diese faszinierende Quelle erstmals systematisch auswertbar und gewährt Einblick in die Reisebewegungen, Berufe und sozialen Netzwerke der Stadt um 1800.

Kontaktieren Sie uns!

Um Nutzende aktiv in unsere Entwicklungen einzubeziehen und ihre Bedürfnisse sowie ihr Feedback besser zu verstehen, suchen wir den direkten Austausch. Sind Sie in den Digital Humanities oder den Geisteswissenschaften tätig? Dann bringen Sie Ihre Perspektive ein und gestalten Sie unsere Entwicklungen mit. Gleichzeitig unterstützen wir Sie gerne bei Ihren digitalen Forschungsanliegen.

Projekte

Swiss Google Books for Research – Genre-Labels für die thematische Suche nach historischen Werken

Im Rahmen des Projekts «Swiss Google Books for Research» wurden über 450'000 Bände aus den Beständen der Zentralbibliothek Zürich, der Universitätsbibliotheken Basel und Bern sowie der Zentral- und Hochschulbibliothek Luzern digitalisiert und sind nun zusammen mit weiteren Werken im neuen Rechercheportal Books as Data einsehbar.

Da viele der historischen Bände nur spärlich mit Metadaten wie Titel, Autor und Erscheinungsjahr versehen sind, gestaltet sich die Suche nach bestimmten Themenbereichen schwierig. Wie lässt sich unter diesen Umständen gezielt nach Biografien oder nach Kinderbüchern suchen?

Um die Auffindbarkeit der über 750'000 Werke auf Books as Data zu verbessern, hat das ZB-Lab in einem Kooperationsprojekt mit der UB Basel eine Genre-Suche entwickelt. Dazu trainierte das ZB-Lab ein eigenes KI-Modell, das die historischen Schweizer Drucke automatisiert einem von 19 vorgegebenen Genres zuordnete. Nun können die Nutzenden gezielt nach Genres wie Wörterbüchern, Hochschulschriften, Bildbänden oder Nachrufen auf historische Persönlichkeiten suchen.  

Wie wir diese automatische Genre-Zuordnung bewerkstelligt haben, lesen Sie in unserem ZBlog-Beitrag.

Zürcher Adressbücher – Daten mit KI strukturieren

Wer wohnte früher mal in meinem Haus? Wie sah die Strasse, in der ich wohne, vor 100 Jahren aus? Welche Geschäfte und Institutionen gab es damals? Wie hat sich die Stadt seither verändert? Solche Fragen lassen sich tatsächlich beantworten: Die Zürcher Adressbücher der Jahre 1875 bis 1998 liefern die Antworten auf genau diese Fragen. Sie sind im Bestand der ZB erhalten und auf der Zurich Open Platform (ZOP) für alle einsehbar.  

Um diesen historischen Schatz, der Privatpersonen und Forschende gleichermassen interessiert, endlich zu heben, ging das ZB-Lab eine Partnerschaft mit dem SNF-Projekt «Multigenerational Social Mobility in Switzerland, 1500 – 2000» ein, das am Soziologischen Institut der Universität Zürich angesiedelt ist. Ziel der Kooperation ist es, bis Ende 2026 die historischen Adressdaten aus den gescannten Bilddateien zu extrahieren und in eine gut durchsuchbare und auswertbare Datenbank zu überführen, die der Öffentlichkeit und der Forschung zugänglich gemacht werden soll.

KI-unterstützte Erschliessungsprozesse – Musiknachlässe und Zürcher Bibliografie

Das ZB-Lab kooperiert nicht nur mit externen Partnern, sondern unterstützt auch intern andere Abteilungen der ZB bei der maschinellen Datenverarbeitung mithilfe von KI.

So unterstützt das ZB-Lab die Musikabteilung dabei, die in PDFs publizierten Nachlassverzeichnisse in die Archivdatenbank CMI zu überführen. Dies hat für Nutzende den Vorteil, dass sie nun bequem im Katalog nach den Kompositionen und Werken verstorbener Musiker*innen suchen können, anstatt sich wie zuvor mühsam durch PDF-Dateien zu kämpfen und jeden Eintrag einzeln lesen zu müssen.

In einem ähnlichen Projekt unterstützt das ZB-Lab die Turicensia-Abteilung dabei, die in PDF-Form publizierten Zürcher Bibliografien (ZüBi) in den Bibliothekskatalog aufzunehmen und einem Themenbereich zuzuordnen. So lassen sich in Zürich erschienene Publikationen künftig einfacher und schneller auffinden.  

Zürcher Nachtzedel – historische Gästelisten der Stadt Zürich

Im Schein seiner Öllampe zog der Nachtschreiber von Herberge zu Herberge, erfragte Namen, Herkunftsorte und Berufe der Gäste und hinterliess damit eine einzigartige Momentaufnahme des frühneuzeitlichen Zürichs. Die sogenannten Nachtzedel aus unserem Handschriftenbestand (Signatur LKR 7, verfügbar auf e-manuscripta) sind kleine historische Schatzkästchen, aus denen man heute vieles über Mobilität, Handel und die sozialen Netzwerke des 18. Jahrhunderts erfahren kann.

Nun hat das ZB-Lab diese faszinierende Quelle mithilfe grosser Sprachmodelle erschlossen und tausende von Gäste-Einträgen extrahiert, strukturiert und analysierbar gemacht. Das so entstandene Datenset erlaubt es erstmals, die Nachtzedel gezielt zu durchsuchen und systematisch zu analysieren, um neue Erkenntnisse über Reisebewegungen, Berufe und sozialen Verflechtungen im Zürich des ausgehenden 18. Jahrhunderts zu gewinnen.

Wie wir bei der KI-gestützten Datenaufbereitung vorgegangen sind, lesen Sie in unserem ZBlog-Beitrag. Das strukturierte Datenset steht auf Zenodo zur Nachnutzung bereit. Unser interaktives Dashboard gewährt zudem erste explorative Einblicke in diese einzigartige Datenquelle.

ZBot – ein KI-Chatbot für die Zentralbibliothek Zürich

Im Jahr 2024 entwickelte das ZB-Lab einen Chatbot-Prototyp, der Fragen zur ZB beantworten kann. Das Experiment zielte darauf ab, das Potenzial von KI im Bibliotheksalltag zu erkunden und zu erproben, wie verlässlich, transparent und nachvollziehbar die Antworten eines solchen Systems sind.

Der Prototyp kombinierte eine Wissensbasis aus Webseiten-Texten der ZB mit grossen Sprachmodellen. Diese nutzten die Wissensbasis, um kontextbasierte Antworten auf User-Anfragen zu liefern. Um Transparenz und Nachvollziehbarkeit zu gewährleisten, konnten sich die Nutzenden die Textstellen anzeigen lassen, auf denen die Antworten des Chatbots basierten.

Das Projekt lieferte wertvolle Einblicke in die Möglichkeiten und Grenzen KI-gestützter Chatbots. Auch wenn der Prototyp nicht weiterverfolgt wird, schafft das Experiment eine fundierte Grundlage für zukünftige Anwendungen und zeigt, wie Bibliotheken neue Technologien reflektiert und verantwortungsvoll erproben können. Mehr über das Experiment erfahren Sie im ZB-Jahresbericht 2024.

swisscollections Download – der einfache Datenbezug für Forschende

Immer wieder stellten wir fest, dass sich Forschende Bibliotheksdaten mühsam über sogenannte Web-Scraping-Skripte beschaffen. Das ist nicht nur umständlich und ineffizient, es wirkt sich auch oft negativ auf die Datenqualität aus. Gleichzeitig war uns bewusst, dass wir unsere Daten auf vielen verschiedenen Plattformen publizieren. Deshalb wollten wir einen zentralen Ort schaffen, an dem sich Forschende dank guter Metadaten gezielt bedienen und so einfach zu den wesentlichen Dokumenten finden können. Nach einem internen Prototyp – wir nannten ihn bezeichnenderweise «OneAPI» – konnten wir in Zusammenarbeit mit dem Verein swisscollections einen Datenexport direkt im gleichnamigen Metakatalog entwickeln, der die Bestände aus 14 Bibliotheken und Archiven vereint.

So lässt sich im swisscollections-Katalog nicht nur suchen: Die Trefferliste kann gleich in verschiedenen Formaten exportiert werden – nicht nur als Metadaten, sondern auch mit den Links zu den zugehörigen digitalisierten Beständen. Über ein zusätzliches Tool lassen sich zudem Bilder, Volltexte und PDFs direkt auf die Festplatte herunterladen.

  • Wie funktioniert es? In diesem Video zeigen wir es Ihnen.
  • Was bringt das für Forschende? Auf diese Perspektive gehen wir im ZB-Jahresbericht 2024 ein.
  • Wie haben wir das gemacht? Über das Making of berichten wir in unserem ZBlog-Beitrag.

ZB-detektIIIF und ZB-Viewer – Digitalisate sammeln, speichern und teilen

Mit Hilfe des International Image Interoperability Framework (IIIF) können Forschende weltweit Digitalisate sammeln und in unserem ZB-Viewer (Mirador Viewer) zusammenführen. Mit dem Browser-Plugin ZB-detektIIIF erkennen Sie automatisch IIIF-konforme Digitalisate und sammeln sie per Klick als IIIF-Collection ein. In unserer Beta-Version können Sie solche Collections zudem dauerhaft, adressierbar und zitierbar auf GitHub speichern (Login via GitHub-Octocat).

Zusätzlich können Sie beliebig viele Digitalisate von e-manuscripta und e-rara direkt im ZB-Viewer nebeneinander öffnen, vergleichen und analysieren – über den Button "Mirador Viewer" in der Titelansicht eines Werks unter "IIIF".

  • So funktioniert das Sammeln von Quellen mit DetektIIIF.
  • Hier finden Sie den ZB-Viewer (Mirador-Viewer).
  • Die erweiterten Funktionen im Beta-Viewer, wo man die eigene IIIF-Collection auf GitHub speichern kann.

Veranstaltungen

Alle aktuellen Veranstaltungen des ZB-Labs finden Sie in unserem Veranstaltungskalender.

Wollen Sie künftig keine Veranstaltungen mehr verpassen? – Bleiben Sie auf dem Laufenden und abonnieren Sie unseren ZB-Newsletter!

Summer School 2026: Longue Durée digital

Wie lassen sich kulturelle Phänomene und Diskurse über grosse Zeiträume hinweg erforschen? Zwischen der Forschungsfrage und dem dafür nötigen Textkorpus stehen oft methodische und praktische Hürden – genau hier setzte unsere Summer School im Juni 2026 an. Sie führte durch den ganzen Workflow hindurch, von der Erschliessung und Exploration des Datenkorpus bis zur Annotation relevanter Textstellen. Die Gastvorträge von Sophie Mützel und Lukas Posselt vertieften die Themen an den Abenden. Die Folien und Colab-Notebooks stehen auf GitLab zur Verfügung.


Vortrag: Von Büchern zu Bytes

Das Thema unserer Summer School 2025 stiess auf so grosses Interesse, dass wir von der Vortragsreihe «Von Büchern zu Bytes» des Konsortiums NFDI4Memory eingeladen wurden, unsere Erfahrungen einem breiteren Publikum vorzustellen. Am 23. Januar 2026 gab Sarah Kiener, Softwareentwicklerin und Machine-Learning-Expertin des ZB-Labs, in einem Online-Workshop Einblicke in die Vorgehensweise bei der Verarbeitung historischer Quellen mit grossen Sprachmodellen. Der Workshop «Vom Digitalisat zu strukturierten Daten» war mit 124 Teilnehmenden ausserordentlich gut besucht.

Workshop: Metadaten in den «Humanities»

Seit einigen Jahren stellen Bibliotheken, Archive und Museen die Metadaten ihrer Bestände für Forschende zur Verfügung: Damit werden Bibliothekskataloge, Archivdatenbanken, Findbücher oder Briefregister selbst zu Gegenständen der Forschung. Welche Herausforderungen ergeben sich dabei für Institutionen und Forschende? Und welche Modelle und Ansätze haben sich in der Praxis bewährt? Der Workshop gibt Antworten auf diese Fragen.



Summer School 2025: Von der Quelle zum Datensatz

Vom 2. bis 3. September 2025 zeigten wir digital affinen Historiker*innen und Geisteswissenschaftler*innen, wie sich serielle Quellen wie Karteikarten, Register oder Listen mit GPT in strukturierte Datensätze überführen lassen – von der Promptentwicklung über die Verarbeitung per Python-API bis zur Qualitätssicherung mit OpenRefine. Als Übungsgrundlage diente unser eigener Nachtzedel-Datensatz. Zwei öffentliche Abendvorträge und eine Podiumsdiskussion rundeten die ausgebuchte Summer School ab. Die meisten Kursmodule wurden aufgezeichnet.


GLAMhack 2024

Wie schafft man eine gute Datengrundlage für ausgefeilte historische Analysen? Mit dieser Frage reisten Kolleg*innen aus dem ZB-Lab und der UB Zürich an die GLAMhack-Jubiläumsausgabe nach Luzern. Mit im Gepäck hatten sie zwei Datensets: die "Nachtzedel", Gästelisten der Zürcher Unterkünfte von 1780 bis 1818, und das "Promptuarium genealogicum", sieben Bände genealogischer Aufstellungen zu Zürcher Familien vor 1825. Zwei Teams entwickelten mit viel Enthusiasmus Tabellen, Graphen und Visualisierungen, eine inspirierende Erfahrung, sowohl in Bezug auf die Resultate wie auch die Arbeitsform.

Lernressourcen

Digitale Aufbereitung historischer Quellen mit GPT

Die im Rahmen der Summer School 2025 «Von der Quelle zum Datensatz» entstandenen Inhalte haben wir als e-Learning-Einheit aufbereitet und via YouTube zugänglich gemacht. Interessierte können einzelne Teile oder den ganzen Kurs durcharbeiten.

Sie finden hier eine gut verständliche Einführung in die Funktionsweise von Sprachmodellen sowie verschiedene Strategien zum Verfassen von Prompts. Ein zentrales Anliegen ist zudem die Evaluation und Qualitätsüberprüfung des Outputs, die insbesondere dann unerlässlich sind, wenn mit den entstandenen Daten anschliessend weitergeforscht wird.

IIIF erklärt

Um den Einstieg ins Arbeiten mit International Image Interoperability Framework (IIIF) zu erleichtern, haben wir in unserem allerersten ZB-Lab Vorhaben im Winter 2020/21 eine Reihe von Video-Tutorials erstellt. Sie reichen von IIIF-Grundfunktionen über die plattformübergreifende Suche nach Digitalisaten bis hin zu Wissensgrundlagen für das Erstellen eigener IIIF-Manifeste. Die Tutorials richten sich zuvorderst an Forschende der Geisteswissenschaften, die mit Digitalisaten arbeiten.