Datenverarbeitung und -analyse sind entscheidende Vorgänge in der datengetriebenen geisteswissenschaftlichen Forschung und somit ein wesentlicher Bestandteil des Lebenszyklus von Forschungsdaten in vielen Projekten. Diese Tätigkeiten umfassen ein breites Spektrum an Aufgaben, von der Verarbeitung natürlicher Sprache (NLP) über die Konvertierung von Datensätzen zwischen Formaten bis hin zur Erstellung automatisierter, wiederverwendbarer Pipelines für die Datenanreicherung.

Angesichts der besonderen Beschaffenheit geisteswissenschaftlicher Daten ist es notwendig, die automatisierte Verarbeitung mit manueller Überprüfung und Kuratierung in hybriden Arbeitsabläufen zu kombinieren. Dieser Ansatz erfordert robustes Datenmanagement, um die Datenintegrität zu wahren und eine exakte Zuordnung der menschlichen Arbeit zu gewährleisten. Dies ist besonders wichtig, da künstliche Intelligenz (KI) zunehmend in der Datenanalyse eingesetzt wird und leistungsstarke Techniken zur Verarbeitung, Interpretation und Anreicherung großer Datenmengen bietet. Während Algorithmen des maschinellen Lernens die Identifizierung von Mustern und Beziehungen innerhalb von Daten unterstützen können und ein großes Potenzial haben, neue Erkenntnisse zu generieren, die durch traditionelle Analysemethoden möglicherweise nicht ersichtlich sind, greift ein ausschließlich statistischer Ansatz angesichts der Komplexität von Digital Humanities- und Cultural Heritage-Daten zu kurz. Im Sinne der Grundsätze von Open Science bemühen wir uns daher um Transparenz und Reproduzierbarkeit der angewandten Verfahren.

Die Datenverarbeitung muss mit der Webentwicklung und -visualisierung Hand in Hand gehen. Die Schaffung benutzerfreundlicher Schnittstellen und Plattformen, die es Forschenden ermöglichen, mit ihren Daten zu interagieren und sie effektiv zu bearbeiten, ist eine entscheidende Voraussetzung, insbesondere für hybride Arbeitsabläufe. Reichhaltige interaktive Visualisierungstechniken helfen nicht nur dabei, verborgene Muster und Trends in den gesammelten Daten aufzudecken, sondern erleichtern auch eine effektivere Kommunikation der Forschungsergebnisse an ein breiteres Publikum. In der geisteswissenschaftlichen Forschung können Visualisierungen abstrakte Konzepte greifbar machen und den Wissenschaftler:innen helfen, ihre Argumente zu veranschaulichen und ihre Daten auf intuitivere Weise zu nutzen.

 

ADD – Astronomische Tagebücher Digital

ADD – Astronomische Tagebücher Digital

Astronomical Diaries Digital (ADD) ist ein Kooperationsprojekt mit der Universität Wien, das spätbabylonische Beobachtungsaufzeichnungen als digitale Edition verfügbar macht und diese mithilfe digitaler Werkzeuge analysiert.

Bestiarium Mesopotamicum – Tieromina im alten Mesopotamien

Bestiarium Mesopotamicum – Tieromina im alten Mesopotamien

Bestiarium Mesopotamicum ist ein vom FWF gefördertes Projekt an der Universität Wien, das altmesopotamische Tieromina auf Keilschrifttafeln mithilfe digitaler Werkzeuge ediert und analysiert.

ChIA – Zugang zu und Analyse von kulturellen Bildern

ChIA – Zugang zu und Analyse von kulturellen Bildern

ChIA zielt darauf ab, neue Technologien vor dem Hintergrund eines ausgewählten Datensatzes von Lebensmittelbildern einzusetzen und zu testen, um den Zugang zu kulturellen Daten zu erleichtern und diese zu analysieren.

Digitarium I

Digitarium I

UNIT-ÜBERGREIFENDE KOOPERATION Durch die Kombination von Texttechnologie und Benutzereinbindung schafft dieses Projekt eine digitale Umgebung zur Erkundung der historischen Zeitung Wien[n]erisches Diarium.

DYLEN – Diachrone Dynamik Lexikalischer Netzwerke

DYLEN – Diachrone Dynamik Lexikalischer Netzwerke

Durch die Kombination von Linguistik, DH und Informatik untersucht das Projekt die diachrone Dynamik lexikalischer Netzwerke auf der Grundlage umfangreicher Korpora.

DYSEN – Dynamische Sentimentanalysen

DYSEN – Dynamische Sentimentanalysen

In diesem Projekt wird ein Tool entwickelt, um die Veränderung der emotionalen Polarisierung von Politikern in österreichischen Zeitungen zu erkennen.