Das Projekt "IIX - Index und Inventur von Textkorpora" hat zum Ziel, die Texte des “AAC – Austrian Academy Corpus” wieder in eine durchsuchbare Form zu bringen. In einem ersten Schritt werden die Texte für Korpusabfragen im Programm der NoSketch Engine aufbereitet und intern zugänglich gemacht. 

Ein Korpuszugang ist vorerst nur zum internen Gebrauch innerhalb der Abteilung Literaturwissenschaft & Printkulturforschung möglich.

Das digitale Textkorpus des AAC umfasst ca. 600 Millionen tokens, basierend auf den mehr als 2.5 Millionen digitalen Bildern von zwischen 1848 und 1989 publizierten Druckwerken (Bücher, Broschüren, Zeitschriften, Zeitungen etc.), die in der ersten Dekade des 21. Jahrhunderts im Rahmen des Austrian Academy Corpus digitalisiert wurden.

Publikationen

  • Biber, Hanno. 2020. "Challenges for Making Use of a Large Text Corpus such as the ‘AAC – Austrian Academy Corpus’ for Digital Literary Studies." In: Piotr Banski, Barbaresi, Adrien, Clematide, Simon, Kupietz, Marc, Lüngen, Harald, and Pisetta, Ines. Proceedings of the LREC 2020 Workshop. 8th Workshop on Challenges in the Management of Large Corpora (CMLC-8 2020).  Webseite   Download
  • Biber, Hanno. 2022. "'The word expired when that world awoke'. New challenges for research with large text corpora and corpus-based discourse studies in totalitarian times." In: Piotr Banski, Barbaresi, Adrien, Clematide, Simon, Kupietz, Marc, and Lüngen, Harald. Proceedings of the LREC 2022 Workshop on challenges in the management of large corpora (CMLC-10 2022). Webseite

Projektleitung

Hanno Biber

Kontakt

Hanno Biber

Projektlaufzeit

01/2024–12/2026