Das EXMARaLDA-Demokorpus enthält Beispiele für EXMARaLDA-Transkripte in verschiedenen Sprachen. Mit dem Demokorpus lässt sich die Funktionalität des EXMARaLDA-Systems ausprobieren und demonstrieren. Version 1.2 wurde ausdrücklich auch mit dem Ziel entwickelt, die Anwendung der Norm ISO 24624:2016 „Language resource management — Transcription of spoken language“ zu demonstrieren.
Das Demokorpus ist in den folgenden Versionen verfügbar:
- Version 1.0 wurde im CLARIN-D-Repositorium des Hamburger Zentrums für Sprachkorpora archiviert. Sie wurde durch Version 1.1 ersetzt und steht nicht mehr zum Download zur Verfügung.
- Version 1.1 ist beim Zentrum für nachhaltiges Forschungsdatenmanagement der Universität Hamburg archiviert. Sie enthält 26 Kommunikationen und deckt 13 Sprachen ab.
- Version 1.2 wurde im Projekt Transcription+ erstellt. Sie ist eine Teilmenge von Version 1.1 (12 Kommunikationen, 8 Sprachen) und enthält kuratierte Fassungen aller Transkripte, einschließlich orthographischer Normalisierung, Lemmatisierung und POS-Tagging in den ISO/TEI-Spoken-Versionen der Transkripte.
Die veröffentlichten Versionen 1.1 und 1.2 können über das Forschungsdatenrepositorium des ZFDM unter https://doi.org/10.25592/uhhfdm.8363 heruntergeladen werden.
Die aktuellste (unveröffentlichte) Version ist im GitHub-Repositorium unter https://github.com/zumult-org/exmaraldademocorpus verfügbar.
Für die Online-Nutzung des Korpus steht die ZuMult-Korpusplattform der AdWHH unter https://transcription-plus.awhamburg.de/zumultapi/index.jsp zur Verfügung.




