Dataset Open Access
Petrova, Svetlana
{"DOI":"10.25592/uhhfdm.1719","abstract":"<p>Das Referenzkorpus Altdeutsch erfasst und annotiert die \u00e4ltesten Sprachdenkm\u00e4ler des Deutschen vom Beginn der kontinuierlichen schriftlichen \u00dcberlieferung um 750 bis etwa 1050 mit einem Umfang von ca. 650 000 Textw\u00f6rtern. Aufgenommen werden alle in dieser Zeit \u00fcberlieferten Texte des Althochdeutschen und des Alts\u00e4chsischen in einer m\u00f6glichst genauen Wiedergabestufe. Dabei werden die handschriftengetreuesten gedruckten Texteditionen zugrundegelegt. Die Annotation erfasst Header-Informationen, strukturelle (Wort, Satz, Zeile, Absatz etc.) und linguistische Annotationen (Part of Speech-Tagging, Flexionsmorphologie) sowie syntaktische Satzinformationen und erfolgt mit Unterst\u00fctzung einer semi-automatischen Vorannotation, die mit Hilfe der digitalisierten Sprachstufen- und Textw\u00f6rterb\u00fccher und Glossare zum Althochdeutschen und zum Alts\u00e4chsischen erzeugt wurde. Die verschiedenen Stufen der Annotation werden in Form einer Mehrebenenarchitektur aufeinander bezogen.</p><p>The reference corpus Old German contains (annotated) data from the oldest language monuments of German before the continuous written transduction around 750 until 1050 with approx. 650,000 text words.</p><p></p><p><strong>CLARIN Metadata summary for B4 Otfrid (CMDI-based)</strong></p> \t \t<p> \t \t\t<strong>Title: </strong>B4 Otfrid<br> \t \t<strong>Description: </strong>Das Referenzkorpus Altdeutsch erfasst und annotiert die \u00e4ltesten Sprachdenkm\u00e4ler des Deutschen vom Beginn der kontinuierlichen schriftlichen \u00dcberlieferung um 750 bis etwa 1050 mit einem Umfang von ca. 650 000 Textw\u00f6rtern. Aufgenommen werden alle in dieser Zeit \u00fcberlieferten Texte des Althochdeutschen und des Alts\u00e4chsischen in einer m\u00f6glichst genauen Wiedergabestufe. Dabei werden die handschriftengetreuesten gedruckten Texteditionen zugrundegelegt. Die Annotation erfasst Header-Informationen, strukturelle (Wort, Satz, Zeile, Absatz etc.) und linguistische Annotationen (Part of Speech-Tagging, Flexionsmorphologie) sowie syntaktische Satzinformationen und erfolgt mit Unterst\u00fctzung einer semi-automatischen Vorannotation, die mit Hilfe der digitalisierten Sprachstufen- und Textw\u00f6rterb\u00fccher und Glossare zum Althochdeutschen und zum Alts\u00e4chsischen erzeugt wurde. Die verschiedenen Stufen der Annotation werden in Form einer Mehrebenenarchitektur aufeinander bezogen.<br>\t\t \t<strong>Description: </strong>The reference corpus Old German contains (annotated) data from the oldest language monuments of German before the continuous written transduction around 750 until 1050 with approx. 650,000 text words.<br>\t\t\t\t\t<strong>Publication date: </strong>2015<br>\t\t\t\t\t<strong>Data owner: </strong>\t\t\tProf. Dr. Svetlana Petrova\t\t\t\t\t\t<br>\t\t\t\t\t \t\t<strong>Contributors: </strong> \tSvetlana Petrova (editor) \t\t\t<br> \t\t \t<strong>Project: </strong> \tSpecial Research Centre 632 Information structure, German Research Foundation \t\t\t\t<br> \t\t\t \t<strong>Keywords: </strong> \thistorical texts, religious texts, information structure \t\t\t\t<br> \t\t\t \t<strong>Language: </strong> \t<a href=\"https://www.ethnologue.com/language/goh\">Old High German (goh)</a> \t\t\t\t\t\t<br> \t\t\t\t\t \t<strong>Size: </strong> \t300000 Token \t\t\t\t\t<br> \t\t\t\t \t\t<strong>Segmentation units: </strong> \tother \t\t\t<br> \t\t \t<strong>Genre: </strong> \thistoric manuscript \t\t\t\t<br> \t\t\t \t<strong>Modality: </strong> \twritten \t\t\t\t<br> \t\t\t\t\t</p><p></p>","author":[{"family":"Petrova, Svetlana"}],"id":"1719","issued":{"date-parts":[[2015,9,29]]},"title":"B4 Otfrid","type":"dataset","version":"1.0"}