
CLARIAH-DE ist ein Beitrag zur digitalen Forschungsinfrastruktur für die Geisteswissenschaften und benachbarte Disziplinen. Durch die Zusammenführung der Verbünde CLARIN-D und
Kurzbeschreibung des Projekts
Das Forschungs- und Lehrkorpus Gesprochenes Deutsch (FOLK) wird seit 2008 am Leibniz-Institut für Deutsche Sprache aufgebaut. Das Korpus enthält Audio- und Videoaufnahmen von natürlichen Interaktionen aus unterschiedlichsten Bereichen des gesellschaftlichen Lebens (Arbeit, Freizeit, Bildung, öffentliches Leben, Dienstleistungen usw.) im deutschen Sprachraum. Das Ziel von FOLK ist die wissenschaftsöffentliche Bereitstellung einer großen, nach aktuellen Standards erschlossenen, breit diversifizierten Datenbasis für die Untersuchung gesprochener Sprache in natürlicher Interaktion. Die Daten werden nach zeitgemäßen Standards erschlossen (transkribiert, annotiert und dokumentiert) und der wissenschaftlichen Gemeinschaft über die Datenbank für Gesprochenes Deutsch (DGD) zur Verfügung gestellt.
Projektinhalt
Während inzwischen verschiedene gut stratifizierte Korpora des geschriebenen Deutsch wissenschaftsöffentlich zugänglich sind, gibt es noch keine vergleichbare Sammlung des gesprochenen Deutsch. Mit FOLK baut das IDS daher seit 2008 ein kontinuierlich wachsendes Korpus auf, das Gesprächsdaten aus unterschiedlichsten Bereichen des gesellschaftlichen Lebens (Arbeit, Freizeit, Bildung, öffentliches Leben, Dienstleistungen usw.) im deutschen Sprachraum beinhaltet. Die Daten werden nach zeitgemäßen Standards erschlossen (transkribiert, annotiert und dokumentiert) und der wissenschaftlichen Gemeinschaft über die Datenbank für Gesprochenes Deutsch (DGD) zur Verfügung gestellt.
Das Korpus bietet Forschenden die Möglichkeit, eine Vielzahl von wissenschaftlichen Fragestellungen an einem für alle in gleicher Weise zur Verfügung stehenden Datenmaterial nachvollziehbar zu untersuchen. So nutzen bereits viele Untersuchungen aus Interaktionaler Linguistik, Gesprächsanalyse und Korpuslinguistik das Korpus als alleinige Analysegrundlage oder als Vergleichsdatum. Kultur- und medienwissenschaftliche Untersuchungen gewinnen durch FOLK vielfältige Einblicke in die Realität der gesellschaftlichen Kommunikation in Deutschland. Der germanistischen Hochschullehre und der DaF/DaZ-Hochschullehre bietet FOLK mannigfaltiges Anschauungsmaterial.
Die Datenbasis von FOLK bilden Audio- und/oder Videoaufzeichnungen authentischer Gespräche. Diese werden mit dem Transkriptionseditor FOLKER gemäß den cGAT-Transkriptionskonventionen (Konventionen für das computergestützte Transkribieren in Anlehnung an das Gesprächsanalytische Transkriptionssystem 2 (GAT2)) als Minimaltranskripte in literarischer Umschrift transkribiert und mit dem Ton aligniert, sodass in der DGD zu jeder Transkriptstelle der zugehörige Audioausschnitt unmittelbar zur Verfügung steht. Für eine bessere Recherchierbarkeit werden eine orthographische Normalisierung, eine Lemmatisierung und ein Part-Of-Speech-Tagging als weitere Annotationsebenen hinzugefügt. Zu jedem Gespräch werden umfassende Kontextdaten zu den Gesprächsumständen sowie soziodemographische Daten zu den beteiligten Sprechenden als Metadaten dokumentiert. Aufnahmen, Transkripte und Metadaten können über die DGD eingesehen und systematisch durchsucht werden. Neben einer Volltextrecherche gibt es eine struktursensitive Tokensuche auf Transkriptdaten mit der Möglichkeit, die Suchergebnisse anhand von Metadaten zu filtern.
Das Korpus wird kontinuierlich ausgebaut, Erweiterungen des Korpus werden regelmäßig in der DGD veröffentlicht. Der Aufbau wird von Kooperationspartnern durch ‚Datenspenden‘ unterstützt. FOLK nimmt gerne Gesprächsdaten aus weiteren Projekten auf.
FOLK ist im Archiv für Gesprochenes Deutsch (AGD) im Programmbereich „Mündliche Korpora“ der Abteilung Pragmatik des Leibniz-Instituts für Deutsche Sprache (IDS), Mannheim, angesiedelt. Das IDS ist die zentrale außeruniversitäre Einrichtung zur Erforschung und Dokumentation der deutschen Sprache. Als Mitglied der Leibniz-Gemeinschaft wird das IDS gemeinsam vom Bund und von den Ländern unter besonderer Beteiligung Baden-Württembergs finanziert.
Dr. Silke Reineke
folk@ids-mannheim.de
Erfahren Sie mehr unter
agd.ids-mannheim.de/folk.shtml
Fügen Sie Ihr DH-Forschungsprojekt dem Projektschaufenster hinzu, indem Sie eine kurze Projektbeschreibung über das Webformular einreichen. Geben Sie Projektdaten, eine Kurzbeschreibung, eine Grafik oder Visualisierung sowie eine detaillierte Beschreibung des Projektinhalts mit fachlicher Zuordnung, Adressaten, Mehrwert, Projektverantwortlichen, Finanzierungsinformationen und Laufzeit an.
CLARIAH-DE ist ein Beitrag zur digitalen Forschungsinfrastruktur für die Geisteswissenschaften und benachbarte Disziplinen. Durch die Zusammenführung der Verbünde CLARIN-D und
Das DARIAH-DE Repository ist eine zentrale Komponente der DARIAH-DE Forschungsdaten-Föderationsarchitektur, die verschiedene Dienste und Anwendungen aggregiert und so komfortabel nutzbar
Das DTA ist ein Archiv für deutschsprachige, historische Textsammlungen an der Berlin-Brandenburgischen Akademie der Wissenschaften. Es umfasst annotierte Volltexttranskriptionen von
Im Zentrum steht die Erforschung digitaler, datenintensiver Medien, die sich auf breiter Front als kooperative Werkzeuge, Plattformen und Infrastrukturen herausgestellt
Das von der Deutschen Forschungsgemeinschaft geförderte Projekt Diccionario del Español Medieval electrónico (DEMel) hat zum Ziel, der Öffentlichkeit ein lemmatisiertes
Die digitale Ausgabe der Werke Friedrichs des Großen der Universitätsbibliothek Trier bietet eine XML-konforme und recherchierbare elektronische Volltextversion der von
Arthur Schnitzler gehört zu den bedeutendsten österreichischen Autoren und war ein produktiver und gut vernetzter Briefschreiber. Seine Korrespondenz wurde jedoch
Mit Dietrich online werden bibliographische Angaben zu ca. 5. Mio im deutschen Sprachraum von 1897- 1944 erschienenen Zeitschriftenaufsätzen und Zeitungsartikeln in einer nach Autorennamen, Titelstichwörtern, deutschsprachigen Schlagwörtern, Zeitschriften- resp. Zeitungstiteln und Jahren durchsuchbaren Online-Datenbank nachgewiesen.
Wir verwenden Cookies und ähnliche Funktionen zur Verarbeitung von Daten. Die Zustimmung ist freiwillig und kann jederzeit widerrufen werden.