
is in die 1990er Jahre war es in der Filmwissenschaft ein Gemeinplatz, dass Frauen in den Anfangsjahren der Filmproduktion nur
Kurzbeschreibung des Projekts
Das Forschungs- und Lehrkorpus Gesprochenes Deutsch (FOLK) wird seit 2008 am Leibniz-Institut für Deutsche Sprache aufgebaut. Das Korpus enthält Audio- und Videoaufnahmen von natürlichen Interaktionen aus unterschiedlichsten Bereichen des gesellschaftlichen Lebens (Arbeit, Freizeit, Bildung, öffentliches Leben, Dienstleistungen usw.) im deutschen Sprachraum. Das Ziel von FOLK ist die wissenschaftsöffentliche Bereitstellung einer großen, nach aktuellen Standards erschlossenen, breit diversifizierten Datenbasis für die Untersuchung gesprochener Sprache in natürlicher Interaktion. Die Daten werden nach zeitgemäßen Standards erschlossen (transkribiert, annotiert und dokumentiert) und der wissenschaftlichen Gemeinschaft über die Datenbank für Gesprochenes Deutsch (DGD) zur Verfügung gestellt.
Projektinhalt
Während inzwischen verschiedene gut stratifizierte Korpora des geschriebenen Deutsch wissenschaftsöffentlich zugänglich sind, gibt es noch keine vergleichbare Sammlung des gesprochenen Deutsch. Mit FOLK baut das IDS daher seit 2008 ein kontinuierlich wachsendes Korpus auf, das Gesprächsdaten aus unterschiedlichsten Bereichen des gesellschaftlichen Lebens (Arbeit, Freizeit, Bildung, öffentliches Leben, Dienstleistungen usw.) im deutschen Sprachraum beinhaltet. Die Daten werden nach zeitgemäßen Standards erschlossen (transkribiert, annotiert und dokumentiert) und der wissenschaftlichen Gemeinschaft über die Datenbank für Gesprochenes Deutsch (DGD) zur Verfügung gestellt.
Das Korpus bietet Forschenden die Möglichkeit, eine Vielzahl von wissenschaftlichen Fragestellungen an einem für alle in gleicher Weise zur Verfügung stehenden Datenmaterial nachvollziehbar zu untersuchen. So nutzen bereits viele Untersuchungen aus Interaktionaler Linguistik, Gesprächsanalyse und Korpuslinguistik das Korpus als alleinige Analysegrundlage oder als Vergleichsdatum. Kultur- und medienwissenschaftliche Untersuchungen gewinnen durch FOLK vielfältige Einblicke in die Realität der gesellschaftlichen Kommunikation in Deutschland. Der germanistischen Hochschullehre und der DaF/DaZ-Hochschullehre bietet FOLK mannigfaltiges Anschauungsmaterial.
Die Datenbasis von FOLK bilden Audio- und/oder Videoaufzeichnungen authentischer Gespräche. Diese werden mit dem Transkriptionseditor FOLKER gemäß den cGAT-Transkriptionskonventionen (Konventionen für das computergestützte Transkribieren in Anlehnung an das Gesprächsanalytische Transkriptionssystem 2 (GAT2)) als Minimaltranskripte in literarischer Umschrift transkribiert und mit dem Ton aligniert, sodass in der DGD zu jeder Transkriptstelle der zugehörige Audioausschnitt unmittelbar zur Verfügung steht. Für eine bessere Recherchierbarkeit werden eine orthographische Normalisierung, eine Lemmatisierung und ein Part-Of-Speech-Tagging als weitere Annotationsebenen hinzugefügt. Zu jedem Gespräch werden umfassende Kontextdaten zu den Gesprächsumständen sowie soziodemographische Daten zu den beteiligten Sprechenden als Metadaten dokumentiert. Aufnahmen, Transkripte und Metadaten können über die DGD eingesehen und systematisch durchsucht werden. Neben einer Volltextrecherche gibt es eine struktursensitive Tokensuche auf Transkriptdaten mit der Möglichkeit, die Suchergebnisse anhand von Metadaten zu filtern.
Das Korpus wird kontinuierlich ausgebaut, Erweiterungen des Korpus werden regelmäßig in der DGD veröffentlicht. Der Aufbau wird von Kooperationspartnern durch ‚Datenspenden‘ unterstützt. FOLK nimmt gerne Gesprächsdaten aus weiteren Projekten auf.
FOLK ist im Archiv für Gesprochenes Deutsch (AGD) im Programmbereich „Mündliche Korpora“ der Abteilung Pragmatik des Leibniz-Instituts für Deutsche Sprache (IDS), Mannheim, angesiedelt. Das IDS ist die zentrale außeruniversitäre Einrichtung zur Erforschung und Dokumentation der deutschen Sprache. Als Mitglied der Leibniz-Gemeinschaft wird das IDS gemeinsam vom Bund und von den Ländern unter besonderer Beteiligung Baden-Württembergs finanziert.
Dr. Silke Reineke
folk@ids-mannheim.de
Erfahren Sie mehr unter
agd.ids-mannheim.de/folk.shtml
Fügen Sie Ihr DH-Forschungsprojekt dem Projektschaufenster hinzu, indem Sie eine kurze Projektbeschreibung über das Webformular einreichen. Geben Sie Projektdaten, eine Kurzbeschreibung, eine Grafik oder Visualisierung sowie eine detaillierte Beschreibung des Projektinhalts mit fachlicher Zuordnung, Adressaten, Mehrwert, Projektverantwortlichen, Finanzierungsinformationen und Laufzeit an.
is in die 1990er Jahre war es in der Filmwissenschaft ein Gemeinplatz, dass Frauen in den Anfangsjahren der Filmproduktion nur
Das forTEXT Portal bietet einsteigerfreundlich aufbereitete, zitierfähige Methodenbeschreibungen und Reviews von Textsammlungen und Tools – von Digitalisierung über Annotation zu
Das DARIAH-DE Repository ist eine zentrale Komponente der DARIAH-DE Forschungsdaten-Föderationsarchitektur, die verschiedene Dienste und Anwendungen aggregiert und so komfortabel nutzbar
CLARIAH-DE ist ein Beitrag zur digitalen Forschungsinfrastruktur für die Geisteswissenschaften und benachbarte Disziplinen. Durch die Zusammenführung der Verbünde CLARIN-D und
is in die 1990er Jahre war es in der Filmwissenschaft ein Gemeinplatz, dass Frauen in den Anfangsjahren der Filmproduktion nur
DisKo steht für Diversitäts-Korpus und ist ein literaturwissenschaftliches Projekt mit Digital-Humanities-Komponente. Mit Methoden des maschinellen Lernens wollen wir einen Algorithmus
Das Portal Revistas culturales 2.0 dient als virtuelle Forschungsumgebung für alle Interessenten, die sich mit historischen Zeitschriften aus dem spanischsprachigen Kulturkreis beschäftigen.
In Kooperation zwischen der Universität Hamburg und der Staats- und Universitätsbibliothek Hamburg werden die ca. 35.000 handschriftlichen Originalbriefe des Dehmel-Archivs
Wir verwenden Cookies und ähnliche Funktionen zur Verarbeitung von Daten. Die Zustimmung ist freiwillig und kann jederzeit widerrufen werden.