
Die digitale Arbeitsumgebung ediarum ist eine aus mehreren Softwarekomponenten bestehende Lösung, die es Wissenschaftler*innen erlaubt, Transkriptionen von Manuskripten und Drucken
Kurzbeschreibung des Projekts
Das Forschungs- und Lehrkorpus Gesprochenes Deutsch (FOLK) wird seit 2008 am Leibniz-Institut für Deutsche Sprache aufgebaut. Das Korpus enthält Audio- und Videoaufnahmen von natürlichen Interaktionen aus unterschiedlichsten Bereichen des gesellschaftlichen Lebens (Arbeit, Freizeit, Bildung, öffentliches Leben, Dienstleistungen usw.) im deutschen Sprachraum. Das Ziel von FOLK ist die wissenschaftsöffentliche Bereitstellung einer großen, nach aktuellen Standards erschlossenen, breit diversifizierten Datenbasis für die Untersuchung gesprochener Sprache in natürlicher Interaktion. Die Daten werden nach zeitgemäßen Standards erschlossen (transkribiert, annotiert und dokumentiert) und der wissenschaftlichen Gemeinschaft über die Datenbank für Gesprochenes Deutsch (DGD) zur Verfügung gestellt.
Projektinhalt
Während inzwischen verschiedene gut stratifizierte Korpora des geschriebenen Deutsch wissenschaftsöffentlich zugänglich sind, gibt es noch keine vergleichbare Sammlung des gesprochenen Deutsch. Mit FOLK baut das IDS daher seit 2008 ein kontinuierlich wachsendes Korpus auf, das Gesprächsdaten aus unterschiedlichsten Bereichen des gesellschaftlichen Lebens (Arbeit, Freizeit, Bildung, öffentliches Leben, Dienstleistungen usw.) im deutschen Sprachraum beinhaltet. Die Daten werden nach zeitgemäßen Standards erschlossen (transkribiert, annotiert und dokumentiert) und der wissenschaftlichen Gemeinschaft über die Datenbank für Gesprochenes Deutsch (DGD) zur Verfügung gestellt.
Das Korpus bietet Forschenden die Möglichkeit, eine Vielzahl von wissenschaftlichen Fragestellungen an einem für alle in gleicher Weise zur Verfügung stehenden Datenmaterial nachvollziehbar zu untersuchen. So nutzen bereits viele Untersuchungen aus Interaktionaler Linguistik, Gesprächsanalyse und Korpuslinguistik das Korpus als alleinige Analysegrundlage oder als Vergleichsdatum. Kultur- und medienwissenschaftliche Untersuchungen gewinnen durch FOLK vielfältige Einblicke in die Realität der gesellschaftlichen Kommunikation in Deutschland. Der germanistischen Hochschullehre und der DaF/DaZ-Hochschullehre bietet FOLK mannigfaltiges Anschauungsmaterial.
Die Datenbasis von FOLK bilden Audio- und/oder Videoaufzeichnungen authentischer Gespräche. Diese werden mit dem Transkriptionseditor FOLKER gemäß den cGAT-Transkriptionskonventionen (Konventionen für das computergestützte Transkribieren in Anlehnung an das Gesprächsanalytische Transkriptionssystem 2 (GAT2)) als Minimaltranskripte in literarischer Umschrift transkribiert und mit dem Ton aligniert, sodass in der DGD zu jeder Transkriptstelle der zugehörige Audioausschnitt unmittelbar zur Verfügung steht. Für eine bessere Recherchierbarkeit werden eine orthographische Normalisierung, eine Lemmatisierung und ein Part-Of-Speech-Tagging als weitere Annotationsebenen hinzugefügt. Zu jedem Gespräch werden umfassende Kontextdaten zu den Gesprächsumständen sowie soziodemographische Daten zu den beteiligten Sprechenden als Metadaten dokumentiert. Aufnahmen, Transkripte und Metadaten können über die DGD eingesehen und systematisch durchsucht werden. Neben einer Volltextrecherche gibt es eine struktursensitive Tokensuche auf Transkriptdaten mit der Möglichkeit, die Suchergebnisse anhand von Metadaten zu filtern.
Das Korpus wird kontinuierlich ausgebaut, Erweiterungen des Korpus werden regelmäßig in der DGD veröffentlicht. Der Aufbau wird von Kooperationspartnern durch ‚Datenspenden‘ unterstützt. FOLK nimmt gerne Gesprächsdaten aus weiteren Projekten auf.
FOLK ist im Archiv für Gesprochenes Deutsch (AGD) im Programmbereich „Mündliche Korpora“ der Abteilung Pragmatik des Leibniz-Instituts für Deutsche Sprache (IDS), Mannheim, angesiedelt. Das IDS ist die zentrale außeruniversitäre Einrichtung zur Erforschung und Dokumentation der deutschen Sprache. Als Mitglied der Leibniz-Gemeinschaft wird das IDS gemeinsam vom Bund und von den Ländern unter besonderer Beteiligung Baden-Württembergs finanziert.
Dr. Silke Reineke
folk@ids-mannheim.de
Erfahren Sie mehr unter
agd.ids-mannheim.de/folk.shtml
Fügen Sie Ihr DH-Forschungsprojekt dem Projektschaufenster hinzu, indem Sie eine kurze Projektbeschreibung über das Webformular einreichen. Geben Sie Projektdaten, eine Kurzbeschreibung, eine Grafik oder Visualisierung sowie eine detaillierte Beschreibung des Projektinhalts mit fachlicher Zuordnung, Adressaten, Mehrwert, Projektverantwortlichen, Finanzierungsinformationen und Laufzeit an.
Die digitale Arbeitsumgebung ediarum ist eine aus mehreren Softwarekomponenten bestehende Lösung, die es Wissenschaftler*innen erlaubt, Transkriptionen von Manuskripten und Drucken
Die im aschkenasischen Europa und Norditalien verbreiteten Pinkasim – Protokollbücher jüdischer Gemeinden – sind zentrale Quellen zur Erforschung der jüdischen
HGIS de las Indias ist eine historisch-geographische Datenbank zum Spanisch-Amerika der ausgehenden Kolonialzeit.
Das von der Deutschen Forschungsgemeinschaft geförderte Projekt Diccionario del Español Medieval electrónico (DEMel) hat zum Ziel, der Öffentlichkeit ein lemmatisiertes
Annotieren, Analysieren, Interpretieren und Visualisieren: In CATMA können Textwissenschaftler:innen so arbeiten, wie es ihren Fragestellungen am besten entspricht: qualitativ oder
Die Virtuelle Forschungsumgebung TextGrid ist optimiert für die digitale Erschließung geisteswissenschaftlicher Quellen und deren langfristige Archivierung in einem Web-Archiv, insbesondere
Das forTEXT Portal bietet einsteigerfreundlich aufbereitete, zitierfähige Methodenbeschreibungen und Reviews von Textsammlungen und Tools – von Digitalisierung über Annotation zu Interpretation und Visualisierung von Literatur.
Das Heinrich-Heine-Portal schöpft aus den Arbeitsergebnissen mehrerer Forschergenerationen, indem es die beiden historisch-kritischen Heine-Gesamtausgaben, die unabhängig voneinander in der Bundesrepublik und der DDR entstanden, in einer digitalen Edition vereint.
Wir verwenden Cookies und ähnliche Funktionen zur Verarbeitung von Daten. Die Zustimmung ist freiwillig und kann jederzeit widerrufen werden.