Interview transkribieren für die Bachelorarbeit: Welche Regeln gelten, wie viel Zeit du wirklich einplanen musst und wie du sauber anonymisierst.

"Zehn Interviewstunden binden 50 bis 100 Arbeitsstunden — Transkribieren ist keine Restarbeit zwischen Erhebung und Auswertung."
Die Interviews sind geführt, die Aufnahmen liegen auf dem Laptop — und jetzt wird es zäh. Transkribieren ist der Schritt, an dem in empirischen Abschlussarbeiten am häufigsten der Zeitplan kippt, weil fast alle den Aufwand unterschätzen. Dazu kommen zwei Fragen, die dir niemand automatisch beantwortet: nach welchen Regeln du verschriftlichst und wie weit du anonymisieren musst. Dieser Leitfaden klärt beides mit den Regelwerken, die im deutschsprachigen Raum tatsächlich Standard sind, und gibt dir belastbare Zahlen für die Zeitplanung.
Ein Transkript ist keine schöne Mitschrift, sondern deine Datengrundlage. Es muss drei Dinge erfüllen: Es bildet das Gesagte nachvollziehbar ab, es folgt einem einheitlichen, benennbaren Regelsystem, und es ist so aufbereitet, dass sich einzelne Stellen später eindeutig zitieren lassen.
Entscheidend ist der zweite Punkt. Nicht welches System du wählst, wird dir angekreidet, sondern dass du keines benennst oder mittendrin die Regeln wechselst. Im Methodenteil deiner Arbeit gibst du an, nach welchem Regelwerk du transkribiert hast — das ist Teil der Nachvollziehbarkeit deiner Erhebung. Leg die Regeln deshalb vor dem ersten Interview fest und schreib sie dir auf.
Im deutschsprachigen Raum konkurrieren zwei Ansätze, die unterschiedliche Fragen beantworten.
Das inhaltlich-semantische System von Dresing und Pehl richtet sich an alle, die wissen wollen, was gesagt wurde. Es verzichtet auf feine Aussprachedetails und ist damit gut lesbar. Für qualitative Inhaltsanalysen — den mit Abstand häufigsten Auswertungsweg in Bachelor- und Masterarbeiten — ist genau das angemessen.
Das Gesprächsanalytische Transkriptionssystem GAT 2 (Selting et al. 2009) richtet sich an alle, die wissen wollen, wie gesprochen wurde: Tonhöhenverläufe, Überlappungen, Dehnungen. Es unterscheidet drei Ausbaustufen — Minimal-, Basis- und Feintranskript —, wobei das Feintranskript speziellen Analysefragen vorbehalten bleibt.
| Kriterium | Inhaltlich-semantisch (Dresing/Pehl) | GAT 2 |
|---|---|---|
| Frage dahinter | Was wurde inhaltlich gesagt? | Wie wurde es gesagt? |
| Typische Auswertung | Qualitative Inhaltsanalyse, Kategorienbildung | Gesprächs- und Konversationsanalyse, Linguistik |
| Dialekt | wird an das Schriftdeutsch angenähert | wird abgebildet |
| Lesbarkeit | hoch | gewöhnungsbedürftig |
| Aufwand | moderat | deutlich höher |
Faustregel: Wenn du Aussagen zu Themen auswertest, nimm das einfache System. Wenn dein Erkenntnisinteresse an der Gesprächsführung selbst hängt, führt an GAT 2 kein Weg vorbei — dann plane aber spürbar mehr Zeit ein.
Das Regelsystem für die inhaltlich-semantische Transkription in der aktuellen Fassung besteht aus fünf Kernregeln:
Das System lässt sich modular ausbauen, ohne dass du gleich zu GAT 2 wechseln musst. Gängige Ergänzungen: Wort- und Satzabbrüche mit Schrägstrich markieren, Wortdoppelungen konsequent notieren, Pausen nach Länge abgestuft kennzeichnen und Fülllaute aller Beteiligten mitschreiben. Nimm nur die Module dazu, die deine Auswertung wirklich braucht — jedes zusätzliche Zeichen kostet Transkriptionszeit.
Hier liegt die häufigste Fehlplanung. Dresing und Pehl empfehlen, für einfache Regelsysteme mit dem Fünf- bis Zehnfachen der Interviewdauer zu rechnen — inklusive Korrekturdurchgang. Die schnellste von ihnen gemessene Geschwindigkeit lag bei 1:3, allerdings nur, weil diese Person eine einzige Stunde tippte, einfache Regeln nutzte und auf den zweiten Korrekturdurchgang verzichtete.
| Umfang deiner Erhebung | Transkriptionszeit (einfaches Regelsystem) | entspricht etwa |
|---|---|---|
| 1 Interview à 60 Minuten | 5 bis 10 Stunden | 1 bis 2 Arbeitstage |
| 5 Interviews à 60 Minuten | 25 bis 50 Stunden | 1 bis 2 Wochen |
| 10 Interviews à 60 Minuten | 50 bis 100 Stunden | 2 bis 4 Wochen bei 4–6 Std. täglich |
Bei einer dreimonatigen Bachelorarbeit ist das ein erheblicher Block — und die Auswertung dauert danach in der Regel noch länger als die Transkription. Für Vorbereitung, Erhebung und Transkription zusammen veranschlagen die Autoren etwa das Zehn- bis Fünfzehnfache der reinen Interviewdauer; für eine vollständige, eher deskriptive qualitative Studie summieren Kuckartz und Kolleg:innen sogar ein Minimum von rund der 60-fachen Zeit.
Praktische Konsequenz: Entscheide die Zahl deiner Interviews mit Blick auf dieses Budget, und trag die Transkriptionswochen fest in deinen Zeitplan für die Bachelorarbeit ein, statt sie als Restarbeit zwischen Erhebung und Auswertung zu quetschen.
Interviews enthalten personenbezogene Daten. Wie weit du sie veränderst, ist keine Geschmacksfrage, sondern eine Frage des Anonymisierungsgrads.
Die Handreichung des DIPF unterscheidet drei Stufen: Bei der formalen Anonymisierung werden direkte Identifizierungsmerkmale entfernt — Eigennamen von Personen und Orten, Bilder, Stimmen. Die faktische Anonymisierung verändert die Daten so, dass eine Re-Identifikation nur mit unverhältnismäßigem Aufwand möglich wäre. Absolut anonymisierte Daten lassen eine Zuordnung gar nicht mehr zu; sie unterliegen dann nicht mehr dem Datenschutz.
Wichtig ist der Unterschied zur Pseudonymisierung: Dort ersetzt du Namen durch Codes, eine Zuordnung bleibt über die Schlüsseldatei aber möglich. Pseudonymisierte Daten sind also nicht anonym.
| Verfahren | Was du tust | Beispiel |
|---|---|---|
| Löschen mit Platzhalter | Merkmal entfernen und markieren | Telefonnummer, E-Mail-Adresse streichen |
| Pseudonymisieren | Merkmal durch ein Pseudonym ersetzen | Arbeitgeber „Bäckerei Schmidt" wird „Metzgerei" |
| Aggregieren | Angabe zu einer Klasse vergröbern | Alter 27 wird „20 bis 30 Jahre"; Gelsenkirchen wird „Ruhrgebiet"; 12.01.1998 wird „01/1998" |
| Bedeutungsgleich ersetzen | Merkmal durch ein gleichwertiges tauschen | aus einer Friseurin wird eine Kosmetikerin, keine Bürokauffrau |
Der letzte Punkt ist der, den die meisten falsch machen: Ersetzungen müssen den sozialen Gehalt bewahren. Wer aus einem Wiener Arbeiterbezirk stammt, bekommt einen anderen Arbeiterbezirk zugeordnet, keinen Nobelbezirk — sonst verfälschst du deine eigenen Daten.
Anonymisiere möglichst schon während der Transkription oder markiere sensible Stellen wenigstens sofort, etwa mit eckigen Klammern. Für bereits anonymisierte Stellen sind Auszeichnungen wie [pseudonym] oder @@pseudonym## üblich; die Variante mit unterschiedlichen Start- und Endzeichen hat den Vorteil, dass vergessene Endmarkierungen auffallen. Führe zusätzlich ein Anonymisierungsprotokoll, in dem alle Ersetzungen, Vergröberungen und Löschungen festgehalten sind. Hilfreich ist außerdem, deine Gesprächspartner:innen schon vorab zu bitten, im Interview keine Namen zu nennen.
Automatische Transkription ist inzwischen gut genug, um in der qualitativen Interviewforschung ernsthaft eingesetzt zu werden. Belastbare Studien zum Gesamtaufwand inklusive Korrektur gibt es allerdings nicht; Dresing und Pehl schätzen den Zeitvorteil gegenüber rein manueller Arbeit auf rund 50 Prozent und mehr. Bei starkem Dialekt, lauter Umgebung oder komplexen Regelsystemen bleibt Handarbeit nötig.
Drei Auflagen solltest du vor dem Hochladen klären, weil sie Datenschutzrecht berühren: Nicht jedes Angebot ist DSGVO-konform, das gehört vorab mit der oder dem Datenschutzbeauftragten deiner Hochschule besprochen. Gibst du die Verarbeitung extern, braucht es eine Vereinbarung zur Auftragsverarbeitung — und die Weitergabe an Externe muss bereits in der Einwilligungserklärung stehen, die deine Interviewten unterschrieben haben. Nach Projektende gilt: sicher löschen, auch auf dem Aufnahmegerät. Wer dir beim Tippen hilft, muss auf das Datengeheimnis verpflichtet werden — auch Freunde und Familie.
Und in jedem Fall: Automatische Rohtexte sind Rohtexte. Ohne vollständigen Korrekturdurchgang am Audio ist kein Transkript zitierfähig.
Ein weit verbreitetes Missverständnis betrifft Zeitmarken. Sie sind nützlich, aber nicht als Fundstellenangabe gedacht: Ihr Zweck ist der schnelle Rücksprung ins Audio per Klick. Zitiert wird über Absatzzahlen, seltener über Zeilennummern. Nummeriere die Absätze deiner Transkripte also durch und belege Interviewstellen im Fließtext einheitlich — etwa als (B2, Abs. 14).
Die vollständigen Transkripte gehören in den Anhang, nicht ins Literaturverzeichnis: Sie sind eigene Erhebungsdaten, keine publizierten Quellen. Wie du sie dort einordnest und im Anhangsverzeichnis aufführst, zeigt der Ratgeber zum Anhang der Bachelorarbeit; die formale Belegweise im Text folgt deinem Zitierstil, den du beim richtigen Zitieren im Studium nachschlagen kannst.
Danach beginnt die eigentliche Analyse: Kategorien bilden, codieren, auswerten. Wie du von den fertigen Transkripten zu einem Kategoriensystem kommst, beschreibt der Ratgeber zum Auswerten von Experteninterviews Schritt für Schritt.
Wenn du dich für die Methodendiskussion und das Kolloquium in Regelwerke und Handreichungen einarbeiten musst, kannst du sie dir mit Learnboost zusammenfassen und in Karteikarten überführen — so hast du die Unterschiede zwischen den Transkriptionssystemen und die Anonymisierungsgrade abrufbar, wenn im Kolloquium danach gefragt wird.
Für ein einfaches Regelsystem solltest du mit dem Fünf- bis Zehnfachen der Interviewdauer rechnen, also etwa fünf bis zehn Stunden pro Interviewstunde. Darin ist ein Korrekturdurchgang enthalten. Schneller geht es nur, wenn du auf die zweite Kontrolle verzichtest — was die Zitierfähigkeit gefährdet.
Im inhaltlich-semantischen System werden Dialekt und Wortverschleifungen an das Schriftdeutsch angenähert, solange eine eindeutige Übertragung möglich ist. Verstehensäußerungen wie "hmm" fallen weg, wenn sie den Redefluss nicht unterbrechen, werden aber notiert, wenn sie eine Antwort auf eine Frage sind.
Als Rohtext ja, als fertiges Transkript nein. Die Spracherkennung spart nach Schätzung von Dresing und Pehl rund die Hälfte der Zeit, ersetzt aber keinen Korrekturdurchgang am Audio. Zusätzlich musst du vorab klären, ob der Dienst datenschutzkonform ist und ob die Weitergabe in deiner Einwilligungserklärung abgedeckt ist.
Über Absatzzahlen, seltener über Zeilennummern — zum Beispiel als (B2, Abs. 14). Zeitmarken sind dafür nicht gedacht; sie dienen dem schnellen Rücksprung in die Audiodatei. Die vollständigen Transkripte gehören in den Anhang, nicht ins Literaturverzeichnis.
Bei der Pseudonymisierung ersetzt du Namen durch Codes, eine Zuordnung bleibt über eine Schlüsseldatei möglich — die Daten sind also nicht anonym. Anonymisierung verändert oder entfernt die Merkmale so, dass eine Re-Identifikation nur mit unverhältnismäßigem Aufwand oder gar nicht mehr gelingt.