Hear2Text
Für Forschende

Transkription qualitativer Interviews: am selben Tag codieren

Für qualitative Interviews und Fokusgruppen, von der Masterarbeit bis zum Forschungsprojekt: Du lädst die Aufnahme hoch oder fügst ihren Link ein, und ein wörtliches Transkript kommt in wenigen Minuten zurück, mit Zeitstempeln und nach Sprechenden getrennt. Den Text exportierst du als TXT oder Word in das Programm, in dem du auswertest.

Die Lücke zwischen Erhebung und Auswertung

Die Erhebung ist der Teil, der nach Plan läuft. Alles zwischen dem letzten Interview und dem ersten Entwurf, das Abtippen, das Glätten, die Suche nach einem Zitat, das du nur halb im Kopf hast, ist die Stelle, an der die Monate still verschwinden.

  • Transkribieren frisst den Zeitplan

    Eine Stunde Aufnahme kostet fast einen Arbeitstag am Fußschalter, und getippt wird sie meistens von der Person, die das Projekt am besten kennt.

  • Codieren von Hand

    Solange es keinen Text gibt, ist eine Kategorie nur eine Tabellenzeile mit einem Timecode und einer Paraphrase. Am Ende wird die Paraphrase zitiert.

  • Jeder Vergleich heißt noch einmal anhören

    Drei Befragte haben etwas Ähnliches über Vertrauen gesagt. Das zu belegen kostet drei Sitzungen mit Kopfhörern und die Hoffnung, jede Stelle wiederzufinden.

  • Zitate, die du nicht belegen kannst

    Ein Zitat muss Wort für Wort zur Aufnahme passen. Aus Notizen rekonstruiert, verrutscht es, und nichts verweist auf die Stelle, die ein Gutachter sehen will.

Das Transkript liegt bereit, wenn du dich an die Auswertung setzt

Lade die Aufnahme hoch, bei einer Online-Sitzung reicht auch ihr Link, und der Text kommt in wenigen Minuten als Segmente mit Zeitstempeln und getrennten Sprechenden zurück. Was übrig bleibt, ist Lesen, Codieren und Zitieren, also genau die Arbeit, für die du ausgebildet bist.

Vom Aufnahmegerät bis zur Auswertung in MAXQDA

Vorher
  • ✗Interview führen und aufnehmen
  • ✗Tagelang abtippen
  • ✗Von Hand in Tabellen codieren
  • ✗Mühsam quer vergleichen
  • ✗Zitierfehler riskieren
Nachher
  • Interview führen und aufnehmen
  • Transkript in Minuten zurückbekommen
  • KI zeigt, wo ein Thema auftaucht
  • Im Text suchen, statt neu anzuhören
  • Zitate mit Zeitstempel belegen

Einzelinterview oder Fokusgruppe, egal womit aufgenommen

Ein exportiertes Videogespräch, ein Handy auf dem Küchentisch, ein Ansteckmikrofon im Fokusgruppenraum, ein Vortrag, den dir jemand als Link geschickt hat. Datei hochladen oder Link einfügen; die Sprache wird automatisch erkannt, aus 100 unterstützten. Klarer Ton kommt mit 95-99 % Genauigkeit zurück, jedes Segment mit eigenem Zeitstempel.

Loslegen

Dem Transkript eine Frage stellen

Im Bezahltarif gehört ein Assistent dazu, der das Transkript gelesen hat und Fragen dazu beantwortet: Wo spricht sie über Arbeitsbelastung? Was hat diese Person zum Thema Kündigung gesagt? Fass die letzten zwanzig Minuten zusammen. Dein Kategoriensystem wendet er nicht an, und das soll er auch nicht. Er bringt dich zu der Passage, die sich zu codieren lohnt, ohne dass du das Audio danach absuchst.

Loslegen

Über alle Befragten hinweg vergleichen

Sobald jedes Interview als Text vorliegt, ist jede Erwähnung eines Begriffs eine Suche und kein erneutes Abhören. Exportiere das gesamte Material nach Word oder TXT, und diese Suche läuft in dem Programm, in dem du deine Daten ohnehin verwaltest. Den Tonfall, den der Text weglässt, hörst du nach, indem du die Stelle im Transkript suchst und über ihren Zeitstempel in die Aufnahme springst.

Loslegen

Anwendungsfälle

  • Leitfadeninterviews

    Lade eine Sitzung hoch, sobald sie zu Ende ist, und lies sie, solange sie frisch ist, statt abzutippen, was du gerade gehört hast. Jede Wortmeldung hat einen Zeitstempel, eine auffällige Antwort ist also einen Klick vom Ton entfernt.

  • Fokusgruppen

    Ein Tisch voller Stimmen um ein Mikrofon kommt mit jeder Wortmeldung in eigener Zeile und mit Sprecherzuordnung zurück. Wo alle durcheinanderreden, prüfst du die Zuordnung nach, aber du korrigierst ein Transkript, statt eines zu schreiben.

  • Thematische Analyse

    Lies das gesamte Material als Text, markiere, was wiederkehrt, und zieh die Passagen heraus, die es tragen. Der Assistent zeigt dir, an welchen Stellen einer langen Sitzung ein Thema auftaucht, und hinter jeder Kategorie steht eine Aufnahme.

  • Literatur- und Materialrecherche

    Aufgezeichnete Tagungsvorträge, Kolloquien und Methodenwebinare sind auch Quellen. Füge den Videolink ein, und du hast durchsuchbaren Text, den du mit Zeitangabe zitieren kannst, statt einer Stunde Video, die du nach der einen Stelle absuchst.

  • Feldforschung

    Nimm das Gespräch dort mit dem Handy auf, wo es stattfindet, und lade die Aufnahme hoch, sobald du wieder Empfang hast. Weil die Sprache automatisch erkannt wird, muss ein Interview in der Sprache vor Ort nicht warten, bis jemand zu Hause es abtippt.

Kernfunktionen

  • Was du der Ethikkommission sagen kannst

    Wir behaupten nicht, die Auflagen einer Ethikkommission zu erfüllen, denn ein Votum hängt an deiner Studie und nicht an einem Dienstleister. Wahr ist: verschlüsselte Übertragung, Aufnahmen, die dein Konto nur verlassen, wenn du sie teilst, und Löschen, sobald du es entscheidest.

  • Namen bleiben in deiner Hand

    Automatisch geschwärzt wird nichts: Wir entfernen weder Namen noch Orte noch andere Merkmale für dich. Arbeite im Interview mit Kürzeln, oder bereinige die exportierte Datei, bevor sie an den Rest des Teams geht.

  • Word und TXT für MAXQDA, ATLAS.ti und NVivo

    Kein .qdpx und keine native Datei für MAXQDA, ATLAS.ti oder NVivo. Im Bezahltarif bekommst du Word, PDF, TXT, SRT und VTT; davon lassen sich Word und reiner Text in jedes dieser Programme als Dokument importieren, das du dort codierst.

  • Wörtlich, nicht geglättet

    Was gesagt wurde, steht da, samt Zögern und Satzabbrüchen, bei klarem Ton mit 95-99 % Genauigkeit. Einem Regelwerk wie GAT 2 folgt es dabei nicht, und Zusammenfassungen sind eine eigene Funktion im Bezahltarif, die den Text nie überschreibt.

  • 100 Sprachen, beim Hochladen erkannt

    Befrage Menschen in der Sprache, in der sie denken. Erkannt wird sie, sobald die Datei ankommt, es muss also nichts pro Aufnahme eingestellt werden, und der Bezahltarif übersetzt den fertigen Text für Mitautorinnen und Mitautoren, die eine andere Sprache lesen.

  • Jede Zeile trägt ihren Zeitstempel

    Ein Zitat in deinem Entwurf lässt sich gegen die Sekunde prüfen, in der es gesagt wurde. Fragt eine Gutachterin nach der Fundstelle, hast du eine Stelle in der Aufnahme und nicht eine Erinnerung an den Raum.

Häufig gestellte Fragen

Ist die Transkription für die Forschung DSGVO-konform?
Das können wir nicht zusichern: Einen Auftragsverarbeitungsvertrag stellen wir nicht bereit, und eine Zertifizierung haben wir nicht. Ob Interviewdaten hier verarbeitet werden dürfen, klärst du mit deiner Ethikkommission und dem Datenschutzbeauftragten deiner Hochschule, denn ein Ethikvotum gilt deiner Studie und nicht deinen Dienstleistern. Was du in den Antrag schreiben kannst: Aufnahmen werden verschlüsselt übertragen, sie liegen in deinem Konto, geteilt wird nur, was du selbst teilst, und Aufnahme wie Transkript kannst du jederzeit löschen. Verlangt eure Genehmigung, dass die Daten hochschuleigene Systeme nicht verlassen, dann transkribier dort.
Werden Namen im Transkript automatisch anonymisiert?
Nein. Eine automatische Anonymisierung oder Pseudonymisierung gibt es nicht, und das sagen wir lieber vorher als nach dem Hochladen. Was in der Aufnahme gesprochen wird, Namen eingeschlossen, steht auch im Transkript. Das übliche Vorgehen funktioniert weiter: im Interview mit Kürzeln arbeiten, oder im exportierten Word- oder TXT-Dokument Namen suchen und ersetzen, bevor das Transkript in die Auswertung wandert.
Kann ich die Transkripte in MAXQDA oder ATLAS.ti importieren?
Ja, als Word- oder TXT-Dokument, nur nicht in einem eigenen Format: Es gibt keine .qdpx-Datei und nichts, was sich direkt in MAXQDA, ATLAS.ti oder NVivo öffnet. Exportiert wird im Bezahltarif nach Word, PDF, TXT, SRT und VTT, im kostenlosen Tarif nach TXT; Word und reiner Text sind genau das, was diese Programme als Dokument importieren. Im Bezahltarif können Word- und TXT-Dateien jede Wortmeldung mit dem Namen der sprechenden Person öffnen; die Zeitstempel bleiben im Transkript hier, halte es also offen, wenn du hören musst, wer eine Zeile gesagt hat.
Wie kommt die Sprechererkennung mit Fokusgruppen zurecht?
Gut, solange nacheinander gesprochen wird; wo drei Leute gleichzeitig reden, korrigierst du ein paar Zuordnungen selbst, und das bleibt ein Lesedurchgang statt eines Tippdurchgangs. Die Sprechererkennung trennt die Stimmen und beschriftet jedes Segment, im kostenlosen Tarif genauso wie im Tarif für 9,99 $ im Monat. Ein Mikrofon in der Mitte des Tisches bringt mehr als eines am Rand, und diese Entscheidung wirkt sich stärker aus als alles auf unserer Seite.
Kann ich Interviews auf Deutsch und in anderen Sprachen transkribieren?
Ja, in 100 Sprachen, und die Sprache wird beim Hochladen automatisch erkannt, eine mehrsprachige Studie braucht also keine Einstellung pro Datei. Bei sauberem Ton liegt die Genauigkeit bei 95-99 %, bei starkem Dialekt oder Akzent darunter. Der Bezahltarif übersetzt ein fertiges Transkript außerdem, was hilft, wenn das Auswertungsteam die Interviewsprache nicht teilt.
Gibt es einen Rabatt für Hochschulen oder Studierende?
Nein. Einen akademischen, studentischen oder institutionellen Rabatt gibt es nicht, der Preis ist für alle gleich. Was ein Promotionsbudget trägt, ist der kostenlose Tarif: 120 Transkriptionsminuten pro Woche, jeden Montag zurückgesetzt, ohne Kreditkarte. Darüber hinaus kosten unbegrenzte Minuten 9,99 $ im Monat oder 89,99 $ im Jahr, also rund 7,50 $ pro Monat.

Für Masterarbeit oder Studie: 120 Freiminuten pro Woche

Das reicht für zwei einstündige Interviews, und am Montag ist das Kontingent wieder voll, ohne Kreditkarte. Unbegrenzte Minuten, Sprechernamen, KI-Zusammenfassungen und alle Exportformate kosten 9,99 $ im Monat oder 89,99 $ im Jahr.