Interviews transkribieren — automatisch statt abtippen

Video oder Audio hier ablegen
oder
MP4, MOV, MP3, WAV, M4A. Bis zu 2 GB.

DeutschFolgt der Quelle

Ein Interview transkribieren Sie automatisch, indem Sie die Aufnahme (MP3, M4A, WAV, auch Video) bei Subanana hochladen: Die Sprecher werden automatisch getrennt, Zeichensetzung und Absätze gesetzt, und Sie erhalten ein Transkript mit Zeitmarken, das Sie im Editor korrigieren und als DOCX, TXT oder XLSX exportieren. Subanana erkennt 95+ Sprachen bei durchschnittlich 98 % Genauigkeit; eine Stunde Selbsttippen kostet dagegen erfahrungsgemäß ein Vielfaches der Aufnahmezeit. Die ersten 15 Minuten jeder Datei sind kostenlos, bis zu 3 Dateien im Monat, ohne Kreditkarte.

Keine Karte nötig. Die ersten 15 Minuten gratis als Vorschau.

  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush
  • Google
  • Deloitte
  • dentsu
  • Manulife
  • NAVER
  • Philips
  • Amazon
  • Shopify
  • Figma
  • Coinbase
  • WPP
  • Semrush

Wie aus einer Aufnahme ein Transkript wird

Interview-Aufnahme

M4A · 58:12 · hochgeladen

Datei hochladen, Link einfügen oder im Browser aufnehmen95+ Sprachen, auch Sprachwechsel mitten im Satz

Transkript

00:12

Wir verschieben den Launch auf die erste Juniwoche.

00:47

Gut — aber die Preisseite muss bis dahin final sein.

Transkript

TXT · DOCX · XLSX · Markdown

Untertitel

SRT · VTT

Übersetzung

95+ Sprachen

Zusammenfassung

Kernpunkte · Aufgaben

Antworten

Das Transkript direkt befragen

Warum Teams ihre Aufnahmen Subanana überlassen

Keine Funktionsliste — sondern das, was entscheidet, ob ein Transkript ohne erneutes Anhören brauchbar ist.

Ein Transkript zum Lesen, nicht zum Entziffern

  • Sprecher getrenntJede Zeile trägt automatisch erkannt, wer sie gesagt hat.
  • Zeichensetzung und AbsätzeAutomatisch wiederhergestellt — der Text liest sich als Prosa, nicht als Wand.
  • Aufgeräumter TextFüllwörter werden entfernt, der Sinn bleibt unangetastet.
  • Das Transkript befragenIm Editor Fragen an die Aufnahme stellen — Antworten stützen sich auf das Gesagte.

Genauigkeit aus Technik, nicht aus Versprechen

  • Bestes Modell je SpracheModelle werden laufend verglichen; jede Datei geht an das stärkste Modell ihrer Sprache.
  • Halluzinations-ErkennungVerdächtige Ausgaben werden abgefangen und von einer anderen Engine neu verarbeitet.
  • Ihre Begriffe, Ihre SchreibweiseNamen, Produkte und Fachjargon im Glossar festlegen — gilt über Ihre Projekte hinweg.
  • Vorschlagen, dann bestätigenDie KI-Korrektur schlägt Fixes für Verhörtes vor; ohne Freigabe ändert sich nichts.

Wer hier Sprache zu Text macht

Der Ablauf ist derselbe — der Unterschied ist das Ergebnis: Transkript, Protokoll, Untertitel oder Zusammenfassung.

Meetings & Calls

Business-Teams

Zusammenfassung, Entscheidungen und Aufgaben auf dem Transkript — geteilt, solange das Meeting frisch ist.

Videos & Podcasts

Creator

Ein Transkript wird zu Untertiteln, Shownotes und Zitaten — bereit für jede Plattform.

Interviews

Journalisten & Forschende

Zitate müssen wörtlich stimmen und dem richtigen Sprecher gehören — und vor der Deadline fertig sein.

Vorlesungen

Studierende & Lehrende

Lange Aufnahmen kommen zusammengefasst und durchsuchbar an — die Wiederholung beginnt beim Wesentlichen.

Interview transkribieren in vier Schritten

Vom Aufnahmegerät zum zitierfähigen Transkript — der Ablauf ist bei jedem Interview gleich.

  1. Aufnahme hochladenMP3, M4A, WAV, OGG oder gleich die Videodatei aus dem Online-Interview — bis 8 Stunden und 30 GB pro Datei. Auch die Handyaufnahme aus dem Seminarraum funktioniert; für jede Sprache wählt Subanana das im Benchmark beste Erkennungsmodell.
  2. Sprecher und Sprache festlegenDie Sprecherzahl geben Sie an oder lassen sie automatisch erkennen — beim Zwei-Personen-Interview genügt die Automatik. Namen und Fachbegriffe aus Ihrem Projekt hinterlegen Sie vorab im Glossar, per Hand oder als XLSX/CSV-Import.
  3. Transkript korrigierenZeichensetzung und Absätze sind bereits gesetzt, Füllwörter entfernt. Die KI-Korrektur schlägt Verbesserungen mit einem Qualitätswert von 0–100 vor — übernommen wird nur, was Sie bestätigen. Unklare Stellen hören Sie direkt an der Zeitmarke nach.
  4. Exportieren und weiterarbeitenAls DOCX für die Arbeit, TXT für die Analyse-Software oder XLSX für die tabellarische Auswertung — Sprecherlabels und Zeitmarken bleiben erhalten. Auf Wunsch alles gebündelt als ZIP.

Was die Interview-Transkription leistet — und wo die Grenzen sind

Für Methodenkapitel und Werkzeugvergleich: die Fakten, inklusive der Grenzen.

Sprechertrennung
Automatisch, mit wählbarer oder automatisch erkannter Sprecherzahl; Labels nachträglich umbenennbar
Textform
Zeichensetzung und Absätze automatisch; Füllwörter werden entfernt, der Wortlaut bleibt erhalten — die Feinabstimmung auf Ihre Transkriptionsregeln machen Sie im Editor
Zeitmarken
Pro Absatz, im Export enthalten
Sprachen
95+, auch Interviews mit Sprachwechsel
Genauigkeit
Durchschnittlich 98 % — abhängig von Audioqualität, Überlappungen und Fachvokabular
Übersetzung
Eine Zielsprache pro Transkript — etwa das englische Experteninterview als deutscher Text
Dateigrenzen
Bis 8 Stunden und 30 GB pro Datei, in jedem Plan
Exportformate
DOCX, TXT, XLSX, Markdown, für Untertitel SRT und VTT, gebündelt als ZIP (kein PDF-Export)
Was Subanana nicht ist
Keine QDA-Analyse-Software: Kodieren und Auswerten übernehmen Werkzeuge wie MAXQDA — Subanana liefert das saubere Transkript dafür

Warum Forschende und Journalistinnen hier transkribieren

Abtippen kostet ein Vielfaches der Aufnahmezeit, Transkriptionsbüros kosten Geld und Tage — die Automatik liefert in Minuten.

  • Zitierfähig statt nur lesbarSprecherlabels, Zeitmarken und ein Wortlaut, den Sie im Editor an Ihre Transkriptionsregeln anpassen — mit direktem Sprung an jede Stelle der Aufnahme zum Nachhören.
  • Fachvokabular sitztNamen, Institutionen und Fachbegriffe einmal ins Glossar — einheitliche Schreibung in jedem Interview der Studie. Import als XLSX oder CSV, Glossare pro Projekt oder für den ganzen Arbeitsbereich.
  • Das Interview befragenIm Editor Fragen direkt an das Transkript stellen — „Wo spricht die Person über Datenschutz?“ — mit Antworten, die sich auf die betreffenden Passagen stützen.
  • Vertraulich behandeltWichtige Informationen werden vor der Verarbeitung unkenntlich gemacht, Inhalte werden nicht zum Training von KI-Modellen verwendet, und die Daten sind verschlüsselt gespeichert — relevant, wenn Interviewpartnern Vertraulichkeit zugesagt wurde.

Häufige FragenHäufig gestellte Fragen

Ja. Mit dem kostenlosen Konto sehen Sie das Transkript der ersten 15 Minuten jeder Datei, bis zu 3 Dateien im Monat, ohne Kreditkarte. So prüfen Sie an Ihrer eigenen Aufnahme, wie gut die Erkennung funktioniert — den Text kopieren und als Datei exportieren gehört zu den bezahlten Plänen.

Das Selbsttippen kostet erfahrungsgemäß ein Vielfaches der Aufnahmezeit, ein Transkriptionsbüro liefert oft erst nach Tagen. Die automatische Transkription läuft in Minuten durch — den Feinschliff im Editor machen Sie selbst, mit Sprung an jede Zeitmarke.

Ja. Jede Aussage erhält automatisch ein Sprecherlabel; die Sprecherzahl geben Sie vor oder lassen sie erkennen. Die Labels benennen Sie anschließend um — etwa „I:“ und „B:“ für Interviewerin und befragte Person.

Ja — Sprecherlabels, Zeitmarken und der Wortlaut bleiben im DOCX- und TXT-Export erhalten, damit Sie nach Ihren Transkriptionsregeln zitieren können. Ob geglättet oder wortnah: Den Wortlaut passen Sie im Editor an, bevor Sie exportieren.

Ja. Exportieren Sie als TXT oder DOCX und importieren Sie die Datei in Ihre QDA-Software — die Sprecherlabels bleiben als Text erhalten. Das Kodieren und Auswerten bleibt Aufgabe der Analyse-Software; Subanana liefert das Transkript dafür.

Durchschnittlich 98 % — abhängig von Aufnahmequalität, gleichzeitigem Sprechen und Fachvokabular. Ein gutes Aufnahmegerät nah an den Sprechenden hilft mehr als jede Nachbearbeitung; Fachbegriffe sichern Sie über das Glossar ab.

Wichtige Informationen werden vor der Verarbeitung unkenntlich gemacht, Ihre Inhalte werden nicht zum Training von KI-Modellen verwendet, und die Daten sind verschlüsselt gespeichert und geschützt.

Ja. Das Interview wird in der Originalsprache transkribiert und auf Wunsch in eine Zielsprache übersetzt — zum Beispiel das englische Experteninterview als deutscher Text. Eine Zielsprache pro Transkript, aus 95+ Sprachen.

Aktualisiert am 2026-08-28

Schluss mit dem Abtippen.

Aus Gesprochenem wirdArbeit, die Sie ausliefern können.

Kostenlos starten