Zum Inhalt springen

Kostenlose Vorschau

Interview-Transkription online

Lade eine Interview-Aufnahme hoch und erhalte die ersten 5 Minuten als Text mit getrennt ausgewiesenem Interviewer und Teilnehmer. Kein Konto, automatische Spracherkennung, Datei wird nach der Verarbeitung gelöscht.

  • Kostenlose Vorschau: erste 5 Minuten
  • Wird nach der Verarbeitung gelöscht
  • Keine Anmeldung erforderlich

Interviewaufnahme hier ablegen

oder

Unterstützt MP3, M4A, WAV, OGG/OPUS, AAC, FLAC und WEBM

So funktioniert es

Interview-Transkription online in drei Schritten

01

Interview-Audio hochladen

Telefonaufnahme, Zoom-Audioexport oder Diktiergerät-Datei. Der Browser behält die ersten 5 Minuten.

02

Sprecher werden markiert

Interviewer und Teilnehmer erhalten getrennte Labels mit Zeitstempeln. Sprache wird automatisch erkannt.

03

In deine Analyse übernehmen

Als .txt herunterladen oder Text kopieren. Das ganze Interview läuft in der App weiter.

Von der Aufnahme zum zitierfähigen Text

Ob Forschungsinterview für eine Abschlussarbeit, Quelle für einen Artikel oder Nutzerinterview für ein Produkt — die Aufnahme wird erst brauchbar, wenn sie als Text vorliegt: codierbar, zitierbar, durchsuchbar. Von Hand transkribiert braucht eine Stunde Audio vier bis sechs Stunden Arbeit. Diese Seite zeigt an den ersten 5 Minuten deiner eigenen Aufnahme, wie die automatische Variante aussieht, bevor du den Rest der App übergibst.

Wer sagt was

Interviews sind Zwei-Stimmen-Aufnahmen, und das Transkript bildet das ab: Jeder Redebeitrag wird mit Sprecher A oder Sprecher B und einem Zeitstempel versehen, sodass die Fragen des Interviewers und die Antworten der teilnehmenden Person getrennt bleiben. Bei dreiköpfigen Gesprächsrunden funktioniert es genauso. Die Kennzeichnung bleibt über das ganze Transkript konsistent — Sprecher B in Minute eins ist auch in Minute vier Sprecher B —, und genau das macht eine Codierung nach Befragten möglich.

Was die Vorschau macht

Dein Browser liest die Datei ein und behält die ersten 5 Minuten, längere Aufnahmen werden lokal zugeschnitten und dieser Ausschnitt als 16-kHz-Mono-WAV neu codiert, sodass der Rest nie hochgeladen wird. Das Audio läuft über eine verschlüsselte Verbindung zur Transkriptions-Engine hinter der SozAI-App (AssemblyAI). Die Sprache wird automatisch aus 99 Sprachen erkannt, Zeichensetzung wird ergänzt und Füllwörter werden leicht bereinigt — ein gut lesbares Transkript, kein striktes Verbatim. Sobald der Text geliefert ist, werden Audio und Transkript beim Anbieter gelöscht.

Formate und Grenzen

  • M4A, MP3, WAV, AAC, FLAC, OGG/OPUS, WEBM, bis 25 MB unverändert; längere Aufnahmen werden zuerst im Browser auf 5 Minuten zugeschnitten (bis 30 MB am Computer, 12 MB am Smartphone).
  • Drei Vorschauen pro Gerät und Tag, ohne Konto.
  • Telefonate, über Lautsprecher aufgenommen, und Interviews über einen Cafétisch hinweg werden beide transkribiert, mit mehr Fehlern bei der leiseren Stimme.

Einwilligung und Vertraulichkeit

Eine Person aufzunehmen setzt fast überall ihre Einwilligung voraus, und Ethikkommissionen verlangen diese meist schriftlich. Am Transkribieren ändert das nichts. Wenn dein Protokoll vorschreibt, wo Audio verarbeitet werden darf: Die Vorschau wird von einem Anbieter mit Sitz in den USA verarbeitet, sofern die Seite nicht auf den EU-Endpunkt eingestellt ist — für alles, was unter eine Datenvereinbarung fällt, nutze die Projekteinstellungen der App.

Das ganze Interview

Ein einstündiges Interview entspricht zwölf Vorschauen an Audio. Die SozAI-App transkribiert es in einem Durchgang, behält die Sprecherkennzeichnung, erstellt eine Zusammenfassung der Themen und speichert jedes Interview in einer durchsuchbaren Bibliothek. Import aus Diktiergerät-Apps, aus Dateien oder einer geteilten Aufnahme. Die ersten 30 Minuten sind kostenlos.

Antworten

Interview-Transkription — häufig gestellte Fragen

Erkennt das Tool, wer gerade spricht?

Ja. Jeder Redebeitrag wird mit Sprecher A, Sprecher B und so weiter samt Zeitstempel gekennzeichnet, und die Zuordnung bleibt über das ganze Transkript konsistent. Namen werden nicht erraten; du benennst die Labels in deinem Dokument oder in der App um.

Ist das Transkript wortwörtlich?

Es ist ein glatt lesbares Transkript: Zeichensetzung wird ergänzt und offensichtliche Füllwörter werden entfernt, damit sich der Text natürlich liest. Wenn deine Methode jedes 'ähm' und jeden Fehlstart verlangt, halte das im Protokoll fest und rechne damit, einige davon von Hand nach Gehör zu ergänzen.

Welche Sprachen funktionieren?

Die Sprache wird automatisch aus 99 Sprachen erkannt. Ein Interview, das überwiegend in einer Sprache geführt wird und gelegentlich Wörter aus einer anderen enthält, wird in der vorherrschenden Sprache transkribiert.

Wie lang darf die Aufnahme für die Vorschau sein?

Beliebig lang, aber du erhältst nur die ersten 5 Minuten. Dateien bis 25 MB werden vollständig gesendet; längere Aufnahmen werden zuerst im Browser auf 5 Minuten zugeschnitten (bis 30 MB am Computer, 12 MB am Smartphone).

Wo wird das Audio verarbeitet und wird es gespeichert?

Es wird über eine verschlüsselte Verbindung an den Transkriptionsanbieter gesendet (AssemblyAI, US-Region, sofern nicht der EU-Endpunkt aktiviert ist), transkribiert und dort zusammen mit dem Transkript gelöscht, sobald es geliefert ist. Diese Seite speichert weder das eine noch das andere.

Reicht das für Zwecke der Forschungsethik?

Das hängt von den Regeln deiner Ethikkommission zur Verarbeitung durch Dritte ab. Die Vorschau ist für eine schnelle Prüfung deiner eigenen Aufnahme gedacht. Für Interviews, die unter eine Datenvereinbarung fallen, lies die Sicherheitsseite von SozAI und nutze die App, wo die vollständige Aufnahme unter einem Konto verarbeitet wird.

Kann ich ein aufgezeichnetes Telefonat oder einen Zoom-Anruf transkribieren?

Ja, sofern eine Audiodatei vorliegt: Zoom und Teams können reine Audioaufnahmen (.m4a) speichern, und Anruf-Rekorder erzeugen MP3 oder M4A. Zwei Stimmen auf einem Kanal werden trotzdem getrennt.

Wie genau ist das Ergebnis?

Bei einer ruhigen, nah aufgenommenen Aufnahme kommt das Transkript nah an ein Verbatim heran. Ein Telefon auf einem Cafétisch zwischen zwei Personen verliert in der Regel ein paar Wörter der leiseren Stimme. Die Sprecherkennzeichnung ist am zuverlässigsten, wenn sich die Stimmen deutlich unterscheiden.

Die ganze Aufnahme, nicht nur die ersten Minuten

Nimm auf oder importiere beliebig lange Aufnahmen in der App: Sprecherkennzeichnung, Zeitstempel, eine Zusammenfassung und Übersetzung in über 100 Sprachen.

App herunterladen — Kostenlos

Kostenlos für iOS und Android. 30 Minuten Transkription inklusive, keine Kreditkarte nötig.