Audio in Text konvertieren

Laden Sie ein gängiges Audioformat hoch und erhalten Sie ein präzises, bearbeitbares Transkript. Kostenlos ohne Anmeldung — Export als TXT, SRT oder VTT.

Keine Anmeldung Kein Wasserzeichen Export als TXT · SRT · VTT Dateien löschen sich automatisch nach 24h
Ziehen Sie Ihre Datei hierher
oder Ihre Dateien durchsuchen
Kostenlos: {0} Dateien pro Tag · bis zu {1} Min. & {2} MB pro Datei

Größere Dateien oder mehr Uploads? Kostenloses Konto: 5 Dateien/Tag, 1-Stunden-Dateien · Pro: 10-Stunden-Dateien + Sprecher-Labels

0%
Hochladen...
Halten Sie diesen Tab offen – Sie werden zu Ihrem Transkript weitergeleitet.
MP3WAVM4AFLACOGGAACWMAOpus

Jedes gängige Audioformat, ein Transkriber

Diese Seite akzeptiert die Audioformate, die die Leute tatsächlich haben: MP3 und AAC von Podcasts und Downloads, WAV und AIFF von Aufnahmegerät, M4A von iPhone und Android Voice Memo Apps, FLAC von Archiv-Rips, OGG und Opus von Messaging-Apps, und WMA von älteren Windows-Recordern. Es gibt keinen separaten Schritt Konverter - der Transkriber entschlüsselt die Datei selbst, so dass Sie nie brauchen, WAV in MP3 zuerst konvertieren.

Sprache wird automatisch in 90+ Sprachen erkannt, oder Sie können sie in die Optionen stecken, wenn Ihre Aufnahme Sprachen mischt und Erkennungsraten falsch sind.

Von der Aufnahme zum nutzbaren Text

Nach der Bearbeitung öffnet sich das Transkript in einem Editor mit Per-Sentenz-Zeitstempeln. Klicken Sie auf eine Zeile, um es zu korrigieren, suchen Sie nach einem Satz, dann exportieren: TXT für Dokumente und Notizen, SRT oder VTT, wenn das Audio gehört zu einem Video. Signed-in Benutzer erhalten auch DOCX und PDF für die Freigabe polierter Dokumente.

Häufig gestellte Fragen

Welche Audioformate werden unterstützt?
MP3, WAV, M4A, FLAC, OGG, AAC, WMA, Opus, AIFF und AMR. Wenn Ihr Rekorder etwas seltener produziert, wird die Konvertierung in WAV oder MP3 zuerst mit jedem freien Konverter immer funktionieren – aber versuchen Sie es mit dem Original zuerst; der Decoder deckt die meisten Container.
Wird laute oder minderwertige Aufnahmen funktionieren?
Normalerweise mit Vorbehalten. Das Modell ist auf eine Menge unvollkommener Real-Welt-Audio trainiert, so dass Zischen, Raum Echo und Kompression Artefakte selten brechen. Was wirklich verletzt Genauigkeit ist Sprache, die ruhig im Verhältnis zum Rauschen ist — ein Rekorder weit vom Lautsprecher, oder Musik lauter als die Stimme. Wenn Sie können, nehmen Sie näher an der Quelle; der Editor macht die Festsetzung der verbleibenden Fehler schnell.
Kann es mehrere Lautsprecher auf einer Spur handhaben?
Ja – die Worte aller werden transkribiert, unabhängig davon, wie viele Menschen sprechen. Auf der freien Ebene sagt das Transkript nicht, wer was gesagt hat; Lautsprecheretiketten (Diarisierung) sind eine Pro-Funktion, die jedes Segment SPEAKER 1, SPEAKER 2 usw. markiert und Sie sie im Editor umbenennen lassen.
Bekomme ich Zeitstempel?
Ja. Jedes Segment führt Start- und Endzeiten. Im Editor können Sie die Zeitstempelanzeige ein- oder ausschalten, und die SRT/VTT-Exporte betten sie in das Standard-Untertitel-Timingformat ein. Der TXT-Export ist saubere Prosa ohne Zeitstempel.
Kann ich das Transkript vor dem Export bearbeiten?
Ja, das ist der Standard-Workflow. Das Transkript öffnet sich in einem Editor, in dem jedes Segment mit Autospeicher auf den Button zubearbeiten ist. Beheben Sie Namen, Jargon oder falsch verstandene Wörter, dann exportieren Sie; Ihre Bearbeitungen sind in jedem Format enthalten.
Wie lange kann meine Audiodatei dauern?
Anonym: 30 Minuten / 100 MB pro Datei, 3 Dateien pro Tag. Kostenloses Konto: 1 Stunde / 500 MB, 5 Dateien pro Tag. Pro oder ein Kreditpaket: bis zu 10 Stunden und 5 GB pro Datei. Dauer ist, was zählt – ein langer, kleiner MP3 trifft die Kappe, bevor ein kurzer, riesiger WAV tut.