Konvertera ljud till text

Ladda upp alla vanliga ljudformat och få en korrekt, redigerbar utskrift. Gratis utan registrering — Export TXT, SRT, eller VTT.

Ingen registrering Inget vattenmärke TXT · SRT · VTT export Filer automatiskt radera i 24h
Dra och släpp filen här
eller bläddra bland dina filer
Gratis: {0} filer per dag · upp till {1} min & {2} MB varje

Större filer eller fler uppladdningar? Gratis konto: 5 filer/dag, 1 timmes filer · Pro: 10 timmars filer + högtalaretiketter

0%
Laddar upp...
Håll fliken öppen – du kommer att omdirigeras till din utskrift.
MP3WAVM4AFLACOGGAACWMAOpus

Varje vanligt ljudformat, en transcriber

Denna sida accepterar ljudformat människor faktiskt har: MP3 och AAC från podcasts och nedladdningar, WAV och AIFF från inspelning redskap, M4A från iPhone och Android röst memo appar, FLAC från arkivet rips, OGG och Opus från meddelande appar, och WMA från äldre Windows-inspelare. Det finns ingen separat konverterare steg - transcriber decodes filen själv, så du behöver aldrig konvertera WAV till MP3 först.

Språket är automatiskt upptäckt över 90+ språk, eller så kan du sätta det i alternativen om din inspelning blandar språk och upptäckt gissar fel.

Från inspelning till användbar text

När den har bearbetats öppnas utskriften i en editor med tidstämpel per deltagare. Klicka på vilken rad som helst för att korrigera den, sök efter en fras, exportera sedan: TXT för dokument och anteckningar, SRT eller VTT om ljudet hör till en video. Inskrivna användare får också DOCX och PDF för att dela polerade dokument.

Vanliga frågor

Vilka ljudformat stöds?
MP3, WAV, M4A, FLAC, OGG, AAC, WMA, Opus, AIFF och AMR. Om din inspelningsapparat producerar något ovanligare, konvertera till WAV eller MP3 först med någon fri omvandlare kommer alltid att fungera - men prova den ursprungliga först; dekoder täcker de flesta behållare.
Kommer bullriga eller låg kvalitet inspelningar fungerar?
Vanligtvis, med caveats. Modellen är tränad på en hel del bristfälliga verkliga ljud, så väss, rum eko och kompression artefakter sällan bryta den. Vad som verkligen skadar noggrannhet är tal som är tyst i förhållande till ljudet — en inspelare långt från högtalaren, eller musik högre än rösten. Om du kan, spela in närmare källan; redaktören gör fixa de återstående felen snabbt.
Kan den hantera flera högtalare på ett spår?
Ja — allas ord transkriberas oavsett hur många människor talar. På den fria nivån säger inte utskriften vem som sa vad; högtalaretiketter (diarisering) är en Pro-funktion som taggar varje segment SPEAKER 1, SPEAKER 2, etc., och låter dig byta namn på dem i redaktören.
Får jag tidsstämpel?
Ja. Varje segment har start- och sluttider. I editorn kan du växla tidstämpel-visning på eller av, och SRT/VTT-exporten bäddade in dem i standardformat för textningstidpunkt. Exporten TXT är ren prosa utan tidsstämpel.
Kan jag redigera utskriften innan jag exporterar?
Ja — det är standardarbetsflödet. Avskriften öppnas i en editor där varje segment är klick-till-redigerat med automatisk spara. Fixa namn, jargong eller fel hörd ord, exportera sedan; dina redigeringar ingår i varje format.
Hur länge kan min ljudfil vara?
Anonym: 30 minuter / 100 MB per fil, 3 filer per dag. Gratis konto: 1 timme / 500 MB, 5 filer per dag. Pro eller en kredit pack: upp till 10 timmar och 5 GB per fil. Varaktighet är vad som betyder något — en lång, liten MP3 träffar locket innan en kort, stor WAV gör.