Converter Áudio para Texto

Envie qualquer formato comum de áudio e receba uma transcrição precisa e editável. Grátis e sem cadastro — exporte TXT, SRT ou VTT.

Sem cadastro Sem marca d'água Exportação em TXT · SRT · VTT Arquivos apagados automaticamente em 24h
Arraste e solte seu arquivo aqui
ou procure seus arquivos
Grátis: {0} arquivos por dia · até {1} min e {2} MB cada

Arquivos maiores ou mais uploads? Conta grátis: 5 arquivos/dia, arquivos de 1 hora · Pro: arquivos de 10 horas + rótulos de falantes

0%
Enviando…
Mantenha esta guia aberta — você será redirecionado para a sua transcrição.
MP3WAVM4AFLACOGGAACWMAOpus

Cada formato de áudio comum, um transcriber

Esta página aceita os formatos de áudio que as pessoas têm: MP3 e AAC de podcasts e downloads, WAV e AIFF de gravação, M4A de aplicativos de memo de voz iPhone e Android, FLAC de arquivos, OGG e Opus de aplicativos de mensagens, e WMA de gravadores mais antigos do Windows. Não há nenhum passo separado de conversor — o transcriber decodifica o arquivo em si, então você nunca precisa converter WAV para MP3 primeiro.

A língua é auto-detetada em mais de 90 idiomas, ou você pode pinhá-lo nas opções se a sua gravação mistura idiomas e detecção supõe errado.

De gravação a texto utilizável

Depois de processado, a transcrição abre em um editor com marcas horárias de per-sentência. Clique em qualquer linha para corrigi-la, procure uma frase, depois exporte: TXT para documentos e notas, SRT ou VTT se o áudio pertencer a um vídeo. Os usuários assinados também obtêm DOCX e PDF para compartilhar documentos polidos.

Perguntas mais frequentes

Que formatos de áudio são suportados?
MP3, WAV, M4A, FLAC, OGG, AAC, WMA, Opus, AIFF e AMR. Se o seu gravador produz algo mais raro, a conversão em WAV ou MP3 primeiro com qualquer conversor gratuito sempre funcionará — mas tente o original primeiro; o decodificador cobre a maioria dos recipientes.
As gravações ruidosas ou de baixa qualidade funcionam?
Normalmente, com caveats. O modelo é treinado em um monte de áudio imperfeito do mundo real, assim seu, eco de quarto e artefatos de compressão raramente quebram. O que realmente magoa a precisão é a fala que é silenciosa em relação ao ruído — um gravador longe do alto-falante, ou música mais alto do que a voz. Se você pode, grava mais perto da fonte; o editor faz corrigir os erros restantes rapidamente.
Pode lidar com vários alto-falantes numa única pista?
Sim — as palavras de todos são transcritas independentemente de quantas pessoas falam. Na linha livre a transcrição não diz quem disse o que; rótulos de alto-falante (diarização) são um recurso Pro que etiqueta cada segmento SPEAKER 1, SPEAKER 2, etc., e permite renomeá-los no editor.
Tenho tempos?
Sim. Cada segmento carrega os tempos de início e de fim. No editor você pode alternar o visor de tempo em ou desligado, e as exportações SRT/VTT as incorporam no formato padrão de tempo de tempo de subtítulos. A exportação TXT é limpo prosa sem tempo de tempo.
Posso editar a transcrição antes de exportar?
Sim — é o fluxo de trabalho padrão. A transcrição abre em um editor onde cada segmento é clicar-para-editar com auto-espaço. Corrigi nomes, jargão ou palavras erradas, então exporte; suas edições estão incluídas em cada formato.
Quanto tempo pode estar o meu arquivo de áudio?
Anônimo: 30 minutos / 100 MB por arquivo, 3 arquivos por dia. Conta grátis: 1 hora / 500 MB, 5 arquivos por dia. Pro ou um pacote de crédito: até 10 horas e 5 GB por arquivo. Duração é o que importa — um longo, pequeno MP3 atinge a tampa antes de um curto, enorme WAV faz.