Transcrição ao vivo

Aperte gravar e suas palavras vão direto para nossa IA — o texto aparece segundos atrás da sua voz, e uma transcrição caprichada chega quando você para.

Sem cadastro Sem marca d'água Exportação em TXT · SRT · VTT Arquivos apagados automaticamente em 24h
Arraste e solte seu arquivo aqui
ou procure seus arquivos
Grátis: {0} arquivos por dia · até {1} min e {2} MB cada
0:00
Projecto ao vivo
As palavras aparecem ao falar, transcritas ao vivo pela nossa própria IA — pressione Transcriba quando você terminar para a versão polida, editável.
O acesso ao microfone foi bloqueado — permita-o nas configurações do site do navegador ou faça upload de um arquivo.

Arquivos maiores ou mais uploads? Conta grátis: 5 arquivos/dia, arquivos de 1 hora · Pro: arquivos de 10 horas + rótulos de falantes

0%
Enviando…
Mantenha esta guia aberta — você será redirecionado para a sua transcrição.
Talks & speechesReal-time notesIn-room speechAccessibility

Ao vivo de verdade: sua fala vai direto para a nossa própria IA enquanto você fala

Enquanto você grava, a página fatia o fluxo do microfone em segmentos curtos — de poucos segundos cada, cortados de forma adaptativa para que o próximo seja enviado no momento em que o anterior volta — e manda cada um direto para nossos servidores de GPU, onde o mesmo modelo da classe do Whisper que move o site inteiro o transcreve na hora. O texto chega ao feed ao vivo segundos atrás da sua voz e continua fluindo enquanto você estiver falando. Nenhum serviço de fala do navegador, nenhuma API de ditado de terceiros — o texto ao vivo é saída real do Whisper no nosso próprio hardware.

Como só precisa da gravação do microfone, o modo ao vivo funciona em todo navegador moderno — Chrome, Edge, Safari e Firefox, no computador e no celular. Cada segmento de áudio é apagado dos nossos servidores no momento em que seu texto volta.

O feed ao vivo vs. a transcrição final

A transcrição segmento a segmento tem um limite embutido: o modelo vê poucos segundos por vez, então uma palavra que cai entre dois segmentos pode sair cortada, e a pontuação nas fronteiras entre segmentos é chute. Por isso o fluxo termina com mais um passo: a gravação completa fica no seu navegador enquanto você fala, e apertar Transcrever passa tudo pelo modelo de uma vez só — contexto completo, pontuação correta, timestamps, o editor e as exportações TXT/SRT/VTT.

Use o feed ao vivo para confirmar que ele está acompanhando e para copiar o texto assim que for falado (há um botão de copiar no feed); use a passada final para tudo o que você vai guardar. Para áudio que você já tem em arquivo, o modo de upload em qualquer página de ferramenta é o caminho mais curto.

Perguntas mais frequentes

Isso é ao vivo mesmo, ou grava e envia depois?
Ao vivo de verdade: gravação e transcrição se sobrepõem. A página envia cada fatia de poucos segundos de áudio para nossas GPUs enquanto você ainda está falando a próxima, então o texto vai se acumulando durante a gravação, não depois dela. Espere que o feed rode alguns segundos atrás da sua voz — o tempo de uma fatia terminar, subir e ser transcrita.
Por que o texto ao vivo fica alguns segundos atrás de mim?
Três pequenos atrasos amontoam: uma fatia tem que terminar de ser gravada (três segundos ou assim), viajar para o servidor e passar pelo modelo. Isso geralmente coloca o feed cerca de 4-8 segundos atrás de sua voz — e se as nossas GPUs estão brevemente ocupados, a página se adapta enviando fatias ligeiramente mais longas em vez de cair para trás. Falação natural com pausas se sente suave.
Em que navegadores o modo ao vivo funciona?
Todos os modernos — Chrome, Edge, Safari, e Firefox, no desktop e telefones. Ele depende da gravação padrão de microfone em vez de um serviço de fala do navegador, então funciona em Firefox, assim como em Chrome.
Para onde vai minha voz enquanto a transcrição ao vivo roda?
Só para os nossos servidores, descrito com honestidade: o modo ao vivo transmite seu áudio para nós em segmentos curtos enquanto você fala — é isso que o torna ao vivo — e cada segmento é apagado imediatamente depois que seu texto volta. Nada vai para o Google, a Apple ou qualquer serviço de fala de terceiros. A gravação completa fica no seu navegador até você apertar Transcrever, e transcrições anônimas se apagam automaticamente em até 24 horas.
Posso usá-lo para acompanhar uma reunião ou palestra na sala?
Como apoio pessoal, sim — deixe o aparelho perto de quem fala e o feed acompanha bem a fala clara, cerca de dez segundos atrás. Conheça os limites: é um microfone só, então vozes distantes e falas sobrepostas degradam o resultado, e não é um serviço de legendagem certificado para conformidade de acessibilidade. Aperte Transcrever no final e a passada com contexto completo geralmente recupera o que o feed ao vivo atrapalhou.
Quais idiomas funcionam ao vivo, e devo escolher um?
Os mesmos 90+ idiomas de qualquer transcrição neste site — é o mesmo modelo. Uma dica específica do modo ao vivo: escolha seu idioma no seletor em vez de deixar a detecção automática ligada. A detecção roda por segmento, e sete segundos não são muita evidência — fixar o idioma evita que o feed vacile em frases curtas ou com sotaque.