Cargando...
Mantenga esta pestaña abierta — usted será redirigido a su transcripción.
MP3WAVM4AFLACOGGAACWMAOpus
Cada formato de audio común, un transcriptor
Esta página acepta los formatos de audio que la gente tiene: MP3 y AAC de podcasts y descargas, WAV y AIFF de equipos de grabación, M4A de iPhone y Android aplicaciones de memo de voz, FLAC de archivos de arranques, OGG y Opus de aplicaciones de mensajería, y WMA de grabadoras de Windows anteriores. No hay paso de conversión separado — el transcriptor decodifica el archivo en sí mismo, por lo que nunca necesita convertir WAV a MP3 primero.
El lenguaje se detecta automáticamente a través de más de 90 idiomas, o puedes fijarlo en las opciones si tu grabación mezcla lenguajes y la detección adivina mal.
De la grabación al texto utilizable
Una vez procesada, la transcripción se abre en un editor con marcas de tiempo de per-sentencia. Haga clic en cualquier línea para corregirla, buscar una frase, luego exportar: TXT para documentos y notas, SRT o VTT si el audio pertenece a un vídeo. Los usuarios firmados también obtienen DOCX y PDF para compartir documentos pulidos.
Preguntas frecuentes
¿Qué formatos de audio son compatibles?
MP3, WAV, M4A, FLAC, OGG, AAC, WMA, Opus, AIFF y AMR. Si su grabador produce algo más raro, convertir a WAV o MP3 primero con cualquier convertidor gratuito siempre funcionará, pero pruebe el original primero; el decodificador cubre la mayoría de los contenedores.
¿Funcionarán las grabaciones ruidosas o de baja calidad?
Por lo general, con advertencias. El modelo está entrenado en un montón de audio del mundo real imperfecto, por lo que silbido, eco de habitación, y artefactos de compresión rara vez lo rompen. Lo que realmente duele la precisión es el habla que es silenciosa en relación con el ruido — un grabador lejos del altavoz, o música más fuerte que la voz. Si puede, grabar más cerca de la fuente; el editor hace que arreglar los errores restantes rápidamente.
¿Puede manejar múltiples altavoces en una sola pista?
Sí — las palabras de todos son transcritas independientemente de cuántas personas hablen. En el nivel libre la transcripción no dice quién dijo qué; las etiquetas de los oradores (diarización) son una característica Pro que etiqueta cada segmento speaker 1, speaker 2, etc., y le permite renombrarlas en el editor.
¿Me dan marcas de tiempo?
Sí. Cada segmento lleva tiempos de inicio y fin. En el editor puede activar o desactivar la pantalla de la marca de tiempo, y las exportaciones SRT/VTT los incrustan en formato estándar de tiempo de subtítulos. La exportación TXT es prosa limpia sin marcas de tiempo.
¿Puedo editar la transcripción antes de exportar?
Sí — ese es el flujo de trabajo predeterminado. La transcripción se abre en un editor donde cada segmento se hace clic en editar con auto-guardar. Fije nombres, jerga o palabras escuchadas erróneamente, luego exporte; sus ediciones se incluyen en cada formato.
¿Cuánto tiempo puede ser mi archivo de audio?
Anónimo: 30 minutos / 100 MB por archivo, 3 archivos al día. Cuenta gratuita: 1 hora / 500 MB, 5 archivos al día. Pro o un paquete de crédito: hasta 10 horas y 5 GB por archivo. La duración es lo que importa — un largo, pequeño MP3 golpea la tapa antes de que un corto, enorme WAV hace.