Cobertura de dialecto: ambos lados del Atlántico
El español es uno de los idiomas más fuertes del modelo, solo en comparación con el inglés en la cobertura de entrenamiento. El español mexicano, colombiano, Rioplatense (Argentina/Uruguay, incluido el voseo), caribeño, andino y castellano, todos ellos transcriben en el nivel de máxima precisión del modelo.
La distinción vs seseo no importa a la salida: la transcripción está escrita en ortografía estándar de cualquier manera, con ñ, marcas de acento, e invertido â €.
Espanol y cambio de código
Con el lenguaje fijado al español (como está en esta página), los fragmentos en inglés son usualmente transcritos como palabras inglesas dentro del texto español en lugar de ser desfiguradas, pero los pasajes largos en inglés salen mejor si usas el transcriptor de autodetección en la página de inicio, que cambia por archivo.
Preguntas frecuentes
¿Se maneja el español latinoamericano y castellano por igual?
Sí. Los datos de entrenamiento sesgan ligeramente latinoamericanos por volumen, pero el castellano (incluyendo la distinción) se transcribe en el mismo nivel. Vocabulario regional —formas de vosotros, conjugaciones de voseo, jerga mexicana y argentina— está escrito como hablado.
¿Cuán exacta es la transcripción española?
El español se encuentra en el nivel de máxima precisión del modelo, normalmente dentro de un punto o dos de Inglés en audio claro — casi humano para el discurso de calidad de emisión. La precisión se sumerge en el discurso caribeño muy rápido y el crosstalk pesado, que es para lo que el editor incorporado es.
¿Saldrán acentos y ñ en el texto?
Sí. La salida es la ortografía española estándar: las marcas de pregunta/exclusivación invertidas son producidas automáticamente por el modelo. Se obtiene un español correctamente escrito, no una aproximación despojada de ASCII.
¿ Qué hay del español y el inglés mezclados?
Las frases cortas en inglés dentro del discurso español ("bien", nombres de marca, jerga de trabajo) se transcriben correctamente en esta página. Si su grabación es genuinamente mitad y mitad, utilice el cargador de autodetección en la página de inicio — las fuerzas españolas que fijan frases límite hacia la ortografía española.
¿Puedo transcribir audio español directamente en el texto inglés?
No en esta página — esto transcribe el discurso en español al texto en español, que es el camino correcto. Traducción automática de la transcripción después (con cualquier traductor que le guste) conserva mucho más significado que pedir un modelo de discurso para traducir en la marcha. Traducción de la transcripción está en nuestra hoja de ruta.
¿Está cubierto aquí el catalán, el gallego o el vasco?
No por esta página — son idiomas separados, no dialectos españoles. El modelo sí admite el catalán, el gallego y el vasco: subir a la página de inicio con autodetectar o fijar el idioma en las opciones allí.