Trascrizione in diretta

Premi registra e le tue parole arrivano in streaming alla nostra IA — il testo appare pochi secondi dopo la tua voce, e allo stop ricevi una trascrizione rifinita.

Senza registrazione Nessuna filigrana Esportazioni TXT · SRT · VTT I file si eliminano automaticamente in 24h
Trascina e rilascia il tuo file qui
oppure sfoglia i tuoi file
Gratis: {0} file al giorno · fino a {1} min e {2} MB ciascuno
0:00
Bozza viva
Le parole appaiono mentre si parla, trascritto dal vivo dalla nostra AI
L'accesso al microfono è stato bloccato

File più grandi o più upload? Account gratuito: 5 file al giorno, file da 1 ora · Pro: file da 10 ore + etichette dei parlanti

0%
Caricamento...
Tieni aperta questa scheda — verrai reindirizzato alla tua trascrizione.
Talks & speechesReal-time notesIn-room speechAccessibility

Davvero in diretta: la tua voce arriva alla nostra IA mentre parli

Mentre si registra, la pagina taglia il flusso del microfono in segmenti brevi • alcuni secondi ciascuno, tagliare adattativamente in modo che il prossimo navi il momento che quello precedente torna • e tubi ciascuno dritto ai nostri server GPU, dove lo stesso modello di classe Whisper che alimenta l'intero sito lo trascrive immediatamente. Il testo atterra nei secondi di alimentazione dal vivo dietro la vostra voce e continua a scorrere fino a quando si continua a parlare. Nessun servizio di parola del browser, nessuna dittatura di terze parti API • il testo dal vivo è reale Whisper uscita dal nostro hardware.

Poiché richiede solo la registrazione dal microfono, la modalità live funziona su ogni browser moderno — Chrome, Edge, Safari e Firefox, desktop e telefono. Ogni segmento audio viene eliminato dai nostri server nel momento in cui il suo testo torna indietro.

Il feed live e la trascrizione finale a confronto

La trascrizione segmento per segmento ha un limite intrinseco: il modello vede pochi secondi alla volta, quindi una parola a cavallo di due segmenti può uscire tagliata, e la punteggiatura ai confini tra segmenti è tirata a indovinare. Per questo il flusso termina con un passaggio in più: la registrazione completa resta nel tuo browser mentre parli, e premendo Trascrivi viene elaborata dal modello come un'unica ripresa — contesto completo, punteggiatura corretta, timestamp, l'editor e gli export TXT/SRT/VTT.

Usa il feed live per verificare che stia al passo e per copiare il testo appena pronunciato (c'è un pulsante di copia sul feed); usa il passaggio finale per tutto ciò che vuoi conservare. Per l'audio che hai già come file, la modalità di caricamento su qualsiasi pagina degli strumenti è la via più breve.

Domande frequenti

È davvero in diretta o viene registrato e inviato dopo?
Davvero in diretta: registrazione e trascrizione si sovrappongono. La pagina invia ogni spezzone audio di pochi secondi alle nostre GPU mentre stai ancora pronunciando il successivo, quindi il testo si accumula durante la registrazione, non dopo. Aspettati che il feed resti una manciata di secondi dietro la tua voce — il tempo perché uno spezzone finisca, venga caricato e trascritto.
Perché il testo in diretta è qualche secondo dietro di me?
Tre piccoli ritardi si accumulano: una fetta deve finire di essere registrata (tre secondi o giù di lì), viaggiare al server, e passare attraverso il modello. Questo di solito mette il feed circa 4-8 secondi dietro la voce Hoppenstedt e se le nostre GPU sono brevemente occupato, la pagina si adatta inviando fette leggermente più lunghe invece di cadere dietro.
In quale browser funziona la modalità live?
Tutti quelli moderni Chrome, Bordo, Safari, e Firefox, sul desktop e telefoni. Si basa sulla registrazione del microfono standard piuttosto che un servizio di parola del browser, in modo che funziona in Firefox così come in Chrome.
Dove va la mia voce durante la trascrizione in diretta?
Solo ai nostri server, detto con onestà: la modalità live ci trasmette il tuo audio in brevi segmenti mentre parli — è questo che la rende live — e ogni segmento viene eliminato subito dopo che il suo testo è tornato. Nulla va a Google, Apple o ad altri servizi vocali di terze parti. La registrazione completa resta nel tuo browser finché non premi Trascrivi, e le trascrizioni anonime si eliminano da sole entro 24 ore.
Posso usarlo per seguire una riunione o una lezione in sala?
Come supporto personale, sì — metti il dispositivo vicino a chi parla e il feed segue bene un parlato chiaro, circa dieci secondi indietro. Conosci i limiti: un solo microfono, quindi voci lontane e sovrapposte lo degradano, e non è un servizio di sottotitolazione certificato per la conformità sull'accessibilità. Premi Trascrivi alla fine e il passaggio sull'intero contesto di solito recupera ciò che il feed live si è perso.
Quali lingue funzionano dal vivo e devo sceglierne una?
Le stesse 90+ lingue di ogni trascrizione su questo sito — il modello è lo stesso. Un consiglio specifico per la modalità live: scegli la lingua nel selettore invece di lasciare il rilevamento automatico. Il rilevamento avviene per segmento, e sette secondi non sono molti indizi: fissare la lingua evita che il feed oscilli su frasi brevi o con accento.