Apasă înregistrarea şi cuvintele tale se îndreaptă direct spre AI - textul apare în spatele vocii tale şi un transcripţie lustruit în ţara în care te opreşti.
Nicio înscriere
Fără semn de apă
TXT · SRT · exporturi VTT
Decuparea automată a fișierelor în 24 ore
Aruncă și aruncă fișierul aici
sau navigați fișierele dumneavoastră
Gratuit: {0} fișiere pe zi · până la {1} min & {2} MB fiecare
0:00
Proiect de live
Cuvintele apar în timp ce vorbeşti, transcrise în direct de propria noastră AI — apăsaţi Transcrie când terminaţi pentru versiunea lustruită, editabilă.
Accesul la microfon a fost blocat — permiteți-l în setările site-ului browser-ului dumneavoastră, sau încărca un fișier în schimb.
De fapt, în direct: tuburile de discurs către propria noastră AI în timp ce vorbești
În timp ce înregistraţi, pagina se taie fluxul microfonului în segmente scurte — câteva secunde fiecare, tăiaţi adaptativ astfel încât următoarea nave va reveni în momentul în care acesta anterior vine — şi conduc fiecare direct la serverele noastre GPU, unde acelaşi model de Whisper de clasa care îi îndepărtă pe întregul site îl transcrie imediat. Textul aterizează în secundele de furaje în direct în spatele vocii şi continuă să curgă atât timp cât tot continui să vorbeşti. Nici un serviciu de dictare de browser, nici o API de dictare de terțe partie — textul live este real Whisper de ieșire din propriul nostru hardware.
Pentru că are nevoie doar de înregistrare microfon, live mode funcționează în fiecare browser modern — Chrome, Edge, Safari, și Firefox, desktop și telefon. Fiecare segment audio este șterse din serverele noastre în momentul în care textul său se întoarce.
Feed live vs. transcripția finală
Segment-by-segment transcription are o limită integrată: modelul vede câteva secunde la un moment dat, astfel un cuvânt care straddles două segmente pot iese prin cliped, și punctuarea de peste granițele segmentului este ghicire. De aceea fluxul se termină cu un pas mai mult: înregistrarea completă este păstrat în browser-ul tău în timp ce vorbești, și presarea Transcrie este executată prin model ca un singur moment — context complet, punctuarea adecvată, timelor horticoase, editorul și exporturile TXT/SRT/VTT.
Folosește feed live pentru a confirma că este păstrarea și pentru a obține text în momentul în care este vorbit (există un buton de copiere pe feed); utilizați pasul final pentru orice veți păstra. Pentru audio aveți deja ca fișier, modul de încărcare pe orice pagină de unelte este calea mai scurtă.
Întrebări frecvente
Este de fapt în direct, sau înregistrat și trimis după?
De fapt live: înregistrarea și transcripția suprapune. Pagina navează fiecare câteva secunde felie de audio la GPU-urile noastre în timp ce încă mai vorbeşti următoarea, așa că textul se acumulează în timpul înregistrării, nu după el. Așteaptă că hrana de a rula o mână de secunde în spatele vocei — timpul necesar pentru a termina, încărca și transcrie.
De ce textul live are câteva secunde în spatele meu?
Trei întârzieri mici se adună: o felie trebuie să termine înregistrarea (trei secunde sau mai mult), călătorie la server, și trece prin model. Asta pune de obicei hrana aproximativ 4-8 secunde în spatele vocii — și dacă GPU-urile noastre sunt brevi ocupate, pagina se adaptă prin trimiterea felie mai lungă în loc de a cădea în urmă.
În ce browser-uri funcționează modul live?
Toate cele moderne — Chrome, Edge, Safari, și Firefox, pe desktop și telefoane. Se bazează pe înregistrarea microfon standard, mai degrabă decât un serviciu de vorbire browser, așa că funcționează în Firefox, la fel de bine ca și în Chrome.
Unde merge vocea mea în timp ce tranziția în direct merge?
Pentru serverele noastre doar, și descrise sincer: live mode flucționează audio pentru noi în segmente scurte pe măsură ce vorbești — asta face să trăiască — și fiecare segment este eliminat imediat după ce textul său vine înapoi. Nimic nu merge la Google, Apple sau orice serviciu de vorbire terți. Înregistrarea completă rămâne în browser-ul tău până când apăs Transcribiți, și transcrie anonimi auto-deleete în 24 de ore.
Pot să-l folosesc pentru a urma o întâlnire sau o prelegere în cameră?
Ca ajutor personal, da — pune dispozitivul în apropiere de speaker și feed urmele clare vorbire bine, aproximativ zece secunde în urmă. Cunoașteți limitele: un microfon, voci atât de îndepărtate și crosstalk-ul degradează, și nu este un serviciu certificat de detindere pentru respectarea accesibilității. Presa Transcrie la sfârșitul și pasul de context complet recuperează de obicei ceea ce hrana live fumbled.
Care limbi lucrează în direct, și ar trebui să aleg una?
Aceeaşi limbi cu 90 de limbi ca fiecare transcription de pe acest site — este acelaşi model. Un tip specific pentru modul live: alege limba în selector în loc să părăsească auto-detecţia pe. Detecţia se execută pe segment, iar şapte secunde nu este o probă, aşa că ascunde limba menţine feed-ul de a vazuri pe fraze scurte sau accentuate.