Shtypni regjistro dhe fjalët tuaja do të rrjedhin drejtpërdrejt tek AI jonë - teksti shfaqet sekonda pas zërit tuaj, dhe një transkriptim i mprehtë zbrit kur ndaloni.
Pa regjistrim
Pa shenjë uji
Eksporti TXT · SRT · VTT
Files auto-fshihen në 24 orë
Tërhiq dhe lësho file këtu
ose Shfleto file tuaja
Pa pagesë: {0} file në ditë · deri në {1} min & {2} MB secili
0:00
Kopjo
Fjalët shfaqen ndërsa flisni, të transkriptuara drejtpërdrejt nga AI jonë — shtyp Transcribe kur të përfundosh për versionin e rafinuar, të editueshme.
Hyrja në mikrofon është bllokuar - lejo këtë në rregullimet e browser-it të site-it, ose ngarko një file.
Në fakt, jeton: fjalimi juaj i shkon tek AI-ja jonë ndërsa ju flisni
Ndërsa regjistroni, faqe e copton mikrofonin në segmente të shkurtra - disa sekonda secili, e prerë adaptivisht në mënyrë që të ardhmja të dërgohet në momentin që e para kthehet - dhe e dërgon çdo segment drejtpërdrejt tek serverat e GPU-ve tona, ku i njëjti model i klasës Whisper që e furnizon të gjithë faqen e transkripton atë menjëherë. Teksti mbërrin në feed-in e drejtpërdrejtë disa sekonda pas zërit tuaj dhe vazhdon të rrjedhë për aq sa vazhdoni të flisni. Pa shërbim të foljes të shfletuesit, pa API të diktimit të të tretave - teksti i drejtpërdrejtë është real Whisper nga hardware-i ynë.
Për shkak se ka nevojë vetëm për regjistrimin e mikrofonit, modaliteti i drejtpërdrejtë punon në çdo shfletues modern — Chrome, Edge, Safari dhe Firefox, desktop dhe telefon. Çdo segment audio fshihet nga serverat tanë në momentin që teksti i tij kthehet.
Fluturimi i drejtpërdrejtë kundër transkriptimit përfundimtar
Transkriptimi segment-për-segment ka një kufizim të ndërtuar: modeli sheh disa sekonda në një kohë, kështu që një fjalë që shtrihet në dy segmente mund të dalë e shkurtuar, dhe pikëprerja në kufijtë e segmenteve është e paramenduar. Kjo është pse rrjedhja përfundon me një hap më shumë: regjistrimi i plotë mbahet në shfletuesin tuaj ndërsa flisni, dhe duke shtypur Transcribe e bën atë të ecë nëpër model si një të vetme të marrë — konteksti i plotë, pikëprerja e duhur, shtyllat e kohës, editori dhe eksportet TXT/SRT/VTT.
Përdor feed-in e drejtpërdrejtë për të konfirmuar që është duke vazhduar dhe për të marrë tekstin në momentin që është folur (ka një buton kopjimi tek feed-i); përdore pasqyrimin përfundimtar për çdo gjë që do të mbash. Për audion që tashmë e ke si file, modaliteti i ngarkimit në çdo faqe instrumenti është rruga më e shkurtër.
Pyetja e shpeshtë
A është kjo në të vërtetë e drejtpërdrejtë, apo e regjistruar dhe e dërguar më pas?
Aktualisht në kohë reale: regjistrimi dhe transkriptimi mbizotërojnë. Faqja dërgon çdo copë audio me disa sekonda tek GPU-të tona ndërsa ju ende flisni atë të ardhshme, kështu që teksti akumulohet gjatë regjistrimit, jo pas tij. Prit që furnizimi të fillojë disa sekonda pas zërit tënd — koha që i duhet një copë për të përfunduar, ngarkuar dhe transkriptuar.
Pse është teksti i drejtpërdrejtë disa sekonda pas meje?
Tre vonesa të vogla vijnë së bashku: një copë duhet të përfundojë regjistrimin (tre sekonda ose diçka e tillë), udhëton në server dhe kalon nëpër model. Kjo zakonisht e vë feed-in rreth 4-8 sekonda prapa zërit tënd — dhe nëse GPU-të tona janë të zënë për pak kohë, faqe përshtatet duke dërguar copëza pak më të gjata në vend të mbetur prapa. Fjalimi natyror me pauza ndjehet i rrjedhshëm.
Në cilat shfletues punon modaliteti i drejtpërdrejtë?
Të gjitha modernet — Chrome, Edge, Safari dhe Firefox, në desktop dhe në telefon. Kjo mbështetet në regjistrimin e mikrofonit standard në vend të një shërbimi të foljes së shfletuesit, kështu që punon në Firefox po aq mirë sa në Chrome.
Ku shkon zëri im kur transkriptimi është në xhirim?
Vetëm për serverat tanë, dhe përshkruar sinqerisht: modaliteti i drejtpërdrejtë transmeton audion tuaj tek ne në segmente të shkurtër ndërsa flisni — kjo është ajo që e bën të drejtpërdrejtë — dhe çdo segment fshihet menjëherë pasi të kthehet teksti i tij. Asgjë nuk shkon tek Google, Apple, apo ndonjë shërbim i tretë i fjalës. Regjistrimi i plotë qëndron në shfletuesin tuaj derisa të shtypni Transkribo, dhe transkriptat anonime fshihen automatikisht brenda 24 orëve.
A mund ta përdor për të ndjekur një takim apo leksion në dhomë?
Si ndihmë personale, po — vendos pajisjen pranë folësit dhe feed-i ndjek fjalën e qartë mirë, rreth dhjetë sekonda prapa. Di kufijtë: një mikrofon, kështu që zërat e largët dhe crosstalk-i e degradojnë atë, dhe nuk është një shërbim i certifikuar i subtitrimit për përshtatshmërinë e përshtatshmërisë. Shtyp Transkribo në fund dhe pasa e plotë e kontekstit zakonisht rimerr atë që feed-i i drejtpërdrejtë ka humbur.
Cilat gjuhë punojnë në të vërtetë, dhe duhet të zgjedh një?
Të njëjtat 90+ gjuhë si çdo transkriptim në këtë faqe — është i njëjti model. Një këshillë e veçantë për modalitetin e drejtpërdrejtë: zgjedh gjuhën tënde në zgjedhës në vend që të lësh auto-zbulimin të aktivizuar. Zbulimi kryhet për segment dhe shtatë sekonda nuk janë shumë prova, kështu që fiksimi i gjuhës e mban feed-in të qëndrojë në fraza të shkurtra apo me theks.