Pindutin ang record at ang iyong mga salita stream nang direkta sa aming AI - teksto ay lilitaw segundo sa likod ng iyong boses, at isang pinakintab transcript lupa kapag tumigil ka.
Walang pag-sign up
Walang watermark
Ang mga sumusunod ay mga halimbawa ng mga palabas sa telebisyon:
File auto-tanggalin sa 24h
I-drag & drop ang iyong file dito
o mag-browse ng iyong mga file
Libre: {0} file sa isang araw · hanggang sa {1} min & {2} MB bawat isa
0:00
Mabuhay draft
Lumalabas ang mga salita habang nagsasalita ka, na isinalin ng aming sariling AI — pindutin ang Isalin kapag natapos ka para sa pinakintab, editable na bersyon.
Ang pag-access sa mikropono ay na-block — payagan ito sa mga setting ng site ng iyong browser, o mag-upload ng isang file sa halip.
aktwal na live: ang iyong mga pipe ng pagsasalita sa aming sariling AI habang nagsasalita ka
Habang nag-record ka, ang pahina ay pinutol ang stream ng microphone sa maikling segment — ilang segundo ang bawat isa, pinutol nang adaptively upang ang susunod na isa ay maglalayag sa sandaling bumalik ang nakaraang isa — at pinapalabas ang bawat isa nang direkta sa aming mga GPU server, kung saan ang parehong Whisper-class model na nagpapatakbo sa buong site ay agad na nag-transcribe nito. Ang teksto ay lumulutang sa live feed na mga segundo sa likod ng iyong boses at patuloy na dumadaloy hangga’t patuloy kang nagsasalita. Walang serbisyo ng boses ng browser, walang third-party na API sa pagdidikta — ang live na teksto ay tunay na Whisper output mula sa aming sariling hardware.
Dahil kailangan lamang nito ang pag-record ng mikropono, gumagana ang live mode sa bawat modernong browser - Chrome, Edge, Safari, at Firefox, desktop at telepono. Ang bawat segment ng audio ay tinanggal mula sa aming mga server sa sandaling bumalik ang teksto nito.
Ang live feed vs ang huling transcript
Ang segment-by-segment transcription ay may isang built-in na limitasyon: ang modelo ay nakikita ng ilang segundo sa isang pagkakataon, kaya ang isang salita na straddles dalawang segment ay maaaring lumabas na-clip, at punctuation sa pagitan ng mga hangganan ng segment ay haka-haka. Iyon ang dahilan kung bakit ang daloy ay nagtatapos sa isa pang hakbang: ang buong recording ay pinapanatili sa iyong browser habang nagsasalita ka, at ang pagpindot Transcribe tumatakbo ito sa pamamagitan ng modelo bilang isang solong kumuha - buong konteksto, tamang punctuation, timestamps, ang editor, at TXT / SRT / VTT exports.
Gamitin ang live feed upang kumpirmahin ito ay pagpapanatili up at upang makuha ang teksto sa sandaling ito ay sinabi (may isang kopya ng button sa feed); gamitin ang huling pass para sa anumang bagay na iyong iiwan. Para sa audio na mayroon ka na bilang isang file, i-upload mode sa anumang tool page ay ang mas maikling landas.
Mga madalas itanong na katanungan
Ito ba ay talagang live, o naitala at ipinadala pagkatapos?
Aktibong live: ang pag-record at transcription magkasabay. Ang pahina ships bawat ilang segundo slice ng audio sa aming GPUs habang ikaw ay pa rin nagsasalita ng susunod na isa, kaya ang teksto ay naipon sa panahon ng pag-record, hindi pagkatapos nito. Inaasahan ang feed upang tumakbo ng ilang segundo sa likod ng iyong boses — ang oras na ito ay tumatagal ng isang slice upang tapusin, mag-upload, at transcribe.
Bakit ang live na teksto ay ilang segundo sa likod ko?
Tatlong maliit na delays stack up: isang slice ay upang tapusin ang pagiging naitala (tatlong segundo o kaya), paglalakbay sa server, at pumasa sa pamamagitan ng modelo. Na karaniwang inilalagay ang feed tungkol sa4-8 segundo sa likod ng iyong boses — at kung ang aming GPUs ay sa maikling busy, ang pahina ay umaangkop sa pamamagitan ng pagpapadala ng bahagyang mas mahabang slices sa halip ng pagkahulog sa likod. Natural na pagsasalita na may pauses pakiramdam makinis.
Aling mga browser ay live mode trabaho sa?
Lahat ng mga modernong mga ito — Chrome, Edge, Safari, at Firefox, sa desktop at mga telepono. Ito ay umaasa sa standard microphone recording sa halip na isang serbisyo ng boses browser, kaya ito ay gumagana sa Firefox pati na rin sa Chrome.
Saan pupunta ang aking boses habang tumatakbo ang live na transcription?
Sa aming mga server lamang, at tapat na inilarawan: live mode streams iyong audio sa amin sa maikling segment bilang ikaw ay nagsasalita - na kung ano ang ginagawang live - at ang bawat segment ay tinanggal kaagad pagkatapos ng teksto nito ay bumalik. Walang bagay na napupunta sa Google, Apple, o anumang third-party na serbisyo ng pagsasalita. Ang buong pag-record ay natili sa iyong browser hanggang sa pindutin mo ang i-transcribe, at anonymous transcripts auto-tanggalin sa loob ng 24 na oras.
Maaari ko bang gamitin ito upang sundin ang isang pulong o lektura sa silid?
Bilang isang personal na tulong, oo — ilagay ang device malapit sa speaker at ang feed tracks malinaw na pagsasalita ng mabuti, tungkol sa sampung segundo sa likod. Alam ang mga limitasyon: isang microphone, kaya malayong tinig at crosstalk degrade ito, at ito ay hindi isang sertipikadong serbisyo ng captioning para sa accessibility compliance. Pindutin ang Transcribe sa dulo at ang buong-konteksto pass karaniwang recovers kung ano ang live feed fumbled.
Aling mga wika ang gumagana live, at dapat ba akong pumili ng isa?
Ang isang tip na partikular sa live mode: piliin ang iyong wika sa selector sa halip ng pag-iwan ng auto-detect sa. Detection tumatakbo sa bawat segment, at pitong segundo ay hindi marami ebidensiya, kaya pinning ang wika ay natiling ang feed mula sa pag-aalinlangan sa maikling o accented parirala.