Заправо, уживо: ваш говор цеви за нашу интелигенцију док причате
Док снимате, страница сече микрофонски ток у краће сегменте — по неколико секунди, сече прилагодљиво тако да следећи брод у тренутку када се претходни врати — и цеви свако право на наше ГПУ сервере, где исти Whisper- класа модел који покреће цео сајт одмах ограничава. Текст слеће у живом пренос секунде иза вашег гласа и наставља да тече док причате. Без сервиса за говор прегледач, без АПИ‐ а за диктацију треће стране — текст уживо је стваран Whisper излаз из нашег хардвера.
Зато што је потребно само снимање микрофона, режим уживо ради у сваком модерном прегледачу — Хрому, Еџу, Сафари и ФатФексу, површи и телефону. Сваки аудио сегмент се обрише са наших сервера чим се текст врати.
Пренос уживо против коначног транскрипта.
Препис сегмента по сегментима има једно уграђено ограничење: модел види неколико секунди истовремено, тако да реч која се издваја два сегмента могу изаћи из исечених, а интерпукција преко граница сегмента је нагађање. Зато се проток завршава још једним кораком: пун снимак се чува у вашем прегледачу док говорите, и притисак Транкрипта га протеже као један модел — пун контекст, исправна интерпукција, временски ознаке, уређивач и извоз ТXT/ СРТ/ ВТТ.
Користите довод уживо да потврдите да се држи и да ухватите текст чим се изговори (има дугме за копирање на доводу); користите коначни пролаз за све што ћете задржати. За аудио који већ имате као фајл, режим слања на било којој страници алатки је краћа путања.
Често постављана питања
Да ли је ово заправо живо, или снимљено и послато после?
Уживо: снимање и транскрипција се преклапају. Страница прелази сваки пар секунди на ГПУ док још увек говорите следећи, тако да текст накупља током снимања, а не после њега. Очекујете да ће довод покренути неколико секунди иза вашег гласа — време које треба да заврши, пребаци и транскриптира.
Зашто је текст уживо неколико секунди иза мене?
Три мала застоја се слажу: парче мора да се завршава (три секунди), да путује на сервер и прође кроз модел. То обично ставља довод око 4- 8 секунди иза вашег гласа — а ако су наши ГПУ- ови укратко заузети, страница се прилагођава послатим мало дуже парчиће уместо да заостаје. Природни говор са паузирањем изгледа глатко.
У ком режиму рада претраживача?
Сви модерни — Хром, Еџ, Сафари и Факстекстоп, на површи и телефоне. Ослања се на стандардни микрофонски снимак, а не на сервис говора у прегледачу, тако да ради у ФатФексфуксу као и у Хрому.
Где мој глас иде док живи транскрипција ради?
Само нашим серверима, и искрено описаним: у живом режиму ваш аудио претекне нам у кратким сегментима док говорите, то је оно што чини да живи, и сваки сегмент се обрише одмах након што се његов текст врати. Ништа не иде Гуглу, Еплу, ни било ком трећем страном сервису говора. Пуна снимања остаје у вашем прегледачу док не притиснете Транкриб и анонимне транскрипте аутоматски избришете у року од 24 сата.
Могу ли да га користим да пратим састанак или предавање у соби?
Као лична помоћ, да — ставите уређај близу звучника и доводне нумере јасног говора, око десет секунди иза. Знајте границе: један микрофон, тако удаљени гласови и унакрсно га деградирају, и то није сертификован сервис за потписивање приступачности. Притисните Транкрип на крају и пуни контекст пролаз обично опоравља оно што је пренос уживо покварио.
Који језици раде уживо, и да изаберем један?
Исти 90+ језика као и сваки транскрипција на овом сајту — исти је модел. Један сајт специфичан за живот: изаберите свој језик у селектору уместо да напустите аутодетекцију. Откривање ради по сегменту, а седам секунди није много доказа, па притискање језика спречава да се пренос ваља на кратким или нагласљеним фразама.