Вақте ки шумо сабт мекунед, саҳифа равонро ба қисмҳои кӯтоҳ тақсим мекунад - ҳар як қисм чанд сония, тақсим карда мешавад, то ки навбатӣ дар ҳамон лаҳзае, ки пешина бармегардад, фиристода шавад - ва ҳар як қисмро ба серверҳои GPU- и мо, ки дар он ҷо ҳамон моделҳои Whisper- и синфӣ, ки тамоми сайтро таъмин мекунанд, онро ба зудӣ нусхабардорӣ мекунанд. Матн дар раванди зинда дар сонияҳои баъди овози шумо меафтад ва то он даме, ки шумо сухан мегӯед, равон мешавад. Ягон хидмати сухани браузер, API- и диктатсия аз тарафи сеюм - матни зинда Whisper- и воқеӣ аз сахтафзори мо мебошад.
Азбаски он танҳо ба сабти микрофон ниёз дорад, ҳолати зинда дар ҳар як браузери муосир кор мекунад - Chrome, Edge, Safari ва Firefox, мизи корӣ ва телефон. Ҳар як сегменти аудиоӣ аз серверҳои мо дар лаҳзаи баргаштани матни он нест карда мешавад.
& Тасвирот
Сегмент-по-сегменту транскрипция имеет один встроенный предел: модель видит несколько секунд в одно время, поэтому слово, которое пересекает два сегмента, может выйти изрезанным, и пунктуация через границы сегмента является предположением. Вот почему поток заканчивается одним шагом больше: полный запис хранится в браузере, пока вы говорите, и нажатие кнопки Транскрипция запускает его через модель как один прием - полный контекст, правильный пунктуация, временные метки, редактор и TXT/SRT/VTT экспорты.