Нажмите «Запись» — и ваши слова потоком идут в наш ИИ: текст появляется через несколько секунд после сказанного, а когда вы остановитесь, вас ждёт аккуратная итоговая расшифровка.
Без регистрации
Без водяных знаков
Экспорт в TXT · SRT · VTT
Файлы автоматически удаляются через 24 часа
Перетащите файл сюда
или выберите файл
Бесплатно: {0} файл(ов) в день · до {1} мин и {2} МБ каждый
0:00
В прямом эфире
Слова появляются, когда вы говорите, транслируемые в прямом эфире нашим собственным IA — нажмите транкрип, когда закончите с полированной, корректируемой версией.
Доступ к микрофонам был заблокирован — позволь ему загрузить файл в настройках сайта своего браузера.
Действительно вживую: ваша речь передаётся нашему собственному ИИ, пока вы говорите
Пока вы записываете, страница нарезает поток с микрофона на короткие сегменты — по несколько секунд каждый, причём длина подбирается адаптивно: следующий сегмент отправляется, как только вернулся предыдущий, — и передаёт их напрямую на наши GPU-серверы, где та же модель класса Whisper, что обслуживает весь сайт, сразу их расшифровывает. Текст появляется в живой ленте через несколько секунд после сказанного и продолжает идти, пока вы говорите. Никаких речевых сервисов браузера и сторонних API диктовки — живой текст это настоящий вывод Whisper с нашего собственного оборудования.
Поскольку нужна только запись с микрофона, живой режим работает в любом современном браузере — Chrome, Edge, Safari и Firefox, на компьютере и телефоне. Каждый аудиосегмент удаляется с наших серверов сразу, как только по нему вернулся текст.
Живая лента и итоговая расшифровка
У посегментной транскрипции есть одно врождённое ограничение: модель видит лишь несколько секунд за раз, поэтому слово на стыке двух сегментов может выйти обрезанным, а пунктуация на границах сегментов — угадывание. Поэтому в конце есть ещё один шаг: пока вы говорите, полная запись хранится в вашем браузере, и по нажатию «Расшифровать» она проходит через модель целиком — полный контекст, правильная пунктуация, таймкоды, редактор и экспорт в TXT/SRT/VTT.
Живая лента нужна, чтобы убедиться, что всё успевает, и сразу забирать текст по мере произнесения (на ленте есть кнопка копирования); для всего, что вы будете хранить, используйте итоговый проход. А если аудио уже есть файлом, короче загрузить его на любой странице инструмента.
Часто задаваемые вопросы
Это действительно в прямом эфире или записано и отправлено после?
Действительно вживую: запись и расшифровка идут внахлёст. Страница отправляет каждый сегмент аудио длиной в несколько секунд на наши GPU, пока вы ещё договариваете следующий, поэтому текст накапливается во время записи, а не после неё. Лента отстаёт от голоса на считанные секунды — столько занимает дозапись сегмента, его загрузка и расшифровка.
Почему живой текст отстаёт от меня на несколько секунд?
Три небольших задержки складываются: кусочек должен быть записан (три секунды или около того), перемещается на сервер и проходит через модель. Обычно сигнал отклоняется примерно на 4-8 секунд, и если наши GPU заняты, то страница адаптируется, посылая несколько более длинные кусочки вместо того, чтобы отставать. Естественная речь с паузами кажется гладкой.
В каких браузерах работает живой режим?
Все современные — Chrome, Edge, Safary и Firefox — настольных и телефонов.
Куда уходит мой голос во время живой транскрипции?
Только на наши серверы — и вот честное описание: живой режим передаёт нам ваше аудио короткими сегментами по мере того, как вы говорите (именно это делает его живым), и каждый сегмент удаляется сразу после того, как по нему вернулся текст. Ничего не уходит в Google, Apple или сторонние речевые сервисы. Полная запись остаётся в вашем браузере, пока вы не нажмёте «Расшифровать», а анонимные расшифровки автоматически удаляются в течение 24 часов.
Можно я воспользуюсь им, чтобы следить за встречей или лекцией в комнате?
Как личный помощник — да: положите устройство ближе к говорящему, и лента хорошо успевает за чёткой речью с отставанием около десяти секунд. Учитывайте ограничения: микрофон один, поэтому далёкие голоса и перекрёстные разговоры ухудшают результат, и это не сертифицированный сервис субтитров для целей доступности. Нажмите «Расшифровать» в конце — проход по полной записи обычно восстанавливает то, что живая лента упустила.
Какие языки работают вживую и нужно ли выбирать язык вручную?
Те же 90+ языков, что и у любой транскрипции на этом сайте — модель одна и та же. Один совет именно для живого режима: выберите язык в селекторе, а не оставляйте автоопределение. Язык определяется по каждому сегменту, а семи секунд для этого мало, поэтому зафиксированный язык не даёт ленте сбиваться на коротких фразах или речи с акцентом.