Транскрипция японского аудио в текст
日本語 в грамотный письменный текст — кандзи, кана и пунктуация на месте. Бесплатно, без аккаунта.
Нужны файлы побольше или больше загрузок? Бесплатный аккаунт: 5 файлов в день, файлы до 1 часа · Pro: файлы до 10 часов + метки спикеров
Как японцы выходят: сценарий и сегментация
Письменная запись написана так, как японский написана: натуральная смесь кандзи, хираганы и катаканы, выбранная контекстом — Δ ник, а не Δо, катакана для заёмных слов и иностранных имен, кана для грамматики. Включена японская пункция ( ) и так как японцы не используют пространства, текст подается несегментированным, точно так же, как и местный писатель.
Одно из последствий для субтитров: длина кие основана на фразе модели, а не на подсчетах слов. Экспорт SRT/VTT производит короткие, удобочитаемые ки, но японские субтитры (13-16 символов на строчку) могут означать, что вы разделили несколько кий в редакторе для субтитров в стиле телевещания.
Регистры и диалекты
Стандартный японский (острый) вид — встречи, лекции, подкасты, кейго-тяжелая деловая речь — является сильным костюмом модели и транскрипцией на высоком уровне. Кансай-бен и другие региональные формы обычно переносятся правильно или легко нормализуются; сильный региональный диалект от старших сельских ораторов (Тогоку, Кагосима) — это действительно трудный случай. Гомофонный японец означает, что модель иногда выбирает неправильный кандзи для имени, который стоит сканировать в редакторе.