Как японцы выходят: сценарий и сегментация
Письменная запись написана так, как японский написана: натуральная смесь кандзи, хираганы и катаканы, выбранная контекстом — Δ ник, а не Δо, катакана для заёмных слов и иностранных имен, кана для грамматики. Включена японская пункция ( ) и так как японцы не используют пространства, текст подается несегментированным, точно так же, как и местный писатель.
Одно из последствий для субтитров: длина кие основана на фразе модели, а не на подсчетах слов. Экспорт SRT/VTT производит короткие, удобочитаемые ки, но японские субтитры (13-16 символов на строчку) могут означать, что вы разделили несколько кий в редакторе для субтитров в стиле телевещания.
Регистры и диалекты
Стандартный японский (острый) вид — встречи, лекции, подкасты, кейго-тяжелая деловая речь — является сильным костюмом модели и транскрипцией на высоком уровне. Кансай-бен и другие региональные формы обычно переносятся правильно или легко нормализуются; сильный региональный диалект от старших сельских ораторов (Тогоку, Кагосима) — это действительно трудный случай. Гомофонный японец означает, что модель иногда выбирает неправильный кандзи для имени, который стоит сканировать в редакторе.
Часто задаваемые вопросы
В стенограмме используются кандзи или кана?
Both, mixed naturally by context — standard written Japanese, not a romaji or all-kana rendering. Common words appear in kanji, grammatical elements in hiragana, loanwords and foreign names in katakana. Rare or ambiguous readings sometimes get the wrong kanji; those are quick edits.
Как с сегментацией можно справиться без пробелов?
Японский текст написан без пробелов, и стенограмма следует за этим соглашением. Сегменты разделены на естественные границы фраз с Δ и ο punctuation, вставленными моделью, так что текст читается как написанный японский, и SRT кувыри на краях фраз, а не как средний слов.
Насколько точен японский по сравнению с английским?
Высокий, но не более чем верхний европейский язык — японский акцент и огромный список гомофонов делают выбор кандзи главным источником ошибок, а не неправильно слышим. Студия с чистотой или звуком заседаний выпускает очень полезные стенограммы; в основном, пропуск от редактора - это проверка гомофона/канджи.
Кансай-бен и другие диалекты?
В средствах массовой информации достаточно широко распространено, что модель хорошо справляется с ней, обычно записывая диалектические формы, как говорят (о чем говорят (о ль, ~ ) отрицательно).
Можно мне английскую смс с японского аудио?
На этой странице готовится японский текст, который является точным. Для английского языка экспорт TXT и его машинный перевод — качество перевода на японский язык значительно выше на чистом, чем на прямом переводе. Перевод в программу работы.
Будет ли он заниматься кейго и бизнесом японским?
Да, вежливые и почетные регистры широко представлены в учебных данных (новостях, презентациях, взаимоотношениях с сервисами) и точно транскрипции, включая скромные/почитаемые формы глаголов.