Как японски излиза: сценарий и сегментация
Преписът е написан по начина, по който японският всъщност е написано: естествен микс на кани, хирагана и катакана, избран по контекст - не , катакана за заем думи и чужди имена, кана за граматика. Японски интерпункция (и.) се вмъква, и тъй като японски не използва пространство, текстът тече несегументиран, точно като местен писател би го произвежда.
Един от последиците за субтитри: продължителността на сигнала се основава на сегментацията на фразата на модела, а не на броя на думите. Износът на SRT/VTT произвежда кратки, четени сигнали, но японските субтитри конвенции (13–16 символа на линия) може да означава, че разделяте няколко сигнала в редактора за излъчване-стил на надписи.
Регистрации и диалекти
Стандартен японски () – срещи, лекции, подкасти, кейго-тежки бизнес реч — е силен модел на строгата страна и транскриптьорите на високо ниво. Кансай-бен и други регионални форми обикновено се превеждат правилно или леко нормализират; силен регионален диалект от по-старите селски говорители (Тогоку, Кагошима) е истински труден случай. Хомофон-тежкия японски означава, че моделът понякога избира грешен канджи за име — струва си сканиране в редактора.
Често задавани въпроси
В преписа ли се използва канджи или кана?
И двете, смесени по естествено контекст — стандартна писано японски, не ромаджи или всички-кана. Обикновени думи се появяват в канджи, граматически елементи в хирагана, заеми и чуждестранни имена в катакана. Редки или двусмислени четения понякога получават грешен канджи; това са бързи редакции.
Как се управлява сегментацията без пространства?
Японски текст е написан без пространства и транскрипт следва тази конвенция. Сегменти са разделени на естествените граници на фрази с. И. интерпункция, вкарани от модела, така че текстът се чете като писмена японски, и SRT сигнали се разбиват на фрази ръбове, отколкото средната дума.
Колко точно японски е в сравнение с английски?
Висока, но черпа под топ европейски езици – японският акцент и масивен хомофонен инвентар на японците правят канджи избор на основния източник на грешки, а не погрешно чуване. Изчистено студио или среща аудио произвежда много приложими транскрипти; пропускът е най-вече хомофон/кањи проверки.
Кансай-бен и други диалекти?
Кансай-бен е достатъчно общ в медиите, че моделът се справя добре, обикновено пишейки диалект формуляри както са изречени (по-скоро отрицателни). Тежките регионални диалекти — селски Тохоку, Окинавски-влияна реч — деградира точността. Стандартните регистъри с регионални акценти не са проблем.
Може ли английски текст от японски аудио?
Тази страница произвежда японски транскрипт, който е точният път. За английски, изнесете TXT и машина-превод — японски→Английски превод качество е много по-високо върху чист текст от направо реч превод. In-app превод е на пътната карта.
Ще се справи ли с кейго и бизнеса японски?
Да — учтивите и почетни регистри са силно представени в тренировъчните данни (новини, презентации, взаимодействия в услугата) и транскриптиране точно, включително скромни/честиви глаголи. Възможната реч с контракции (доклади, ) също излиза както е изказано.