Ako japončina vychádza: skript a segmentácia
Prepis je napísaný tak, ako sa japončina píše: prirodzená zmes kanji, hiragana a katakana, vybraná podľa kontextu - 会議 nie かいぎ, katakana pre požičané slová a cudzie názvy, kana pre gramatiku. Japonská interpunkcia (、 a 。) je vložená, a keďže japončina nepoužíva medzery, text tečie bez segmentov, presne tak, ako by to urobil rodák.
Exporty SRT/VTT produkujú krátke, čitateľné stopy, ale japonské konvencie titulkov (13 – 16 znakov na riadok) môžu znamenať, že v editore rozdelíte niekoľko stop na titulky v štýle vysielania.V prípade japonských titulkov (13 – 16 znakov na riadok) sa môže stať, že v editore rozdelíte niekoľko stop na titulky v štýle vysielania.
Registre a dialekty
Štandardné japonské (標準語) — stretnutia, prednášky, podcasty, obchodné reči s veľkým množstvom keigo — je silnou stránkou modelu a prepisuje na vysokej úrovni. Kansai-ben a iné regionálne formy sú zvyčajne vykreslené správne alebo mierne normalizované; silný regionálny dialekt od starších vidieckych hovoriacich (Tōhoku, Kagoshima) je skutočne ťažký prípad. Homofónne japonské znamená, že model občas vyberie nesprávne kanji pre meno — stojí za to skenovanie v editore.
Často kladené otázky
Používa sa v prepise kanji alebo kana?
Obidve, prirodzene zmiešané kontextom – štandardná japončina, nie romadži alebo úplne kana. Bežné slová sú v kanji, gramatické prvky v hiragane, pôžičky a cudzie mená v katakane. Zriedkavé alebo nejednoznačné čítanie niekedy dostane nesprávne kanji; to sú rýchle úpravy.
Ako sa spracováva segmentácia bez medzier?
Japonský text je písaný bez medzier a prepis nasleduje túto konvenciu. Segmenty sú rozdelené na prirodzené hranice frázy s interpunkciou 、and 。 vloženou modelom, takže text sa číta ako písaná japončina a SRT signály sa lámu na okrajoch frázy namiesto v strede slova.
Ako presné je japončina v porovnaní s angličtinou?
Vysoká, ale pod úrovňou najlepších európskych jazykov – japonský prízvuk a obrovský počet homofónnych znakov spôsobujú, že výber kanji je hlavným zdrojom chýb skôr ako nesprávne počutie. Čisté štúdiové alebo schôdzkové audio produkuje veľmi použiteľné prepisy. Editorský priechod je väčšinou homofónna/kandži kontrola.
Kansai-ben a iné dialekty?
Kansai-ben je v médiách dosť bežný, že model ho zvláda dobre, zvyčajne píše dialektové formy ako hovorené (negatívne あかん, ~へん). Ťažšie regionálne dialekty - vidiecke Tōhoku, Okinawa-ovplyvnená reč - značne znižujú presnosť. Hovoriaci štandardného registra s regionálnymi prízvukmi nie sú problém.
Môžem získať anglický text z japonského zvuku?
Táto stránka vytvára japonský prepis, ktorý je presnou cestou. Pre angličtinu exportujte TXT a strojovo ho preložte - kvalita prekladu japončina → angličtina je oveľa vyššia pri čistom texte ako pri priamom preklade reči.
Zvládne keigo a obchodné japončiny?
Áno — slušné a čestné registre sú silne zastúpené v tréningových dátach (správy, prezentácie, interakcie so službami) a presne sa prepisujú, vrátane pokorných/čestných slovesných foriem.Neformálna reč so kontrakciami (っす, じゃん) tiež vychádza ako hovorená.