Kako japanski izlazi: scenarij i segmentacija
Transkripcija je napisanačin na koji se japanski zapravo piše: prirodna mješavina kanji, hiragana i katakana, odabrana u kontekstu - 会議 ne かいぎ, katakana za posuđene riječi i strana imena, kana za gramatiku. japanska interpunkcija (、and 。) je umetnuta, a pošto japanski ne koristi razmake, tekst teče nesegmentirano, baš kao što bi ga nativni pisac proizveo.
Jedna posljedica za titlove: duljine signala su zasnovane na segmentaciji fraze modela, a ne na broju riječi.SRT/VTT izvozi proizvode kratke, čitljive signale, ali japanske konvencije za titlove (13-16 znakova po liniji) mogu značiti da podijelite nekoliko signala u editoru za emitiranje stila titlova.
Registri i dijalekti
Standardni japanski (標準語) — sastanci, predavanja, podcasti, keigo-teški poslovni govor — je modelov snažan trik i transkripira na visokom nivou. Kansai-ben i druge regionalne forme su obično ispravno prikazane ili blago normalizirane; snažan regionalni dijalekt starijih ruralnih govornika (Tōhoku, Kagoshima) je zaista težak slučaj. Homofonski japanski znači da model povremeno bira pogrešan kanji za ime — vrijedi skenirati u editoru.
Često postavljana pitanja
Da li se u transkripciji koristi kanji ili kana?
Oba, prirodno pomiješana kontekstom — standardni pisani japanski, ne romaji ili sve kana rendering. Uobičajene riječi pojavljuju se u kanji, gramatički elementi u hiragani, posuđenice i strana imena u katakani. Rijetka ili dvosmislena čitanja ponekad dobiju pogrešan kanji; to su brze izmjene.
Kako se segmentacija obavlja bez praznina?
Japanski tekst je napisan bez razmaka i transkripcija slijedi tu konvenciju. Segmenti su podijeljeni na prirodne granice fraze sa 、and 。 interpunkcijom umetnute od strane modela, tako da se tekst čita kao pisani japanski, a SRT signali se prekidaju na rubovima fraze umjesto u sredini riječi.
Koliko je točan japanski u odnosu na engleski?
Visok, ali ispod najviših evropskih jezika — japanski naglasak i masivni homofoni inventari čine izbor kanjija glavnim izvorom grešaka, a ne neslikom. čisti studijski ili sastanakni audio proizvodi vrlo korisne transkripte; urednički prolaz je uglavnom homofonska/kanji provjera.
Kansai-ben i drugi dijalekti?
Kansai-ben je dovoljno čest u medijima da ga model dobro obrađuje, obično pišući dijalektalne oblike kao govorene (あかん, ~へん negative).Teži regionalni dijalekti - ruralni Tōhoku, govor pod utjecajem Okinawe - značajno smanjuju tačnost.
Mogu li dobiti engleski tekst iz japanskog zvuka?
Ova stranica proizvodi japanski transkript, koji je tačan put. Za engleski, izvozite TXT i mašinski ga prevedite — kvalitet japanskog→engleskog prevoda je mnogo veći na čistom tekstu nego na direktnom govornom prevodu. Prevođenje u aplikaciji je na planu.
Hoće li se nositi sa Keigom i poslovnim Japancima?
Da — pristojno i počasno govorništvo je jako zastupljeno u podacima za trening (vijesti, prezentacije, servisne interakcije) i transkribira se tačno, uključujući i skromne/počasne oblike glagola.