Si del japonishtja: shkrimi dhe segmentimi
Transkriptimi është shkruar në mënyrën se si japonishtja është shkruar aktualisht: një përzierje natyrale e kanji, hiragana dhe katakana, e zgjedhur nga konteksti — 会議 jo かいぎ, katakana për huazime dhe emra të huaj, kana për gramatikë. Pikturat japoneze (、 dhe 。) janë të përfshira, dhe pasi japonishtja nuk përdor hapësirat, teksti rrjedh pa segmente, saktësisht siç do ta prodhonte një shkrimtar vendas.
Një pasojë për subtitrat: gjatësitë e pikave bazohen në segmentimin e frazës së modelit sesa numrin e fjalëve. Eksportimi SRT/VTT prodhon pika të shkurtra, të lexueshme, por konventat e subtitrit japonez (13-16 karaktere për rresht) mund të thotë që ju ndani disa pika në editor për subtitrimin në stil broadcast.
Regjistrime dhe dialekte
Japonishtja standarde (標準語) — takime, leksione, podcast, fjalime biznesi me keigo të rëndë — është modeli i fortë i modelit dhe transkribohet në një nivel të lartë. Kansai-ben dhe format e tjera rajonale zakonisht janë të paraqitura korrektisht ose lehtë të normalizuara; dialekti i fortë rajonal nga folësit e vjetër ruralë (Tōhoku, Kagoshima) është rasti i vërtetë i vështirë. Japonishtja me homofone të rëndë do të thotë se modeli ndonjëherë zgjedh kanji të gabuar për një emër — vlenë një skanim në editor.
Pyetja e shpeshtë
A përdor transkriptimi kanji apo kana?
Të dyja, të përziera natyrshëm nga konteksti - standardi i shkruar japonez, jo një romaji apo një paraqitje e gjithë kana. Fjalët e zakonshme shfaqen në kanji, elementet gramatikore në hiragana, huafjalë dhe emra të huaj në katakana. Lexues të rrallë ose të paqartë ndonjëherë marrin kanji të gabuar; këto janë ndryshime të shpejta.
Si trajtohet segmentimi pa hapësira?
Teksti japonez shkruhet pa hapësirë dhe transkripti ndjek këtë konventë. Segmentet ndahen në kufijtë natyrorë të frazës me pikëpamje të 、and。 të vendosura nga modeli, kështu që teksti lexohet si tekst japonez i shkruar dhe shenjat SRT ndahen në skajet e frazës sesa në mes të fjalës.
Sa e saktë është japonishtja krahasuar me anglishten?
E lartë, por një hap poshtë gjuhëve evropiane — theksi i japonezëve dhe inventari masiv homofon e bëjnë zgjedhjen e kanji burimi kryesor i gabimeve sesa dëgjimi i gabuar. Studioja e pastër ose audio e takimit prodhon transkripta shumë të përdorshme; editori kalon kryesisht kontrollet homofone/kanji.
Kansai-ben dhe dialektet e tjera?
Kansai-ben është mjaft e zakonshme në media që modeli e trajton atë mirë, zakonisht duke shkruar forma dialektesh si të folura (あかん, ~へん negatives). Dialektet më të rënda rajonale — rurale Tōhoku, fjalimi i ndikuar nga Okinawan — degradojnë saktësi në mënyrë të dukshme. Folësit e rregjistrit standard me thekse rajonale nuk janë problem.
Mund të marr tekstin në anglisht nga audio japoneze?
Kjo faqe prodhon një transkriptim japonez, që është rruga e saktë. Për anglisht, eksporto TXT dhe përktheje automatikisht atë — japonez → anglisht cilësia e përkthimit është shumë më e lartë në tekstin e pastër se sa në përkthimin e drejtpërdrejtë të fjalimit. Përkthimi në aplikativ është në udhëzues.
A do të trajtojë Keigo dhe biznesin japonez?
Po — rregjistrimet e sjelljes dhe të nderit janë të përfaqësuara në të dhënat e trainimit (lajmet, paraqitjet, ndërveprimet e shërbimeve) dhe transkribohen saktësisht, duke përfshirë forma të foljeve të përulura/honorifice. Fjalë të rastit me kontraksione (っす, じゃん) gjithashtu dalin si të folura.