Japonca nasıl çıkıyor: senaryo ve segmentasyon
Yazı Japoncanın gerçekte yazıldığı şekilde yazılmıştır: bağlam tarafından seçilen kanji, hiragana ve katakana'nın doğal bir karışımıdır - 会議 değil かいぎ, borç kelimeler ve yabancı isimler için katakana, gramer için kana. Japonca noktalama işareti (、 ve 。) eklenmiştir ve Japonca boşluk kullanmadığından, metin segmentsiz olarak akmaktadır, tam olarak yerli bir yazarın üretir gibi.
Altyazı için bir sonuç: cue uzunlukları kelime sayısından ziyade modelin cümle segmentasyonuna dayanır.SRT / VTT ihracatları kısa, okunabilir ipuçları üretir, ancak Japon altyazı konvansiyonları (satır başına 13-16 karakter) yayın tarzı altyazı için editörde birkaç ipucu bölmeniz anlamına gelebilir.
Kayıtlar ve lehçeler
Standart Japonca (標準語) — toplantılar, dersler, podcastler, keigo ağırlıklı iş konuşması — modelinin güçlü kıyafetidir ve yüksek seviyede transliterasyonlar. Kansai-ben ve diğer bölgesel formlar genellikle doğru veya hafifçe normalleştirilir; daha eski kırsal konuşuculardan (Tōhoku, Kagoshima) güçlü bölgesel lehçe gerçekten zor bir durumdur. Homofon ağırlıklı Japonca modelinin bazen bir isim için yanlış kanji seçtiği anlamına gelir - editörde bir tarama değer.
Sıkça Sorulan Sorular
Kanji mi kana mı?
Her ikisi de, bağlam tarafından doğal olarak karıştırılmıştır — standart Japonca yazım, romaji veya tüm kana görüntüleme değil. Sık kullanılan kelimeler kanji, gramer unsurları hiragana, borç kelimeler ve yabancı isimler katakana olarak görüntülenir. Nadir veya belirsiz okumalar bazen yanlış kanji alır; bunlar hızlı düzenlemelerdir.
Bölümleme boşluklar olmadan nasıl yapılır?
Japonca metin boşluksuz yazılmıştır ve transkripsiyon bu konvansiyonu izler. Bölümler model tarafından eklenen 、and 。 noktalama işareti ile doğal cümle sınırları üzerinde bölünür, böylece metin Japonca yazılmış gibi okunur ve SRT işaretleri kelimenin ortasında değil cümle kenarlarında kırılır.
Japonca İngilizceye göre ne kadar doğru?
Yüksek, ancak Avrupa dillerinin altında bir nokta — Japonca'nın ses aksanları ve devasa homofon envanterleri kanji seçimini yanlış duyma yerine ana hata kaynağı yapmaktadır. Açık stüdyo veya toplantı sesleri çok kullanışlı metinler üretir; editör geçişi çoğunlukla homofon/kanji kontrolüdür.
Kansai-ben ve diğer lehçeler?
Kansai-ben medyada o kadar yaygındır ki model bunu iyi yönetebilir, genellikle konuşulan (あかん, ~へん negatifleri) diyalekt formlarını yazarak. Daha ağır bölgesel diyalektler - kırsal Tōhoku, Okinawan-etkili konuşma - doğruluğu belirgin şekilde düşürür. Bölgesel aksanlarla standart kayıt konuşanlar sorun değildir.
Japonca sesli kitaptan İngilizce metin çıkarabilir miyim?
Bu sayfa Japonca bir transkript üretir, bu doğru yoldur. İngilizce için, TXT'yi ihraç edin ve makine çevirisi yapın — Japonca→İngilizce çeviri kalitesi, doğrudan konuşma çevirisinden temiz metin üzerinde çok daha yüksektir. Uygulama içinde çeviri yol haritasındadır.
Keigo ve iş Japoncasını anlayacak mı?
Evet — kibar ve onurlu kayıtlar eğitim verilerinde (haberler, sunumlar, hizmet etkileşimi) ağırlıklı olarak temsil edilir ve alçakgönüllü/onurlu fiil biçimleri de dahil olmak üzere doğru bir şekilde yazılmaktadır.