日本語音声をテキストに文字起こし

日本語を正しい書き言葉のテキストに — 漢字・かな・句読点まで処理。無料、アカウント不要。

登録なし 透かしなし TXT · SRT · VTT エクスポート ファイルは24時間後に自動的に削除されます
ファイルをここにドラッグ&ドロップ
または ファイルを選択
無料: 1日 {0} ファイル · 各ファイル最大 {1} 分・{2} MB
Japanese (日本語) このページの言語のプリセット

より大きなファイルや、より多くのアップロードが必要ですか? 無料アカウント:1日5ファイル、最長1時間のファイル · Pro: 最長10時間のファイル + 話者ラベル

0%
アップロード中...
このタブを開いたままにしてください — 文字起こしページに自動的に移動します。
Kanji + kana output標準語Kansai-benBusiness Japanese
出力の見た目
0:00
では、来週の打ち合わせの日程を確認しましょう。
0:05
火曜日の午後三時なら、全員参加できると思います。
0:11
わかりました。会議室を予約して、資料を共有しておきます。
高精度クラス:クリアな標準的な日本語はきれいに出力されます。早口で発言が重なる掛け合いや方言の強い音声では、修正がやや増えます。

日本語がどう出てくるか:文字と分割

文脈に応じて選択された漢字・平仮名・片仮名の自然な組み合わせで、日本語の文脈に合わせて書かれており、会議はかいぎではなく、借用語や外国語名は片仮名、文法は仮名である。

字幕の場合の一つの結果は、クイック長は単語数ではなくモデルのフレーズセグメンテーションに基づいています。SRT/VTTエクスポートは短く読みやすいクイックを生成しますが、日本語字幕の慣習(1行あたり13-16文字)は、ブロードキャストスタイルの字幕を作成するために、エディタでいくつかのクイックを分割する必要があるかもしれません。

文字体系と方言

標準語(会議、講演、ポッドキャスト、京都重視のビジネススピーチ)がモデルの強みであり、高レベルで転写する。関西弁などの地域形は正しくあるいはわずかに正規化される。強い地方方言(東北、鹿児島)は本当に難しい。同音異義語重視の日本語は、モデルが名前の漢字を間違えることもある。エディタでスキャンする価値がある。

よくある質問

転写は漢字か仮名ですか。
文脈によって自然に混合される両方の文字列を表示します。標準的な日本語で書かれた文字列で、ローマ字や全漢字ではありません。一般的な言葉は漢字で表示され、文法要素は平仮名で、借用語や外国名は片仮名で表示されます。稀な読み方や曖昧な読み方は間違った漢字で表示されます。これは簡単な編集です。
スペースなしのセグメンテーションはどうするのか。
テキストは自然な文脈で分割され,SRTのキーは文字の中央ではなく文字の端で切断される。
日本語は英語に比べてどれだけ正確ですか。
音声の読み取りは,音声の読み取りのための音声処理システムである。
関西弁とか?
関西弁はメディアにおいて十分に普通であり,モデルはそれをよく扱い,方言形式を話されたものとして記述する(あかん,〜へんネガティブ)が,東北地方の田舎話,沖縄語の影響を受けた話など,より重い地域方言は正確性を著しく低下させる。
日本語音声から英語テキストを取得できますか。
このページは日本語の翻訳を生成します。正確なパスです。英語の場合は、TXTをエクスポートして機械翻訳を行ってください。日本語から英語への翻訳の質は、直接音声翻訳よりも純粋なテキストの方がずっと高いです。アプリ内翻訳はロードマップにあります。
京都とビジネス日本語は 対応できるのか?
訓練データ(ニュース,プレゼンテーション,サービス相互作用)において礼儀正しく尊敬的な言葉が多く含まれ,謙虚な動詞形を含めて正確に転写される。