Przekształc dźwięk na tekst

Wyślij dowolny wspólny format audio i uzyskać dokładny, edytowany transkrypt. Darmowy bez rejestracji — eksport TXT, SRT lub VTT.

Brak rejestracji Brak znaku wodnego Eksport TXT · SRT · VTT Pliki są automatycznie usuwane po 24 h
Przeciągnij i upuść plik tutaj
lub przeglądaj swoje pliki
Darmowe: pliki {0} dziennie · do {1} min & {2} MB każde

Większe pliki lub więcej przesyłanych plików? Darmowe konto: 5 plików dziennie, pliki do 1 godziny · Pro: pliki do 10 godzin + oznaczanie mówców

0%
Przesyłanie…
Nie zamykaj tej karty — nastąpi przekierowanie do transkrypcji.
MP3WAVM4AFLACOGGAACWMAOpus

Każdy wspólny format audio, jeden transcriber

Ta strona akceptuje formaty audio, które ludzie mają: MP3 i AAC z podcastów i pobierań, WAV i AIFF z narzędzia nagrywania, M4A z aplikacji pamięć głosowych iPhone i Android, FLAC z archiwalnych rips, OGG i Opus z aplikacji wiadomości, oraz WMA z starszych zapisaczy Windows. Nie ma oddzielnego kroku konwertera – transcriber dekoduje sam plik, więc nigdy nie trzeba najpierw konwertować WAV do MP3.

Język jest automatycznie wykrywany w 90+ językach, lub można go przykleić w opcjach, jeśli nagranie miesza języki i wykrywanie zgaduje źle.

Od nagrywania do użytkowego tekstu

Po przetwarzaniu transkrypcja otwiera się w edytorze z czasem na wypowiedzenie. Kliknij dowolną linię, aby ją skorygować, poszukać wyrażenia, a następnie eksportować: TXT dla dokumentów i notatek, SRT lub VTT, jeśli audio należy do wideo. Podpisane użytkowniki również dostają DOCX i PDF za udostępnianie polerowanych dokumentów.

Często zadawane pytania

Jakie formaty audio są obsługiwane?
MP3, WAV, M4A, FLAC, OGG, AAC, WMA, Opus, AIFF i AMR. Jeśli rejestrator wytwarza coś rzadniejszego, konwersja na WAV lub MP3 najpierw z dowolnym konwerterem zawsze działa – ale spróbuj oryginalnym pierwszym; dekoder obejmuje większość pojemników.
Czy głośne czy niskojakościowe nagrania zadziałają?
Model jest przeszkolony na wielu niedoskonałych audio w rzeczywistości, więc jego, echo pokojowe i artefakty kompresyjne rzadko je rozbijają. Co naprawdę boli dokładność to przemówienie ciche w stosunku do hałasu — rejestrator daleko od głośnika, czy muzyka głośniej niż głos. Jeśli można, zapisz się bliżej źródła; redaktor szybko naprawia pozostałe błędy.
Czy może on zająć się wieloma głośnikami na jednym torze?
Tak — wszystkie słowa są transkrybowane niezależnie od liczby osób. Na wolnym poziomie transkrypta nie mówi, kto co powiedział; etykiety głośniki (diaryzacja) to funkcja Pro, która oznacza każdy segment PEEKER 1, PEEKER 2, itp., i pozwala na ich nazwę w redaktorze.
Czy mam czasy?
Tak. Każdy segment posiada czas startu i końca. W edytorze możesz włączyć lub wyłączyć wyświetlanie czasowego, a eksport SRT/VTT wbudować je w standardowy format czasu napisów. Eksport TXT jest czystym prozą bez czasowych empingów.
Mogę edytować transkrypt przed eksportem?
Tak — to domyślny przepływ pracy. Transkrypt otwiera się w edytorze, w którym każdy segment jest klikniętym do editu za pomocą automatycznego zachowania. Ustawienie nazw, żargon lub błędnie słyszane słowa, następnie eksport; Twoje edycje są wpisane w każdy format.
Jak długo może trwać mój plik audio?
Anonimowy: 30 minut / 100 MB w pliku, 3 pliki dziennie. Darmowe konto: 1 godzina / 500 MB, 5 plików dziennie. Pro lub pakiet kredytowy: do 10 godzin i 5 GB w pliku. Czas trwania jest ważny — długi, mały MP3 trafia na czapkę przed krótkim, ogromnym WAV.