Live Transcription

Napisy prasowe i słowa przepływają prosto do naszego AL — tekst pojawia się w sekundach za głosem, a po zatrzymaniu się polerowany transkrypt popada.

Brak rejestracji Brak znaku wodnego Eksport TXT · SRT · VTT Pliki są automatycznie usuwane po 24 h
Przeciągnij i upuść plik tutaj
lub przeglądaj swoje pliki
Darmowe: pliki {0} dziennie · do {1} min & {2} MB każde
0:00
Żywy projekt
Słowa pojawiają się w trakcie waszego wypowiedzenia, przepisane żywo przez naszą własną AL – naciśnij Transcribe po zakończeniu polerowanej, do wykonania wersji.
Mikrofon został zablokowany — pozwólcie na to w ustawieniach strony przeglądarki lub prześlecie plik.

Większe pliki lub więcej przesyłanych plików? Darmowe konto: 5 plików dziennie, pliki do 1 godziny · Pro: pliki do 10 godzin + oznaczanie mówców

0%
Przesyłanie…
Nie zamykaj tej karty — nastąpi przekierowanie do transkrypcji.
Talks & speechesReal-time notesIn-room speechAccessibility

Właściwie, żywo: twoje rury mowy do naszego własnego AI, kiedy mówisz

Podczas zapisu strona przecina strumienie mikrofonu na krótkie segmenty – po kilka sekund, przystosowując się do siebie tak, że następny statek w momencie, gdy poprzednia wraca – i rury każdego prosto do naszych serwerów GPU, gdzie ten sam model Whisper klasy, który potęguje cały witryn transkrypuje go natychmiast. Tekst leży w żywym paszku sekundy za głosem i ciągle płynie tak długo, jak mówisz. Brak usługi mowy przeglądarki, bez dyktatu API osób trzecich – tekst na żywo jest prawdziwy Whisper wyjścia z naszego sprzętu.

Ponieważ potrzeba nagrywania mikrofonu, tryb na żywo działa w każdej nowoczesnej przeglądarce — Chrome, Edge, Safari, Firefox, pulpit i telefon. Każdy segment audio jest usuwany z naszych serwerów w momencie, gdy tekst przychodzi.

Na żywo w porównaniu z ostatecznym transkryptem

Transkrypcja segmentu po segmentie ma jeden wbudowany limit: model widzi kilka sekund na raz, więc słowo, że przechodzi dwa segmenty może wyjść wycięte, a interpuktuacja przez granice segmentów jest zgadnienie. Dlatego przepływ kończy się kolejnym krokem: pełny nagranie jest przechowywane w przeglądarce podczas mówienia, a nacisk na Transcribeta przebiega przez model jako pojedynczy zajęcie – pełny kontekst, odpowiednia interpuktuacja, czasowe opcje, edytor i eksport TXT/SRT/VT.

Użyj na żywo nadajnika, aby potwierdzić, że jest na bieżąco i aby złapać tekst w momencie, gdy jest wypowiedziane (to jest przycisk kopii na paszy); użyj końcowego przepustki na wszystko, co zachowasz. Dla audio, które już masz jako plik, tryb wysyłki na każdej stronie narzędzia jest krótszą ścieżką.

Często zadawane pytania

Czy to naprawdę jest nagrywane czy wysłane później?
W rzeczywistości na żywo: nagrywanie i transkrypcja nakłada się. Strona stawia każdy kilka sekund kawałek dźwięku do naszych GPU, podczas gdy wciąż mówi następny, więc tekst gromadzi się podczas nagrywania, nie po nim. Oczekuj, że pasz będzie działał kilka sekund za głosem – czas, kiedy to wymaga kawałek, aby zakończyć, przesyłać i napisać.
Dlaczego SMS na żywo jest za mną kilka sekund?
Trzy małe opóźnienia stosują: kawałek musi być zakończony rejestrowany (trzy sekundy), podróżować na serwer i przejść przez model. Zazwyczaj pokłada pasz o 4-8 sekund za głosem — a jeśli nasze GPU są krótko zajęte, strona dostosowuje się przez wysyłanie nieco dłuższych kawałków zamiast spadać z tyłu. Naturalne mowy z przerwami są gładkie.
W jakim trybie działa przeglądarka na żywo?
Wszystkie nowoczesne — Chrome, Edge, Safari i Firefox, na pulpitach i telefonach. Opiera się raczej na standardowym nagraniu mikrofonu niż na usługę przeglądarki, więc działa w Firefox tak samo jak w Chrome.
Gdzie mój głos prowadzi się podczas transkrypcji?
Tylko do naszych serwerów i szczerze opisywano: tryb żywy strumień dźwięku do nas w krótkich segmentach, kiedy mówisz – to właśnie sprawia, że żyje – i każdy segment jest usuwany natychmiast po powrocie tekstu. Nic nie idzie do Google, Apple, ani do żadnej usługi mowy. Cały nagranie pozostaje w przeglądarce aż do czasu wcisku Transcribe i anonimowych transkryptów automatycznie usunąć w ciągu 24 godzin.
Mogę go wykorzystać do posiedzenia lub wykładu w pokoju?
Jako pomoc osobista, tak — umieścić urządzenie w pobliżu głośnika i ścieżek paszowych czyste wypowiedzenie dobrze, około dziesięciu sekund za. Znać granice: jeden mikrofon, tak odległe głosy i krzyżowanie degradować go, i to nie jest certyfikowana subskrybucja dla zgodności z dostępnością. Prasa Transcribe na końcu i pełny przepustka kontekstu zwykle odzyskuje to, co pasza na żywo zmarła.
Które języki działają na żywo, a ja mam wybrać jeden?
Te same 90+ języków, co każdy transkrypcja na tej stronie – jest to ten sam model. Jedna wskazówka specyficzna dla trybu życia: wybierz swój język w selektorze zamiast pozostawić autodetekcję. Wykrywanie uruchamia się na segment, a siedem sekund nie jest zbyt wiele dowodów, więc przypiągnięcie języka utrzymuje paszenie przed wahaniem się na krótkie lub akcentowane frazy.