Live-Transkription

Tryck på skivan och dina ord strömma direkt till vår AI — texten visas sekunder bakom din röst, och en polerad utskrift landar när du slutar.

Ingen registrering Inget vattenmärke TXT · SRT · VTT export Filer automatiskt radera i 24h
Dra och släpp filen här
eller bläddra bland dina filer
Gratis: {0} filer per dag · upp till {1} min & {2} MB varje
0:00
Direktutdrag
Ord visas när du talar, transkriberas live av vår egen AI - tryck transkribera när du avslutar för polerad, redigerbar version.
Mikrofonåtkomst blockerades — låt det i webbläsarens inställningar för webbplatsen, eller ladda upp en fil istället.

Större filer eller fler uppladdningar? Gratis konto: 5 filer/dag, 1 timmes filer · Pro: 10 timmars filer + högtalaretiketter

0%
Laddar upp...
Håll fliken öppen – du kommer att omdirigeras till din utskrift.
Talks & speechesReal-time notesIn-room speechAccessibility

Faktiskt live: dina talrör till vår egen AI medan du pratar

Medan du spelar in, sidan skär mikrofonen ström i korta segment - några sekunder vardera, klippa adaptivt så nästa skeppar det ögonblick den föregående kommer tillbaka - och rör var och en direkt till våra GPU-servrar, där samma Whisper-klass modell som driver hela webbplatsen transkriberar det omedelbart. Texten landar i live-flöde sekunder bakom din röst och fortsätter att flöda så länge du fortsätter att prata. Ingen webbläsare taltjänst, ingen tredje part diktation API - live text är verklig Whisper utgång från vår egen hårdvara.

Eftersom det bara behöver mikrofon inspelning, fungerar live-läge i varje modern webbläsare — Chrome, Edge, Safari, och Firefox, skrivbord och telefon. Varje ljudsegment raderas från våra servrar när dess text kommer tillbaka.

Live-flöde vs slututskriften

Segment-by-segment transkription har en inbyggd gräns: modellen ser några sekunder åt gången, så ett ord som straddrar två segment kan komma ut klippt, och interpunktion över segmentgränser är gissningar. Det är därför flödet slutar med ett steg till: den fullständiga inspelningen hålls i din webbläsare medan du talar, och trycker Transcript kör det genom modellen som en enda ta – full kontext, korrekt interpunktion, tidsstämpel, editorn, och TXT/SRT/VTT export.

Använd live-feed för att bekräfta att det håller jämna steg och för att ta tag i text i det ögonblick det talas (det finns en kopieringsknapp på kanalen); använd det slutliga passet för allt du kommer att behålla. För ljud du redan har som fil, uppladdningsläge på någon verktygssida är den kortare sökvägen.

Vanliga frågor

Är detta verkligen live, eller spelas in och skickas efteråt?
Faktiskt live: inspelning och transkription överlappar. Sidan skickar varje några sekunders ljudskiva till våra GPU:er medan du fortfarande talar nästa, så text ackumuleras under inspelningen, inte efter den. Förvänta dig att flödet kör en handfull sekunder bakom din röst – den tid det tar en bit att avsluta, ladda upp och transkribera.
Varför ligger live-texterna bakom mig?
Tre små förseningar stapla upp: en skiva måste vara klar spelas in (tre sekunder eller så), resa till servern, och passera genom modellen. Det brukar sätta flödet ca 4-8 sekunder bakom din röst — och om våra GPU:er är kort upptagen, sidan anpassar sig genom att skicka något längre skivor i stället för att falla efter. Naturligt tal med pauser känns smidigt.
Vilka webbläsare fungerar live-läget i?
Alla moderna — Chrome, Edge, Safari och Firefox, på skrivbordet och telefoner. Det bygger på standard mikrofon inspelning snarare än en webbläsare taltjänst, så det fungerar i Firefox lika bra som i Chrome.
Vart tar min röst vägen när jag kör live transkription?
Endast till våra servrar, och ärligt beskriven: live-läge strömmar ditt ljud till oss i korta segment medan du talar – det är det som gör det levande – och varje segment raderas omedelbart efter att dess text kommer tillbaka. Ingenting går till Google, Apple, eller någon tredje part taltjänst. Den fullständiga inspelningen stannar i din webbläsare tills du trycker på Transcript, och anonyma utskrifter auto-delete inom 24 timmar.
Kan jag använda den för att följa ett möte eller en föreläsning i rummet?
Som en personlig hjälp, ja - sätta enheten nära högtalaren och matar spåren tydligt tal, ungefär tio sekunder bakom. Känn gränserna: en mikrofon, så avlägsna röster och korstalk försämrar det, och det är inte en certifierad bildtext tjänst för tillgänglighet efterlevnad. Tryck Transkript i slutet och full-kontext pass vanligtvis återhämtar vad den levande feed fumlade.
Vilka språk fungerar, och ska jag välja ett?
Samma 90+ språk som varje transkription på denna webbplats - det är samma modell. Ett tips specifikt för live-läge: välj ditt språk i väljaren istället för att lämna auto-detekt på. Detektion körs per segment, och sju sekunder är inte mycket bevis, så att fästa språket håller flödet från vackla på korta eller accenterade fraser.