Lancez l'enregistrement et vos mots filent droit vers notre IA — le texte apparaît quelques secondes derrière votre voix, et une transcription soignée arrive quand vous vous arrêtez.
Sans inscription
Pas de filigrane
Exports TXT · SRT · VTT
Fichiers auto-supprimés en 24h
Faites glisser et déposez votre fichier ici
ou parcourir vos fichiers
Gratuit : {0} fichiers par jour · jusqu'à {1} min et {2} Mo chacun
0:00
Projet en direct
Les mots apparaissent alors que vous parlez, transcrits en direct par notre propre AI — appuyez sur Transcribe quand vous terminez pour la version polie et modifiable.
L'accès au microphone a été bloqué — le permettre dans les paramètres du site de votre navigateur, ou télécharger un fichier à la place.
Vraiment en direct : votre voix part vers notre propre IA pendant que vous parlez
Pendant que vous enregistrez, la page découpe le flux du micro en segments courts — quelques secondes chacun, ajustés de façon adaptative pour que le suivant parte dès que le précédent revient — et envoie chacun directement à nos serveurs GPU, où le même modèle de classe Whisper qui fait tourner tout le site le transcrit immédiatement. Le texte atterrit dans le flux en direct quelques secondes derrière votre voix et continue d'arriver tant que vous parlez. Pas de service vocal du navigateur, pas d'API de dictée tierce — le texte en direct est une vraie sortie Whisper produite sur notre propre matériel.
Comme il ne nécessite que l'enregistrement au micro, le mode direct fonctionne dans tous les navigateurs modernes — Chrome, Edge, Safari et Firefox, sur ordinateur comme sur téléphone. Chaque segment audio est supprimé de nos serveurs dès que son texte revient.
Le flux en direct vs la transcription finale
La transcription segment par segment a une limite intrinsèque : le modèle ne voit que quelques secondes à la fois, donc un mot à cheval sur deux segments peut ressortir tronqué, et la ponctuation aux frontières des segments relève de la devinette. C'est pourquoi le parcours se termine par une étape de plus : l'enregistrement complet est conservé dans votre navigateur pendant que vous parlez, et appuyer sur Transcrire le fait passer dans le modèle en une seule prise — contexte complet, ponctuation correcte, horodatages, l'éditeur et les exports TXT/SRT/VTT.
Utilisez le flux en direct pour vérifier qu'il suit et pour copier le texte dès qu'il est prononcé (un bouton de copie se trouve sur le flux) ; utilisez la passe finale pour tout ce que vous comptez garder. Pour un audio que vous avez déjà en fichier, le mode d'envoi de n'importe quelle page d'outil est le chemin le plus court.
Foire aux questions
Est-ce vraiment en direct, ou enregistré et envoyé après?
Vraiment en direct : l'enregistrement et la transcription se chevauchent. La page envoie chaque tranche de quelques secondes d'audio à nos GPU pendant que vous prononcez encore la suivante, donc le texte s'accumule pendant l'enregistrement, pas après. Attendez-vous à ce que le flux ait quelques secondes de retard sur votre voix — le temps qu'une tranche se termine, s'envoie et se transcrive.
Pourquoi le texte en direct a-t-il quelques secondes de retard sur moi ?
Trois petits retards s'accumulent : une tranche doit être enregistrée (trois secondes environ), se déplacer vers le serveur et passer à travers le modèle. Cela met généralement le flux environ 4-8 secondes derrière votre voix — et si nos GPU sont brièvement occupés, la page s'adapte en envoyant des tranches légèrement plus longues au lieu de tomber derrière.
Dans quels navigateurs le mode live fonctionne-t-il?
Tous les modernes — Chrome, Edge, Safari, et Firefox, sur le bureau et les téléphones. Il repose sur l'enregistrement de microphone standard plutôt que sur un service de parole de navigateur, de sorte qu'il fonctionne dans Firefox tout aussi bien que dans Chrome.
Où va ma voix pendant que la transcription en direct tourne?
Vers nos serveurs uniquement, et décrit honnêtement : le mode direct nous envoie votre audio en courts segments pendant que vous parlez — c'est ce qui le rend « en direct » — et chaque segment est supprimé immédiatement dès que son texte revient. Rien ne part chez Google, Apple ou un quelconque service vocal tiers. L'enregistrement complet reste dans votre navigateur jusqu'à ce que vous appuyiez sur Transcrire, et les transcriptions anonymes sont supprimées automatiquement sous 24 heures.
Puis-je l'utiliser pour suivre une réunion ou une conférence dans la salle?
Comme aide personnelle, oui — placez l'appareil près de la personne qui parle et le flux suit bien une voix claire, avec environ dix secondes de retard. Connaissez les limites : un seul micro, donc les voix lointaines et les conversations croisées le dégradent, et ce n'est pas un service de sous-titrage certifié pour la conformité accessibilité. Appuyez sur Transcrire à la fin : la passe avec contexte complet récupère généralement ce que le flux en direct a raté.
Quelles langues fonctionnent en direct, et dois-je en choisir une ?
Les mêmes plus de 90 langues que toute transcription sur ce site — c'est le même modèle. Un conseil propre au mode direct : choisissez votre langue dans le sélecteur au lieu de laisser la détection automatique. La détection s'exécute segment par segment, et sept secondes ne sont pas beaucoup d'indices ; fixer la langue évite que le flux hésite sur des phrases courtes ou accentuées.