EZ
EZ2Conv

Voix vers Texte

Convertissez votre voix en texte en temps réel grâce à la reconnaissance vocale du navigateur. Transcrivez aussi des fichiers audio et vidéo avec l'IA locale Whisper. Gratuit, sécurisé et sans connexion requise.

Characters
0
Words
0
Sentences
0
Duration
00:00

Transcript

You can edit the text below

Comment Utiliser

  1. [Temps réel] Sélectionnez l'onglet "Temps réel", choisissez votre langue et cliquez sur "Démarrer l'enregistrement"
  2. [Temps réel] Parlez clairement dans votre microphone - le texte apparaît en temps réel pendant que vous parlez
  3. [Téléversement] Sélectionnez l'onglet "Téléversement", choisissez un modèle IA et téléversez un fichier audio/vidéo
  4. [Téléversement] Cliquez sur "Transcrire" - le modèle IA est téléchargé automatiquement lors du premier usage
  5. Modifiez, copiez ou téléchargez votre transcription une fois terminée avec les options disponibles

Conseils Utiles

  • Le mode temps réel nécessite le navigateur Chrome, Edge ou Safari
  • Le téléchargement de fichiers fonctionne hors ligne après le téléchargement du modèle IA
  • Pour les fichiers longs, le modèle 'Tiny' offre le traitement le plus rapide
  • Seul le téléversement garde l'audio sur votre appareil : le mode temps réel l'envoie au service vocal du navigateur, sauf si la reconnaissance locale est disponible

Deux façons de transformer la parole en texte

Ce que fait cet outil

Speech to Text réunit deux moteurs indépendants pour un même but. Le mode temps réel s'appuie sur la Web Speech API — l'interface SpeechRecognition intégrée aux navigateurs actuels — et inscrit les mots sur la page au fil de la parole : d'abord un texte provisoire, puis une ligne définitive dès que vous marquez une pause. Le mode d'envoi de fichier charge quant à lui un modèle d'IA Whisper via Transformers.js et transcrit un enregistrement que vous possédez déjà, sans écouter le moindre micro.

Quel mode choisir

La dictée en temps réel est idéale pour saisir des idées sans les mains : notes de réunion, brouillon rapide ou pense-bête que l'on préfère dicter plutôt que taper. Elle brille lors de courtes sessions en direct, où voir le texte apparaître aussitôt entretient le rythme.

L'envoi de fichier convient mieux à un contenu déjà enregistré : un entretien, un cours, un mémo vocal ou la piste audio d'une vidéo. Une fois le téléchargement initial du modèle Whisper terminé, ce mode continue de fonctionner même hors connexion, ce qui aide pour les longs enregistrements et les tâches répétées.

Un aperçu rapide

Pour travailler en direct, choisissez votre langue dans la liste, cliquez sur Start Recording et autorisez l'accès au micro lorsque le navigateur le demande ; votre voix remplit la transcription, que vous pouvez ensuite retoucher. Pour un enregistrement, passez à File Upload, sélectionnez un modèle — Tiny pour la rapidité, Small pour une meilleure précision multilingue — et déposez un fichier MP3, WAV, MP4 ou équivalent. Une fois le modèle exécuté, le texte est prêt à copier ou à télécharger.

Compatibilité et points de vigilance

La reconnaissance en temps réel dépend du navigateur : Chrome, Edge et Safari implémentent la Web Speech API, contrairement à Firefox, où il vaut mieux passer par File Upload. Les versions récentes de Chrome peuvent installer un modèle de langue sur l'appareil et garder l'audio du micro en local ; sinon, la parole est traitée par le service vocal de l'éditeur du navigateur. La liste en temps réel propose 22 langues, tandis que Whisper en couvre plus de 99 avec détection automatique. L'envoi accepte les formats audio et vidéo courants jusqu'à 500MB ; pour une vidéo, extraire d'abord l'audio accélère le traitement et améliore le résultat.

Questions fréquentes

Les deux moteurs sont accessibles sans limite : la dictée en direct via la Web Speech API et la transcription de fichiers avec les modèles Whisper Tiny, Base et Small, pour un audio ou une vidéo de n'importe quelle durée. Pas de facturation à la minute ni de modèles premium verrouillés derrière un paiement.
Cela dépend du mode. La transcription par fichier exécute un modèle Whisper avec Transformers.js en local : l'enregistrement et son texte ne quittent pas l'appareil. Le mode temps réel s'appuie sur la Web Speech API du navigateur, qui envoie souvent l'audio du micro aux serveurs de l'éditeur pour le reconnaître, sauf si Chrome a installé le modèle sur l'appareil. EZ2Conv ne reçoit jamais votre audio.
Aucun compte n'est nécessaire. Choisissez le mode, dictez ou envoyez votre enregistrement, puis modifiez, copiez ou téléchargez le texte. Ni e-mail ni données personnelles ne sont demandés.
Chrome, Edge et Safari implémentent la Web Speech API requise pour le mode en direct ; Firefox ne l'inclut pas. Dans tous les cas, le mode File Upload fonctionne, car il transcrit avec Whisper sans dépendre de cette API.
Le mode temps réel a besoin du micro pour capter votre voix, et le navigateur pose la question une fois. Si vous refusez, ce mode ne peut pas écouter, mais l'envoi de fichier n'exige aucun micro, puisqu'il lit un enregistrement existant.
La liste en temps réel comprend 22 langues via la Web Speech API, et le mode par fichier avec Whisper en gère plus de 99 avec détection automatique. Sélectionnez la langue avant d'enregistrer pour une meilleure précision.