Reconnaissance Vocale en Ligne Gratuite

Convertissez la parole en texte avec la reconnaissance vocale. Plus de 20 langues. Gratuit, rapide et entièrement dans votre navigateur, sans inscription.

Mis à jour le

Share:
Home/Text Tools/Speech to Text

Speech to Text

Convert spoken words to text using your browser's speech recognition. Support for multiple languages, continuous transcription, confidence scoring, and export options.

Voice Recognition Controls

Continuous mode keeps listening after pauses. Say "period", "comma", etc. for punctuation.

Transcript

0 words, 0 characters

Words

0

Characters

0

Duration

00:00

Language

English

Transcription History

Tips for Better Recognition

  • Speak clearly and at a moderate pace
  • Use a good quality microphone if possible
  • Minimize background noise
  • Position the microphone at an appropriate distance
  • Select the correct language for best results
  • Enable continuous mode for longer dictation sessions
  • You can edit the transcript text directly while still recording

Voice Punctuation Commands

About Speech to Text

This tool uses the Web Speech API built into modern browsers to convert your spoken words into text. It supports continuous transcription and multiple languages.

Features:

  • Real-time speech recognition with interim results
  • Support for 45+ languages and dialects
  • Continuous and single-result listening modes
  • Confidence scoring for each recognized segment
  • Voice commands for punctuation and formatting
  • Auto-capitalization after sentences and line breaks
  • Edit transcript while still recording
  • Recording timer and word count stats
  • Export as .txt or .srt subtitle format
  • Save and load transcription history (stored locally)

Browser Support:

  • Chrome (desktop and Android) - Full support
  • Edge - Full support
  • Safari - Partial support
  • Firefox - Not supported

Privacy Note: Speech recognition uses your browser's built-in speech API. Audio may be processed by your browser's cloud services (like Google for Chrome) for transcription. Your transcript is not stored or sent to our servers. History is saved only in your browser's local storage.

Questions Fréquentes

Qu'est-ce que la Reconnaissance Vocale ?

La Reconnaissance Vocale est un outil en ligne gratuit qui convertit les paroles prononcées en texte grâce à la reconnaissance vocale, avec plus de 20 langues. Elle fonctionne intégralement dans votre navigateur, sans installation ni inscription.

Quelles langues la Reconnaissance Vocale prend-elle en charge ?

La Reconnaissance Vocale prend en charge plus de 20 langues, dont l'anglais, l'espagnol, le français, l'allemand, le chinois, le japonais et bien d'autres.

La Reconnaissance Vocale est-elle gratuite ?

Oui, la Reconnaissance Vocale est 100 % gratuite, sans inscription, sans frais cachés et sans limite d'utilisation. Tout le traitement s'effectue localement dans votre navigateur, garantissant une confidentialité totale.

Mes données sont-elles en sécurité avec cet outil ?

Absolument. La Reconnaissance Vocale traite tout côté client, dans votre navigateur. Aucune donnée n'est envoyée ni stockée sur un serveur. Votre contenu reste privé sur votre appareil à tout moment.

La Reconnaissance Vocale fonctionne-t-elle sur les appareils mobiles ?

Oui, la Reconnaissance Vocale est entièrement adaptative et fonctionne sur smartphones et tablettes. Vous pouvez l'utiliser sur n'importe quel appareil doté d'un navigateur web moderne, sans aucun téléchargement d'application.

Dois-je créer un compte pour utiliser cet outil ?

Aucun compte ni inscription n'est nécessaire. Ouvrez simplement la Reconnaissance Vocale dans votre navigateur et commencez à l'utiliser immédiatement. Il n'y a ni barrière d'inscription ni restriction d'usage.

Puis-je traiter de grandes quantités de texte ?

Oui, la Reconnaissance Vocale gère du texte de n'importe quelle longueur grâce à un traitement rapide et en temps réel. Comme tout s'exécute dans votre navigateur, les performances dépendent de votre appareil, mais l'outil fonctionne bien dans la plupart des cas.

Comment utiliser la Reconnaissance Vocale ?

Saisissez simplement votre texte dans le champ prévu à cet effet, ajustez les paramètres selon vos préférences, et l'outil le traitera instantanément. Vous pourrez ensuite copier le résultat dans votre presse-papiers ou le télécharger.

Quels navigateurs sont pris en charge ?

La Reconnaissance Vocale fonctionne sur tous les navigateurs modernes, dont Chrome, Firefox, Safari, Edge et Opera. Pour une expérience optimale, utilisez la dernière version de votre navigateur préféré.

Comment ajouter de la ponctuation en dictant avec la reconnaissance vocale ?

Vous prononcez la ponctuation à voix haute. Une fois les commandes vocales de ponctuation activées, il suffit de dire le nom du signe pendant que vous parlez pour qu'il soit inséré automatiquement : « point », « virgule », « point d'interrogation », « point d'exclamation », « deux-points », « point-virgule » et « tiret ». Pour la mise en page, dites « nouvelle ligne » ou « nouveau paragraphe » pour aller à la ligne. La première lettre après un signe de fin de phrase et le début de chaque nouvelle ligne sont mis en majuscule automatiquement, si bien que la transcription se lit comme un texte rédigé plutôt que comme un flux de mots ininterrompu. Il n'est pas nécessaire de marquer une pause pour insérer quoi que ce soit. Si vous oubliez une commande, ouvrez le panneau des commandes vocales de ponctuation pour consulter la liste complète. Essayez de dicter une phrase en terminant par le mot « point » pour la voir apparaître correctement ponctuée.

Quelle est la fiabilité de la reconnaissance vocale du navigateur et que signifient les scores de confiance ?

La précision dépend de votre microphone, du bruit ambiant, de votre accent, et de la correspondance entre la langue sélectionnée et ce que vous dites. Pour vous aider à en juger, activez Afficher les scores de confiance : l'outil étiquette alors chaque segment finalisé selon la valeur renvoyée par le moteur de reconnaissance : Élevé signifie 90 % ou plus et est généralement correct, Moyen couvre 70 % à 89 % et mérite une relecture rapide, et Faible se situe en dessous de 70 % et contient probablement une erreur. Un score de confiance moyen s'affiche également au-dessus de la transcription. Des scores faibles signalent souvent du bruit, un micro trop éloigné, ou un dialecte mal sélectionné, ce qui indique précisément où réenregistrer ou corriger le texte. Comme la transcription reste modifiable même pendant l'enregistrement, vous pouvez corriger n'importe quel mot à la main. Activez les scores de confiance pour voir comment le moteur évalue votre dictée.

Puis-je exporter une transcription de reconnaissance vocale en sous-titres pour une vidéo ?

Oui. En plus de la copie dans le presse-papiers et du téléchargement en simple fichier .txt, cet outil exporte votre transcription en fichier de sous-titres .srt. Chaque segment prononcé reçoit des horodatages calculés à partir du moment où il a réellement été reconnu pendant la session, si bien que les sous-titres correspondent approximativement à l'instant où vous avez prononcé chaque phrase. C'est un moyen rapide d'ébaucher des sous-titres pour un enregistrement d'écran, une voix off, ou une vidéo face caméra, que vous pourrez ensuite affiner dans votre logiciel de montage. Notez que l'export .srt ne fonctionne qu'une fois qu'au moins un segment est finalisé, puisque les horodatages proviennent d'événements de reconnaissance réels et non d'estimations. Pour des sous-titres les plus nets possibles, dictez à un rythme régulier et corrigez les segments à faible confiance avant d'exporter. Enregistrez votre narration, puis cliquez sur le bouton .srt pour télécharger des sous-titres prêts à l'emploi.

Pourquoi la reconnaissance vocale ne fonctionne-t-elle pas dans Firefox ou pas entièrement dans Safari ?

Cet outil s'appuie sur l'API Web Speech, la fonctionnalité de reconnaissance vocale intégrée directement au navigateur, et tous les navigateurs ne l'exposent pas. La reconnaissance est complète dans Chrome sur ordinateur et Android ainsi que dans Edge, ce qui explique pourquoi ces navigateurs sont recommandés. Safari n'offre qu'un support partiel, donc les résultats peuvent y être moins fiables, et Firefox n'expose actuellement pas du tout l'API de reconnaissance vocale, ce qui fait que l'outil ne peut tout simplement pas s'y exécuter. Lorsque votre navigateur ne prend pas en charge cette fonctionnalité, la page le détecte et affiche un message clair plutôt que d'échouer silencieusement. La solution consiste à ouvrir l'outil dans Chrome ou Edge, où la dictée, le mode continu et les scores de confiance fonctionnent tous. Si la reconnaissance ne démarre pas, passez à un navigateur pris en charge et autorisez l'accès au microphone lorsque cela vous est demandé.

Choisir la bonne langue ou le bon dialecte améliore-t-il la reconnaissance vocale ?

Oui, et cela compte plus qu'on ne le pense généralement. L'outil propose plus de 45 langues et dialectes régionaux, dont plusieurs variantes de l'anglais, de l'espagnol, du français, du portugais, du chinois et de l'arabe, ainsi que l'hindi, le bengali, le tamoul, le japonais, le coréen, l'allemand, et bien d'autres. Le moteur de reconnaissance s'ajuste à l'accent et au vocabulaire du dialecte choisi, si bien que sélectionner English (India) plutôt qu'English (US), ou Spanish (Mexico) plutôt que Spanish (Spain), peut réduire sensiblement les erreurs lorsque cela correspond à votre façon de parler. Un dialecte mal choisi est une cause fréquente de scores de confiance faibles et de choix de mots étranges. Définissez la langue avant de démarrer l'enregistrement, car elle ne peut pas être modifiée en cours de session. Choisissez le dialecte le plus proche de votre propre accent, réduisez le bruit ambiant, et parlez à un rythme modéré pour obtenir la transcription la plus nette possible.

Embed This Tool

Add a free, live version of this widget to your own website or blog post — it runs entirely in your visitors' browsers, with a credit link back to The Toolbox.

Copy & paste this HTML
<iframe src="https://getthetoolbox.com/embed/speech-to-text" title="Free Speech to Text Online — The Toolbox" width="100%" height="280" style="max-width:480px;border:1px solid #e2e8f0;border-radius:12px" loading="lazy"></iframe>
<p style="font-size:12px;margin:4px 0 0"><a href="https://getthetoolbox.com/text-tools/speech-to-text?utm_source=embed&utm_medium=widget" target="_blank" rel="noopener">Free Speech to Text Online</a> by The Toolbox</p>

À propos de l'outil Speech to Text gratuit (reconnaissance vocale en ligne)

Speech to Text transforme votre voix en texte écrit en temps réel. Cliquez sur Démarrer l'enregistrement, autorisez l'accès au micro, et vos paroles s'affichent au fil de votre discours dans une zone de transcription modifiable, avec un aperçu « À l'écoute » montrant en direct les mots encore en cours de traitement avant validation. Il s'adresse à quiconque pense plus vite qu'il ne tape : rédacteurs composant à la voix, étudiants prenant des notes de cours, professionnels dictant leurs e-mails, et toute personne pour qui le clavier est fatigant ou peu accessible.

L'outil repose sur l'API Web Speech intégrée aux navigateurs modernes : rien à installer, aucun compte à créer. La reconnaissance fonctionne le mieux dans Chrome (ordinateur et Android) et Edge, où la prise en charge est complète. Safari n'offre qu'un support partiel, et Firefox n'expose actuellement pas l'API de reconnaissance vocale — l'outil vous avertit donc s'il ne peut pas s'exécuter dans votre navigateur.

Comment fonctionnent la dictée et la ponctuation

Inutile d'arrêter de parler pour ajouter de la ponctuation. Une fois les commandes vocales de ponctuation activées, il suffit de prononcer le nom du signe pour qu'il soit inséré automatiquement — « point », « virgule », « point d'interrogation », « point d'exclamation », « deux-points », « point-virgule », « tiret », « guillemet ouvrant » et « guillemet fermant », ainsi que « nouvelle ligne » et « nouveau paragraphe » pour la mise en forme. La première lettre après un signe de fin de phrase est mise en majuscule automatiquement, tout comme le début de chaque nouvelle ligne, si bien que le résultat se lit comme un texte rédigé, non comme un flux brut de mots.

Deux modes d'écoute structurent les sessions plus longues. Le mode continu garde le micro actif pendant les pauses naturelles, en relançant la reconnaissance en coulisses pour qu'une longue dictée ne s'interrompe pas quand vous reprenez votre souffle. Le mode résultat unique s'arrête après une seule phrase, utile pour de courts extraits comme une requête de recherche ou une phrase isolée. Un chronomètre et des compteurs de mots et de caractères en direct tournent pendant toute la session.

Comprendre les scores de confiance

La reconnaissance vocale du navigateur renvoie une valeur de confiance pour chaque segment finalisé — une estimation du degré de certitude du moteur quant à ce qu'il a entendu. Activez Afficher les scores de confiance et chaque segment est alors étiqueté :

  • Élevé — confiance de 90 % ou plus, généralement fiable.
  • Moyen — de 70 % à 89 %, mérite une relecture rapide.
  • Faible — en dessous de 70 %, susceptible de contenir une erreur.

Un score de confiance moyen s'affiche également au-dessus de la transcription. Des scores faibles signalent souvent un bruit de fond, un micro trop éloigné, ou une langue mal sélectionnée — un bon indice pour savoir où réenregistrer ou corriger. La transcription reste entièrement modifiable à tout moment : vous pouvez corriger un mot à la main même pendant que l'enregistrement se poursuit.

Exporter, historique et confidentialité

Une fois terminées, les transcriptions peuvent être copiées dans le presse-papiers, téléchargées en simple fichier .txt, ou exportées en fichier de sous-titres .srt avec des horodatages tirés du moment où chaque segment a été prononcé — pratique pour sous-titrer une vidéo. Le bouton Enregistrer conserve une transcription, avec sa langue, sa durée et son nombre de mots, dans le stockage local de votre navigateur ; vous pouvez recharger ou supprimer d'anciennes entrées depuis le panneau Historique, qui garde vos transcriptions les plus récentes sur cet appareil.

Précision importante sur la confidentialité : cet outil s'appuyant sur le moteur vocal intégré du navigateur, l'audio peut être envoyé au service cloud de l'éditeur de ce navigateur pour être transcrit — par exemple, Chrome fait transiter l'audio par le service de reconnaissance de Google. Ce traitement est effectué par votre navigateur, pas par ce site. Le texte de votre transcription n'est jamais envoyé ni stocké sur nos serveurs, et votre historique enregistré ne vit que dans le stockage local de votre navigateur.

L'outil Speech to Text couvre plus de 45 langues et dialectes régionaux, dont plusieurs variantes de l'anglais, de l'espagnol, du français, du portugais, du chinois et de l'arabe, ainsi que l'hindi, le japonais, le coréen, l'allemand, et bien d'autres. Choisir le dialecte le plus proche de votre accent — par exemple English (India) plutôt qu'English (US) — améliore sensiblement la précision. Pour un résultat optimal, parlez à un rythme modéré, réduisez le bruit ambiant, et gardez le micro à une distance stable.