Pendant deux décennies, Dragon NaturallySpeaking a été la référence absolue en matière de précision de dictée. Cette position est en train de changer. Le moteur Whisper d'OpenAI, en particulier la variante Large v3 Turbo sortie en 2024, a atteint la parité avec Dragon pour la dictée générale et le dépasse dans de nombreux cas précis. Cet article passe en revue ce que nous savons réellement de la comparaison, avec ses sources.
Ce que signifie la « précision » en dictée
La précision de la dictée se mesure généralement par le taux d'erreur sur les mots (WER, Word Error Rate), c'est-à-dire le pourcentage de mots qui ressortent erronés dans la transcription. Plus c'est bas, mieux c'est. Un WER de 5 % signifie que 95 mots sur 100 sont corrects.
Le WER varie énormément selon les conditions : la voix du locuteur, la qualité du microphone, le bruit de fond, le domaine de vocabulaire, le style de dictée. Un chiffre de référence n'a de sens que si vous connaissez les conditions dans lesquelles il a été mesuré.
Whisper Large v3 Turbo : les chiffres publiés
OpenAI a publié Whisper Large v3 Turbo en 2024 comme une variante plus rapide de Whisper Large v3 à la précision comparable. Les taux d'erreur sur les mots rapportés sur des bancs d'essai standards :
- Whisper Large v3 (original) : 13,20 % de WER en moyenne sur des jeux de données multilingues
- Whisper Large v3 Turbo : 13,40 % de WER — à 0,2 % de l'original
- Conditions propres, anglais uniquement : 3-5 % de WER (précision de 97-95 %)
La variante Turbo tourne environ 4× plus vite que la v3 avec une précision pour ainsi dire identique. C'est le moteur qu'utilise CaringDictate.
Pour le cas d'usage typique de CaringDictate (anglais, pièce calme, microphone correct), la précision en conditions réelles est en moyenne de 96-97 % en dictée continue. Cela correspond aux chiffres publiés par OpenAI pour les conditions propres en anglais, et c'est ce que nous annonçons sur nos pages marketing.
Les allégations de précision de Dragon
Dragon a historiquement annoncé une précision de 99 %. Le détail en petits caractères : ce chiffre était obtenu sur des utilisateurs entraînés, avec des microphones-casques de haute qualité, dans des environnements silencieux, après un entraînement vocal poussé. Un utilisateur Dragon non entraîné au premier jour observe plutôt une précision de l'ordre de 92-94 %.
Pour les utilisateurs entraînés de Dragon Professional Individual disposant d'une configuration adéquate, la précision en conditions réelles se situe généralement dans la plage de 95-98 % en dictée générale. Pour les domaines spécialisés (médical, juridique), un Dragon entraîné peut grimper jusqu'à 98-99 % sur le vocabulaire pour lequel il a été personnalisé.
Le face-à-face honnête
Pour un utilisateur non entraîné, avec un casque USB générique, dictant de l'anglais conversationnel : les moteurs basés sur Whisper (CaringDictate) l'emportent généralement. Whisper ne nécessite aucun entraînement vocal et fonctionne bien dès le départ sur le large éventail de voix sur lequel il a été entraîné (plus de 680 000 heures d'audio multilingue).
Pour un utilisateur entraîné, avec un microphone haut de gamme (Plantronics, Andrea USB), dictant un vocabulaire spécialisé : un Dragon Professional entraîné peut encore prendre l'avantage sur le vocabulaire précis pour lequel il a été entraîné. L'avantage se réduit considérablement pour l'écriture générale.
Pour les locuteurs non natifs de l'anglais, les locuteurs avec un accent, ou les locuteurs présentant une légère dysarthrie due à une affection médicale : Whisper a un avantage net. Le corpus d'entraînement était bien plus diversifié que celui de Dragon, et la reconnaissance gère nettement mieux les variations de la parole.
Pour les locuteurs présentant une dysarthrie importante (maladie de Parkinson sévère, SLA affectant la parole, paralysie cérébrale affectant la parole) : ni Whisper ni Dragon n'est le bon outil. Voiceitt est spécifiquement conçu pour ce cas et est nettement meilleur que l'un comme l'autre, quoique bien plus cher.
Vitesse
Le véritable avantage de Whisper Turbo sur Dragon, c'est la vitesse. Whisper Large v3 Turbo, sur du matériel moderne (un Intel i5 des 5 dernières années, ou Apple Silicon, ou tout processeur AMD moderne), produit une transcription plus rapide que le temps réel — c'est-à-dire que vous pouvez dicter une phrase et que les mots apparaissent avant que vous ayez fini de parler. Dragon traite lui aussi en temps réel, mais présente une latence plus perceptible sur le premier mot de chaque énoncé.
Pour la dictée de textes longs, cette différence de vitesse est surtout psychologique. Pour la dictée de messages courts (commentaires Facebook, e-mails rapides), la réactivité de Whisper Turbo paraît nettement meilleure.
La question des données d'entraînement
L'avantage de précision traditionnel de Dragon provenait d'un entraînement vocal supervisé : vous lisiez un long passage à Dragon, et il construisait un modèle personnel qui reconnaissait votre voix mieux que son modèle par défaut. Cela fonctionnait, mais demandait un temps initial considérable.
Whisper ne fonctionne pas ainsi. Il a été entraîné une fois sur un vaste corpus multilingue, par OpenAI, et le modèle qui en résulte est celui que tout utilisateur de Whisper exécute. Vous ne l'entraînez pas sur votre voix. Soit il fonctionne sur votre voix, soit il ne fonctionne pas — et l'ampleur des données d'entraînement fait qu'il fonctionne raisonnablement bien sur la plupart des voix.
Ce que cela implique pour les utilisateurs : avec Dragon, vous pouvez consacrer du temps à l'entraînement pour améliorer la précision. Avec Whisper, ce que vous obtenez le premier jour est ce que vous obtenez au 365e jour. Pour la plupart des utilisateurs, c'est un atout, pas un défaut — ils ne voulaient de toute façon pas passer une heure à entraîner Dragon. Pour les utilisateurs avancés au vocabulaire technique, l'impossibilité d'entraîner Whisper à la voix est une réelle limite.
La question de la maintenance
Dragon Professional Individual est figé à la version 16 depuis 2023. Le moteur de reconnaissance n'est plus mis à jour. Microsoft a réorienté Dragon vers le médical d'entreprise et laisse le Dragon grand public tomber en désuétude.
Whisper, en revanche, est activement développé par OpenAI et la communauté open source. Whisper v3 est sorti en 2023, Whisper v3 Turbo en 2024, et des modèles successeurs sont en développement actif. CaringDictate est livré aujourd'hui avec v3 Turbo et passera à des modèles plus récents, sous forme de mise à jour gratuite, lorsqu'ils auront fait leurs preuves.
Sur un horizon de cinq ans, c'est la différence la plus importante. Un moteur de reconnaissance figé continuera de fonctionner, mais il ne profitera pas des progrès substantiels qui se produisent ailleurs dans le domaine.
Pour des groupes d'utilisateurs précis
Utilisateurs âgés au vocabulaire anglais général : Whisper (via CaringDictate) est le meilleur choix. Pas d'entraînement, pas de complexité de configuration, fonctionne bien dès le départ.
Professionnels de santé dictant des notes cliniques : Un Dragon Medical One entraîné reste la norme du secteur. Le vocabulaire médical de Whisper est bon, mais pas aussi spécialisé.
Avocats dictant des documents juridiques : Un Dragon Professional entraîné avec un vocabulaire personnalisé est difficile à battre. Whisper gère bien la plupart de l'anglais juridique, mais lui manque la possibilité de personnalisation.
Adultes atteints d'affections médicales touchant les mains mais non la parole : Whisper via CaringDictate est ce que nous recommanderions. Aucune surcharge d'entraînement, une meilleure précision sur les variations de la parole, et bien moins cher.
Locuteurs non natifs de l'anglais : Whisper a un avantage net. Son corpus d'entraînement multilingue lui permet de gérer les accents bien mieux que les modèles entraînés en anglais de Dragon.
En conclusion
Whisper Large v3 Turbo et un Dragon Professional entraîné se situent désormais à quelques points de pourcentage l'un de l'autre en matière de précision de dictée générale. Pour la plupart des utilisateurs, en particulier les personnes âgées et les utilisateurs atteints d'affections médicales, les avantages pratiques de Whisper (pas d'entraînement, meilleure gestion des accents, développement actif, coût bien plus bas) l'emportent sur l'avantage résiduel de Dragon sur le vocabulaire spécialisé.
CaringDictate est bâti sur Whisper Large v3 Turbo parce que nous pensons que c'est le bon moteur pour notre public. Le remboursement sous 30 jours vous permet de comparer par vous-même, sans aucun risque.
Où aller à partir d'ici
Lisez la comparaison complète CaringDictate vs Dragon pour les différences au niveau du produit (prix, expérience utilisateur, mises à jour, remboursement), et notre guide de confidentialité si le traitement local ou dans le cloud est important pour votre situation.