Mis à jour le 4 septembre 2026 · Par Sumbat.T

Testez d’abord votre micro actuel



Le matériel sur votre bureau suffit probablement déjà
BlabbyAI fonctionne avec n’importe quel périphérique d’entrée que Windows ou Chrome expose, sur Whisper v3 Turbo. 60 crédits par semaine gratuits, sans carte, pour tester avant de dépenser.
Chaque roundup de micros de dictée compare capsules, diagrammes polaires et qualité de fabrication, puis recommande quelque chose de cher. Presque aucun ne mentionne le seul chiffre qui décide combien de tout cela atteint la transcription : la fréquence d’échantillonnage que le modèle lit vraiment.
Whisper, la famille de modèles derrière la plupart des outils de dictée modernes dont BlabbyAI, ne lit pas votre audio à la qualité où vous l’avez enregistré. Son étape de preprocessing rééchantillonne tout en 16 kHz mono et le convertit en spectrogramme Mel en log-magnitude avant que la première couche du réseau voie quoi que ce soit. Une fréquence d’échantillonnage de 16 kHz ne peut représenter du contenu fréquentiel que jusqu’à 8 kHz, c’est la limite de Nyquist, la moitié de la fréquence d’échantillonnage.
Donc si vous enregistrez à 48 kHz et 24 bits sur un condensateur de studio, tout ce que vous avez capturé au-dessus de 8 kHz est jeté, et la profondeur de bits supplémentaire est normalisée. Ce n’est pas une critique du modèle. L’intelligibilité de la parole humaine vit presque entièrement sous 8 kHz, c’est pourquoi la téléphonie fonctionne depuis un siècle avec bien moins. Cela signifie simplement que la fiche technique sur laquelle vous comparez les micros mesure quelque chose que le modèle ne recevra jamais.
Tout au-dessus de 8 kHz est jeté avant que le modèle ne lise
Limite supérieure de fréquence capturée, face à ce qu’un pipeline 16 kHz peut réellement représenter.
Micro condensateur de studio
20 kHz
Micro grand public typique (30 $)
20 kHz
Philips SpeechMike (423 $)
12 kHz
Ce que Whisper peut représenter
8 kHz
Sources : spécification publiée Philips SpeechMike Premium Touch (200 à 12 000 Hz) ; le preprocessing Whisper rééchantillonne tout l’audio en 16 kHz, soit un plafond de Nyquist à 8 kHz.
Pourquoi cela compte pour votre achat
L’écart entre un micro à 30 $ et un à 400 $, sur le papier, se trouve surtout dans la réponse en fréquence au-dessus de 12 kHz, le plancher de bruit à sensibilité extrême, et la fabrication. Le premier est jeté purement et simplement. Le second ne compte que si l’enregistrement est faible, ce qui est un problème de distance. Le troisième est réel, et il porte sur combien de temps l’appareil survit à être pris en main quarante fois par jour.
Si les micros chers étaient une exigence de précision, la preuve la plus claire viendrait de la dictée clinique, où les erreurs ont des conséquences réelles et où les budgets existent. Nuance Dragon y est le standard depuis deux décennies. Son exigence matérielle publiée figure sur Microsoft Learn, mise à jour le 13 juillet 2026, et elle n’est pas exigeante.
« Dragon Medical SpeechKit requires a microphone which records audio data with a bit depth of 16-bit and a sampling rate of at least 16 kHz. »
Microsoft Learn, Dragon Medical SpeechKit microphone support, mise à jour le 13 juillet 2026
Cette phrase apparaît deux fois sur la page, une pour l’édition .NET et une pour l’édition navigateur. C’est une barre que franchissent confortablement chaque casque, chaque micro USB et chaque portable construit ces quinze dernières années. Et le même document est encore plus explicite sur le mobile :
« Tests have been performed with the built-in microphones and the packaged cable-based headsets of all supported iOS devices. »
Microsoft Learn, Dragon Medical SpeechKit microphone support, éditions iOS et Android
L’entreprise qui vend l’écosystème de micro de dictée à 400 $ valide ses propres produits mobiles sur des micros de téléphone. Cela mérite qu’on s’y arrête avant de dépenser, parce que cela recadre toute la question. Ce n’est pas le matériel qui se dresse entre vous et une transcription utilisable.
Il y a une chose dans votre setup qui change la qualité de transcription plus que n’importe quel achat, et elle est gratuite. La pression acoustique obéit à la loi en inverse du carré : le niveau chute d’environ 6 dB chaque fois que la distance à la source double. Votre voix suit cette loi. La climatisation, le brouhaha d’open space et la circulation dehors non, parce qu’ils sont déjà diffus quand ils vous atteignent.
Cette asymétrie, c’est tout le jeu. Rapprocher la capsule relève votre voix face à un plancher de bruit qui reste exactement où il était. Chaque réduction de moitié de la distance, c’est environ 6 dB de rapport signal/bruit gagnés pour rien.
3 cm
Perche de casque, au coin de la bouche
référence
6 cm
Micro de dictée portable
-6 dB
12 cm
Micro de bureau, penché en avant
-12 dB
25 cm
Micro de bureau, posture assise normale
-18 dB
50 cm
Capot du portable pendant que vous tapez
-24 dB
Niveau de signal approximatif par rapport à une perche de casque, d’après la loi en inverse du carré : la pression acoustique chute d’environ 6 dB à chaque doublement de distance. Le bruit de pièce reste constant, donc chaque cran vers le bas est du rapport signal/bruit que vous perdez.
Relisez cela face au point où la précision casse vraiment. Une étude de novembre 2025 dans JAMIA Open a évalué plusieurs systèmes speech-to-text, dont Whisper v3 Turbo, face à quatre environnements de bruit enregistrés : conversations en intérieur, circulation, espaces publics bondés et intérieur d’ambulance. La précision restait à peu près stable jusqu’à environ 3 dB de rapport signal/bruit, puis se dégradait brusquement en dessous.
La conséquence pratique
Environ 6 dB séparent la zone stable de la zone d’effondrement dans cette étude, et environ 6 dB, c’est ce que vous gagnez en réduisant de moitié la distance au micro. Passer de 40 à 20 centimètres peut faire ce qu’aucun upgrade de micro à 40 centimètres ne fera.
Il y a un résultat dans l’article Whisper d’origine qui inverse l’hypothèse habituelle, et il vaut la peine de le connaître parce qu’il change ce sur quoi vous devez optimiser. Les auteurs ont comparé Whisper à un ensemble de modèles entraînés spécifiquement sur LibriSpeech, un corpus de parole lue propre, sous bruit blanc et bruit de pub ajoutés.
En conditions calmes, beaucoup de ces modèles spécialisés battent Whisper. C’est le résultat attendu : un modèle entraîné sur de l’audio propre marche bien sur de l’audio propre. Ce qui suit n’est pas attendu.
« All models quickly degrade as the noise becomes more intensive, performing worse than the Whisper model under additive pub noise of SNR below 10 dB. »
Radford et al., Robust Speech Recognition via Large-Scale Weak Supervision, arXiv:2212.04356, section 3.7
L’avantage s’inverse exactement là où le vrai travail se passe. Sous 10 dB de rapport signal/bruit, c’est un bureau normal avec des gens qui parlent, un café, une table de cuisine avec un lave-vaisselle qui tourne. Whisper a été entraîné sur 680 000 heures d’audio réel extrêmement varié plutôt que sur des enregistrements de studio propres, et l’article rapporte que « when compared to humans, the models approach their accuracy and robustness ».
La version que la plupart des outils de dictée font tourner aujourd’hui, large-v3, est allée plus loin : 1 million d’heures d’audio faiblement labellisé plus 4 millions d’heures d’audio pseudo-labellisé, 128 bins de fréquences Mel au lieu de 80, et une réduction d’erreurs annoncée de 10 % à 20 % face à son prédécesseur. BlabbyAI tourne sur Whisper v3 Turbo, la variante optimisée de ce modèle, qui est aussi la version évaluée dans l’étude sur le bruit d’ambulance ci-dessus.
Ce que cela change
Acheter un micro pour chasser un signal plus propre, c’est optimiser pour les conditions où ces modèles se différencient le moins. Leur vraie force, c’est de tenir dans des pièces qui ne sont pas calmes, et c’est probablement la pièce où vous êtes assis.
Whisper v3 Turbo, n’importe quel micro



Dictez dans n’importe quel champ de texte, avec le matériel que vous avez
L’app Windows tape dans n’importe quelle application avec Ctrl+Espace. L’extension Chrome n’a besoin d’aucun téléchargement et marche dans Gmail, Docs, Notion et chaque autre champ de texte. Les deux démarrent gratuitement.
Le Philips SpeechMike Premium Touch est le standard professionnel de dictée, et c’est vraiment un bon appareil. Il vaut la peine d’être précis sur ce qui le rend bon, parce que le marketing autour des micros de dictée pousse les gens à l’acheter pour des raisons qui ne sont pas les vraies.
Commencez par la spécification audio publiée. Le SpeechMike Premium Touch utilise une capsule condensateur électret de 10 mm avec un diagramme unidirectionnel et une réponse en fréquence de 200 à 12 000 Hz. Cette plage est plus étroite aux deux extrémités qu’un micro grand public typique à 30 $ qui annonce 20 Hz à 20 kHz. Il est volontairement limité à la bande de la parole, une décision d’ingénierie sensée et aussi un signal clair sur à quoi sert l’appareil.
Maintenant lisez ce que Philips met vraiment en avant sur sa propre page produit. Presque rien ne concerne l’audio.
Touches de fonction programmables
Philips les décrit comme « especially useful for programming speech recognition commands ». C’est la fonction que les cliniciens achètent vraiment : une main sur l’appareil, pas de clavier.
Capteur de mouvement
Il « automatically switches between different microphone modes depending on device usage », en changeant de comportement quand vous le posez et le reprenez.
Boîtier antimicrobien
Une « hygienic surface physically hinders the colonization of germs ». C’est une exigence hospitalière, et cela n’a rien à voir avec votre transcription.
Capsule découplée
Une vraie fonction audio, et révélatrice : elle existe pour rejeter le bruit de manipulation, un problème que l’appareil n’a que parce qu’il est portable et couvert de boutons.
Le modèle SMP3800, à 1 191 $, ajoute un scanner de codes-barres intégré pour qu’un clinicien puisse lier un dossier patient à une dictée en scannant un bracelet. Notez que le SMP3700 standard à 423 $ n’inclut pas le scanner, malgré la fréquence à laquelle les deux sont confondus dans les roundups. La différence de prix entre les deux modèles, c’est presque entièrement ce scanner.
Qui devrait vraiment en acheter un
Un radiologue qui dicte 120 comptes rendus par jour, un médecin qui doit essuyer l’appareil entre les patients, ou un avocat qui veut des boutons enregistrement-et-relecture sous le pouce sans toucher un clavier. Si vous dictez des e-mails et des documents à un bureau, vous achetez un scanner de codes-barres que vous ne scannerez jamais.
| Option | Prix | Distance à la bouche | Idéal pour | Le hic |
|---|---|---|---|---|
| Micro intégré du portable | 0 $ | 40 à 50 cm | Pièces calmes, test avant d’acheter | Capte le bruit du clavier juste en dessous |
| Casque filaire avec perche | 25 à 60 $ | 2 à 3 cm | Presque tout le monde, presque tout le temps | Vous portez un casque |
| Micro de bureau USB | 60 à 150 $ | 15 à 30 cm | Bureaux fixes, appels vidéo, confort | La précision dérive avec votre posture |
| Philips SpeechMike SMP3700 | 423 $ | Portable, quelques cm | Dictée clinique et juridique toute la journée | Limité à 12 kHz ; vous achetez des boutons, pas de la fidélité |
| Philips SpeechMike SMP3800 | 1 191 $ | Portable, quelques cm | Cliniciens qui scannent des codes-barres patients | Le scanner est toute la différence de prix |
La colonne qui décide la plupart des résultats, c’est la troisième, pas la deuxième. Un casque gagne non parce que sa capsule est meilleure que celle d’un micro de bureau, mais parce qu’il maintient une distance courte et fixe, quoi que fasse votre posture sur un après-midi de travail.
Avant d’acheter quoi que ce soit, quatre réglages valent le coup d’être vérifiés, parce qu’ils coûtent régulièrement aux gens plus de précision que leur matériel ne le pourrait jamais.
1. Définir explicitement le périphérique d’entrée
Windows choisit souvent par défaut le micro d’une webcam ou d’un moniteur plutôt que le casque que vous visiez. C’est la cause la plus courante de « ma dictée a empiré » sans aucun autre changement.
2. Régler le gain pour que les pics restent aux trois quarts
L’écrêtage détruit l’information de façon permanente, et aucun modèle ne peut reconstruire ce qui a été aplati. Visez sous le haut du compteur, pas dessus.
3. Désactiver le « voice enhancement »
La suppression de bruit agressive dans les pilotes audio est calibrée pour les appels téléphoniques, et elle peut mâcher exactement le détail des consonnes qu’un modèle de transcription aurait utilisé.
4. Positionner hors axe
Placez la capsule au coin de la bouche plutôt que devant, pour que les explosions de « p » et « b » ne frappent pas le diaphragme directement.
Le premier de ces points est la raison pour laquelle BlabbyAI fait du choix de micro l’étape un de son onboarding Windows, avant que vous n’enregistriez quoi que ce soit. Pas de compte à créer ni de raccourci à configurer : choisissez le périphérique, lancez une transcription d’essai pour entendre que cela marche, et c’est terminé.

Source : app Windows BlabbyAI. Le bouton micro et le périphérique d’entrée actuel sont dans la barre d’outils, donc changer de périphérique ne veut pas dire retourner dans les paramètres.
Une grande part de « mon micro de dictée ne marche pas » se révèle être une boîte de dialogue d’autorisation refusée, pas une panne matérielle. Cela vaut le coup de l’écarter avant de conclure que vous avez besoin d’un autre équipement, parce que le correctif prend moins d’une minute.
Dans Chrome, cliquez sur l’icône à gauche de la barre d’adresse, trouvez Microphone et réglez-le sur Autoriser, puis rechargez. Si le site n’y figure pas, ouvrez Paramètres, puis Confidentialité et sécurité, puis Paramètres des sites, puis Microphone, et vérifiez s’il a été placé sous « Non autorisé à utiliser votre microphone ».
Sous Windows, il y a une seconde barrière qui siège entièrement au-dessus du navigateur. Ouvrez Paramètres, puis Confidentialité et sécurité, puis Microphone, et confirmez que « Accès au microphone » et « Autoriser les applications de bureau à accéder à votre microphone » sont tous deux activés. Si votre micro marche dans une application et pas dans une autre, ce second basculeur est presque toujours la raison.
À savoir
L’extension Chrome BlabbyAI demande l’autorisation micro une fois à l’installation, puis fonctionne dans n’importe quel champ de texte sur n’importe quel site sans invite par site. Si vous butez sans cesse sur des murs d’autorisation sur des sites individuels, c’est la forme du correctif.
Les casques Bluetooth portent une complication qui n’est pas évidente sur la boîte. Quand un appareil Bluetooth ouvre son micro, beaucoup de systèmes passent la connexion d’un profil audio unidirectionnel haute qualité à un mode mains libres bidirectionnel, et la qualité audio chute nettement dans les deux sens. C’est pourquoi la musique sonne moins bien dès qu’un appel démarre.
Pour la dictée, le compromis reste en général acceptable, parce que vous êtes bien dans la zone où ces modèles sont à l’aise. Mais cela veut dire qu’un casque filaire à 30 $ battra généralement un sans-fil à 30 $, puisque le budget sans-fil est allé dans la radio plutôt que dans la capsule. Si vous avez déjà de bons écouteurs sans fil, testez-les avant de supposer qu’ils conviennent, et comparez avec n’importe quel casque filaire dans un tiroir.
Plutôt que de lire encore des recommandations, mesurez votre propre setup. La comparaison est facile à mener et elle répond à la question pour votre voix, votre pièce et votre accent, ce qu’aucun roundup ne peut.
L’offre gratuite de BlabbyAI vous donne 60 crédits par semaine, environ 2 000 mots, sans carte requise, largement assez pour mener cette comparaison correctement. Sous Windows, il y a un avantage supplémentaire pour ce test précis : History enregistre chaque enregistrement sur votre propre disque dès que vous arrêtez de parler, donc vous pouvez rejouer le même audio et le retranscrire plus tard plutôt que de faire confiance à votre mémoire de ce que le passage un sonnait.
Le résumé honnête, c’est que le choix de micro est un levier bien plus petit que le marché autour ne le laisse croire, et la raison est structurelle plutôt qu’une question d’opinion. L’audio est rééchantillonné en 16 kHz mono avant qu’un modèle de dictée ne le lise. L’appareil standard professionnel est limité à 12 kHz et se vend sur les boutons et l’hygiène. Le vendeur médical de référence demande 16 kHz et 16 bits et valide sur des micros de téléphone.
Face à tout cela, la variable libre, à quelle distance la capsule se trouve de votre bouche, fait bouger la précision d’environ la même marge qui sépare la zone stable de la zone d’effondrement dans les tests de bruit publiés. Réglez cela d’abord. S’il reste un problème ensuite, alors achetez quelque chose, et achetez un casque avant d’acheter un appareil spécialisé.
Si vous voulez tester tout cela sur votre propre voix, le côté logiciel est gratuit à essayer. BlabbyAI tourne sur Whisper v3 Turbo sous Windows avec un raccourci global Ctrl+Espace qui tape dans n’importe quelle application, et comme extension Chrome qui n’a besoin d’aucun téléchargement et fonctionne dans chaque champ de texte du navigateur. Les deux acceptent n’importe quel micro que votre système expose déjà, les deux démarrent avec 60 crédits gratuits par semaine, et l’usage illimité coûte 8,49 $ par mois. Pour un regard plus large sur la catégorie, voir notre roundup des meilleures apps de dictée ou le guide sur les logiciels de dictée.
Pour presque tout le monde, un casque filaire avec une perche que vous placez à deux ou trois centimètres du coin de la bouche, entre 25 et 60 $. La raison est géométrique, pas une question de marque : la pression acoustique chute d’environ 6 dB chaque fois que vous doublez la distance à la source, donc réduire de moitié la distance entre la bouche et la capsule gagne environ 6 dB de rapport signal/bruit. C’est un gain plus grand que de passer d’un micro correct à un micro cher à la même distance. L’exception, c’est le clinicien ou l’avocat qui dicte toute la journée et a besoin de boutons physiques, d’un scanner de codes-barres ou d’une surface désinfectable : dans ce cas, achetez un Philips SpeechMike, 423 $ pour le SMP3700 et 1 191 $ pour le SMP3800 avec scanner. Notez ce que vous achetez : un terminal de workflow portable, pas un meilleur audio. BlabbyAI tourne sur Whisper v3 Turbo et fonctionne avec n’importe quel micro que Windows ou Chrome voit déjà, donc vous pouvez tester votre matériel actuel avec 60 crédits gratuits par semaine avant de dépenser quoi que ce soit.
Non, et la spécification qui le tranche est publiée par le leader du marché. La documentation Microsoft Learn pour Dragon Medical SpeechKit, mise à jour le 13 juillet 2026, indique qu’il « requires a microphone which records audio data with a bit depth of 16-bit and a sampling rate of at least 16 kHz ». C’est une barre basse que franchissent pratiquement tous les casques, micros USB et portables modernes vendus aujourd’hui. La même page note que pour les éditions iOS et Android, « tests have been performed with the built-in microphones and the packaged cable-based headsets » des appareils pris en charge. Si la stack de dictée médicale la plus établie au monde valide sur des micros de téléphone, l’exigence matérielle pour une dictée ordinaire n’est pas l’obstacle que beaucoup imaginent. Commencez avec ce que vous avez, et ne changez que si vous entendez un problème précis. BlabbyAI adopte la même approche : il accepte n’importe quel périphérique d’entrée déjà exposé par Windows ou Chrome, ce qui vous permet de tester votre matériel actuel avec les 60 crédits gratuits par semaine avant de décider de remplacer quoi que ce soit.
Passé un micro correct placé près de la bouche, très peu. Deux faits publiés l’expliquent. Premièrement, Whisper, la famille de modèles derrière la plupart des outils de dictée modernes dont BlabbyAI, rééchantillonne tout l’audio entrant en 16 kHz mono avant de faire quoi que ce soit d’autre, comme le décrit la section preprocessing de l’article Whisper. Une fréquence d’échantillonnage de 16 kHz ne porte du contenu fréquentiel que jusqu’à 8 kHz, donc la bande supplémentaire capturée par un micro de studio est jetée avant que le modèle voie le moindre chiffre. Deuxièmement, le Philips SpeechMike Premium Touch, le standard professionnel de dictée, publie une réponse en fréquence de 200 à 12 000 Hz, plus étroite qu’un micro grand public typique à 30 $. Il est volontairement limité à la bande de la parole. Aucun de ces deux faits ne tiendrait si le surcoût portait sur la fidélité audio. Ce que l’argent achète vraiment, ce sont des boutons, une certification hygiène et une ergonomie de la main.
Un casque, pour une raison qui l’emporte sur tout le reste : il maintient une distance fixe et courte de votre bouche, peu importe comment vous bougez. Un micro de bureau n’est bon que tant que votre posture l’est, et la posture dérive sur une journée de travail. Quand vous vous reculez pour réfléchir, la distance double et vous perdez environ 6 dB de rapport signal/bruit sans le remarquer. Les casques utilisent aussi en général un diagramme directionnel orienté vers la bouche, qui rejette le bruit de pièce arrivant d’autres angles. Les micros de bureau gagnent en confort sur les longues sessions et en ne plaquant pas les cheveux, ce qui compte plus que les ingénieurs aiment l’admettre si vous faites des appels vidéo. Si vous utilisez un micro de bureau, placez-le plus près que ce qui semble naturel, environ 15 à 20 centimètres et décalé sur le côté pour ne pas respirer directement dedans.
Lisez la liste de fonctionnalités sur la page produit Philips et la réponse est claire : presque rien ne concerne l’audio. L’appareil a des touches de fonction librement configurables, décrites par Philips comme « especially useful for programming speech recognition commands » ; un capteur de mouvement intégré qui « automatically switches between different microphone modes depending on device usage » ; un capteur tactile avec fonction souris intégrée ; et un boîtier antimicrobien dont la « hygienic surface physically hinders the colonization of germs and thus improves the efficiency of the usual measures for disinfecting ». Le modèle SMP3800 ajoute un scanner de codes-barres pour lier un dossier patient à une dictée, et coûte 1 191 $. Ce sont des fonctions de workflow pour hôpital et cabinet d’avocat. Un radiologue qui dicte 120 comptes rendus par jour, a besoin d’une main libre et doit essuyer l’appareil entre les patients tire une vraie valeur. Quelqu’un qui dicte des e-mails à un bureau achète un scanner qu’il ne scannera jamais.
Moins que de se rapprocher, et il existe des recherches sur où se situe la limite. Une étude de novembre 2025 dans JAMIA Open a évalué plusieurs systèmes speech-to-text, dont Whisper v3 Turbo, face à quatre types de bruit réels : conversations en intérieur, circulation, espaces publics bondés et intérieur d’ambulance. La précision restait stable jusqu’à environ 3 dB de rapport signal/bruit, puis se dégradait brusquement en dessous. Comme réduire de moitié la distance au micro gagne environ 6 dB, passer de 40 à 20 centimètres peut faire toute la différence entre la zone stable et la zone d’effondrement, ce qu’aucun upgrade de micro à la distance d’origine ne livrerait. Un second résultat, plus surprenant, figure dans l’article Whisper d’origine : les modèles entraînés spécifiquement sur de la parole propre battent Whisper en conditions calmes, mais « all models quickly degrade as the noise becomes more intensive, performing worse than the Whisper model under additive pub noise of SNR below 10 dB ». Les modèles de dictée modernes sont au plus concurrentiels exactement là où vivent les vrais bureaux. BlabbyAI fonctionne avec Whisper v3 Turbo, exactement la version de modèle évaluée dans cette étude JAMIA Open, où elle a mieux tenu que Whisper Large et Whisper Medium sur les quatre environnements sonores testés.
Pour la plupart des gens dans une pièce raisonnablement calme, oui, et cela vaut le coup de tester avant de supposer le contraire. Un micro de portable se trouve environ à 40 à 50 centimètres de la bouche quand vous tapez normalement : c’est sa vraie faiblesse, pas la qualité de la capsule. Cette distance coûte du rapport signal/bruit face à un micro-perche à 3 centimètres, et il capte le bruit du clavier juste en dessous. Dans un bureau à domicile calme, le résultat est en général correct. En open space ou en café, c’est la première chose à corriger. Le test pratique prend deux minutes : dictez le même paragraphe deux fois, une fois avec le micro du portable et une fois avec n’importe quel casque filaire que vous avez, puis lisez les deux transcriptions côte à côte. BlabbyAI vous donne 60 crédits par semaine gratuits sans carte, assez pour mener cette comparaison honnêtement avant d’acheter du matériel.
Pas d’une façon qui atteigne la transcription. Un micro USB fait la conversion analogique-numérique dans l’appareil plutôt que sur la carte son de votre machine, ce qui aide vraiment si le circuit audio de l’ordinateur est bruyant, et il offre en général un chemin plus clair vers des réglages de gain par périphérique. Mais les deux finissent en flux 16 kHz mono au moment où un modèle de dictée les lit. Choisissez plutôt sur des critères pratiques : USB pour un bureau fixe où vous voulez un bouton mute et un molette de gain, 3,5 mm ou un casque sans fil si vous passez d’un portable à une station d’accueil. Le connecteur n’est pas la variable qui décide de votre précision. L’endroit où vous placez la capsule, oui.
Quatre, et cela prend environ cinq minutes. Premièrement, définissez explicitement le périphérique d’entrée au lieu de faire confiance au défaut, parce que Windows choisit régulièrement le micro d’une webcam ou d’un moniteur plutôt que le casque que vous visiez. BlabbyAI en fait exactement la première étape de son onboarding Windows pour cette raison. Deuxièmement, réglez le volume d’entrée pour que la parole normale plafonne autour des trois quarts du compteur, pas en haut, parce que l’écrêtage détruit de l’information qu’aucun modèle ne peut récupérer. Troisièmement, désactivez la suppression de bruit agressive et le « voice enhancement » si le pilote le propose, car ces traitements sont calibrés pour les appels téléphoniques et peuvent mâcher les consonnes qu’un modèle de transcription aurait autrement utilisées. Quatrièmement, placez la capsule sur le côté de la bouche plutôt que juste devant, pour que les explosions de « p » et « b » n’atteignent pas directement le diaphragme.
Presque toujours une invite d’autorisation refusée, pas une panne matérielle. Dans Chrome, cliquez sur l’icône à gauche de la barre d’adresse, trouvez Microphone, et réglez-le sur Autoriser, puis rechargez la page. Si le site n’apparaît jamais dans cette liste, ouvrez Paramètres, Confidentialité et sécurité, Paramètres des sites, Microphone, et regardez s’il se trouve sous « Non autorisé à utiliser votre microphone ». Sous Windows, il y a une seconde barrière au-dessus du navigateur : Paramètres, Confidentialité et sécurité, Microphone, où « Accès au microphone » et « Autoriser les applications de bureau à accéder à votre microphone » doivent tous deux être activés. Si l’audio marche dans une application et pas dans une autre, ce basculeur Windows est en général le coupable. L’extension Chrome BlabbyAI demande l’autorisation micro une fois à l’installation, puis fonctionne dans n’importe quel champ de texte sur n’importe quel site, ce qui contourne entièrement l’invite par site.
Non. BlabbyAI tourne sur Whisper v3 Turbo et accepte l’audio de n’importe quel périphérique d’entrée que votre système d’exploitation ou navigateur expose déjà, donc un micro de portable, un casque à 25 $ et un SpeechMike à 423 $ fonctionnent sans configuration. L’app Windows fait du choix de périphérique l’étape un de l’onboarding, avant que vous n’enregistriez quoi que ce soit, puis le raccourci global Ctrl+Espace tape dans le champ de texte où se trouve votre curseur. L’extension Chrome n’a besoin d’aucun téléchargement et fonctionne de la même façon dans le navigateur. Comme tout finit rééchantillonné en 16 kHz mono, le conseil honnête est de commencer avec le matériel sur votre bureau, de faire quelques enregistrements sur l’offre gratuite de 60 crédits par semaine, et de n’acheter un casque que si la transcription montre vraiment un problème que vous entendez dans l’audio.
N’importe quel casque filaire avec perche entre 25 et 60 $ fera le travail, et la raison de préférer le filaire à ce prix, c’est que le sans-fil bon marché met son budget dans la radio plutôt que dans la capsule. Le Bluetooth ajoute une seconde complication à connaître : quand un casque Bluetooth ouvre son micro, beaucoup de systèmes passent la connexion en mode mains libres qui fait chuter nettement la qualité audio, c’est pourquoi votre musique sonne moins bien dès qu’un appel démarre. Pour la dictée, le compromis reste en général acceptable, mais un casque filaire à 30 $ battra généralement un sans-fil à 30 $. Mettez la différence sur la bonne position de la perche plutôt que sur la marque. Ce qui compte, c’est que la capsule reste à quelques centimètres du coin de la bouche, à chaque session, sans que vous y pensiez.
Testez votre micro actuel avant d’en acheter un autre
BlabbyAI tourne sur Whisper v3 Turbo et fonctionne avec n’importe quel périphérique d’entrée que Windows ou Chrome voit déjà. 60 crédits par semaine gratuits sans carte, 8,49 $ par mois en illimité.