Tirez le meilleur de DijiFlow Dictate
Quelques petits réglages font une grande différence en matière de précision, de rapidité et de confort. Voici nos façons préférées d'ajuster l'application à votre voix, à votre langue et à votre machine.
Votre microphone compte plus que n'importe quel réglage de l'application. Un micro-cravate à pince — le petit clip qui s'accroche à votre chemise ou à votre col — est l'une des améliorations les moins chères et les plus efficaces pour la précision. Il reste près de votre bouche, garde une distance stable quand vous bougez et écarte une grande partie du bruit ambiant qui met en difficulté le micro intégré d'un ordinateur portable.
En bref : presque n'importe quel micro externe plus proche de votre bouche que celui intégré à votre ordinateur portable améliorera nettement vos résultats.
Le seuil de silence indique à DijiFlow la différence entre votre voix et le bruit de fond. Bien le régler pour votre pièce est le seul ajustement qui évite la plupart des mots manqués et des déclenchements intempestifs. Utilisez le test de micro intégré pour l'affiner.
- 1 Ouvrez les Réglages et cliquez sur Tester le micro.
- 2 Parlez normalement et observez le vumètre — pendant que vous parlez, il devrait se situer à peu près entre le milieu et la droite du vumètre.
- 3 Restez maintenant silencieux — le niveau doit baisser et rester sous la ligne blanche. La position de cette ligne dépend du niveau de bruit de votre pièce.
- 4 Faites glisser le filtre de silence pour déplacer la ligne blanche vers le haut ou le bas. Cette ligne blanche est votre seuil de silence — tout ce qui se trouve en dessous est considéré comme du silence.
- 5 Faites glisser la sensibilité du microphone pour changer la hauteur à laquelle votre voix s'affiche sur le vumètre, afin que votre parole dépasse aisément la ligne.
Visez un écart net : votre voix bien au-dessus de la ligne blanche, votre silence bien en dessous. Revérifiez ce réglage chaque fois que vous changez de pièce ou de microphone.
DijiFlow peut apprendre les mots qui vous sont propres — noms, jargon, marques — et les corriger automatiquement. Comme cela se produit après la transcription, cela affine le résultat sans jamais influencer ce que le modèle entend réellement.
- 1 Ouvrez l'onglet Vocabulaire.
- 2 Cochez les domaines qui vous concernent, afin de charger les bons lots de termes.
- 3 Ajoutez vos propres termes personnalisés — noms de collègues, votre entreprise, noms de produits et tous les mots que vous employez souvent.
- 4 Si l'application se trompe toujours sur un mot précis, ajoutez son orthographe correcte à vos termes personnalisés et elle commencera à le transcrire correctement.
Voyez vos termes personnalisés comme une liste évolutive : chaque fois qu'un mot ressort mal, ajoutez la bonne version et le problème disparaît.
Les modèles plus grands sont plus précis, mais ils sont plus lents et consomment plus de mémoire — la RAM sur Mac, la VRAM sur Windows. Il existe un juste équilibre pour chaque machine, alors cela vaut la peine d'en télécharger quelques-uns et de tester lequel suit votre rythme.
- 1 Pour l'anglais, small ou medium est généralement le bon équilibre. Sur les machines moins puissantes, base fonctionne encore bien.
- 2 Pour d'autres langues ou un usage mixte/multilingue, nous recommandons vivement medium ou large — les petits modèles perdent vite en précision hors de l'anglais.
- 3 Téléchargez quelques tailles et testez-les sur votre propre voix pour voir ce que votre machine gère confortablement.
Si un modèle plus grand vous semble poussif, descendez d'une taille — un modèle rapide que vous utilisez vraiment vaut mieux qu'un modèle précis que vous évitez.
Le push-to-talk doit sembler naturel — quelque chose que vous pouvez maintenir sans y penser. Le meilleur raccourci est celui près duquel vos doigts reposent déjà, et vous pouvez même le déplacer entièrement en dehors du clavier.
- 1 D'excellentes combinaisons de touches à essayer : Ctrl+Space, Alt+Space ou Shift+Space (surtout sous Windows).
- 2 Sur Mac, Cmd+Space est utilisé par Spotlight — soit vous réattribuez Spotlight dans Réglages Système → Clavier → Raccourcis clavier → Spotlight et utilisez Cmd+Space, soit vous utilisez simplement Shift+Space ou Ctrl+Space.
- 3 Astuce de pro : associez le push-to-talk et Entrée / retour à la ligne aux boutons précédent et suivant de votre souris — par exemple Shift+Précédent pour un retour à la ligne et Shift+Suivant pour Entrée (ou associez-les directement dans le logiciel de votre souris).
Configurez les boutons de la souris et vous pourrez dicter presque entièrement à la souris — sans clavier. Sous Windows, utilisez l'utilitaire du fabricant de votre souris ; sur Mac, un outil de remappage comme ceux pour souris de jeu fonctionne bien.
La reconnaissance vocale ne vaut que ce qui parvient au microphone. Un ventilateur soufflant droit dans le micro, une pièce bondée ou de la musique à proximité feront tous baisser la précision — souvent plus qu'on ne le pense.
Si le bruit est inévitable, relevez votre seuil de silence pour l'adapter à l'environnement afin que l'application ne soit pas sans cesse déclenchée par le fond sonore — puis rabaissez-le une fois de retour au calme.
L'Optimisation dynamique de la mémoire est le réglage à privilégier quand vous manquez de RAM (Mac) ou de VRAM (Windows). Elle charge et décharge les modèles au fur et à mesure que vous changez, si bien qu'un seul modèle est actif à la fois — ce qui garde une machine plus modeste réactive.
- 1 Si les modèles semblent lents ou si votre machine manque de mémoire, activez l'Optimisation dynamique de la mémoire dans les Réglages.
- 2 À partir de là, DijiFlow ne garde en mémoire que le modèle que vous utilisez et décharge les autres entre les changements.
À noter : lancer une transcription de fichier ET une dictée en direct en même temps ralentira si la mémoire est limitée — mais avec assez de RAM/VRAM, tout est parfaitement fluide.
Si votre machine a de la marge — en gros plus de 8 GB de RAM ou 12 GB de VRAM — vous pouvez garder deux modèles chargés et basculer instantanément entre eux avec des raccourcis différents. C'est l'une des choses les plus productives que font les utilisateurs avancés.
- 1 Bilingue ? Associez l'anglais à un raccourci et votre autre langue à un second — changez de langue sans modifier aucun réglage.
- 2 Une seule langue ? Associez deux tailles de modèle — un modèle rapide pour la dictée express et un plus précis pour quand vous pouvez patienter un instant.
- 3 Avec le Q mode, vous pouvez même mélanger les langues au sein d'une même phrase, une fois que vous en avez pris l'habitude.
Cela brille quand vous rédigez un e-mail dans une langue tout en discutant ou en codant dans une autre — le tout dans la même session, sans manipulation.
Pour les réunions, la précision compte plus que la vitesse : choisissez donc le modèle le plus précis possible — même s'il est plus lent. Gardez à l'esprit que la transcription automatique et l'identification des intervenants ne sont jamais parfaites à 100 % et ne captent pas forcément toute une réunion proprement à elles seules. L'astuce consiste à confier la transcription à un grand modèle d'IA pour la consolider en quelque chose d'utile.
- 1 Transcrivez la réunion avec identification des intervenants, en utilisant le meilleur modèle dont vous disposez.
- 2 Si vous savez combien de personnes ont parlé, indiquez le nombre d'intervenants — cela rend l'identification bien plus précise (voir l'astuce sur le nombre d'intervenants).
- 3 Collez la transcription terminée dans un grand modèle d'IA — ChatGPT, Gemini, Claude, DeepSeek ou Kimi — et utilisez l'invite prête à l'emploi ci-dessous pour obtenir un résumé propre et consolidé.
Tu m'aides à transformer un enregistrement brut de réunion en quelque chose de vraiment exploitable.
Voici ci-dessous une transcription générée automatiquement à partir d'un fichier audio ou vidéo, avec identification automatique des intervenants. Deux choses à garder à l'esprit en la lisant :
- Les étiquettes des intervenants ("Intervenant 1", "Intervenant 2", etc.) et un mot de temps en temps peuvent être erronés. Lorsqu'une étiquette ou un mot contredit clairement le contexte de la conversation, fie-toi au contexte et corrige-le discrètement.
- Tu es en général doué pour deviner qui est qui à partir de la conversation elle-même, alors déduis les noms quand tu le peux.
Facultatif — si je sais déjà qui est qui, je les indiquerai ici (sinon, laisse vide) :
- Intervenant 1 =
- Intervenant 2 =
- Intervenant 3 =
Merci de lire toute la transcription et de me donner un résumé clair et bien organisé avec ces sections :
1. Aperçu — deux ou trois phrases sur le sujet de la réunion et le résultat global.
2. Points clés de la discussion — les principaux sujets, regroupés logiquement, avec les détails importants sous chacun.
3. Décisions — ce qui a réellement été convenu (et par qui, si c'est clair).
4. Actions à mener — regroupées par personne : ce dont elle est responsable et toute échéance mentionnée.
5. Obstacles et risques — tout ce qui a été soulevé comme problème, dépendance ou préoccupation.
6. Questions ouvertes — tout ce qui reste en suspens ou nécessite un suivi.
Reste concis et facile à parcourir. Privilégie les puces courtes aux longs paragraphes. Si quelque chose est flou ou absent de la transcription, dis-le clairement plutôt que de deviner.
Transcription :
[collez votre transcription ici]
Bon à savoir : vous pouvez continuer à dicter dans d'autres applications pendant qu'un fichier se transcrit en arrière-plan.
DijiFlow ne sert pas qu'à votre propre voix — il peut transcrire n'importe quel fichier vidéo ou audio que vous y déposez, avec identification des intervenants. Il devient ainsi facile de transformer une conférence, un entretien ou un cours en texte.
- 1 Téléchargez la vidéo avec n'importe quel téléchargeur YouTube en ligne.
- 2 Glissez-déposez le fichier téléchargé dans DijiFlow en tant que vidéo — il s'occupe du reste.
Le même glisser-déposer fonctionne pour tout fichier audio ou vidéo local, pas seulement YouTube.
Si votre machine dispose d'un GPU Intel ou AMD, assurez-vous que DijiFlow l'utilise réellement — l'accélération matérielle est bien plus rapide que l'exécution sur le CPU.
- 1 Ouvrez l'onglet GPU.
- 2 Assurez-vous que l'accélération Intel ou AMD est sélectionnée et affichée comme fonctionnelle.
Avertissement pour les GPU Intel : ils sont généralement intégrés au CPU et partagent une mémoire limitée. Si vous voulez de la vitesse sur un GPU Intel, chargez des modèles plus petits ou activez l'Optimisation dynamique de la mémoire pour que les modèles tiennent.
Quand vous transcrivez une réunion ou un fichier avec plusieurs personnes, l'identification des intervenants doit deviner combien de voix distinctes il y a. Vous pouvez l'aider énormément en le lui indiquant d'emblée.
Si vous savez exactement combien de personnes parlent dans l'enregistrement, indiquez ce nombre avant de transcrire — l'identification des intervenants devient bien plus précise quand elle n'a pas à deviner.