Tips en trucs

Haal het meeste uit DijiFlow Dictate

Een paar kleine aanpassingen maken een groot verschil voor nauwkeurigheid, snelheid en comfort. Hier zijn onze favoriete manieren om de app af te stemmen op jouw stem, jouw taal en jouw computer.

Je microfoon telt zwaarder dan welke afzonderlijke instelling in de app dan ook. Een dasspeldmicrofoon met clip — dat kleine klipje dat je aan je shirt of kraag bevestigt — is een van de goedkoopste en grootste verbeteringen die je voor de nauwkeurigheid kunt doen. Hij zit dicht bij je mond, houdt een constante afstand terwijl je beweegt en weert veel van het ruimtegeluid dat de ingebouwde microfoon van een laptop in de war brengt.

Kort gezegd: bijna elke externe microfoon die dichter bij je mond komt dan de ingebouwde van je laptop verbetert je resultaten merkbaar.

De stiltedrempel is wat DijiFlow het verschil vertelt tussen jou die praat en achtergrondgeluid. Die goed instellen voor jouw ruimte is de ene aanpassing die de meeste weggevallen woorden en valse triggers voorkomt. Gebruik de ingebouwde microfoontest om hem af te stellen.

  1. 1 Open Instellingen en klik op Test de microfoon.
  2. 2 Praat normaal en let op de niveaumeter — terwijl je praat, hoort hij ongeveer tussen het midden en de rechterkant van de meter te staan.
  3. 3 Blijf nu stil — het niveau hoort te zakken en onder de witte lijn te blijven. Waar die lijn precies moet staan, hangt af van hoe lawaaierig je ruimte is.
  4. 4 Sleep het stiltefilter om de witte lijn omhoog of omlaag te bewegen. Die witte lijn is je stiltedrempel — alles eronder wordt als stilte behandeld.
  5. 5 Sleep de microfoongevoeligheid om aan te passen hoe hoog je stem op de meter uitkomt, zodat je spraak ruim boven de lijn uitkomt.

Streef naar een duidelijk gat: je spraak ruim boven de witte lijn, je stilte ruim eronder. Controleer het opnieuw telkens als je van ruimte of microfoon wisselt.

DijiFlow kan de woorden leren die specifiek voor jou zijn — namen, jargon, merken — en ze automatisch corrigeren. Omdat dit ná de transcriptie gebeurt, verscherpt het het resultaat zonder ooit te beïnvloeden wat het model daadwerkelijk hoort.

  1. 1 Open het tabblad Woordenlijst.
  2. 2 Vink de vakgebieden aan die op jou van toepassing zijn, zodat de juiste termpakketten worden geladen.
  3. 3 Voeg je eigen aangepaste termen toe — namen van collega's, je bedrijf, productnamen en alle woorden die je vaak zegt.
  4. 4 Als de app een specifiek woord steeds verkeerd verstaat, voeg dan de juiste spelling toe aan je aangepaste termen en hij begint het goed te schrijven.

Zie je aangepaste termen als een doorlopende lijst: elke keer dat er iets fout uitkomt, voeg je de juiste versie toe en houdt het op.

Grotere modellen zijn nauwkeuriger, maar ze zijn trager en gebruiken meer geheugen — RAM op de Mac, VRAM op Windows. Er is voor elke computer een ideaal punt, dus het loont om er een paar te downloaden en te testen welk het jou kan bijhouden.

  1. 1 Voor Engels is small of medium meestal het ideale punt. Op minder krachtige computers werkt base nog steeds goed.
  2. 2 Voor andere talen of gemengd/meertalig gebruik raden we medium of large sterk aan — kleinere modellen verliezen buiten het Engels snel aan nauwkeurigheid.
  3. 3 Download een paar formaten en test ze op je eigen spraak om te zien wat je computer comfortabel aankan.

Als een groter model traag aanvoelt, ga dan een formaat omlaag — een snel model dat je echt gebruikt is beter dan een nauwkeurig model dat je mijdt.

Push-to-talk moet moeiteloos aanvoelen — iets wat je kunt ingedrukt houden zonder erover na te denken. De beste sneltoets is er een waar je vingers al vlakbij rusten, en je kunt hem zelfs helemaal van het toetsenbord af halen.

  1. 1 Goede toetsencombinaties om te proberen: Ctrl+Space, Alt+Space of Shift+Space (vooral op Windows).
  2. 2 Op de Mac is Cmd+Space bezet door Spotlight — wijs Spotlight opnieuw toe in Systeeminstellingen → Toetsenbord → Toetscombinaties → Spotlight en gebruik Cmd+Space, of gebruik gewoon Shift+Space of Ctrl+Space.
  3. 3 Powermove: koppel push-to-talk en Enter / nieuwe regel aan de vorige- en volgende-knop van je muis — bijvoorbeeld Shift+Vorige voor een nieuwe regel en Shift+Volgende voor Enter (of stel ze rechtstreeks in je muissoftware in).

Stel de muiskoppelingen in en je kunt vrijwel volledig met de muis dicteren — geen toetsenbord nodig. Gebruik op Windows het hulpprogramma van je muisfabrikant; op de Mac werkt een remaptool zoals die voor gamingmuizen goed.

Spraakherkenning is niet beter dan wat de microfoon bereikt. Een ventilator die recht in de microfoon blaast, een volle ruimte of muziek die vlakbij speelt trekken de nauwkeurigheid allemaal omlaag — vaak meer dan mensen verwachten.

Als het geluid onvermijdelijk is, verhoog dan je stiltedrempel om bij de omgeving te passen, zodat de app niet voortdurend door de achtergrond wordt getriggerd — verlaag hem daarna weer wanneer je terug bent op een rustige plek.

Dynamische geheugenoptimalisatie is de instelling om naar te grijpen wanneer je krap zit met RAM (Mac) of VRAM (Windows). Hij laadt en ontlaadt modellen terwijl je wisselt, zodat er altijd maar één model tegelijk actief is — wat een lichtere computer soepel houdt.

  1. 1 Als modellen traag aanvoelen of je computer krap in het geheugen zit, schakel dan Dynamische geheugenoptimalisatie in bij Instellingen.
  2. 2 Vanaf dat moment houdt DijiFlow alleen het model dat je gebruikt in het geheugen en ontlaadt de andere tussen het wisselen door.

Let op: tegelijk een bestand transcriberen ÉN live dicteren wordt trager als het geheugen krap is — maar met genoeg RAM/VRAM verloopt het volkomen soepel.

Als je computer ruimte over heeft — grofweg meer dan 8 GB RAM of 12 GB VRAM — kun je twee modellen geladen houden en er direct tussen wisselen met verschillende sneltoetsen. Het is een van de productiefste dingen die gevorderde gebruikers doen.

  1. 1 Tweetalig? Koppel Engels aan de ene sneltoets en je andere taal aan een tweede — wissel van taal zonder een instelling te veranderen.
  2. 2 Eén taal? Koppel twee modelformaten — een snel model voor snel dicteren en een nauwkeuriger model voor wanneer je even kunt wachten.
  3. 3 Met de Q mode kun je zelfs talen binnen één zin mengen, zodra je er eenmaal aan gewend bent.

Dit komt tot zijn recht wanneer je een e-mail in de ene taal schrijft terwijl je in een andere chat of programmeert — allemaal in dezelfde sessie, zonder gepruts.

Voor vergaderingen telt nauwkeurigheid zwaarder dan snelheid, dus kies het nauwkeurigste model dat je kunt — ook al is het trager. Houd er rekening mee dat automatische transcriptie en sprekerherkenning nooit 100% perfect zijn en een hele vergadering op zichzelf misschien niet netjes vastleggen. De truc is om het transcript aan een groot AI-model te geven om het samen te voegen tot iets bruikbaars.

  1. 1 Transcribeer de vergadering met sprekerherkenning, met het beste model dat je hebt.
  2. 2 Als je weet hoeveel mensen er spraken, stel dan het aantal sprekers in — het maakt de herkenning veel nauwkeuriger (zie de tip over het aantal sprekers).
  3. 3 Plak het voltooide transcript in een groot AI-model — ChatGPT, Gemini, Claude, DeepSeek of Kimi — en gebruik de kant-en-klare prompt hieronder voor een schone, samengevoegde samenvatting.
Kant-en-klare vergaderprompt om te plakken
Je helpt me om een ruwe vergaderopname om te zetten in iets wat ik echt kan gebruiken.

Hieronder staat een transcript dat automatisch is gegenereerd uit audio of video, inclusief automatische sprekerherkenning. Twee dingen om in gedachten te houden terwijl je het leest:
- De sprekerlabels ("Speaker 1", "Speaker 2", enzovoort) en af en toe een woord kunnen fout zijn. Waar een label of een woord duidelijk botst met de context van het gesprek, vertrouw dan op de context en corrigeer het stilzwijgend.
- Je bent er meestal goed in om uit het gesprek zelf op te maken wie wie is, dus leid namen af waar je kunt.

Optioneel — als ik al weet wie wie is, geef ik dat hier aan (laat anders leeg):
- Speaker 1 =
- Speaker 2 =
- Speaker 3 =

Lees het hele transcript en geef me een duidelijke, goed geordende samenvatting met deze secties:
1. Overzicht — twee of drie zinnen over waar de vergadering over ging en de algehele uitkomst.
2. Belangrijkste gesprekspunten — de hoofdonderwerpen, logisch gegroepeerd, met de belangrijke details onder elk.
3. Beslissingen — wat er daadwerkelijk is afgesproken (en door wie, als dat duidelijk is).
4. Actiepunten — gegroepeerd per persoon: waar diegene verantwoordelijk voor is en elke genoemde deadline.
5. Blokkades en risico's — alles wat is aangekaart als probleem, afhankelijkheid of zorg.
6. Openstaande vragen — alles wat onopgelost is gebleven of opvolging nodig heeft.

Houd het beknopt en makkelijk te scannen. Gebruik liever korte opsommingstekens dan lange alinea's. Als iets onduidelijk is of ontbreekt in het transcript, zeg dat dan gewoon in plaats van te gokken.

Transcript:
[plak hier je transcript]

Goed om te weten: je kunt in andere apps blijven dicteren terwijl een bestand op de achtergrond wordt getranscribeerd.

DijiFlow is niet alleen voor je eigen stem — het kan elk video- of audiobestand transcriberen dat je erin sleept, compleet met sprekerherkenning. Daarmee zet je een lezing, interview of college eenvoudig om in tekst.

  1. 1 Download de video met een willekeurige online YouTube-downloader.
  2. 2 Sleep het gedownloade bestand als video in DijiFlow — de rest doet hij zelf.

Hetzelfde slepen-en-neerzetten werkt voor elk lokaal audio- of videobestand, niet alleen voor YouTube.

Als je computer een Intel- of AMD-GPU heeft, zorg er dan voor dat DijiFlow die ook echt gebruikt — hardwareversnelling is drastisch sneller dan draaien op de CPU.

  1. 1 Open het tabblad GPU.
  2. 2 Zorg dat Intel- of AMD-versnelling geselecteerd is en als werkend wordt weergegeven.

Waarschuwing voor Intel-GPU's: die zijn meestal in de CPU ingebouwd en delen een beperkt geheugen. Wil je snelheid op een Intel-GPU, laad dan kleinere modellen of schakel Dynamische geheugenoptimalisatie in zodat de modellen passen.

Wanneer je een vergadering of een bestand met meerdere personen transcribeert, moet de sprekerherkenning raden hoeveel verschillende stemmen er zijn. Je kunt haar enorm helpen door het van tevoren aan te geven.

Als je precies weet hoeveel mensen er in de opname spreken, stel dat aantal dan in voordat je transcribeert — de sprekerherkenning wordt veel nauwkeuriger wanneer ze niet hoeft te raden.