Sfaturi și trucuri

Profită la maximum de DijiFlow Dictate

Câteva mici ajustări fac o mare diferență la precizie, viteză și confort. Iată metodele noastre preferate de a regla aplicația pentru vocea ta, limba ta și calculatorul tău.

Microfonul contează mai mult decât orice setare individuală din aplicație. Un microfon lavalieră cu clips — clema mică ce se prinde de cămașă sau de guler — este una dintre cele mai ieftine și mai importante îmbunătățiri pe care le poți aduce preciziei. Stă aproape de gură, păstrează o distanță constantă când te miști și respinge mare parte din zgomotul încăperii care încurcă microfonul integrat al laptopului.

Pe scurt: aproape orice microfon extern care ajunge mai aproape de gură decât cel integrat în laptop îți va îmbunătăți vizibil rezultatele.

Pragul de liniște este ceea ce îi spune lui DijiFlow diferența dintre momentul în care vorbești și zgomotul de fundal. Reglarea lui corectă pentru încăperea ta este singura ajustare care previne majoritatea cuvintelor pierdute și a declanșărilor false. Folosește testul de microfon integrat ca să îl reglezi.

  1. 1 Deschide Setări și apasă pe Testează microfonul.
  2. 2 Vorbește normal și urmărește indicatorul de nivel — în timp ce vorbești, ar trebui să stea aproximativ între mijlocul și partea dreaptă a indicatorului.
  3. 3 Acum păstrează liniștea — nivelul ar trebui să scadă și să rămână sub linia albă. Unde trebuie să stea linia depinde de cât de zgomotoasă este încăperea ta.
  4. 4 Trage de filtrul de liniște pentru a muta linia albă în sus sau în jos. Acea linie albă este pragul tău de liniște — tot ce este sub ea este tratat ca liniște.
  5. 5 Trage de sensibilitatea microfonului pentru a schimba cât de sus ajunge vocea ta pe indicator, astfel încât vorbirea să depășească confortabil linia.

Urmărește un decalaj clar: vorbirea mult deasupra liniei albe, liniștea mult sub ea. Verific-o din nou ori de câte ori schimbi încăperea sau microfonul.

DijiFlow poate învăța cuvintele specifice ție — nume, jargon, mărci — și le poate corecta automat. Deoarece acest lucru se întâmplă după transcriere, îmbunătățește rezultatul fără a influența vreodată ceea ce aude modelul de fapt.

  1. 1 Deschide fila Vocabular.
  2. 2 Bifează domeniile care ți se potrivesc, astfel încât să fie încărcate pachetele de termeni potrivite.
  3. 3 Adaugă-ți propriii termeni — numele colegilor, firma ta, numele produselor și orice cuvinte pe care le spui des.
  4. 4 Dacă aplicația aude greșit în continuare un anumit cuvânt, adaugă ortografia corectă la termenii tăi și va începe să îl scrie corect.

Gândește-te la termenii tăi ca la o listă în continuă creștere: de fiecare dată când ceva iese greșit, adaugă versiunea corectă și nu se va mai întâmpla.

Modelele mai mari sunt mai precise, dar sunt mai lente și folosesc mai multă memorie — RAM pe Mac, VRAM pe Windows. Există un punct optim pentru fiecare calculator, așa că merită să descarci câteva și să testezi care ține pasul cu tine.

  1. 1 Pentru engleză, small sau medium este de obicei punctul optim. Pe calculatoare mai modeste, base funcționează în continuare bine.
  2. 2 Pentru alte limbi sau utilizare mixtă/multilingvă, recomandăm cu tărie medium sau large — modelele mai mici pierd rapid din precizie în afara englezei.
  3. 3 Descarcă mai multe dimensiuni și testează-le pe propria voce ca să vezi ce gestionează confortabil calculatorul tău.

Dacă un model mai mare pare greoi, coboară o dimensiune — un model rapid pe care chiar îl folosești bate unul precis pe care îl eviți.

Push-to-talk ar trebui să fie fără efort — ceva ce poți ține apăsat fără să te gândești. Cea mai bună scurtătură este cea lângă care degetele tale se odihnesc deja și o poți muta chiar complet de pe tastatură.

  1. 1 Combinații de taste grozave de încercat: Ctrl+Space, Alt+Space sau Shift+Space (mai ales pe Windows).
  2. 2 Pe Mac, Cmd+Space este ocupat de Spotlight — fie reasignează Spotlight în Setări de sistem → Tastatură → Scurtături de tastatură → Spotlight și folosește Cmd+Space, fie pur și simplu folosește Shift+Space sau Ctrl+Space.
  3. 3 Mișcare de pro: leagă push-to-talk și Enter / rând nou de butoanele înapoi și înainte ale mouse-ului — de exemplu Shift+Înapoi pentru un rând nou și Shift+Înainte pentru Enter (sau leagă-le direct în software-ul mouse-ului).

Setează asocierile mouse-ului și poți dicta aproape în întregime cu mouse-ul — fără tastatură. Pe Windows folosește utilitarul producătorului mouse-ului; pe Mac funcționează bine un instrument de remapare, precum cele pentru mouse-urile de gaming.

Recunoașterea vorbirii este la fel de bună ca ceea ce ajunge la microfon. Un ventilator care suflă direct în microfon, o încăpere aglomerată sau muzica din apropiere vor scădea precizia — adesea mai mult decât se așteaptă oamenii.

Dacă zgomotul este inevitabil, ridică pragul de liniște ca să se potrivească mediului, astfel încât aplicația să nu fie declanșată constant de fundal — apoi coboară-l din nou când revii undeva liniștit.

Optimizarea dinamică a memoriei este setarea la care să apelezi când ești pe terminate cu RAM (Mac) sau VRAM (Windows). Încarcă și descarcă modele pe măsură ce comuți, astfel încât un singur model să fie activ la un moment dat — ceea ce menține un calculator mai modest reactiv.

  1. 1 Dacă modelele par lente sau calculatorul tău este la limită cu memoria, activează Optimizarea dinamică a memoriei din Setări.
  2. 2 De atunci înainte, DijiFlow păstrează în memorie doar modelul pe care îl folosești și le descarcă pe celelalte între comutări.

Atenție: rularea unei transcrieri de fișier ȘI a dictării live în același timp va încetini dacă memoria este la limită — dar cu suficient RAM/VRAM totul este perfect fluid.

Dacă are calculatorul tău spațiu de manevră — aproximativ mai mult de 8 GB de RAM sau 12 GB de VRAM — poți ține două modele încărcate și poți comuta instantaneu între ele cu scurtături diferite. Este unul dintre cele mai productive lucruri pe care le fac utilizatorii avansați.

  1. 1 Bilingv? Leagă engleza de o scurtătură și cealaltă limbă de a doua — schimbă limbile fără să modifici vreo setare.
  2. 2 O singură limbă? Leagă două dimensiuni de model — una rapidă pentru dictare rapidă și una mai precisă pentru când poți aștepta o clipă.
  3. 3 Cu Q mode poți chiar amesteca limbi în cadrul aceleiași propoziții, odată ce te obișnuiești.

Strălucește atunci când scrii un e-mail într-o limbă în timp ce discuți sau programezi în alta — totul în aceeași sesiune, fără bătăi de cap.

La ședințe, precizia contează mai mult decât viteza, așa că alege cel mai precis model pe care îl poți — chiar dacă este mai lent. Ține cont că transcrierea automată și identificarea vorbitorilor nu sunt niciodată 100% perfecte și e posibil să nu surprindă singure o ședință întreagă fără greșeli. Trucul este să dai transcrierea unui model AI mare, care să o consolideze în ceva util.

  1. 1 Transcrie ședința cu identificarea vorbitorilor, folosind cel mai bun model pe care îl ai.
  2. 2 Dacă știi câți oameni au vorbit, setează numărul de vorbitori — face identificarea mult mai precisă (vezi sfatul despre numărul de vorbitori).
  3. 3 Lipește transcrierea finalizată într-un model AI mare — ChatGPT, Gemini, Claude, DeepSeek sau Kimi — și folosește promptul gata făcut de mai jos pentru a obține un rezumat curat și consolidat.
Prompt pentru ședințe, gata de lipit
Mă ajuți să transform o înregistrare brută a unei ședințe în ceva ce pot folosi cu adevărat.

Mai jos este o transcriere generată automat din audio sau video, inclusiv identificarea automată a vorbitorilor. Ține cont de două lucruri în timp ce o citești:
- Etichetele vorbitorilor ("Speaker 1", "Speaker 2" și așa mai departe) și, ocazional, câte un cuvânt pot fi greșite. Acolo unde o etichetă sau un cuvânt intră clar în conflict cu contextul conversației, ai încredere în context și corectează discret.
- De obicei te descurci bine să îți dai seama cine este cine chiar din conversație, așa că deduce numele acolo unde poți.

Opțional — dacă știu deja cine este cine, le voi asocia aici (altfel lasă necompletat):
- Speaker 1 =
- Speaker 2 =
- Speaker 3 =

Te rog citește toată transcrierea și oferă-mi un rezumat clar și bine organizat, cu aceste secțiuni:
1. Prezentare generală — două sau trei propoziții despre subiectul ședinței și rezultatul general.
2. Puncte cheie de discuție — principalele subiecte, grupate logic, cu detaliile importante sub fiecare.
3. Decizii — ce s-a convenit efectiv (și de către cine, dacă este clar).
4. Sarcini de acțiune — grupate pe persoană: de ce răspund și orice termen limită menționat.
5. Blocaje și riscuri — orice ridicat ca problemă, dependență sau îngrijorare.
6. Întrebări deschise — orice a rămas nerezolvat sau necesită o urmărire ulterioară.

Păstrează totul concis și ușor de parcurs. Preferă puncte scurte în locul paragrafelor lungi. Dacă ceva este neclar sau lipsește din transcriere, spune-o direct în loc să ghicești.

Transcriere:
[lipește aici transcrierea ta]

Bine de știut: poți continua să dictezi în alte aplicații în timp ce un fișier se transcrie în fundal.

DijiFlow nu este doar pentru vocea ta — poate transcrie orice fișier video sau audio pe care îl tragi în el, complet cu identificarea vorbitorilor. Astfel transformi ușor o prezentare, un interviu sau o prelegere în text.

  1. 1 Descarcă videoclipul cu orice descărcător online de YouTube.
  2. 2 Trage și plasează fișierul descărcat în DijiFlow ca videoclip — se ocupă de restul.

Aceeași tragere și plasare funcționează pentru orice fișier audio sau video local, nu doar de pe YouTube.

Dacă are calculatorul tău o placă video Intel sau AMD, asigură-te că DijiFlow o folosește cu adevărat — accelerarea hardware este dramatic mai rapidă decât rularea pe procesor (CPU).

  1. 1 Deschide fila GPU.
  2. 2 Asigură-te că accelerarea Intel sau AMD este selectată și apare ca funcțională.

Avertisment pentru plăcile video Intel: de obicei sunt integrate în procesor și împart o memorie limitată. Dacă vrei viteză pe o placă video Intel, încarcă modele mai mici sau activează Optimizarea dinamică a memoriei ca modelele să încapă.

Când transcrii o ședință sau un fișier cu mai multe persoane, identificarea vorbitorilor trebuie să ghicească câte voci distincte există. O poți ajuta enorm dacă îi spui din start.

Dacă știi exact câți oameni vorbesc în înregistrare, setează acel număr înainte de a transcrie — identificarea vorbitorilor devine mult mai precisă când nu trebuie să ghicească.