Поради та підказки

Отримайте максимум від DijiFlow Dictate

Кілька невеликих налаштувань суттєво впливають на точність, швидкість і зручність. Ось наші улюблені способи налаштувати застосунок під ваш голос, вашу мову та ваш комп'ютер.

Ваш мікрофон важливіший за будь-яке окреме налаштування в застосунку. Петличний мікрофон (лавальє) — маленька кліпса, що кріпиться до сорочки чи коміра — одне з найдешевших і найпомітніших покращень точності, яке ви можете зробити. Він розташований близько до рота, зберігає стабільну відстань, коли ви рухаєтеся, і відсікає значну частину шуму приміщення, який заважає вбудованому мікрофону ноутбука.

Коротко: майже будь-який зовнішній мікрофон, який опиняється ближче до рота, ніж вбудований у ноутбук, помітно покращить ваші результати.

Поріг тиші — це те, що вказує DijiFlow різницю між вашим мовленням і фоновим шумом. Правильно виставити його для вашого приміщення — це те єдине налаштування, яке запобігає більшості пропущених слів і хибних спрацювань. Скористайтеся вбудованою перевіркою мікрофона, щоб точно його налаштувати.

  1. 1 Відкрийте Налаштування й натисніть Перевірити мікрофон.
  2. 2 Говоріть як зазвичай і стежте за індикатором рівня — поки ви говорите, він має бути приблизно між серединою та правим краєм індикатора.
  3. 3 Тепер помовчіть — рівень має впасти й лишатися нижче білої лінії. Де саме має бути ця лінія, залежить від того, наскільки шумно у вашому приміщенні.
  4. 4 Перетягніть фільтр тиші, щоб пересунути білу лінію вгору чи вниз. Ця біла лінія — ваш поріг тиші; усе нижче за неї вважається тишею.
  5. 5 Перетягніть чутливість мікрофона, щоб змінити, наскільки високо ваш голос піднімається на індикаторі, щоб мовлення впевнено перевищувало лінію.

Прагніть чіткого проміжку: ваше мовлення значно вище білої лінії, а тиша значно нижче за неї. Перевіряйте це щоразу, коли змінюєте приміщення чи мікрофон.

DijiFlow може вивчити слова, характерні саме для вас — імена, жаргон, бренди — і виправляти їх автоматично. Оскільки це відбувається після транскрипції, воно вдосконалює результат, ніколи не впливаючи на те, що модель насправді чує.

  1. 1 Відкрийте вкладку Словник.
  2. 2 Позначте галузі, які вас стосуються, щоб завантажилися потрібні набори термінів.
  3. 3 Додайте власні терміни — імена колег, назву вашої компанії, назви продуктів і будь-які слова, які ви часто вимовляєте.
  4. 4 Якщо застосунок постійно неправильно чує одне конкретне слово, додайте його правильне написання до своїх термінів, і він почне записувати його правильно.

Сприймайте свої терміни як список, що постійно поповнюється: щоразу, коли щось виходить неправильно, додавайте правильний варіант — і це припиняється.

Більші моделі точніші, але вони повільніші й використовують більше пам'яті — RAM на Mac, VRAM на Windows. Для кожного комп'ютера є оптимальна точка, тож варто завантажити кілька й перевірити, яка встигає за вами.

  1. 1 Для англійської зазвичай оптимальні small або medium. На слабших комп'ютерах base теж працює добре.
  2. 2 Для інших мов або змішаного/багатомовного використання ми наполегливо рекомендуємо medium чи large — менші моделі швидко втрачають точність поза англійською.
  3. 3 Завантажте кілька розмірів і перевірте їх на власному мовленні, щоб побачити, з чим ваш комп'ютер справляється комфортно.

Якщо більша модель здається неповороткою, зменшіть на один розмір — швидка модель, якою ви справді користуєтеся, краща за точну, якої ви уникаєте.

Push-to-talk має бути невимушеним — таким, що ви можете утримувати не замислюючись. Найкраще сполучення — те, поряд з яким уже лежать ваші пальці, і ви можете навіть цілком перенести його з клавіатури.

  1. 1 Чудові комбінації клавіш, які варто спробувати: Ctrl+Space, Alt+Space або Shift+Space (особливо на Windows).
  2. 2 На Mac Cmd+Space зайнято Spotlight — або переприсвойте Spotlight у Системні параметри → Клавіатура → Клавіатурні скорочення → Spotlight і використовуйте Cmd+Space, або просто скористайтеся Shift+Space чи Ctrl+Space.
  3. 3 Хід для просунутих: прив'яжіть push-to-talk та Enter / новий рядок до кнопок «назад» і «вперед» на миші — наприклад, Shift+Назад для нового рядка та Shift+Вперед для Enter (або прив'яжіть їх безпосередньо у програмі миші).

Налаштуйте прив'язки миші — і зможете диктувати майже повністю мишею, без клавіатури. На Windows скористайтеся утилітою виробника миші; на Mac добре працює інструмент перепризначення, як-от ті, що для ігрових мишей.

Розпізнавання мовлення настільки добре, наскільки добре те, що доходить до мікрофона. Вентилятор, що дме просто в мікрофон, переповнене приміщення чи музика поруч — усе це знижує точність, часто більше, ніж очікують.

Якщо шуму не уникнути, підніміть поріг тиші під оточення, щоб застосунок не спрацьовував постійно через фон — а потім знову знизьте його, коли повернетеся в тихе місце.

Динамічна оптимізація пам'яті — це налаштування, до якого варто вдатися, коли бракує RAM (Mac) або VRAM (Windows). Вона завантажує й вивантажує моделі під час перемикання, тож у кожен момент активна лише одна модель — що зберігає слабший комп'ютер чутливим.

  1. 1 Якщо моделі здаються повільними або вашому комп'ютеру бракує пам'яті, увімкніть Динамічну оптимізацію пам'яті в Налаштуваннях.
  2. 2 Відтоді DijiFlow тримає в пам'яті лише ту модель, якою ви користуєтеся, а решту вивантажує під час перемикань.

Зверніть увагу: одночасний запуск транскрипції файлу ТА живого диктування сповільниться, якщо пам'яті обмаль — але за достатньої кількості RAM/VRAM усе працює цілком плавно.

Якщо у вашого комп'ютера є запас — приблизно понад 8 GB RAM або 12 GB VRAM — ви можете тримати дві моделі завантаженими й миттєво перемикатися між ними різними гарячими клавішами. Це одна з найпродуктивніших речей, які роблять досвідчені користувачі.

  1. 1 Двомовні? Прив'яжіть англійську до однієї гарячої клавіші, а другу мову — до іншої, і перемикайте мови без зміни налаштувань.
  2. 2 Одна мова? Прив'яжіть два розміри моделі — швидку для оперативного диктування й точнішу для випадків, коли можна трохи зачекати.
  3. 3 З Q mode ви навіть зможете змішувати мови в межах одного речення, щойно призвичаїтеся.

Це особливо зручно, коли ви пишете лист однією мовою, водночас спілкуючись чи програмуючи іншою — усе в одній сесії, без метушні.

Для нарад точність важливіша за швидкість, тож обирайте найточнішу модель, яку можете — навіть якщо вона повільніша. Пам'ятайте, що автоматична транскрипція та визначення мовців ніколи не бувають на 100% ідеальними й самі собою можуть не охопити всю нараду бездоганно. Прийом полягає в тому, щоб передати транскрипцію великій моделі ШІ, яка зведе її в щось корисне.

  1. 1 Транскрибуйте нараду з визначенням мовців, використовуючи найкращу модель, яку маєте.
  2. 2 Якщо ви знаєте, скільки людей говорило, задайте кількість мовців — це робить визначення набагато точнішим (див. пораду про кількість мовців).
  3. 3 Вставте готову транскрипцію у велику модель ШІ — ChatGPT, Gemini, Claude, DeepSeek чи Kimi — і скористайтеся готовим промптом нижче, щоб отримати чисте, зведене резюме.
Готовий до вставлення промпт для нарад
Ви допомагаєте мені перетворити необроблений запис наради на щось, чим я справді зможу скористатися.

Нижче наведено транскрипцію, згенеровану автоматично з аудіо чи відео, включно з автоматичним визначенням мовців. Читаючи її, майте на увазі дві речі:
- Позначки мовців ("Speaker 1", "Speaker 2" тощо) та окремі слова можуть бути помилковими. Якщо позначка чи слово явно суперечить контексту розмови, довіряйте контексту й непомітно виправляйте це.
- Зазвичай ви добре визначаєте, хто є хто, із самої розмови, тож там, де можливо, здогадуйтеся про імена.

Необов'язково — якщо я вже знаю, хто є хто, я зіставлю це тут (інакше залиште порожнім):
- Speaker 1 =
- Speaker 2 =
- Speaker 3 =

Будь ласка, прочитайте всю транскрипцію й надайте мені чітке, добре впорядковане резюме з такими розділами:
1. Огляд — два-три речення про те, чого стосувалася нарада та який був загальний результат.
2. Ключові моменти обговорення — основні теми, логічно згруповані, з важливими деталями під кожною.
3. Рішення — про що фактично домовилися (і ким, якщо це зрозуміло).
4. Завдання — згруповані за особами: за що вони відповідають і будь-який згаданий термін.
5. Перешкоди та ризики — усе, що згадувалося як проблема, залежність чи занепокоєння.
6. Відкриті питання — усе, що залишилося невирішеним або потребує подальших дій.

Тримайте текст стислим і зручним для перегляду. Надавайте перевагу коротким пунктам, а не довгим абзацам. Якщо щось незрозуміле або відсутнє в транскрипції, скажіть про це прямо, замість того щоб вгадувати.

Транскрипція:
[вставте сюди свою транскрипцію]

Корисно знати: ви можете продовжувати диктувати в інших застосунках, поки файл транскрибується у фоні.

DijiFlow призначений не лише для вашого власного голосу — він може транскрибувати будь-який відео- чи аудіофайл, який ви в нього перетягнете, разом із визначенням мовців. Завдяки цьому легко перетворити доповідь, інтерв'ю чи лекцію на текст.

  1. 1 Завантажте відео за допомогою будь-якого онлайн-завантажувача з YouTube.
  2. 2 Перетягніть завантажений файл у DijiFlow як відео — решту він зробить сам.

Те саме перетягування працює для будь-якого локального аудіо- чи відеофайлу, не лише з YouTube.

Якщо ваш комп'ютер має відеокарту Intel чи AMD, переконайтеся, що DijiFlow справді її використовує — апаратне прискорення значно швидше, ніж робота на процесорі (CPU).

  1. 1 Відкрийте вкладку GPU.
  2. 2 Переконайтеся, що прискорення Intel чи AMD вибрано й воно відображається як робоче.

Попередження щодо відеокарт Intel: зазвичай вони вбудовані в процесор і використовують спільну обмежену пам'ять. Якщо вам потрібна швидкість на відеокарті Intel, завантажуйте менші моделі або ввімкніть Динамічну оптимізацію пам'яті, щоб моделі помістилися.

Коли ви транскрибуєте нараду чи файл із кількома людьми, визначення мовців має вгадати, скільки є окремих голосів. Ви можете надзвичайно допомогти йому, вказавши це заздалегідь.

Якщо ви точно знаєте, скільки людей говорить у записі, задайте це число перед транскрипцією — визначення мовців стає набагато точнішим, коли йому не доводиться вгадувати.