استفد إلى أقصى حد من DijiFlow Dictate
بضع تعديلات صغيرة تُحدث فرقًا كبيرًا في الدقة والسرعة والراحة. إليك طرقنا المفضّلة لضبط التطبيق بدقة بما يلائم صوتك ولغتك وجهازك.
الميكروفون أهم من أي إعداد منفرد في التطبيق. ميكروفون الياقة (lavalier) بمشبك — ذلك المشبك الصغير الذي يُثبَّت على قميصك أو ياقتك — من أرخص وأكبر الترقيات التي يمكنك إجراؤها لتحسين الدقة. فهو قريب من فمك، ويحافظ على مسافة ثابتة أثناء تحركك، ويستبعد كثيرًا من ضوضاء الغرفة التي تربك الميكروفون المدمج في الحاسوب المحمول.
باختصار: أي ميكروفون خارجي تقريبًا يقترب من فمك أكثر من الميكروفون المدمج في حاسوبك المحمول سيحسّن نتائجك بشكل ملحوظ.
عتبة الصمت هي ما يُخبر DijiFlow بالفرق بين حديثك وضوضاء الخلفية. ضبطها بشكل صحيح لغرفتك هو التعديل الوحيد الذي يمنع معظم الكلمات الضائعة والتشغيلات الخاطئة. استخدم اختبار الميكروفون المدمج لضبطها بدقة.
- 1 افتح الإعدادات وانقر على اختبر الميكروفون.
- 2 تحدّث بشكل طبيعي وراقب مؤشر المستوى — أثناء حديثك ينبغي أن يستقر تقريبًا بين منتصف المؤشر وطرفه الأيمن.
- 3 الآن التزم الصمت — ينبغي أن ينخفض المستوى ويبقى تحت الخط الأبيض. أين يجب أن يقع هذا الخط يعتمد على مدى ضوضاء غرفتك.
- 4 اسحب مرشّح الصمت لتحريك الخط الأبيض للأعلى أو للأسفل. هذا الخط الأبيض هو عتبة الصمت لديك — كل ما تحته يُعامَل كصمت.
- 5 اسحب حساسية الميكروفون لتغيير مدى ارتفاع صوتك على المؤشر، بحيث يتجاوز حديثك الخط بأريحية.
استهدف فجوة واضحة: حديثك أعلى بكثير من الخط الأبيض، وصمتك أدنى منه بكثير. أعد التحقق منها كلما غيّرت الغرفة أو الميكروفون.
يستطيع DijiFlow أن يتعلّم الكلمات الخاصة بك — الأسماء والمصطلحات والعلامات التجارية — ويصحّحها تلقائيًا. ولأن ذلك يحدث بعد التفريغ، فإنه يشحذ النتيجة دون أن يُحيّز أبدًا ما يسمعه النموذج فعليًا.
- 1 افتح علامة التبويب القاموس.
- 2 أشِّر على المجالات التي تنطبق عليك، لتُحمَّل حِزم المصطلحات الصحيحة.
- 3 أضف مصطلحاتك الخاصة — أسماء الزملاء واسم شركتك وأسماء المنتجات وأي كلمات تقولها كثيرًا.
- 4 إذا ظل التطبيق يسمع كلمة معيّنة بشكل خاطئ، فأضِف تهجئتها الصحيحة إلى مصطلحاتك وسيبدأ بكتابتها بشكل صحيح.
اعتبر مصطلحاتك قائمة متجددة: في كل مرة يخرج شيء خاطئًا، أضِف النسخة الصحيحة فيتوقف تكرار الخطأ.
النماذج الأكبر أدق، لكنها أبطأ وتستهلك ذاكرة أكثر — RAM على Mac وVRAM على Windows. لكل جهاز نقطة مثالية، لذا يستحق الأمر تنزيل نموذجين واختبار أيهما يواكبك.
- 1 للإنجليزية، عادةً ما يكون small أو medium هو الخيار المثالي. على الأجهزة الأضعف، لا يزال base يعمل جيدًا.
- 2 للغات الأخرى أو الاستخدام المختلط/متعدد اللغات، نوصي بشدة بـ medium أو large — فخارج الإنجليزية تفقد النماذج الأصغر دقتها سريعًا.
- 3 نزّل بضعة أحجام واختبرها على حديثك أنت لترى ما يتعامل معه جهازك بأريحية.
إذا بدا نموذج أكبر بطيئًا، فانزل حجمًا واحدًا — نموذج سريع تستخدمه فعلًا أفضل من نموذج دقيق تتجنّبه.
ينبغي أن يكون «اضغط للتحدث» بلا عناء — شيء يمكنك الضغط عليه دون تفكير. أفضل اختصار هو ذلك الذي تستقر أصابعك بالقرب منه أصلًا، بل يمكنك نقله خارج لوحة المفاتيح تمامًا.
- 1 تركيبات لوحة مفاتيح رائعة لتجربتها: Ctrl+Space أو Alt+Space أو Shift+Space (خصوصًا على Windows).
- 2 على Mac، يشغل Spotlight الاختصار Cmd+Space — إما أن تعيد تعيين Spotlight في System Settings → Keyboard → Keyboard Shortcuts → Spotlight وتستخدم Cmd+Space، أو ببساطة استخدم Shift+Space أو Ctrl+Space.
- 3 خطوة احترافية: اربط «اضغط للتحدث» وEnter / سطر جديد بزرّي الرجوع والتقدّم في فأرتك — مثلًا Shift+Back لسطر جديد وShift+Forward لـ Enter (أو اربطهما مباشرة في برنامج فأرتك).
اضبط ارتباطات الفأرة فتتمكن من الإملاء بالفأرة وحدها تقريبًا — دون حاجة إلى لوحة مفاتيح. على Windows استخدم أداة الشركة المصنّعة لفأرتك؛ وعلى Mac تعمل أداة إعادة تعيين جيدًا، مثل تلك المخصصة لفئران الألعاب.
التعرّف على الكلام جيد بقدر ما يصل إلى الميكروفون. مروحة تنفخ مباشرة في الميكروفون، أو غرفة مزدحمة، أو موسيقى تُعزَف قريبًا — كلها تخفض الدقة، وغالبًا أكثر مما يتوقع الناس.
إذا كانت الضوضاء لا مفر منها، فارفع عتبة الصمت لتلائم المحيط حتى لا يتشغّل التطبيق باستمرار بسبب الخلفية — ثم اخفضها مجددًا عند عودتك إلى مكان هادئ.
تحسين الذاكرة الديناميكي هو الإعداد الذي تلجأ إليه عندما تنقصك RAM (Mac) أو VRAM (Windows). فهو يحمّل النماذج ويُفرِغها عند التبديل، بحيث لا يكون نشطًا سوى نموذج واحد في كل مرة — مما يبقي الجهاز الأضعف سريع الاستجابة.
- 1 إذا بدت النماذج بطيئة أو كان جهازك ضيّق الذاكرة، فعّل تحسين الذاكرة الديناميكي في الإعدادات.
- 2 من حينها، يبقي DijiFlow في الذاكرة النموذج الذي تستخدمه فقط ويُفرِغ البقية بين عمليات التبديل.
تنبيه: تشغيل تفريغ ملف وإملاء مباشر في الوقت نفسه سيتباطأ إذا كانت الذاكرة ضيّقة — لكن مع قدر كافٍ من RAM/VRAM يسير كل شيء بسلاسة تامة.
إذا كان لدى جهازك متّسع — أكثر من 8 GB من RAM أو 12 GB من VRAM تقريبًا — فيمكنك إبقاء نموذجين محمّلين والتبديل بينهما فورًا بمفاتيح اختصار مختلفة. إنها من أكثر الأشياء إنتاجيةً التي يفعلها المستخدمون المتمرّسون.
- 1 ثنائي اللغة؟ اربط الإنجليزية بمفتاح اختصار ولغتك الأخرى بمفتاح ثانٍ — بدّل اللغات دون تغيير أي إعداد.
- 2 لغة واحدة؟ اربط حجمي نموذجين — سريعًا للإملاء العاجل وأدق للأوقات التي يمكنك فيها الانتظار قليلًا.
- 3 مع Q mode يمكنك حتى مزج اللغات داخل الجملة الواحدة بمجرد أن تعتاد على ذلك.
يتألق هذا حين تكتب بريدًا إلكترونيًا بلغة بينما تدردش أو تبرمج بأخرى — كل ذلك في الجلسة نفسها دون عناء.
في الاجتماعات، الدقة أهم من السرعة، لذا اختر أدق نموذج تستطيعه — حتى لو كان أبطأ. تذكّر أن التفريغ التلقائي والتعرّف على المتحدثين ليسا مثاليين بنسبة 100% أبدًا، وقد لا يلتقطان اجتماعًا كاملًا بوضوح بمفردهما. الحيلة هي تسليم النص المُفرَّغ إلى نموذج ذكاء اصطناعي كبير ليدمجه في شيء مفيد.
- 1 فرّغ الاجتماع مع التعرّف على المتحدثين، مستخدمًا أفضل نموذج لديك.
- 2 إذا كنت تعرف عدد الأشخاص الذين تحدّثوا، فحدّد عدد المتحدثين — فذلك يجعل التعرّف أدق بكثير (انظر نصيحة عدد المتحدثين).
- 3 الصق النص المُفرَّغ النهائي في نموذج ذكاء اصطناعي كبير — ChatGPT أو Gemini أو Claude أو DeepSeek أو Kimi — واستخدم المطالبة الجاهزة أدناه للحصول على ملخص نظيف ومدمج.
أنت تساعدني على تحويل تسجيل اجتماع خام إلى شيء يمكنني استخدامه فعلًا.
في الأسفل نص مُفرَّغ تم إنشاؤه تلقائيًا من صوت أو فيديو، بما في ذلك التعرّف التلقائي على المتحدثين. انتبه إلى أمرين وأنت تقرأه:
- قد تكون تسميات المتحدثين («Speaker 1» و«Speaker 2» وهكذا) وبعض الكلمات أحيانًا خاطئة. حيثما تتعارض تسمية أو كلمة بوضوح مع سياق المحادثة، ثِق بالسياق وصحّحها بهدوء.
- عادةً ما تكون بارعًا في معرفة مَن هو مَن من المحادثة نفسها، لذا استنتج الأسماء حيثما أمكن.
اختياري — إن كنت أعرف مسبقًا مَن هو مَن، فسأربطهم هنا (وإلا فاتركه فارغًا):
- Speaker 1 =
- Speaker 2 =
- Speaker 3 =
اقرأ النص المُفرَّغ بالكامل وأعطني ملخصًا واضحًا ومنظّمًا جيدًا بالأقسام التالية:
1. نظرة عامة — جملتان أو ثلاث عن موضوع الاجتماع والنتيجة الإجمالية.
2. نقاط النقاش الرئيسية — الموضوعات الأساسية، مجمّعة منطقيًا، مع التفاصيل المهمة تحت كل منها.
3. القرارات — ما تم الاتفاق عليه فعلًا (ومن قِبَل مَن، إن كان واضحًا).
4. المهام — مجمّعة حسب الشخص: ما يتولّاه كل شخص، وأي موعد نهائي تم ذكره.
5. العوائق والمخاطر — أي شيء أُثير كمشكلة أو تبعية أو مصدر قلق.
6. الأسئلة المفتوحة — أي شيء بقي دون حل أو يحتاج إلى متابعة.
اجعله موجزًا وسهل التصفّح. فضّل النقاط القصيرة على الفقرات الطويلة. إن كان هناك شيء غير واضح أو مفقود من النص المُفرَّغ، فقُل ذلك بصراحة بدلًا من التخمين.
النص المُفرَّغ:
[الصق النص المُفرَّغ هنا]
من الجيد أن تعرف: يمكنك متابعة الإملاء في تطبيقات أخرى بينما يجري تفريغ ملف في الخلفية.
DijiFlow ليس لصوتك وحده — يمكنه تفريغ أي ملف فيديو أو صوت تُسقطه فيه، مع التعرّف على المتحدثين. وهذا يجعل من السهل تحويل محاضرة أو مقابلة أو درس إلى نص.
- 1 نزّل الفيديو بأي أداة تنزيل YouTube عبر الإنترنت.
- 2 اسحب الملف المُنزَّل وأفلته في DijiFlow كفيديو — وهو يتولّى الباقي.
السحب والإفلات نفسه يعمل مع أي ملف صوت أو فيديو محلي، وليس YouTube فقط.
إذا كان جهازك يحوي بطاقة رسوميات Intel أو AMD، فتأكد من أن DijiFlow يستخدمها فعلًا — فالتسريع العتادي أسرع بكثير من التشغيل على المعالج (CPU).
- 1 افتح علامة التبويب GPU.
- 2 تأكد من أن تسريع Intel أو AMD محدَّد ويظهر أنه يعمل.
تحذير لبطاقات Intel: عادةً ما تكون مدمجة في المعالج وتتقاسم ذاكرة محدودة. إن أردت السرعة على بطاقة Intel، فحمّل نماذج أصغر أو فعّل تحسين الذاكرة الديناميكي حتى تتّسع النماذج.
عندما تفرّغ اجتماعًا أو ملفًا يضم عدة أشخاص، يتعيّن على التعرّف على المتحدثين أن يخمّن كم صوتًا مميزًا هناك. يمكنك مساعدته كثيرًا بإخباره مسبقًا.
إذا كنت تعرف بالضبط عدد الأشخاص المتحدثين في التسجيل، فحدّد ذلك العدد قبل التفريغ — يصبح التعرّف على المتحدثين أدق بكثير حين لا يخمّن.