### الأسئلة الشائعة (الإنجليزية) 3.8.2025 الأحد **1. س: ما هي SL5 Aura؟** ج: إنه برنامج تحويل الكلام إلى نص على مستوى النظام وغير متصل بالإنترنت. يسمح لك بالإملاء على أي تطبيق على جهاز الكمبيوتر الخاص بك (Windows وmacOS وLinux) دون الحاجة إلى اتصال بالإنترنت. **2. س: لماذا يجب أن أستخدم هذا؟ ما الذي يجعلها مميزة؟ ** ج: **الخصوصية.** تتم معالجة بياناتك الصوتية بنسبة 100% على جهازك المحلي ولا يتم إرسالها مطلقًا إلى السحابة. وهذا يجعلها خاصة تمامًا ومتوافقة مع اللائحة العامة لحماية البيانات. **3. س: هل هو مجاني؟** ج: نعم، إصدار المجتمع مجاني تمامًا ومفتوح المصدر. يمكنك العثور على الكود والمثبت على GitHub الخاص بنا: [https://github.com/sl5net/Vosk-System-Listener](https://github.com/sl5net/Vosk-System-Listener) **4. س: ما الذي أحتاجه لاستخدامه؟** ج: جهاز كمبيوتر وميكروفون. للحصول على أفضل دقة، نوصي بشدة باستخدام ميكروفون سماعة رأس مخصص عبر ميكروفون الكمبيوتر المحمول المدمج. **5. س: الدقة ليست مثالية. كيف يمكنني تحسينه؟** ج: حاول أن تتحدث بوضوح وبصوت وسرعة ثابتين. إن تقليل الضوضاء في الخلفية واستخدام ميكروفون أفضل يحدث فرقًا كبيرًا. تخصيص البرنامج (الطاقة المتقدمة): للحصول على دقة المستوى التالي، يستخدم SL5 Aura ميزة قوية تسمى FuzzyMaps. فكر في هذه الكلمات على أنها قاموسك الشخصي الذكي. يمكنك إنشاء ملفات نصية بسيطة تحتوي على قواعد لإصلاح أخطاء التعرف الشائعة والمتكررة. مثال: إذا كان البرنامج يسمع غالبًا "get hap" بدلاً من "GitHub"، فيمكنك إضافة قاعدة تعمل على تصحيح ذلك تلقائيًا في كل مرة. الفائدة: يتيح لك ذلك "تعليم" البرنامج المصطلحات الفنية الخاصة بك، أو أسماء المنتجات، أو الاختصارات، أو حتى إنشاء مجموعات قواعد لمفردات فريدة. من خلال تخصيص هذه الخرائط، يمكنك تحسين الدقة بشكل كبير لحالة الاستخدام المحددة الخاصة بك. *** #### **الجزء الأول: أسئلة عامة** **س: ما هو SL5 Auro؟** ج: SL5 Auro هو برنامج تحويل الكلام إلى نص على مستوى النظام وغير متصل بالإنترنت. فهو يسمح لك بإملاء النص في أي تطبيق على جهاز الكمبيوتر الخاص بك (على سبيل المثال، عميل البريد الإلكتروني الخاص بك، معالج النصوص، محرر التعليمات البرمجية) دون الحاجة إلى اتصال بالإنترنت. **س: ماذا يعني "غير متصل بالإنترنت" وما سبب أهميته؟** ج: "غير متصل" يعني أن جميع عمليات معالجة الصوت تتم مباشرة على جهاز الكمبيوتر الخاص بك. لا يتم إرسال بياناتك الصوتية **مطلقًا** إلى خادم سحابي (مثل Google أو Amazon أو OpenAI). وهذا يوفر أقصى قدر من الخصوصية والأمان، مما يجعله مثاليًا للمعلومات السرية (على سبيل المثال، للمحامين والأطباء والصحفيين) ومتوافق تمامًا مع لوائح حماية البيانات مثل اللائحة العامة لحماية البيانات. **س: هل هو مجاني حقا؟ ما الفائدة؟** ج: "إصدار المجتمع" مجاني ومفتوح المصدر بنسبة 100%. لا يوجد الصيد. نحن نؤمن بقوة الأدوات مفتوحة المصدر. إذا وجدت البرنامج ذا قيمة وترغب في دعم تطويره المستمر، فيمكنك القيام بذلك عبر [Ko-fi page](https://ko-fi.com/sl5) الخاص بنا. **س: لمن هذا البرنامج؟** ج: إنه مخصص لأي شخص يكتب كثيرًا ويريد زيادة كفاءته: الكتاب، والطلاب، والمبرمجين، والمهنيين القانونيين والطبيين، والأشخاص الذين يعانون من قيود جسدية، أو أي شخص يفضل التحدث بدلاً من الكتابة. #### **الجزء الثاني: التثبيت والإعداد** **س: ما هي أنظمة التشغيل المدعومة؟** ج: تم اختبار البرنامج والتأكد من عمله على أنظمة التشغيل Windows 11 وManjaro Linux وUbuntu وmacOS. **س: كيف أقوم بتثبيته على نظام التشغيل Windows؟** ج: نحن نقدم أداة تثبيت بسيطة بنقرة واحدة. إنه برنامج نصي .Bat يتطلب حقوقًا إدارية لإعداد البيئة وتنزيل النماذج الضرورية. بمجرد تشغيله، سوف يتعامل مع كل شيء نيابةً عنك. **س: تنزيل النماذج كبير جدًا. لماذا؟** ج: إن نماذج التعرف على الكلام هي التي تسمح للبرنامج بالعمل دون اتصال بالإنترنت. أنها تحتوي على جميع البيانات اللازمة للذكاء الاصطناعي لفهم لغتك. يمكن أن يصل حجم النماذج الأكبر والأكثر دقة إلى عدة غيغابايت. يقوم برنامج التنزيل الجديد الخاص بنا بتقسيم هذه الأجزاء إلى أجزاء أصغر يمكن التحقق منها لضمان تنزيل موثوق. **س: أنا أستخدم Linux. ما هي العملية؟** ج: في نظام التشغيل Linux، ستقوم عادةً باستنساخ المستودع من GitHub وتشغيل برنامج نصي للإعداد. يقوم هذا البرنامج النصي بإنشاء بيئة افتراضية لـ Python، وتثبيت التبعيات، وبدء خدمة الإملاء. **س: عندما أنقر نقرًا مزدوجًا فوق ملف `.py` على نظام التشغيل Windows، يتم فتحه في محرر نصوص. كيف يمكنني تشغيله؟ ** ج: هذه مشكلة شائعة في Windows حيث لا ترتبط ملفات `.py` بمترجم Python. لا يجب عليك تشغيل نصوص Python الفردية مباشرةً. استخدم دائمًا البرنامج النصي الرئيسي لبدء التشغيل المقدم (على سبيل المثال، ملف ".bat")، حيث يضمن ذلك تنشيط البيئة الصحيحة أولاً. #### **الجزء 3: الاستخدام والميزات** **س: كيف يمكنني استخدامه فعليًا للإملاء؟** ج: أولاً، عليك تشغيل "خدمة الإملاء" عن طريق تشغيل البرنامج النصي المناسب. سيتم تشغيله في الخلفية. بعد ذلك، يمكنك استخدام مشغل (مثل مفتاح التشغيل السريع أو برنامج نصي مخصص) لبدء التسجيل وإيقافه. سيتم بعد ذلك كتابة النص الذي تم التعرف عليه تلقائيًا في أي نافذة نشطة حاليًا. **س: كيف يمكنني تحسين الدقة؟** ج: 1. **استخدم ميكروفونًا جيدًا:** يعد ميكروفون سماعة الرأس أفضل بكثير من الميكروفون المدمج في الكمبيوتر المحمول. 2. **تقليل الضوضاء في الخلفية:** البيئة الهادئة هي المفتاح. 3. **تحدث بوضوح:** تحدث بوتيرة وحجم ثابتين. لا تتلعثم أو تتعجل. تخصيص البرامج (الطاقة المتقدمة): للحصول على دقة المستوى التالي، يستخدم SL5 Auro ميزة قوية تسمى FuzzyMaps. فكر في هذه الكلمات على أنها قاموسك الشخصي الذكي. يمكنك إنشاء ملفات نصية بسيطة تحتوي على قواعد لإصلاح أخطاء التعرف الشائعة والمتكررة. مثال: إذا كان البرنامج يسمع غالبًا "get hap" بدلاً من "GitHub"، فيمكنك إضافة قاعدة تعمل على تصحيح ذلك تلقائيًا في كل مرة. الفائدة: يتيح لك ذلك "تعليم" البرنامج المصطلحات الفنية الخاصة بك، أو أسماء المنتجات، أو الاختصارات، أو حتى إنشاء مجموعات قواعد لمفردات فريدة. من خلال تخصيص هذه الخرائط، يمكنك تحسين الدقة بشكل كبير لحالة الاستخدام المحددة الخاصة بك. **س: هل يمكنني تبديل اللغات؟** ج: نعم. يدعم النظام "إعادة التحميل السريع" لملفات التكوين. يمكنك تغيير نموذج اللغة في التكوين، وستتحول الخدمة إليه على الفور دون الحاجة إلى إعادة التشغيل. **س: ما هي "أداة اللغة"؟** ج: LanguageTool عبارة عن مدقق نحوي وأسلوب مفتوح المصدر قمنا بدمجه. بعد تحويل كلامك إلى نص، تقوم LanguageTool تلقائيًا بتصحيح أخطاء النسخ الشائعة (على سبيل المثال، "يمين" مقابل "كتابة") وإصلاح علامات الترقيم، مما يؤدي إلى تحسين الإخراج النهائي بشكل ملحوظ. #### **الجزء الرابع: استكشاف الأخطاء وإصلاحها والدعم** **س: لقد بدأت الخدمة، ولكن لم يحدث شيء عندما أحاول الإملاء.** ج: تأكد مما يلي: 1. هل لا تزال الخدمة قيد التشغيل في المحطة/وحدة التحكم الخاصة بك؟ ابحث عن أي رسائل خطأ. 2. هل تم تحديد الميكروفون بشكل صحيح باعتباره جهاز الإدخال الافتراضي في نظام التشغيل الخاص بك؟ 3. هل تم كتم صوت الميكروفون أو تم ضبط مستوى الصوت على مستوى منخفض جدًا؟ **س: لقد وجدت خطأ أو لدي فكرة لميزة جديدة. ماذا علي أن أفعل؟** ج: هذا عظيم! أفضل مكان للإبلاغ عن الأخطاء أو اقتراح الميزات هو فتح "مشكلة" على [GitHub repository](https://github.com/sl5net/Vosk-System-Listener) الخاص بنا. **5. س: الدقة ليست مثالية. كيف يمكنني تحسينه؟** ج: تعتمد الدقة على كل من الإعداد وتخصيص البرنامج. * **الإعداد الخاص بك (الأساسيات):** حاول التحدث بوضوح بصوت وسرعة ثابتين. إن تقليل الضوضاء في الخلفية واستخدام ميكروفون سماعة رأس جيد بدلاً من الميكروفون المدمج في الكمبيوتر المحمول يُحدث فرقًا كبيرًا. * **تخصيص البرامج (الطاقة المتقدمة):** للحصول على دقة المستوى التالي، يستخدم SL5 Auro ميزة قوية تسمى **FuzzyMaps**. فكر في هذه الكلمات على أنها قاموسك الشخصي الذكي. يمكنك إنشاء ملفات نصية بسيطة تحتوي على قواعد لإصلاح أخطاء التعرف الشائعة والمتكررة. * **مثال:** إذا كان البرنامج كثيرًا ما يسمع عبارة "get hap" بدلاً من "GitHub"، فيمكنك إضافة قاعدة تعمل على تصحيح ذلك تلقائيًا في كل مرة. * **الفائدة:** يتيح لك ذلك "تعليم" البرنامج المصطلحات الفنية المحددة، أو أسماء المنتجات، أو الاختصارات، أو حتى إنشاء مجموعات قواعد لمفردات فريدة. من خلال تخصيص هذه الخرائط، يمكنك تحسين الدقة بشكل كبير لحالة الاستخدام المحددة الخاصة بك. ### الغوص العميق في التصميم المعماري: تحقيق نمط التسجيل المستمر "جهاز الاتصال اللاسلكي" تطبق خدمة الإملاء لدينا بنية قوية تعتمد على الحالة لتوفير تجربة تسجيل سلسة ومستمرة، تشبه استخدام جهاز اتصال لاسلكي. النظام جاهز دائمًا لالتقاط الصوت، ولكنه يعالجه فقط عند تشغيله بشكل صريح، مما يضمن استجابة عالية واستخدامًا منخفضًا للموارد. يتم تحقيق ذلك عن طريق فصل حلقة الاستماع الصوتي عن سلسلة المعالجة وإدارة حالة النظام بمكونين رئيسيين: علامة حدث "active_session" و"audio_manager" للتحكم في الميكروفون على مستوى نظام التشغيل. **منطق آلة الدولة:** يعمل النظام في حلقة دائمة، تتم إدارتها بواسطة مفتاح تشغيل سريع واحد يقوم بالتبديل بين حالتين أساسيتين: 1. **حالة الاستماع (افتراضي/جاهز):** * **الحالة:** علامة `الجلسة النشطة` هي `خطأ`. * **حالة الميكروفون:** تم **كتم صوت الميكروفون** لـ `إلغاء كتم صوت الميكروفون()`. مستمع Vosk نشط وينتظر إدخال الصوت. * **الإجراء:** عندما يضغط المستخدم على مفتاح التشغيل السريع، تنتقل الحالة. يتم تعيين علامة `active_session` على `True`، للإشارة إلى بداية الإملاء "الحقيقي". 2. **حالة المعالجة (انتهى المستخدم من التحدث):** * **الحالة:** يقوم المستخدم بالضغط على مفتاح التشغيل السريع بينما تكون علامة "الجلسة_النشطة" هي "صحيح". * **حالة الميكروفون:** **الإجراء الأول** هو **كتم صوت** الميكروفون فورًا عبر `mute_microphone()`. يؤدي هذا إلى إيقاف تدفق الصوت إلى محرك Vosk على الفور. * **فعل:** * تم ضبط علامة "الجلسة النشطة" على "خطأ". * يتم استرداد الجزء الصوتي النهائي الذي تم التعرف عليه من Vosk. * يتم إطلاق سلسلة المعالجة بهذا النص النهائي. * بشكل حاسم، داخل كتلة `أخيرًا`، ينفذ مؤشر ترابط المعالجة `unmute_microphone()` عند الانتهاء. ** "سحر" إشارة إلغاء كتم الصوت:** مفتاح الحلقة اللانهائية هو المكالمة النهائية `unmute_microphone()`. بمجرد الانتهاء من معالجة الإملاء `A` وإلغاء كتم صوت الميكروفون، يعود النظام تلقائيًا وعلى الفور إلى حالة **الاستماع**. يبدأ مستمع Vosk، الذي كان ينتظر بفارغ الصبر، على الفور في تلقي الصوت مرة أخرى، ويكون جاهزًا لالتقاط الإملاء "B". يؤدي هذا إلى إنشاء دورة عالية الاستجابة: `اضغط -> تحدث -> اضغط -> (كتم الصوت والمعالجة) -> (إلغاء كتم الصوت والاستماع)` تضمن هذه البنية عدم كتم صوت الميكروفون إلا لفترة قصيرة من معالجة النص، مما يجعل النظام يبدو فوريًا للمستخدم مع الحفاظ على تحكم قوي ومنع التسجيلات الهاربة.