المراجعة والاختبار النهائي
عشر وحدات لتحويل «نموذج لغوي كبير» من مفهوم عامّ إلى مساعد دعم عملاء مُشغَّل، مقاس، ومُكلَّف بأرقام. هذه هي الدورة مُكثَّفة، ثمّ الخيوط التي تعبرها، ثمّ إعلان الامتحان.
الدورة في لمحة
| الوحدة | الجوهر الواجب حفظه |
|---|---|
| 1. ما يغيّره التوسّع | القدرات الطارئة غالبًا وهم قياسي؛ التعلّم داخل السياق هو التحوّل الوظيفي الأهمّ |
| 2. التدريب المسبق | Chinchilla: 20 رمزًا لكلّ وسيط؛ إزالة التكرار قد تُضاهي مضاعفة الحجم |
| 3. الضبط بالتعليمات | استعمل apply_chat_template دائمًا؛ LoRA يفتح باب الضبط على معالج واحد |
| 4. المواءمة | DPO حلّ عمليّ يستبدل PPO؛ المواءمة لا تضمن ا لصدق ولا تمنع كسر السلوك |
| 5. فكّ الترميز | حرارة 0.5-0.7 مع top-p 0.9 قاعدة صالحة لمساعد؛ الحتميّة تستوجب البذرة |
| 6. نافذة السياق | كلفة الانتباه تربيعية؛ ضياع الوسط ظاهرة موثَّقة؛ RAG أفضل من السياق الطويل |
| 7. الهلوسة | الترسيخ والاقتباس القابل للتحقّق؛ التحذيرات في المُطالبة ضعيفة الأثر |
| 8. التكميم والخدمة | 4 بت يخفض الذاكرة إلى ربعها بفقدان محدود؛ vLLM للمعالج الرسومي، llama.cpp للمركزي |
| 9. التقييم | معايير عامّة تُلوَّث؛ ابنِ جدول تقييم داخلي من طلبات حقيقيّة |
| 10. الكلفة والمعمارية | التوجيه بين نموذج مُصغَّر ونموذج قوي يقلّص الفاتورة إلى الثلث |
الخيوط التي تعبر الدورة
النموذج نفسه ليس المسألة، بل ما حوله. خطوط الأساس على معايير عامّة تُوحي بأنّ اختيار النموذج هو القرار الحاسم. هذه الدورة أظهرت العكس: معماريّة النشر — قالب المحادثة، وفكّ الترميز، وترسيخ RAG، وطبقة تحقّق، وتوجيه، وتخبئة — تُنتِج ثمانين بالمائة من جودة النظام النهائي. نموذج متوسّط في معماريّة متينة يتفوّق على نموذج قوي في معماريّة بدائيّة. لذلك ابدأ من معماريّة قبل النموذج.
الكلفة الحقيقيّة تعبر النموذج. الفاتورة الأولى بضعة دولارات يوميًا، ثمّ مع RAG تصير ستّة أضعاف، ثمّ مع المحادثات المتعدّدة تصير الضعف مرّة أخرى، ثمّ مع نموّ الاستخدام تصير الضعف مرّة ثالثة. الوحدات 6 و10 قدّمتا الأرقام تحديدًا لتجنّب الاصطدام بها. حساب الكلفة على استخدام سنوي معقول قبل الالتزام بمزوّد قرارٌ يوفّر عشرات آلاف الدولارات.
المواءمة، والهلوسة، والتقييم مسائل مترابطة. المواءمة تُنتج نموذجًا يفضّل الإجابة على الرفض، فتزيد الهلوسة عند حدود المعرفة. الترسيخ (الوحدة 7) والامتناع المُعلَّم يوازنان ذلك. والتقييم (الوحدة 9) هو الوسيلة الوحيدة للتأكّد من أنّ الميزان تحقّق. هذه الوحدات الثلاث ليست موضوعات منفصلة، بل جبهةٌ واحدة.
المفتوح أو المِلكي ليس قرارًا نهائيًا. المشروع النموذجي يبدأ بـAPI مِلكيّ للسرعة، ثمّ ينتقل عند شروط معيّنة (حجم، تنظيم، خصوصيّة) إلى الاستضافة الداخليّة. ما يجعل الانتقال ممكنًا هو الفصل بين الكود التطبيقي والنموذج، عبر واجهة موحّدة (OpenAI API التي يحاكيها vLLM). بنينا هذا الفصل منذ البداية، حتّى قبل الحاجة إليه.
جدول القرار لمساعد الدعم
جميع القرارات الرئيسيّة في مكان واحد، مع التبعيّة على وضع المشروع:
| القرار | مشروع صغير (< 5000 طلب/يوم) | مشروع متوسّط (5-30 ألف) | مشروع كبير أو منظّم |
|---|---|---|---|
| النموذج | API نموذج متوسّط | نموذج مفتوح 7-8B مُكمَّم داخليًا | نموذج مفتوح 70B داخليًا |
| المعرفة | RAG أساسي | RAG مع مُشفّرات متعدّدة اللغات | RAG هجين، وتنقيح دلاليّ |
| نافذة السياق | 8K رمز | 16K رمز | 32K مع تلخيص منزلق |
| فكّ الترميز | حرارة 0.6، top-p 0.9 | نفسه، بعقوبة تكرار 1.1 | نفسه، مع بذرة ثابتة للتقييم |
| الهلوسة | ترسيخ + امتناع | ترسيخ + اقتباس + تحقّق آلي | ترسيخ + اقتباس + نموذج حَكَم |
| الخدمة | API خارجي | vLLM على A100 | vLLM + توجيه هرمي |
| التقييم | جدول 100 حالة | جدول 500 حالة + تصويت مستخدم | جدول 500 + حَكَم + مراجعة بشرية شهرية |
| الكلفة السنوية المتوقّعة | 1000-5000 دولار | 15-30 ألف دولار | 60-150 ألف دولار |
الاختبار النهائي
يتضمّن الاختبار 40 سؤالًا تشمل الوحدات العشر: طبيعة القدرات الطارئة والتعلّم داخل السياق، وقوانين توسّع Chinchilla، والفرق بين نموذج أساس ونموذج مُضبَط، وDPO مقابل RLHF، وأثر درجة الحرارة وtop-p، وظاهرة ضياع الوسط، وحلول الهلوسة الفعّالة، ومفاضلة التكميم، وقيود المعايير المرجعيّة، وحساب كلفة الاستعلام، والقرار بين API واستضافة داخليّة.
عدّة أسئلة تعرض حالات للتشخيص: نموذج يُنتج نصوصًا مطوّلة عبثًا (ما الوسيط؟)، وذاكرة معالج تمتلئ في منتصف طلب طويل (ما السبب؟)، ونموذج يجيب على أسئلة مشروعة برفض قاطع (أيّ خلل؟)، وفاتورة API تضاعفت بعد ميزة جديدة (أين تبحث؟). المُقيَّم هو الحُكم على قرارات تشغيليّة حقيقيّة، لا الاستظهار.
في حال النجاح تُمنح شهادة الإتمام فورًا؛ ورقمها قابل للتحقّق من أيّ طرف على المنصّة.
استعِد جدول القرار أعلاه، واسأل نفسك عن كلّ صف: «كيف سأشرح لمدير غير تقنيّ لماذا هذا الخيار وليس غيره؟». إن استطعتَ تعليل كلٍّ من الحرارة 0.6، وترسيخ RAG بدل السياق الطويل، والاستضافة الداخليّة عند الحجم الكبير، والحاجة إلى جدول تقييم داخلي — فأنت جاهز. الاختبار لن يطلب منك تذكّر أرقام محدَّدة، بل تطبيق منطق الوحدات على حالات جديدة. حظًّا موفّقًا!
الامتحان النهائي
هل أنت مستعدّ لاعتماد هذه الدورة؟
40 سؤالًا تُختار عشوائيًّا من بنك أسئلة الدورة · حدّ النجاح 70 % · شهادة PDF قابلة للتحقّق تُصدَر فورًا عند النجاح.
ابدأ الامتحانيلزم تسجيل الدخول إلى حسابك في InSkillML مع اشتراك نشط. يمكنك أيضًا بدء الامتحان من دوراتي.