انتقل إلى المحتوى الرئيسي

المراجعة والاختبار النهائي

عشر وحدات لتحويل «نموذج لغوي كبير» من مفهوم عامّ إلى مساعد دعم عملاء مُشغَّل، مقاس، ومُكلَّف بأرقام. هذه هي الدورة مُكثَّفة، ثمّ الخيوط التي تعبرها، ثمّ إعلان الامتحان.

الدورة في لمحة

الوحدةالجوهر الواجب حفظه
1. ما يغيّره التوسّعالقدرات الطارئة غالبًا وهم قياسي؛ التعلّم داخل السياق هو التحوّل الوظيفي الأهمّ
2. التدريب المسبقChinchilla: 20 رمزًا لكلّ وسيط؛ إزالة التكرار قد تُضاهي مضاعفة الحجم
3. الضبط بالتعليماتاستعمل apply_chat_template دائمًا؛ LoRA يفتح باب الضبط على معالج واحد
4. المواءمةDPO حلّ عمليّ يستبدل PPO؛ المواءمة لا تضمن الصدق ولا تمنع كسر السلوك
5. فكّ الترميزحرارة 0.5-0.7 مع top-p 0.9 قاعدة صالحة لمساعد؛ الحتميّة تستوجب البذرة
6. نافذة السياقكلفة الانتباه تربيعية؛ ضياع الوسط ظاهرة موثَّقة؛ RAG أفضل من السياق الطويل
7. الهلوسةالترسيخ والاقتباس القابل للتحقّق؛ التحذيرات في المُطالبة ضعيفة الأثر
8. التكميم والخدمة4 بت يخفض الذاكرة إلى ربعها بفقدان محدود؛ vLLM للمعالج الرسومي، llama.cpp للمركزي
9. التقييممعايير عامّة تُلوَّث؛ ابنِ جدول تقييم داخلي من طلبات حقيقيّة
10. الكلفة والمعماريةالتوجيه بين نموذج مُصغَّر ونموذج قوي يقلّص الفاتورة إلى الثلث

الخيوط التي تعبر الدورة

النموذج نفسه ليس المسألة، بل ما حوله. خطوط الأساس على معايير عامّة تُوحي بأنّ اختيار النموذج هو القرار الحاسم. هذه الدورة أظهرت العكس: معماريّة النشر — قالب المحادثة، وفكّ الترميز، وترسيخ RAG، وطبقة تحقّق، وتوجيه، وتخبئة — تُنتِج ثمانين بالمائة من جودة النظام النهائي. نموذج متوسّط في معماريّة متينة يتفوّق على نموذج قوي في معماريّة بدائيّة. لذلك ابدأ من معماريّة قبل النموذج.

الكلفة الحقيقيّة تعبر النموذج. الفاتورة الأولى بضعة دولارات يوميًا، ثمّ مع RAG تصير ستّة أضعاف، ثمّ مع المحادثات المتعدّدة تصير الضعف مرّة أخرى، ثمّ مع نموّ الاستخدام تصير الضعف مرّة ثالثة. الوحدات 6 و10 قدّمتا الأرقام تحديدًا لتجنّب الاصطدام بها. حساب الكلفة على استخدام سنوي معقول قبل الالتزام بمزوّد قرارٌ يوفّر عشرات آلاف الدولارات.

المواءمة، والهلوسة، والتقييم مسائل مترابطة. المواءمة تُنتج نموذجًا يفضّل الإجابة على الرفض، فتزيد الهلوسة عند حدود المعرفة. الترسيخ (الوحدة 7) والامتناع المُعلَّم يوازنان ذلك. والتقييم (الوحدة 9) هو الوسيلة الوحيدة للتأكّد من أنّ الميزان تحقّق. هذه الوحدات الثلاث ليست موضوعات منفصلة، بل جبهةٌ واحدة.

المفتوح أو المِلكي ليس قرارًا نهائيًا. المشروع النموذجي يبدأ بـAPI مِلكيّ للسرعة، ثمّ ينتقل عند شروط معيّنة (حجم، تنظيم، خصوصيّة) إلى الاستضافة الداخليّة. ما يجعل الانتقال ممكنًا هو الفصل بين الكود التطبيقي والنموذج، عبر واجهة موحّدة (OpenAI API التي يحاكيها vLLM). بنينا هذا الفصل منذ البداية، حتّى قبل الحاجة إليه.

جدول القرار لمساعد الدعم

جميع القرارات الرئيسيّة في مكان واحد، مع التبعيّة على وضع المشروع:

القرارمشروع صغير (< 5000 طلب/يوم)مشروع متوسّط (5-30 ألف)مشروع كبير أو منظّم
النموذجAPI نموذج متوسّطنموذج مفتوح 7-8B مُكمَّم داخليًانموذج مفتوح 70B داخليًا
المعرفةRAG أساسيRAG مع مُشفّرات متعدّدة اللغاتRAG هجين، وتنقيح دلاليّ
نافذة السياق8K رمز16K رمز32K مع تلخيص منزلق
فكّ الترميزحرارة 0.6، top-p 0.9نفسه، بعقوبة تكرار 1.1نفسه، مع بذرة ثابتة للتقييم
الهلوسةترسيخ + امتناعترسيخ + اقتباس + تحقّق آليترسيخ + اقتباس + نموذج حَكَم
الخدمةAPI خارجيvLLM على A100vLLM + توجيه هرمي
التقييمجدول 100 حالةجدول 500 حالة + تصويت مستخدمجدول 500 + حَكَم + مراجعة بشرية شهرية
الكلفة السنوية المتوقّعة1000-5000 دولار15-30 ألف دولار60-150 ألف دولار

الاختبار النهائي

يتضمّن الاختبار 40 سؤالًا تشمل الوحدات العشر: طبيعة القدرات الطارئة والتعلّم داخل السياق، وقوانين توسّع Chinchilla، والفرق بين نموذج أساس ونموذج مُضبَط، وDPO مقابل RLHF، وأثر درجة الحرارة وtop-p، وظاهرة ضياع الوسط، وحلول الهلوسة الفعّالة، ومفاضلة التكميم، وقيود المعايير المرجعيّة، وحساب كلفة الاستعلام، والقرار بين API واستضافة داخليّة.

عدّة أسئلة تعرض حالات للتشخيص: نموذج يُنتج نصوصًا مطوّلة عبثًا (ما الوسيط؟)، وذاكرة معالج تمتلئ في منتصف طلب طويل (ما السبب؟)، ونموذج يجيب على أسئلة مشروعة برفض قاطع (أيّ خلل؟)، وفاتورة API تضاعفت بعد ميزة جديدة (أين تبحث؟). المُقيَّم هو الحُكم على قرارات تشغيليّة حقيقيّة، لا الاستظهار.

في حال النجاح تُمنح شهادة الإتمام فورًا؛ ورقمها قابل للتحقّق من أيّ طرف على المنصّة.

قبل أن تبدأ

استعِد جدول القرار أعلاه، واسأل نفسك عن كلّ صف: «كيف سأشرح لمدير غير تقنيّ لماذا هذا الخيار وليس غيره؟». إن استطعتَ تعليل كلٍّ من الحرارة 0.6، وترسيخ RAG بدل السياق الطويل، والاستضافة الداخليّة عند الحجم الكبير، والحاجة إلى جدول تقييم داخلي — فأنت جاهز. الاختبار لن يطلب منك تذكّر أرقام محدَّدة، بل تطبيق منطق الوحدات على حالات جديدة. حظًّا موفّقًا!

الامتحان النهائي

هل أنت مستعدّ لاعتماد هذه الدورة؟

40 سؤالًا تُختار عشوائيًّا من بنك أسئلة الدورة · حدّ النجاح 70 % · شهادة PDF قابلة للتحقّق تُصدَر فورًا عند النجاح.

ابدأ الامتحان

يلزم تسجيل الدخول إلى حسابك في InSkillML مع اشتراك نشط. يمكنك أيضًا بدء الامتحان من دوراتي.