الوحدة 2 — جلب النماذج وعرضها وحذفها
بعد أن صار Ollama يعمل، نأتي إلى القرار الحاسم: أيّ نموذج نُشغّل؟ الاختيار الخاطئ يعني إمّا جودة سيّئة على أسئلة المكتب، وإمّا امتلاء القرص بعد ثلاثة نماذج. هذه الوحدة تُدرّبك على قراءة الوسوم قبل الجلب، لا بعد.
مكتبة Ollama
النماذج تُنشر على ollama.com/library بأسماء قصيرة (llama3.1، qwen2.5، mistral، gemma3، phi4…). كلّ اسم يحمل عائلة من الوسوم بأحجام وتكميمات مختلفة:
llama3.1:8b— النسخة الأساسيّة بثمانية مليارات معامل.llama3.1:70b— النسخة الكبرى.llama3.1:8b-instruct-q4_K_M— نسخة تعليمات مكمَّمة على 4 بتّات.llama3.1:latest— يشير إلى وسم افتراضيّ يتغيّر مع الإصدارات.
قاعدة: لا تستعمل latest في الإنتاج. تحديد الوسم بدقّة (llama3.1:8b-instruct-q4_K_M) هو ما يجعل جلبك اليوم مطابقًا لجلبك بعد شهر. هذا هو الفارق بين تجربة قابلة للتكرار وأخرى مفاجئة.
الأمر pull
ollama pull llama3.1:8b-instruct-q4_K_M
يحمّل الأمر النموذج على شكل ملفّات blob في OLLAMA_MODELS/blobs/، ثمّ يبني مانيفستًا في OLLAMA_MODELS/manifests/. الملفّات كبيرة (من مئات الميغابايتات إلى عشرات الغيغابايتات) وتُخزَّن بمُختصر SHA-256، فيُشارك النماذج التي تعتمد الطبقات نفسها.
يمكن استئناف تحميل مقطوع بإعادة تشغيل الأمر نفسه: Ollama يتعرّف على القطع المكتملة ولا يعيد جلبها.
الأمر list
$ ollama list
NAME ID SIZE MODIFIED
qwen2.5:7b-instruct-q4_K_M a7f42c8d3e91 4.7 GB قبل ساعة
llama3.1:8b-instruct-q4_K_M b1e94a2f6c50 4.9 GB قبل يومين
nomic-embed-text:latest 0a4b7c1d2e3f 274 MB قبل يومين
الحجم هنا هو حجم الملفّات على القرص لا الذاكرة المطلوبة عند التنفيذ. الوحدة 6 توضّح كيف تُحسب الذاكرة اللازمة انطلاقًا من التكميم ونافذة السياق.
الأمر show
قبل أوّل استعمال، اقرأ ما داخل النموذج:
$ ollama show qwen2.5:7b-instruct-q4_K_M
Model
architecture qwen2
parameters 7.6B
context length 32768
embedding length 3584
quantization Q4_K_M
License
Apache License 2.0
System
You are Qwen, created by Alibaba Cloud...
هذه الشاشة تعطيك بضربة واحدة: الحجم الحقيقيّ، أقصى سياق يقبله، التكميم المُطبَّق، والرسالة النظاميّة الافتراضيّة. الأسئلة اللاحقة (كم من الذاكرة؟ هل يفهم عربيّتنا؟) تنطلق من هنا.
الأمر rm
ollama rm llama3.1:8b-instruct-q4_K_M
يزيل الأمر المانيفست فقط. الطبقات المشتركة التي ما زالت تخدم نموذجًا آخر لا تُمسح؛ الطبقات اليتيمة تُنظَّف تلقائيًّا. هذا يفسّر أنّ حذف نموذجَين من ثلاثة قد لا يحرّر الحجم المتوقّع، ما دام النموذج الباقي يشترك في طبقات كبيرة.
كم يشغل النموذج فعلًا؟
يقاس الحجم على القرص كتلةً واحدة (ollama list)، لكنّ الذاكرة المطلوبة عند التشغيل تُحسب تقريبًا:
الذاكرة (GB) ≈ (عدد المعاملات بالمليارات) × (البتّات لكلّ معامل ÷ 8) + سعة السياق
- نموذج 7B مكمَّم Q4 يحتاج ≈ 4 GB زائد 0.5–2 GB للسياق.
- نموذج 7B غير مكمَّم (FP16) يحتاج ≈ 14 GB.
- نموذج 13B Q4 يحتاج ≈ 7 GB.
على جهاز بذاكرة 16 GB، نموذج 7B مكمَّم يسع براحة؛ نموذج 13B على الحدّ؛ نموذج 70B مكمَّم Q4 يحتاج 40 GB وهو غير ممكن. الوحدة 6 تُفصّل هذه الحسابات.
اختيار نموذج للغة الواجهة
المكتب يعمل بالعربيّة الفصحى والفرنسيّة. ليس كلّ نموذج مفتوح يجيد العربيّة بالقدر نف سه:
qwen2.5:7b-instruct— من أفضل النماذج المفتوحة في العربيّة والفرنسيّة معًا.llama3.1:8b-instruct— جيّد في الإنجليزيّة والفرنسيّة، مقبول في العربيّة، ضعيف في التصريف.gemma3:9b-it— جودة عربيّة محترمة، وسياق طويل.mistral:7b-instruct— قويّ في الفرنسيّة، متوسّط في العربيّة.
القرار لا يُتَّخذ من ورقة تقييم عامّة، بل من اختبار عشرة أسئلة حقيقيّة من المكتب: تلخيص عقد، تصنيف بريد وارد، صياغة ردّ رسميّ. النموذج الذي يجيب أوضح على هذه العشرة هو الأنسب، ولو تفوّق غيره في مقاييس أكاديميّة.
الخيط الأحمر
للمكتب، نجلب ثلاثة نماذج ونحذف الباقي:
ollama pull qwen2.5:7b-instruct-q4_K_M # المساعد الأساسيّ
ollama pull llama3.1:8b-instruct-q4_K_M # بديل للمقارنة
ollama pull nomic-embed-text # للتضمينات (الوحدة 9)
الحزمة تشغل ≈ 10 GB. النسخة الكبرى (70B) لن نستعملها: العتاد لا يسعها، والفارق على أسئلتنا محدود بعد التخصيص في الوحدتين 5 و9.
اسأل نفسك: هل النموذج يجيد لغة موكّليك؟ هل حجمه يسع في ذاكرة الجهاز الأقلّ في الفريق؟ هل الرخصة (Apache، Llama Community، Gemma…) تسمح بالاستعمال التجاريّ؟ لا معنى لتحميل ثلاثين غيغابايتًا قبل الإجابة عن الأسئلة الثلاثة.
الخلاصة
- الاسم القصير عائلة، والوسم الكامل هو ما يُثبّت النموذج؛
latestممنوع في الإنتاج. pullقابل للاستئناف، والطبقات تُشارَك بين النماذج فيُوفَّر القرص.showيعطي البنية والسياق والتكميم والرخصة قبل أوّل تشغيل.- اختيار النموذج يمرّ بعشرة أسئلة حقيقيّة من ميدان الاستعمال، لا بمقارنة أكاديميّة عامّة.