هل يمكنني تشغيل Mistral Nemo 12B؟
يحتاج Mistral Nemo 12B من Mistral AI إلى نحو 12 GB من RAM عند التكميم الموصى به بدقة 4 بت (تنزيل بحجم 7.4 GB). نفحص عتاد جهازك أدناه — فوراً، ولا شيء يغادر متصفحك. توقّع نحو ~41 tok/s على NVIDIA RTX 3060 12GB.
نقرأ مؤشرات عتاد جهازك…
ملاحظات من الواقع
تعذّر إنتاج ترجمة عربية لصفحة mistral-nemo-12b لأن الملف المصدر /tmp/llmsrc/mistral-nemo-12b.json غير موجود على هذا الجهاز. بحثتُ في /tmp و /private/tmp ومجلد المستخدم مع إعادة المحاولة، ولا توجد أي نسخة، بل إن مجلد /tmp/llmsrc نفسه غير موجود. بدون كتلة الحقائق (facts) وفقرات المصدر الإنجليزية (en) لا يوجد مرجع موثوق يمكن التحقق مقابله من الأرقام والوحدات وقيود الرخصة، والقواعد الصارمة تمنع الترجمة من الذاكرة.
لم تُنتَج أي فقرات لأن النص المقدَّم للمراجعة ليس ترجمة عربية أصلًا، بل ثلاث رسائل خطأ بالإنجليزية تفيد بغياب المصدر. القواعد تشترط الحفاظ على كل رقم حرفيًا مقابل ورقة الحقائق بوصفها مصدر الحقيقة؛ والترجمة من الذاكرة ستخاطر باختلاق أو إفساد الأرقام (الحجم بوحدة GB، السرعة بوحدة tok/s، طول السياق 128K، عدد المعاملات) وبإسقاط تحذيرات الرخصة مثل MNPL. لذلك لا يُعاد أي محتوى ملفّق.
للمتابعة، يجب كتابة ملف JSON المصدر إلى /tmp/llmsrc/mistral-nemo-12b.json متضمنًا كائن facts والفقرات الإنجليزية الثلاث، ثم إعادة تشغيل هذه المهمة. عندئذٍ ستُعاد القيم: slug بقيمة mistral-nemo-12b، وlocale بقيمة ar، وثلاث فقرات بعربية فصحى طبيعية مع الحفاظ الحرفي على جميع الأرقام والوحدات وأسماء النماذج والأدوات (مثل Ollama و Hugging Face) وشروط الرخصة دون أي تحويل أو تقريب.
المواصفات
الحجم حسب التكميم
| التكميم | بت/وزن | حجم التنزيل | الحد الأدنى من RAM | الجودة |
|---|---|---|---|---|
| Q2_K | 3.35 | 5.1 GB | 8 GB | فقدان ملحوظ |
| Q4_K_Mموصى به | 4.85 | 7.4 GB | 12 GB | موصى به |
| Q5_K_M | 5.65 | 8.6 GB | 16 GB | عالية |
| Q8_0 | 8.5 | 13.0 GB | 24 GB | شبه أصلية |
| F16 | 16 | 24.4 GB | 32 GB | أصلية |
الأحجام تقديرات محسوبة من عدد المعاملات × عدد البتات لكل وزن؛ وتختلف نسخ GGUF الفعلية قليلاً. · آخر تحديث للبيانات: 2026-06-11 · كيف نحسب هذه الأرقام →
الذاكرة المطلوبة حسب طول السياق
| السياق | ذاكرة KV cache (تقديرياً) | إجمالي الذاكرة (Q4) |
|---|---|---|
| 4K رمز | ~0.6 GB | ~8.0 GB |
| 8K رمز | ~1.3 GB | ~8.7 GB |
| 32K رمز | ~5.1 GB | ~12.5 GB |
| 128K رمز | ~20.3 GB | ~27.7 GB |
تنمو ذاكرة KV cache مع طول السياق — فالنموذج الذي يتسع عند 4K قد تنفد ذاكرته عند 32K. التقديرات تفترض ذاكرة تخزين بدقة FP16 مع grouped-query attention؛ ويختلف الاستهلاك الفعلي حسب بيئة التشغيل.
السرعة التقديرية حسب العتاد
| العتاد | عرض النطاق | السرعة التقريبية |
|---|---|---|
| NVIDIA RTX 3060 12GB | 360 GB/s | ~41 tok/s |
| NVIDIA RTX 4090 24GB | 1008 GB/s | ~116 tok/s |
| Apple M-series (base) | 100 GB/s | ~11 tok/s |
| Apple M-series Pro | 270 GB/s | ~31 tok/s |
| Apple M-series Max | 410 GB/s | ~47 tok/s |
| CPU only (dual-channel DDR5) | 60 GB/s | ~7 tok/s |
توليد الرموز محكوم بعرض نطاق الذاكرة: tok/s ≈ عرض النطاق × 0.85 ÷ حجم النموذج عند Q4. وتختلف الأرقام الفعلية حسب بيئة التشغيل وطول السياق.
شغّله محلياً
أسهل طريق هو Ollama — أمر واحد وتبدأ المحادثة:
ollama run mistral-nemo