هل يمكنني تشغيل Magistral Small 1.2؟
يحتاج Magistral Small 1.2 من Mistral AI إلى نحو 24 GB من RAM عند التكميم الموصى به بدقة 4 بت (تنزيل بحجم 14.6 GB). نفحص عتاد جهازك أدناه — فوراً، ولا شيء يغادر متصفحك. توقّع نحو ~24 tok/s على Apple M-series Max.
نقرأ مؤشرات عتاد جهازك…
ملاحظات من الواقع
تعذّر إنتاج الترجمة العربية لصفحة نموذج magistral-small-1-2 لأن ملف المصدر المطلوب غير موجود. الملف المتوقع على المسار /tmp/llmsrc/magistral-small-1-2.json مفقود تمامًا، والمجلد /tmp/llmsrc نفسه غير موجود. جرى التحقق من ذلك بالأوامر cat و ls و find عبر /tmp و /private/tmp و /var/folders وشجرة المشروع، دون أي نتيجة.
لا يمكن كتابة محتوى عربي دقيق بدون هذا الملف، لأنه يحتوي على الأرقام المرجعية المعتمدة: أحجام النموذج بوحدة GB، السرعات بوحدة tok/s، متطلبات RAM، طول السياق، وعدد المعاملات، إضافةً إلى نص الترخيص وتحذيراته. القواعد الصارمة تمنع اختلاق أي رقم أو ادعاء أو تنبيه ترخيص مثل قيد MNPL على الاستخدام غير الإنتاجي، لذلك لن أصوغ فقرات بأرقام مُلفّقة.
يرجى التأكد من أن المنسّق يكتب الملف /tmp/llmsrc/magistral-small-1-2.json متضمنًا الحقلين facts و en قبل تشغيل هذه المهمة، ثم إعادة التشغيل. فور توفّر المصدر سأعيد الفقرات الثلاث بالعربية الفصحى مع الحفاظ على كل رقم ووحدة واسم نموذج وتنبيه ترخيص كما هو تمامًا. هذا النص الحالي مجرد إشعار بالعائق وليس مادة قابلة للنشر.
المواصفات
الحجم حسب التكميم
| التكميم | بت/وزن | حجم التنزيل | الحد الأدنى من RAM | الجودة |
|---|---|---|---|---|
| Q2_K | 3.35 | 10.1 GB | 16 GB | فقدان ملحوظ |
| Q4_K_Mموصى به | 4.85 | 14.6 GB | 24 GB | موصى به |
| Q5_K_M | 5.65 | 17.0 GB | 24 GB | عالية |
| Q8_0 | 8.5 | 25.5 GB | 48 GB | شبه أصلية |
| F16 | 16 | 48.0 GB | 64 GB | أصلية |
الأحجام تقديرات محسوبة من عدد المعاملات × عدد البتات لكل وزن؛ وتختلف نسخ GGUF الفعلية قليلاً. · آخر تحديث للبيانات: 2026-06-11 · كيف نحسب هذه الأرقام →
الذاكرة المطلوبة حسب طول السياق
| السياق | ذاكرة KV cache (تقديرياً) | إجمالي الذاكرة (Q4) |
|---|---|---|
| 4K رمز | ~0.9 GB | ~15.5 GB |
| 8K رمز | ~1.7 GB | ~16.3 GB |
| 32K رمز | ~6.9 GB | ~21.5 GB |
| 128K رمز | ~27.5 GB | ~42.1 GB |
تنمو ذاكرة KV cache مع طول السياق — فالنموذج الذي يتسع عند 4K قد تنفد ذاكرته عند 32K. التقديرات تفترض ذاكرة تخزين بدقة FP16 مع grouped-query attention؛ ويختلف الاستهلاك الفعلي حسب بيئة التشغيل.
السرعة التقديرية حسب العتاد
| العتاد | عرض النطاق | السرعة التقريبية |
|---|---|---|
| NVIDIA RTX 3060 12GB | 360 GB/s | لا يتسع في VRAM |
| NVIDIA RTX 4090 24GB | 1008 GB/s | ~59 tok/s |
| Apple M-series (base) | 100 GB/s | ~6 tok/s |
| Apple M-series Pro | 270 GB/s | ~16 tok/s |
| Apple M-series Max | 410 GB/s | ~24 tok/s |
| CPU only (dual-channel DDR5) | 60 GB/s | ~4 tok/s |
توليد الرموز محكوم بعرض نطاق الذاكرة: tok/s ≈ عرض النطاق × 0.85 ÷ حجم النموذج عند Q4. وتختلف الأرقام الفعلية حسب بيئة التشغيل وطول السياق.