هل يمكنني تشغيل Mellum 2 12B-A2.5B؟
يحتاج Mellum 2 12B-A2.5B من JetBrains إلى نحو 12 GB من RAM عند التكميم الموصى به بدقة 4 بت (تنزيل بحجم 7.3 GB). نفحص عتاد جهازك أدناه — فوراً، ولا شيء يغادر متصفحك. توقّع نحو ~202 tok/s على NVIDIA RTX 3060 12GB.
نقرأ مؤشرات عتاد جهازك…
المواصفات
الحجم حسب التكميم
| التكميم | بت/وزن | حجم التنزيل | الحد الأدنى من RAM | الجودة |
|---|---|---|---|---|
| Q2_K | 3.35 | 5.0 GB | 8 GB | فقدان ملحوظ |
| Q4_K_Mموصى به | 4.85 | 7.3 GB | 12 GB | موصى به |
| Q5_K_M | 5.65 | 8.5 GB | 16 GB | عالية |
| Q8_0 | 8.5 | 12.8 GB | 24 GB | شبه أصلية |
| F16 | 16 | 24.0 GB | 32 GB | أصلية |
الأحجام تقديرات محسوبة من عدد المعاملات × عدد البتات لكل وزن؛ وتختلف نسخ GGUF الفعلية قليلاً. · آخر تحديث للبيانات: 2026-06-11 · كيف نحسب هذه الأرقام →
الذاكرة المطلوبة حسب طول السياق
| السياق | ذاكرة KV cache (تقديرياً) | إجمالي الذاكرة (Q4) |
|---|---|---|
| 4K رمز | ~0.6 GB | ~7.9 GB |
| 8K رمز | ~1.3 GB | ~8.6 GB |
| 32K رمز | ~5.0 GB | ~12.3 GB |
| 128K رمز | ~20.1 GB | ~27.4 GB |
تنمو ذاكرة KV cache مع طول السياق — فالنموذج الذي يتسع عند 4K قد تنفد ذاكرته عند 32K. التقديرات تفترض ذاكرة تخزين بدقة FP16 مع grouped-query attention؛ ويختلف الاستهلاك الفعلي حسب بيئة التشغيل.
السرعة التقديرية حسب العتاد
| العتاد | عرض النطاق | السرعة التقريبية |
|---|---|---|
| NVIDIA RTX 3060 12GB | 360 GB/s | ~202 tok/s |
| NVIDIA RTX 4090 24GB | 1008 GB/s | ~565 tok/s |
| Apple M-series (base) | 100 GB/s | ~56 tok/s |
| Apple M-series Pro | 270 GB/s | ~151 tok/s |
| Apple M-series Max | 410 GB/s | ~230 tok/s |
| CPU only (dual-channel DDR5) | 60 GB/s | ~34 tok/s |
توليد الرموز محكوم بعرض نطاق الذاكرة: tok/s ≈ عرض النطاق × 0.85 ÷ حجم النموذج عند Q4. وتختلف الأرقام الفعلية حسب بيئة التشغيل وطول السياق.