هل يمكنني تشغيل Gemma 4 E2B؟
يحتاج Gemma 4 E2B من Google إلى نحو 6 GB من RAM عند التكميم الموصى به بدقة 4 بت (تنزيل بحجم 3.1 GB). نفحص عتاد جهازك أدناه — فوراً، ولا شيء يغادر متصفحك. توقّع نحو ~219 tok/s على NVIDIA RTX 3060 12GB.
نقرأ مؤشرات عتاد جهازك…
المواصفات
الحجم حسب التكميم
| التكميم | بت/وزن | حجم التنزيل | الحد الأدنى من RAM | الجودة |
|---|---|---|---|---|
| Q2_K | 3.35 | 2.1 GB | 6 GB | فقدان ملحوظ |
| Q4_K_Mموصى به | 4.85 | 3.1 GB | 6 GB | موصى به |
| Q5_K_M | 5.65 | 3.6 GB | 6 GB | عالية |
| Q8_0 | 8.5 | 5.4 GB | 12 GB | شبه أصلية |
| F16 | 16 | 10.2 GB | 16 GB | أصلية |
الأحجام تقديرات محسوبة من عدد المعاملات × عدد البتات لكل وزن؛ وتختلف نسخ GGUF الفعلية قليلاً. · آخر تحديث للبيانات: 2026-06-11 · كيف نحسب هذه الأرقام →
الذاكرة المطلوبة حسب طول السياق
| السياق | ذاكرة KV cache (تقديرياً) | إجمالي الذاكرة (Q4) |
|---|---|---|
| 4K رمز | ~0.4 GB | ~3.5 GB |
| 8K رمز | ~0.9 GB | ~4.0 GB |
| 32K رمز | ~3.4 GB | ~6.5 GB |
| 128K رمز | ~13.7 GB | ~16.8 GB |
تنمو ذاكرة KV cache مع طول السياق — فالنموذج الذي يتسع عند 4K قد تنفد ذاكرته عند 32K. التقديرات تفترض ذاكرة تخزين بدقة FP16 مع grouped-query attention؛ ويختلف الاستهلاك الفعلي حسب بيئة التشغيل.
السرعة التقديرية حسب العتاد
| العتاد | عرض النطاق | السرعة التقريبية |
|---|---|---|
| NVIDIA RTX 3060 12GB | 360 GB/s | ~219 tok/s |
| NVIDIA RTX 4090 24GB | 1008 GB/s | ~614 tok/s |
| Apple M-series (base) | 100 GB/s | ~61 tok/s |
| Apple M-series Pro | 270 GB/s | ~165 tok/s |
| Apple M-series Max | 410 GB/s | ~250 tok/s |
| CPU only (dual-channel DDR5) | 60 GB/s | ~37 tok/s |
توليد الرموز محكوم بعرض نطاق الذاكرة: tok/s ≈ عرض النطاق × 0.85 ÷ حجم النموذج عند Q4. وتختلف الأرقام الفعلية حسب بيئة التشغيل وطول السياق.
شغّله محلياً
أسهل طريق هو Ollama — أمر واحد وتبدأ المحادثة:
ollama run gemma4:e2b