← جميع النماذجفحص النموذج

هل يمكنني تشغيل Qwen 3 1.7B؟

يحتاج Qwen 3 1.7B من Alibaba إلى نحو 3 GB من RAM عند التكميم الموصى به بدقة 4 بت (تنزيل بحجم 1.0 GB). نفحص عتاد جهازك أدناه — فوراً، ولا شيء يغادر متصفحك. توقّع نحو ~297 tok/s على NVIDIA RTX 3060 12GB.

نقرأ مؤشرات عتاد جهازك…

ملاحظات من الواقع

Qwen 3 1.7B هو نموذج محادثة صغير موجّه لمن يريد مساعدًا محليًا يُحمَّل فورًا وبالكاد يستهلك موارد جهازه. بكمّنة 4-bit يبلغ حجمه على القرص نحو 1 GB، ويعمل بالكامل ضمن حوالي 3 GB من الـ RAM، لذا يتسع تقريبًا على أي شيء: حاسوب محمول قديم، لوحة من فئة Raspberry Pi، هاتف، أو كرت رسوميات منخفض المستوى نسيت أنك تملكه. هذا هو النموذج الذي تلجأ إليه عندما لا تملك بطاقة رسوميات مخصصة، أو حين تريد شيئًا يعمل في الخلفية دون أن تفكر في الذاكرة إطلاقًا.

على بطاقة رسوميات حقيقية تكون سرعته سخيفة تقريبًا. يدفع RTX 3060 نحو 297 tok/s، ويتجاوز الـ 4090 حاجز 831، بينما يستقر معالج Apple Silicon M Max قرب 338. وحتى على المعالج المركزي وحده مع ذاكرة DDR5 يحقق نحو 49 tok/s، وهي سرعة أعلى مما تقرأ به. نافذة السياق تبلغ 32K، وبخلاف النماذج الثقيلة يمكنك فعليًا ملؤها هنا دون عناء كبير: عند السياق الكامل 32K يبقى الاستهلاك الإجمالي عند حوالي 3.1 GB فقط، لذا يستطيع جهاز متواضع أن يحتفظ بمحادثة طويلة في الذاكرة براحة.

وقت الصراحة: بـ 1.7B معامل، هذا نموذج محادثة لا محرّك استدلال. يتعامل جيدًا مع الأسئلة والأجوبة القصيرة، وإعادة الصياغة، واستدعاء الأدوات البسيط، لكنه يصبح هشًّا مع المنطق متعدد الخطوات أو أي شيء يتطلب تخطيطًا فعليًا. إن كانت لديك الذاكرة الكافية، فإن Qwen 3 4B يستدل عمومًا بشكل أفضل بوضوح؛ وإن كنت أكثر تقييدًا، فإن Qwen 3 0.6B هو الخطوة الأخف نزولًا، بينما يُعدّ SmolLM2 1.7B نظيرًا بالحجم نفسه يستحق الموازنة معه. ميزته البارزة هي نسبة السرعة إلى الحجم، ولأنه بترخيص Apache 2.0 يمكنك استخدامه تجاريًا وفي الإنتاج دون أي قلق بشأن الترخيص.

المواصفات

المعاملات1.7B
نافذة السياق32K رمز
المطوِّرAlibaba
الرخصةApache 2.0
تاريخ الإصدار2025-04
الأفضل فيمحادثة

الحجم حسب التكميم

التكميمبت/وزنحجم التنزيلالحد الأدنى من RAMالجودة
Q2_K3.350.7 GB3 GBفقدان ملحوظ
Q4_K_Mموصى به4.851.0 GB3 GBموصى به
Q5_K_M5.651.2 GB3 GBعالية
Q8_08.51.8 GB4 GBشبه أصلية
F16163.4 GB6 GBأصلية

الأحجام تقديرات محسوبة من عدد المعاملات × عدد البتات لكل وزن؛ وتختلف نسخ GGUF الفعلية قليلاً. · آخر تحديث للبيانات: 2026-06-11 · كيف نحسب هذه الأرقام →

الذاكرة المطلوبة حسب طول السياق

السياقذاكرة KV cache (تقديرياً)إجمالي الذاكرة (Q4)
4K رمز~0.3 GB~1.3 GB
8K رمز~0.5 GB~1.5 GB
32K رمز~2.1 GB~3.1 GB

تنمو ذاكرة KV cache مع طول السياق — فالنموذج الذي يتسع عند 4K قد تنفد ذاكرته عند 32K. التقديرات تفترض ذاكرة تخزين بدقة FP16 مع grouped-query attention؛ ويختلف الاستهلاك الفعلي حسب بيئة التشغيل.

السرعة التقديرية حسب العتاد

العتادعرض النطاقالسرعة التقريبية
NVIDIA RTX 3060 12GB360 GB/s~297 tok/s
NVIDIA RTX 4090 24GB1008 GB/s~831 tok/s
Apple M-series (base)100 GB/s~82 tok/s
Apple M-series Pro270 GB/s~223 tok/s
Apple M-series Max410 GB/s~338 tok/s
CPU only (dual-channel DDR5)60 GB/s~49 tok/s

توليد الرموز محكوم بعرض نطاق الذاكرة: tok/s ≈ عرض النطاق × 0.85 ÷ حجم النموذج عند Q4. وتختلف الأرقام الفعلية حسب بيئة التشغيل وطول السياق.

شغّله محلياً

أسهل طريق هو Ollama — أمر واحد وتبدأ المحادثة:

ollama run qwen3:1.7b

الأسئلة الشائعة

متطلبات تشغيل Qwen 3 1.7B — هل يستطيع جهازي تشغيله؟