مقارنة نماذج Gemma 4: أي نموذج يجب أن تختار؟

أبريل ٤، ٢٠٢٦

يقدم Gemma 4 خمسة متغيرات نموذج متميزة، كل منها محسّن لأجهزة وحالات استخدام مختلفة. يساعدك هذا الدليل على اختيار النموذج المناسب.

عائلة نماذج Gemma 4 في لمحة

النموذجالمعاملاتالمعاملات النشطةالسياقالأفضل لـ
E2B2.3B2.3B128Kالهواتف المحمولة، إنترنت الأشياء، أجهزة الحافة
E4B4.5B4.5B128Kأجهزة الكمبيوتر المحمولة، الأجهزة اللوحية، وحدات معالجة الرسومات الحافة
12Bأعباء العمل الموحّدة متعددة الوسائط (صدر في 3 يونيو 2026)
26B A4B26B3.8B (MoE)256Kوحدات معالجة الرسومات الاستهلاكية، استدلال موفر للتكلفة
31B Dense30.7B30.7B256Kأقصى جودة، الضبط الدقيق، محطات العمل

Gemma 4 E2B: النموذج الفائق الصغر

الأفضل لـ: الهواتف، Raspberry Pi، Jetson Nano، والأجهزة الأخرى المقيدة بالموارد.

يحزم نموذج E2B قدرة مذهلة في 2.3 مليار معامل فعّال فقط. عند تكميم Q4، يتطلب فقط 3.2 جيجابايت من الذاكرة — صغير بما يكفي للعمل على معظم الهواتف الذكية الحديثة.

نقاط القوة الرئيسية:

  • دعم إدخال الصوت الأصلي
  • زمن استجابة شبه معدوم للمهام البسيطة
  • تشغيل غير متصل بالكامل
  • نافذة سياق 128K

القيود: جودة استدلال أقل مقارنة بالمتغيرات الأكبر. الأفضل للمهام المباشرة مثل تلخيص النصوص، والأسئلة والأجوبة الأساسية، والترجمات السريعة.

Gemma 4 E4B: النقطة المثالية للحافة

الأفضل لـ: أجهزة الكمبيوتر المحمولة، الأجهزة اللوحية، تطبيقات Android/iOS، ووحدات معالجة الرسومات الحافة.

يضاعف E4B قدرة E2B مع البقاء قابلًا للنشر على الأجهزة الاستهلاكية. عند تكميم Q4، يحتاج إلى حوالي 5 جيجابايت — مريح لمعظم أجهزة الكمبيوتر المحمولة.

نقاط القوة الرئيسية:

  • قدرات الصوت والرؤية
  • دعم معاينة AICore على Android
  • تكامل ML Kit GenAI API
  • أداء قوي متعدد اللغات

متى تختار E4B بدلاً من E2B: عندما تحتاج إلى جودة استدلال أفضل ولديك ذاكرة أكثر قليلًا. E4B هو نقطة البداية الموصى بها لمعظم عمليات النشر المحلية.

Gemma 4 12B: الإصدار الموحّد متعدد الوسائط

الأفضل لـ: أعباء العمل التي تمزج بين النصوص والصور والصوت ضمن مسار واحد.

وصل تكوين 12B في 3 يونيو 2026، بعد الإطلاق الأصلي في أبريل، ويستخدم بنية موحّدة متعددة الوسائط بدلاً من إلحاق مُرمّزات منفصلة بجذع نصي. وهذا يجعله الإصدار الذي ينبغي النظر فيه أولاً عندما يتعين على نموذج واحد التعامل مع أكثر من نوع واحد من المدخلات من دون طبقة توجيه مُنشأة يدوياً.

ونظراً إلى أنه طُرح في وقت لاحق من بقية أفراد العائلة، فما تزال الأرقام المنشورة المتعلقة بعدد المَعلمات ونافذة السياق وبصمة الذاكرة بعد التكميم قيد الاستقرار. راجع بطاقة النموذج الرسمية على Hugging Face للاطلاع على الأرقام الحالية قبل تحديد مواصفات العتاد اعتماداً عليه — وسنحدّث الجدول أعلاه بمجرد تأكيد هذه الأرقام.

Gemma 4 26B A4B: بطل الكفاءة

الأفضل لـ: وحدات معالجة الرسومات الاستهلاكية، H100 واحد، خدمة الإنتاج الموفرة للتكلفة.

هذا هو المكان الذي تتألق فيه بنية Mixture-of-Experts. على الرغم من امتلاكها 26 مليار معامل إجمالي، فإن 3.8 مليار فقط ينشط لكل رمز — مما يوفر جودة نموذج كبير بتكلفة استدلال نموذج صغير.

نقاط القوة الرئيسية:

  • مرتبة #6 بين النماذج المفتوحة على Arena AI
  • نافذة سياق 256K
  • استدلال فائق السرعة مع كفاءة MoE
  • يعمل على وحدات معالجة الرسومات الاستهلاكية عند Q4 (15.6 جيجابايت)

متى تختار 26B بدلاً من 31B: عندما تكون سرعة الاستدلال والتكلفة أكثر أهمية من الحصول على آخر بضع نقاط مئوية من الجودة. لمعظم حالات الاستخدام الإنتاجية، يقدم 26B A4B أفضل نسبة جودة إلى تكلفة.

Gemma 4 31B Dense: النموذج الرائد

الأفضل لـ: مهام أقصى جودة، الضبط الدقيق، البحث، ونشر محطة العمل.

نموذج 31B Dense هو أكثر متغيرات Gemma 4 قدرة، ويحتل المرتبة #3 بين النماذج المفتوحة عالميًا على لوحة المتصدرين النصية في Arena AI.

نقاط القوة الرئيسية:

  • أعلى جودة عبر جميع المعايير
  • AIME 2026: 89.2%
  • LiveCodeBench v6: 80%
  • محسّن لسير عمل الضبط الدقيق
  • نافذة سياق 256K

متطلبات العتاد: عند دقة BF16 الكاملة، تحتاج إلى 58.3 جيجابايت (H100 واحد بسعة 80 جيجابايت). عند تكميم Q4، تنخفض إلى 17.4 جيجابايت — قابلة للتطبيق على وحدات معالجة الرسومات الاستهلاكية الراقية.

مخطط القرار

  1. التشغيل على هاتف أو جهاز صغير؟ → E2B
  2. التشغيل على كمبيوتر محمول أو جهاز لوحي؟ → E4B
  3. بحاجة إلى خدمة إنتاج بكفاءة تكلفة جيدة؟ → 26B A4B
  4. بحاجة إلى أقصى جودة أو تخطط للضبط الدقيق؟ → 31B Dense
  5. غير متأكد؟ → ابدأ بـ 26B A4B إذا كان لديك 16+ جيجابايت VRAM، وإلا E4B

مرجع سريع لمتطلبات الذاكرة

النموذجBF16FP8Q4_0
E2B9.6 GB4.6 GB3.2 GB
E4B15 GB7.5 GB5 GB
26B A4B48 GB25 GB15.6 GB
31B58.3 GB30.4 GB17.4 GB

تمثل هذه الأرقام أوزان النموذج الثابتة فقط. يزداد استخدام الذاكرة الفعلي مع حجم نافذة السياق وذاكرة التخزين المؤقت KV ونفقات التشغيل.

الخاتمة

لا يوجد نموذج Gemma 4 "أفضل" واحد — يعتمد الاختيار الصحيح على قيود عتادك وأولويات حالة الاستخدام. تم تصميم عائلة النماذج بحيث يمكنك البدء صغيرًا (E2B/E4B للنماذج الأولية) والتوسع للأعلى (26B/31B للإنتاج) مع الحفاظ على توافق واجهة برمجة التطبيقات عبر التشكيلة بأكملها.

لمعظم المطورين الذين يبدأون، نوصي بـ 26B A4B — فهو يقدم أفضل توازن بين الجودة والسرعة وإمكانية الوصول إلى العتاد. إذا كنت تنشر على الأجهزة المحمولة أو الحافة، ابدأ بـ E4B ولا تنزل إلى E2B إلا إذا كانت الذاكرة مقيدة حقًا.

Gemma 4 Team

Gemma 4 Team