يقدم Gemma 4 خمسة متغيرات نموذج متميزة، كل منها محسّن لأجهزة وحالات استخدام مختلفة. يساعدك هذا الدليل على اختيار النموذج المناسب.
عائلة نماذج Gemma 4 في لمحة
| النموذج | المعاملات | المعاملات النشطة | السياق | الأفضل لـ |
|---|---|---|---|---|
| E2B | 2.3B | 2.3B | 128K | الهواتف المحمولة، إنترنت الأشياء، أجهزة الحافة |
| E4B | 4.5B | 4.5B | 128K | أجهزة الكمبيوتر المحمولة، الأجهزة اللوحية، وحدات معالجة الرسومات الحافة |
| 12B | — | — | — | أعباء العمل الموحّدة متعددة الوسائط (صدر في 3 يونيو 2026) |
| 26B A4B | 26B | 3.8B (MoE) | 256K | وحدات معالجة الرسومات الاستهلاكية، استدلال موفر للتكلفة |
| 31B Dense | 30.7B | 30.7B | 256K | أقصى جودة، الضبط الدقيق، محطات العمل |
Gemma 4 E2B: النموذج الفائق الصغر
الأفضل لـ: الهواتف، Raspberry Pi، Jetson Nano، والأجهزة الأخرى المقيدة بالموارد.
يحزم نموذج E2B قدرة مذهلة في 2.3 مليار معامل فعّال فقط. عند تكميم Q4، يتطلب فقط 3.2 جيجابايت من الذاكرة — صغير بما يكفي للعمل على معظم الهواتف الذكية الحديثة.
نقاط القوة الرئيسية:
- دعم إدخال الصوت الأصلي
- زمن استجابة شبه معدوم للمهام البسيطة
- تشغيل غير متصل بالكامل
- نافذة سياق 128K
القيود: جودة استدلال أقل مقارنة بالمتغيرات الأكبر. الأفضل للمهام المباشرة مثل تلخيص النصوص، والأسئلة والأجوبة الأساسية، والترجمات السريعة.
Gemma 4 E4B: النقطة المثالية للحافة
الأفضل لـ: أجهزة الكمبيوتر المحمولة، الأجهزة اللوحية، تطبيقات Android/iOS، ووحدات معالجة الرسومات الحافة.
يضاعف E4B قدرة E2B مع البقاء قابلًا للنشر على الأجهزة الاستهلاكية. عند تكميم Q4، يحتاج إلى حوالي 5 جيجابايت — مريح لمعظم أجهزة الكمبيوتر المحمولة.
نقاط القوة الرئيسية:
- قدرات الصوت والرؤية
- دعم معاينة AICore على Android
- تكامل ML Kit GenAI API
- أداء قوي متعدد اللغات
متى تختار E4B بدلاً من E2B: عندما تحتاج إلى جودة استدلال أفضل ولديك ذاكرة أكثر قليلًا. E4B هو نقطة البداية الموصى بها لمعظم عمليات النشر المحلية.
Gemma 4 12B: الإصدار الموحّد متعدد الوسائط
الأفضل لـ: أعباء العمل التي تمزج بين النصوص والصور والصوت ضمن مسار واحد.
وصل تكوين 12B في 3 يونيو 2026، بعد الإطلاق الأصلي في أبريل، ويستخدم بنية موحّدة متعددة الوسائط بدلاً من إلحاق مُرمّزات منفصلة بجذع نصي. وهذا يجعله الإصدار الذي ينبغي النظر فيه أولاً عندما يتعين على نموذج واحد التعامل مع أكثر من نوع واحد من المدخلات من دون طبقة توجيه مُنشأة يدوياً.
ونظراً إلى أنه طُرح في وقت لاحق من بقية أفراد العائلة، فما تزال الأرقام المنشورة المتعلقة بعدد المَعلمات ونافذة السياق وبصمة الذاكرة بعد التكميم قيد الاستقرار. راجع بطاقة النموذج الرسمية على Hugging Face للاطلاع على الأرقام الحالية قبل تحديد مواصفات العتاد اعتماداً عليه — وسنحدّث الجدول أعلاه بمجرد تأكيد هذه الأرقام.
Gemma 4 26B A4B: بطل الكفاءة
الأفضل لـ: وحدات معالجة الرسومات الاستهلاكية، H100 واحد، خدمة الإنتاج الموفرة للتكلفة.
هذا هو المكان الذي تتألق فيه بنية Mixture-of-Experts. على الرغم من امتلاكها 26 مليار معامل إجمالي، فإن 3.8 مليار فقط ينشط لكل رمز — مما يوفر جودة نموذج كبير بتكلفة استدلال نموذج صغير.
نقاط القوة الرئيسية:
- مرتبة #6 بين النماذج المفتوحة على Arena AI
- نافذة سياق 256K
- استدلال فائق السرعة مع كفاءة MoE
- يعمل على وحدات معالجة الرسومات الاستهلاكية عند Q4 (15.6 جيجابايت)
متى تختار 26B بدلاً من 31B: عندما تكون سرعة الاستدلال والتكلفة أكثر أهمية من الحصول على آخر بضع نقاط مئوية من الجودة. لمعظم حالات الاستخدام الإنتاجية، يقدم 26B A4B أفضل نسبة جودة إلى تكلفة.
Gemma 4 31B Dense: النموذج الرائد
الأفضل لـ: مهام أقصى جودة، الضبط الدقيق، البحث، ونشر محطة العمل.
نموذج 31B Dense هو أكثر متغيرات Gemma 4 قدرة، ويحتل المرتبة #3 بين النماذج المفتوحة عالميًا على لوحة المتصدرين النصية في Arena AI.
نقاط القوة الرئيسية:
- أعلى جودة عبر جميع المعايير
- AIME 2026: 89.2%
- LiveCodeBench v6: 80%
- محسّن لسير عمل الضبط الدقيق
- نافذة سياق 256K
متطلبات العتاد: عند دقة BF16 الكاملة، تحتاج إلى 58.3 جيجابايت (H100 واحد بسعة 80 جيجابايت). عند تكميم Q4، تنخفض إلى 17.4 جيجابايت — قابلة للتطبيق على وحدات معالجة الرسومات الاستهلاكية الراقية.
مخطط القرار
- التشغيل على هاتف أو جهاز صغير؟ → E2B
- التشغيل على كمبيوتر محمول أو جهاز لوحي؟ → E4B
- بحاجة إلى خدمة إنتاج بكفاءة تكلفة جيدة؟ → 26B A4B
- بحاجة إلى أقصى جودة أو تخطط للضبط الدقيق؟ → 31B Dense
- غير متأكد؟ → ابدأ بـ 26B A4B إذا كان لديك 16+ جيجابايت VRAM، وإلا E4B
مرجع سريع لمتطلبات الذاكرة
| النموذج | BF16 | FP8 | Q4_0 |
|---|---|---|---|
| E2B | 9.6 GB | 4.6 GB | 3.2 GB |
| E4B | 15 GB | 7.5 GB | 5 GB |
| 26B A4B | 48 GB | 25 GB | 15.6 GB |
| 31B | 58.3 GB | 30.4 GB | 17.4 GB |
تمثل هذه الأرقام أوزان النموذج الثابتة فقط. يزداد استخدام الذاكرة الفعلي مع حجم نافذة السياق وذاكرة التخزين المؤقت KV ونفقات التشغيل.
الخاتمة
لا يوجد نموذج Gemma 4 "أفضل" واحد — يعتمد الاختيار الصحيح على قيود عتادك وأولويات حالة الاستخدام. تم تصميم عائلة النماذج بحيث يمكنك البدء صغيرًا (E2B/E4B للنماذج الأولية) والتوسع للأعلى (26B/31B للإنتاج) مع الحفاظ على توافق واجهة برمجة التطبيقات عبر التشكيلة بأكملها.
لمعظم المطورين الذين يبدأون، نوصي بـ 26B A4B — فهو يقدم أفضل توازن بين الجودة والسرعة وإمكانية الوصول إلى العتاد. إذا كنت تنشر على الأجهزة المحمولة أو الحافة، ابدأ بـ E4B ولا تنزل إلى E2B إلا إذا كانت الذاكرة مقيدة حقًا.
