---
title: "Jamba (language model) — جامبا"
source: "https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7"
wiki: "systems-analysis.info/int"
article: "Jamba_(language_model)_—_جامبا"
language: "ar"
categories:
  - "Category:Arabic"
  - "Category:Large language models"
  - "Category:LLM families"
  - "Category:Machine learning"
revision_id: 3360
wiki_created_at: 2026-09-06T23:19:30Z
wiki_modified_at: 2026-09-06T23:19:30Z
downloaded_at: 2026-09-07T22:56:32Z
---

# Jamba (language model) — جامبا

**Jamba** هي عائلة من نماذج اللغة الكبيرة (LLM) طورتها شركة الأبحاث الإسرائيلية AI21 Labs. يمثل Jamba أول **بنية هجينة** من نوعها، حيث تدمج العناصر الأساسية لاثنين من أبرز المنهجيات في تطوير الذكاء الاصطناعي: المحولات (Transformers) ونماذج فضاء الحالة (State Space Models, SSM)، وتحديدًا بنية Mamba<sup>[\[1\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-ai21-announcement-1)</sup>.

الهدف الرئيسي لـ Jamba هو حل المقايضة الأساسية في نماذج اللغة الكبيرة الحديثة: الجودة العالية والأداء (وهي سمة المحولات) مقابل الكفاءة والقدرة على معالجة السياقات الطويلة جدًا (وهي سمة نماذج SSM). من خلال الجمع بين هذه المنهجيات وإضافة التخفيف (sparsity) باستخدام Mixture-of-Experts (MoE)، يقدم Jamba نموذجًا قويًا وفعالًا في آن واحد، وقادرًا على التعامل مع كميات هائلة من النصوص في استعلام واحد.

## بنية Jamba بالتفصيل

لا يقتصر Jamba على تبديل طبقات المحولات وMamba بشكل بسيط. بل يستخدم **بنية كتلية** مصممة بعناية، حيث تتكون كل كتلة من ثماني طبقات.

هيكل كتلة Jamba الواحدة:

- **طبقة محول واحدة:** هذه الطبقة مسؤولة عن الفهم "العميق" والاستدلال المعقد. وتتضمن هذه الطبقة بنية **Mixture-of-Experts (MoE)**.
- **سبع طبقات Mamba:** تتبع هذه الطبقات طبقة المحول، وهي مسؤولة عن المعالجة الفعالة للتسلسل و"تمرير" المعلومات عبر السياق الطويل<sup>[\[2\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-arxiv-jamba-2)</sup>.

تسمح هذه البنية غير المتماثلة للنموذج بإدارة الموارد الحسابية بكفاءة: فالعمليات الثقيلة ولكن القوية للمحولات تُنفذ بشكل أقل، بينما تُنفذ عمليات Mamba الخفيفة والسريعة بشكل أكثر تكرارًا.

### Mixture-of-Experts (MoE) - تكامل خليط الخبراء (MoE)

يستخدم Jamba بنية MoE لزيادة الكفاءة بشكل أكبر.

- تُطبق MoE **فقط على الكتل متصلة بالكامل (FFN) داخل طبقات المحولات**<sup>[\[3\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-transformers-doc-jamba-3)</sup>. بينما تظل طبقات Mamba كثيفة.
- في نموذج Jamba الأول، كان هناك **16 خبيرًا**.
- لكل توكن، تختار شبكة التوجيه **أفضل خبيرين** (Top-2 gating).

وهذا يعني أنه على الرغم من أن العدد الإجمالي لمعلمات النموذج كبير (52 مليار)، إلا أنه في كل خطوة من خطوات معالجة التوكن في طبقة المحول، يكون هناك خبيران فقط من أصل 16 نشطين، مما يجعل العمليات الحسابية سريعة جدًا.

## تطور نماذج Jamba

### Jamba-v0.1 (مارس 2024)

النموذج الأول الذي تم تقديمه ضمن هذه العائلة له الخصائص التالية:

| الخاصية                 | القيمة                                                                                                                                                    |
|-------------------------|-----------------------------------------------------------------------------------------------------------------------------------------------------------|
| **إجمالي عدد المعلمات** | 52 مليار                                                                                                                                                  |
| **المعلمات النشطة**     | ~12 مليار                                                                                                                                                 |
| **عدد الخبراء (MoE)**   | 16 (2 نشطين)                                                                                                                                              |
| **نافذة السياق**        | 256,000 توكن                                                                                                                                              |
| **الترخيص**             | Apache 2.0<sup>[\[4\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-hf-jamba-v0.1-4)</sup> |

المواصفات الفنية لـ Jamba-v0.1

بفضل بنيته الهجينة، يستطيع Jamba-1 معالجة سياق يصل طوله إلى 256,000 توكن، وهو ما يعادل رواية من 400 صفحة تقريبًا، ويمكن نشره على GPU استهلاكي واحد بذاكرة 80 جيجابايت<sup>[\[5\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-gradientflow-jamba-5)</sup>.

### Jamba-1.5 (2024)

في عام 2024، قدمت AI21 Labs عائلة محدثة من نماذج Jamba 1.5، والتي تتضمن إصدارين: **Jamba 1.5 Mini** (12 مليار معلمة نشطة من إجمالي 52 مليار) و**Jamba 1.5 Large** (94 مليار معلمة نشطة من إجمالي 398 مليار)<sup>[\[6\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-jamba-1.5-family-6)</sup>. تُظهر هذه النماذج تحسينات كبيرة في الأداء:

- استدلال أسرع بما يصل إلى 2.5 مرة في السياقات الطويلة مقارنة بالمنافسين.
- دعم تسع لغات، بما في ذلك الإنجليزية والإسبانية والفرنسية والعربية<sup>[\[7\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-hf-jamba-large-1.5-7)</sup>.

## المزايا الرئيسية والأداء

- **نافذة سياق ضخمة:** 256,000 توكن — وهي واحدة من أكبر النوافذ المتاحة بين جميع النماذج (بما في ذلك النماذج الاحتكارية) وقت إصداره. هذا يجعل Jamba مثاليًا للمهام التي تتطلب تحليل مستندات كبيرة: العقود القانونية، الأبحاث العلمية، قواعد الأكواد البرمجية بأكملها، أو الحوارات الطويلة.
- **أداء وكفاءة عالية:** في الاختبارات، يُظهر Jamba أداءً يضاهي أو يتفوق على النماذج المفتوحة الرائدة ذات الحجم المماثل، مثل Llama وMixtral، مع تحقيق **إنتاجية أعلى بـ 3 مرات** في السياقات الطويلة<sup>[\[8\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-itinai-jamba-8)</sup>.
- **الانفتاح والتوافر:** يُوزع Jamba بموجب ترخيص Apache 2.0 المتساهل، مما يسمح باستخدامه بحرية في الأغراض التجارية والبحثية. أوزان النموذج متاحة على منصة Hugging Face.

### النتائج على مقاييس الأداء (Benchmarks)

يُظهر Jamba 1.5 نتائج تنافسية على مختلف مقاييس الأداء<sup>[\[9\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-dzen-jamba-9)</sup>:

- حقق **Jamba 1.5 Mini** درجة 46.1 في Arena Hard، مما يجعله النموذج العام الرائد في فئته<sup>[\[10\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-aws-jamba-1.5-bedrock-10)</sup>.
- حقق **Jamba 1.5 Large** درجة 65.4 في Arena Hard، متفوقًا على Llama 3.1 70B و 405B.

## التطبيقات والتوافر

تم تحسين Jamba للتطبيقات التجارية ويدعم ميزات مثل استدعاء الوظائف (function calling)، والإخراج المنظم بصيغة JSON، ومعالجة المستندات. النموذج متاح على العديد من المنصات، بما في ذلك:

- Hugging Face
- Google Cloud Vertex AI
- Microsoft Azure
- NVIDIA API catalog
- Amazon Bedrock<sup>[\[9\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-dzen-jamba-9)</sup>
- AI21 Studio

لدعم الاستدلال الفعال من حيث التكلفة، قدمت AI21 Labs تقنية **ExpertsInt8** — وهي تقنية تكميم (quantization) جديدة تسمح بتشغيل Jamba 1.5 Large على جهاز بـ 8 وحدات GPU بسعة 80 جيجابايت لكل منها دون فقدان في الجودة عند معالجة سياق بحجم 256 ألف توكن<sup>[\[11\]](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_note-openreview-expertsint8-11)</sup>.

## المؤلفات

- Lieber, O.; et al. (2024). *Jamba: A Hybrid Transformer‑Mamba Language Model*. <a href="https://arxiv.org/abs/2403.19887" class="external text" rel="nofollow">arXiv:2403.19887</a>.
- Lieber, O.; et al. (2024). *Jamba‑1.5 Models and ExpertsInt8 Quantization*. <a href="https://openreview.net/pdf?id=JFPaD7lpBD" class="external text" rel="nofollow">OpenReview JFPaD7lpBD</a>.
- Gu, A.; Dao, T. (2023). *Mamba: Linear‑Time Sequence Modeling with Selective State Spaces*. <a href="https://arxiv.org/abs/2312.00752" class="external text" rel="nofollow">arXiv:2312.00752</a>.
- Gu, A.; et al. (2021). *S4: Efficiently Modeling Long Sequences with Structured State Spaces*. <a href="https://arxiv.org/abs/2111.00396" class="external text" rel="nofollow">arXiv:2111.00396</a>.
- Fedus, W.; et al. (2021). *Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity*. <a href="https://arxiv.org/abs/2101.03961" class="external text" rel="nofollow">arXiv:2101.03961</a>.
- Yun, L.; et al. (2024). *Toward Inference‑Optimal Mixture‑of‑Expert Large Language Models*. <a href="https://arxiv.org/abs/2404.02852" class="external text" rel="nofollow">arXiv:2404.02852</a>.
- Liu, J.; et al. (2024). *A Survey on Mixture of Experts in Large Language Models*. <a href="https://arxiv.org/abs/2407.06204" class="external text" rel="nofollow">arXiv:2407.06204</a>.
- Gupta, V.; et al. (2024). *Lynx: Enabling Efficient MoE Inference through Dynamic Batch‑Aware Expert Selection*. <a href="https://arxiv.org/abs/2411.08982" class="external text" rel="nofollow">arXiv:2411.08982</a>.
- Liu, J.; et al. (2024). *A Survey on Inference Optimization Techniques for Mixture of Experts Models*. <a href="https://arxiv.org/abs/2412.14219" class="external text" rel="nofollow">arXiv:2412.14219</a>.
- Hsieh, C.‑P.; et al. (2024). *RULER: What's the Real Context Size of Your Long‑Context Language Models?*. <a href="https://arxiv.org/abs/2404.06654" class="external text" rel="nofollow">arXiv:2404.06654</a>.

## ملاحظات

1.  <span id="cite_note-ai21-announcement-1">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-ai21-announcement_1-0) «Announcing Jamba: AI21's Groundbreaking SSM-Transformer Model». *AI21 Labs Blog*. <a href="https://www.ai21.com/blog/announcing-jamba/" class="external autonumber" rel="nofollow">[١]</a></span>
2.  <span id="cite_note-arxiv-jamba-2">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-arxiv-jamba_2-0) Lieber, O., et al. (2024). *Jamba: A Hybrid Transformer-Mamba Language Model*. <a href="https://arxiv.org/abs/2403.19887" class="external text" rel="nofollow">arXiv:2403.19887</a>.</span>
3.  <span id="cite_note-transformers-doc-jamba-3">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-transformers-doc-jamba_3-0) «Jamba Documentation». *Hugging Face Transformers*. <a href="https://huggingface.co/docs/transformers/model_doc/jamba" class="external autonumber" rel="nofollow">[٢]</a></span>
4.  <span id="cite_note-hf-jamba-v0.1-4">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-hf-jamba-v0.1_4-0) «ai21labs/Jamba-v0.1». *Hugging Face*. <a href="https://huggingface.co/ai21labs/Jamba-v0.1" class="external autonumber" rel="nofollow">[٣]</a></span>
5.  <span id="cite_note-gradientflow-jamba-5">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-gradientflow-jamba_5-0) «AI21 Labs' Jamba: A New Hybrid LLM Architecture». *Gradient Flow*. <a href="https://gradientflow.com/ai21labs-jamba/" class="external autonumber" rel="nofollow">[٤]</a></span>
6.  <span id="cite_note-jamba-1.5-family-6">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-jamba-1.5-family_6-0) «Announcing the Jamba-1.5 model family». *AI21 Labs Blog*. <a href="https://www.ai21.com/blog/announcing-jamba-model-family/" class="external autonumber" rel="nofollow">[٥]</a></span>
7.  <span id="cite_note-hf-jamba-large-1.5-7">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-hf-jamba-large-1.5_7-0) «ai21labs/AI21-Jamba-Large-1.5». *Hugging Face*. <a href="https://huggingface.co/ai21labs/AI21-Jamba-Large-1.5" class="external autonumber" rel="nofollow">[٦]</a></span>
8.  <span id="cite_note-itinai-jamba-8">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-itinai-jamba_8-0) «تكسر AI21 Labs حواجز جديدة بمساعدة Jamba». *ITinAI*. <a href="https://itinai.ru/ai21-labs-разбивает-новые-барьеры-с-помощью-jamba/" class="external autonumber" rel="nofollow">[٧]</a></span>
9.  <span id="cite_note-dzen-jamba-9">↑ <sup>[9.0](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-dzen-jamba_9-0)</sup> <sup>[9.1](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-dzen-jamba_9-1)</sup> «إصدار Jamba 1.5: النموذج الهجين من AI21 Labs». *Dzen*. <a href="https://dzen.ru/b/ZshehqcyHXQEtm7n" class="external autonumber" rel="nofollow">[٨]</a></span>
10. <span id="cite_note-aws-jamba-1.5-bedrock-10">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-aws-jamba-1.5-bedrock_10-0) «Jamba-1.5 family of models by AI21 Labs is now available in Amazon Bedrock». *AWS What's New*. <a href="https://aws.amazon.com/about-aws/whats-new/2024/09/jamba-1-5-family-models-amazon-bedrock/?nc1=h_ls" class="external autonumber" rel="nofollow">[٩]</a></span>
11. <span id="cite_note-openreview-expertsint8-11">[↑](https://systems-analysis.info/int/Jamba_(language_model)_%E2%80%94_%D8%AC%D8%A7%D9%85%D8%A8%D8%A7#cite_ref-openreview-expertsint8_11-0) «ExpertsInt8: A new paradigm for efficient inference of MoE-based LLMs». *OpenReview*. <a href="https://openreview.net/forum?id=JFPaD7lpBD" class="external autonumber" rel="nofollow">[١٠]</a></span>
