---
title: "Jamba (language model) (EL)"
source: "https://systems-analysis.info/int/Jamba_(language_model)_(EL)"
wiki: "systems-analysis.info/int"
article: "Jamba_(language_model)_(EL)"
language: "el"
categories:
  - "Category:Greek"
  - "Category:Large language models"
  - "Category:LLM families"
  - "Category:Machine learning"
revision_id: 3343
wiki_created_at: 2026-09-06T23:19:16Z
wiki_modified_at: 2026-09-06T23:19:16Z
downloaded_at: 2026-09-07T22:56:27Z
---

# Jamba (language model) (EL)

**Jamba** — είναι μια οικογένεια μεγάλων γλωσσικών μοντέλων (LLM), που αναπτύχθηκε από την ισραηλινή ερευνητική εταιρεία AI21 Labs. Το Jamba αποτελεί την πρώτη στο είδος της **υβριδική αρχιτεκτονική**, που συνδυάζει βασικά στοιχεία δύο κυρίαρχων προσεγγίσεων στην ανάπτυξη AI: transformer και μοντέλα χώρου καταστάσεων (State Space Models, SSM), ειδικότερα, της αρχιτεκτονικής Mamba<sup>[\[1\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-ai21-announcement-1)</sup>.

Ο κύριος στόχος του Jamba είναι η επίλυση του θεμελιώδους συμβιβασμού των σύγχρονων LLM: υψηλή ποιότητα και απόδοση (χαρακτηριστικά των transformer) έναντι αποδοτικότητας και ικανότητας επεξεργασίας υπερ-μακρών πλαισίων (χαρακτηριστικά των SSM). Συνδυάζοντας αυτές τις προσεγγίσεις και προσθέτοντας σπανιότητα μέσω Mixture-of-Experts (MoE), το Jamba προσφέρει ένα μοντέλο που είναι ταυτόχρονα ισχυρό, αποδοτικό και ικανό να επεξεργάζεται τεράστιους όγκους κειμένου σε ένα μόνο ερώτημα.

## Αρχιτεκτονική Jamba σε λεπτομέρειες

Το Jamba δεν απλώς εναλλάσσει στρώματα transformer και Mamba. Χρησιμοποιεί μια προσεκτικά σχεδιασμένη **δομή block**, όπου κάθε block αποτελείται από οκτώ στρώματα.

Δομή ενός block Jamba:

- **Ένα στρώμα Transformer:** Αυτό το στρώμα είναι υπεύθυνο για την «βαθιά» κατανόηση και τους σύνθετους συλλογισμούς. Σε αυτό το στρώμα είναι ενσωματωμένη η αρχιτεκτονική **Mixture-of-Experts (MoE)**.
- **Επτά στρώματα Mamba:** Αυτά τα στρώματα ακολουθούν το στρώμα transformer και είναι υπεύθυνα για την αποδοτική επεξεργασία της ακολουθίας και τη «μεταφορά» πληροφοριών μέσα από μεγάλο πλαίσιο<sup>[\[2\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-arxiv-jamba-2)</sup>.

Αυτή η ασύμμετρη δομή επιτρέπει στο μοντέλο να διαχειρίζεται αποδοτικά τους υπολογιστικούς πόρους: οι βαριές αλλά ισχυρές λειτουργίες transformer εκτελούνται λιγότερο συχνά, ενώ οι ελαφριές και γρήγορες λειτουργίες Mamba εκτελούνται συχνότερα.

### Ενσωμάτωση Mixture-of-Experts (MoE)

Στο Jamba χρησιμοποιείται η αρχιτεκτονική MoE για περαιτέρω αύξηση της αποδοτικότητας.

- Το MoE εφαρμόζεται **μόνο στα πλήρως συνδεδεμένα blocks (FFN) εντός των στρωμάτων-transformer**<sup>[\[3\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-transformers-doc-jamba-3)</sup>. Τα στρώματα Mamba παραμένουν πυκνά.
- Στο πρώτο μοντέλο Jamba υπήρχαν **16 ειδικοί**.
- Για κάθε token, το δίκτυο-δρομολογητής επιλέγει **2 καλύτερους ειδικούς** (Top-2 gating).

Αυτό σημαίνει ότι, αν και ο συνολικός αριθμός παραμέτρων του μοντέλου είναι μεγάλος (52 δισ.), σε κάθε βήμα επεξεργασίας token στο στρώμα-transformer ενεργοποιούνται μόνο 2 από τους 16 ειδικούς, καθιστώντας τους υπολογισμούς πολύ γρήγορους.

## Εξέλιξη των μοντέλων Jamba

### Jamba-v0.1 (Μάρτιος 2024)

Το πρώτο μοντέλο που παρουσιάστηκε στο πλαίσιο αυτής της οικογένειας έχει τα ακόλουθα χαρακτηριστικά:

| Χαρακτηριστικό                   | Τιμή                                                                                                                  |
|----------------------------------|-----------------------------------------------------------------------------------------------------------------------|
| **Συνολικός αριθμός παραμέτρων** | 52 δισεκατομμύρια                                                                                                     |
| **Ενεργές παράμετροι**           | ~12 δισεκατομμύρια                                                                                                    |
| **Αριθμός ειδικών (MoE)**        | 16 (2 ενεργοί)                                                                                                        |
| **Παράθυρο πλαισίου**            | 256 000 token                                                                                                         |
| **Άδεια**                        | Apache 2.0<sup>[\[4\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-hf-jamba-v0.1-4)</sup> |

Τεχνικά χαρακτηριστικά Jamba-v0.1

Χάρη στην υβριδική αρχιτεκτονική του, το Jamba-1 είναι ικανό να επεξεργάζεται πλαίσιο μήκους 256 000 token, που ισοδυναμεί με ένα μυθιστόρημα περίπου 400 σελίδων, και μπορεί να αναπτυχθεί σε μία καταναλωτική GPU με 80 GB μνήμης<sup>[\[5\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-gradientflow-jamba-5)</sup>.

### Jamba-1.5 (2024)

Το 2024 η AI21 Labs παρουσίασε την ανανεωμένη οικογένεια μοντέλων Jamba 1.5, που περιλαμβάνει δύο εκδόσεις: **Jamba 1.5 Mini** (12B ενεργές παράμετροι από 52B συνολικά) και **Jamba 1.5 Large** (94B ενεργές παράμετροι από 398B συνολικά)<sup>[\[6\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-jamba-1.5-family-6)</sup>. Αυτά τα μοντέλα παρουσιάζουν ουσιαστικές βελτιώσεις στην απόδοση:

- Έως 2,5 φορές ταχύτερη εξαγωγή συμπερασμάτων σε μεγάλα πλαίσια σε σύγκριση με τους ανταγωνιστές.
- Υποστήριξη εννέα γλωσσών, συμπεριλαμβανομένων των αγγλικών, ισπανικών, γαλλικών και αραβικών<sup>[\[7\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-hf-jamba-large-1.5-7)</sup>.

## Βασικά πλεονεκτήματα και απόδοση

- **Τεράστιο παράθυρο πλαισίου:** 256 000 token — ένα από τα μεγαλύτερα παράθυρα μεταξύ όλων των διαθέσιμων (συμπεριλαμβανομένων των ιδιόκτητων) μοντέλων κατά τη στιγμή της κυκλοφορίας του. Αυτό καθιστά το Jamba ιδανικό για εργασίες που απαιτούν ανάλυση μεγάλων εγγράφων: νομικών συμβολαίων, επιστημονικών εργασιών, ολόκληρων βάσεων κώδικα ή μακρών διαλόγων.
- **Υψηλή απόδοση και αποδοτικότητα:** Στις δοκιμές, το Jamba επιδεικνύει απόδοση συγκρίσιμη ή ανώτερη από τα κορυφαία ανοιχτά μοντέλα παρόμοιου μεγέθους, όπως τα Llama και Mixtral, παρουσιάζοντας ταυτόχρονα **3 φορές υψηλότερη απόδοση** σε μεγάλα πλαίσια<sup>[\[8\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-itinai-jamba-8)</sup>.
- **Ανοιχτότητα και προσβασιμότητα:** Το Jamba διανέμεται υπό την ελεύθερη άδεια Apache 2.0, που επιτρέπει την ελεύθερη χρήση του για εμπορικούς και ερευνητικούς σκοπούς. Τα βάρη του μοντέλου είναι διαθέσιμα στην πλατφόρμα Hugging Face.

### Αποτελέσματα σε benchmark

Το Jamba 1.5 παρουσιάζει ανταγωνιστικά αποτελέσματα σε διάφορα benchmark<sup>[\[9\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-dzen-jamba-9)</sup>:

- **Jamba 1.5 Mini** σκόραρε 46,1 στο Arena Hard, καθιστώντας το το κορυφαίο δημόσιο μοντέλο στην κατηγορία του<sup>[\[10\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-aws-jamba-1.5-bedrock-10)</sup>.
- **Jamba 1.5 Large** σκόραρε 65,4 στο Arena Hard, ξεπερνώντας τα Llama 3.1 70B και 405B.

## Εφαρμογές και διαθεσιμότητα

Το Jamba είναι βελτιστοποιημένο για επιχειρηματικές εφαρμογές και υποστηρίζει δυνατότητες όπως κλήση συναρτήσεων, δομημένη εξαγωγή σε JSON και επεξεργασία εγγράφων. Το μοντέλο είναι διαθέσιμο σε πολλές πλατφόρμες, συμπεριλαμβανομένων:

- Hugging Face
- Google Cloud Vertex AI
- Microsoft Azure
- NVIDIA API catalog
- Amazon Bedrock<sup>[\[9\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-dzen-jamba-9)</sup>
- AI21 Studio

Για την υποστήριξη οικονομικά αποδοτικής εξαγωγής συμπερασμάτων, η AI21 Labs παρουσίασε **ExpertsInt8** — μια νέα τεχνική κβαντισμού που επιτρέπει την εκτέλεση του Jamba 1.5 Large σε μηχάνημα με 8 GPU των 80GB χωρίς απώλεια ποιότητας κατά την επεξεργασία πλαισίου 256K token<sup>[\[11\]](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_note-openreview-expertsint8-11)</sup>.

## Βιβλιογραφία

- Lieber, O.; et al. (2024). *Jamba: A Hybrid Transformer‑Mamba Language Model*. arXiv:2403.19887.
- Lieber, O.; et al. (2024). *Jamba‑1.5 Models and ExpertsInt8 Quantization*. OpenReview JFPaD7lpBD.
- Gu, A.; Dao, T. (2023). *Mamba: Linear‑Time Sequence Modeling with Selective State Spaces*. arXiv:2312.00752.
- Gu, A.; et al. (2021). *S4: Efficiently Modeling Long Sequences with Structured State Spaces*. arXiv:2111.00396.
- Fedus, W.; et al. (2021). *Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity*. arXiv:2101.03961.
- Yun, L.; et al. (2024). *Toward Inference‑Optimal Mixture‑of‑Expert Large Language Models*. arXiv:2404.02852.
- Liu, J.; et al. (2024). *A Survey on Mixture of Experts in Large Language Models*. arXiv:2407.06204.
- Gupta, V.; et al. (2024). *Lynx: Enabling Efficient MoE Inference through Dynamic Batch‑Aware Expert Selection*. arXiv:2411.08982.
- Liu, J.; et al. (2024). *A Survey on Inference Optimization Techniques for Mixture of Experts Models*. arXiv:2412.14219.
- Hsieh, C.‑P.; et al. (2024). *RULER: What's the Real Context Size of Your Long‑Context Language Models?*. arXiv:2404.06654.

## Σημειώσεις

1.  <span id="cite_note-ai21-announcement-1">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-ai21-announcement_1-0) «Announcing Jamba: AI21's Groundbreaking SSM-Transformer Model». *AI21 Labs Blog*. <a href="https://www.ai21.com/blog/announcing-jamba/" class="external autonumber" rel="nofollow">[1]</a></span>
2.  <span id="cite_note-arxiv-jamba-2">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-arxiv-jamba_2-0) Lieber, O., et al. (2024). *Jamba: A Hybrid Transformer-Mamba Language Model*. <a href="https://arxiv.org/abs/2403.19887" class="external text" rel="nofollow">arXiv:2403.19887</a>.</span>
3.  <span id="cite_note-transformers-doc-jamba-3">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-transformers-doc-jamba_3-0) «Jamba Documentation». *Hugging Face Transformers*. <a href="https://huggingface.co/docs/transformers/model_doc/jamba" class="external autonumber" rel="nofollow">[2]</a></span>
4.  <span id="cite_note-hf-jamba-v0.1-4">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-hf-jamba-v0.1_4-0) «ai21labs/Jamba-v0.1». *Hugging Face*. <a href="https://huggingface.co/ai21labs/Jamba-v0.1" class="external autonumber" rel="nofollow">[3]</a></span>
5.  <span id="cite_note-gradientflow-jamba-5">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-gradientflow-jamba_5-0) «AI21 Labs' Jamba: A New Hybrid LLM Architecture». *Gradient Flow*. <a href="https://gradientflow.com/ai21labs-jamba/" class="external autonumber" rel="nofollow">[4]</a></span>
6.  <span id="cite_note-jamba-1.5-family-6">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-jamba-1.5-family_6-0) «Announcing the Jamba-1.5 model family». *AI21 Labs Blog*. <a href="https://www.ai21.com/blog/announcing-jamba-model-family/" class="external autonumber" rel="nofollow">[5]</a></span>
7.  <span id="cite_note-hf-jamba-large-1.5-7">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-hf-jamba-large-1.5_7-0) «ai21labs/AI21-Jamba-Large-1.5». *Hugging Face*. <a href="https://huggingface.co/ai21labs/AI21-Jamba-Large-1.5" class="external autonumber" rel="nofollow">[6]</a></span>
8.  <span id="cite_note-itinai-jamba-8">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-itinai-jamba_8-0) «AI21 Labs разбивает новые барьеры с помощью Jamba». *ITinAI*. <a href="https://itinai.ru/ai21-labs-разбивает-новые-барьеры-с-помощью-jamba/" class="external autonumber" rel="nofollow">[7]</a></span>
9.  <span id="cite_note-dzen-jamba-9">↑ <sup>[9.0](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-dzen-jamba_9-0)</sup> <sup>[9.1](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-dzen-jamba_9-1)</sup> «Вышла Jamba 1.5: гибридная модель от AI21 Labs». *Дзен*. <a href="https://dzen.ru/b/ZshehqcyHXQEtm7n" class="external autonumber" rel="nofollow">[8]</a></span>
10. <span id="cite_note-aws-jamba-1.5-bedrock-10">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-aws-jamba-1.5-bedrock_10-0) «Jamba-1.5 family of models by AI21 Labs is now available in Amazon Bedrock». *AWS What's New*. <a href="https://aws.amazon.com/ru/about-aws/whats-new/2024/09/jamba-1-5-family-models-amazon-bedrock/?nc1=h_ls" class="external autonumber" rel="nofollow">[9]</a></span>
11. <span id="cite_note-openreview-expertsint8-11">[↑](https://systems-analysis.info/int/Jamba_(language_model)_(EL)#cite_ref-openreview-expertsint8_11-0) «ExpertsInt8: A new paradigm for efficient inference of MoE-based LLMs». *OpenReview*. <a href="https://openreview.net/forum?id=JFPaD7lpBD" class="external autonumber" rel="nofollow">[10]</a></span>
