---
title: "Jamba (modelo de lenguaje)"
source: "https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)"
wiki: "systems-analysis.info/int"
article: "Jamba_(modelo_de_lenguaje)"
language: "es"
categories:
  - "Category:Large language models"
  - "Category:LLM families"
  - "Category:Machine learning"
  - "Category:Spanish"
revision_id: 3363
wiki_created_at: 2026-09-06T23:19:33Z
wiki_modified_at: 2026-09-06T23:19:33Z
downloaded_at: 2026-09-07T22:56:33Z
---

# Jamba (modelo de lenguaje)

**Jamba** es una familia de [grandes modelos de lenguaje](https://systems-analysis.info/int/Grandes_modelos_de_lenguaje "Grandes modelos de lenguaje") (LLM) desarrollada por la empresa de investigación israelí AI21 Labs. Jamba presenta la primera **arquitectura híbrida** de su tipo, que combina elementos clave de dos enfoques dominantes en el desarrollo de IA: los transformers y los modelos de espacio de estados (State Space Models, SSM), en particular, la arquitectura Mamba<sup>[\[1\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-ai21-announcement-1)</sup>.

El objetivo principal de Jamba es resolver el compromiso fundamental de los LLM modernos: la alta calidad y el rendimiento (característicos de los transformers) frente a la eficiencia y la capacidad para procesar contextos extralargos (características de los SSM). Al combinar estos enfoques y añadir escasez mediante Mixture-of-Experts (MoE), Jamba ofrece un modelo que es a la vez potente, eficiente y capaz de trabajar con enormes volúmenes de texto en una sola consulta.

## Arquitectura de Jamba en detalle

Jamba no se limita a alternar capas de transformer y Mamba. Utiliza una **estructura de bloques** cuidadosamente diseñada, donde cada bloque consta de ocho capas.

Estructura de un bloque de Jamba:

- **Una capa de Transformer:** Esta capa es responsable de la comprensión "profunda" y el razonamiento complejo. En esta capa se integra la arquitectura **Mixture-of-Experts (MoE)**.
- **Siete capas de Mamba:** Estas capas siguen a la capa de transformer y son responsables del procesamiento eficiente de la secuencia y de "arrastrar" la información a través de un contexto largo<sup>[\[2\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-arxiv-jamba-2)</sup>.

Esta estructura asimétrica permite al modelo gestionar eficientemente los recursos computacionales: las operaciones de transformer, pesadas pero potentes, se ejecutan con menos frecuencia, mientras que las operaciones de Mamba, ligeras y rápidas, se ejecutan más a menudo.

### Integración de Mixture-of-Experts (MoE)

En Jamba se utiliza la arquitectura MoE para mejorar aún más la eficiencia.

- El MoE se aplica **únicamente a los bloques de avance de red (FFN) dentro de las capas de transformer**<sup>[\[3\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-transformers-doc-jamba-3)</sup>. Las capas de Mamba permanecen densas.
- El primer modelo Jamba tenía **16 expertos**.
- Para cada token, la red de enrutamiento selecciona los **2 mejores expertos** (gating Top-2).

Esto significa que, aunque el número total de parámetros del modelo es grande (52 mil millones), en cada paso del procesamiento de un token en la capa de transformer solo están activos 2 de los 16 expertos, lo que hace que los cálculos sean muy rápidos.

## Evolución de los modelos Jamba

### Jamba-v0.1 (marzo de 2024)

El primer modelo presentado dentro de esta familia tiene las siguientes características:

| Característica                 | Valor                                                                                                                |
|--------------------------------|----------------------------------------------------------------------------------------------------------------------|
| **Número total de parámetros** | 52 mil millones                                                                                                      |
| **Parámetros activos**         | ~12 mil millones                                                                                                     |
| **Número de expertos (MoE)**   | 16 (2 activos)                                                                                                       |
| **Ventana de contexto**        | 256 000 tokens                                                                                                       |
| **Licencia**                   | Apache 2.0<sup>[\[4\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-hf-jamba-v0.1-4)</sup> |

Especificaciones técnicas de Jamba-v0.1

Gracias a su arquitectura híbrida, Jamba-1 es capaz de procesar un contexto de 256 000 tokens, lo que equivale aproximadamente a una novela de 400 páginas, y puede desplegarse en una única GPU de consumo con 80 GB de memoria<sup>[\[5\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-gradientflow-jamba-5)</sup>.

### Jamba-1.5 (2024)

En 2024, AI21 Labs presentó la familia de modelos actualizada Jamba 1.5, que incluye dos versiones: **Jamba 1.5 Mini** (12B de parámetros activos de un total de 52B) y **Jamba 1.5 Large** (94B de parámetros activos de un total de 398B)<sup>[\[6\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-jamba-1.5-family-6)</sup>. Estos modelos demuestran mejoras significativas en el rendimiento:

- Inferencia hasta 2.5 veces más rápida en contextos largos en comparación con la competencia.
- Soporte para nueve idiomas, incluyendo inglés, español, francés y árabe<sup>[\[7\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-hf-jamba-large-1.5-7)</sup>.

## Ventajas clave y rendimiento

- **Enorme ventana de contexto:** 256 000 tokens, una de las ventanas más grandes entre todos los modelos disponibles (incluidos los propietarios) en el momento de su lanzamiento. Esto hace que Jamba sea ideal para tareas que requieren el análisis de documentos extensos: contratos legales, artículos científicos, bases de código completas o diálogos largos.
- **Alto rendimiento y eficiencia:** En las pruebas, Jamba demuestra un rendimiento comparable o superior a los principales modelos abiertos de tamaño similar, como Llama y Mixtral, al tiempo que muestra un **rendimiento 3 veces mayor** en contextos largos<sup>[\[8\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-itinai-jamba-8)</sup>.
- **Código abierto y accesibilidad:** Jamba se distribuye bajo la licencia permisiva Apache 2.0, lo que permite su uso libre con fines comerciales y de investigación. Los pesos del modelo están disponibles en la plataforma Hugging Face.

### Resultados en benchmarks

Jamba 1.5 muestra resultados competitivos en diversos benchmarks<sup>[\[9\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-dzen-jamba-9)</sup>:

- **Jamba 1.5 Mini** obtuvo 46.1 puntos en Arena Hard, lo que la convierte en el modelo público líder en su categoría<sup>[\[10\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-aws-jamba-1.5-bedrock-10)</sup>.
- **Jamba 1.5 Large** obtuvo 65.4 puntos en Arena Hard, superando a Llama 3.1 70B y 405B.

## Aplicación y disponibilidad

Jamba está optimizado para aplicaciones empresariales y admite capacidades como la llamada a funciones (function calling), la salida estructurada en JSON y el procesamiento de documentos. El modelo está disponible en múltiples plataformas, incluyendo:

- Hugging Face
- Google Cloud Vertex AI
- Microsoft Azure
- NVIDIA API catalog
- Amazon Bedrock<sup>[\[9\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-dzen-jamba-9)</sup>
- AI21 Studio

Para soportar una inferencia rentable, AI21 Labs introdujo **ExpertsInt8**, una nueva técnica de cuantización que permite alojar Jamba 1.5 Large en una máquina con 8 GPU de 80 GB cada una, sin pérdida de calidad al procesar un contexto de 256K tokens<sup>[\[11\]](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_note-openreview-expertsint8-11)</sup>.

## Literatura

- Lieber, O.; et al. (2024). *Jamba: A Hybrid Transformer‑Mamba Language Model*. <a href="https://arxiv.org/abs/2403.19887" class="external text" rel="nofollow">arXiv:2403.19887</a>.
- Lieber, O.; et al. (2024). *Jamba‑1.5 Models and ExpertsInt8 Quantization*. <a href="https://openreview.net/pdf?id=JFPaD7lpBD" class="external text" rel="nofollow">OpenReview JFPaD7lpBD</a>.
- Gu, A.; Dao, T. (2023). *Mamba: Linear‑Time Sequence Modeling with Selective State Spaces*. <a href="https://arxiv.org/abs/2312.00752" class="external text" rel="nofollow">arXiv:2312.00752</a>.
- Gu, A.; et al. (2021). *S4: Efficiently Modeling Long Sequences with Structured State Spaces*. <a href="https://arxiv.org/abs/2111.00396" class="external text" rel="nofollow">arXiv:2111.00396</a>.
- Fedus, W.; et al. (2021). *Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity*. <a href="https://arxiv.org/abs/2101.03961" class="external text" rel="nofollow">arXiv:2101.03961</a>.
- Yun, L.; et al. (2024). *Toward Inference‑Optimal Mixture‑of‑Expert Large Language Models*. <a href="https://arxiv.org/abs/2404.02852" class="external text" rel="nofollow">arXiv:2404.02852</a>.
- Liu, J.; et al. (2024). *A Survey on Mixture of Experts in Large Language Models*. <a href="https://arxiv.org/abs/2407.06204" class="external text" rel="nofollow">arXiv:2407.06204</a>.
- Gupta, V.; et al. (2024). *Lynx: Enabling Efficient MoE Inference through Dynamic Batch‑Aware Expert Selection*. <a href="https://arxiv.org/abs/2411.08982" class="external text" rel="nofollow">arXiv:2411.08982</a>.
- Liu, J.; et al. (2024). *A Survey on Inference Optimization Techniques for Mixture of Experts Models*. <a href="https://arxiv.org/abs/2412.14219" class="external text" rel="nofollow">arXiv:2412.14219</a>.
- Hsieh, C.‑P.; et al. (2024). *RULER: What's the Real Context Size of Your Long‑Context Language Models?*. <a href="https://arxiv.org/abs/2404.06654" class="external text" rel="nofollow">arXiv:2404.06654</a>.

## Referencias

1.  <span id="cite_note-ai21-announcement-1">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-ai21-announcement_1-0) «Announcing Jamba: AI21's Groundbreaking SSM-Transformer Model». *AI21 Labs Blog*. <a href="https://www.ai21.com/blog/announcing-jamba/" class="external autonumber" rel="nofollow">[1]</a></span>
2.  <span id="cite_note-arxiv-jamba-2">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-arxiv-jamba_2-0) Lieber, O., et al. (2024). *Jamba: A Hybrid Transformer-Mamba Language Model*. <a href="https://arxiv.org/abs/2403.19887" class="external text" rel="nofollow">arXiv:2403.19887</a>.</span>
3.  <span id="cite_note-transformers-doc-jamba-3">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-transformers-doc-jamba_3-0) «Jamba Documentation». *Hugging Face Transformers*. <a href="https://huggingface.co/docs/transformers/model_doc/jamba" class="external autonumber" rel="nofollow">[2]</a></span>
4.  <span id="cite_note-hf-jamba-v0.1-4">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-hf-jamba-v0.1_4-0) «ai21labs/Jamba-v0.1». *Hugging Face*. <a href="https://huggingface.co/ai21labs/Jamba-v0.1" class="external autonumber" rel="nofollow">[3]</a></span>
5.  <span id="cite_note-gradientflow-jamba-5">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-gradientflow-jamba_5-0) «AI21 Labs' Jamba: A New Hybrid LLM Architecture». *Gradient Flow*. <a href="https://gradientflow.com/ai21labs-jamba/" class="external autonumber" rel="nofollow">[4]</a></span>
6.  <span id="cite_note-jamba-1.5-family-6">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-jamba-1.5-family_6-0) «Announcing the Jamba-1.5 model family». *AI21 Labs Blog*. <a href="https://www.ai21.com/blog/announcing-jamba-model-family/" class="external autonumber" rel="nofollow">[5]</a></span>
7.  <span id="cite_note-hf-jamba-large-1.5-7">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-hf-jamba-large-1.5_7-0) «ai21labs/AI21-Jamba-Large-1.5». *Hugging Face*. <a href="https://huggingface.co/ai21labs/AI21-Jamba-Large-1.5" class="external autonumber" rel="nofollow">[6]</a></span>
8.  <span id="cite_note-itinai-jamba-8">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-itinai-jamba_8-0) «AI21 Labs rompe nuevas barreras con la ayuda de Jamba». *ITinAI*. <a href="https://itinai.ru/ai21-labs-разбивает-новые-барьеры-с-помощью-jamba/" class="external autonumber" rel="nofollow">[7]</a></span>
9.  <span id="cite_note-dzen-jamba-9">↑ <sup>[9.0](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-dzen-jamba_9-0)</sup> <sup>[9.1](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-dzen-jamba_9-1)</sup> «Ha salido Jamba 1.5: el modelo híbrido de AI21 Labs». *Dzen*. <a href="https://dzen.ru/b/ZshehqcyHXQEtm7n" class="external autonumber" rel="nofollow">[8]</a></span>
10. <span id="cite_note-aws-jamba-1.5-bedrock-10">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-aws-jamba-1.5-bedrock_10-0) «Jamba-1.5 family of models by AI21 Labs is now available in Amazon Bedrock». *AWS What's New*. <a href="https://aws.amazon.com/ru/about-aws/whats-new/2024/09/jamba-1-5-family-models-amazon-bedrock/?nc1=h_ls" class="external autonumber" rel="nofollow">[9]</a></span>
11. <span id="cite_note-openreview-expertsint8-11">[↑](https://systems-analysis.info/int/Jamba_(modelo_de_lenguaje)#cite_ref-openreview-expertsint8_11-0) «ExpertsInt8: A new paradigm for efficient inference of MoE-based LLMs». *OpenReview*. <a href="https://openreview.net/forum?id=JFPaD7lpBD" class="external autonumber" rel="nofollow">[10]</a></span>
