---
title: "YandexGPT (modelo de lenguaje)"
source: "https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)"
wiki: "systems-analysis.info/int"
article: "YandexGPT_(modelo_de_lenguaje)"
language: "es"
categories:
  - "Category:Large language models"
  - "Category:LLM families"
  - "Category:Machine learning"
  - "Category:Spanish"
revision_id: 8534
wiki_created_at: 2026-09-07T01:18:46Z
wiki_modified_at: 2026-09-07T01:18:46Z
downloaded_at: 2026-09-07T23:25:55Z
---

# YandexGPT (modelo de lenguaje)

**YandexGPT (Yet another GPT)** es una familia de [grandes modelos de lenguaje](https://systems-analysis.info/int/Grandes_modelos_de_lenguaje "Grandes modelos de lenguaje") desarrollados por Yandex y presentados por primera vez en mayo de 2023.<sup>[\[1\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-rbc-may17-1)</sup> Los modelos YandexGPT se utilizan en el asistente integrado Alisa, en la Búsqueda y en otros servicios, y también están disponibles a través de la API pública de la plataforma Yandex Cloud.<sup>[\[2\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-cloud-api-2)</sup>

**YaLM-100B** (2022) fue un modelo de investigación predecesor con 100 mil millones de parámetros y código abierto; sirvió como una «prueba de concepto», pero YandexGPT se creó por separado para aplicaciones comerciales.<sup>[\[3\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-github-yalm-3)</sup>

## Historial de lanzamientos

| Fecha       | Versión                   | Características clave                                                                                                                                                             |
|-------------|---------------------------|-----------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|
| Jun 2022    | YaLM-100B                 | 100 B de parámetros, 1.7 TB de datos; Apache 2.0.<sup>[\[3\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-github-yalm-3)</sup>                     |
| 17 may 2023 | YandexGPT 1.0             | Integración en «Alisa».<sup>[\[1\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-rbc-may17-1)</sup>                                                 |
| 7 sep 2023  | YandexGPT 2               | +67 % de calidad según pruebas internas.<sup>[\[4\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-rbc-sep8-4)</sup>                                 |
| 28 mar 2024 | YandexGPT 3 Pro / Lite    | Nueva línea de API corporativa.<sup>[\[5\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-rbc-mar28-5)</sup>                                         |
| 24 oct 2024 | YandexGPT 4 Pro / Lite    | Contexto de 32 000 tokens; razonamiento oculto (chain-of-thought).<sup>[\[6\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-habr-gpt4-6)</sup>      |
| 25 feb 2025 | YandexGPT 5 Pro           | Paridad con GPT-4o en el 64 % de las tareas.<sup>[\[7\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-adindex-5pro-7)</sup>                         |
| 31 mar 2025 | YandexGPT 5 Lite Instruct | Modelo de 8 mil millones de parámetros de acceso abierto; formato Llama.<sup>[\[8\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-hf-5lite-8)</sup> |

Versiones principales

## Arquitectura y entrenamiento

- Arquitectura base: transformer, optimizado para el idioma ruso.
- YandexGPT 5 Lite: compatible con Llama; preentrenamiento ≈ 15 billones de tokens, fine-tuning posterior ≈ 320 mil millones.<sup>[\[8\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-hf-5lite-8)</sup>

### Contexto y límites

- Límite de contexto arquitectónico: 32 000 tokens (versiones 4/5).<sup>[\[6\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-habr-gpt4-6)</sup>
- La API pública limita una única solicitud (prompt + completion) a 7400 tokens.<sup>[\[9\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-langchain-7400-9)</sup>
- El tamaño máximo de la \*\*respuesta\*\* es de 2000 tokens, según la sección «Quotas and limits».<sup>[\[10\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-cloud-limits-10)</sup>

## Modelos actuales (junio 2025)

| Modelo           | Parámetros       | Contexto | Licencia                | Notas                                                                                                                                              |
|------------------|------------------|----------|-------------------------|----------------------------------------------------------------------------------------------------------------------------------------------------|
| YandexGPT 5 Pro  | n/d              | 32 000   | Propietaria             | Acceso a través de API y «Alisa Pro».<sup>[\[7\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-adindex-5pro-7)</sup> |
| YandexGPT 5 Lite | 8 mil millones   | 32 000   | Yandex GPT-Lite License | Abierta; compatible con Llama.<sup>[\[8\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-hf-5lite-8)</sup>            |
| YaLM-100B        | 100 mil millones | 2048     | Apache 2.0              | Proyecto original.<sup>[\[3\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-github-yalm-3)</sup>                     |

## Benchmarks

- Pruebas internas: 5 Pro alcanzó la paridad con GPT-4o en el 64 % de las tareas; superando a 4 Pro en un 67 %.<sup>[\[7\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-adindex-5pro-7)</sup>
- ru-LLM Arena: YandexGPT mantiene el liderazgo en la clasificación ELO entre los modelos en ruso.<sup>[\[11\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-llmarena-11)</sup>

## Fine-tuning

Para 5 Lite, se admite oficialmente el método LoRA; un ejemplo de ejecución está publicado en la model card.<sup>[\[8\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-hf-5lite-8)</sup>

## Modos de API

- Síncrono: para respuestas rápidas (Lite).
- Asíncrono: para tareas que consumen muchos recursos (Pro).<sup>[\[2\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-cloud-api-2)</sup>

## Multimodalidad

La familia YandexGPT sigue siendo textual; los servicios multimodales («Neuro», «YandexArt», «Yandex Vision») se desarrollan por separado.<sup>[\[6\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_note-habr-gpt4-6)</sup>

## Enlaces externos

- <a href="https://cloud.yandex.ru/services/yandexgpt" class="external text" rel="nofollow">YandexGPT en Yandex Cloud</a> - página del servicio
- <a href="https://huggingface.co/yandex/YandexGPT-5-Lite-8B-pretrain" class="external text" rel="nofollow">Pesos de YandexGPT-5 Lite en Hugging Face</a>
- <a href="https://github.com/yandex/YaLM-100B" class="external text" rel="nofollow">Repositorio de YaLM-100B en GitHub</a>

## Bibliografía

- Matkin, N. et al. (2024). *Comparative Analysis of Encoder-Based NER and Large Language Models for Skill Extraction from Russian Job Vacancies*. <a href="https://arxiv.org/abs/2407.19816" class="external text" rel="nofollow">arXiv:2407.19816</a>.
- Tsanda, A.; Bruches, E. (2024). *Russian-Language Multimodal Dataset for Automatic Summarization of Scientific Papers*. <a href="https://arxiv.org/abs/2405.07886" class="external text" rel="nofollow">arXiv:2405.07886</a>.
- Goloburda, M. et al. (2025). *Qorǵau: Evaluating LLM Safety in Kazakh-Russian Bilingual Contexts*. <a href="https://arxiv.org/abs/2502.13640" class="external text" rel="nofollow">arXiv:2502.13640</a>.
- Togmanov, M. et al. (2025). *KazMMLU: Evaluating Language Models on Kazakh, Russian, and Regional Knowledge of Kazakhstan*. <a href="https://arxiv.org/abs/2502.12829" class="external text" rel="nofollow">arXiv:2502.12829</a>.
- Noels, S. et al. (2025). *What Large Language Models Do Not Talk About: An Empirical Study of Moderation and Censorship Practices*. <a href="https://arxiv.org/abs/2504.03803" class="external text" rel="nofollow">arXiv:2504.03803</a>.

## Referencias

1.  <span id="cite_note-rbc-may17-1">↑ <sup>[1.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-rbc-may17_1-0)</sup> <sup>[1.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-rbc-may17_1-1)</sup> «“Яндекс” добавил в “Алису” аналог ChatGPT». *РБК*. <a href="https://www.rbc.ru/technology_and_media/17/05/2023/6464aa4e9a79473a1f0464c1" class="external autonumber" rel="nofollow">[1]</a></span>
2.  <span id="cite_note-cloud-api-2">↑ <sup>[2.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-cloud-api_2-0)</sup> <sup>[2.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-cloud-api_2-1)</sup> «Getting started with YandexGPT (Quickstart)». *Yandex Cloud Docs*. <a href="https://cloud.yandex.com/en/docs/yandexgpt/quickstart" class="external autonumber" rel="nofollow">[2]</a></span>
3.  <span id="cite_note-github-yalm-3">↑ <sup>[3.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-github-yalm_3-0)</sup> <sup>[3.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-github-yalm_3-1)</sup> <sup>[3.2](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-github-yalm_3-2)</sup> «yandex/YaLM‑100B: Pretrained language model with 100B». *GitHub*. <a href="https://github.com/yandex/YaLM-100B" class="external autonumber" rel="nofollow">[3]</a></span>
4.  <span id="cite_note-rbc-sep8-4">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-rbc-sep8_4-0) «Как “Яндекс” решил зарабатывать на своём аналоге ChatGPT». *РБК*. <a href="https://www.rbc.ru/technology_and_media/08/09/2023/64f9ff099a79472ad0e24715" class="external autonumber" rel="nofollow">[4]</a></span>
5.  <span id="cite_note-rbc-mar28-5">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-rbc-mar28_5-0) «“Яндекс” представил третье поколение нейросетей YandexGPT». *РБК*. <a href="https://www.rbc.ru/rbcfreenews/660563e29a794766b508c1f9" class="external autonumber" rel="nofollow">[5]</a></span>
6.  <span id="cite_note-habr-gpt4-6">↑ <sup>[6.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-habr-gpt4_6-0)</sup> <sup>[6.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-habr-gpt4_6-1)</sup> <sup>[6.2](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-habr-gpt4_6-2)</sup> «Более мощное семейство моделей YandexGPT 4». *Habr*. <a href="https://habr.com/ru/companies/yandex/articles/852968/" class="external autonumber" rel="nofollow">[6]</a></span>
7.  <span id="cite_note-adindex-5pro-7">↑ <sup>[7.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-adindex-5pro_7-0)</sup> <sup>[7.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-adindex-5pro_7-1)</sup> <sup>[7.2](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-adindex-5pro_7-2)</sup> «“Яндекс” внедрил YandexGPT 5 Pro в чат с “Алисой Про”». *AdIndex*. <a href="https://adindex.ru/news/digital/2025/02/25/331154.phtml" class="external autonumber" rel="nofollow">[7]</a></span>
8.  <span id="cite_note-hf-5lite-8">↑ <sup>[8.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-hf-5lite_8-0)</sup> <sup>[8.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-hf-5lite_8-1)</sup> <sup>[8.2](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-hf-5lite_8-2)</sup> <sup>[8.3](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-hf-5lite_8-3)</sup> «yandex/YandexGPT‑5‑Lite‑8B‑pretrain». *Hugging Face*. <a href="https://huggingface.co/yandex/YandexGPT-5-Lite-8B-pretrain" class="external autonumber" rel="nofollow">[8]</a></span>
9.  <span id="cite_note-langchain-7400-9">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-langchain-7400_9-0) «ChatYandexGPT API Reference (max_tokens = 7400)». *LangChain Docs*. <a href="https://python.langchain.com/api_reference/community/chat_models/langchain_community.chat_models.yandex.ChatYandexGPT.html" class="external autonumber" rel="nofollow">[9]</a></span>
10. <span id="cite_note-cloud-limits-10">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-cloud-limits_10-0) «Yandex Cloud service quotas and limits → Foundation Models». *Yandex Cloud Docs*. <a href="https://cloud.yandex.com/en/docs/overview/concepts/quotas-limits" class="external autonumber" rel="nofollow">[10]</a></span>
11. <span id="cite_note-llmarena-11">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_lenguaje)#cite_ref-llmarena_11-0) «llmarena/llmarena — российская краудсорсинговая платформа оценки LLM». *GitHub*. <a href="https://github.com/llmarena/llmarena" class="external autonumber" rel="nofollow">[11]</a></span>
