---
title: "YandexGPT (modelo de linguagem)"
source: "https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)"
wiki: "systems-analysis.info/int"
article: "YandexGPT_(modelo_de_linguagem)"
language: "pt"
categories:
  - "Category:Large language models"
  - "Category:LLM families"
  - "Category:Machine learning"
  - "Category:Portuguese"
revision_id: 8535
wiki_created_at: 2026-09-07T01:18:47Z
wiki_modified_at: 2026-09-07T01:18:47Z
downloaded_at: 2026-09-07T23:25:56Z
---

# YandexGPT (modelo de linguagem)

**YandexGPT (Yet another GPT)** é uma família de grandes modelos de linguagem desenvolvida pela Yandex e apresentada pela primeira vez em maio de 2023.<sup>[\[1\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-rbc-may17-1)</sup> As redes YandexGPT são utilizadas na assistente integrada Alisa, na Busca Yandex e em outros serviços, além de estarem disponíveis através da API pública da plataforma Yandex Cloud.<sup>[\[2\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-cloud-api-2)</sup>

**YaLM-100B** (2022) foi um modelo de pesquisa anterior com 100 bilhões de parâmetros e código aberto; ele serviu como uma "prova de conceito", mas o YandexGPT foi criado separadamente para aplicação comercial.<sup>[\[3\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-github-yalm-3)</sup>

## História de lançamentos

| Data               | Lançamento                | Principais características                                                                                                                                                   |
|--------------------|---------------------------|------------------------------------------------------------------------------------------------------------------------------------------------------------------------------|
| Jun 2022           | YaLM-100B                 | 100 B parâmetros, 1,7 TB de dados; Apache 2.0.<sup>[\[3\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-github-yalm-3)</sup>                  |
| 17 de maio de 2023 | YandexGPT 1.0             | Integração na 'Alisa'.<sup>[\[1\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-rbc-may17-1)</sup>                                            |
| 7 de set de 2023   | YandexGPT 2               | +67% de qualidade em testes internos.<sup>[\[4\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-rbc-sep8-4)</sup>                              |
| 28 de mar de 2024  | YandexGPT 3 Pro / Lite    | Nova linha de API corporativa.<sup>[\[5\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-rbc-mar28-5)</sup>                                    |
| 24 de out de 2024  | YandexGPT 4 Pro / Lite    | Contexto de 32.000 tokens; raciocínio oculto (chain-of-thought).<sup>[\[6\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-habr-gpt4-6)</sup>  |
| 25 de fev de 2025  | YandexGPT 5 Pro           | Paridade com o GPT-4o em 64% das tarefas.<sup>[\[7\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-adindex-5pro-7)</sup>                      |
| 31 de mar de 2025  | YandexGPT 5 Lite Instruct | Modelo de 8 bilhões de parâmetros em acesso aberto; formato Llama.<sup>[\[8\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-hf-5lite-8)</sup> |

Versões principais

## Arquitetura e treinamento

- Arquitetura base: transformer, otimizado para o idioma russo.
- YandexGPT 5 Lite: compatível com Llama; pré-treinamento ≈ 15 trilhões de tokens, fine-tuning subsequente ≈ 320 bilhões.<sup>[\[8\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-hf-5lite-8)</sup>

### Contexto e limites

- Limite arquitetônico de contexto — 32.000 tokens (versões 4/5).<sup>[\[6\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-habr-gpt4-6)</sup>
- A API pública limita uma única solicitação (prompt + completion) a 7.400 tokens.<sup>[\[9\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-langchain-7400-9)</sup>
- O tamanho máximo da \*\*resposta\*\* é de 2.000 tokens, de acordo com a seção “Quotas and limits”.<sup>[\[10\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-cloud-limits-10)</sup>

## Modelos atuais (junho de 2025)

| Modelo           | Parâmetros  | Contexto | Licença                 | Observações                                                                                                                                 |
|------------------|-------------|----------|-------------------------|---------------------------------------------------------------------------------------------------------------------------------------------|
| YandexGPT 5 Pro  | n/d         | 32.000   | proprietária            | Acesso via API e 'Alisa Pro'.<sup>[\[7\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-adindex-5pro-7)</sup> |
| YandexGPT 5 Lite | 8 bilhões   | 32.000   | Yandex GPT-Lite License | Aberta; compatível com Llama.<sup>[\[8\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-hf-5lite-8)</sup>     |
| YaLM-100B        | 100 bilhões | 2.048    | Apache 2.0              | Projeto original.<sup>[\[3\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-github-yalm-3)</sup>              |

## Benchmarks

- Testes internos: o 5 Pro alcançou paridade com o GPT-4o em 64% das tarefas; superou o 4 Pro em 67%.<sup>[\[7\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-adindex-5pro-7)</sup>
- ru-LLM Arena: O YandexGPT mantém a liderança no ranking ELO entre os modelos de língua russa.<sup>[\[11\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-llmarena-11)</sup>

## Fine-tuning

Para o 5 Lite, o método LoRA é oficialmente suportado; um exemplo de execução está publicado no model card.<sup>[\[8\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-hf-5lite-8)</sup>

## Modos de API

- Síncrono — respostas rápidas (Lite).
- Assíncrono — tarefas que consomem muitos recursos (Pro).<sup>[\[2\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-cloud-api-2)</sup>

## Multimodalidade

A família YandexGPT permanece baseada em texto; os serviços multimodais ('Neuro', 'YandexArt', 'Yandex Vision') são desenvolvidos separadamente.<sup>[\[6\]](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_note-habr-gpt4-6)</sup>

## Ligações externas

- <a href="https://cloud.yandex.ru/services/yandexgpt" class="external text" rel="nofollow">YandexGPT na Yandex Cloud</a> — página do serviço
- <a href="https://huggingface.co/yandex/YandexGPT-5-Lite-8B-pretrain" class="external text" rel="nofollow">Pesos do YandexGPT-5 Lite no Hugging Face</a>
- <a href="https://github.com/yandex/YaLM-100B" class="external text" rel="nofollow">Repositório do YaLM-100B no GitHub</a>

## Literatura

- Matkin, N. et al. (2024). *Comparative Analysis of Encoder-Based NER and Large Language Models for Skill Extraction from Russian Job Vacancies*. <a href="https://arxiv.org/abs/2407.19816" class="external text" rel="nofollow">arXiv:2407.19816</a>.
- Tsanda, A.; Bruches, E. (2024). *Russian-Language Multimodal Dataset for Automatic Summarization of Scientific Papers*. <a href="https://arxiv.org/abs/2405.07886" class="external text" rel="nofollow">arXiv:2405.07886</a>.
- Goloburda, M. et al. (2025). *Qorǵau: Evaluating LLM Safety in Kazakh-Russian Bilingual Contexts*. <a href="https://arxiv.org/abs/2502.13640" class="external text" rel="nofollow">arXiv:2502.13640</a>.
- Togmanov, M. et al. (2025). *KazMMLU: Evaluating Language Models on Kazakh, Russian, and Regional Knowledge of Kazakhstan*. <a href="https://arxiv.org/abs/2502.12829" class="external text" rel="nofollow">arXiv:2502.12829</a>.
- Noels, S. et al. (2025). *What Large Language Models Do Not Talk About: An Empirical Study of Moderation and Censorship Practices*. <a href="https://arxiv.org/abs/2504.03803" class="external text" rel="nofollow">arXiv:2504.03803</a>.

## Notas

1.  <span id="cite_note-rbc-may17-1">↑ <sup>[1.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-rbc-may17_1-0)</sup> <sup>[1.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-rbc-may17_1-1)</sup> “Yandex adiciona análogo do ChatGPT à Alisa”. *RBC*. <a href="https://www.rbc.ru/technology_and_media/17/05/2023/6464aa4e9a79473a1f0464c1" class="external autonumber" rel="nofollow">[1]</a></span>
2.  <span id="cite_note-cloud-api-2">↑ <sup>[2.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-cloud-api_2-0)</sup> <sup>[2.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-cloud-api_2-1)</sup> “Getting started with YandexGPT (Quickstart)”. *Yandex Cloud Docs*. <a href="https://cloud.yandex.com/en/docs/yandexgpt/quickstart" class="external autonumber" rel="nofollow">[2]</a></span>
3.  <span id="cite_note-github-yalm-3">↑ <sup>[3.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-github-yalm_3-0)</sup> <sup>[3.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-github-yalm_3-1)</sup> <sup>[3.2](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-github-yalm_3-2)</sup> “yandex/YaLM-100B: Pretrained language model with 100B”. *GitHub*. <a href="https://github.com/yandex/YaLM-100B" class="external autonumber" rel="nofollow">[3]</a></span>
4.  <span id="cite_note-rbc-sep8-4">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-rbc-sep8_4-0) “Como a Yandex decidiu lucrar com seu análogo do ChatGPT”. *RBC*. <a href="https://www.rbc.ru/technology_and_media/08/09/2023/64f9ff099a79472ad0e24715" class="external autonumber" rel="nofollow">[4]</a></span>
5.  <span id="cite_note-rbc-mar28-5">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-rbc-mar28_5-0) “Yandex apresenta a terceira geração das redes neurais YandexGPT”. *RBC*. <a href="https://www.rbc.ru/rbcfreenews/660563e29a794766b508c1f9" class="external autonumber" rel="nofollow">[5]</a></span>
6.  <span id="cite_note-habr-gpt4-6">↑ <sup>[6.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-habr-gpt4_6-0)</sup> <sup>[6.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-habr-gpt4_6-1)</sup> <sup>[6.2](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-habr-gpt4_6-2)</sup> “Uma família de modelos mais poderosa: YandexGPT 4”. *Habr*. <a href="https://habr.com/ru/companies/yandex/articles/852968/" class="external autonumber" rel="nofollow">[6]</a></span>
7.  <span id="cite_note-adindex-5pro-7">↑ <sup>[7.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-adindex-5pro_7-0)</sup> <sup>[7.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-adindex-5pro_7-1)</sup> <sup>[7.2](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-adindex-5pro_7-2)</sup> “Yandex integra YandexGPT 5 Pro ao chat com 'Alisa Pro'”. *AdIndex*. <a href="https://adindex.ru/news/digital/2025/02/25/331154.phtml" class="external autonumber" rel="nofollow">[7]</a></span>
8.  <span id="cite_note-hf-5lite-8">↑ <sup>[8.0](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-hf-5lite_8-0)</sup> <sup>[8.1](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-hf-5lite_8-1)</sup> <sup>[8.2](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-hf-5lite_8-2)</sup> <sup>[8.3](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-hf-5lite_8-3)</sup> “yandex/YandexGPT-5-Lite-8B-pretrain”. *Hugging Face*. <a href="https://huggingface.co/yandex/YandexGPT-5-Lite-8B-pretrain" class="external autonumber" rel="nofollow">[8]</a></span>
9.  <span id="cite_note-langchain-7400-9">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-langchain-7400_9-0) “ChatYandexGPT API Reference (max_tokens = 7400)”. *LangChain Docs*. <a href="https://python.langchain.com/api_reference/community/chat_models/langchain_community.chat_models.yandex.ChatYandexGPT.html" class="external autonumber" rel="nofollow">[9]</a></span>
10. <span id="cite_note-cloud-limits-10">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-cloud-limits_10-0) “Yandex Cloud service quotas and limits → Foundation Models”. *Yandex Cloud Docs*. <a href="https://cloud.yandex.com/en/docs/overview/concepts/quotas-limits" class="external autonumber" rel="nofollow">[10]</a></span>
11. <span id="cite_note-llmarena-11">[↑](https://systems-analysis.info/int/YandexGPT_(modelo_de_linguagem)#cite_ref-llmarena_11-0) “llmarena/llmarena — plataforma russa de avaliação de LLMs por crowdsourcing”. *GitHub*. <a href="https://github.com/llmarena/llmarena" class="external autonumber" rel="nofollow">[11]</a></span>
