YandexGPT (language model) (HI)
YandexGPT (Yet another GPT) — बड़े भाषा मॉडलों का एक परिवार, जिसे Яндекс (Yandex) द्वारा विकसित किया गया और मई 2023 में पहली बार प्रस्तुत किया गया।[1] YandexGPT के नेटवर्क का उपयोग अंतर्निहित सहायक Алиса (Alice), खोज (Search) और अन्य सेवाओं में किया जाता है, तथा ये Yandex Cloud प्लेटफ़ॉर्म के सार्वजनिक API के माध्यम से भी उपलब्ध हैं।[2]
YaLM‑100B (2022) — 100 अरब parameters वाला एक पूर्ववर्ती शोध मॉडल जो खुले स्रोत कोड के साथ था; इसने "अवधारणा के प्रमाण" की भूमिका निभाई, लेकिन YandexGPT को व्यावसायिक उपयोग के लिए अलग से बनाया गया था।[3]
रिलीज़ का इतिहास
| तारीख | रिलीज़ | प्रमुख विशेषताएँ |
|---|---|---|
| जून 2022 | YaLM‑100B | 100 B parameters, 1.7 TB डेटा; Apache 2.0।[3] |
| 17 मई 2023 | YandexGPT 1.0 | «Алиса» में एकीकरण।[1] |
| 7 सितम्बर 2023 | YandexGPT 2 | आंतरिक परीक्षणों के अनुसार गुणवत्ता में +67%।[4] |
| 28 मार्च 2024 | YandexGPT 3 Pro / Lite | नई कॉर्पोरेट API श्रृंखला।[5] |
| 24 अक्टूबर 2024 | YandexGPT 4 Pro / Lite | 32,000 tokens का context; गुप्त तर्क (chain‑of‑thought)।[6] |
| 25 फ़रवरी 2025 | YandexGPT 5 Pro | 64% कार्यों में GPT‑4o के साथ समानता।[7] |
| 31 मार्च 2025 | YandexGPT 5 Lite Instruct | 8 अरब parameters वाला मॉडल खुली पहुँच में; Llama प्रारूप।[8] |
आर्किटेक्चर और प्रशिक्षण
- मूल आर्किटेक्चर: transformer, रूसी भाषा के लिए अनुकूलित।
- YandexGPT 5 Lite: Llama-संगत; pre‑training ≈ 15 ट्रिलियन tokens, तत्पश्चात fine‑tuning ≈ 320 अरब।[8]
Context और सीमाएँ
- आर्किटेक्चरल context सीमा — 32,000 tokens (संस्करण 4/5)।[6]
- सार्वजनिक API एक अनुरोध (prompt + completion) को 7,400 tokens तक सीमित करता है।[9]
- उत्तर का अधिकतम आकार — «Quotas and limits» अनुभाग के अनुसार 2,000 tokens।[10]
वर्तमान मॉडल (जून 2025)
| मॉडल | Parameters | Context | लाइसेंस | टिप्पणियाँ |
|---|---|---|---|---|
| YandexGPT 5 Pro | अज्ञात | 32,000 | API और «Алиса Про» के माध्यम से पहुँच।[7] | |
| YandexGPT 5 Lite | 8 अरब | 32,000 | Yandex GPT‑Lite License | खुला; Llama-संगत।[8] |
| YaLM‑100B | 100 अरब | 2,048 | Apache 2.0 | मूल परियोजना।[3] |
Benchmarks
- आंतरिक परीक्षण: 5 Pro ने 64% कार्यों में GPT‑4o के साथ समानता प्राप्त की; 4 Pro से 67% अधिक।[7]
- ru‑LLM Arena: YandexGPT रूसी भाषा के मॉडलों में ELO रेटिंग में अग्रणी स्थान पर बना हुआ है।[11]
Fine‑tuning
5 Lite के लिए आधिकारिक रूप से LoRA विधि समर्थित है; चलाने का उदाहरण model card में प्रकाशित किया गया है।[8]
API मोड
- तुल्यकालिक (Synchronous) — त्वरित उत्तर (Lite)।
- अतुल्यकालिक (Asynchronous) — संसाधन-गहन कार्य (Pro)।[2]
मल्टीमॉडलिटी
YandexGPT परिवार केवल पाठ-आधारित बना हुआ है; मल्टीमॉडल सेवाएँ («Neuro», «YandexArt», «Yandex Vision») अलग रूप से विकसित की जा रही हैं।[6]
संदर्भ
- Yandex Cloud में YandexGPT — सेवा पृष्ठ
- Hugging Face पर YandexGPT‑5 Lite के weights
- GitHub पर YaLM‑100B का भंडार
साहित्य
- Matkin, N. et al. (2024). Comparative Analysis of Encoder-Based NER and Large Language Models for Skill Extraction from Russian Job Vacancies. arXiv:2407.19816.
- Tsanda, A.; Bruches, E. (2024). Russian-Language Multimodal Dataset for Automatic Summarization of Scientific Papers. arXiv:2405.07886.
- Goloburda, M. et al. (2025). Qorǵau: Evaluating LLM Safety in Kazakh-Russian Bilingual Contexts. arXiv:2502.13640.
- Togmanov, M. et al. (2025). KazMMLU: Evaluating Language Models on Kazakh, Russian, and Regional Knowledge of Kazakhstan. arXiv:2502.12829.
- Noels, S. et al. (2025). What Large Language Models Do Not Talk About: An Empirical Study of Moderation and Censorship Practices. arXiv:2504.03803.
टिप्पणियाँ
- ↑ 1.0 1.1 «“Яндекс” добавил в “Алису” аналог ChatGPT». РБК. [१]
- ↑ 2.0 2.1 «Getting started with YandexGPT (Quickstart)». Yandex Cloud Docs. [२]
- ↑ 3.0 3.1 3.2 «yandex/YaLM‑100B: Pretrained language model with 100B». GitHub. [३]
- ↑ «Как “Яндекс” решил зарабатывать на своём аналоге ChatGPT». РБК. [४]
- ↑ «“Яндекс” представил третье поколение нейросетей YandexGPT». РБК. [५]
- ↑ 6.0 6.1 6.2 «Более мощное семейство моделей YandexGPT 4». Habr. [६]
- ↑ 7.0 7.1 7.2 «“Яндекс” внедрил YandexGPT 5 Pro в чат с “Алисой Про”». AdIndex. [७]
- ↑ 8.0 8.1 8.2 8.3 «yandex/YandexGPT‑5‑Lite‑8B‑pretrain». Hugging Face. [८]
- ↑ «ChatYandexGPT API Reference (max_tokens = 7400)». LangChain Docs. [९]
- ↑ «Yandex Cloud service quotas and limits → Foundation Models». Yandex Cloud Docs. [१०]
- ↑ «llmarena/llmarena — российская краудсорсинговая платформа оценки LLM». GitHub. [११]