YandexGPT (language model) (HE)
Jump to navigation
Jump to search
YandexGPT (Yet another GPT) — משפחת מודלים לשוניים גדולים (LLM) שפותחה על ידי Yandex והוצגה לראשונה במאי 2023.[1] רשתות YandexGPT משמשות את העוזר המובנה Alice, את חיפוש Yandex ושירותים נוספים, וכן זמינות דרך API ציבורי של פלטפורמת Yandex Cloud.[2]
YaLM‑100B (2022) — מודל מחקרי קודם עם 100 מיליארד פרמטרים בקוד פתוח; שימש כ"הוכחת היתכנות", אך YandexGPT פותחה בנפרד לשימוש מסחרי.[3]
היסטוריית גרסאות
| תאריך | גרסה | מאפיינים מרכזיים |
|---|---|---|
| יוני 2022 | YaLM‑100B | 100B פרמטרים, 1.7 TB נתונים; Apache 2.0.[3] |
| 17 מאי 2023 | YandexGPT 1.0 | שילוב ב-Alice.[1] |
| 7 ספטמבר 2023 | YandexGPT 2 | שיפור של 67% באיכות לפי בדיקות פנימיות.[4] |
| 28 מרץ 2024 | YandexGPT 3 Pro / Lite | קו API ארגוני חדש.[5] |
| 24 אוקטובר 2024 | YandexGPT 4 Pro / Lite | הקשר של 32,000 token; chain‑of‑thought סמוי.[6] |
| 25 פברואר 2025 | YandexGPT 5 Pro | שוויון עם GPT‑4o ב-64% מהמשימות.[7] |
| 31 מרץ 2025 | YandexGPT 5 Lite Instruct | מודל של 8 מיליארד פרמטרים בגישה פתוחה; פורמט Llama.[8] |
ארכיטקטורה ואימון
- ארכיטקטורת בסיס: transformer, מותאם לשפה הרוסית.
- YandexGPT 5 Lite: תואמת Llama; pre‑training ≈ 15 טריליון token, לאחריו fine‑tuning ≈ 320 מיליארד.[8]
הקשר ומגבלות
- מגבלת הקשר ארכיטקטונית — 32,000 token (גרסאות 4/5).[6]
- ה-API הציבורי מגביל בקשה אחת (prompt + completion) ל-7,400 token.[9]
- הגודל המרבי של תגובה — 2,000 token בהתאם לסעיף "Quotas and limits".[10]
מודלים נוכחיים (יוני 2025)
| מודל | פרמטרים | הקשר | רישיון | הערות |
|---|---|---|---|---|
| YandexGPT 5 Pro | לא ידוע | 32,000 | קנייני | גישה דרך API ו-Alice Pro.[7] |
| YandexGPT 5 Lite | 8 מיליארד | 32,000 | Yandex GPT‑Lite License | פתוח; תואם Llama.[8] |
| YaLM‑100B | 100 מיליארד | 2,048 | Apache 2.0 | הפרויקט המקורי.[3] |
Benchmarks
- בדיקות פנימיות: 5 Pro השיג שוויון עם GPT‑4o ב-64% מהמשימות; עליונות על 4 Pro — 67%.[7]
- ru‑LLM Arena: YandexGPT מחזיקה במקום הראשון לפי דירוג ELO בקרב מודלים בשפה הרוסית.[11]
Fine‑tuning
עבור 5 Lite נתמכת רשמית שיטת LoRA; דוגמת הפעלה פורסמה ב-model card.[8]
מצבי API
- סינכרוני — תגובות מהירות (Lite).
- אסינכרוני — משימות עתירות משאבים (Pro).[2]
מולטימודאליות
משפחת YandexGPT נותרת טקסטואלית; שירותים מולטימודאליים ("Neuro", "YandexArt", "Yandex Vision") מתפתחים בנפרד.[6]
קישורים
- YandexGPT ב-Yandex Cloud — דף השירות
- משקלי YandexGPT‑5 Lite ב-Hugging Face
- מאגר YaLM‑100B ב-GitHub
ספרות
- Matkin, N. et al. (2024). Comparative Analysis of Encoder-Based NER and Large Language Models for Skill Extraction from Russian Job Vacancies. arXiv:2407.19816.
- Tsanda, A.; Bruches, E. (2024). Russian-Language Multimodal Dataset for Automatic Summarization of Scientific Papers. arXiv:2405.07886.
- Goloburda, M. et al. (2025). Qorǵau: Evaluating LLM Safety in Kazakh-Russian Bilingual Contexts. arXiv:2502.13640.
- Togmanov, M. et al. (2025). KazMMLU: Evaluating Language Models on Kazakh, Russian, and Regional Knowledge of Kazakhstan. arXiv:2502.12829.
- Noels, S. et al. (2025). What Large Language Models Do Not Talk About: An Empirical Study of Moderation and Censorship Practices. arXiv:2504.03803.
הערות
- ↑ 1.0 1.1 «“Яндекс” добавил в “Алису” аналог ChatGPT». РБК. [1]
- ↑ 2.0 2.1 «Getting started with YandexGPT (Quickstart)». Yandex Cloud Docs. [2]
- ↑ 3.0 3.1 3.2 «yandex/YaLM‑100B: Pretrained language model with 100B». GitHub. [3]
- ↑ «Как “Яндекс” решил зарабатывать на своём аналоге ChatGPT». РБК. [4]
- ↑ «“Яндекс” представил третье поколение нейросетей YandexGPT». РБК. [5]
- ↑ 6.0 6.1 6.2 «Более мощное семейство моделей YandexGPT 4». Habr. [6]
- ↑ 7.0 7.1 7.2 «“Яндекс” внедрил YandexGPT 5 Pro в чат с “Алисой Про”». AdIndex. [7]
- ↑ 8.0 8.1 8.2 8.3 «yandex/YandexGPT‑5‑Lite‑8B‑pretrain». Hugging Face. [8]
- ↑ «ChatYandexGPT API Reference (max_tokens = 7400)». LangChain Docs. [9]
- ↑ «Yandex Cloud service quotas and limits → Foundation Models». Yandex Cloud Docs. [10]
- ↑ «llmarena/llmarena — российская краудсорсинговая платформа оценки LLM». GitHub. [11]