YandexGPT (language model) (HE)

From Systems analysis Wiki
Jump to navigation Jump to search

YandexGPT (Yet another GPT) — משפחת מודלים לשוניים גדולים (LLM) שפותחה על ידי Yandex והוצגה לראשונה במאי 2023.[1] רשתות YandexGPT משמשות את העוזר המובנה Alice, את חיפוש Yandex ושירותים נוספים, וכן זמינות דרך API ציבורי של פלטפורמת Yandex Cloud.[2]

YaLM‑100B (2022) — מודל מחקרי קודם עם 100 מיליארד פרמטרים בקוד פתוח; שימש כ"הוכחת היתכנות", אך YandexGPT פותחה בנפרד לשימוש מסחרי.[3]

היסטוריית גרסאות

גרסאות עיקריות
תאריך גרסה מאפיינים מרכזיים
יוני 2022 YaLM‑100B 100B פרמטרים, 1.7 TB נתונים; Apache 2.0.[3]
17 מאי 2023 YandexGPT 1.0 שילוב ב-Alice.[1]
7 ספטמבר 2023 YandexGPT 2 שיפור של 67% באיכות לפי בדיקות פנימיות.[4]
28 מרץ 2024 YandexGPT 3 Pro / Lite קו API ארגוני חדש.[5]
24 אוקטובר 2024 YandexGPT 4 Pro / Lite הקשר של 32,000 token; chain‑of‑thought סמוי.[6]
25 פברואר 2025 YandexGPT 5 Pro שוויון עם GPT‑4o ב-64% מהמשימות.[7]
31 מרץ 2025 YandexGPT 5 Lite Instruct מודל של 8 מיליארד פרמטרים בגישה פתוחה; פורמט Llama.[8]

ארכיטקטורה ואימון

  • ארכיטקטורת בסיס: transformer, מותאם לשפה הרוסית.
  • YandexGPT 5 Lite: תואמת Llama; pre‑training ≈ 15 טריליון token, לאחריו fine‑tuning ≈ 320 מיליארד.[8]

הקשר ומגבלות

  • מגבלת הקשר ארכיטקטונית — 32,000 token (גרסאות 4/5).[6]
  • ה-API הציבורי מגביל בקשה אחת (prompt + completion) ל-7,400 token.[9]
  • הגודל המרבי של תגובה — 2,000 token בהתאם לסעיף "Quotas and limits".[10]

מודלים נוכחיים (יוני 2025)

מודל פרמטרים הקשר רישיון הערות
YandexGPT 5 Pro לא ידוע 32,000 קנייני גישה דרך API ו-Alice Pro.[7]
YandexGPT 5 Lite 8 מיליארד 32,000 Yandex GPT‑Lite License פתוח; תואם Llama.[8]
YaLM‑100B 100 מיליארד 2,048 Apache 2.0 הפרויקט המקורי.[3]

Benchmarks

  • בדיקות פנימיות: 5 Pro השיג שוויון עם GPT‑4o ב-64% מהמשימות; עליונות על 4 Pro — 67%.[7]
  • ru‑LLM Arena: YandexGPT מחזיקה במקום הראשון לפי דירוג ELO בקרב מודלים בשפה הרוסית.[11]

Fine‑tuning

עבור 5 Lite נתמכת רשמית שיטת LoRA; דוגמת הפעלה פורסמה ב-model card.[8]

מצבי API

  • סינכרוני — תגובות מהירות (Lite).
  • אסינכרוני — משימות עתירות משאבים (Pro).[2]

מולטימודאליות

משפחת YandexGPT נותרת טקסטואלית; שירותים מולטימודאליים ("Neuro", "YandexArt", "Yandex Vision") מתפתחים בנפרד.[6]

קישורים

  • YandexGPT ב-Yandex Cloud — דף השירות
  • משקלי YandexGPT‑5 Lite ב-Hugging Face
  • מאגר YaLM‑100B ב-GitHub

ספרות

  • Matkin, N. et al. (2024). Comparative Analysis of Encoder-Based NER and Large Language Models for Skill Extraction from Russian Job Vacancies. arXiv:2407.19816.
  • Tsanda, A.; Bruches, E. (2024). Russian-Language Multimodal Dataset for Automatic Summarization of Scientific Papers. arXiv:2405.07886.
  • Goloburda, M. et al. (2025). Qorǵau: Evaluating LLM Safety in Kazakh-Russian Bilingual Contexts. arXiv:2502.13640.
  • Togmanov, M. et al. (2025). KazMMLU: Evaluating Language Models on Kazakh, Russian, and Regional Knowledge of Kazakhstan. arXiv:2502.12829.
  • Noels, S. et al. (2025). What Large Language Models Do Not Talk About: An Empirical Study of Moderation and Censorship Practices. arXiv:2504.03803.

הערות

  1. 1.0 1.1 «“Яндекс” добавил в “Алису” аналог ChatGPT». РБК. [1]
  2. 2.0 2.1 «Getting started with YandexGPT (Quickstart)». Yandex Cloud Docs. [2]
  3. 3.0 3.1 3.2 «yandex/YaLM‑100B: Pretrained language model with 100B». GitHub. [3]
  4. «Как “Яндекс” решил зарабатывать на своём аналоге ChatGPT». РБК. [4]
  5. «“Яндекс” представил третье поколение нейросетей YandexGPT». РБК. [5]
  6. 6.0 6.1 6.2 «Более мощное семейство моделей YandexGPT 4». Habr. [6]
  7. 7.0 7.1 7.2 «“Яндекс” внедрил YandexGPT 5 Pro в чат с “Алисой Про”». AdIndex. [7]
  8. 8.0 8.1 8.2 8.3 «yandex/YandexGPT‑5‑Lite‑8B‑pretrain». Hugging Face. [8]
  9. «ChatYandexGPT API Reference (max_tokens = 7400)». LangChain Docs. [9]
  10. «Yandex Cloud service quotas and limits → Foundation Models». Yandex Cloud Docs. [10]
  11. «llmarena/llmarena — российская краудсорсинговая платформа оценки LLM». GitHub. [11]