Claude (Anthropic) (HE)
Claude — זוהי משפחה של מודלים לשוניים גדולים (LLM) מולטי-מודליים, שפותחה על ידי חברת המחקר Anthropic.
מודלי Claude, הבנויים על ארכיטקטורת transformer, ממוצבים כעוזרי AI המתמקדים בבטיחות, שימושיות ויושרה. תכונה מרכזית בפיתוחם היא השיטה Constitutional AI ("בינה מלאכותית חוקתית"), המכוונת ליצירת מערכות ניתנות לבקרה ומיושרות מבחינה אתית.
היסטוריה ופילוסופיה
ייסוד Anthropic ומשימתה
חברת Anthropic נוסדה בשנת 2021 על ידי עובדים בכירים לשעבר של OpenAI, ובהם האח והאחות דאריו[1] ודנייאלה אמודיי[2]. הסיבה לעזיבה הייתה חילוקי דעות עם הנהלת OpenAI בנוגע לכיוון הפיתוח, ובמיוחד חשש שהשותפות עם Microsoft והסחרור הגובר עלולים לסכן את המחויבות לבטיחות הבינה המלאכותית.
משימת Anthropic היא "פיתוח ותחזוקה של AI מתקדם לטובת האנושות לטווח הארוך". החברה רשומה כ-Public Benefit Corporation (PBC) בארצות הברית, מה שמחייב אותה מבחינה משפטית לאזן בין אינטרסים פיננסיים לבין תועלת ציבורית. גישה זו נתמכת במבנה ממשל ייחודי עם Long-Term Benefit Trust (LTBT), גוף עצמאי שיש לו סמכות להשפיע על הרכב מועצת המנהלים כדי להבטיח מחויבות למשימת הבטיחות.
פילוסופיה: HHH ו-Constitutional AI
בבסיס התנהגות מודלי Claude עומדת הנוסחה HHH: Helpful, Honest, and Harmless (שימושי, ישר ובלתי מזיק). למימוש עקרונות אלה פיתחה Anthropic שיטת אימון ייחודית משלה — Constitutional AI (CAI).
בשונה מ-RLHF המסורתי (למידה מחיזוק על בסיס משוב אנושי), שבו מוערכי-אנוש מדרגים ישירות את תגובות המודל, CAI משתמשת ב"חוקה" — קבוצה של עקרונות אתיים מפורשים, שעל בסיסם המודל לומד להעריך ולתקן את תגובותיו באופן עצמאי. הדבר הופך את התהליך לניתן יותר להרחבה, שקוף וניתן לבקרה.
ארכיטקטורה וטכנולוגיות מרכזיות
בסיס ה-Transformer
כמו LLM מודרניים אחרים, Claude משתמש בארכיטקטורת transformer-decoder, המייצרת טקסט באופן אוטו-רגרסיבי token אחר token. עם זאת, Anthropic הכניסה שיפורים משמעותיים שמטרתם לשפר את הביצועים, הבטיחות והניתנות לבקרה.
Constitutional AI (CAI)
תהליך האימון עם CAI מתבצע בשני שלבים:
- שלב Supervised Learning: המודל מייצר תגובות לבקשות, ואז מודל-מבקר אחר, בהנחיית ה"חוקה", מעריך אותן ומציע תיקונים. על בסיס תיקונים אלה, המודל המקורי עובר fine-tuning.
- שלב RLAIF (Reinforcement Learning from AI Feedback): המודל מייצר זוגות של תגובות, ומודל-המבקר בוחר את הטובה שבהן על בסיס ה"חוקה". נתונים אלה משמשים לאימון מודל ההעדפות (reward model), המשמש לאחר מכן כאות ל-fine-tuning של המודל הראשי באמצעות אלגוריתמי חיזוק.
חלון הקשר ארוך ומולטי-מודליות
אחד היתרונות המרכזיים של Claude הוא חלון הקשר הגדול מאוד. החל מ-100 אלף token ב-Claude 2, הוא הורחב ל-200 אלף ב-Claude 3 ועד 1-2 מיליון token בגרסאות 3.5 ו-4. הדבר מאפשר למודלים לנתח ספרים שלמים, בסיסי קוד או תמלולים של שעות רבות בתוך בקשה אחת.
החל ממשפחת Claude 3, המודלים הפכו מולטי-מודליים, ורכשו את היכולת לעבד תמונות לצד טקסט.
חשיבה היברידית ויכולות אגנטיות
מגרסאות Claude 3.7 ו-4 הוכנסה ארכיטקטורת חשיבה היברידית. היא מאפשרת למודלים לעבור בין שני מצבים:
- תגובות מהירות: מצב סטנדרטי למשימות פשוטות.
- Extended Thinking (חשיבה מורחבת): למשימות מורכבות המודל עוצר כדי "לחשוב", מבצע שלבי הסקה פנימיים, מפעיל כלים (חיפוש ברשת, הרצת קוד) ומגבש תגובה מבוססת יותר. הדבר הופך את התהליך לשקוף ואמין יותר.
התפתחות מודלי Claude
Claude 1 (2023)
- Claude (14 במרץ 2023): הגרסה הראשונה שהוצגה לציבור. בו-זמנית הוכרזו שתי הגדרות — Claude (ראשית) ו-Claude Instant (מהירה וזולה יותר).[3]
- 100K Context Window (11 במאי 2023): הרחבת חלון ההקשר של Claude מ-9,000 ל-100,000 token. זה היה עדכון נפרד לאחר ההשקה הראשונית, ולא חלק מהפצת מרץ.[4]
Claude 2 (2023)
- Claude 2 (11 ביולי 2023): עדכון מרכזי עם שיפורים בקידוד, מתמטיקה והסקה. המודל הפך זמין דרך API וגרסת beta ציבורית של claude.ai. תמך בקלט של עד 100,000 token; בבדיקת Codex HumanEval ציינה Anthropic תוצאה של 71.2%.[5]
- Claude 2.1 (21 בנובמבר 2023): גרסה עם חלון הקשר של 200,000 token, נטייה מופחתת להזיות, תמיכה ב-system prompts ופונקציית beta של tool use.[6]
Claude 3 (2024)
- Claude 3 (4 במרץ 2024): משפחת מודלים חדשה שכללה Haiku (המהירה ביותר), Sonnet (מאוזנת) ו-Opus (החזקה ביותר). Anthropic מיצבה דור זה כרף חדש במספר benchmark קוגניטיביים.[7]
- שינויים מרכזיים: יכולות חזותיות ומולטי-מודליות חזקות (ניתוח תמונות, גרפים ותרשימים), ירידה ניכרת בסירובים בלתי מוצדקים, עלייה בדיוק, וכן 200,000 token של הקשר מהשקה. לגבי לקוחות מסוימים ציינה Anthropic גם אפשרות לעבוד עם קלטים מעל מיליון token.[8]
Claude 3.5 (2024)
- Claude 3.5 Sonnet (21 ביוני 2024): המודל הראשון של משפחה 3.5. לפי הצהרת Anthropic, הוא עלה על Claude 3 Opus במגוון רחב של הערכות, תוך שמירה על מהירות ועלות של דרגת הביניים; החברה ציינה בנפרד גם שיפור מהירות של כפול פי שניים בערך. חלון ההקשר עמד על 200,000 token.[9]
- Claude 3.5 Sonnet המעודכן ו-Claude 3.5 Haiku (22 באוקטובר 2024): עדכון אוקטובר חיזק את היכולות בקידוד אגנטי ושימוש בכלים. אז גם הוציאה Anthropic לראשונה לפונקציית Computer Use ל-public beta, המאפשרת למודל לעבוד עם ממשק המחשב: לראות את המסך, להזיז את הסמן, ללחוץ על כפתורים ולהזין טקסט. בגרסת 3.5 Sonnet המעודכנת עלה הציון ב-SWE-bench Verified מ-33.4% ל-49.0%.[10]
Claude 3.7 ו-Claude 4 (2025)
- Claude 3.7 Sonnet (24 בפברואר 2025): Anthropic הציגה אותו כ-hybrid reasoning model הראשון. המודל יכול היה לענות כמעט מיידית, או להשתמש במצב של הסקה צעד-אחר-צעד ממושכת יותר. בו-זמנית הוצג Claude Code.[11]
- Claude 4 (22 במאי 2025): משפחת דגל חדשה שכללה Opus 4 ו-Sonnet 4. שני המודלים תוארו כהיברידיים: עם מצבי תגובות מהירות ו-extended thinking. Anthropic הדגישה במיוחד extended thinking with tool use, parallel tool execution ושיפורי זיכרון; Opus 4 הוכרז כמוביל ב-SWE-bench עם תוצאה של 72.5%.[12]
Claude 4.5–4.6 (סוף 2025 — תחילת 2026)
- Claude Sonnet 4.5 (29 בספטמבר 2025): עדכון מהותי לקו Sonnet עם עלייה ניכרת באיכות בקידוד, computer use, הסקה ומתמטיקה. Anthropic ציינה גם שהמודל שומר על ריכוז במשימות מרובות-שלבים מורכבות במשך יותר מ-30 שעות.[13]
- Claude Opus 4.5 (24 בנובמבר 2025): האיטרציה הבאה של Opus, שאותה תיארה Anthropic כחזקה במיוחד בקידוד, בתרחישים אגנטיים וב-computer use.[14]
- Claude Opus 4.6 (5 בפברואר 2026): מודל Opus מעודכן עם שיפורים בקידוד, code review, debugging ומשימות אגנטיות ממושכות. לראשונה לקו Opus הוכרז 1M token context window במצב beta.[15]
- Claude Sonnet 4.6 (17 בפברואר 2026): הגרסה החזקה ביותר של Sonnet באותה עת; Anthropic ציינה שיפורים בקידוד, computer use, long-context reasoning, agent planning, knowledge work ועיצוב. כמו Opus 4.6, גם מודל זה קיבל 1M token context window ב-beta.[16]
טבלת סיכום דורות Claude
| דור | שנת הוצאה | גרסאות מרכזיות | חלון הקשר מקסימלי | חידושים מרכזיים |
|---|---|---|---|---|
| Claude 1 | 2023 | Claude, Instant | 100,000 token | הפצה ציבורית ראשונה, הקשר גדול. |
| Claude 2 | 2023 | Claude 2, 2.1 | 200,000 token | קידוד והסקה משופרים, זמינות ציבורית. |
| Claude 3 | 2024 | Opus, Sonnet, Haiku | 200,000+ token | מולטי-מודליות (תמונות), עדיפות על GPT-4. |
| Claude 3.5 | 2024 | Sonnet, Haiku | 200,000+ token | שיפור מהירות ואינטליגנציה, פונקציית "Artifacts". |
| Claude 4 / 3.7 | 2025 | Opus, Sonnet | 200,000+ token | חשיבה היברידית, יכולות אגנטיות, שימוש בכלים. |
שימוש וזמינות
מודלי Claude זמינים דרך מספר ערוצים:
- ממשק הווב claude.ai: מספק גישה חינמית (למודל Sonnet) ומנויים בתשלום (Pro, Max) עם גישה למודלים חזקים יותר (Opus) ומגבלות מורחבות.
- API למפתחים: Anthropic מספקת API מסחרי המאפשר שילוב של Claude ביישומים צד-שלישי. המחירים משתנים בהתאם למודל (Haiku — הזול ביותר, Opus — היקר ביותר).
- פלטפורמות ענן: Claude זמין דרך Amazon Bedrock ו-Google Cloud Vertex AI, מה שמפשט את השימוש בו בסביבה ארגונית.
- אינטגרציות: Claude משולב בשירותים פופולריים כגון Slack, Notion ו-Quora (בצ'אט-בוט Poe).
ספרות
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, מרץ). Introducing the next generation of Claude.
- Anthropic (2025, מאי). Introducing Claude 4.
קישורים
- האתר הרשמי של Anthropic
- תיעוד למפתחים
ספרות
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).
הערות
- ↑ «Dario Amodei». В Wikipedia [1]
- ↑ «Daniela Amodei». В Wikipedia [2]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.