Claude (Anthropic) (HI)

From Systems analysis Wiki
Jump to navigation Jump to search

Claude — यह Anthropic अनुसंधान कंपनी द्वारा विकसित मल्टीमोडल Large Language Models (LLM) का एक परिवार है।

ट्रांसफॉर्मर आर्किटेक्चर पर निर्मित Claude मॉडल्स को सुरक्षा, उपयोगिता और ईमानदारी पर केंद्रित AI असिस्टेंट के रूप में प्रस्तुत किया जाता है। इनके विकास की प्रमुख विशेषता Constitutional AI («संवैधानिक AI») पद्धति है, जो नियंत्रणीय और नैतिक रूप से संरेखित प्रणालियाँ बनाने पर केंद्रित है।

इतिहास और दर्शन

Anthropic की स्थापना और मिशन

Anthropicकंपनी की स्थापना 2021 में OpenAI के पूर्व वरिष्ठ कर्मचारियों द्वारा की गई थी, जिनमें भाई-बहन Dario[1] और Daniela Amodei[2] शामिल हैं। इस्तीफे का कारण OpenAI के नेतृत्व के साथ विकास की दिशा को लेकर मतभेद थे — विशेष रूप से यह चिंता कि Microsoft के साथ साझेदारी और बढ़ती व्यावसायिकता AI सुरक्षा के प्रति प्रतिबद्धता को खतरे में डाल सकती है।

Anthropicका मिशन है — «मानवता के दीर्घकालिक लाभ के लिए अग्रणी AI का विकास और रखरखाव।» कंपनी अमेरिका में Public Benefit Corporation (PBC) के रूप में पंजीकृत है, जो उसे कानूनी रूप से वित्तीय हितों और सार्वजनिक लाभ के बीच संतुलन बनाने के लिए बाध्य करती है। इस दृष्टिकोण को Long-Term Benefit Trust (LTBT) की अनूठी प्रशासन संरचना द्वारा समर्थित किया गया है — यह एक स्वतंत्र निकाय है जो सुरक्षा मिशन के प्रति प्रतिबद्धता सुनिश्चित करने के लिए निदेशक मंडल की संरचना को प्रभावित करने का अधिकार रखता है।

दर्शन: HHH और Constitutional AI

Claude मॉडल्स के व्यवहार के मूल में HHH सूत्र है: Helpful, Honest, and Harmless (उपयोगी, ईमानदार और हानिरहित)। इन सिद्धांतों को लागू करने के लिए Anthropic ने अपनी प्रशिक्षण पद्धति — Constitutional AI (CAI) विकसित की।

परंपरागत RLHF (मानव फीडबैक से Reinforcement Learning) के विपरीत, जहाँ मानव एनोटेटर सीधे मॉडल के उत्तरों का मूल्यांकन करते हैं, CAI एक «संविधान» का उपयोग करती है — स्पष्ट नैतिक सिद्धांतों का एक समूह, जिसके आधार पर मॉडल स्वयं अपने उत्तरों का मूल्यांकन और सुधार करना सीखता है। इससे यह प्रक्रिया अधिक स्केलेबल, पारदर्शी और नियंत्रणीय बनती है।

आर्किटेक्चर और प्रमुख तकनीकें

ट्रांसफॉर्मर आधार

अन्य आधुनिक LLM की तरह, Claude ट्रांसफॉर्मर-डिकोडर आर्किटेक्चर का उपयोग करता है, जो ऑटोरिग्रेसिव रूप से टोकन-दर-टोकन टेक्स्ट उत्पन्न करता है। हालाँकि, Anthropic ने प्रदर्शन, सुरक्षा और नियंत्रणीयता बढ़ाने के उद्देश्य से महत्वपूर्ण सुधार किए हैं।

Constitutional AI (CAI)

CAI के साथ प्रशिक्षण प्रक्रिया दो चरणों में होती है:

  1. Supervised Learning चरण: मॉडल अनुरोधों पर उत्तर उत्पन्न करता है, फिर एक अन्य क्रिटिक मॉडल «संविधान» के आधार पर उनका मूल्यांकन करता है और सुधार सुझाता है। इन सुधारों के आधार पर मूल मॉडल को fine-tune किया जाता है।
  2. AI से Reinforcement Learning (RLAIF) चरण: मॉडल उत्तरों के जोड़े उत्पन्न करता है, और क्रिटिक मॉडल «संविधान» के आधार पर सर्वश्रेष्ठ उत्तर चुनता है। इस डेटा का उपयोग reward model (प्राथमिकता मॉडल) को प्रशिक्षित करने के लिए किया जाता है, जो फिर Reinforcement Learning एल्गोरिदम के माध्यम से मुख्य मॉडल के fine-tuning के लिए संकेत का काम करता है।

लंबा context और मल्टीमोडलता

Claude की प्रमुख विशेषताओं में से एक बहुत बड़ा context window है। Claude 2 में 1 लाख टोकन से शुरू होकर, यह Claude 3 में 2 लाख और संस्करण 3.5 व 4 में 10-20 लाख टोकन तक बढ़ाया गया। इससे मॉडल एकल अनुरोध के भीतर पूरी किताबें, कोडबेस या घंटों के ट्रांसक्रिप्ट का विश्लेषण कर सकते हैं।

Claude 3 परिवार से शुरू होकर, मॉडल मल्टीमोडल बन गए — उन्हें टेक्स्ट के साथ-साथ छवियाँ प्रोसेस करने की क्षमता मिली।

हाइब्रिड तर्क और एजेंट क्षमताएँ

Claude 3.7 और 4 संस्करण से हाइब्रिड तर्क आर्किटेक्चर लागू किया गया। यह मॉडल को दो मोड के बीच स्विच करने देता है:

  • त्वरित उत्तर: सरल कार्यों के लिए मानक मोड।
  • विस्तारित तर्क (Extended Thinking): जटिल कार्यों के लिए मॉडल रुककर «सोचता» है — आंतरिक तर्क के चरण निष्पादित करता है, टूल्स (वेब-सर्च, कोड निष्पादन) का उपयोग करता है और अधिक सुविचारित उत्तर तैयार करता है। इससे प्रक्रिया अधिक पारदर्शी और विश्वसनीय बनती है।

Claude मॉडल्स का विकास क्रम

Claude 1 (2023)

  • Claude (14 मार्च 2023): मॉडल का पहला सार्वजनिक संस्करण। एक साथ दो कॉन्फ़िगरेशन घोषित किए गए — Claude (मुख्य) और Claude Instant (तेज़ और सस्ता)।[3]
  • 100K Context Window (11 मई 2023): Claude के context window को 9,000 से बढ़ाकर 1,00,000 टोकन किया गया। यह मार्च रिलीज़ का हिस्सा न होकर एक अलग अपडेट था।[4]

Claude 2 (2023)

  • Claude 2 (11 जुलाई 2023): कोडिंग, गणित और तर्क में सुधार के साथ एक बड़ा अपडेट। मॉडल API और सार्वजनिक beta claude.ai के माध्यम से उपलब्ध हुआ। 1,00,000 टोकन तक इनपुट समर्थित; Codex HumanEval परीक्षण में Anthropic ने 71.2% परिणाम दर्शाया।[5]
  • Claude 2.1 (21 नवंबर 2023): 2,00,000 टोकन context window वाला संस्करण, जिसमें hallucination की प्रवृत्ति कम, system prompts का समर्थन और बीटा फीचर tool use शामिल था।[6]

Claude 3 (2024)

  • Claude 3 (4 मार्च 2024): नए मॉडल परिवार में Haiku (सबसे तेज़), Sonnet (संतुलित) और Opus (सबसे शक्तिशाली) शामिल थे। Anthropic ने इस पीढ़ी को कई संज्ञानात्मक benchmark पर नए मानक के रूप में प्रस्तुत किया।[7]
  • प्रमुख बदलाव: मजबूत दृश्य और मल्टीमोडल क्षमताएँ (छवियों, ग्राफ और आरेखों का विश्लेषण), अनावश्यक अस्वीकृतियों में उल्लेखनीय कमी, सटीकता में वृद्धि, और शुरुआत से 2,00,000 टोकन context। कुछ विशेष क्लाइंट्स के लिए Anthropic ने 10 लाख से अधिक टोकन के इनपुट की क्षमता भी बताई।[8]

Claude 3.5 (2024)

  • Claude 3.5 Sonnet (21 जून 2024): 3.5 परिवार का पहला मॉडल। Anthropic के अनुसार, यह मध्यम श्रेणी की गति और लागत बनाए रखते हुए मूल्यांकन के व्यापक सेट पर Claude 3 Opus से बेहतर था; कंपनी ने लगभग दोगुनी गति का भी विशेष उल्लेख किया। Context window 2,00,000 टोकन था।[9]
  • अपडेटेड Claude 3.5 Sonnet और Claude 3.5 Haiku (22 अक्टूबर 2024): अक्टूबर अपडेट ने एजेंट कोडिंग और टूल उपयोग क्षमताओं को मजबूत किया। उसी समय Anthropic ने पहली बार Computer Use फीचर को public beta में लाया, जो मॉडल को कंप्यूटर इंटरफेस के साथ काम करने देता है — स्क्रीन देखना, कर्सर हिलाना, बटन दबाना और टेक्स्ट दर्ज करना। अपडेटेड 3.5 Sonnet का SWE-bench Verified पर परिणाम 33.4% से बढ़कर 49.0% हो गया।[10]

Claude 3.7 और Claude 4 (2025)

  • Claude 3.7 Sonnet (24 फरवरी 2025): Anthropic ने इसे पहले hybrid reasoning model के रूप में प्रस्तुत किया। मॉडल या तो लगभग तत्काल उत्तर दे सकता था या लंबे, चरणबद्ध तर्क मोड का उपयोग कर सकता था। साथ ही Claude Code भी प्रस्तुत किया गया।[11]
  • Claude 4 (22 मई 2025): नए फ्लैगशिप परिवार में Opus 4 और Sonnet 4 शामिल थे। दोनों मॉडल को हाइब्रिड बताया गया — त्वरित उत्तर और extended thinking दोनों मोड के साथ। Anthropic ने विशेष रूप से extended thinking with tool use, parallel tool execution और स्मृति सुधारों पर जोर दिया; Opus 4 को SWE-bench पर 72.5% परिणाम के साथ अग्रणी घोषित किया गया।[12]

Claude 4.5–4.6 (2025 के अंत — 2026 की शुरुआत)

  • Claude Sonnet 4.5 (29 सितंबर 2025): Sonnet लाइन का महत्वपूर्ण अपडेट जिसमें कोडिंग, computer use, तर्क और गणित में गुणवत्ता में उल्लेखनीय वृद्धि हुई। Anthropic ने यह भी उल्लेख किया कि मॉडल 30 घंटों से अधिक समय तक जटिल बहु-चरणीय कार्यों पर ध्यान केंद्रित रख सकता है।[13]
  • Claude Opus 4.5 (24 नवंबर 2025): Opus की अगली पुनरावृत्ति, जिसे Anthropic ने कोडिंग, एजेंट परिदृश्यों और computer use में विशेष रूप से सशक्त बताया।[14]
  • Claude Opus 4.6 (5 फरवरी 2026): कोडिंग, code review, debugging और दीर्घकालिक एजेंट कार्यों में सुधार के साथ अपडेटेड Opus मॉडल। Opus लाइन के लिए पहली बार beta मोड में 1M token context window की घोषणा की गई।[15]
  • Claude Sonnet 4.6 (17 फरवरी 2026): उस समय Sonnet का सबसे शक्तिशाली संस्करण; Anthropic ने कोडिंग, computer use, long-context reasoning, agent planning, knowledge work और design में सुधार बताए। Opus 4.6 की तरह, इस मॉडल को भी beta में 1M token context window मिला।[16]

Claude पीढ़ियों की सारांश तालिका

Claude मॉडल्स की प्रमुख विशेषताओं का विकास
पीढ़ी रिलीज़ वर्ष प्रमुख संस्करण अधिकतम context window प्रमुख नवाचार
Claude 1 2023 Claude, Instant 1,00,000 टोकन पहला सार्वजनिक रिलीज़, बड़ा context।
Claude 2 2023 Claude 2, 2.1 2,00,000 टोकन बेहतर कोडिंग और तर्क, सार्वजनिक उपलब्धता।
Claude 3 2024 Opus, Sonnet, Haiku 2,00,000+ टोकन मल्टीमोडलता (छवियाँ), GPT-4 से श्रेष्ठता।
Claude 3.5 2024 Sonnet, Haiku 2,00,000+ टोकन गति और बुद्धिमत्ता में वृद्धि, "Artifacts" फीचर।
Claude 4 / 3.7 2025 Opus, Sonnet 2,00,000+ टोकन हाइब्रिड तर्क, एजेंट क्षमताएँ, टूल उपयोग।

उपयोग और उपलब्धता

Claude मॉडल कई माध्यमों से उपलब्ध हैं:

  • वेब इंटरफेस claude.ai: निःशुल्क पहुँच (Sonnet मॉडल तक) और सशुल्क सदस्यता (Pro, Max) प्रदान करता है जिसमें अधिक शक्तिशाली मॉडल (Opus) और विस्तारित सीमाएँ मिलती हैं।
  • डेवलपर्स के लिए API: Anthropic एक व्यावसायिक API प्रदान करता है जो Claude को तृतीय-पक्ष अनुप्रयोगों में एकीकृत करने की अनुमति देता है। कीमतें मॉडल के अनुसार भिन्न होती हैं (Haiku — सबसे सस्ता, Opus — सबसे महंगा)।
  • क्लाउड प्लेटफॉर्म: Claude Amazon Bedrock और Google Cloud Vertex AI के माध्यम से उपलब्ध है, जो कॉर्पोरेट परिवेश में इसके उपयोग को सरल बनाता है।
  • एकीकरण: Claude को Slack, Notion, Quora (Poe चैटबॉट में) जैसी लोकप्रिय सेवाओं में एकीकृत किया गया है।

साहित्य

  • Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Anthropic (2023). Claude's Constitution.
  • Anthropic (2024, मार्च). Introducing the next generation of Claude.
  • Anthropic (2025, मई). Introducing Claude 4.

संदर्भ

  • Anthropic की आधिकारिक वेबसाइट
  • डेवलपर्स के लिए दस्तावेज़ीकरण

साहित्य

  • Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
  • Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
  • Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
  • Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
  • Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
  • Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
  • Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
  • Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
  • Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
  • Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [३] (tech-report, open review).

टिप्पणियाँ

  1. «Dario Amodei». В Wikipedia [१]
  2. «Daniela Amodei». В Wikipedia [२]
  3. Introducing Claude. Anthropic. 14 марта 2023.
  4. Introducing 100K Context Windows. Anthropic. 11 мая 2023.
  5. Introducing Claude 2. Anthropic. 11 июля 2023.
  6. Introducing Claude 2.1. Anthropic. 21 ноября 2023.
  7. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  8. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  9. Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
  10. New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
  11. Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
  12. Introducing Claude 4. Anthropic. 22 мая 2025.
  13. Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
  14. Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
  15. Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
  16. Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.