Claude (Anthropic) (UR)
Claude — یہ Anthropic نامی تحقیقی کمپنی کی تیار کردہ ملٹی موڈل بڑے زبان کے ماڈلز (LLM) کا ایک خاندان ہے۔
Transformer فن تعمیر پر تعمیر کردہ Claude ماڈلز کو حفاظت، افادیت اور ایمانداری پر مرکوز AI اسسٹنٹس کے طور پر پیش کیا جاتا ہے۔ ان کی ترقی کی کلیدی خصوصیت Constitutional AI («آئینی AI») کا طریقہ کار ہے، جو قابلِ انتظام اور اخلاقی طور پر ہم آہنگ نظام بنانے کی طرف مرکوز ہے۔
تاریخ اور فلسفہ
Anthropic کی بنیاد اور مشن
Anthropicکمپنی 2021 میں OpenAI کے سابق سینئر ملازمین نے قائم کی، جن میں بھائی اور بہن داریو[1] اور ڈانیئلا امودئی[2] شامل تھے۔ علیحدگی کی وجہ OpenAI کی قیادت کے ساتھ ترقی کی سمت کے بارے میں اختلافات تھے، خاص طور پر یہ خدشات کہ Microsoft کے ساتھ شراکت اور بڑھتی ہوئی تجارتی کاری AI حفاظت سے وابستگی کو خطرے میں ڈال سکتی ہے۔
Anthropicکا مشن «انسانیت کے طویل مدتی فائدے کے لیے جدید ترین AI کی ترقی اور مدد» ہے۔ کمپنی امریکہ میں Public Benefit Corporation (PBC) کے طور پر رجسٹرڈ ہے، جو اسے قانونی طور پر مالی مفادات کو عوامی بھلائی کے ساتھ متوازن کرنے کا پابند کرتی ہے۔ اس نقطہ نظر کو Long-Term Benefit Trust (LTBT) کے ساتھ ایک منفرد گورننس ڈھانچے سے تقویت ملتی ہے، جو ایک آزاد ادارہ ہے جو حفاظت کے مشن سے وابستگی کو یقینی بنانے کے لیے بورڈ آف ڈائریکٹرز کی ترکیب پر اثر انداز ہونے کا اختیار رکھتا ہے۔
فلسفہ: HHH اور Constitutional AI
Claude ماڈلز کے رویے کی بنیاد HHH فارمولا ہے: Helpful, Honest, and Harmless (مفید، ایماندار اور بے ضرر)۔ ان اصولوں کو نافذ کرنے کے لیے Anthropic نے اپنا تربیتی طریقہ کار — Constitutional AI (CAI) — تیار کیا۔
روایتی RLHF (انسانی آراء پر مبنی Reinforcement Learning) کے برعکس، جہاں انسانی تشریح کار براہ راست ماڈل کے جوابات کا جائزہ لیتے ہیں، CAI ایک «آئین» — واضح اخلاقی اصولوں کا مجموعہ — استعمال کرتا ہے، جس کی بنیاد پر ماڈل اپنے جوابات کا خود جائزہ لینا اور انہیں درست کرنا سیکھتا ہے۔ یہ اس عمل کو زیادہ قابلِ توسیع، شفاف اور قابلِ کنٹرول بناتا ہے۔
فن تعمیر اور کلیدی ٹیکنالوجیز
Transformer کی بنیاد
دیگر جدید LLMs کی طرح، Claude بھی Transformer-decoder فن تعمیر استعمال کرتا ہے، جو autoregressive طریقے سے token بہ token متن تیار کرتا ہے۔ تاہم، Anthropic نے کارکردگی، حفاظت اور قابلِ انتظامی میں بہتری کے لیے اہم اضافہ جات کیے ہیں۔
Constitutional AI (CAI)
CAI کے ساتھ تربیت کا عمل دو مراحل میں ہوتا ہے:
- Supervised Learning کا مرحلہ: ماڈل درخواستوں پر جوابات تیار کرتا ہے، پھر ایک دوسرا ناقد ماڈل «آئین» کی رہنمائی میں انہیں جانچتا اور تصحیح تجویز کرتا ہے۔ انہی تصحیحات کی بنیاد پر اصل ماڈل کو fine-tune کیا جاتا ہے۔
- RLAIF (AI فیڈ بیک سے Reinforcement Learning) کا مرحلہ: ماڈل جوابوں کے جوڑے تیار کرتا ہے، اور ناقد ماڈل «آئین» کی بنیاد پر بہترین کا انتخاب کرتا ہے۔ یہ ڈیٹا ترجیحی ماڈل (reward model) کی تربیت کے لیے استعمال ہوتا ہے، جو پھر Reinforcement Learning الگورتھمز کے ذریعے بنیادی ماڈل کی fine-tuning کے لیے سگنل کا کام کرتا ہے۔
طویل Context اور Multimodality
Claude کی ایک اہم خصوصیت بہت بڑی Context Window ہے۔ Claude 2 میں 100 ہزار tokens سے شروع ہو کر یہ Claude 3 میں 200 ہزار اور ورژن 3.5 اور 4 میں 1 تا 2 ملین tokens تک بڑھائی گئی۔ اس سے ماڈلز ایک ہی درخواست میں مکمل کتابیں، code bases یا کئی گھنٹوں کی transcripts تجزیہ کر سکتے ہیں۔
Claude 3 خاندان سے ماڈلز ملٹی موڈل ہو گئے، یعنی متن کے ساتھ ساتھ تصاویر کو بھی پروسیس کرنے کی صلاحیت حاصل ہوئی۔
ہائبرڈ سوچ اور Agentic صلاحیتیں
Claude 3.7 اور 4 ورژن سے ہائبرڈ سوچ فن تعمیر متعارف کرائی گئی۔ یہ ماڈلز کو دو طریقوں کے درمیان سوئچ کرنے کی اجازت دیتی ہے:
- فوری جوابات: سادہ کاموں کے لیے معیاری طریقہ۔
- Extended Thinking (توسیع یافتہ سوچ): پیچیدہ کاموں کے لیے ماڈل رک کر «سوچتا» ہے، اندرونی استدلالی مراحل انجام دیتا ہے، ٹولز (ویب سرچ، کوڈ چلانا) استعمال کرتا ہے اور زیادہ مدلل جواب تشکیل دیتا ہے۔ یہ عمل کو زیادہ شفاف اور قابلِ اعتماد بناتا ہے۔
Claude ماڈلز کا ارتقاء
Claude 1 (2023)
- Claude (14 مارچ 2023): ماڈل کا پہلا عوامی طور پر پیش کردہ ورژن۔ بیک وقت دو ترتیبات کا اعلان کیا گیا — Claude (بنیادی) اور Claude Instant (زیادہ تیز اور سستا)۔[3]
- 100K Context Window (11 مئی 2023): Claude کی Context Window کو 9,000 سے بڑھا کر 100,000 tokens کیا گیا۔ یہ ابتدائی اجراء کے بعد ایک الگ اپ ڈیٹ تھا، نہ کہ مارچ کے ریلیز کا حصہ۔[4]
Claude 2 (2023)
- Claude 2 (11 جولائی 2023): Coding، ریاضی اور استدلال میں بہتری کے ساتھ ایک بڑی اپ ڈیٹ۔ ماڈل API اور claude.ai کے عوامی beta ورژن کے ذریعے دستیاب ہو گئی۔ 100,000 tokens تک کا ان پٹ سپورٹ کرتی تھی؛ Codex HumanEval ٹیسٹ میں Anthropic نے 71.2% کا نتیجہ درج کیا۔[5]
- Claude 2.1 (21 نومبر 2023): 200,000 tokens کی Context Window، hallucinations کا کم رجحان، system prompts کی سپورٹ اور tool use کی beta فیچر کے ساتھ ورژن۔[6]
Claude 3 (2024)
- Claude 3 (4 مارچ 2024): ماڈلز کا نیا خاندان، جس میں Haiku (تیز ترین)، Sonnet (متوازن) اور Opus (طاقتور ترین) شامل تھے۔ Anthropic نے اس نسل کو متعدد علمی benchmarks پر ایک نئی حد کے طور پر پیش کیا۔[7]
- کلیدی تبدیلیاں: مضبوط بصری اور ملٹی موڈل صلاحیتیں (تصاویر، گراف اور ڈایاگرامز کا تجزیہ)، بلا جواز انکار میں نمایاں کمی، درستگی میں اضافہ، نیز آغاز میں 200,000 tokens کا Context۔ انفرادی صارفین کے لیے Anthropic نے 1 ملین tokens سے زائد ان پٹ کے ساتھ کام کرنے کی صلاحیت بھی بتائی۔[8]
Claude 3.5 (2024)
- Claude 3.5 Sonnet (21 جون 2024): خاندان 3.5 کا پہلا ماڈل۔ Anthropic کے مطابق، اس نے درمیانے درجے کی رفتار اور لاگت کو برقرار رکھتے ہوئے جائزوں کے وسیع مجموعے پر Claude 3 Opus کو پیچھے چھوڑ دیا؛ کمپنی نے تقریباً دوگنی رفتار بھی خصوصی طور پر بیان کی۔ Context Window 200,000 tokens تھی۔[9]
- اپ ڈیٹ شدہ Claude 3.5 Sonnet اور Claude 3.5 Haiku (22 اکتوبر 2024): اکتوبر اپ ڈیٹ نے Agentic Coding اور ٹولز کے استعمال کی صلاحیتیں مضبوط کیں۔ اسی وقت Anthropic نے Computer Use فیچر کو پہلی بار public beta میں پیش کیا، جو ماڈل کو کمپیوٹر انٹرفیس کے ساتھ کام کرنے دیتا ہے: اسکرین دیکھنا، کرسر حرکت دینا، بٹن دبانا اور متن ٹائپ کرنا۔ اپ ڈیٹ شدہ 3.5 Sonnet کا SWE-bench Verified پر نتیجہ 33.4% سے بڑھ کر 49.0% ہو گیا۔[10]
Claude 3.7 اور Claude 4 (2025)
- Claude 3.7 Sonnet (24 فروری 2025): Anthropic نے اسے پہلا hybrid reasoning model قرار دیا۔ ماڈل یا تو تقریباً فوری جواب دے سکتا تھا، یا طویل، مرحلہ وار استدلال کا طریقہ استعمال کر سکتا تھا۔ ساتھ ہی Claude Code بھی پیش کیا گیا۔[11]
- Claude 4 (22 مئی 2025): نیا flagship خاندان، جس میں Opus 4 اور Sonnet 4 شامل تھے۔ دونوں ماڈلز کو ہائبرڈ قرار دیا گیا: فوری جوابات اور extended thinking کے طریقوں کے ساتھ۔ Anthropic نے خاص طور پر extended thinking with tool use، parallel tool execution اور میموری کی بہتری پر زور دیا؛ Opus 4 کو SWE-bench پر 72.5% نتیجے کے ساتھ رہنما قرار دیا گیا۔[12]
Claude 4.5–4.6 (2025 کے اواخر — 2026 کا آغاز)
- Claude Sonnet 4.5 (29 ستمبر 2025): Sonnet لائن کی اہم اپ ڈیٹ جس میں Coding، Computer Use، استدلال اور ریاضی میں نمایاں بہتری آئی۔ Anthropic نے یہ بھی بتایا کہ ماڈل پیچیدہ کثیر مرحلہ کاموں پر 30 گھنٹوں سے زائد توجہ برقرار رکھتا ہے۔[13]
- Claude Opus 4.5 (24 نومبر 2025): Opus کی اگلی تکرار، جسے Anthropic نے Coding، Agentic منظرناموں اور Computer Use میں خاص طور پر مضبوط قرار دیا۔[14]
- Claude Opus 4.6 (5 فروری 2026): Coding، Code Review، Debugging اور طویل Agentic کاموں میں بہتری کے ساتھ اپ ڈیٹ شدہ Opus ماڈل۔ Opus لائن کے لیے پہلی بار beta طریقہ میں 1M token context window کا اعلان کیا گیا۔[15]
- Claude Sonnet 4.6 (17 فروری 2026): اس وقت Sonnet کا طاقتور ترین ورژن؛ Anthropic نے Coding، Computer Use، Long-Context Reasoning، Agent Planning، Knowledge Work اور Design میں بہتری بیان کی۔ Opus 4.6 کی طرح اس ماڈل کو بھی beta میں 1M token context window ملی۔[16]
Claude نسلوں کا خلاصہ جدول
| نسل | اجراء کا سال | کلیدی ورژن | زیادہ سے زیادہ Context Window | کلیدی اختراعات |
|---|---|---|---|---|
| Claude 1 | 2023 | Claude, Instant | 100,000 tokens | پہلا عوامی ریلیز، بڑا Context۔ |
| Claude 2 | 2023 | Claude 2, 2.1 | 200,000 tokens | بہتر Coding اور استدلال، عوامی دستیابی۔ |
| Claude 3 | 2024 | Opus, Sonnet, Haiku | 200,000+ tokens | Multimodality (تصاویر)، GPT-4 پر برتری۔ |
| Claude 3.5 | 2024 | Sonnet, Haiku | 200,000+ tokens | رفتار اور ذہانت میں اضافہ، "Artifacts" فیچر۔ |
| Claude 4 / 3.7 | 2025 | Opus, Sonnet | 200,000+ tokens | ہائبرڈ سوچ، Agentic صلاحیتیں، ٹولز کا استعمال۔ |
استعمال اور دستیابی
Claude ماڈلز کئی ذرائع سے دستیاب ہیں:
- ویب انٹرفیس claude.ai: مفت رسائی (Sonnet ماڈل تک) اور بامعاوضہ سبسکرپشنز (Pro, Max) فراہم کرتا ہے جن میں طاقتور تر ماڈلز (Opus) اور توسیع یافتہ حدود شامل ہیں۔
- ڈویلپرز کے لیے API: Anthropic ایک تجارتی API فراہم کرتا ہے جو Claude کو تھرڈ پارٹی ایپلیکیشنز میں ضم کرنے کی اجازت دیتا ہے۔ قیمتیں ماڈل کے لحاظ سے مختلف ہوتی ہیں (Haiku — سب سے سستا، Opus — سب سے مہنگا)۔
- کلاؤڈ پلیٹ فارمز: Claude Amazon Bedrock اور Google Cloud Vertex AI کے ذریعے دستیاب ہے، جو کارپوریٹ ماحول میں اس کے استعمال کو آسان بناتا ہے۔
- انضمام: Claude مشہور سروسز جیسے Slack، Notion، Quora (Poe چیٹ بوٹ میں) کے ساتھ ضم کیا گیا ہے۔
ادبیات
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, مارچ). Introducing the next generation of Claude.
- Anthropic (2025, مئی). Introducing Claude 4.
حوالہ جات
- Anthropic کی سرکاری ویب سائٹ
- ڈویلپرز کی دستاویزات
ادبیات
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).
نوٹس
- ↑ «Dario Amodei». В Wikipedia [1]
- ↑ «Daniela Amodei». В Wikipedia [2]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.