Claude (Anthropic) (BN)
Claude — এটি Anthropic গবেষণা কোম্পানি কর্তৃক তৈরি মাল্টিমোডাল বৃহৎ ভাষা মডেলের (LLM) একটি পরিবার।
ট্রান্সফর্মার আর্কিটেকচারের উপর নির্মিত Claude মডেলগুলো নিরাপত্তা, উপযোগিতা এবং সততার উপর দৃষ্টি নিবদ্ধ AI-সহায়ক হিসেবে অবস্থান করা হয়েছে। এদের তৈরির মূল বৈশিষ্ট্য হলো Constitutional AI («সাংবিধানিক AI») পদ্ধতি, যা নিয়ন্ত্রণযোগ্য এবং নৈতিকভাবে সামঞ্জস্যপূর্ণ সিস্টেম তৈরির লক্ষ্যে পরিচালিত।
ইতিহাস ও দর্শন
Anthropic-এর প্রতিষ্ঠা ও লক্ষ্য
Anthropicকোম্পানিটি ২০২১ সালে OpenAI-এর প্রাক্তন ঊর্ধ্বতন কর্মীদের দ্বারা প্রতিষ্ঠিত হয়েছিল, যার মধ্যে ছিলেন ভাই-বোন দারিও[1] এবং দানিয়েলা আমোদেই[2]। চলে যাওয়ার কারণ ছিল OpenAI-এর নেতৃত্বের সাথে উন্নয়নের দিকনির্দেশনা নিয়ে মতবিরোধ, বিশেষত এই আশঙ্কা যে Microsoft-এর সাথে অংশীদারিত্ব এবং ক্রমবর্ধমান বাণিজ্যিকীকরণ AI নিরাপত্তার প্রতি অঙ্গীকারকে বিপন্ন করতে পারে।
Anthropic-এর লক্ষ্য হলো «মানবজাতির দীর্ঘমেয়াদী সুবিধার জন্য অগ্রণী AI তৈরি ও সমর্থন করা»। কোম্পানিটি যুক্তরাষ্ট্রে Public Benefit Corporation (PBC) হিসেবে নিবন্ধিত, যা আইনগতভাবে এটিকে আর্থিক স্বার্থ এবং সামাজিক কল্যাণের মধ্যে ভারসাম্য রাখতে বাধ্য করে। এই পদ্ধতি একটি অনন্য শাসন কাঠামো দ্বারা সমর্থিত — Long-Term Benefit Trust (LTBT), একটি স্বাধীন সংস্থা যা নিরাপত্তা মিশনের প্রতি অঙ্গীকার নিশ্চিত করতে পরিচালনা পর্ষদের গঠনকে প্রভাবিত করার অধিকার রাখে।
দর্শন: HHH এবং Constitutional AI
Claude মডেলগুলোর আচরণের ভিত্তিতে রয়েছে HHH সূত্র: Helpful, Honest, and Harmless (উপকারী, সৎ এবং নিরীহ)। এই নীতিগুলো বাস্তবায়নের জন্য Anthropic নিজস্ব প্রশিক্ষণ পদ্ধতি তৈরি করেছে — Constitutional AI (CAI)।
প্রচলিত RLHF (মানব প্রতিক্রিয়া থেকে শক্তিবর্ধক শিক্ষা)-এর বিপরীতে, যেখানে মানব-টীকাকারীরা সরাসরি মডেলের উত্তর মূল্যায়ন করেন, CAI একটি «সংবিধান» ব্যবহার করে — স্পষ্ট নৈতিক নীতিমালার একটি সেট, যার ভিত্তিতে মডেল স্বাধীনভাবে নিজের উত্তর মূল্যায়ন এবং সংশোধন করতে প্রশিক্ষিত হয়। এটি প্রক্রিয়াটিকে আরও মাপযোগ্য, স্বচ্ছ এবং নিয়ন্ত্রণযোগ্য করে তোলে।
আর্কিটেকচার ও মূল প্রযুক্তি
ট্রান্সফর্মারের উপর ভিত্তি
অন্যান্য আধুনিক LLM-এর মতো, Claude একটি ট্রান্সফর্মার-ডিকোডার আর্কিটেকচার ব্যবহার করে, যা অটোরিগ্রেসিভলি টোকেন-দর-টোকেন পাঠ্য তৈরি করে। তবে Anthropic কর্মক্ষমতা, নিরাপত্তা এবং নিয়ন্ত্রণযোগ্যতা বাড়ানোর লক্ষ্যে উল্লেখযোগ্য উন্নতি করেছে।
Constitutional AI (CAI)
CAI-এর সাথে প্রশিক্ষণ প্রক্রিয়া দুটি ধাপে পরিচালিত হয়:
- Supervised Learning পর্যায়: মডেলটি অনুরোধের উত্তর তৈরি করে, এবং তারপর একটি সমালোচক মডেল «সংবিধান» দ্বারা পরিচালিত হয়ে সেগুলো মূল্যায়ন করে এবং সংশোধন প্রস্তাব দেয়। এই সংশোধনগুলোর উপর ভিত্তি করে মূল মডেলটি fine-tuning করা হয়।
- RLAIF (Reinforcement Learning from AI Feedback) পর্যায়: মডেলটি উত্তরের জোড়া তৈরি করে, এবং সমালোচক মডেলটি «সংবিধান»-এর ভিত্তিতে সেরাটি বেছে নেয়। এই ডেটা একটি reward model প্রশিক্ষণে ব্যবহৃত হয়, যা পরে শক্তিবর্ধক অ্যালগরিদম ব্যবহার করে মূল মডেলের fine-tuning-এর জন্য সংকেত হিসেবে কাজ করে।
দীর্ঘ Context এবং মাল্টিমোডালিটি
Claude-এর অন্যতম প্রধান সুবিধা হলো অত্যন্ত বড় context window। Claude 2-এ ১ লক্ষ token থেকে শুরু করে Claude 3-এ ২ লক্ষ এবং সংস্করণ 3.5 ও 4-এ ১০ লক্ষ থেকে ২০ লক্ষ token পর্যন্ত বাড়ানো হয়েছে। এটি মডেলগুলোকে একটি একক অনুরোধের মধ্যে সম্পূর্ণ বই, কোড বেস বা ঘণ্টার পর ঘণ্টার ট্রান্সক্রিপ্ট বিশ্লেষণ করতে সক্ষম করে।
Claude 3 পরিবার থেকে, মডেলগুলো মাল্টিমোডাল হয়ে উঠেছে, পাঠ্যের পাশাপাশি ছবি প্রক্রিয়া করার ক্ষমতা পেয়েছে।
হাইব্রিড চিন্তাভাবনা ও এজেন্টিক সক্ষমতা
Claude 3.7 এবং 4 সংস্করণ থেকে হাইব্রিড চিন্তাভাবনা আর্কিটেকচার চালু করা হয়েছে। এটি মডেলগুলোকে দুটি মোডের মধ্যে পরিবর্তন করতে সক্ষম করে:
- দ্রুত উত্তর: সহজ কাজের জন্য স্ট্যান্ডার্ড মোড।
- Extended Thinking (বিস্তৃত চিন্তাভাবনা): জটিল কাজের জন্য মডেলটি «চিন্তা করতে» বিরতি দেয়, অভ্যন্তরীণ যুক্তিপ্রক্রিয়ার ধাপ সম্পাদন করে, সরঞ্জাম (ওয়েব অনুসন্ধান, কোড কার্যকর করা) ব্যবহার করে এবং আরও সুচিন্তিত উত্তর তৈরি করে। এটি প্রক্রিয়াটিকে আরও স্বচ্ছ ও নির্ভরযোগ্য করে তোলে।
Claude মডেলের বিবর্তন
Claude 1 (২০২৩)
- Claude (১৪ মার্চ ২০২৩): মডেলের প্রথম প্রকাশ্যে উপস্থাপিত সংস্করণ। একই সাথে দুটি কনফিগারেশন ঘোষণা করা হয়েছিল — Claude (মূল) এবং Claude Instant (দ্রুততর এবং সস্তা)।[3]
- 100K Context Window (১১ মে ২০২৩): Claude-এর context window ৯,০০০ থেকে ১,০০,০০০ token-এ সম্প্রসারণ। এটি মার্চের রিলিজের অংশ নয়, বরং প্রাথমিক লঞ্চের পরে একটি পৃথক আপডেট ছিল।[4]
Claude 2 (২০২৩)
- Claude 2 (১১ জুলাই ২০২৩): কোডিং, গণিত এবং যুক্তিপ্রক্রিয়ায় উন্নতি সহ একটি বড় আপডেট। মডেলটি API এবং পাবলিক beta সংস্করণ claude.ai-এর মাধ্যমে পাওয়া যায়। সর্বাধিক ১,০০,০০০ token ইনপুট সমর্থন করত; Codex HumanEval পরীক্ষায় Anthropic ৭১.২% ফলাফল উল্লেখ করেছিল।[5]
- Claude 2.1 (২১ নভেম্বর ২০২৩): ২,০০,০০০ token context window সহ একটি সংস্করণ, হ্যালুসিনেশনের প্রবণতা হ্রাস, system prompts সমর্থন এবং tool use বেটা ফিচার সহ।[6]
Claude 3 (২০২৪)
- Claude 3 (৪ মার্চ ২০২৪): একটি নতুন মডেল পরিবার, যার মধ্যে ছিল Haiku (সবচেয়ে দ্রুত), Sonnet (সুষম) এবং Opus (সবচেয়ে শক্তিশালী)। Anthropic এই প্রজন্মকে বেশ কিছু জ্ঞানীয় benchmark-এ একটি নতুন মাইলফলক হিসেবে অবস্থান করেছিল।[7]
- মূল পরিবর্তন: শক্তিশালী ভিজ্যুয়াল ও মাল্টিমোডাল সক্ষমতা (ছবি, গ্রাফ ও চার্ট বিশ্লেষণ), অযৌক্তিক প্রত্যাখ্যানের উল্লেখযোগ্য হ্রাস, নির্ভুলতার বৃদ্ধি, এবং শুরু থেকেই ২,০০,০০০ token context। নির্বাচিত গ্রাহকদের জন্য Anthropic ১০ লক্ষ token-এরও বেশি ইনপুট পরিচালনার সম্ভাবনাও উল্লেখ করেছিল।[8]
Claude 3.5 (২০২৪)
- Claude 3.5 Sonnet (২১ জুন ২০২৪): 3.5 পরিবারের প্রথম মডেল। Anthropic-এর দাবি অনুযায়ী, এটি মধ্যম শ্রেণির গতি ও খরচ বজায় রেখে মূল্যায়নের একটি বিস্তৃত সেটে Claude 3 Opus-কে ছাড়িয়ে গেছে; কোম্পানি আলাদাভাবে প্রায় দ্বিগুণ গতি বৃদ্ধিও উল্লেখ করেছিল। Context window ছিল ২,০০,০০০ token।[9]
- আপডেটেড Claude 3.5 Sonnet এবং Claude 3.5 Haiku (২২ অক্টোবর ২০২৪): অক্টোবরের আপডেট এজেন্টিক কোডিং এবং সরঞ্জাম ব্যবহারের সক্ষমতা বৃদ্ধি করেছে। তখনই Anthropic প্রথমবারের মতো Computer Use ফিচারটি public beta-তে চালু করে, যা মডেলটিকে কম্পিউটার ইন্টারফেসের সাথে কাজ করতে সক্ষম করে: স্ক্রিন দেখা, কার্সর সরানো, বোতাম ক্লিক করা এবং পাঠ্য ইনপুট করা। আপডেটেড 3.5 Sonnet-এর SWE-bench Verified-এ ফলাফল ৩৩.৪% থেকে বেড়ে ৪৯.০% হয়েছে।[10]
Claude 3.7 এবং Claude 4 (২০২৫)
- Claude 3.7 Sonnet (২৪ ফেব্রুয়ারি ২০২৫): Anthropic এটিকে প্রথম hybrid reasoning model হিসেবে উপস্থাপন করেছিল। মডেলটি হয় প্রায় তাৎক্ষণিকভাবে উত্তর দিতে পারত, অথবা আরও দীর্ঘ, ধাপে ধাপে যুক্তিপ্রক্রিয়ার মোড ব্যবহার করতে পারত। একই সাথে Claude Code উপস্থাপন করা হয়েছিল।[11]
- Claude 4 (২২ মে ২০২৫): নতুন ফ্ল্যাগশিপ পরিবার, যার মধ্যে ছিল Opus 4 এবং Sonnet 4। উভয় মডেলকেই হাইব্রিড হিসেবে বর্ণনা করা হয়েছিল: দ্রুত উত্তরের মোড এবং extended thinking সহ। Anthropic বিশেষভাবে extended thinking with tool use, parallel tool execution এবং মেমরির উন্নতি তুলে ধরেছিল; Opus 4 কে SWE-bench-এ ৭২.৫% ফলাফল সহ নেতৃস্থানীয় বলে দাবি করা হয়েছিল।[12]
Claude 4.5–4.6 (২০২৫-এর শেষ — ২০২৬-এর শুরু)
- Claude Sonnet 4.5 (২৯ সেপ্টেম্বর ২০২৫): Sonnet লাইনের একটি উল্লেখযোগ্য আপডেট, কোডিং, computer use, যুক্তিপ্রক্রিয়া এবং গণিতে গুণমানে লক্ষণীয় বৃদ্ধি সহ। Anthropic এটাও উল্লেখ করেছিল যে মডেলটি ৩০ ঘণ্টার বেশি সময় ধরে জটিল বহু-ধাপের কাজে মনোযোগ ধরে রাখতে পারে।[13]
- Claude Opus 4.5 (২৪ নভেম্বর ২০২৫): Opus-এর পরবর্তী পুনরাবৃত্তি, যাকে Anthropic কোডিং, এজেন্টিক পরিস্থিতি এবং computer use-এ বিশেষভাবে শক্তিশালী বলে বর্ণনা করেছিল।[14]
- Claude Opus 4.6 (৫ ফেব্রুয়ারি ২০২৬): কোডিং, code review, debugging এবং দীর্ঘমেয়াদী এজেন্টিক কাজে উন্নতি সহ একটি আপডেটেড Opus মডেল। Opus লাইনের জন্য প্রথমবারের মতো বেটা মোডে 1M token context window ঘোষণা করা হয়েছিল।[15]
- Claude Sonnet 4.6 (১৭ ফেব্রুয়ারি ২০২৬): সেই সময়ের Sonnet-এর সবচেয়ে শক্তিশালী সংস্করণ; Anthropic কোডিং, computer use, long-context reasoning, agent planning, knowledge work এবং design-এ উন্নতির কথা উল্লেখ করেছিল। Opus 4.6-এর মতো, মডেলটিও beta-তে 1M token context window পেয়েছে।[16]
Claude প্রজন্মের সারসংক্ষেপ সারণি
| প্রজন্ম | প্রকাশের বছর | মূল সংস্করণ | সর্বোচ্চ Context Window | মূল উদ্ভাবন |
|---|---|---|---|---|
| Claude 1 | ২০২৩ | Claude, Instant | ১,০০,০০০ token | প্রথম পাবলিক রিলিজ, বড় context। |
| Claude 2 | ২০২৩ | Claude 2, 2.1 | ২,০০,০০০ token | উন্নত কোডিং ও যুক্তিপ্রক্রিয়া, সাধারণ প্রাপ্যতা। |
| Claude 3 | ২০২৪ | Opus, Sonnet, Haiku | ২,০০,০০০+ token | মাল্টিমোডালিটি (ছবি), GPT-4-এর উপর শ্রেষ্ঠত্ব। |
| Claude 3.5 | ২০২৪ | Sonnet, Haiku | ২,০০,০০০+ token | গতি ও বুদ্ধিমত্তার উন্নতি, "Artifacts" ফিচার। |
| Claude 4 / 3.7 | ২০২৫ | Opus, Sonnet | ২,০০,০০০+ token | হাইব্রিড চিন্তাভাবনা, এজেন্টিক সক্ষমতা, সরঞ্জাম ব্যবহার। |
প্রয়োগ ও প্রাপ্যতা
Claude মডেলগুলো বেশ কয়েকটি চ্যানেলের মাধ্যমে পাওয়া যায়:
- ওয়েব ইন্টারফেস claude.ai: বিনামূল্যে অ্যাক্সেস (Sonnet মডেলে) এবং আরও শক্তিশালী মডেলে (Opus) অ্যাক্সেস ও বর্ধিত সীমাসহ পেইড সাবস্ক্রিপশন (Pro, Max) প্রদান করে।
- ডেভেলপারদের জন্য API: Anthropic একটি বাণিজ্যিক API প্রদান করে যা তৃতীয় পক্ষের অ্যাপ্লিকেশনে Claude একীভূত করতে সক্ষম করে। মূল্য মডেলের উপর নির্ভর করে পরিবর্তিত হয় (Haiku — সবচেয়ে সস্তা, Opus — সবচেয়ে ব্যয়বহুল)।
- ক্লাউড প্ল্যাটফর্ম: Claude Amazon Bedrock এবং Google Cloud Vertex AI-এর মাধ্যমে পাওয়া যায়, যা কর্পোরেট পরিবেশে এর ব্যবহার সহজ করে।
- ইন্টিগ্রেশন: Claude Slack, Notion, Quora (Poe চ্যাটবটে)-এর মতো জনপ্রিয় সেবায় একীভূত করা হয়েছে।
সাহিত্য
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, মার্চ). Introducing the next generation of Claude.
- Anthropic (2025, মে). Introducing Claude 4.
তথ্যসূত্র
- Anthropic-এর অফিসিয়াল ওয়েবসাইট
- ডেভেলপারদের ডকুমেন্টেশন
সাহিত্য
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [৩] (tech-report, open review).
টীকা
- ↑ «Dario Amodei». В Wikipedia [১]
- ↑ «Daniela Amodei». В Wikipedia [২]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.