Claude (Anthropic) (FA)
Claude — خانوادهای از مدلهای زبانی بزرگ (LLM) چندوجهی است که توسط شرکت پژوهشی Anthropic توسعه یافته است.
مدلهای Claude که بر پایه معماری transformer ساخته شدهاند، به عنوان دستیارهای هوش مصنوعی با محوریت ایمنی، سودمندی و صداقت معرفی میشوند. ویژگی کلیدی توسعه آنها روش Constitutional AI («هوش مصنوعی قانوناساسی») است که هدف آن ایجاد سیستمهای قابل کنترل و از نظر اخلاقی همسو است.
تاریخچه و فلسفه
تأسیس و مأموریت Anthropic
شرکت Anthropic در سال ۲۰۲۱ توسط تعدادی از کارمندان ارشد سابق OpenAI، از جمله برادر و خواهر داریو[1] و دانیلا آمودئی[2] تأسیس شد. دلیل جدایی آنها اختلاف نظر با مدیریت OpenAI درباره مسیر توسعه بود؛ بهویژه نگرانی از اینکه مشارکت با Microsoft و تجاریسازی فزاینده ممکن است تعهد به ایمنی هوش مصنوعی را به خطر اندازد.
مأموریت Anthropic «توسعه و حمایت از هوش مصنوعی پیشرفته برای منفعت بلندمدت بشریت» است. این شرکت به عنوان یک Public Benefit Corporation (PBC) در ایالات متحده ثبت شده است که از نظر قانونی ملزم به ایجاد توازن میان منافع مالی و منافع عمومی است. این رویکرد با ساختار حاکمیتی منحصربهفردی شامل Long-Term Benefit Trust (LTBT) — نهادی مستقل که حق تأثیرگذاری بر ترکیب هیئت مدیره برای تضمین پایبندی به مأموریت ایمنی را دارد — تقویت شده است.
فلسفه: HHH و Constitutional AI
اساس رفتار مدلهای Claude فرمول HHH است: Helpful, Honest, and Harmless (سودمند، صادق و بیضرر). برای اجرای این اصول، Anthropic روش آموزشی خاص خود را به نام Constitutional AI (CAI) توسعه داده است.
برخلاف RLHF سنتی (یادگیری تقویتی بر اساس بازخورد انسانی) که در آن حاشیهنویسان انسانی مستقیماً پاسخهای مدل را ارزیابی میکنند، CAI از یک «قانون اساسی» — مجموعهای از اصول اخلاقی صریح — استفاده میکند که بر اساس آن مدل یاد میگیرد پاسخهای خود را بهطور مستقل ارزیابی و اصلاح کند. این فرآیند را مقیاسپذیرتر، شفافتر و قابل کنترلتر میسازد.
معماری و فناوریهای کلیدی
پایه transformer
مانند سایر LLMهای مدرن، Claude از معماری transformer-decoder استفاده میکند که متن را به صورت خودبازگشتی توکن به توکن تولید میکند. با این حال، Anthropic بهبودهای قابل توجهی را با هدف افزایش کارایی، ایمنی و قابلیت کنترل اعمال کرده است.
Constitutional AI (CAI)
فرآیند آموزش با CAI در دو مرحله انجام میشود:
- مرحله یادگیری با ناظر (Supervised Learning): مدل پاسخهایی برای درخواستها تولید میکند، سپس یک مدل منتقد بر اساس «قانون اساسی» آنها را ارزیابی کرده و اصلاحاتی پیشنهاد میدهد. مدل اصلی بر اساس این اصلاحات fine-tune میشود.
- مرحله یادگیری تقویتی از هوش مصنوعی (RLAIF): مدل جفت پاسخهایی تولید میکند و مدل منتقد بهترین آنها را بر اساس «قانون اساسی» انتخاب میکند. این دادهها برای آموزش مدل ترجیح (reward model) استفاده میشوند که سپس به عنوان سیگنال برای fine-tuning مدل اصلی با الگوریتمهای تقویتی به کار میرود.
پنجره زمینه بلند و چندوجهی بودن
یکی از مزایای اصلی Claude پنجره زمینه بسیار بزرگ آن است. از ۱۰۰ هزار توکن در Claude 2 آغاز شد، به ۲۰۰ هزار در Claude 3 افزایش یافت و در نسخههای ۳.۵ و ۴ به ۱ تا ۲ میلیون توکن رسید. این ویژگی به مدلها اجازه میدهد کتابهای کامل، پایگاههای کد یا رونوشتهای چندساعته را در یک درخواست تجزیهوتحلیل کنند.
از خانواده Claude 3 به بعد، مدلها چندوجهی شدند و توانایی پردازش تصاویر در کنار متن را به دست آوردند.
تفکر ترکیبی و قابلیتهای عاملی
از نسخههای Claude 3.7 و 4، معماری تفکر ترکیبی معرفی شد. این معماری به مدلها اجازه میدهد بین دو حالت جابجا شوند:
- پاسخهای سریع: حالت استاندارد برای وظایف ساده.
- تفکر گسترده (Extended Thinking): برای وظایف پیچیده، مدل مکث میکند تا «فکر کند»، گامهای استدلال داخلی را انجام دهد، ابزارها را فراخوانی کند (جستجوی وب، اجرای کد) و پاسخ مستدلتری تشکیل دهد. این فرآیند را شفافتر و قابل اطمینانتر میکند.
تکامل مدلهای Claude
Claude 1 (2023)
- Claude (۱۴ مارس ۲۰۲۳): اولین نسخه عمومی مدل. به طور همزمان دو پیکربندی اعلام شد — Claude (اصلی) و Claude Instant (سریعتر و ارزانتر).[3]
- 100K Context Window (۱۱ مه ۲۰۲۳): گسترش پنجره زمینه Claude از ۹٬۰۰۰ به ۱۰۰٬۰۰۰ توکن. این یک بهروزرسانی جداگانه پس از راهاندازی اولیه بود و بخشی از انتشار ماه مارس نبود.[4]
Claude 2 (2023)
- Claude 2 (۱۱ ژوئیه ۲۰۲۳): بهروزرسانی اساسی با بهبودهایی در کدنویسی، ریاضیات و استدلال. مدل از طریق API و نسخه beta عمومی claude.ai در دسترس قرار گرفت. از ورودی تا ۱۰۰٬۰۰۰ توکن پشتیبانی میکرد؛ در آزمون Codex HumanEval، Anthropic نتیجه ۷۱.۲٪ را اعلام کرد.[5]
- Claude 2.1 (۲۱ نوامبر ۲۰۲۳): نسخهای با پنجره زمینه ۲۰۰٬۰۰۰ توکن، کاهش تمایل به توهمپردازی، پشتیبانی از system prompts و قابلیت beta برای tool use.[6]
Claude 3 (2024)
- Claude 3 (۴ مارس ۲۰۲۴): خانواده جدیدی از مدلها شامل Haiku (سریعترین)، Sonnet (متعادل) و Opus (قدرتمندترین). Anthropic این نسل را به عنوان مرز جدیدی در چندین benchmark شناختی معرفی کرد.[7]
- تغییرات کلیدی: قابلیتهای بصری و چندوجهی قوی (تحلیل تصاویر، نمودارها و دیاگرامها)، کاهش قابل توجه در رد درخواستهای بیدلیل، افزایش دقت، و ۲۰۰٬۰۰۰ توکن زمینه از ابتدا. Anthropic همچنین برای برخی مشتریان امکان کار با ورودیهای بیش از ۱ میلیون توکن را اعلام کرد.[8]
Claude 3.5 (2024)
- Claude 3.5 Sonnet (۲۱ ژوئن ۲۰۲۴): اولین مدل خانواده ۳.۵. Anthropic اعلام کرد که این مدل بر روی مجموعه گستردهای از ارزیابیها از Claude 3 Opus پیشی گرفته و در عین حال سرعت و هزینه رده میانی را حفظ کرده است؛ شرکت همچنین بهطور جداگانه به افزایش سرعت تقریباً دو برابری اشاره کرد. پنجره زمینه ۲۰۰٬۰۰۰ توکن بود.[9]
- Claude 3.5 Sonnet بهروزرسانیشده و Claude 3.5 Haiku (۲۲ اکتبر ۲۰۲۴): بهروزرسانی اکتبر قابلیتها را در کدنویسی عاملی و استفاده از ابزار تقویت کرد. در همان زمان Anthropic برای اولین بار قابلیت Computer Use را در beta عمومی معرفی کرد که به مدل امکان میدهد با رابط کامپیوتر کار کند: صفحه را ببیند، مکاننما را حرکت دهد، دکمهها را فشار دهد و متن وارد کند. نتیجه Sonnet 3.5 بهروزرسانیشده بر روی SWE-bench Verified از ۳۳.۴٪ به ۴۹.۰٪ افزایش یافت.[10]
Claude 3.7 و Claude 4 (2025)
- Claude 3.7 Sonnet (۲۴ فوریه ۲۰۲۵): Anthropic آن را به عنوان اولین hybrid reasoning model معرفی کرد. مدل میتوانست یا تقریباً فوری پاسخ دهد یا از حالت استدلال طولانیتر و گامبهگام استفاده کند. به طور همزمان Claude Code نیز معرفی شد.[11]
- Claude 4 (۲۲ مه ۲۰۲۵): خانواده پرچمدار جدید شامل Opus 4 و Sonnet 4. هر دو مدل به عنوان ترکیبی توصیف شدند: با حالتهای پاسخ سریع و extended thinking. Anthropic بهویژه بر extended thinking with tool use، parallel tool execution و بهبودهای حافظه تأکید کرد؛ Opus 4 با نتیجه ۷۲.۵٪ به عنوان پیشرو در SWE-bench معرفی شد.[12]
Claude 4.5–4.6 (اواخر ۲۰۲۵ — اوایل ۲۰۲۶)
- Claude Sonnet 4.5 (۲۹ سپتامبر ۲۰۲۵): بهروزرسانی قابل توجه خط Sonnet با رشد چشمگیر کیفیت در کدنویسی، computer use، استدلال و ریاضیات. Anthropic همچنین اشاره کرد که مدل تمرکز خود را در وظایف پیچیده چندمرحلهای بیش از ۳۰ ساعت حفظ میکند.[13]
- Claude Opus 4.5 (۲۴ نوامبر ۲۰۲۵): تکرار بعدی Opus که Anthropic آن را بهویژه قوی در کدنویسی، سناریوهای عاملی و computer use توصیف کرد.[14]
- Claude Opus 4.6 (۵ فوریه ۲۰۲۶): مدل Opus بهروزرسانیشده با بهبودهایی در کدنویسی، code review، debugging و وظایف عاملی طولانی. برای اولین بار در خط Opus، پنجره زمینه ۱M توکن در حالت beta اعلام شد.[15]
- Claude Sonnet 4.6 (۱۷ فوریه ۲۰۲۶): قدرتمندترین نسخه Sonnet تا آن زمان؛ Anthropic بهبودهایی در کدنویسی، computer use، long-context reasoning، agent planning، کار دانشی و طراحی را اعلام کرد. مانند Opus 4.6، این مدل نیز پنجره زمینه ۱M توکن را در beta دریافت کرد.[16]
جدول تجمیعی نسلهای Claude
| نسل | سال انتشار | نسخههای کلیدی | حداکثر پنجره زمینه | نوآوریهای کلیدی |
|---|---|---|---|---|
| Claude 1 | 2023 | Claude, Instant | ۱۰۰٬۰۰۰ توکن | اولین انتشار عمومی، زمینه بزرگ. |
| Claude 2 | 2023 | Claude 2, 2.1 | ۲۰۰٬۰۰۰ توکن | کدنویسی و استدلال بهبودیافته، دسترسی عمومی. |
| Claude 3 | 2024 | Opus, Sonnet, Haiku | ۲۰۰٬۰۰۰+ توکن | چندوجهی بودن (تصاویر)، پیشی گرفتن از GPT-4. |
| Claude 3.5 | 2024 | Sonnet, Haiku | ۲۰۰٬۰۰۰+ توکن | افزایش سرعت و هوش، قابلیت «Artifacts». |
| Claude 4 / 3.7 | 2025 | Opus, Sonnet | ۲۰۰٬۰۰۰+ توکن | تفکر ترکیبی، قابلیتهای عاملی، استفاده از ابزار. |
کاربرد و دسترسی
مدلهای Claude از طریق چندین کانال در دسترس هستند:
- رابط وب claude.ai: دسترسی رایگان (به مدل Sonnet) و اشتراکهای پولی (Pro، Max) با دسترسی به مدلهای قدرتمندتر (Opus) و محدودیتهای گسترشیافته.
- API برای توسعهدهندگان: Anthropic یک API تجاری ارائه میدهد که امکان یکپارچهسازی Claude در برنامههای شخص ثالث را فراهم میکند. قیمتها بسته به مدل متفاوت است (Haiku ارزانترین، Opus گرانترین).
- پلتفرمهای ابری: Claude از طریق Amazon Bedrock و Google Cloud Vertex AI در دسترس است که استفاده از آن را در محیط سازمانی سادهتر میکند.
- یکپارچهسازیها: Claude در سرویسهای محبوبی مانند Slack، Notion و Quora (در چتبات Poe) یکپارچه شده است.
پیوندها
- وبسایت رسمی Anthropic
- مستندات برای توسعهدهندگان
منابع
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, مارس). Introducing the next generation of Claude.
- Anthropic (2025, مه). Introducing Claude 4.
منابع
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [۳] (tech-report, open review).
یادداشتها
- ↑ «Dario Amodei». В Wikipedia [۱]
- ↑ «Daniela Amodei». В Wikipedia [۲]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.