Claude (Anthropic) (FA)

From Systems analysis Wiki
Jump to navigation Jump to search

Claude — خانواده‌ای از مدل‌های زبانی بزرگ (LLM) چندوجهی است که توسط شرکت پژوهشی Anthropic توسعه یافته است.

مدل‌های Claude که بر پایه معماری transformer ساخته شده‌اند، به عنوان دستیارهای هوش مصنوعی با محوریت ایمنی، سودمندی و صداقت معرفی می‌شوند. ویژگی کلیدی توسعه آن‌ها روش Constitutional AI («هوش مصنوعی قانون‌اساسی») است که هدف آن ایجاد سیستم‌های قابل کنترل و از نظر اخلاقی همسو است.

تاریخچه و فلسفه

تأسیس و مأموریت Anthropic

شرکت Anthropic در سال ۲۰۲۱ توسط تعدادی از کارمندان ارشد سابق OpenAI، از جمله برادر و خواهر داریو[1] و دانیلا آمودئی[2] تأسیس شد. دلیل جدایی آن‌ها اختلاف نظر با مدیریت OpenAI درباره مسیر توسعه بود؛ به‌ویژه نگرانی از اینکه مشارکت با Microsoft و تجاری‌سازی فزاینده ممکن است تعهد به ایمنی هوش مصنوعی را به خطر اندازد.

مأموریت Anthropic «توسعه و حمایت از هوش مصنوعی پیشرفته برای منفعت بلندمدت بشریت» است. این شرکت به عنوان یک Public Benefit Corporation (PBC) در ایالات متحده ثبت شده است که از نظر قانونی ملزم به ایجاد توازن میان منافع مالی و منافع عمومی است. این رویکرد با ساختار حاکمیتی منحصربه‌فردی شامل Long-Term Benefit Trust (LTBT) — نهادی مستقل که حق تأثیرگذاری بر ترکیب هیئت مدیره برای تضمین پایبندی به مأموریت ایمنی را دارد — تقویت شده است.

فلسفه: HHH و Constitutional AI

اساس رفتار مدل‌های Claude فرمول HHH است: Helpful, Honest, and Harmless (سودمند، صادق و بی‌ضرر). برای اجرای این اصول، Anthropic روش آموزشی خاص خود را به نام Constitutional AI (CAI) توسعه داده است.

برخلاف RLHF سنتی (یادگیری تقویتی بر اساس بازخورد انسانی) که در آن حاشیه‌نویسان انسانی مستقیماً پاسخ‌های مدل را ارزیابی می‌کنند، CAI از یک «قانون اساسی» — مجموعه‌ای از اصول اخلاقی صریح — استفاده می‌کند که بر اساس آن مدل یاد می‌گیرد پاسخ‌های خود را به‌طور مستقل ارزیابی و اصلاح کند. این فرآیند را مقیاس‌پذیرتر، شفاف‌تر و قابل کنترل‌تر می‌سازد.

معماری و فناوری‌های کلیدی

پایه transformer

مانند سایر LLM‌های مدرن، Claude از معماری transformer-decoder استفاده می‌کند که متن را به صورت خودبازگشتی توکن به توکن تولید می‌کند. با این حال، Anthropic بهبودهای قابل توجهی را با هدف افزایش کارایی، ایمنی و قابلیت کنترل اعمال کرده است.

Constitutional AI (CAI)

فرآیند آموزش با CAI در دو مرحله انجام می‌شود:

  1. مرحله یادگیری با ناظر (Supervised Learning): مدل پاسخ‌هایی برای درخواست‌ها تولید می‌کند، سپس یک مدل منتقد بر اساس «قانون اساسی» آن‌ها را ارزیابی کرده و اصلاحاتی پیشنهاد می‌دهد. مدل اصلی بر اساس این اصلاحات fine-tune می‌شود.
  2. مرحله یادگیری تقویتی از هوش مصنوعی (RLAIF): مدل جفت پاسخ‌هایی تولید می‌کند و مدل منتقد بهترین آن‌ها را بر اساس «قانون اساسی» انتخاب می‌کند. این داده‌ها برای آموزش مدل ترجیح (reward model) استفاده می‌شوند که سپس به عنوان سیگنال برای fine-tuning مدل اصلی با الگوریتم‌های تقویتی به کار می‌رود.

پنجره زمینه بلند و چندوجهی بودن

یکی از مزایای اصلی Claude پنجره زمینه بسیار بزرگ آن است. از ۱۰۰ هزار توکن در Claude 2 آغاز شد، به ۲۰۰ هزار در Claude 3 افزایش یافت و در نسخه‌های ۳.۵ و ۴ به ۱ تا ۲ میلیون توکن رسید. این ویژگی به مدل‌ها اجازه می‌دهد کتاب‌های کامل، پایگاه‌های کد یا رونوشت‌های چندساعته را در یک درخواست تجزیه‌وتحلیل کنند.

از خانواده Claude 3 به بعد، مدل‌ها چندوجهی شدند و توانایی پردازش تصاویر در کنار متن را به دست آوردند.

تفکر ترکیبی و قابلیت‌های عاملی

از نسخه‌های Claude 3.7 و 4، معماری تفکر ترکیبی معرفی شد. این معماری به مدل‌ها اجازه می‌دهد بین دو حالت جابجا شوند:

  • پاسخ‌های سریع: حالت استاندارد برای وظایف ساده.
  • تفکر گسترده (Extended Thinking): برای وظایف پیچیده، مدل مکث می‌کند تا «فکر کند»، گام‌های استدلال داخلی را انجام دهد، ابزارها را فراخوانی کند (جستجوی وب، اجرای کد) و پاسخ مستدل‌تری تشکیل دهد. این فرآیند را شفاف‌تر و قابل اطمینان‌تر می‌کند.

تکامل مدل‌های Claude

Claude 1 (2023)

  • Claude (۱۴ مارس ۲۰۲۳): اولین نسخه عمومی مدل. به طور همزمان دو پیکربندی اعلام شد — Claude (اصلی) و Claude Instant (سریع‌تر و ارزان‌تر).[3]
  • 100K Context Window (۱۱ مه ۲۰۲۳): گسترش پنجره زمینه Claude از ۹٬۰۰۰ به ۱۰۰٬۰۰۰ توکن. این یک به‌روزرسانی جداگانه پس از راه‌اندازی اولیه بود و بخشی از انتشار ماه مارس نبود.[4]

Claude 2 (2023)

  • Claude 2 (۱۱ ژوئیه ۲۰۲۳): به‌روزرسانی اساسی با بهبودهایی در کدنویسی، ریاضیات و استدلال. مدل از طریق API و نسخه beta عمومی claude.ai در دسترس قرار گرفت. از ورودی تا ۱۰۰٬۰۰۰ توکن پشتیبانی می‌کرد؛ در آزمون Codex HumanEval، Anthropic نتیجه ۷۱.۲٪ را اعلام کرد.[5]
  • Claude 2.1 (۲۱ نوامبر ۲۰۲۳): نسخه‌ای با پنجره زمینه ۲۰۰٬۰۰۰ توکن، کاهش تمایل به توهم‌پردازی، پشتیبانی از system prompts و قابلیت beta برای tool use.[6]

Claude 3 (2024)

  • Claude 3 (۴ مارس ۲۰۲۴): خانواده جدیدی از مدل‌ها شامل Haiku (سریع‌ترین)، Sonnet (متعادل) و Opus (قدرتمندترین). Anthropic این نسل را به عنوان مرز جدیدی در چندین benchmark شناختی معرفی کرد.[7]
  • تغییرات کلیدی: قابلیت‌های بصری و چندوجهی قوی (تحلیل تصاویر، نمودارها و دیاگرام‌ها)، کاهش قابل توجه در رد درخواست‌های بی‌دلیل، افزایش دقت، و ۲۰۰٬۰۰۰ توکن زمینه از ابتدا. Anthropic همچنین برای برخی مشتریان امکان کار با ورودی‌های بیش از ۱ میلیون توکن را اعلام کرد.[8]

Claude 3.5 (2024)

  • Claude 3.5 Sonnet (۲۱ ژوئن ۲۰۲۴): اولین مدل خانواده ۳.۵. Anthropic اعلام کرد که این مدل بر روی مجموعه گسترده‌ای از ارزیابی‌ها از Claude 3 Opus پیشی گرفته و در عین حال سرعت و هزینه رده میانی را حفظ کرده است؛ شرکت همچنین به‌طور جداگانه به افزایش سرعت تقریباً دو برابری اشاره کرد. پنجره زمینه ۲۰۰٬۰۰۰ توکن بود.[9]
  • Claude 3.5 Sonnet به‌روزرسانی‌شده و Claude 3.5 Haiku (۲۲ اکتبر ۲۰۲۴): به‌روزرسانی اکتبر قابلیت‌ها را در کدنویسی عاملی و استفاده از ابزار تقویت کرد. در همان زمان Anthropic برای اولین بار قابلیت Computer Use را در beta عمومی معرفی کرد که به مدل امکان می‌دهد با رابط کامپیوتر کار کند: صفحه را ببیند، مکان‌نما را حرکت دهد، دکمه‌ها را فشار دهد و متن وارد کند. نتیجه Sonnet 3.5 به‌روزرسانی‌شده بر روی SWE-bench Verified از ۳۳.۴٪ به ۴۹.۰٪ افزایش یافت.[10]

Claude 3.7 و Claude 4 (2025)

  • Claude 3.7 Sonnet (۲۴ فوریه ۲۰۲۵): Anthropic آن را به عنوان اولین hybrid reasoning model معرفی کرد. مدل می‌توانست یا تقریباً فوری پاسخ دهد یا از حالت استدلال طولانی‌تر و گام‌به‌گام استفاده کند. به طور همزمان Claude Code نیز معرفی شد.[11]
  • Claude 4 (۲۲ مه ۲۰۲۵): خانواده پرچم‌دار جدید شامل Opus 4 و Sonnet 4. هر دو مدل به عنوان ترکیبی توصیف شدند: با حالت‌های پاسخ سریع و extended thinking. Anthropic به‌ویژه بر extended thinking with tool use، parallel tool execution و بهبودهای حافظه تأکید کرد؛ Opus 4 با نتیجه ۷۲.۵٪ به عنوان پیشرو در SWE-bench معرفی شد.[12]

Claude 4.5–4.6 (اواخر ۲۰۲۵ — اوایل ۲۰۲۶)

  • Claude Sonnet 4.5 (۲۹ سپتامبر ۲۰۲۵): به‌روزرسانی قابل توجه خط Sonnet با رشد چشمگیر کیفیت در کدنویسی، computer use، استدلال و ریاضیات. Anthropic همچنین اشاره کرد که مدل تمرکز خود را در وظایف پیچیده چندمرحله‌ای بیش از ۳۰ ساعت حفظ می‌کند.[13]
  • Claude Opus 4.5 (۲۴ نوامبر ۲۰۲۵): تکرار بعدی Opus که Anthropic آن را به‌ویژه قوی در کدنویسی، سناریوهای عاملی و computer use توصیف کرد.[14]
  • Claude Opus 4.6 (۵ فوریه ۲۰۲۶): مدل Opus به‌روزرسانی‌شده با بهبودهایی در کدنویسی، code review، debugging و وظایف عاملی طولانی. برای اولین بار در خط Opus، پنجره زمینه ۱M توکن در حالت beta اعلام شد.[15]
  • Claude Sonnet 4.6 (۱۷ فوریه ۲۰۲۶): قدرتمندترین نسخه Sonnet تا آن زمان؛ Anthropic بهبودهایی در کدنویسی، computer use، long-context reasoning، agent planning، کار دانشی و طراحی را اعلام کرد. مانند Opus 4.6، این مدل نیز پنجره زمینه ۱M توکن را در beta دریافت کرد.[16]

جدول تجمیعی نسل‌های Claude

تکامل ویژگی‌های کلیدی مدل‌های Claude
نسل سال انتشار نسخه‌های کلیدی حداکثر پنجره زمینه نوآوری‌های کلیدی
Claude 1 2023 Claude, Instant ۱۰۰٬۰۰۰ توکن اولین انتشار عمومی، زمینه بزرگ.
Claude 2 2023 Claude 2, 2.1 ۲۰۰٬۰۰۰ توکن کدنویسی و استدلال بهبودیافته، دسترسی عمومی.
Claude 3 2024 Opus, Sonnet, Haiku ۲۰۰٬۰۰۰+ توکن چندوجهی بودن (تصاویر)، پیشی گرفتن از GPT-4.
Claude 3.5 2024 Sonnet, Haiku ۲۰۰٬۰۰۰+ توکن افزایش سرعت و هوش، قابلیت «Artifacts».
Claude 4 / 3.7 2025 Opus, Sonnet ۲۰۰٬۰۰۰+ توکن تفکر ترکیبی، قابلیت‌های عاملی، استفاده از ابزار.

کاربرد و دسترسی

مدل‌های Claude از طریق چندین کانال در دسترس هستند:

  • رابط وب claude.ai: دسترسی رایگان (به مدل Sonnet) و اشتراک‌های پولی (Pro، Max) با دسترسی به مدل‌های قدرتمندتر (Opus) و محدودیت‌های گسترش‌یافته.
  • API برای توسعه‌دهندگان: Anthropic یک API تجاری ارائه می‌دهد که امکان یکپارچه‌سازی Claude در برنامه‌های شخص ثالث را فراهم می‌کند. قیمت‌ها بسته به مدل متفاوت است (Haiku ارزان‌ترین، Opus گران‌ترین).
  • پلتفرم‌های ابری: Claude از طریق Amazon Bedrock و Google Cloud Vertex AI در دسترس است که استفاده از آن را در محیط سازمانی ساده‌تر می‌کند.
  • یکپارچه‌سازی‌ها: Claude در سرویس‌های محبوبی مانند Slack، Notion و Quora (در چت‌بات Poe) یکپارچه شده است.

پیوندها

  • وب‌سایت رسمی Anthropic
  • مستندات برای توسعه‌دهندگان

منابع

  • Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Anthropic (2023). Claude's Constitution.
  • Anthropic (2024, مارس). Introducing the next generation of Claude.
  • Anthropic (2025, مه). Introducing Claude 4.

منابع

  • Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
  • Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
  • Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
  • Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
  • Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
  • Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
  • Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
  • Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
  • Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
  • Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [۳] (tech-report, open review).

یادداشت‌ها

  1. «Dario Amodei». В Wikipedia [۱]
  2. «Daniela Amodei». В Wikipedia [۲]
  3. Introducing Claude. Anthropic. 14 марта 2023.
  4. Introducing 100K Context Windows. Anthropic. 11 мая 2023.
  5. Introducing Claude 2. Anthropic. 11 июля 2023.
  6. Introducing Claude 2.1. Anthropic. 21 ноября 2023.
  7. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  8. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  9. Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
  10. New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
  11. Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
  12. Introducing Claude 4. Anthropic. 22 мая 2025.
  13. Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
  14. Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
  15. Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
  16. Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.