Claude

Материал из Systems analysis Wiki
Перейти к навигации Перейти к поиску

Claude — это семейство мультимодальных больших языковых моделей (LLM), разработанных исследовательской компанией Anthropic.

Модели Claude, построенные на архитектуре трансформеров, позиционируются как AI-ассистенты, ориентированные на безопасность, полезность и честность. Ключевой особенностью их разработки является методика Constitutional AI («Конституционный ИИ»), направленная на создание управляемых и этически согласованных систем.

История и философия

Основание и миссия Anthropic

Компания Anthropic была основана в 2021 году бывшими старшими сотрудниками OpenAI, включая брата и сестру Дарио[1] и Даниэлу Амодеи[2]. Причиной ухода стали разногласия с руководством OpenAI относительно направления развития, в частности, из-за опасений, что партнёрство с Microsoft и растущая коммерциализация могут поставить под угрозу приверженность безопасности ИИ.

Миссия Anthropic — «разработка и поддержка передового ИИ для долгосрочной пользы человечества». Компания зарегистрирована как Public Benefit Corporation (PBC) в США, что юридически обязывает её уравновешивать финансовые интересы с общественной пользой. Этот подход подкреплён уникальной структурой управления с Long-Term Benefit Trust (LTBT), независимым органом, который имеет право влиять на состав совета директоров для обеспечения приверженности миссии безопасности.

Философия: HHH и Конституционный ИИ

В основе поведения моделей Claude лежит формула HHH: Helpful, Honest, and Harmless (Полезный, Честный и Безвредный). Для реализации этих принципов Anthropic разработала собственную методику обучения — Constitutional AI (CAI).

В отличие от традиционного RLHF (обучение с подкреплением на основе отзывов людей), где люди-аннотаторы напрямую оценивают ответы модели, CAI использует «конституцию» — набор явных этических принципов, на основе которых модель обучается самостоятельно оценивать и корректировать свои ответы. Это делает процесс более масштабируемым, прозрачным и контролируемым.

Архитектура и ключевые технологии

Основа на Трансформере

Как и другие современные LLM, Claude использует архитектуру трансформера-декодера, которая авторегрессионно генерирует текст токен за токеном. Однако Anthropic внесла значительные усовершенствования, направленные на повышение производительности, безопасности и управляемости.

Конституционный ИИ (CAI)

Процесс обучения с CAI проходит в два этапа:

  1. Фаза обучения с учителем (Supervised Learning): Модель генерирует ответы на запросы, а затем другая модель-критик, руководствуясь «конституцией», оценивает их и предлагает исправления. На основе этих исправлений исходная модель дообучается.
  2. Фаза обучения с подкреплением от ИИ (RLAIF): Модель генерирует пары ответов, а модель-критик выбирает лучший из них на основе «конституции». Эти данные используются для обучения модели предпочтений (reward model), которая затем служит сигналом для дообучения основной модели с помощью алгоритмов подкрепления.

Длинный контекст и мультимодальность

Одним из главных преимуществ Claude является очень большое контекстное окно. Начиная со 100 тыс. токенов в Claude 2, оно было увеличено до 200 тыс. в Claude 3 и до 1-2 млн токенов в версиях 3.5 и 4. Это позволяет моделям анализировать целые книги, кодовые базы или многочасовые транскрипты внутри одного запроса.

Начиная с семейства Claude 3, модели стали мультимодальными, получив способность обрабатывать изображения наряду с текстом.

Гибридное мышление и агентные возможности

С версий Claude 3.7 и 4 была внедрена архитектура гибридного мышления. Она позволяет моделям переключаться между двумя режимами:

  • Быстрые ответы: Стандартный режим для простых задач.
  • Расширенное мышление (Extended Thinking): Для сложных задач модель делает паузу, чтобы «подумать», выполняя внутренние шаги рассуждений, вызывая инструменты (веб-поиск, выполнение кода) и формируя более обоснованный ответ. Это делает процесс более прозрачным и надёжным.

Эволюция моделей Claude

Claude 1 (2023)

  • Claude (14 марта 2023): первая публично представленная версия модели. Одновременно Anthropic объявила две конфигурации — основную Claude и более быструю и дешёвую Claude Instant, рассчитанную на задачи, где скорость и стоимость ответа важнее предельной глубины рассуждения.[3]
  • Расширение контекста до 100K (11 мая 2023): спустя два месяца после запуска контекстное окно Claude было увеличено с 9 000 до 100 000 токенов. Это было отдельное обновление, а не часть мартовского релиза, и оно стало первым окном такого объёма среди передовых лабораторий, позволив модели обрабатывать объёмные документы целиком за один проход.[4]

Claude 2 (2023)

  • Claude 2 (11 июля 2023): крупное обновление с улучшениями в кодировании, математике и рассуждении. Модель стала доступна через API и публичную бета-версию claude.ai и поддерживала ввод до 100 000 токенов; в тесте Codex HumanEval Anthropic приводила результат 71,2 %.[5]
  • Claude 2.1 (21 ноября 2023): версия с контекстным окном 200 000 токенов и сниженной склонностью к галлюцinациям. В ней появились поддержка системных промптов (system prompts) и бета-функция использования инструментов (tool use), позволяющая модели вызывать заданные разработчиком функции.[6]

Claude 3 (2024)

  • Claude 3 (4 марта 2024): новое семейство из трёх моделей — Haiku (самая быстрая), Sonnet (сбалансированная) и Opus (самая мощная). Anthropic позиционировала это поколение как новый рубеж по ряду когнитивных бенчмарков, отдельно отмечая, что Opus превосходит конкурирующие модели того времени, включая GPT-4, на большинстве распространённых тестов.[7]
  • Ключевые изменения: впервые в семействе появились сильные визуальные и мультимодальные возможности — анализ изображений, графиков и диаграмм на всех уровнях линейки. Заметно снизилась доля необоснованных отказов, выросла точность ответов. Контекстное окно на старте составляло 200 000 токенов, а для отдельных клиентов Anthropic допускала обработку входов свыше 1 млн токенов.[8]

Claude 3.5 (2024)

  • Claude 3.5 Sonnet (21 июня 2024): первая модель семейства 3.5. По заявлению Anthropic, она превосходила Claude 3 Opus на широком наборе оценок, сохраняя скорость и стоимость среднего класса и работая примерно вдвое быстрее предшественника. Контекстное окно осталось на уровне 200 000 токенов. В том же анонсе была представлена функция Artifacts — отдельная панель в claude.ai, где результаты работы модели (код, документы, интерфейсы) отображаются и редактируются рядом с диалогом.[9]
  • Обновлённый Claude 3.5 Sonnet и Claude 3.5 Haiku (22 октября 2024): октябрьское обновление усилило агентное кодирование и работу с инструментами. Тогда же Anthropic впервые вывела в публичную бету функцию Computer Use, позволяющую модели взаимодействовать с интерфейсом компьютера — видеть экран, перемещать курсор, нажимать кнопки и вводить текст. У обновлённого 3.5 Sonnet результат на SWE-bench Verified вырос с 33,4 % до 49,0 %.[10]

Claude 3.7 (2025)

  • Claude 3.7 Sonnet (24 февраля 2025): представлена как первая hybrid reasoning model — гибридная модель рассуждения, способная либо отвечать почти мгновенно, либо переходить в режим более длительного пошагового рассуждения (extended thinking), глубину которого задаёт разработчик. Одновременно вышел исследовательский релиз Claude Code — агента для работы с кодом из командной строки.[11]

Claude 4 (2025)

  • Claude Opus 4 и Claude Sonnet 4 (22 мая 2025): новое флагманское семейство. Обе модели — гибридные, с режимами быстрых ответов и расширенного мышления (extended thinking). Anthropic подчёркивала расширенное мышление с параллельным вызовом инструментов (extended thinking with tool use, parallel tool execution) и улучшения памяти; Opus 4 был заявлен лидером на SWE-bench Verified с результатом 72,5 %. В тот же день общедоступным стал Claude Code.[12]
  • Claude Opus 4.1 (5 августа 2025): промежуточное обновление флагмана с упором на кодирование, исследовательские задачи и анализ данных. На SWE-bench Verified модель достигла 74,5 %, превзойдя Opus 4, и распространялась через Anthropic API, Amazon Bedrock и Google Cloud Vertex AI (идентификатор claude-opus-4-1-20250805).[13]

Claude 4.5 (2025)

  • Claude Sonnet 4.5 (29 сентября 2025): существенное обновление линии Sonnet с заметным ростом качества в кодировании, работе с компьютером, рассуждении и математике. Anthropic отмечала, что модель способна удерживать фокус на сложных многошаговых задачах более 30 часов.[14]
  • Claude Haiku 4.5 (15 октября 2025): обновление младшей, самой быстрой и экономичной линии. Это первая модель Haiku, получившая расширенное мышление (extended thinking) и режим Computer Use, ранее доступные только старшим линиям. По заявлению Anthropic, по качеству кодирования она сопоставима с Sonnet 4, но работает примерно вдвое быстрее и стоит около трети его цены.[15]
  • Claude Opus 4.5 (24 ноября 2025): очередная итерация старшей линии, которую Anthropic описывала как особенно сильную в кодировании, агентных сценариях и работе с компьютером. Вместе с ней появился параметр effort, позволяющий выбирать баланс между качеством ответа и расходом токенов, механизм уплотнения контекста (context compaction) для автоматического сжатия длинных диалогов и углублённый инструмент памяти. Это первая модель, ставшая доступной одновременно на четырёх платформах, включая Microsoft Foundry.[16]

Claude 4.6 (2026)

  • Claude Opus 4.6 (5 февраля 2026): обновлённая Opus-модель с улучшениями в кодировании, ревью кода, отладке и длительных агентных задачах. Впервые для линии Opus заявлено контекстное окно в 1 млн токенов в бета-режиме, вывод до 128 000 токенов и адаптивное мышление, при котором модель сама выбирает глубину рассуждения. В Claude Code появилась функция «команд агентов» (agent teams) для параллельной автономной работы.[17]
  • Claude Sonnet 4.6 (17 февраля 2026): наиболее мощная версия Sonnet на тот момент, с улучшениями в кодировании, работе с компьютером, рассуждении на длинном контексте, планировании агентов, интеллектуальном труде и дизайне. Как и Opus 4.6, модель получила контекстное окно в 1 млн токенов в бета-режиме.[18]

Claude 4.7 (2026)

  • Claude Opus 4.7 (16 апреля 2026): на момент выхода — флагманская модель Anthropic. Основной прирост пришёлся на самые трудные задачи кодирования. Дополнительно появились ввод изображений более высокого разрешения (до 2 576 пикселей по длинной стороне, около 3,75 мегапикселя), новый уровень усилия xhigh и восстановление памяти между сессиями на основе файловой системы. В публичную бету вышли бюджеты задач (Task Budgets), ограничивающие расход токенов на отдельную задачу.[19]

Claude 4.8 (2026)

  • Claude Opus 4.8 (28 мая 2026): новая флагманская модель, вышедшая примерно через шесть недель после Opus 4.7 — самый короткий интервал между соседними версиями Opus. Главный акцент сделан на честности и надёжности: по данным Anthropic, модель примерно вчетверо реже, чем Opus 4.7, оставляет незамеченными изъяны в написанном ею коде. Улучшены вызовы инструментов и агентное «суждение», в том числе работа с компьютером и браузером (84 % на бенчмарке Online-Mind2Web). Вместе с моделью в Claude Code появилась исследовательская функция Dynamic Workflows — оркестратор, запускающий сотни параллельных субагентов, каждый из которых планирует, выполняет и проверяет свою часть задачи, — а в claude.ai и Cowork добавлено управление уровнем усилия на стороне пользователя.[20]

Claude Fable 5 (2026)

  • Claude Fable 5 (9 июня 2026): первая общедоступная модель нового класса Mythos, который по возможностям расположен выше линии Opus, — первый новый именованный класс с момента появления Opus / Sonnet / Haiku в марте 2024 года. Anthropic характеризует Fable 5 как наиболее мощную из своих широко доступных моделей с лучшими результатами почти на всех протестированных бенчмарках — от программной инженерии и интеллектуального труда до анализа изображений и научных задач. Модель работает с постоянно включённым адаптивным мышлением (отключить его нельзя, а глубину задаёт параметр effort), контекстным окном в 1 млн токенов и выводом до 128 000 токенов. В неё встроены классификаторы безопасности для областей кибербезопасности, биологии, химии и попыток «дистилляции» модели: отмеченные запросы автоматически передаются на обработку модели Opus 4.8 (это затрагивает менее 5 % сессий).[21]

Claude Mythos 5 (2026)

  • Claude Mythos 5 (9 июня 2026): модель с теми же возможностями, что и Fable 5, но без классификаторов безопасности. Она не является общедоступной и предоставляется ограниченному кругу одобренных клиентов — например, отдельным исследователям в области биологии — через программу Project Glasswing; доступ оформляется через аккаунт-команды Anthropic, AWS или Google Cloud. Mythos 5 пришла на смену более раннему пробному выпуску Claude Mythos Preview.[22]
  • Приостановка доступа (12 июня 2026): по экспортно-контрольной директиве властей США Anthropic приостановила доступ к обеим моделям класса Mythos — Fable 5 и Mythos 5. Как сообщает компания, для соблюдения требований ей пришлось отключить эти модели для всех клиентов, тогда как доступ ко всем остальным моделям Claude (Opus, Sonnet, Haiku) сохранился.[23]

Сводная таблица поколений Claude

Эволюция ключевых характеристик моделей Claude
Поколение Год выпуска Ключевые версии Макс. контекстное окно Ключевые инновации
Claude 1 2023 Claude, Instant 100 000 токенов Первый публичный релиз (март 2023); первое контекстное окно на 100K токенов среди передовых лабораторий.
Claude 2 2023 Claude 2, 2.1 200 000 токенов Прогресс в кодировании и рассуждениях; запуск публичного чат-интерфейса claude.ai; системные промпты, инструменты и контекст 200K (в версии 2.1).
Claude 3 2024 Opus, Sonnet, Haiku 200 000 токенов Трёхуровневая линейка Opus / Sonnet / Haiku; мультимодальность (ввод изображений) на всех уровнях; превосходство над GPT-4 по ряду бенчмарков на момент выпуска.
Claude 3.5 2024 Sonnet, Haiku 200 000 токенов Рост скорости и интеллекта без повышения цены; функция «Artifacts»; режим «Computer Use» (управление компьютером).
Claude 3.7 2025 Sonnet 200 000 токенов Первая гибридная reasoning-модель: стандартный и расширенный («extended thinking») режимы мышления под управлением разработчика; исследовательский запуск Claude Code.
Claude 4 2025 Opus 4, Sonnet 4, Opus 4.1 200 000 (до 1 000 000 в бета-режиме) Агентные возможности и расширенное мышление с использованием инструментов; инструмент памяти и Files API; общедоступность Claude Code.
Claude 4.5 2025 Sonnet 4.5, Haiku 4.5, Opus 4.5 200 000 (до 1 000 000 в бета-режиме) Параметр «effort» (баланс «качество / стоимость»); уплотнение контекста (context compaction); первый Haiku с расширенным мышлением и Computer Use.
Claude 4.6 2026 Opus 4.6, Sonnet 4.6 1 000 000 (бета) Контекст 1 млн токенов на уровне Opus; вывод до 128K токенов; адаптивное мышление; «команды агентов» в Claude Code.
Claude 4.7 2026 Opus 4.7 1 000 000 (бета) Ввод изображений высокого разрешения; уровень усилия «xhigh»; межсессионная память на основе файловой системы.
Claude 4.8 2026 Opus 4.8 1 000 000 (бета) Упор на честность и надёжность кода; более эффективные вызовы инструментов; «Dynamic Workflows» в Claude Code (сотни параллельных субагентов).
Claude Fable 5 2026 Fable 5 1 000 000 токенов Общедоступная модель нового класса «Mythos» (выше уровня Opus); SOTA-результаты почти на всех протестированных бенчмарках; постоянно включённое адаптивное мышление; вывод до 128K токенов; классификаторы безопасности с автоматическим откатом на Opus 4.8 для отмеченных запросов (кибербезопасность, биология / химия).[24]
Claude Mythos 5 2026 Mythos 5 1 000 000 токенов Те же возможности, что у Fable 5, но без классификаторов безопасности; ограниченная доступность для одобренных клиентов через программу Project Glasswing (преемник Claude Mythos Preview).[24]

Применение и доступность

Модели Claude доступны через несколько каналов:

  • Веб-интерфейс claude.ai: Предоставляет бесплатный доступ (к модели Sonnet) и платные подписки (Pro, Max) с доступом к более мощным моделям (Opus) и расширенными лимитами.
  • API для разработчиков: Anthropic предоставляет коммерческий API, позволяющий интегрировать Claude в сторонние приложения. Цены варьируются в зависимости от модели (Haiku — самая дешёвая, Opus — самая дорогая).
  • Облачные платформы: Claude доступен через Amazon Bedrock и Google Cloud Vertex AI, что упрощает его использование в корпоративной среде.
  • Интеграции: Claude интегрирован в популярные сервисы, такие как Slack, Notion, Quora (в чат-боте Poe).

См. также

Ссылки

Литература

  • Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Anthropic (2023). Claude’s Constitution.
  • Anthropic (2024, март). Introducing the next generation of Claude.
  • Anthropic (2025, май). Introducing Claude 4.
  • Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
  • Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
  • Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
  • Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
  • Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
  • Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
  • Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
  • Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
  • Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
  • Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).

Примечания

  1. «Dario Amodei». В Wikipedia [1]
  2. «Daniela Amodei». В Wikipedia [2]
  3. Introducing Claude. Anthropic. 14 марта 2023.
  4. Introducing 100K Context Windows. Anthropic. 11 мая 2023.
  5. Introducing Claude 2. Anthropic. 11 июля 2023.
  6. Introducing Claude 2.1. Anthropic. 21 ноября 2023.
  7. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  8. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  9. Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
  10. New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
  11. Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
  12. Introducing Claude 4. Anthropic. 22 мая 2025.
  13. Claude Opus 4.1. Anthropic. 5 августа 2025.
  14. Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
  15. Claude Haiku 4.5. Anthropic. 15 октября 2025.
  16. Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
  17. Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
  18. Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.
  19. Claude Opus 4.7. Anthropic. 16 апреля 2026.
  20. Claude Opus 4.8. Anthropic. 28 мая 2026.
  21. Introducing Claude Fable 5 and Claude Mythos 5. Anthropic. 9 июня 2026.
  22. Introducing Claude Fable 5 and Claude Mythos 5. Anthropic. 9 июня 2026.
  23. Statement on the US government directive to suspend access to Fable 5 and Mythos 5. Anthropic. 12 июня 2026.
  24. 24,0 24,1 Доступ к Fable 5 и Mythos 5 приостановлен с 12 июня 2026 г. по экспортно-контрольной директиве властей США; остальные модели Claude (Opus, Sonnet, Haiku) остаются доступны.