Claude (Anthropic) (CS)

From Systems analysis Wiki
Jump to navigation Jump to search

Claude — je rodina multimodálních velkých jazykových modelů (LLM) vyvinutých výzkumnou společností Anthropic.

Modely Claude, postavené na architektuře transformer, jsou prezentovány jako AI asistenti zaměření na bezpečnost, užitečnost a poctivost. Klíčovým rysem jejich vývoje je metodika Constitutional AI („Ústavní AI"), jejímž cílem je vytváření řiditelných a eticky konzistentních systémů.

Historie a filozofie

Založení a mise Anthropic

Společnost Anthropic byla založena v roce 2021 bývalými vedoucími zaměstnanci OpenAI, včetně bratra a sestry Daria[1] a Daniely Amodei[2]. Důvodem odchodu byly neshody s vedením OpenAI ohledně směru vývoje, zejména obavy, že partnerství s Microsoftem a rostoucí komercializace mohou ohrozit závazek k bezpečnosti AI.

Misí Anthropic je „vývoj a udržování špičkové AI pro dlouhodobý prospěch lidstva". Společnost je registrována jako Public Benefit Corporation (PBC) v USA, což ji právně zavazuje vyvažovat finanční zájmy s veřejným prospěchem. Tento přístup je podpořen unikátní strukturou správy s Long-Term Benefit Trust (LTBT) — nezávislým orgánem, který má právo ovlivňovat složení správní rady za účelem zajištění závazku k bezpečnostní misi.

Filozofie: HHH a Constitutional AI

Základem chování modelů Claude je formule HHH: Helpful, Honest, and Harmless (Užitečný, Poctivý a Neškodný). K realizaci těchto principů vyvinul Anthropic vlastní metodiku trénování — Constitutional AI (CAI).

Na rozdíl od tradičního RLHF (učení s posílením na základě zpětné vazby od lidí), kde lidé-anotátoři přímo hodnotí odpovědi modelu, CAI využívá „ústavu" — soubor explicitních etických principů, na jejichž základě se model učí samostatně hodnotit a korigovat své odpovědi. To činí proces škálovatelnějším, transparentnějším a kontrolovatelnějším.

Architektura a klíčové technologie

Základ na architektuře Transformer

Jako ostatní moderní LLM využívá Claude architekturu transformer-dekodéru, která autoregresivně generuje text token po tokenu. Anthropic však provedl významná vylepšení zaměřená na zvýšení výkonu, bezpečnosti a řiditelnosti.

Constitutional AI (CAI)

Proces trénování s CAI probíhá ve dvou fázích:

  1. Fáze učení s učitelem (Supervised Learning): Model generuje odpovědi na dotazy a jiný model-kritik, řídící se „ústavou", je hodnotí a navrhuje opravy. Na základě těchto oprav je původní model dotrénován.
  2. Fáze učení s posílením od AI (RLAIF): Model generuje páry odpovědí a model-kritik vybírá lepší z nich na základě „ústavy". Tato data jsou použita k trénování modelu preferencí (reward model), který pak slouží jako signál pro dotrénování hlavního modelu pomocí algoritmů posílení.

Dlouhý kontext a multimodalita

Jednou z hlavních předností Claude je velmi velké kontextové okno. Počínaje 100 tis. tokeny v Claude 2 bylo rozšířeno na 200 tis. v Claude 3 a na 1–2 miliony tokenů ve verzích 3.5 a 4. To umožňuje modelům analyzovat celé knihy, kódové základny nebo vícehodinové přepisy v rámci jediného dotazu.

Počínaje rodinou Claude 3 se modely staly multimodálními a získaly schopnost zpracovávat obrázky společně s textem.

Hybridní uvažování a agentní schopnosti

Od verzí Claude 3.7 a 4 byla zavedena architektura hybridního uvažování. Ta umožňuje modelům přepínat mezi dvěma režimy:

  • Rychlé odpovědi: Standardní režim pro jednoduché úlohy.
  • Rozšířené uvažování (Extended Thinking): Pro složité úlohy model udělá pauzu, aby „přemýšlel", provádí vnitřní kroky uvažování, volá nástroje (webové vyhledávání, spouštění kódu) a formuluje podloženější odpověď. To činí proces transparentnějším a spolehlivějším.

Evoluce modelů Claude

Claude 1 (2023)

  • Claude (14. března 2023): první veřejně představená verze modelu. Současně byly oznámeny dvě konfigurace — Claude (hlavní) a Claude Instant (rychlejší a levnější).[3]
  • 100K Context Window (11. května 2023): rozšíření kontextového okna Claude z 9 000 na 100 000 tokenů. Šlo o samostatnou aktualizaci po počátečním spuštění, nikoli součást březnového vydání.[4]

Claude 2 (2023)

  • Claude 2 (11. července 2023): velká aktualizace se zlepšeními v kódování, matematice a uvažování. Model se stal dostupným prostřednictvím API a veřejné beta verze claude.ai. Podporoval vstup až 100 000 tokenů; v testu Codex HumanEval uváděl Anthropic výsledek 71,2 %.[5]
  • Claude 2.1 (21. listopadu 2023): verze s kontextovým oknem 200 000 tokenů, sníženou skloností k halucinacím, podporou system prompts a beta funkcí tool use.[6]

Claude 3 (2024)

  • Claude 3 (4. března 2024): nová rodina modelů zahrnující Haiku (nejrychlejší), Sonnet (vyvážený) a Opus (nejvýkonnější). Anthropic tuto generaci prezentoval jako novou hranici v řadě kognitivních benchmarků.[7]
  • Klíčové změny: silné vizuální a multimodální schopnosti (analýza obrázků, grafů a diagramů), výrazné snížení neopodstatněných odmítnutí, nárůst přesnosti a 200 000 tokenů kontextu od počátku. Pro vybrané klienty Anthropic také uváděl možnost práce se vstupy přesahujícími 1 milion tokenů.[8]

Claude 3.5 (2024)

  • Claude 3.5 Sonnet (21. června 2024): první model rodiny 3.5. Podle vyjádření Anthropic překonával Claude 3 Opus na širokém souboru hodnocení při zachování rychlosti a nákladů střední třídy; společnost také zvlášť zdůrazňovala přibližně dvojnásobný nárůst rychlosti. Kontextové okno činilo 200 000 tokenů.[9]
  • Aktualizovaný Claude 3.5 Sonnet a Claude 3.5 Haiku (22. října 2024): říjnová aktualizace posílila schopnosti v agentním kódování a používání nástrojů. Tehdy Anthropic poprvé zveřejnil v public beta funkci Computer Use, umožňující modelu pracovat s rozhraním počítače: vidět obrazovku, pohybovat kurzorem, klikat na tlačítka a zadávat text. U aktualizovaného 3.5 Sonnet vzrostl výsledek na SWE-bench Verified z 33,4 % na 49,0 %.[10]

Claude 3.7 a Claude 4 (2025)

  • Claude 3.7 Sonnet (24. února 2025): Anthropic jej představil jako první hybrid reasoning model. Model mohl buď odpovídat téměř okamžitě, nebo využívat režim delšího, postupného uvažování. Současně byl představen Claude Code.[11]
  • Claude 4 (22. května 2025): nová vlajková rodina zahrnující Opus 4 a Sonnet 4. Oba modely byly popsány jako hybridní: s režimy rychlých odpovědí a extended thinking. Anthropic zvlášť zdůraznil extended thinking with tool use, parallel tool execution a vylepšení paměti; Opus 4 byl prohlášen lídrem na SWE-bench s výsledkem 72,5 %.[12]

Claude 4.5–4.6 (konec 2025 — začátek 2026)

  • Claude Sonnet 4.5 (29. září 2025): výrazná aktualizace řady Sonnet s patrným nárůstem kvality v kódování, computer use, uvažování a matematice. Anthropic také uváděl, že model udržuje soustředění na složité vícekrokové úlohy po dobu více než 30 hodin.[13]
  • Claude Opus 4.5 (24. listopadu 2025): další iterace Opus, kterou Anthropic popisoval jako zvláště silnou v kódování, agentních scénářích a computer use.[14]
  • Claude Opus 4.6 (5. února 2026): aktualizovaný model Opus se zlepšeními v kódování, code review, debuggingu a dlouhodobých agentních úlohách. Pro řadu Opus bylo poprvé oznámeno 1M token context window v beta režimu.[15]
  • Claude Sonnet 4.6 (17. února 2026): nejsilnější verze Sonnet v daném období; Anthropic uváděl zlepšení v kódování, computer use, long-context reasoning, agent planning, knowledge work a designu. Stejně jako Opus 4.6 obdržel model 1M token context window v beta verzi.[16]

Přehledná tabulka generací Claude

Evoluce klíčových charakteristik modelů Claude
Generace Rok vydání Klíčové verze Max. kontextové okno Klíčové inovace
Claude 1 2023 Claude, Instant 100 000 tokenů První veřejné vydání, velký kontext.
Claude 2 2023 Claude 2, 2.1 200 000 tokenů Vylepšené kódování a uvažování, veřejná dostupnost.
Claude 3 2024 Opus, Sonnet, Haiku 200 000+ tokenů Multimodalita (obrázky), převaha nad GPT-4.
Claude 3.5 2024 Sonnet, Haiku 200 000+ tokenů Zvýšení rychlosti a inteligence, funkce „Artifacts".
Claude 4 / 3.7 2025 Opus, Sonnet 200 000+ tokenů Hybridní uvažování, agentní schopnosti, používání nástrojů.

Využití a dostupnost

Modely Claude jsou dostupné prostřednictvím několika kanálů:

  • Webové rozhraní claude.ai: Poskytuje bezplatný přístup (k modelu Sonnet) a placená předplatná (Pro, Max) s přístupem k výkonnějším modelům (Opus) a rozšířenými limity.
  • API pro vývojáře: Anthropic poskytuje komerční API umožňující integrovat Claude do aplikací třetích stran. Ceny se liší podle modelu (Haiku — nejlevnější, Opus — nejdražší).
  • Cloudové platformy: Claude je dostupný prostřednictvím Amazon Bedrock a Google Cloud Vertex AI, což usnadňuje jeho použití v podnikovém prostředí.
  • Integrace: Claude je integrován do populárních služeb, jako jsou Slack, Notion, Quora (v chatbotu Poe).

Literatura

  • Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Anthropic (2023). Claude's Constitution.
  • Anthropic (2024, březen). Introducing the next generation of Claude.
  • Anthropic (2025, květen). Introducing Claude 4.

Odkazy

  • Oficiální stránky Anthropic
  • Dokumentace pro vývojáře

Literatura

  • Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
  • Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
  • Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
  • Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
  • Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
  • Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
  • Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
  • Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
  • Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
  • Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).

Poznámky

  1. «Dario Amodei». В Wikipedia [1]
  2. «Daniela Amodei». В Wikipedia [2]
  3. Introducing Claude. Anthropic. 14 марта 2023.
  4. Introducing 100K Context Windows. Anthropic. 11 мая 2023.
  5. Introducing Claude 2. Anthropic. 11 июля 2023.
  6. Introducing Claude 2.1. Anthropic. 21 ноября 2023.
  7. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  8. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  9. Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
  10. New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
  11. Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
  12. Introducing Claude 4. Anthropic. 22 мая 2025.
  13. Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
  14. Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
  15. Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
  16. Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.