Claude (Anthropic) (CS)
Claude — je rodina multimodálních velkých jazykových modelů (LLM) vyvinutých výzkumnou společností Anthropic.
Modely Claude, postavené na architektuře transformer, jsou prezentovány jako AI asistenti zaměření na bezpečnost, užitečnost a poctivost. Klíčovým rysem jejich vývoje je metodika Constitutional AI („Ústavní AI"), jejímž cílem je vytváření řiditelných a eticky konzistentních systémů.
Historie a filozofie
Založení a mise Anthropic
Společnost Anthropic byla založena v roce 2021 bývalými vedoucími zaměstnanci OpenAI, včetně bratra a sestry Daria[1] a Daniely Amodei[2]. Důvodem odchodu byly neshody s vedením OpenAI ohledně směru vývoje, zejména obavy, že partnerství s Microsoftem a rostoucí komercializace mohou ohrozit závazek k bezpečnosti AI.
Misí Anthropic je „vývoj a udržování špičkové AI pro dlouhodobý prospěch lidstva". Společnost je registrována jako Public Benefit Corporation (PBC) v USA, což ji právně zavazuje vyvažovat finanční zájmy s veřejným prospěchem. Tento přístup je podpořen unikátní strukturou správy s Long-Term Benefit Trust (LTBT) — nezávislým orgánem, který má právo ovlivňovat složení správní rady za účelem zajištění závazku k bezpečnostní misi.
Filozofie: HHH a Constitutional AI
Základem chování modelů Claude je formule HHH: Helpful, Honest, and Harmless (Užitečný, Poctivý a Neškodný). K realizaci těchto principů vyvinul Anthropic vlastní metodiku trénování — Constitutional AI (CAI).
Na rozdíl od tradičního RLHF (učení s posílením na základě zpětné vazby od lidí), kde lidé-anotátoři přímo hodnotí odpovědi modelu, CAI využívá „ústavu" — soubor explicitních etických principů, na jejichž základě se model učí samostatně hodnotit a korigovat své odpovědi. To činí proces škálovatelnějším, transparentnějším a kontrolovatelnějším.
Architektura a klíčové technologie
Základ na architektuře Transformer
Jako ostatní moderní LLM využívá Claude architekturu transformer-dekodéru, která autoregresivně generuje text token po tokenu. Anthropic však provedl významná vylepšení zaměřená na zvýšení výkonu, bezpečnosti a řiditelnosti.
Constitutional AI (CAI)
Proces trénování s CAI probíhá ve dvou fázích:
- Fáze učení s učitelem (Supervised Learning): Model generuje odpovědi na dotazy a jiný model-kritik, řídící se „ústavou", je hodnotí a navrhuje opravy. Na základě těchto oprav je původní model dotrénován.
- Fáze učení s posílením od AI (RLAIF): Model generuje páry odpovědí a model-kritik vybírá lepší z nich na základě „ústavy". Tato data jsou použita k trénování modelu preferencí (reward model), který pak slouží jako signál pro dotrénování hlavního modelu pomocí algoritmů posílení.
Dlouhý kontext a multimodalita
Jednou z hlavních předností Claude je velmi velké kontextové okno. Počínaje 100 tis. tokeny v Claude 2 bylo rozšířeno na 200 tis. v Claude 3 a na 1–2 miliony tokenů ve verzích 3.5 a 4. To umožňuje modelům analyzovat celé knihy, kódové základny nebo vícehodinové přepisy v rámci jediného dotazu.
Počínaje rodinou Claude 3 se modely staly multimodálními a získaly schopnost zpracovávat obrázky společně s textem.
Hybridní uvažování a agentní schopnosti
Od verzí Claude 3.7 a 4 byla zavedena architektura hybridního uvažování. Ta umožňuje modelům přepínat mezi dvěma režimy:
- Rychlé odpovědi: Standardní režim pro jednoduché úlohy.
- Rozšířené uvažování (Extended Thinking): Pro složité úlohy model udělá pauzu, aby „přemýšlel", provádí vnitřní kroky uvažování, volá nástroje (webové vyhledávání, spouštění kódu) a formuluje podloženější odpověď. To činí proces transparentnějším a spolehlivějším.
Evoluce modelů Claude
Claude 1 (2023)
- Claude (14. března 2023): první veřejně představená verze modelu. Současně byly oznámeny dvě konfigurace — Claude (hlavní) a Claude Instant (rychlejší a levnější).[3]
- 100K Context Window (11. května 2023): rozšíření kontextového okna Claude z 9 000 na 100 000 tokenů. Šlo o samostatnou aktualizaci po počátečním spuštění, nikoli součást březnového vydání.[4]
Claude 2 (2023)
- Claude 2 (11. července 2023): velká aktualizace se zlepšeními v kódování, matematice a uvažování. Model se stal dostupným prostřednictvím API a veřejné beta verze claude.ai. Podporoval vstup až 100 000 tokenů; v testu Codex HumanEval uváděl Anthropic výsledek 71,2 %.[5]
- Claude 2.1 (21. listopadu 2023): verze s kontextovým oknem 200 000 tokenů, sníženou skloností k halucinacím, podporou system prompts a beta funkcí tool use.[6]
Claude 3 (2024)
- Claude 3 (4. března 2024): nová rodina modelů zahrnující Haiku (nejrychlejší), Sonnet (vyvážený) a Opus (nejvýkonnější). Anthropic tuto generaci prezentoval jako novou hranici v řadě kognitivních benchmarků.[7]
- Klíčové změny: silné vizuální a multimodální schopnosti (analýza obrázků, grafů a diagramů), výrazné snížení neopodstatněných odmítnutí, nárůst přesnosti a 200 000 tokenů kontextu od počátku. Pro vybrané klienty Anthropic také uváděl možnost práce se vstupy přesahujícími 1 milion tokenů.[8]
Claude 3.5 (2024)
- Claude 3.5 Sonnet (21. června 2024): první model rodiny 3.5. Podle vyjádření Anthropic překonával Claude 3 Opus na širokém souboru hodnocení při zachování rychlosti a nákladů střední třídy; společnost také zvlášť zdůrazňovala přibližně dvojnásobný nárůst rychlosti. Kontextové okno činilo 200 000 tokenů.[9]
- Aktualizovaný Claude 3.5 Sonnet a Claude 3.5 Haiku (22. října 2024): říjnová aktualizace posílila schopnosti v agentním kódování a používání nástrojů. Tehdy Anthropic poprvé zveřejnil v public beta funkci Computer Use, umožňující modelu pracovat s rozhraním počítače: vidět obrazovku, pohybovat kurzorem, klikat na tlačítka a zadávat text. U aktualizovaného 3.5 Sonnet vzrostl výsledek na SWE-bench Verified z 33,4 % na 49,0 %.[10]
Claude 3.7 a Claude 4 (2025)
- Claude 3.7 Sonnet (24. února 2025): Anthropic jej představil jako první hybrid reasoning model. Model mohl buď odpovídat téměř okamžitě, nebo využívat režim delšího, postupného uvažování. Současně byl představen Claude Code.[11]
- Claude 4 (22. května 2025): nová vlajková rodina zahrnující Opus 4 a Sonnet 4. Oba modely byly popsány jako hybridní: s režimy rychlých odpovědí a extended thinking. Anthropic zvlášť zdůraznil extended thinking with tool use, parallel tool execution a vylepšení paměti; Opus 4 byl prohlášen lídrem na SWE-bench s výsledkem 72,5 %.[12]
Claude 4.5–4.6 (konec 2025 — začátek 2026)
- Claude Sonnet 4.5 (29. září 2025): výrazná aktualizace řady Sonnet s patrným nárůstem kvality v kódování, computer use, uvažování a matematice. Anthropic také uváděl, že model udržuje soustředění na složité vícekrokové úlohy po dobu více než 30 hodin.[13]
- Claude Opus 4.5 (24. listopadu 2025): další iterace Opus, kterou Anthropic popisoval jako zvláště silnou v kódování, agentních scénářích a computer use.[14]
- Claude Opus 4.6 (5. února 2026): aktualizovaný model Opus se zlepšeními v kódování, code review, debuggingu a dlouhodobých agentních úlohách. Pro řadu Opus bylo poprvé oznámeno 1M token context window v beta režimu.[15]
- Claude Sonnet 4.6 (17. února 2026): nejsilnější verze Sonnet v daném období; Anthropic uváděl zlepšení v kódování, computer use, long-context reasoning, agent planning, knowledge work a designu. Stejně jako Opus 4.6 obdržel model 1M token context window v beta verzi.[16]
Přehledná tabulka generací Claude
| Generace | Rok vydání | Klíčové verze | Max. kontextové okno | Klíčové inovace |
|---|---|---|---|---|
| Claude 1 | 2023 | Claude, Instant | 100 000 tokenů | První veřejné vydání, velký kontext. |
| Claude 2 | 2023 | Claude 2, 2.1 | 200 000 tokenů | Vylepšené kódování a uvažování, veřejná dostupnost. |
| Claude 3 | 2024 | Opus, Sonnet, Haiku | 200 000+ tokenů | Multimodalita (obrázky), převaha nad GPT-4. |
| Claude 3.5 | 2024 | Sonnet, Haiku | 200 000+ tokenů | Zvýšení rychlosti a inteligence, funkce „Artifacts". |
| Claude 4 / 3.7 | 2025 | Opus, Sonnet | 200 000+ tokenů | Hybridní uvažování, agentní schopnosti, používání nástrojů. |
Využití a dostupnost
Modely Claude jsou dostupné prostřednictvím několika kanálů:
- Webové rozhraní claude.ai: Poskytuje bezplatný přístup (k modelu Sonnet) a placená předplatná (Pro, Max) s přístupem k výkonnějším modelům (Opus) a rozšířenými limity.
- API pro vývojáře: Anthropic poskytuje komerční API umožňující integrovat Claude do aplikací třetích stran. Ceny se liší podle modelu (Haiku — nejlevnější, Opus — nejdražší).
- Cloudové platformy: Claude je dostupný prostřednictvím Amazon Bedrock a Google Cloud Vertex AI, což usnadňuje jeho použití v podnikovém prostředí.
- Integrace: Claude je integrován do populárních služeb, jako jsou Slack, Notion, Quora (v chatbotu Poe).
Literatura
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, březen). Introducing the next generation of Claude.
- Anthropic (2025, květen). Introducing Claude 4.
Odkazy
- Oficiální stránky Anthropic
- Dokumentace pro vývojáře
Literatura
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).
Poznámky
- ↑ «Dario Amodei». В Wikipedia [1]
- ↑ «Daniela Amodei». В Wikipedia [2]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.