Claude (Anthropic) (SV)
Claude — är en familj av multimodala stora språkmodeller (LLM), utvecklade av forskningsföretaget Anthropic.
Claude-modellerna, byggda på transformer-arkitektur, positioneras som AI-assistenter med fokus på säkerhet, användbarhet och ärlighet. En central egenskap i deras utveckling är metoden Constitutional AI («Konstitutionell AI»), som syftar till att skapa hanterbara och etiskt anpassade system.
Historia och filosofi
Grundande och Anthropics uppdrag
Företaget Anthropic grundades 2021 av tidigare seniora medarbetare från OpenAI, däribland syskonparet Dario[1] och Daniela Amodei[2]. Orsaken till avgången var meningsskiljaktigheter med OpenAI:s ledning om utvecklingsriktningen, särskilt farhågor om att partnerskapet med Microsoft och en ökande kommersialisering kunde äventyra engagemanget för AI-säkerhet.
Anthropic har som uppdrag att «utveckla och upprätthålla avancerad AI för mänsklighetens långsiktiga nytta». Företaget är registrerat som en Public Benefit Corporation (PBC) i USA, vilket juridiskt förpliktar det att balansera finansiella intressen med samhällsnytta. Detta tillvägagångssätt stöds av en unik styrningsstruktur med Long-Term Benefit Trust (LTBT), ett oberoende organ med rätt att påverka styrelsens sammansättning för att säkerställa efterlevnad av säkerhetsuppdraget.
Filosofi: HHH och Konstitutionell AI
Grunden för Claude-modellernas beteende är formeln HHH: Helpful, Honest, and Harmless (Hjälpsam, Ärlig och Ofarlig). För att förverkliga dessa principer har Anthropic utvecklat sin egen träningsmetod — Constitutional AI (CAI).
Till skillnad från traditionell RLHF (förstärkningsinlärning baserad på mänsklig återkoppling), där mänskliga annotatorer direkt bedömer modellens svar, använder CAI en «konstitution» — en uppsättning explicita etiska principer utifrån vilka modellen tränas att självständigt utvärdera och korrigera sina svar. Detta gör processen mer skalbar, transparent och kontrollerbar.
Arkitektur och nyckelteknologier
Grund i Transformer
Liksom andra moderna LLM använder Claude en transformer-decoder-arkitektur som autoregressivt genererar text token för token. Anthropic har dock gjort betydande förbättringar som syftar till att öka prestanda, säkerhet och styrbarhet.
Konstitutionell AI (CAI)
Träningsprocessen med CAI sker i två faser:
- Supervised Learning-fas: Modellen genererar svar på frågor, varefter en annan kritikmodell, vägledd av «konstitutionen», utvärderar dem och föreslår korrigeringar. Utifrån dessa korrigeringar finjusteras den ursprungliga modellen.
- RLAIF-fas (Reinforcement Learning from AI Feedback): Modellen genererar par av svar, och kritikmodellen väljer det bästa utifrån «konstitutionen». Dessa data används för att träna en preferensmodell (reward model), som sedan fungerar som signal för finjustering av huvudmodellen med hjälp av förstärkningsalgoritmer.
Långt kontextfönster och multimodalitet
Ett av Claudes främsta fördelar är ett mycket stort kontextfönster. Från 100 000 token i Claude 2 utökades det till 200 000 i Claude 3 och till 1–2 miljoner token i versionerna 3.5 och 4. Detta gör det möjligt för modellerna att analysera hela böcker, kodbaser eller flertimmeslånga transkript inom en enda förfrågan.
Från och med Claude 3-familjen blev modellerna multimodala och fick förmågan att bearbeta bilder tillsammans med text.
Hybridtänkande och agentförmågor
Från och med versionerna Claude 3.7 och 4 introducerades en arkitektur för hybridtänkande. Den gör det möjligt för modellerna att växla mellan två lägen:
- Snabba svar: Standardläge för enkla uppgifter.
- Utökat tänkande (Extended Thinking): För komplexa uppgifter gör modellen en paus för att «tänka», utför interna resonemangssteg, anropar verktyg (webbsökning, kodexekvering) och formulerar ett mer välgrundat svar. Detta gör processen mer transparent och tillförlitlig.
Claude-modellernas utveckling
Claude 1 (2023)
- Claude (14 mars 2023): den första offentligt presenterade versionen av modellen. Samtidigt presenterades två konfigurationer — Claude (huvud) och Claude Instant (snabbare och billigare).[3]
- 100K Context Window (11 maj 2023): utökning av Claudes kontextfönster från 9 000 till 100 000 token. Detta var en separat uppdatering efter den ursprungliga lanseringen, inte en del av marsreleasen.[4]
Claude 2 (2023)
- Claude 2 (11 juli 2023): en stor uppdatering med förbättringar inom kodning, matematik och resonemang. Modellen gjordes tillgänglig via API och en offentlig beta-version av claude.ai. Den stödde inmatning på upp till 100 000 token; i testet Codex HumanEval angav Anthropic ett resultat på 71,2 %.[5]
- Claude 2.1 (21 november 2023): en version med ett kontextfönster på 200 000 token, minskad benägenhet för hallucinationer, stöd för system prompts och beta-funktionen tool use.[6]
Claude 3 (2024)
- Claude 3 (4 mars 2024): en ny modellfamilj som inkluderade Haiku (snabbast), Sonnet (balanserad) och Opus (kraftfullast). Anthropic positionerade denna generation som en ny milstolpe på ett antal kognitiva benchmark.[7]
- Nyckelförändringar: starka visuella och multimodala förmågor (analys av bilder, grafer och diagram), märkbar minskning av obefogade avböjanden, ökad precision samt 200 000 token kontext vid start. För utvalda kunder angav Anthropic också möjligheten att arbeta med inmatningar på över 1 miljon token.[8]
Claude 3.5 (2024)
- Claude 3.5 Sonnet (21 juni 2024): den första modellen i 3.5-familjen. Enligt Anthropic överträffade den Claude 3 Opus på ett brett utvärderingsset, med bibehållen hastighet och kostnad för mellanklassen; företaget betonade också en ungefär dubblad hastighet. Kontextfönstret var 200 000 token.[9]
- Uppdaterad Claude 3.5 Sonnet och Claude 3.5 Haiku (22 oktober 2024): oktoberuppdateringen förstärkte förmågorna inom agentprogrammering och verktygsanvändning. Då lanserade Anthropic också för första gången funktionen Computer Use i public beta, vilket gör det möjligt för modellen att arbeta med ett datorgränssnitt: se skärmen, flytta markören, klicka på knappar och skriva in text. För den uppdaterade 3.5 Sonnet ökade resultatet på SWE-bench Verified från 33,4 % till 49,0 %.[10]
Claude 3.7 och Claude 4 (2025)
- Claude 3.7 Sonnet (24 februari 2025): Anthropic presenterade den som den första hybrid reasoning model. Modellen kunde antingen svara nästan omedelbart eller använda ett läge med längre, stegvist resonemang. Samtidigt presenterades Claude Code.[11]
- Claude 4 (22 maj 2025): en ny flaggskeppsfamilj som inkluderade Opus 4 och Sonnet 4. Båda modellerna beskrevs som hybrider: med lägen för snabba svar och extended thinking. Anthropic betonade särskilt extended thinking with tool use, parallel tool execution och minnesförbättringar; Opus 4 utropades till ledare på SWE-bench med ett resultat på 72,5 %.[12]
Claude 4.5–4.6 (slutet av 2025 – början av 2026)
- Claude Sonnet 4.5 (29 september 2025): en väsentlig uppdatering av Sonnet-linjen med märkbar kvalitetshöjning inom kodning, computer use, resonemang och matematik. Anthropic noterade också att modellen håller fokus på komplexa flerstegsproblem i mer än 30 timmar.[13]
- Claude Opus 4.5 (24 november 2025): nästa iteration av Opus, som Anthropic beskrev som särskilt stark inom kodning, agentscenarier och computer use.[14]
- Claude Opus 4.6 (5 februari 2026): en uppdaterad Opus-modell med förbättringar inom kodning, code review, debugging och långvariga agentuppgifter. För första gången i Opus-linjen presenterades ett 1M token context window i beta-läge.[15]
- Claude Sonnet 4.6 (17 februari 2026): den kraftfullaste Sonnet-versionen vid den tidpunkten; Anthropic angav förbättringar inom kodning, computer use, long-context reasoning, agent planning, kunskapsarbete och design. Liksom Opus 4.6 fick modellen ett 1M token context window i beta.[16]
Sammanfattande tabell över Claude-generationer
| Generation | Utgivningsår | Nyckelversioner | Max. kontextfönster | Nyckelinnovationer |
|---|---|---|---|---|
| Claude 1 | 2023 | Claude, Instant | 100 000 token | Första offentliga releasen, stort kontextfönster. |
| Claude 2 | 2023 | Claude 2, 2.1 | 200 000 token | Förbättrad kodning och resonemang, allmän tillgänglighet. |
| Claude 3 | 2024 | Opus, Sonnet, Haiku | 200 000+ token | Multimodalitet (bilder), överlägsenhet gentemot GPT-4. |
| Claude 3.5 | 2024 | Sonnet, Haiku | 200 000+ token | Ökad hastighet och intelligens, funktionen "Artifacts". |
| Claude 4 / 3.7 | 2025 | Opus, Sonnet | 200 000+ token | Hybridtänkande, agentförmågor, verktygsanvändning. |
Användning och tillgänglighet
Claude-modellerna är tillgängliga via flera kanaler:
- Webbgränssnitt claude.ai: Erbjuder kostnadsfri åtkomst (till Sonnet-modellen) och betalda prenumerationer (Pro, Max) med åtkomst till kraftfullare modeller (Opus) och utökade gränser.
- API för utvecklare: Anthropic tillhandahåller ett kommersiellt API som gör det möjligt att integrera Claude i tredjepartsapplikationer. Priserna varierar beroende på modell (Haiku — billigast, Opus — dyrast).
- Molnplattformar: Claude är tillgängligt via Amazon Bedrock och Google Cloud Vertex AI, vilket förenklar användningen i företagsmiljöer.
- Integrationer: Claude är integrerat i populära tjänster som Slack, Notion och Quora (i chattboten Poe).
Litteratur
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, mars). Introducing the next generation of Claude.
- Anthropic (2025, maj). Introducing Claude 4.
Länkar
- Anthropics officiella webbplats
- Dokumentation för utvecklare
Litteratur
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).
Noter
- ↑ «Dario Amodei». В Wikipedia [1]
- ↑ «Daniela Amodei». В Wikipedia [2]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.