Claude (Anthropic) (IT)

From Systems analysis Wiki
Jump to navigation Jump to search

Claude — è una famiglia di modelli linguistici di grandi dimensioni (LLM) multimodali, sviluppati dalla società di ricerca Anthropic.

I modelli Claude, basati sull'architettura transformer, sono posizionati come assistenti AI orientati alla sicurezza, all'utilità e all'onestà. La caratteristica principale del loro sviluppo è la metodologia Constitutional AI («IA Costituzionale»), volta alla creazione di sistemi controllabili ed eticamente allineati.

Storia e filosofia

Fondazione e missione di Anthropic

Anthropic è stata fondata nel 2021 da ex dipendenti senior di OpenAI, tra cui il fratello e la sorella Dario[1] e Daniela Amodei[2]. Il motivo della separazione furono i disaccordi con la dirigenza di OpenAI riguardo alla direzione dello sviluppo, in particolare per il timore che la partnership con Microsoft e la crescente commercializzazione potessero mettere a rischio l'impegno per la sicurezza dell'IA.

La missione di Anthropic è «sviluppare e mantenere un'IA all'avanguardia per il beneficio a lungo termine dell'umanità». L'azienda è registrata come Public Benefit Corporation (PBC) negli Stati Uniti, il che la obbliga legalmente a bilanciare gli interessi finanziari con il beneficio pubblico. Questo approccio è supportato da una struttura di governance unica con il Long-Term Benefit Trust (LTBT), un organo indipendente che ha il diritto di influenzare la composizione del consiglio di amministrazione per garantire l'impegno verso la missione di sicurezza.

Filosofia: HHH e Constitutional AI

Alla base del comportamento dei modelli Claude vi è la formula HHH: Helpful, Honest, and Harmless (Utile, Onesto e Innocuo). Per realizzare questi principi, Anthropic ha sviluppato una propria metodologia di addestramento — Constitutional AI (CAI).

A differenza del tradizionale RLHF (apprendimento per rinforzo basato sul feedback umano), in cui annotatori umani valutano direttamente le risposte del modello, il CAI utilizza una «costituzione» — un insieme di principi etici espliciti sulla base dei quali il modello impara autonomamente a valutare e correggere le proprie risposte. Questo rende il processo più scalabile, trasparente e controllabile.

Architettura e tecnologie chiave

Base sul Transformer

Come altri LLM moderni, Claude utilizza l'architettura transformer-decoder, che genera testo in modo autoregressivo token per token. Tuttavia, Anthropic ha apportato significativi miglioramenti volti ad aumentare le prestazioni, la sicurezza e la controllabilità.

Constitutional AI (CAI)

Il processo di addestramento con CAI avviene in due fasi:

  1. Fase di apprendimento supervisionato (Supervised Learning): Il modello genera risposte alle richieste, dopodiché un altro modello critico, guidato dalla «costituzione», le valuta e propone correzioni. Sulla base di queste correzioni, il modello originale viene ulteriormente addestrato.
  2. Fase di apprendimento per rinforzo dall'IA (RLAIF): Il modello genera coppie di risposte e il modello critico seleziona la migliore sulla base della «costituzione». Questi dati vengono utilizzati per addestrare un modello di preferenza (reward model), che funge poi da segnale per il fine-tuning del modello principale mediante algoritmi di rinforzo.

Contesto lungo e multimodalità

Uno dei principali vantaggi di Claude è la sua finestra di contesto molto ampia. Partendo da 100 mila token in Claude 2, è stata aumentata a 200 mila in Claude 3 e fino a 1-2 milioni di token nelle versioni 3.5 e 4. Ciò consente ai modelli di analizzare interi libri, basi di codice o trascrizioni di molte ore all'interno di una singola richiesta.

A partire dalla famiglia Claude 3, i modelli sono diventati multimodali, acquisendo la capacità di elaborare immagini insieme al testo.

Ragionamento ibrido e capacità agentiche

Dalle versioni Claude 3.7 e 4 è stata introdotta l'architettura di ragionamento ibrido. Essa consente ai modelli di passare tra due modalità:

  • Risposte rapide: Modalità standard per compiti semplici.
  • Ragionamento esteso (Extended Thinking): Per compiti complessi, il modello fa una pausa per «riflettere», eseguendo passaggi di ragionamento interni, richiamando strumenti (ricerca web, esecuzione di codice) e formulando una risposta più ponderata. Questo rende il processo più trasparente e affidabile.

Evoluzione dei modelli Claude

Claude 1 (2023)

  • Claude (14 marzo 2023): prima versione del modello presentata pubblicamente. Contemporaneamente furono annunciate due configurazioni — Claude (principale) e Claude Instant (più veloce ed economica).[3]
  • 100K Context Window (11 maggio 2023): ampliamento della finestra di contesto di Claude da 9.000 a 100.000 token. Si trattò di un aggiornamento separato dopo il lancio iniziale, non parte della release di marzo.[4]

Claude 2 (2023)

  • Claude 2 (11 luglio 2023): aggiornamento importante con miglioramenti nella programmazione, nella matematica e nel ragionamento. Il modello è diventato disponibile tramite API e versione beta pubblica di claude.ai. Supportava un input fino a 100.000 token; nel test Codex HumanEval Anthropic indicava un risultato del 71,2%.[5]
  • Claude 2.1 (21 novembre 2023): versione con finestra di contesto di 200.000 token, ridotta tendenza alle allucinazioni, supporto per system prompt e funzione beta di tool use.[6]

Claude 3 (2024)

  • Claude 3 (4 marzo 2024): nuova famiglia di modelli che includeva Haiku (la più veloce), Sonnet (bilanciata) e Opus (la più potente). Anthropic posizionava questa generazione come un nuovo traguardo su una serie di benchmark cognitivi.[7]
  • Modifiche principali: forti capacità visive e multimodali (analisi di immagini, grafici e diagrammi), notevole riduzione dei rifiuti ingiustificati, aumento della precisione e 200.000 token di contesto al lancio. Per alcuni clienti, Anthropic indicava anche la possibilità di elaborare input superiori a 1 milione di token.[8]

Claude 3.5 (2024)

  • Claude 3.5 Sonnet (21 giugno 2024): primo modello della famiglia 3.5. Secondo quanto dichiarato da Anthropic, superava Claude 3 Opus su un ampio insieme di valutazioni, mantenendo la velocità e il costo della fascia media; l'azienda sottolineava anche un aumento della velocità di circa il doppio. La finestra di contesto era di 200.000 token.[9]
  • Claude 3.5 Sonnet aggiornato e Claude 3.5 Haiku (22 ottobre 2024): l'aggiornamento di ottobre ha potenziato le capacità nel coding agentivo e nell'uso degli strumenti. In quella stessa occasione, Anthropic ha portato per la prima volta in public beta la funzione Computer Use, che consente al modello di interagire con l'interfaccia del computer: vedere lo schermo, muovere il cursore, cliccare i pulsanti e digitare testo. Il risultato del 3.5 Sonnet aggiornato su SWE-bench Verified è salito dal 33,4% al 49,0%.[10]

Claude 3.7 e Claude 4 (2025)

  • Claude 3.7 Sonnet (24 febbraio 2025): Anthropic lo ha presentato come il primo hybrid reasoning model. Il modello poteva rispondere quasi istantaneamente oppure utilizzare una modalità di ragionamento più lungo e passo dopo passo. Contemporaneamente è stato presentato Claude Code.[11]
  • Claude 4 (22 maggio 2025): nuova famiglia di punta, che includeva Opus 4 e Sonnet 4. Entrambi i modelli erano descritti come ibridi: con modalità di risposta rapida e extended thinking. Anthropic sottolineava in particolare l'extended thinking with tool use, il parallel tool execution e i miglioramenti della memoria; Opus 4 è stato dichiarato leader su SWE-bench con un risultato del 72,5%.[12]

Claude 4.5–4.6 (fine 2025 – inizio 2026)

  • Claude Sonnet 4.5 (29 settembre 2025): aggiornamento sostanziale della linea Sonnet con un notevole miglioramento della qualità nella programmazione, nel computer use, nel ragionamento e nella matematica. Anthropic ha anche sottolineato che il modello mantiene la concentrazione su compiti complessi a più fasi per oltre 30 ore.[13]
  • Claude Opus 4.5 (24 novembre 2025): iterazione successiva di Opus, che Anthropic descriveva come particolarmente forte nella programmazione, negli scenari agentici e nel computer use.[14]
  • Claude Opus 4.6 (5 febbraio 2026): modello Opus aggiornato con miglioramenti nella programmazione, nel code review, nel debugging e nelle attività agentiche prolungate. Per la prima volta nella linea Opus è stata annunciata una finestra di contesto da 1M di token in modalità beta.[15]
  • Claude Sonnet 4.6 (17 febbraio 2026): versione più potente di Sonnet fino a quel momento; Anthropic indicava miglioramenti nella programmazione, nel computer use, nel ragionamento su contesti lunghi, nella pianificazione agentiva, nel knowledge work e nel design. Come Opus 4.6, il modello ha ricevuto una finestra di contesto da 1M di token in beta.[16]

Tabella riepilogativa delle generazioni di Claude

Evoluzione delle caratteristiche principali dei modelli Claude
Generazione Anno di rilascio Versioni principali Finestra di contesto massima Innovazioni chiave
Claude 1 2023 Claude, Instant 100.000 token Primo rilascio pubblico, contesto ampio.
Claude 2 2023 Claude 2, 2.1 200.000 token Programmazione e ragionamento migliorati, disponibilità pubblica.
Claude 3 2024 Opus, Sonnet, Haiku 200.000+ token Multimodalità (immagini), superiorità rispetto a GPT-4.
Claude 3.5 2024 Sonnet, Haiku 200.000+ token Aumento di velocità e intelligenza, funzione "Artifacts".
Claude 4 / 3.7 2025 Opus, Sonnet 200.000+ token Ragionamento ibrido, capacità agentiche, uso degli strumenti.

Applicazioni e disponibilità

I modelli Claude sono disponibili attraverso diversi canali:

  • Interfaccia web claude.ai: Fornisce accesso gratuito (al modello Sonnet) e abbonamenti a pagamento (Pro, Max) con accesso a modelli più potenti (Opus) e limiti estesi.
  • API per sviluppatori: Anthropic fornisce un'API commerciale che consente di integrare Claude in applicazioni di terze parti. I prezzi variano in base al modello (Haiku — il più economico, Opus — il più costoso).
  • Piattaforme cloud: Claude è disponibile tramite Amazon Bedrock e Google Cloud Vertex AI, il che ne semplifica l'utilizzo in ambienti aziendali.
  • Integrazioni: Claude è integrato in servizi popolari come Slack, Notion, Quora (nel chatbot Poe).

Bibliografia

  • Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Anthropic (2023). Claude's Constitution.
  • Anthropic (2024, marzo). Introducing the next generation of Claude.
  • Anthropic (2025, maggio). Introducing Claude 4.

Riferimenti

  • Sito ufficiale di Anthropic
  • Documentazione per sviluppatori

Bibliografia

  • Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
  • Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
  • Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
  • Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
  • Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
  • Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
  • Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
  • Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
  • Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
  • Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).

Note

  1. «Dario Amodei». В Wikipedia [1]
  2. «Daniela Amodei». В Wikipedia [2]
  3. Introducing Claude. Anthropic. 14 марта 2023.
  4. Introducing 100K Context Windows. Anthropic. 11 мая 2023.
  5. Introducing Claude 2. Anthropic. 11 июля 2023.
  6. Introducing Claude 2.1. Anthropic. 21 ноября 2023.
  7. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  8. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  9. Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
  10. New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
  11. Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
  12. Introducing Claude 4. Anthropic. 22 мая 2025.
  13. Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
  14. Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
  15. Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
  16. Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.