Claude (Anthropic) (TL)
Claude — ito ay isang pamilya ng multimodal na malalaking modelo ng wika (LLM), na binuo ng kumpanyang pananaliksik na Anthropic.
Ang mga modelo ng Claude, na itinayo sa arkitektura ng transformer, ay inilalagay bilang mga AI assistant na nakatuon sa kaligtasan, kapaki-pakinabang, at katapatan. Ang pangunahing katangian ng kanilang pagbuo ay ang pamamaraan ng Constitutional AI («Konstitusyonal na AI»), na naglalayong lumikha ng mga sistemang namamahalaan at etikal na nakahanay.
Kasaysayan at Pilosopiya
Pagtatag at Misyon ng Anthropic
Ang kumpanyang Anthropic ay itinatag noong 2021 ng mga dating nangungunang empleyado ng OpenAI, kasama ang magkapatid na Dario[1] at Daniela Amodei[2]. Ang dahilan ng kanilang pag-alis ay mga hindi pagkakasundo sa pamunuan ng OpenAI kaugnay ng direksyon ng pagpapaunlad, lalo na dahil sa mga alalahanin na ang pakikipagsosyo sa Microsoft at lumalaking komersyalisasyon ay maaaring magbanta sa pangako sa kaligtasan ng AI.
Ang misyon ng Anthropic ay «ang pagbuo at pagsuporta ng pinakamataas na antas ng AI para sa pangmatagalang kapakanan ng sangkatauhan». Ang kumpanya ay nakarehistro bilang Public Benefit Corporation (PBC) sa Estados Unidos, na legal na nag-oobliga sa kanya na balansehin ang mga interes sa pananalapi at ang kapakanan ng publiko. Ang diskarteng ito ay sinusuportahan ng natatanging istruktura ng pamamahala na may Long-Term Benefit Trust (LTBT), isang independiyenteng katawan na may karapatang maimpluwensyahan ang komposisyon ng lupon ng mga direktor upang matiyak ang pangako sa misyon ng kaligtasan.
Pilosopiya: HHH at Constitutional AI
Sa pundasyon ng gawi ng mga modelo ng Claude ay ang formula na HHH: Helpful, Honest, and Harmless (Kapaki-pakinabang, Tapat, at Walang Pinsala). Upang maipatupad ang mga prinsipyong ito, bumuo ang Anthropic ng sariling pamamaraan ng pagsasanay — Constitutional AI (CAI).
Sa kaibahan sa tradisyonal na RLHF (pagsasanay sa pamamagitan ng reinforcement mula sa feedback ng tao), kung saan direktang sinusuri ng mga tao-annotator ang mga tugon ng modelo, gumagamit ang CAI ng «konstitusyon» — isang hanay ng malinaw na etikal na prinsipyo, batay sa kung saan natututo ang modelo na sariling suriin at itama ang sarili nitong mga tugon. Ginagawa nitong mas nasusukat, mas malinaw, at mas nakontrol ang proseso.
Arkitektura at Pangunahing Teknolohiya
Pundasyon sa Transformer
Tulad ng iba pang modernong LLM, gumagamit ang Claude ng arkitektura ng transformer-decoder, na awtoregressibong nagge-generate ng teksto token sa bawat token. Gayunpaman, gumawa ang Anthropic ng mahahalagang pagpapabuti na naglalayong mapataas ang pagganap, kaligtasan, at kontrol.
Constitutional AI (CAI)
Ang proseso ng pagsasanay gamit ang CAI ay may dalawang yugto:
- Yugto ng Supervised Learning: Nagge-generate ang modelo ng mga tugon sa mga kahilingan, at pagkatapos ay sinusuri ng ibang modelo-kritiko, na ginagabayan ng «konstitusyon», ang mga ito at nagmumungkahi ng mga pagwawasto. Batay sa mga pagwawastong ito, ang orihinal na modelo ay dagdag na sinaasanay.
- Yugto ng Reinforcement Learning mula sa AI (RLAIF): Nagge-generate ang modelo ng mga pares ng tugon, at pinipili ng modelo-kritiko ang pinakamahusay mula sa kanila batay sa «konstitusyon». Ginagamit ang datos na ito para sanayin ang reward model, na pagkatapos ay nagsisilbing signal para sa karagdagang pagsasanay ng pangunahing modelo gamit ang mga algorithm ng reinforcement.
Mahabang Context at Multimodality
Isa sa mga pangunahing kalamangan ng Claude ay ang napakalaking context window. Simula sa 100 libong token sa Claude 2, ito ay pinalawak hanggang 200 libo sa Claude 3 at hanggang 1–2 milyong token sa mga bersyon 3.5 at 4. Nagbibigay-daan ito sa mga modelo na suriin ang buong mga libro, codebase, o maraming oras na transcript sa loob ng isang kahilingan.
Simula sa pamilya ng Claude 3, naging multimodal ang mga modelo, na nakakuha ng kakayahang mag-proseso ng mga larawan kasabay ng teksto.
Hybrid na Pag-iisip at Kakayahang Ahensyal
Mula sa mga bersyon ng Claude 3.7 at 4, ipinakilala ang arkitektura ng hybrid na pag-iisip. Nagbibigay-daan ito sa mga modelo na lumipat sa pagitan ng dalawang mode:
- Mabilis na mga tugon: Karaniwang mode para sa mga simpleng gawain.
- Pinalawig na Pag-iisip (Extended Thinking): Para sa mga kumplikadong gawain, nagpapatahan ang modelo upang «mag-isip», nagsasagawa ng mga panloob na hakbang ng pangangatuwiran, tumatawag ng mga kasangkapan (paghahanap sa web, pagpapatupad ng code), at bumubuo ng mas makatwirang tugon. Ginagawa nitong mas malinaw at mas maaasahan ang proseso.
Ebolusyon ng mga Modelo ng Claude
Claude 1 (2023)
- Claude (14 Marso 2023): ang unang pampublikong bersyon ng modelo. Sabay-sabay na inihayag ang dalawang configuration — Claude (pangunahin) at Claude Instant (mas mabilis at mas mura).[3]
- 100K Context Window (11 Mayo 2023): pagpapalawak ng context window ng Claude mula 9,000 hanggang 100,000 token. Ito ay isang hiwalay na update pagkatapos ng orihinal na paglulunsad, at hindi bahagi ng release noong Marso.[4]
Claude 2 (2023)
- Claude 2 (11 Hulyo 2023): malaking update na may mga pagpapabuti sa coding, matematika, at pangangatuwiran. Naging available ang modelo sa pamamagitan ng API at pampublikong beta-bersyon ng claude.ai. Sumuporta ng input na hanggang 100,000 token; sa pagsubok na Codex HumanEval, iniulat ng Anthropic ang resulta na 71.2%.[5]
- Claude 2.1 (21 Nobyembre 2023): bersyon na may context window na 200,000 token, nabawasang posibilidad ng mga hallucination, suporta para sa system prompt, at beta na tampok ng tool use.[6]
Claude 3 (2024)
- Claude 3 (4 Marso 2024): bagong pamilya ng mga modelo, kabilang ang Haiku (pinaka-mabilis), Sonnet (balanse), at Opus (pinaka-makapangyarihan). Inilagay ng Anthropic ang henerasyong ito bilang bagong antas sa ilang mga kognitibong benchmark.[7]
- Mga pangunahing pagbabago: malakas na visual at multimodal na kakayahan (pagsusuri ng mga larawan, graph, at diagram), kapansin-pansing pagbaba ng mga walang batayan na pagtanggi, pagtaas ng katumpakan, at 200,000 token ng context sa simula. Para sa ilang mga kliyente, iminungkahi rin ng Anthropic ang posibilidad ng pagtatrabaho sa mga input na higit sa 1 milyong token.[8]
Claude 3.5 (2024)
- Claude 3.5 Sonnet (21 Hunyo 2024): ang unang modelo ng pamilya 3.5. Ayon sa pahayag ng Anthropic, nalampasan nito ang Claude 3 Opus sa malawak na hanay ng mga ebalwasyon, habang pinapanatili ang bilis at gastos ng gitnang klase; hiwalay ding binanggit ng kumpanya ang humigit-kumulang doble na pagtaas ng bilis. Ang context window ay 200,000 token.[9]
- Ina-update na Claude 3.5 Sonnet at Claude 3.5 Haiku (22 Oktubre 2024): pinahusay ng update noong Oktubre ang mga kakayahan sa ahensyal na coding at paggamit ng mga kasangkapan. Nang panahon din iyon, unang inilabas ng Anthropic sa public beta ang tampok na Computer Use, na nagbibigay-daan sa modelo na gumana sa interface ng kompyuter: makita ang screen, galaw ang cursor, pindutin ang mga pindutan, at mag-type ng teksto. Sa ina-update na 3.5 Sonnet, umabot ang resulta sa SWE-bench Verified mula 33.4% hanggang 49.0%.[10]
Claude 3.7 at Claude 4 (2025)
- Claude 3.7 Sonnet (24 Pebrero 2025): iprinisenta ito ng Anthropic bilang unang hybrid reasoning model. Ang modelo ay maaaring tumugon nang halos agaran, o gumamit ng mode ng mas matagal at hakbang-hakbang na pangangatuwiran. Sabay-sabay na iprinisenta ang Claude Code.[11]
- Claude 4 (22 Mayo 2025): bagong flagship na pamilya, kabilang ang Opus 4 at Sonnet 4. Ang parehong modelo ay inilarawan bilang hybrid: na may mga mode ng mabilis na tugon at extended thinking. Partikular na binigyang-diin ng Anthropic ang extended thinking with tool use, parallel tool execution, at mga pagpapabuti ng memorya; ang Opus 4 ay inihayag bilang lider sa SWE-bench na may resulta na 72.5%.[12]
Claude 4.5–4.6 (huling bahagi ng 2025 — simula ng 2026)
- Claude Sonnet 4.5 (29 Setyembre 2025): makabuluhang update ng linya ng Sonnet na may kapansin-pansing pagtaas ng kalidad sa coding, computer use, pangangatuwiran, at matematika. Binanggit din ng Anthropic na pinapanatili ng modelo ang pokus sa mga kumplikadong multi-step na gawain nang higit sa 30 oras.[13]
- Claude Opus 4.5 (24 Nobyembre 2025): susunod na ulit ng Opus, na inilarawan ng Anthropic bilang partikular na malakas sa coding, mga ahensyal na senaryo, at computer use.[14]
- Claude Opus 4.6 (5 Pebrero 2026): ina-update na modelo ng Opus na may mga pagpapabuti sa coding, code review, debugging, at matagalang mga ahensyal na gawain. Sa unang pagkakataon para sa linya ng Opus, inihayag ang 1M token context window sa beta mode.[15]
- Claude Sonnet 4.6 (17 Pebrero 2026): ang pinaka-makapangyarihang bersyon ng Sonnet sa oras na iyon; iminungkahi ng Anthropic ang mga pagpapabuti sa coding, computer use, long-context reasoning, agent planning, knowledge work, at design. Tulad ng Opus 4.6, ang modelo ay nakatanggap ng 1M token context window sa beta.[16]
Buod na Talahanayan ng mga Henerasyon ng Claude
| Henerasyon | Taon ng Paglabas | Mga Pangunahing Bersyon | Pinakamataas na Context Window | Mga Pangunahing Inobasyon |
|---|---|---|---|---|
| Claude 1 | 2023 | Claude, Instant | 100,000 token | Unang pampublikong release, malaking context. |
| Claude 2 | 2023 | Claude 2, 2.1 | 200,000 token | Pinahusay na coding at pangangatuwiran, pampublikong availability. |
| Claude 3 | 2024 | Opus, Sonnet, Haiku | 200,000+ token | Multimodality (mga larawan), kahusayan sa GPT-4. |
| Claude 3.5 | 2024 | Sonnet, Haiku | 200,000+ token | Pagtaas ng bilis at katalinuhan, tampok na "Artifacts". |
| Claude 4 / 3.7 | 2025 | Opus, Sonnet | 200,000+ token | Hybrid na pag-iisip, kakayahang ahensyal, paggamit ng mga kasangkapan. |
Paggamit at Availability
Ang mga modelo ng Claude ay available sa pamamagitan ng ilang channel:
- Web interface na claude.ai: Nagbibigay ng libreng access (sa modelo ng Sonnet) at mga bayad na subscription (Pro, Max) na may access sa mas makapangyarihang mga modelo (Opus) at pinapalawak na mga limitasyon.
- API para sa mga developer: Nagbibigay ang Anthropic ng komersyal na API na nagbibigay-daan sa pag-integrate ng Claude sa mga third-party na aplikasyon. Ang mga presyo ay nag-iiba depende sa modelo (Haiku — pinaka-mura, Opus — pinaka-mahal).
- Mga cloud platform: Available ang Claude sa pamamagitan ng Amazon Bedrock at Google Cloud Vertex AI, na nagpapadali ng paggamit nito sa kapaligiran ng korporasyon.
- Mga integration: Ang Claude ay integrated sa mga popular na serbisyo, tulad ng Slack, Notion, Quora (sa chatbot na Poe).
Panitikan
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, Marso). Introducing the next generation of Claude.
- Anthropic (2025, Mayo). Introducing Claude 4.
Mga Sanggunian
- Opisyal na website ng Anthropic
- Dokumentasyon para sa mga developer
Panitikan
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).
Mga Tala
- ↑ «Dario Amodei». В Wikipedia [1]
- ↑ «Daniela Amodei». В Wikipedia [2]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.