Claude (Anthropic) (VI)
Claude — là một họ mô hình ngôn ngữ lớn (LLM) đa phương thức được phát triển bởi công ty nghiên cứu Anthropic.
Các mô hình Claude, được xây dựng trên kiến trúc transformer, được định vị là các AI assistant hướng đến sự an toàn, hữu ích và trung thực. Đặc điểm cốt lõi trong quá trình phát triển của chúng là phương pháp Constitutional AI («Trí tuệ nhân tạo có Hiến pháp»), nhằm tạo ra các hệ thống có thể kiểm soát và phù hợp về mặt đạo đức.
Lịch sử và triết lý
Thành lập và sứ mệnh của Anthropic
Công ty Anthropic được thành lập vào năm 2021 bởi các cựu nhân viên cấp cao của OpenAI, bao gồm anh em Dario[1] và Daniela Amodei[2]. Nguyên nhân ra đi là do bất đồng với ban lãnh đạo OpenAI về hướng phát triển, đặc biệt là lo ngại rằng quan hệ đối tác với Microsoft và sự thương mại hóa ngày càng tăng có thể gây tổn hại đến cam kết về an toàn AI.
Sứ mệnh của Anthropic là «phát triển và duy trì AI tiên tiến vì lợi ích lâu dài của nhân loại». Công ty được đăng ký là Public Benefit Corporation (PBC) tại Hoa Kỳ, điều này ràng buộc họ về mặt pháp lý phải cân bằng lợi ích tài chính với lợi ích công cộng. Cách tiếp cận này được củng cố bởi cấu trúc quản trị độc đáo với Long-Term Benefit Trust (LTBT) — một cơ quan độc lập có quyền ảnh hưởng đến thành phần hội đồng quản trị để đảm bảo cam kết với sứ mệnh an toàn.
Triết lý: HHH và Constitutional AI
Nền tảng hành vi của các mô hình Claude là công thức HHH: Helpful, Honest, and Harmless (Hữu ích, Trung thực và Vô hại). Để thực hiện các nguyên tắc này, Anthropic đã phát triển phương pháp huấn luyện riêng — Constitutional AI (CAI).
Khác với RLHF truyền thống (học tăng cường từ phản hồi của con người), nơi các chuyên gia gán nhãn trực tiếp đánh giá câu trả lời của mô hình, CAI sử dụng «hiến pháp» — một tập hợp các nguyên tắc đạo đức rõ ràng, dựa trên đó mô hình được huấn luyện để tự đánh giá và điều chỉnh các câu trả lời của mình. Điều này làm cho quá trình có khả năng mở rộng, minh bạch và kiểm soát tốt hơn.
Kiến trúc và các công nghệ chính
Nền tảng Transformer
Cũng như các LLM hiện đại khác, Claude sử dụng kiến trúc transformer-decoder, tự hồi quy sinh ra văn bản từng token một. Tuy nhiên, Anthropic đã thực hiện các cải tiến đáng kể nhằm nâng cao hiệu suất, an toàn và khả năng kiểm soát.
Constitutional AI (CAI)
Quá trình huấn luyện với CAI diễn ra theo hai giai đoạn:
- Giai đoạn học có giám sát (Supervised Learning): Mô hình sinh ra các câu trả lời cho các yêu cầu, sau đó một mô hình phê bình khác, dựa trên «hiến pháp», đánh giá chúng và đề xuất các chỉnh sửa. Dựa trên các chỉnh sửa này, mô hình gốc được fine-tuning thêm.
- Giai đoạn học tăng cường từ AI (RLAIF): Mô hình sinh ra các cặp câu trả lời, và mô hình phê bình chọn câu tốt hơn dựa trên «hiến pháp». Dữ liệu này được dùng để huấn luyện mô hình ưu tiên (reward model), sau đó được dùng làm tín hiệu để fine-tuning mô hình chính bằng các thuật toán tăng cường.
Cửa sổ ngữ cảnh dài và đa phương thức
Một trong những ưu điểm chính của Claude là cửa sổ ngữ cảnh rất lớn. Bắt đầu từ 100 nghìn token trong Claude 2, nó đã được tăng lên 200 nghìn trong Claude 3 và lên 1–2 triệu token trong các phiên bản 3.5 và 4. Điều này cho phép các mô hình phân tích toàn bộ sách, codebase hoặc bản ghi âm nhiều giờ trong một yêu cầu duy nhất.
Bắt đầu từ họ Claude 3, các mô hình trở nên đa phương thức, có khả năng xử lý hình ảnh cùng với văn bản.
Tư duy lai và khả năng tác nhân
Từ các phiên bản Claude 3.7 và 4, kiến trúc tư duy lai đã được triển khai. Nó cho phép các mô hình chuyển đổi giữa hai chế độ:
- Phản hồi nhanh: Chế độ tiêu chuẩn cho các tác vụ đơn giản.
- Tư duy mở rộng (Extended Thinking): Đối với các tác vụ phức tạp, mô hình dừng lại để «suy nghĩ», thực hiện các bước lý luận nội bộ, gọi công cụ (tìm kiếm web, thực thi mã) và hình thành câu trả lời có cơ sở hơn. Điều này làm cho quá trình minh bạch và đáng tin cậy hơn.
Quá trình phát triển các mô hình Claude
Claude 1 (2023)
- Claude (14 tháng 3 năm 2023): phiên bản đầu tiên được công bố công khai. Đồng thời, hai cấu hình đã được công bố — Claude (chính) và Claude Instant (nhanh hơn và rẻ hơn).[3]
- 100K Context Window (11 tháng 5 năm 2023): mở rộng cửa sổ ngữ cảnh của Claude từ 9.000 lên 100.000 token. Đây là một bản cập nhật riêng biệt sau lần ra mắt ban đầu, không phải một phần của bản phát hành tháng 3.[4]
Claude 2 (2023)
- Claude 2 (11 tháng 7 năm 2023): bản cập nhật lớn với các cải tiến về lập trình, toán học và lý luận. Mô hình trở nên khả dụng qua API và phiên bản beta công khai claude.ai. Hỗ trợ đầu vào lên tới 100.000 token; trong bài kiểm tra Codex HumanEval, Anthropic ghi nhận kết quả 71,2%.[5]
- Claude 2.1 (21 tháng 11 năm 2023): phiên bản với cửa sổ ngữ cảnh 200.000 token, giảm xu hướng ảo giác, hỗ trợ system prompt và tính năng beta tool use.[6]
Claude 3 (2024)
- Claude 3 (4 tháng 3 năm 2024): họ mô hình mới bao gồm Haiku (nhanh nhất), Sonnet (cân bằng) và Opus (mạnh nhất). Anthropic định vị thế hệ này là cột mốc mới trên một loạt benchmark nhận thức.[7]
- Những thay đổi chính: khả năng thị giác và đa phương thức mạnh mẽ (phân tích hình ảnh, biểu đồ và sơ đồ), giảm đáng kể các từ chối vô lý, tăng độ chính xác, cùng với ngữ cảnh 200.000 token ngay từ đầu. Đối với một số khách hàng nhất định, Anthropic cũng cho biết khả năng làm việc với đầu vào vượt quá 1 triệu token.[8]
Claude 3.5 (2024)
- Claude 3.5 Sonnet (21 tháng 6 năm 2024): mô hình đầu tiên của họ 3.5. Theo tuyên bố của Anthropic, nó vượt trội hơn Claude 3 Opus trên một tập hợp đánh giá rộng, đồng thời duy trì tốc độ và chi phí của phân khúc trung cấp; công ty cũng riêng biệt lưu ý mức tăng tốc độ khoảng gấp đôi. Cửa sổ ngữ cảnh là 200.000 token.[9]
- Claude 3.5 Sonnet cập nhật và Claude 3.5 Haiku (22 tháng 10 năm 2024): bản cập nhật tháng 10 tăng cường khả năng trong lập trình tác nhân và sử dụng công cụ. Cùng lúc đó, Anthropic lần đầu tiên đưa tính năng Computer Use vào public beta, cho phép mô hình làm việc với giao diện máy tính: nhìn màn hình, di chuyển con trỏ, nhấn nút và nhập văn bản. Kết quả của 3.5 Sonnet cập nhật trên SWE-bench Verified tăng từ 33,4% lên 49,0%.[10]
Claude 3.7 và Claude 4 (2025)
- Claude 3.7 Sonnet (24 tháng 2 năm 2025): Anthropic giới thiệu đây là mô hình hybrid reasoning đầu tiên. Mô hình có thể phản hồi gần như tức thì hoặc sử dụng chế độ lý luận từng bước dài hơn. Đồng thời, Claude Code cũng được ra mắt.[11]
- Claude 4 (22 tháng 5 năm 2025): họ flagship mới, bao gồm Opus 4 và Sonnet 4. Cả hai mô hình được mô tả là lai: với các chế độ phản hồi nhanh và extended thinking. Anthropic đặc biệt nhấn mạnh extended thinking with tool use, parallel tool execution và các cải tiến bộ nhớ; Opus 4 được tuyên bố dẫn đầu trên SWE-bench với kết quả 72,5%.[12]
Claude 4.5–4.6 (cuối 2025 — đầu 2026)
- Claude Sonnet 4.5 (29 tháng 9 năm 2025): bản cập nhật đáng kể của dòng Sonnet với mức tăng chất lượng đáng chú ý trong lập trình, computer use, lý luận và toán học. Anthropic cũng lưu ý rằng mô hình duy trì sự tập trung vào các tác vụ nhiều bước phức tạp trong hơn 30 giờ.[13]
- Claude Opus 4.5 (24 tháng 11 năm 2025): phiên bản tiếp theo của Opus, mà Anthropic mô tả là đặc biệt mạnh trong lập trình, các kịch bản tác nhân và computer use.[14]
- Claude Opus 4.6 (5 tháng 2 năm 2026): mô hình Opus cập nhật với các cải tiến trong lập trình, code review, debugging và các tác vụ tác nhân kéo dài. Lần đầu tiên đối với dòng Opus, cửa sổ ngữ cảnh 1M token được công bố ở chế độ beta.[15]
- Claude Sonnet 4.6 (17 tháng 2 năm 2026): phiên bản Sonnet mạnh nhất tại thời điểm đó; Anthropic ghi nhận các cải tiến trong lập trình, computer use, long-context reasoning, agent planning, xử lý tri thức và thiết kế. Cũng như Opus 4.6, mô hình nhận được cửa sổ ngữ cảnh 1M token ở chế độ beta.[16]
Bảng tổng hợp các thế hệ Claude
| Thế hệ | Năm phát hành | Các phiên bản chính | Cửa sổ ngữ cảnh tối đa | Những đổi mới chính |
|---|---|---|---|---|
| Claude 1 | 2023 | Claude, Instant | 100.000 token | Bản phát hành công khai đầu tiên, ngữ cảnh lớn. |
| Claude 2 | 2023 | Claude 2, 2.1 | 200.000 token | Cải thiện lập trình và lý luận, tính sẵn dùng công khai. |
| Claude 3 | 2024 | Opus, Sonnet, Haiku | 200.000+ token | Đa phương thức (hình ảnh), vượt trội hơn GPT-4. |
| Claude 3.5 | 2024 | Sonnet, Haiku | 200.000+ token | Tăng tốc độ và trí thông minh, tính năng "Artifacts". |
| Claude 4 / 3.7 | 2025 | Opus, Sonnet | 200.000+ token | Tư duy lai, khả năng tác nhân, sử dụng công cụ. |
Ứng dụng và khả năng truy cập
Các mô hình Claude có thể truy cập qua nhiều kênh:
- Giao diện web claude.ai: Cung cấp quyền truy cập miễn phí (đến mô hình Sonnet) và các gói đăng ký trả phí (Pro, Max) với quyền truy cập vào các mô hình mạnh hơn (Opus) và giới hạn mở rộng.
- API cho nhà phát triển: Anthropic cung cấp API thương mại cho phép tích hợp Claude vào các ứng dụng của bên thứ ba. Giá cả thay đổi tùy theo mô hình (Haiku — rẻ nhất, Opus — đắt nhất).
- Nền tảng đám mây: Claude có thể truy cập qua Amazon Bedrock và Google Cloud Vertex AI, giúp đơn giản hóa việc sử dụng trong môi trường doanh nghiệp.
- Tích hợp: Claude được tích hợp vào các dịch vụ phổ biến như Slack, Notion, Quora (trong chatbot Poe).
Tài liệu tham khảo
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, tháng 3). Introducing the next generation of Claude.
- Anthropic (2025, tháng 5). Introducing Claude 4.
Liên kết
- Trang web chính thức của Anthropic
- Tài liệu dành cho nhà phát triển
Tài liệu
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).
Ghi chú
- ↑ «Dario Amodei». В Wikipedia [1]
- ↑ «Daniela Amodei». В Wikipedia [2]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.