Claude (Anthropic) (TH)
Claude — คือกลุ่มโมเดลภาษาขนาดใหญ่ (LLM) แบบมัลติโมดัลที่พัฒนาโดยบริษัทวิจัย Anthropic
โมเดล Claude ที่สร้างบนสถาปัตยกรรม transformer นั้นถูกวางตำแหน่งให้เป็น AI-ผู้ช่วยที่มุ่งเน้นด้านความปลอดภัย ความเป็นประโยชน์ และความซื่อสัตย์ คุณลักษณะสำคัญในการพัฒนาคือวิธีการ Constitutional AI («AI แบบรัฐธรรมนูญ») ซึ่งมุ่งสร้างระบบที่ควบคุมได้และสอดคล้องกับจริยธรรม
ประวัติและปรัชญา
การก่อตั้งและพันธกิจของ Anthropic
บริษัท Anthropic ก่อตั้งขึ้นในปี 2021 โดยอดีตพนักงานอาวุโสของ OpenAI รวมถึงพี่น้อง Dario[1] และ Daniela Amodei[2] สาเหตุของการลาออกคือความขัดแย้งกับผู้บริหาร OpenAI เกี่ยวกับทิศทางการพัฒนา โดยเฉพาะความกังวลว่าการเป็นหุ้นส่วนกับ Microsoft และการมุ่งเน้นเชิงพาณิชย์ที่เพิ่มขึ้นอาจเป็นภัยต่อความมุ่งมั่นด้านความปลอดภัยของ AI
พันธกิจของ Anthropic คือ «การพัฒนาและดูแล AI ขั้นสูงเพื่อประโยชน์ระยะยาวของมนุษยชาติ» บริษัทจดทะเบียนในรูปแบบ Public Benefit Corporation (PBC) ในสหรัฐอเมริกา ซึ่งผูกพันตามกฎหมายให้สร้างสมดุลระหว่างผลประโยชน์ทางการเงินกับประโยชน์สาธารณะ แนวทางนี้ได้รับการสนับสนุนจากโครงสร้างการกำกับดูแลที่มีเอกลักษณ์เฉพาะด้วย Long-Term Benefit Trust (LTBT) ซึ่งเป็นองค์กรอิสระที่มีสิทธิ์มีอิทธิพลต่อการจัดองค์ประกอบของคณะกรรมการบริษัทเพื่อรับประกันความมุ่งมั่นต่อพันธกิจด้านความปลอดภัย
ปรัชญา: HHH และ Constitutional AI
รากฐานของพฤติกรรมโมเดล Claude คือสูตร HHH: Helpful, Honest, and Harmless (เป็นประโยชน์ ซื่อสัตย์ และไม่เป็นอันตราย) เพื่อนำหลักการเหล่านี้ไปปฏิบัติ Anthropic ได้พัฒนาวิธีการฝึกอบรมของตนเองที่เรียกว่า Constitutional AI (CAI)
ต่างจาก RLHF แบบดั้งเดิม (Reinforcement Learning จากข้อมูลป้อนกลับของมนุษย์) ที่ผู้บันทึกข้อมูลที่เป็นมนุษย์ประเมินคำตอบของโมเดลโดยตรง CAI ใช้ «รัฐธรรมนูญ» ซึ่งเป็นชุดหลักการจริยธรรมที่ชัดเจน ซึ่งโมเดลใช้เรียนรู้ที่จะประเมินและแก้ไขคำตอบของตนเองอย่างเป็นอิสระ ทำให้กระบวนการมีความสามารถในการขยายขนาด ความโปร่งใส และการควบคุมที่ดียิ่งขึ้น
สถาปัตยกรรมและเทคโนโลยีหลัก
พื้นฐาน Transformer
เช่นเดียวกับ LLM สมัยใหม่อื่นๆ Claude ใช้สถาปัตยกรรม transformer-decoder ที่สร้างข้อความแบบ autoregressive ทีละ token อย่างไรก็ตาม Anthropic ได้ทำการปรับปรุงที่สำคัญเพื่อเพิ่มประสิทธิภาพ ความปลอดภัย และความสามารถในการควบคุม
Constitutional AI (CAI)
กระบวนการฝึกอบรมด้วย CAI ดำเนินการสองขั้นตอน:
- ขั้นตอนการเรียนรู้แบบมีผู้สอน (Supervised Learning): โมเดลสร้างคำตอบสำหรับคำถาม จากนั้นโมเดลผู้วิจารณ์อีกตัวหนึ่งที่ใช้ «รัฐธรรมนูญ» เป็นแนวทางจะประเมินคำตอบเหล่านั้นและเสนอการแก้ไข โมเดลต้นฉบับจะถูก fine-tune บนพื้นฐานการแก้ไขเหล่านี้
- ขั้นตอนการเรียนรู้แบบ Reinforcement Learning จาก AI (RLAIF): โมเดลสร้างคู่คำตอบ และโมเดลผู้วิจารณ์เลือกคำตอบที่ดีที่สุดโดยอิงจาก «รัฐธรรมนูญ» ข้อมูลเหล่านี้ใช้ฝึก reward model ซึ่งต่อมาทำหน้าที่เป็นสัญญาณสำหรับการ fine-tune โมเดลหลักด้วยอัลกอริธึม Reinforcement Learning
Context Window ขนาดใหญ่และมัลติโมดัล
หนึ่งในข้อได้เปรียบหลักของ Claude คือ context window ที่ใหญ่มาก เริ่มต้นที่ 100,000 token ใน Claude 2 และเพิ่มขึ้นเป็น 200,000 token ใน Claude 3 และ 1-2 ล้าน token ในเวอร์ชัน 3.5 และ 4 ทำให้โมเดลสามารถวิเคราะห์หนังสือทั้งเล่ม codebase หรือข้อความการสนทนาหลายชั่วโมงภายในคำถามเดียว
ตั้งแต่กลุ่ม Claude 3 เป็นต้นมา โมเดลกลายเป็น มัลติโมดัล โดยได้รับความสามารถในการประมวลผลภาพควบคู่กับข้อความ
การคิดแบบ Hybrid และความสามารถเชิง Agent
ตั้งแต่เวอร์ชัน Claude 3.7 และ 4 เป็นต้นมา ได้มีการนำสถาปัตยกรรม การคิดแบบ Hybrid มาใช้ ซึ่งช่วยให้โมเดลสามารถสลับระหว่างสองโหมด:
- การตอบสนองรวดเร็ว: โหมดมาตรฐานสำหรับงานง่ายๆ
- Extended Thinking (การคิดแบบขยาย): สำหรับงานที่ซับซ้อน โมเดลจะหยุดชั่วคราวเพื่อ «คิด» โดยดำเนินขั้นตอนการให้เหตุผลภายใน เรียกใช้เครื่องมือ (การค้นหาเว็บ การรันโค้ด) และสร้างคำตอบที่มีเหตุผลมากขึ้น ทำให้กระบวนการโปร่งใสและเชื่อถือได้มากขึ้น
วิวัฒนาการของโมเดล Claude
Claude 1 (2023)
- Claude (14 มีนาคม 2023): เวอร์ชันแรกที่เปิดตัวต่อสาธารณะ พร้อมกันนั้นได้ประกาศสองรูปแบบ ได้แก่ Claude (หลัก) และ Claude Instant (เร็วกว่าและราคาถูกกว่า)[3]
- 100K Context Window (11 พฤษภาคม 2023): การขยาย context window ของ Claude จาก 9,000 เป็น 100,000 token นี่เป็นการอัปเดตแยกต่างหากหลังการเปิดตัวครั้งแรก ไม่ใช่ส่วนหนึ่งของการเปิดตัวในเดือนมีนาคม[4]
Claude 2 (2023)
- Claude 2 (11 กรกฎาคม 2023): การอัปเดตครั้งใหญ่พร้อมการปรับปรุงด้านการเขียนโค้ด คณิตศาสตร์ และการให้เหตุผล โมเดลพร้อมใช้งานผ่าน API และเวอร์ชัน beta สาธารณะที่ claude.ai รองรับ input สูงสุด 100,000 token โดย Anthropic รายงานผลการทดสอบ Codex HumanEval ที่ 71.2%[5]
- Claude 2.1 (21 พฤศจิกายน 2023): เวอร์ชันที่มี context window 200,000 token ลดแนวโน้มการสร้างข้อมูลเท็จ รองรับ system prompts และมีฟีเจอร์เบต้า tool use[6]
Claude 3 (2024)
- Claude 3 (4 มีนาคม 2024): กลุ่มโมเดลใหม่ประกอบด้วย Haiku (เร็วที่สุด) Sonnet (สมดุล) และ Opus (ทรงพลังที่สุด) Anthropic วางตำแหน่งรุ่นนี้ให้เป็นมาตรฐานใหม่บน benchmark ด้านการรู้คิดหลายรายการ[7]
- การเปลี่ยนแปลงสำคัญ: ความสามารถด้านการมองเห็นและมัลติโมดัลที่แข็งแกร่ง (การวิเคราะห์ภาพ กราฟ และแผนภาพ) การลดการปฏิเสธที่ไม่มีเหตุผลอย่างเห็นได้ชัด ความแม่นยำที่สูงขึ้น รวมถึง 200,000 token context ตั้งแต่เริ่มต้น สำหรับลูกค้าบางราย Anthropic ยังระบุถึงความสามารถในการรองรับ input เกิน 1 ล้าน token[8]
Claude 3.5 (2024)
- Claude 3.5 Sonnet (21 มิถุนายน 2024): โมเดลแรกในกลุ่ม 3.5 ตาม Anthropic โมเดลนี้มีประสิทธิภาพเหนือกว่า Claude 3 Opus บน benchmark ชุดกว้าง ในขณะที่รักษาความเร็วและต้นทุนระดับกลาง โดยบริษัทยังระบุถึง ความเร็วที่เพิ่มขึ้นประมาณสองเท่า context window คือ 200,000 token[9]
- Claude 3.5 Sonnet ที่อัปเดต และ Claude 3.5 Haiku (22 ตุลาคม 2024): การอัปเดตในเดือนตุลาคมเสริมความสามารถด้านการเขียนโค้ดเชิง agent และการใช้เครื่องมือ ในช่วงเวลาเดียวกัน Anthropic ได้เปิดตัวฟีเจอร์ Computer Use เป็น public beta ครั้งแรก ซึ่งช่วยให้โมเดลทำงานกับอินเทอร์เฟซคอมพิวเตอร์ได้ ทั้งการมองเห็นหน้าจอ การเลื่อนเคอร์เซอร์ การกดปุ่ม และการพิมพ์ข้อความ ผลลัพธ์บน SWE-bench Verified ของ 3.5 Sonnet ที่อัปเดตเพิ่มขึ้นจาก 33.4% เป็น 49.0%[10]
Claude 3.7 และ Claude 4 (2025)
- Claude 3.7 Sonnet (24 กุมภาพันธ์ 2025): Anthropic แนะนำในฐานะ hybrid reasoning model ตัวแรก โมเดลสามารถตอบสนองได้เกือบทันที หรือใช้โหมดการให้เหตุผลแบบทีละขั้นตอนที่ยาวนานกว่า พร้อมกันนั้นได้เปิดตัว Claude Code[11]
- Claude 4 (22 พฤษภาคม 2025): กลุ่มโมเดล flagship ใหม่ประกอบด้วย Opus 4 และ Sonnet 4 โมเดลทั้งสองถูกอธิบายว่าเป็น hybrid ที่มีโหมดการตอบสนองรวดเร็วและ extended thinking Anthropic เน้นย้ำเป็นพิเศษเกี่ยวกับ extended thinking with tool use, parallel tool execution และการปรับปรุงด้านหน่วยความจำ โดย Opus 4 ถูกประกาศเป็นผู้นำบน SWE-bench ด้วยผลลัพธ์ 72.5%[12]
Claude 4.5–4.6 (ปลายปี 2025 — ต้นปี 2026)
- Claude Sonnet 4.5 (29 กันยายน 2025): การอัปเดตครั้งสำคัญของสาย Sonnet พร้อมคุณภาพที่เพิ่มขึ้นอย่างเห็นได้ชัดในด้านการเขียนโค้ด computer use การให้เหตุผล และคณิตศาสตร์ Anthropic ยังระบุว่าโมเดลรักษาโฟกัสในงานหลายขั้นตอนที่ซับซ้อนได้นานกว่า 30 ชั่วโมง[13]
- Claude Opus 4.5 (24 พฤศจิกายน 2025): การปรับปรุง Opus รุ่นถัดไปที่ Anthropic อธิบายว่ามีความโดดเด่นเป็นพิเศษในด้านการเขียนโค้ด สถานการณ์เชิง agent และ computer use[14]
- Claude Opus 4.6 (5 กุมภาพันธ์ 2026): โมเดล Opus ที่อัปเดตพร้อมการปรับปรุงด้านการเขียนโค้ด code review การ debugging และงาน agent ระยะยาว เป็นครั้งแรกสำหรับสาย Opus ที่มีการประกาศ 1M token context window ในโหมดเบต้า[15]
- Claude Sonnet 4.6 (17 กุมภาพันธ์ 2026): เวอร์ชัน Sonnet ที่ทรงพลังที่สุดในขณะนั้น โดย Anthropic ระบุการปรับปรุงในด้านการเขียนโค้ด computer use, long-context reasoning, agent planning, knowledge work และ design เช่นเดียวกับ Opus 4.6 โมเดลได้รับ 1M token context window ในเวอร์ชัน beta[16]
ตารางสรุปรุ่น Claude
| รุ่น | ปีที่เปิดตัว | เวอร์ชันหลัก | Context Window สูงสุด | นวัตกรรมสำคัญ |
|---|---|---|---|---|
| Claude 1 | 2023 | Claude, Instant | 100,000 token | การเปิดตัวต่อสาธารณะครั้งแรก, context ขนาดใหญ่ |
| Claude 2 | 2023 | Claude 2, 2.1 | 200,000 token | การเขียนโค้ดและการให้เหตุผลที่ดีขึ้น, พร้อมใช้งานสาธารณะ |
| Claude 3 | 2024 | Opus, Sonnet, Haiku | 200,000+ token | มัลติโมดัล (ภาพ), เหนือกว่า GPT-4 |
| Claude 3.5 | 2024 | Sonnet, Haiku | 200,000+ token | ความเร็วและสติปัญญาที่เพิ่มขึ้น, ฟีเจอร์ "Artifacts" |
| Claude 4 / 3.7 | 2025 | Opus, Sonnet | 200,000+ token | การคิดแบบ Hybrid, ความสามารถเชิง Agent, การใช้เครื่องมือ |
การใช้งานและการเข้าถึง
โมเดล Claude พร้อมใช้งานผ่านหลายช่องทาง:
- เว็บอินเทอร์เฟซ claude.ai: ให้การเข้าถึงฟรี (สำหรับโมเดล Sonnet) และการสมัครสมาชิกแบบชำระเงิน (Pro, Max) พร้อมการเข้าถึงโมเดลที่ทรงพลังกว่า (Opus) และ limit ที่ขยายเพิ่ม
- API สำหรับนักพัฒนา: Anthropic ให้บริการ API เชิงพาณิชย์ที่ช่วยให้สามารถรวม Claude เข้ากับแอปพลิเคชันของบุคคลที่สาม ราคาแตกต่างกันตามโมเดล (Haiku — ราคาถูกที่สุด, Opus — ราคาแพงที่สุด)
- แพลตฟอร์มคลาวด์: Claude พร้อมใช้งานผ่าน Amazon Bedrock และ Google Cloud Vertex AI ซึ่งทำให้การใช้งานในสภาพแวดล้อมองค์กรง่ายขึ้น
- การผสานรวม: Claude ถูกรวมเข้ากับบริการยอดนิยมเช่น Slack, Notion, Quora (ในแชทบอท Poe)
เอกสารอ้างอิง
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, มีนาคม). Introducing the next generation of Claude.
- Anthropic (2025, พฤษภาคม). Introducing Claude 4.
ลิงก์ภายนอก
- เว็บไซต์ทางการของ Anthropic
- เอกสารสำหรับนักพัฒนา
บรรณานุกรม
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).
หมายเหตุ
- ↑ «Dario Amodei». В Wikipedia [1]
- ↑ «Daniela Amodei». В Wikipedia [2]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.