Claude (Anthropic) (TH)

From Systems analysis Wiki
Jump to navigation Jump to search

Claude — คือกลุ่มโมเดลภาษาขนาดใหญ่ (LLM) แบบมัลติโมดัลที่พัฒนาโดยบริษัทวิจัย Anthropic

โมเดล Claude ที่สร้างบนสถาปัตยกรรม transformer นั้นถูกวางตำแหน่งให้เป็น AI-ผู้ช่วยที่มุ่งเน้นด้านความปลอดภัย ความเป็นประโยชน์ และความซื่อสัตย์ คุณลักษณะสำคัญในการพัฒนาคือวิธีการ Constitutional AI («AI แบบรัฐธรรมนูญ») ซึ่งมุ่งสร้างระบบที่ควบคุมได้และสอดคล้องกับจริยธรรม

ประวัติและปรัชญา

การก่อตั้งและพันธกิจของ Anthropic

บริษัท Anthropic ก่อตั้งขึ้นในปี 2021 โดยอดีตพนักงานอาวุโสของ OpenAI รวมถึงพี่น้อง Dario[1] และ Daniela Amodei[2] สาเหตุของการลาออกคือความขัดแย้งกับผู้บริหาร OpenAI เกี่ยวกับทิศทางการพัฒนา โดยเฉพาะความกังวลว่าการเป็นหุ้นส่วนกับ Microsoft และการมุ่งเน้นเชิงพาณิชย์ที่เพิ่มขึ้นอาจเป็นภัยต่อความมุ่งมั่นด้านความปลอดภัยของ AI

พันธกิจของ Anthropic คือ «การพัฒนาและดูแล AI ขั้นสูงเพื่อประโยชน์ระยะยาวของมนุษยชาติ» บริษัทจดทะเบียนในรูปแบบ Public Benefit Corporation (PBC) ในสหรัฐอเมริกา ซึ่งผูกพันตามกฎหมายให้สร้างสมดุลระหว่างผลประโยชน์ทางการเงินกับประโยชน์สาธารณะ แนวทางนี้ได้รับการสนับสนุนจากโครงสร้างการกำกับดูแลที่มีเอกลักษณ์เฉพาะด้วย Long-Term Benefit Trust (LTBT) ซึ่งเป็นองค์กรอิสระที่มีสิทธิ์มีอิทธิพลต่อการจัดองค์ประกอบของคณะกรรมการบริษัทเพื่อรับประกันความมุ่งมั่นต่อพันธกิจด้านความปลอดภัย

ปรัชญา: HHH และ Constitutional AI

รากฐานของพฤติกรรมโมเดล Claude คือสูตร HHH: Helpful, Honest, and Harmless (เป็นประโยชน์ ซื่อสัตย์ และไม่เป็นอันตราย) เพื่อนำหลักการเหล่านี้ไปปฏิบัติ Anthropic ได้พัฒนาวิธีการฝึกอบรมของตนเองที่เรียกว่า Constitutional AI (CAI)

ต่างจาก RLHF แบบดั้งเดิม (Reinforcement Learning จากข้อมูลป้อนกลับของมนุษย์) ที่ผู้บันทึกข้อมูลที่เป็นมนุษย์ประเมินคำตอบของโมเดลโดยตรง CAI ใช้ «รัฐธรรมนูญ» ซึ่งเป็นชุดหลักการจริยธรรมที่ชัดเจน ซึ่งโมเดลใช้เรียนรู้ที่จะประเมินและแก้ไขคำตอบของตนเองอย่างเป็นอิสระ ทำให้กระบวนการมีความสามารถในการขยายขนาด ความโปร่งใส และการควบคุมที่ดียิ่งขึ้น

สถาปัตยกรรมและเทคโนโลยีหลัก

พื้นฐาน Transformer

เช่นเดียวกับ LLM สมัยใหม่อื่นๆ Claude ใช้สถาปัตยกรรม transformer-decoder ที่สร้างข้อความแบบ autoregressive ทีละ token อย่างไรก็ตาม Anthropic ได้ทำการปรับปรุงที่สำคัญเพื่อเพิ่มประสิทธิภาพ ความปลอดภัย และความสามารถในการควบคุม

Constitutional AI (CAI)

กระบวนการฝึกอบรมด้วย CAI ดำเนินการสองขั้นตอน:

  1. ขั้นตอนการเรียนรู้แบบมีผู้สอน (Supervised Learning): โมเดลสร้างคำตอบสำหรับคำถาม จากนั้นโมเดลผู้วิจารณ์อีกตัวหนึ่งที่ใช้ «รัฐธรรมนูญ» เป็นแนวทางจะประเมินคำตอบเหล่านั้นและเสนอการแก้ไข โมเดลต้นฉบับจะถูก fine-tune บนพื้นฐานการแก้ไขเหล่านี้
  2. ขั้นตอนการเรียนรู้แบบ Reinforcement Learning จาก AI (RLAIF): โมเดลสร้างคู่คำตอบ และโมเดลผู้วิจารณ์เลือกคำตอบที่ดีที่สุดโดยอิงจาก «รัฐธรรมนูญ» ข้อมูลเหล่านี้ใช้ฝึก reward model ซึ่งต่อมาทำหน้าที่เป็นสัญญาณสำหรับการ fine-tune โมเดลหลักด้วยอัลกอริธึม Reinforcement Learning

Context Window ขนาดใหญ่และมัลติโมดัล

หนึ่งในข้อได้เปรียบหลักของ Claude คือ context window ที่ใหญ่มาก เริ่มต้นที่ 100,000 token ใน Claude 2 และเพิ่มขึ้นเป็น 200,000 token ใน Claude 3 และ 1-2 ล้าน token ในเวอร์ชัน 3.5 และ 4 ทำให้โมเดลสามารถวิเคราะห์หนังสือทั้งเล่ม codebase หรือข้อความการสนทนาหลายชั่วโมงภายในคำถามเดียว

ตั้งแต่กลุ่ม Claude 3 เป็นต้นมา โมเดลกลายเป็น มัลติโมดัล โดยได้รับความสามารถในการประมวลผลภาพควบคู่กับข้อความ

การคิดแบบ Hybrid และความสามารถเชิง Agent

ตั้งแต่เวอร์ชัน Claude 3.7 และ 4 เป็นต้นมา ได้มีการนำสถาปัตยกรรม การคิดแบบ Hybrid มาใช้ ซึ่งช่วยให้โมเดลสามารถสลับระหว่างสองโหมด:

  • การตอบสนองรวดเร็ว: โหมดมาตรฐานสำหรับงานง่ายๆ
  • Extended Thinking (การคิดแบบขยาย): สำหรับงานที่ซับซ้อน โมเดลจะหยุดชั่วคราวเพื่อ «คิด» โดยดำเนินขั้นตอนการให้เหตุผลภายใน เรียกใช้เครื่องมือ (การค้นหาเว็บ การรันโค้ด) และสร้างคำตอบที่มีเหตุผลมากขึ้น ทำให้กระบวนการโปร่งใสและเชื่อถือได้มากขึ้น

วิวัฒนาการของโมเดล Claude

Claude 1 (2023)

  • Claude (14 มีนาคม 2023): เวอร์ชันแรกที่เปิดตัวต่อสาธารณะ พร้อมกันนั้นได้ประกาศสองรูปแบบ ได้แก่ Claude (หลัก) และ Claude Instant (เร็วกว่าและราคาถูกกว่า)[3]
  • 100K Context Window (11 พฤษภาคม 2023): การขยาย context window ของ Claude จาก 9,000 เป็น 100,000 token นี่เป็นการอัปเดตแยกต่างหากหลังการเปิดตัวครั้งแรก ไม่ใช่ส่วนหนึ่งของการเปิดตัวในเดือนมีนาคม[4]

Claude 2 (2023)

  • Claude 2 (11 กรกฎาคม 2023): การอัปเดตครั้งใหญ่พร้อมการปรับปรุงด้านการเขียนโค้ด คณิตศาสตร์ และการให้เหตุผล โมเดลพร้อมใช้งานผ่าน API และเวอร์ชัน beta สาธารณะที่ claude.ai รองรับ input สูงสุด 100,000 token โดย Anthropic รายงานผลการทดสอบ Codex HumanEval ที่ 71.2%[5]
  • Claude 2.1 (21 พฤศจิกายน 2023): เวอร์ชันที่มี context window 200,000 token ลดแนวโน้มการสร้างข้อมูลเท็จ รองรับ system prompts และมีฟีเจอร์เบต้า tool use[6]

Claude 3 (2024)

  • Claude 3 (4 มีนาคม 2024): กลุ่มโมเดลใหม่ประกอบด้วย Haiku (เร็วที่สุด) Sonnet (สมดุล) และ Opus (ทรงพลังที่สุด) Anthropic วางตำแหน่งรุ่นนี้ให้เป็นมาตรฐานใหม่บน benchmark ด้านการรู้คิดหลายรายการ[7]
  • การเปลี่ยนแปลงสำคัญ: ความสามารถด้านการมองเห็นและมัลติโมดัลที่แข็งแกร่ง (การวิเคราะห์ภาพ กราฟ และแผนภาพ) การลดการปฏิเสธที่ไม่มีเหตุผลอย่างเห็นได้ชัด ความแม่นยำที่สูงขึ้น รวมถึง 200,000 token context ตั้งแต่เริ่มต้น สำหรับลูกค้าบางราย Anthropic ยังระบุถึงความสามารถในการรองรับ input เกิน 1 ล้าน token[8]

Claude 3.5 (2024)

  • Claude 3.5 Sonnet (21 มิถุนายน 2024): โมเดลแรกในกลุ่ม 3.5 ตาม Anthropic โมเดลนี้มีประสิทธิภาพเหนือกว่า Claude 3 Opus บน benchmark ชุดกว้าง ในขณะที่รักษาความเร็วและต้นทุนระดับกลาง โดยบริษัทยังระบุถึง ความเร็วที่เพิ่มขึ้นประมาณสองเท่า context window คือ 200,000 token[9]
  • Claude 3.5 Sonnet ที่อัปเดต และ Claude 3.5 Haiku (22 ตุลาคม 2024): การอัปเดตในเดือนตุลาคมเสริมความสามารถด้านการเขียนโค้ดเชิง agent และการใช้เครื่องมือ ในช่วงเวลาเดียวกัน Anthropic ได้เปิดตัวฟีเจอร์ Computer Use เป็น public beta ครั้งแรก ซึ่งช่วยให้โมเดลทำงานกับอินเทอร์เฟซคอมพิวเตอร์ได้ ทั้งการมองเห็นหน้าจอ การเลื่อนเคอร์เซอร์ การกดปุ่ม และการพิมพ์ข้อความ ผลลัพธ์บน SWE-bench Verified ของ 3.5 Sonnet ที่อัปเดตเพิ่มขึ้นจาก 33.4% เป็น 49.0%[10]

Claude 3.7 และ Claude 4 (2025)

  • Claude 3.7 Sonnet (24 กุมภาพันธ์ 2025): Anthropic แนะนำในฐานะ hybrid reasoning model ตัวแรก โมเดลสามารถตอบสนองได้เกือบทันที หรือใช้โหมดการให้เหตุผลแบบทีละขั้นตอนที่ยาวนานกว่า พร้อมกันนั้นได้เปิดตัว Claude Code[11]
  • Claude 4 (22 พฤษภาคม 2025): กลุ่มโมเดล flagship ใหม่ประกอบด้วย Opus 4 และ Sonnet 4 โมเดลทั้งสองถูกอธิบายว่าเป็น hybrid ที่มีโหมดการตอบสนองรวดเร็วและ extended thinking Anthropic เน้นย้ำเป็นพิเศษเกี่ยวกับ extended thinking with tool use, parallel tool execution และการปรับปรุงด้านหน่วยความจำ โดย Opus 4 ถูกประกาศเป็นผู้นำบน SWE-bench ด้วยผลลัพธ์ 72.5%[12]

Claude 4.5–4.6 (ปลายปี 2025 — ต้นปี 2026)

  • Claude Sonnet 4.5 (29 กันยายน 2025): การอัปเดตครั้งสำคัญของสาย Sonnet พร้อมคุณภาพที่เพิ่มขึ้นอย่างเห็นได้ชัดในด้านการเขียนโค้ด computer use การให้เหตุผล และคณิตศาสตร์ Anthropic ยังระบุว่าโมเดลรักษาโฟกัสในงานหลายขั้นตอนที่ซับซ้อนได้นานกว่า 30 ชั่วโมง[13]
  • Claude Opus 4.5 (24 พฤศจิกายน 2025): การปรับปรุง Opus รุ่นถัดไปที่ Anthropic อธิบายว่ามีความโดดเด่นเป็นพิเศษในด้านการเขียนโค้ด สถานการณ์เชิง agent และ computer use[14]
  • Claude Opus 4.6 (5 กุมภาพันธ์ 2026): โมเดล Opus ที่อัปเดตพร้อมการปรับปรุงด้านการเขียนโค้ด code review การ debugging และงาน agent ระยะยาว เป็นครั้งแรกสำหรับสาย Opus ที่มีการประกาศ 1M token context window ในโหมดเบต้า[15]
  • Claude Sonnet 4.6 (17 กุมภาพันธ์ 2026): เวอร์ชัน Sonnet ที่ทรงพลังที่สุดในขณะนั้น โดย Anthropic ระบุการปรับปรุงในด้านการเขียนโค้ด computer use, long-context reasoning, agent planning, knowledge work และ design เช่นเดียวกับ Opus 4.6 โมเดลได้รับ 1M token context window ในเวอร์ชัน beta[16]

ตารางสรุปรุ่น Claude

วิวัฒนาการของคุณลักษณะสำคัญของโมเดล Claude
รุ่น ปีที่เปิดตัว เวอร์ชันหลัก Context Window สูงสุด นวัตกรรมสำคัญ
Claude 1 2023 Claude, Instant 100,000 token การเปิดตัวต่อสาธารณะครั้งแรก, context ขนาดใหญ่
Claude 2 2023 Claude 2, 2.1 200,000 token การเขียนโค้ดและการให้เหตุผลที่ดีขึ้น, พร้อมใช้งานสาธารณะ
Claude 3 2024 Opus, Sonnet, Haiku 200,000+ token มัลติโมดัล (ภาพ), เหนือกว่า GPT-4
Claude 3.5 2024 Sonnet, Haiku 200,000+ token ความเร็วและสติปัญญาที่เพิ่มขึ้น, ฟีเจอร์ "Artifacts"
Claude 4 / 3.7 2025 Opus, Sonnet 200,000+ token การคิดแบบ Hybrid, ความสามารถเชิง Agent, การใช้เครื่องมือ

การใช้งานและการเข้าถึง

โมเดล Claude พร้อมใช้งานผ่านหลายช่องทาง:

  • เว็บอินเทอร์เฟซ claude.ai: ให้การเข้าถึงฟรี (สำหรับโมเดล Sonnet) และการสมัครสมาชิกแบบชำระเงิน (Pro, Max) พร้อมการเข้าถึงโมเดลที่ทรงพลังกว่า (Opus) และ limit ที่ขยายเพิ่ม
  • API สำหรับนักพัฒนา: Anthropic ให้บริการ API เชิงพาณิชย์ที่ช่วยให้สามารถรวม Claude เข้ากับแอปพลิเคชันของบุคคลที่สาม ราคาแตกต่างกันตามโมเดล (Haiku — ราคาถูกที่สุด, Opus — ราคาแพงที่สุด)
  • แพลตฟอร์มคลาวด์: Claude พร้อมใช้งานผ่าน Amazon Bedrock และ Google Cloud Vertex AI ซึ่งทำให้การใช้งานในสภาพแวดล้อมองค์กรง่ายขึ้น
  • การผสานรวม: Claude ถูกรวมเข้ากับบริการยอดนิยมเช่น Slack, Notion, Quora (ในแชทบอท Poe)

เอกสารอ้างอิง

  • Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Anthropic (2023). Claude's Constitution.
  • Anthropic (2024, มีนาคม). Introducing the next generation of Claude.
  • Anthropic (2025, พฤษภาคม). Introducing Claude 4.

ลิงก์ภายนอก

  • เว็บไซต์ทางการของ Anthropic
  • เอกสารสำหรับนักพัฒนา

บรรณานุกรม

  • Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
  • Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
  • Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
  • Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
  • Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
  • Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
  • Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
  • Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
  • Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
  • Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
  • Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).

หมายเหตุ

  1. «Dario Amodei». В Wikipedia [1]
  2. «Daniela Amodei». В Wikipedia [2]
  3. Introducing Claude. Anthropic. 14 марта 2023.
  4. Introducing 100K Context Windows. Anthropic. 11 мая 2023.
  5. Introducing Claude 2. Anthropic. 11 июля 2023.
  6. Introducing Claude 2.1. Anthropic. 21 ноября 2023.
  7. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  8. The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
  9. Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
  10. New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
  11. Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
  12. Introducing Claude 4. Anthropic. 22 мая 2025.
  13. Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
  14. Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
  15. Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
  16. Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.