Claude (Anthropic) (KO)
Claude — Anthropic 연구 회사가 개발한 멀티모달 대형 언어 모델(LLM) 패밀리입니다.
Transformer 아키텍처를 기반으로 구축된 Claude 모델은 안전성, 유용성, 정직성을 지향하는 AI 어시스턴트로 포지셔닝됩니다. 개발의 핵심 특징은 관리 가능하고 윤리적으로 일관된 시스템을 만들기 위한 Constitutional AI(「헌법적 AI」) 방법론입니다.
역사와 철학
Anthropic의 설립과 사명
Anthropic은 남매인 다리오[1]와 다니엘라 아모데이[2]를 포함한 OpenAI 전 고위 직원들이 2021년에 설립했습니다. 퇴사의 이유는 OpenAI 경영진과의 방향성 갈등 때문이었으며, 특히 Microsoft와의 파트너십 및 증가하는 상업화가 AI 안전성에 대한 헌신을 위협할 수 있다는 우려에서 비롯되었습니다.
Anthropicの 사명은 「인류의 장기적 이익을 위한 최첨단 AI 개발 및 유지」입니다. 회사는 미국에서 Public Benefit Corporation(PBC)으로 등록되어 있으며, 이는 법적으로 재정적 이익과 공익 사이의 균형을 유지하도록 의무화합니다. 이 접근법은 사명에 대한 안전 헌신을 보장하기 위해 이사회 구성에 영향을 미칠 권한을 가진 독립 기관인 Long-Term Benefit Trust(LTBT)를 갖춘 독특한 지배 구조로 뒷받침됩니다.
철학: HHH와 Constitutional AI
Claude 모델 행동의 기반은 HHH 공식입니다: Helpful, Honest, and Harmless(유용하고, 정직하고, 무해함). 이 원칙들을 구현하기 위해 Anthropic은 자체 훈련 방법론인 Constitutional AI(CAI)를 개발했습니다.
사람 어노테이터가 모델 응답을 직접 평가하는 전통적인 RLHF(인간 피드백 강화 학습)와 달리, CAI는 「헌법」—명시적인 윤리 원칙의 집합—을 사용하여 모델이 자체적으로 응답을 평가하고 수정하도록 훈련합니다. 이는 프로세스를 더 확장 가능하고, 투명하며, 제어 가능하게 만듭니다.
아키텍처와 핵심 기술
Transformer 기반
다른 현대적인 LLM과 마찬가지로 Claude는 토큰 단위로 텍스트를 자기회귀적으로 생성하는 decoder-only Transformer 아키텍처를 사용합니다. 그러나 Anthropic은 성능, 안전성, 제어 가능성 향상을 위한 중요한 개선을 도입했습니다.
Constitutional AI(CAI)
CAI를 활용한 훈련 과정은 두 단계로 진행됩니다:
- Supervised Learning 단계: 모델이 요청에 대한 응답을 생성하고, 「헌법」에 따라 안내되는 다른 비평 모델이 이를 평가하고 수정안을 제안합니다. 이 수정안을 기반으로 원래 모델이 fine-tuning됩니다.
- RLAIF(AI 피드백 강화 학습) 단계: 모델이 응답 쌍을 생성하고, 비평 모델이 「헌법」을 기반으로 더 나은 응답을 선택합니다. 이 데이터는 선호도 모델(reward model)을 훈련하는 데 사용되며, 이후 강화 학습 알고리즘을 통해 기본 모델의 fine-tuning을 위한 신호로 활용됩니다.
긴 컨텍스트와 멀티모달리티
Claude의 주요 장점 중 하나는 매우 큰 컨텍스트 윈도우입니다. Claude 2의 10만 토큰부터 시작하여 Claude 3에서 20만 토큰으로, 버전 3.5와 4에서는 100만~200만 토큰으로 확대되었습니다. 이를 통해 모델은 단일 요청 내에서 책 전체, 코드베이스, 또는 수 시간 분량의 트랜스크립트를 분석할 수 있습니다.
Claude 3 패밀리부터 모델은 멀티모달이 되어 텍스트와 함께 이미지를 처리하는 능력을 갖추게 되었습니다.
하이브리드 추론과 에이전트 기능
Claude 3.7과 4 버전부터 하이브리드 추론 아키텍처가 도입되었습니다. 이를 통해 모델은 두 가지 모드 사이를 전환할 수 있습니다:
- 빠른 응답: 간단한 작업을 위한 표준 모드.
- Extended Thinking(확장 추론): 복잡한 작업의 경우 모델이 잠시 멈추어 「생각」하며, 내부 추론 단계를 수행하고, 도구(웹 검색, 코드 실행)를 호출하여 더 근거 있는 답변을 형성합니다. 이는 프로세스를 더 투명하고 신뢰할 수 있게 만듭니다.
Claude 모델의 진화
Claude 1 (2023)
- Claude (2023년 3월 14일): 최초로 공개된 모델 버전. 동시에 두 가지 구성—Claude(기본)와 Claude Instant(더 빠르고 저렴한)—이 발표되었습니다.[3]
- 100K Context Window (2023년 5월 11일): Claude의 컨텍스트 윈도우가 9,000에서 100,000 토큰으로 확장. 이는 3월 릴리스의 일부가 아닌 초기 출시 이후의 별도 업데이트였습니다.[4]
Claude 2 (2023)
- Claude 2 (2023년 7월 11일): 코딩, 수학, 추론에서 개선된 주요 업데이트. 모델은 API와 공개 beta인 claude.ai를 통해 사용 가능해졌습니다. 최대 100,000 토큰 입력을 지원하며, Codex HumanEval 테스트에서 Anthropic은 71.2%의 결과를 보고했습니다.[5]
- Claude 2.1 (2023년 11월 21일): 200,000 토큰 컨텍스트 윈도우, 감소된 환각 경향, system prompt 지원, 베타 기능인 tool use를 갖춘 버전.[6]
Claude 3 (2024)
- Claude 3 (2024년 3월 4일): Haiku(가장 빠름), Sonnet(균형 잡힌), Opus(가장 강력함)를 포함하는 새로운 모델 패밀리. Anthropic은 이 세대를 여러 인지 benchmark에서 새로운 기준으로 포지셔닝했습니다.[7]
- 주요 변경사항: 강력한 시각적 및 멀티모달 기능(이미지, 그래프, 다이어그램 분석), 근거 없는 거절의 현저한 감소, 정확도 향상, 출시 시 200,000 토큰 컨텍스트. 일부 고객을 위해 Anthropic은 100만 토큰 이상의 입력 처리 가능성도 언급했습니다.[8]
Claude 3.5 (2024)
- Claude 3.5 Sonnet (2024년 6월 21일): 3.5 패밀리의 첫 번째 모델. Anthropic의 발표에 따르면, 중간급의 속도와 비용을 유지하면서 광범위한 평가에서 Claude 3 Opus를 능가했으며, 약 2배의 속도 향상도 별도로 언급했습니다. 컨텍스트 윈도우는 200,000 토큰이었습니다.[9]
- 업데이트된 Claude 3.5 Sonnet과 Claude 3.5 Haiku (2024년 10월 22일): 10월 업데이트로 에이전트 코딩과 도구 사용 기능이 강화되었습니다. 이때 Anthropic은 처음으로 Computer Use 기능을 public beta로 출시했으며, 이를 통해 모델이 컴퓨터 인터페이스와 상호작용—화면 보기, 커서 이동, 버튼 클릭, 텍스트 입력—할 수 있게 되었습니다. 업데이트된 3.5 Sonnet의 SWE-bench Verified 점수는 33.4%에서 49.0%로 향상되었습니다.[10]
Claude 3.7과 Claude 4 (2025)
- Claude 3.7 Sonnet (2025년 2월 24일): Anthropic이 최초의 hybrid reasoning model로 소개했습니다. 모델은 거의 즉각적으로 응답하거나 더 길고 단계적인 추론 모드를 사용할 수 있었습니다. 동시에 Claude Code도 소개되었습니다.[11]
- Claude 4 (2025년 5월 22일): Opus 4와 Sonnet 4를 포함하는 새로운 플래그십 패밀리. 두 모델 모두 빠른 응답 모드와 extended thinking 모드를 갖춘 하이브리드로 설명되었습니다. Anthropic은 extended thinking with tool use, parallel tool execution 및 메모리 개선을 별도로 강조했으며, Opus 4는 72.5%의 결과로 SWE-bench 리더로 발표되었습니다.[12]
Claude 4.5–4.6 (2025년 말 – 2026년 초)
- Claude Sonnet 4.5 (2025년 9월 29일): 코딩, computer use, 추론 및 수학에서 눈에 띄는 품질 향상을 갖춘 Sonnet 라인의 중요한 업데이트. Anthropic은 또한 모델이 복잡한 다단계 작업에서 30시간 이상 집중력을 유지한다고 언급했습니다.[13]
- Claude Opus 4.5 (2025년 11월 24일): Anthropic이 코딩, 에이전트 시나리오 및 computer use에서 특히 강력하다고 설명한 Opus의 다음 이터레이션.[14]
- Claude Opus 4.6 (2026년 2월 5일): 코딩, code review, debugging 및 장기 에이전트 작업에서 개선된 업데이트된 Opus 모델. Opus 라인에서 처음으로 베타 모드에서 1M 토큰 컨텍스트 윈도우가 발표되었습니다.[15]
- Claude Sonnet 4.6 (2026년 2월 17일): 당시 가장 강력한 Sonnet 버전으로, Anthropic은 코딩, computer use, long-context reasoning, agent planning, 지식 작업 및 디자인에서의 개선을 언급했습니다. Opus 4.6과 마찬가지로 베타에서 1M 토큰 컨텍스트 윈도우를 갖추었습니다.[16]
Claude 세대 요약 표
| 세대 | 출시 연도 | 주요 버전 | 최대 컨텍스트 윈도우 | 핵심 혁신 |
|---|---|---|---|---|
| Claude 1 | 2023 | Claude, Instant | 100,000 토큰 | 최초 공개 릴리스, 대용량 컨텍스트. |
| Claude 2 | 2023 | Claude 2, 2.1 | 200,000 토큰 | 개선된 코딩 및 추론, 일반 가용성. |
| Claude 3 | 2024 | Opus, Sonnet, Haiku | 200,000+ 토큰 | 멀티모달리티(이미지), GPT-4 능가. |
| Claude 3.5 | 2024 | Sonnet, Haiku | 200,000+ 토큰 | 속도 및 지능 향상, "Artifacts" 기능. |
| Claude 4 / 3.7 | 2025 | Opus, Sonnet | 200,000+ 토큰 | 하이브리드 추론, 에이전트 기능, 도구 사용. |
활용과 가용성
Claude 모델은 여러 채널을 통해 이용 가능합니다:
- 웹 인터페이스 claude.ai: 무료 접근(Sonnet 모델)과 더 강력한 모델(Opus) 및 확장된 한도를 포함한 유료 구독(Pro, Max)을 제공합니다.
- 개발자 API: Anthropic은 Claude를 서드파티 애플리케이션에 통합할 수 있는 상업적 API를 제공합니다. 가격은 모델에 따라 다양합니다(Haiku—가장 저렴, Opus—가장 비싼).
- 클라우드 플랫폼: Claude는 Amazon Bedrock과 Google Cloud Vertex AI를 통해 이용 가능하여 기업 환경에서의 사용을 용이하게 합니다.
- 통합: Claude는 Slack, Notion, Quora(챗봇 Poe)와 같은 인기 서비스에 통합되어 있습니다.
참고 문헌
- Anthropic (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Anthropic (2023). Claude's Constitution.
- Anthropic (2024, 3월). Introducing the next generation of Claude.
- Anthropic (2025, 5월). Introducing Claude 4.
링크
- Anthropic 공식 웹사이트
- 개발자 문서
참고 문헌
- Ouyang, L. et al. (2022). Training Language Models to Follow Instructions with Human Feedback. arXiv:2203.02155.
- Bai, Y. et al. (2022). Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback. arXiv:2204.05862.
- Bai, Y. et al. (2022). Constitutional AI: Harmlessness from AI Feedback. arXiv:2212.08073.
- Bulatov, A. et al. (2023). Scaling Transformer to 1M Tokens and Beyond with RMT. arXiv:2304.11062.
- Jimenez, C. E. et al. (2023). SWE-bench: Can Language Models Resolve Real-World GitHub Issues?. arXiv:2310.06770.
- Yuan, W. et al. (2024). Self-Rewarding Language Models. arXiv:2401.10020.
- Yang, A. et al. (2024). Context Parallelism for Scalable Million-Token Inference. arXiv:2411.01783.
- Miranda, L. J. V. et al. (2024). Hybrid Preferences: Learning to Route Instances for Human vs AI Feedback. arXiv:2410.19133.
- Chittepu, Y. et al. (2025). Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints. arXiv:2506.08266.
- Yuan, W. et al. (2025). Process-based Self-Rewarding Language Models. arXiv:2503.03746.
- Yang, B. et al. (2025). Long Context Windows in Generative AI: An AI Atlas Report. [3] (tech-report, open review).
주석
- ↑ «Dario Amodei». В Wikipedia [1]
- ↑ «Daniela Amodei». В Wikipedia [2]
- ↑ Introducing Claude. Anthropic. 14 марта 2023.
- ↑ Introducing 100K Context Windows. Anthropic. 11 мая 2023.
- ↑ Introducing Claude 2. Anthropic. 11 июля 2023.
- ↑ Introducing Claude 2.1. Anthropic. 21 ноября 2023.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ The Claude 3 model family: Opus, Sonnet, Haiku. Anthropic. 4 марта 2024.
- ↑ Introducing Claude 3.5 Sonnet. Anthropic. 21 июня 2024.
- ↑ New Claude 3.5 Sonnet and Claude 3.5 Haiku, plus desktop automation. Anthropic. 22 октября 2024.
- ↑ Claude 3.7 Sonnet and Claude Code. Anthropic. 24 февраля 2025.
- ↑ Introducing Claude 4. Anthropic. 22 мая 2025.
- ↑ Introducing Claude Sonnet 4.5. Anthropic. 29 сентября 2025.
- ↑ Introducing Claude Opus 4.5. Anthropic. 24 ноября 2025.
- ↑ Introducing Claude Opus 4.6. Anthropic. 5 февраля 2026.
- ↑ Introducing Claude Sonnet 4.6. Anthropic. 17 февраля 2026.