Claude를 처음 쓸 때 모델 선택 드롭다운에서 멈추게 된다. Opus, Sonnet, Haiku — 이름만 봐서는 뭐가 다른지 전혀 알 수 없다. 2026년 5~6월 기준 최신 라인업을 성능·속도·비용 세 가지로 나눠 비교하고, 어떤 작업에 어떤 모델이 맞는지 선택 기준까지 정리했다.
클로드 모델 패밀리 — Opus·Sonnet·Haiku의 역할 구분

클로드 모델 패밀리는 지능 수준과 처리 속도에 따라 Opus·Sonnet·Haiku 세 계층으로 나뉜다.
각 이름은 단일 모델이 아니다. 버전이 계속 갱신되는 계열이다. 2026년 6월 기준 최신 버전은 Opus 4.8(2026년 5월 출시), Sonnet 4.6(2026년 2월 출시), Haiku 4.5다. 숫자가 클수록 최신이지만, 계열마다 버전이 따로 올라가기 때문에 Opus 4.8과 Sonnet 4.6의 번호를 직접 비교하면 안 된다.
- Opus 4.8 — 가장 높은 지능. 복잡한 추론과 장시간 에이전트 작업 특화.
- Sonnet 4.6 — 성능과 속도의 균형. 대부분의 실무 작업 커버.
- Haiku 4.5 — 가장 빠르고 저렴. 분류·태깅·반복 작업에 적합.
패턴이 단순하다. Opus가 무겁고 느리지만 정확하고, Haiku가 가볍고 빠르며, Sonnet이 그 중간이다. 대부분의 일상적 작업은 이 중간 어딘가에 속한다. Anthropic의 공식 권고도 “잘 모르겠으면 Sonnet으로 시작하라”다.
Opus 4.8 vs Sonnet 4.6 — 성능 수치로 보는 실력 차이
Opus 4.8은 코딩·에이전트 작업에서 Sonnet 4.6보다 유의미하게 앞선다.
코딩 벤치마크 SWE-bench Verified 기준으로 Opus 4.8은 88.6점, Sonnet 4.6은 79.6점이다. 9점 차다. 단순 코드 스니펫 생성보다는 수천 스텝짜리 자율 에이전트 작업에서 이 격차가 체감으로 드러난다. 반면 일반 질의응답(Google-Proof Q&A)에서는 Opus 4.8이 93.6, Sonnet 4.6이 89.9로 3.7점 차에 그친다. 글쓰기, 요약, 번역 같은 작업이라면 두 모델의 결과물이 크게 다르지 않다.
컨텍스트 윈도우 차이가 실질적으로 더 결정적인 경우가 많다. Opus 4.8은 입력 토큰 100만 개를 처리하고, Sonnet 4.6은 20만 개다. 코드베이스 전체나 수백 페이지 분량의 문서를 한 번에 넘겨야 하는 작업이라면 Opus가 사실상 유일한 선택이 된다.
| 항목 | Opus 4.8 | Sonnet 4.6 |
|---|---|---|
| SWE-bench Verified | 88.6 | 79.6 |
| 입력 컨텍스트 윈도우 | 100만 토큰 | 20만 토큰 |
| 최대 출력 토큰 | 128,000 | 64,000 |
| 출시 시기 | 2026년 5월 | 2026년 2월 |
한 줄로 정리하면, 텍스트·언어 작업은 두 모델이 엇비슷하고, 에이전트 실행과 긴 입력 처리에서 Opus가 명확히 앞선다.
속도와 비용 — API 요금부터 구독 플랜까지

API 기준으로 Sonnet 4.6은 Opus 4.8보다 입력 비용이 약 40% 저렴하고, 응답 속도는 약 2배 빠르다.
복수의 비교 자료에서 확인된 2026년 기준 API 가격은 아래와 같다. 최신 공식 가격은 Anthropic API 문서(docs.anthropic.com)에서 직접 확인해야 한다.
| 모델 | 입력 (1M 토큰) | 출력 (1M 토큰) |
|---|---|---|
| Opus 4.8 | $5 | $25 |
| Sonnet 4.6 | $3 | $15 |
| Haiku 4.5 | 공식 페이지 확인 필요 | |
claude.ai 구독 기준으로는 Free 플랜에서 Sonnet 4.6이 기본 제공된다. Opus 4.8을 쓰려면 Pro 이상 플랜이 필요하다. Pro 플랜 가격은 미국 기준 월 $20이며, 국내 원화 가격은 공식 claude.ai/pricing에서 확인해야 한다. Pro 플랜 안에서도 Opus 4.8을 쓰면 월간 사용 한도가 Sonnet보다 훨씬 빨리 소진된다. 무거운 작업만 Opus로 돌리고 나머지는 Sonnet으로 처리하는 방식이 실제로는 더 효율적이다.
Sonnet 4.6은 Opus 4.8 성능의 약 85%를, 비용은 약 20% 수준으로 처리한다. 대부분의 프로덕션 작업은 이 지점에서 충분하다.
응답 속도 측면에서 Sonnet 4.6은 초당 40~60토큰을 생성한다. Opus 4.8은 그 절반 수준이다. 실시간 대화형 인터페이스나 타이핑 반응 속도가 중요한 서비스라면 속도 차이가 사용자 경험에 직접 영향을 준다.
작업별 모델 선택 기준 — 이런 경우라면 이 모델
모델 선택의 기준은 작업 복잡도, 필요 컨텍스트 길이, 비용 허용 범위 세 가지로 압축된다.
아직 어느 모델을 골라야 할지 모르겠다면 Sonnet 4.6에서 시작하자. 결과물이 아쉽거나 컨텍스트가 부족할 때 Opus 4.8로 올리면 된다.
Sonnet 4.6이 적합한 경우
- 문서 작성, 요약, 번역, 이메일 초안
- 코드 리뷰, 중간 수준 코드 생성 및 디버깅
- 빠른 응답 속도가 필요한 반복 작업
- 비용에 민감한 프로덕션 API 연동
Opus 4.8이 필요한 경우
- 수천 스텝짜리 장시간 자율 에이전트 실행
- 코드베이스 전체 분석 또는 대규모 마이그레이션
- 법률·재무 문서처럼 정확도가 비용보다 우선인 작업
- 입력이 20만 토큰을 초과하는 긴 자료를 한 번에 처리해야 할 때
Haiku 4.5가 적합한 경우
- 텍스트 분류, 태깅, 짧은 요약 같은 단순 반복 호출
- API 호출 수가 수만 건에 달하는 배치 작업
- 응답 속도가 최우선인 실시간 서비스
모델을 정했다면 프롬프트 설계가 그 다음 변수다. 선택한 모델에서 원하는 결과가 안 나온다면 모델을 바꾸기 전에 클로드 프롬프트 작성 팁을 먼저 확인해보자.
자주 묻는 질문

Q. 무료 플랜에서 Opus 4.8을 쓸 수 있나요?
무료 플랜에서는 Opus 4.8을 사용할 수 없다. Free 플랜은 Sonnet 4.6을 기본으로 제공하며, Opus 4.8 접근은 Pro 이상 플랜에서만 가능하다. Pro 플랜 안에서도 Opus를 반복 사용하면 월간 한도가 Sonnet보다 빠르게 소진된다.
Q. Sonnet과 Opus, 일반 텍스트 작업에서 체감 차이가 있나요?
글쓰기·요약·번역 같은 범용 작업에서는 체감 차이가 크지 않다. 차이가 두드러지는 건 복잡한 에이전트 코딩, 멀티스텝 분석, 100만 토큰에 가까운 긴 문서 처리다. 같은 프롬프트를 두 모델에 넣어 직접 비교해보는 것이 가장 정확한 판단 방법이다.
Q. Claude 모델 버전이 자꾸 바뀌는데 최신 정보는 어디서 확인하나요?
Anthropic 공식 모델 개요 페이지(docs.anthropic.com/en/docs/about-claude/models/overview)가 기준이 된다. 이 페이지는 신규 모델 출시와 함께 업데이트되므로, 모델명·버전·컨텍스트 윈도우를 확인할 때 이 링크를 먼저 열어보자.
Sonnet으로 시작하고, 막히면 Opus로 올린다
결론은 단순하다. Sonnet 4.6은 Opus 4.8 성능의 약 85%를 약 20% 비용으로 커버한다. 처음부터 Opus를 쓸 이유가 없다. 컨텍스트가 부족하거나, 에이전트가 중간에 실패하거나, 정밀도가 비용보다 중요한 상황이 됐을 때 그때 Opus로 올려도 늦지 않다.
Claude와 ChatGPT 중 어느 도구가 맞는지 고민 중이라면 클로드 vs ChatGPT 성능 비교 2026도 함께 읽어보자. 요금제와 실전 사용 기준을 나란히 정리해뒀다.