Claude

AI맵위키
최종 확인: 2026-08-09
Claude
개발사Anthropic
계열Claude (계열 문서)
공개일2023년 (첫 세대)
종류대규모 언어 모델 계열
공개 방식비공개 (API만)
매개변수비공개
컨텍스트최대 100만 토큰
입출력텍스트·이미지 → 텍스트
쓰이는 곳Claude Code, Cursor, GitHub Copilot, claude.ai
공식발표/문서

Claude(클로드)는 Anthropic이 만드는 대규모 언어 모델 계열이다. 하나의 모델이 아니라 등급과 세대로 나뉜 여러 모델의 묶음이며, 이 문서는 계열 전체를 다룬다.

가중치를 공개하지 않는 비공개 모델이고, API·클라우드 플랫폼·자체 서비스를 통해 쓴다.

개요

Claude는 세 곳에서 만난다. 서로 다른 것이니 구분해야 한다.

이름 정체
Claude 모델. 이 문서가 다루는 것
claude.ai 웹·앱 채팅 서비스
Claude Code 코딩 에이전트 도구

세 가지가 구독을 공유한다. Pro를 결제하면 채팅과 Claude Code를 함께 쓰고 한도도 함께 쓴다. 채팅을 많이 하면 코딩에 쓸 몫이 줄어든다.

API로 쓸 때는 구독과 별개로 토큰 단위 종량제로 과금된다.

이름 읽는 법

Claude 이름 체계는 두 축으로 되어 있다. 이걸 모르면 목록이 뒤죽박죽으로 보인다.

Claude   Opus   5
  │       │     └── 세대 (버전)
  │       └──────── 등급 (성능·속도·가격 위치)
  └──────────────── 계열

등급은 크기와 성격을 나타낸다.

등급 자리
Fable 가장 높은 성능. 장기간 도는 에이전트용
Opus 복잡한 에이전트 코딩과 기업 업무
Sonnet 속도와 지능의 균형
Haiku 가장 빠르고 싸다

세대는 숫자다. 다만 등급마다 세대가 따로 간다. 2026년 8월 현재 Opus와 Sonnet은 5세대인데 Haiku는 4.5세대다. "Claude 5"라는 단일 모델은 없고, "Claude Opus 5"와 "Claude Sonnet 5"가 각각 있다.

참고

같은 세대라도 등급이 다르면 다른 모델이다.

Claude Opus 5와 Claude Sonnet 5는 세대만 같을 뿐 성능·속도·가격이 다르다. "Claude 5를 쓴다"는 말은 정확하지 않고, 어느 등급인지까지 말해야 한다.

현행 모델

2026년 8월 기준으로 널리 쓸 수 있는 모델은 넷이다.[1]

모델 컨텍스트 최대 출력 입력 출력 지식 기준일
Claude Fable 5 100만 12.8만 $10 $50 2026년 1월
Claude Opus 5 100만 12.8만 $5 $25 2026년 5월
Claude Sonnet 5 100만 12.8만 $3 $15 2026년 1월
Claude Haiku 4.5 20만 6.4만 $1 $5 2025년 2월

가격은 100만 토큰당 USD다. 전 모델이 텍스트와 이미지를 입력받고 텍스트를 출력하며 다국어를 지원한다.

Claude Fable 5

공식 문서가 "가장 성능이 높은 널리 공개된 모델"로 소개한다. 2026년 6월 9일부터 정식 제공됐다.

오래 도는 에이전트를 겨냥한 모델이다. 사고 기능이 항상 켜져 있고, 그만큼 응답이 느리다. 가격도 Opus 5의 두 배다.

Claude Opus 5

복잡한 에이전트 코딩과 기업 업무용이며, 공식 문서가 "어느 것을 쓸지 모르겠으면 여기서 시작하라"고 권하는 기본값이다.

지식 기준일이 2026년 5월로 현행 모델 중 가장 최신이라는 점이 실무에서 유리하다.

Claude Sonnet 5

속도와 지능의 균형을 노린 등급이다. Opus 5의 60% 가격에 같은 100만 토큰 컨텍스트를 쓴다.

2026년 8월 31일까지 도입 가격 $2/$10이 적용된다. 그 이후에는 $3/$15가 된다. 지금 비용을 계산하고 있다면 이 시점을 넘긴 뒤의 가격으로 계산해야 한다.

Claude Haiku 4.5

가장 빠르고 가장 싸다. 다만 다른 셋과 차이가 몇 가지 있다.

  • 컨텍스트가 20만 토큰으로 다섯 분의 일이다
  • 최대 출력도 6.4만 토큰
  • 적응형 사고를 지원하지 않는다 (대신 확장 사고 방식을 쓴다)
  • 지식 기준일이 2025년 2월로 가장 오래됐다

분류·추출·요약처럼 정해진 형태의 작업을 대량으로 돌릴 때 값어치가 크다.

Claude Mythos 5

초청 전용 모델이다. Fable 5와 사양·가격이 같지만, 방어적 사이버보안 워크플로를 위해 Project Glasswing 참여 고객에게만 제공된다. 자체 신청 경로가 없다.

어떤 모델을 고를까

정리


고민되면 Claude Opus 5부터. 공식 문서의 권장 기본값이고 지식 기준일도 가장 최신이다.

  • 비용이 중요하다 → Sonnet 5. 같은 컨텍스트에 60% 가격
  • 대량 처리·낮은 지연 → Haiku 4.5. 단 컨텍스트 20만 제한을 확인할 것
  • 가장 어려운 장기 작업 → Fable 5. 느리고 비싸다
  • 방어적 보안 업무 → Mythos 5 (초청 필요)

등급을 고정하지 말고 작업마다 바꾸는 편이 낫다. 간단한 분류에 Opus를 쓰면 돈만 더 나가고, 어려운 리팩터링에 Haiku를 쓰면 결과가 안 나온다.

공통 특징

적응형 사고

답하기 전에 얼마나 깊이 생각할지를 모델이 스스로 정하는 방식이다. Fable 5는 항상 켜져 있고, Opus 5·Sonnet 5도 지원한다. Haiku 4.5는 지원하지 않는다.

깊이는 effort 로 조절한다. 기본값은 high 이며, Claude API와 Claude Code 모두 그렇다. 낮추면 빠르고 싸지지만 얕아진다.

컨텍스트 창

Fable 5·Opus 5·Sonnet 5가 100만 토큰을 쓴다. 한국어 기준으로는 대략 책 여러 권 분량이다.

주의

토크나이저가 바뀌어 같은 글이 더 많은 토큰이 된다.

Claude Opus 4.7 세대부터 새 토크나이저를 쓴다. 공식 문서는 이전 모델 대비 같은 텍스트가 약 30% 더 많은 토큰이 된다고 밝히고 있다. 정확한 증가폭은 내용에 따라 다르다.

컨텍스트가 늘었다고 같은 분량을 더 넣을 수 있는 것이 아니다. 비용을 계산하던 기준도 다시 재야 한다.

모델 ID는 고정 스냅샷이다

자동으로 최신 모델로 바뀌지 않는다.

Claude 4.6 세대부터 모델 ID에 날짜가 빠졌지만, 여전히 특정 릴리스에 고정된 스냅샷이다. 날짜가 없다고 최신을 가리키는 포인터가 아니다.

새 모델이 나와도 코드에 적힌 ID는 그대로 예전 모델을 가리킨다. 바꾸려면 직접 고쳐야 한다. 예고 없이 동작이 바뀌지 않는다는 장점이자, 방치하면 낡은 모델을 계속 쓰게 되는 단점이다.

가격

아래 가격은 2026년 8월 기준이다. AI 서비스 요금제는 자주 바뀌므로 결제 전 공식 요금 페이지를 반드시 직접 확인할 것. 100만 토큰(MTok)당 USD 기준이다.

API는 입력 토큰과 출력 토큰을 따로 계산한다. 전 등급에서 출력이 입력의 다섯 배다.

모델 입력 출력 출력/입력 배수
Claude Fable 5 $10 $50 5배
Claude Opus 5 $5 $25 5배
Claude Sonnet 5 $3 $15 5배
Claude Haiku 4.5 $1 $5 5배

출력이 다섯 배라는 점이 실무에서 중요하다. 긴 문서를 읽히는 것보다 긴 답을 받는 쪽이 비용을 훨씬 크게 밀어 올린다.

컨텍스트 길이에 따른 할증은 없다

Claude 4.6 이후 모델은 100만 토큰 전 구간을 같은 단가로 쓴다. 공식 문서가 "90만 토큰 요청도 9천 토큰 요청과 같은 토큰당 단가로 청구된다"고 명시한다.

경쟁 모델 중에는 긴 컨텍스트에 할증을 붙이는 경우가 있어 혼동하기 쉬운 부분이다.

프롬프트 캐싱

같은 내용을 매번 다시 읽히지 않게 하는 기능이다. 긴 시스템 프롬프트나 문서를 반복해서 보내는 상황에서 비용이 크게 준다.

기본 입력 단가에 배수를 곱해 계산한다.

동작 배수 유효 시간
캐시 쓰기 (5분) 1.25배 5분
캐시 쓰기 (1시간) 2배 1시간
캐시 읽기 (적중) 0.1배 앞선 쓰기와 동일

적중하면 정가의 10%다. 그래서 손익분기가 명확하다.

  • 5분 캐시 — 쓰기 1.25배 → 한 번만 적중해도 이득
  • 1시간 캐시 — 쓰기 2배 → 두 번 적중해야 이득

Opus 5 기준으로 캐시 읽기는 100만 토큰당 $0.50, Haiku 4.5는 $0.10이다.

배치 API

급하지 않은 작업을 비동기로 몰아 처리하면 입력과 출력 모두 50% 할인된다.

모델 배치 입력 배치 출력
Claude Fable 5 $5 $25
Claude Opus 5 $2.50 $12.50
Claude Sonnet 5 $1.50 $7.50
Claude Haiku 4.5 $0.50 $2.50

캐싱 할인과 겹쳐 쓸 수 있다. 공식 FAQ가 두 기능을 함께 쓰면 상당한 절감이 된다고 안내한다. 대신 실시간 응답이 아니다.

Fast 모드

Opus 5와 Opus 4.8에만 있는 리서치 프리뷰 기능으로, 출력이 훨씬 빨라지는 대신 $10 / $50 — 즉 Fable 5와 같은 가격이 된다. Claude API에서만 쓸 수 있고 배치 API와는 함께 쓸 수 없다.

Opus 4.7에서는 요청 자체가 오류가 되고, Opus 4.6에서는 무시되고 표준 속도·표준 요금으로 처리된다.

데이터 위치 지정

Claude 4.6 이후 모델은 추론을 미국 안에서만 돌리도록 지정할 수 있는데, 모든 토큰 항목에 1.1배 할증이 붙는다. 입력·출력·캐시 쓰기·캐시 읽기 전부에 적용된다. 기본값인 글로벌 라우팅은 표준 가격이다.

주의

구독과 API는 별개 과금이다.

claude.ai나 Claude Code구독으로 쓸 때는 위 표가 아니라 구독 한도가 적용된다. Pro를 결제했다고 API 호출이 공짜가 되지 않고, 반대로 API 크레딧이 있다고 채팅 한도가 늘어나지도 않는다.

도구를 쓸 때의 요금

Claude에 도구를 붙이면 도구 정의 자체가 입력 토큰으로 과금된다. 도구를 하나라도 넘기면 시스템 프롬프트가 자동으로 추가되기 때문이다.

모델 도구 사용 시스템 프롬프트
Claude Opus 5 286~406 토큰
Claude Sonnet 5 354~474 토큰
Claude Opus 4.7 675~804 토큰
Claude Haiku 4.5 496~588 토큰

여기에 도구 이름·설명·스키마, 호출과 결과 블록이 더해진다. 도구를 많이 붙일수록 매 요청의 고정비가 올라간다.

Anthropic이 서버에서 직접 돌려 주는 도구는 별도 요금이 붙는 것도 있다.

서버 도구 추가 요금
웹 검색 1,000회당 $10 + 검색 결과 토큰
웹 페치 추가 요금 없음 (가져온 내용의 토큰만)
코드 실행 1,550시간 무료, 초과분 컨테이너당 시간당 $0.05

웹 검색은 결과 개수와 무관하게 1회로 센다. 오류가 나면 청구되지 않는다. 코드 실행은 웹 검색·웹 페치와 함께 쓰면 무료이며, 단독으로 쓸 때만 실행 시간으로 계산된다.

웹 페치의 토큰 소모는 문서 크기에 비례한다. 공식 문서의 예시로는 일반 웹페이지(10 kB)가 약 2,500 토큰, 문서 페이지(100 kB)가 약 25,000 토큰, 논문 PDF(500 kB)가 약 125,000 토큰이다. PDF 몇 개면 컨텍스트가 금방 찬다.

어디서 쓸 수 있나

경로 특징
Claude API 직접 호출. 기능이 가장 먼저 들어온다
claude.ai 웹·앱 채팅. 구독제
Claude Code 코딩 에이전트
Amazon Bedrock AWS 안에서. 모델 ID에 anthropic. 접두사
Google Cloud GCP 안에서
Microsoft Foundry Azure 계열

클라우드 플랫폼마다 모델 ID 형식이 다르다. 같은 모델이라도 Bedrock에서는 anthropic.claude-opus-5 처럼 접두사가 붙는다. 플랫폼별로 쓸 수 있는 기능도 차이가 있다.

CursorGitHub Copilot 같은 외부 도구도 Claude를 선택지로 제공한다.

세대별 변화

세대 주요 변화
4.5 컨텍스트 20만, 확장 사고
4.6 컨텍스트 100만, 적응형 사고 도입, 모델 ID에서 날짜 제거
4.7 새 토크나이저 (같은 글이 약 30% 더 많은 토큰), 확장 사고 제거
4.8 성능 개선. effort 기본값 high
5 Opus·Sonnet 5세대. Fable 등급 신설

4.6에서 컨텍스트가 다섯 배로 늘었고, 4.7에서 토크나이저가 바뀌었다. 이 두 세대가 실무에 가장 큰 영향을 준 변화다.

레거시 모델

아직 쓸 수 있지만 이전을 권하는 모델들이다.

모델 컨텍스트 가격 (입력/출력)
Claude Opus 4.8 · 4.7 · 4.6 100만 $5 / $25
Claude Sonnet 4.6 100만 $3 / $15
Claude Opus 4.5 20만 $5 / $25
Claude Sonnet 4.5 20만 $3 / $15

가격이 현행 모델과 같은 경우가 많다. Opus 4.5부터 4.8까지 전부 $5 / $25이고, Sonnet 4.5·4.6도 $3 / $15다. 같은 값이면 최신 세대를 쓰는 편이 낫다.

은퇴한 모델

더 이상 새로 쓸 수 없는 모델들이다.

모델 상태
Claude Opus 4.1 은퇴. Bedrock과 Google Cloud에서만 남아 있음
Claude Opus 4 은퇴. Google Cloud에서만 남아 있음
Claude Sonnet 4 은퇴. Bedrock과 Google Cloud에서만 남아 있음
Claude Haiku 3.5 은퇴. Bedrock과 Google Cloud에서만 남아 있음

은퇴 시점이 플랫폼마다 다르다. Claude API에서 먼저 사라지고 파트너 클라우드에는 한동안 남는 식이다. 특정 모델에 의존하는 시스템이라면 공식 문서의 모델 지원 종료(deprecation) 안내를 주기적으로 봐야 한다.

참고로 은퇴한 Opus 4.1·Opus 4는 $15 / $75로, 현행 Opus 5($5 / $25)의 세 배였다. 세대가 올라가며 최상위 등급 가격이 크게 내려온 셈이다.

클라우드 플랫폼별 차이

같은 모델이라도 어디서 쓰느냐에 따라 과금 방식과 모델 ID가 달라진다.

① 청구 단위가 다르다

Claude Platform on AWS와 Microsoft Foundry는 CCU(Claude Consumption Unit)로 청구한다. 토큰 사용량을 표준 단가로 계산한 뒤 1 CCU = $0.01로 환산해 마켓플레이스에 보고하는 방식이라, AWS·Azure 청구서에는 CCU 한 줄만 찍힌다. 할인은 CCU 단가가 아니라 환산 수량에서 반영된다.

② 리전 엔드포인트에 할증이 붙는다

Bedrock과 Google Cloud에서 데이터 경로를 특정 지역으로 고정하는 엔드포인트를 쓰면 글로벌 엔드포인트 대비 10% 할증이다. Sonnet 4.5·Haiku 4.5·Opus 4.5 이후 모델에 적용된다.

③ 기능이 늦게 들어온다

Claude API에 먼저 들어오고 파트너 플랫폼에는 나중에 반영되는 기능이 있다. Fast 모드처럼 Claude API 전용인 것도 있다.

한계

① 지식 기준일이 있다

모델마다 학습 데이터가 끊긴 시점이 다르다. Haiku 4.5는 2025년 2월로 현행 모델 중 가장 오래됐다. 그 이후의 사건·제품·가격은 모른다. 최신 정보가 필요하면 검색 도구를 붙이거나 직접 넣어 줘야 한다.

② 가중치를 공개하지 않는다

내려받아 자체 서버에서 돌릴 수 없다. 코드나 문서가 외부로 나가면 안 되는 환경에서는 쓸 수 없고, 오픈 웨이트 모델을 검토해야 한다.

③ 매개변수 수를 공개하지 않는다

인터넷에 추정치가 떠돌지만 공식 발표가 없다. 다른 모델과 크기를 직접 비교할 근거가 없다는 뜻이다.

④ 이미지를 만들지 못한다

이미지를 입력받아 이해할 수는 있지만 출력은 텍스트뿐이다. 그림 생성에는 MidjourneyStable Diffusion 계열이 필요하다.

⑤ 등급 간 성능 차이를 수치로 알기 어렵다

공식 문서는 "복잡한 작업용", "속도와 지능의 균형" 같은 서술로 구분한다. 내 작업에서 Sonnet과 Opus의 차이가 얼마나 나는지는 직접 돌려 봐야 안다.

⑥ 성능이 높을수록 느리다

Fable 5는 사고 기능이 항상 켜져 있어 응답이 오래 걸린다. 대화형으로 쓰기에는 답답할 수 있고, 그래서 Fast 모드 같은 별도 옵션이 따로 붙어 있다. 빠른 응답이 중요한 서비스라면 등급을 낮추는 쪽이 현실적이다.

자주 묻는 것

Claude 5는 무슨 모델인가?

그런 단일 모델은 없다. Claude Opus 5, Claude Sonnet 5처럼 등급까지 붙여야 특정 모델을 가리킨다.

가장 좋은 모델은?

성능만 보면 Fable 5다. 다만 느리고 Opus 5의 두 배 가격이다. 대부분의 작업에는 Opus 5가 공식 권장 기본값이다.

무료로 쓸 수 있나?

claude.ai 무료 플랜에서 제한적으로 쓸 수 있다. API는 종량제라 쓴 만큼 과금된다.

내려받아서 내 서버에서 돌릴 수 있나?

불가능하다. 가중치를 공개하지 않는다. 자체 호스팅이 필요하면 Llama·Qwen 같은 오픈 웨이트 모델을 봐야 한다.

한국어는 잘하나?

전 모델이 다국어를 지원한다. 다만 공식 문서가 언어별 성능을 따로 공개하지는 않는다.

웹 검색을 붙이면 최신 정보를 알게 되나?

부분적으로 그렇다. 검색해서 가져온 내용은 알지만, 모델 자체의 지식이 갱신되는 것은 아니다. 검색 요금(1,000회당 $10)과 결과 토큰 비용도 따로 든다.

응답이 느린데 어떻게 하나?

등급을 낮추거나(Opus → Sonnet → Haiku), effort 를 낮추거나, Opus 5라면 Fast 모드를 쓸 수 있다. Fast 모드는 가격이 두 배가 된다는 점만 감안하면 된다.

모델을 바꾸면 코드를 고쳐야 하나?

모델 ID가 고정 스냅샷이라 직접 고쳐야 한다. 세대에 따라 지원하는 파라미터가 달라지므로 이전 안내를 확인하는 편이 안전하다.

여담

여담

등급 이름이 문학 형식에서 왔다. Haiku(하이쿠, 짧은 일본 정형시), Sonnet(소네트, 14행시), Opus(작품)로 갈수록 길고 무거워지는 구성이다. 크기와 성격을 이름만으로 짐작하게 만든 작명이다.

여기에 Fable(우화)이 더해지면서 규칙이 조금 흐려졌다. 길이 순서라기보다 "이야기"라는 다른 축으로 보인다.

버전 번호가 등급마다 따로 가는 것도 특이하다. 보통 제품은 세대를 맞춰 내는데, Claude는 Opus가 5세대일 때 Haiku가 4.5세대인 식이다. 등급별로 개발 주기가 다르기 때문으로 보이지만, 이름만 보고 어느 것이 최신인지 알기 어렵게 만든 원인이기도 하다.

Claude 계열
굵게 표시된 것이 2026년 8월 기준 현행 모델이다. 등급마다 세대가 따로 간다.

관련 문서

각주