Claude Sonnet 5 리뷰: 실제 비용, Opus 4.8 비교와 토크나이저 함정

Claude Sonnet 5의 실제 가격과 성능을 깊이 분석합니다. Opus 4.8과 비교해 어떤 작업에서 유리한지, 새 토크나이저로 약 30% 늘어나는 비용은 얼마인지, API 마이그레이션 전 반드시 수정해야 할 세 가지 호환성 변경과 전환 기준까지 한 번에 확인하세요.

Thursday, September 3, 2026Omid Saffari
Claude Sonnet 5 리뷰: 실제 비용, Opus 4.8 비교와 토크나이저 함정

이번 Claude Sonnet 5 리뷰에서 확인할 핵심은 세 가지입니다. 이제 모든 Free 및 Pro 계정의 기본 모델이 되었고, 에이전트 작업에서는 Opus 4.8에 근접하며, 8월 31일까지 입력 토큰 백만 개당 $2로 책정됩니다. 다만 가격표에는 잘 드러나지 않는 변수가 있습니다. 새 토크나이저 때문에 같은 작업도 Sonnet 4.6보다 약 30% 많은 토큰을 사용하므로 실제 청구액은 표시 가격만 보고 예상한 것보다 높습니다.

Claude Sonnet 5 리뷰 한 줄 결론

에이전트, 코딩, 툴 중심 자동화라면 Sonnet 5로 전환할 만합니다. 단, 더 저렴해졌다고 판단하기 전에 토크나이저 변경분부터 비용에 반영해야 합니다.

Anthropic은 2026년 6월 30일, 지금까지 만든 Sonnet 중 에이전트 역량이 가장 뛰어난 모델로 Sonnet 5를 출시했습니다. 여러 단계의 작업을 계획하고 브라우저나 터미널 같은 툴을 직접 다루며, 이전 Sonnet 모델이 도중에 멈추던 작업도 끝까지 수행합니다. API와 Claude Code에서는 기본적으로 effort=high로 작동합니다. 이 설정에서는 일부 작업에서 Opus 4.8에 근접하면서도 표시 가격은 훨씬 낮습니다. 이미 Claude Code를 주로 사용하거나 에이전트를 구축하는 대다수 사용자에게 이제 가장 합리적인 기본 선택입니다.

서두르기 전에 따져볼 부분은 성능이 아니라 비용입니다. 출시 가격만 보면 인하처럼 보이지만, 새 토크나이저는 같은 텍스트를 약 30% 더 많은 토큰으로 계산합니다. 또한 내용을 확인하지 않고 마이그레이션하면 요청에 400 오류를 일으키는 세 가지 API 호환성 변경도 있습니다. 두 문제 모두 아래에서 자세히 다룹니다.

Claude Sonnet 5 제품 페이지
Claude Sonnet 5

Sonnet 4.6에서 실제로 달라진 점

Sonnet 5는 Sonnet 4.6에서 거의 그대로 교체할 수 있는 업그레이드입니다. 세세한 수동 제어를 조금 줄이는 대신 훨씬 높은 자율성을 제공합니다.

가장 큰 향상은 에이전트가 작업을 끝까지 수행하는 능력입니다. Anthropic의 설명에 따르면 최근 가장 뚜렷한 성능 도약은 Opus급 모델에 집중됐지만, Sonnet 5가 그 격차를 좁혔습니다. 더 낮은 가격으로 Opus 4.8에 가까운 성능을 내고, Sonnet 4.6보다 비용과 속도를 훨씬 폭넓게 조절할 수 있습니다. 추론, 툴 사용, 코딩, 지식 작업 모두 4.6보다 개선됐으며, 얼리 액세스 파트너들은 여러 단계의 소프트웨어 작업을 완수하고 별도 지시 없이 자체 결과까지 점검한다고 평가했습니다. Anthropic이 강조한 에이전트 검색(BrowseComp)과 컴퓨터 사용(OSWorld-Verified) 벤치마크에서는 4.6보다 확실히 향상됐고, 일부 작업은 높은 effort 설정에서 Opus 4.8과 대등합니다. Anthropic의 안전성 자료에 따르면 바람직하지 않은 행동도 4.6보다 적습니다. 사이버 보안 작업 능력은 현재 Opus 모델보다 눈에 띄게 낮은데, 대부분의 비즈니스 용도에서는 단점보다 장점에 가깝습니다.

실사용에서 가장 유용한 변화는 adaptive thinking이 기본으로 켜진다는 점입니다. Sonnet 4.6은 요청에 thinking 필드가 없으면 thinking 없이 실행됐습니다. Sonnet 5는 같은 요청에서도 상황에 맞춰 thinking을 수행합니다. 별도 설정 없이 더 나은 답을 얻을 수 있지만, max_tokens가 thinking과 응답 텍스트를 합친 전체를 제한하므로 4.6에 맞춘 출력 한도에서는 사용자에게 보이는 답변이 중간에 잘릴 수 있습니다. 기존에 thinking 없이 실행했던 워크로드라면 max_tokens를 다시 검토해야 합니다.

Claude Sonnet 5 가격: Claude 5 전체 라인업 비교

Sonnet 5의 출시 프로모션 가격은 2026년 8월 31일까지 입력 토큰 백만 개당 $2, 출력 토큰 백만 개당 $10입니다. 이후에는 각각 입력 $3, 출력 $15로 바뀝니다. 현재 기준으로 제품군 내 위치를 비교하면 다음과 같습니다.

모델API ID가격(입력 / 출력, MTok당)컨텍스트최대 출력
Claude Fable 5claude-fable-5$10 / $501M128k
Claude Opus 4.8claude-opus-4-8$5 / $251M128k
Claude Sonnet 5claude-sonnet-5출시가 $2 / $10, 이후 $3 / $151M128k
Claude Haiku 4.5claude-haiku-4-5$1 / $5200k64k

비율로 보면 선택은 단순해집니다. 출시 가격 기준 Sonnet 5의 토큰당 비용은 **Opus 4.8의 40%**이며, 8월 이후 정가도 **Opus의 60%**입니다. 반대로 정가 기준으로는 Haiku 4.5 가격의 3x입니다. Haiku의 컨텍스트 창은 200k가 한계지만 Sonnet 5는 1M 전체를 제공합니다. 결국 Sonnet 5는 의도적으로 중간 자리를 맡습니다. Opus보다 저렴하고 Haiku보다 성능이 확실히 높으면서, 플래그십과 같은 1M 컨텍스트와 128k 출력 한도를 갖췄습니다.

긴 작업에서 은근히 중요한 사양도 있습니다. Sonnet 5는 1M 토큰 컨텍스트를 기본값이자 최댓값으로 유지하며 더 작은 컨텍스트 버전은 없습니다. Batch API에서는 output-300k-2026-03-24 베타 헤더를 사용해 출력 토큰을 300k까지 늘릴 수 있습니다. Opus급과 달리 Sonnet 5에는 Priority Tier가 제공되지 않습니다.

Claude 5 제품군의 가격 및 성능 단계
Sonnet 5의 위치: Opus보다 저렴하고 Haiku보다 훨씬 강력하며, 동일한 1M 컨텍스트를 제공합니다.

가격표에 잡히지 않는 토크나이저 비용

표시 가격은 내려갔지만 작업량 기준 실질 가격은 그만큼 낮아지지 않았습니다. Sonnet 5의 새 토크나이저가 같은 텍스트를 Sonnet 4.6보다 약 30% 더 많은 토큰으로 변환하기 때문입니다.

토크나이저는 텍스트를 과금 단위인 토큰으로 잘게 나누는 구성 요소입니다. Sonnet 5의 토크나이저는 4.6과 다르며, Anthropic은 같은 입력 텍스트에서 대략 30% 더 많은 토큰이 생성된다고 명시합니다. 정확한 수치는 콘텐츠에 따라 달라집니다. 토큰당 가격은 그대로지만 과금은 토큰 수를 기준으로 합니다. 따라서 4.6에서 10,000토큰이던 요청이 이제 약 13,000토큰으로 계산되면, 가격 변경 자체를 반영하기 전에도 같은 작업의 비용이 약 30% 늘어납니다. 1M 컨텍스트 창에 실제로 담을 수 있는 텍스트도 줄고, 4.6의 출력량을 기준으로 설정한 max_tokens는 응답을 조기에 끊을 수 있습니다.

실무 원칙은 분명합니다. 이전 모델에서 측정한 토큰 수를 그대로 쓰지 말고 Sonnet 5 기준으로 다시 측정해야 합니다. 4.6 수치를 바탕으로 비용을 예측하거나, 요청별 예산을 잡거나, 컨텍스트 패킹 로직을 만들었다면 이제 그 계산은 지나치게 낙관적입니다. 앞서 Opus 제품군에도 같은 현상이 있었으며, 자세한 내용은 Opus 4.7 토크나이저 변경에서 다뤘습니다. 해결책도 동일합니다. 다시 계산한 뒤 결정해야 합니다.

같은 문장이 Sonnet 5에서 약 30% 더 많은 토큰으로 계산되는 모습
토큰당 가격은 같지만 동일한 텍스트도 약 30% 더 많은 토큰으로 청구됩니다.

그렇다고 Sonnet 5가 비싼 모델이라는 뜻은 아닙니다. 출시 가격으로는 비슷한 출력을 내는 Opus보다 여전히 훨씬 저렴합니다. 다만 정직한 비교식은 ‘표시 가격 $2에서 실제 성능 향상의 가치를 빼고 약 30%의 토큰 증가분을 더한 것’이지, 단순히 ‘저렴해졌다’가 아닙니다. 비용 절감을 단정하기 전에 실제 워크로드로 계산해야 합니다.

전환 전에 처리해야 할 세 가지 호환성 변경

4.6에서 옮기는 과정은 대체로 간단하지만, 어제까지 작동하던 세 종류의 요청이 이제 400 오류를 반환합니다. 먼저 수정하지 않으면 에이전트 루프가 첫 호출부터 중단됩니다.

  1. 샘플링 매개변수 제거

    Sonnet 5에서는 temperature, top_p, top_k를 기본값이 아닌 값으로 설정하면 400 오류가 발생합니다. 요청에서 삭제해야 하며, 기본값을 쓰거나 매개변수를 생략하는 방식은 허용됩니다. 동작을 조정하려면 관련 지침을 시스템 프롬프트로 옮겨야 합니다. Opus 4.7에는 이미 적용됐지만 Sonnet급 모델에는 새로 생긴 제약입니다.

  2. 수동 extended thinking 제거

    기존 thinking: {type: "enabled", budget_tokens: N} 형식은 삭제됐으며 400 오류를 반환합니다. Opus 4.8과 마찬가지로 effort 매개변수를 이용한 adaptive thinking을 사용해야 합니다. thinking을 완전히 끄려면 thinking: {type: "disabled"}를 전달하면 됩니다.

  3. max_tokens 재점검

    adaptive thinking이 기본으로 활성화되고 max_tokens가 thinking과 응답을 합쳐 제한하므로, 4.6을 기준으로 설정한 한도는 다시 테스트해야 합니다. 이전에 thinking 없이 실행되던 워크로드일수록 응답이 잘릴 가능성이 큽니다.

Python
# Fails on Sonnet 5 (returns 400)
resp = client.messages.create(
    model="claude-sonnet-5",
    temperature=0.7,
    thinking={"type": "enabled", "budget_tokens": 32000},
    max_tokens=4000,
    messages=[...],
)

# Works: no sampling params, adaptive thinking, roomier max_tokens
resp = client.messages.create(
    model="claude-sonnet-5",
    thinking={"type": "adaptive"},
    max_tokens=8000,
    messages=[...],
)

Claude Sonnet 5와 Opus 4.8 비교: 더 저렴한 모델이 맞는 경우

에이전트 코딩과 툴 사용 자동화에는 effort=high의 Sonnet 5를 기본으로 선택하고, 작업에 최고 수준의 역량이 정말 필요할 때만 Opus 4.8로 올리는 편이 합리적입니다.

Sonnet 5의 핵심 경쟁력은 effort 조절 기능입니다. Opus급과 같은 medium/high/extra-high effort 단계를 제공하며, Anthropic의 비용 대비 성능 곡선을 보면 4.6보다 훨씬 넓은 범위를 포괄합니다. medium effort에서는 효율이 뛰어나고, 더 높은 effort에서는 일부 작업에서 Opus 4.8의 성능에 도달합니다. 출시 가격으로 Opus 비용의 40%, 8월 이후에도 60%이므로, 모든 작업에 Opus 요금을 내기보다 Sonnet 5로 시작한 뒤 특정 고난도 작업만 Opus로 올리는 편이 계산상 유리합니다.

Opus 4.8을 유지할 이유는 제한적이지만 분명히 있습니다. 최고 성능이 비용을 상쇄하는 작업, 가장 어려운 에이전트 코딩, 한 번의 단계 실패도 큰 비용으로 이어지는 장시간 자율 실행, 또는 ‘일부 작업에서 대등하다’는 수준으로 부족한 경우입니다. 특히 중요한 작업이 Sonnet 5가 따라잡지 못한 영역에 있다면 그렇습니다. 대규모 운영 환경에서 사람의 감독 없이 작업을 맡긴다면, 가격 차이가 Sonnet의 잘못된 실행 한 번보다 오히려 저렴할 수 있습니다.

엇갈린 실제 평가: 일부 사용자가 다운그레이드라고 말하는 이유

커뮤니티의 반응은 갈렸으며 이를 외면해서는 안 됩니다. ‘4.6이 끝내지 못한 작업까지 완수한다’는 호평과 함께, 이번 달 r/ClaudeAI 공개 게시물에는 제목부터 직설적인 “Sonnet 5 is a downgrade”가 올라왔습니다. “is it actually worth using”, “what's the consensus”처럼 실제로 쓸 가치가 있는지 묻는 글도 꾸준히 이어졌습니다. Anthropic이 내세우는 ‘Opus 4.8에 근접한다’는 설명과 일부 사용자의 체감 사이에 존재하는 간극은 짚고 넘어갈 필요가 있습니다.

대부분은 두 가지 이유로 설명됩니다. 첫째, adaptive thinking이 기본으로 활성화되면서 응답 형태와 지연 시간이 달라졌습니다. 4.6의 간결하고 thinking 없는 출력에 맞춘 워크플로에서는 품질이 좋아져도 낯설거나 나빠진 것처럼 느낄 수 있습니다. 둘째, 토크나이저 변경 후 비용을 다시 측정하기 전에는 비교 결과가 더 나빠 보입니다. 그래서 ‘다른 토크나이저’보다 ‘더 비싸다’는 인상이 먼저 남습니다. 어느 쪽도 모델 자체가 나쁘다는 뜻은 아닙니다. 교체만 하면 끝나는 업그레이드가 실제로는 완전히 단순할 수 없다는 의미입니다. 누구의 평가든 그대로 믿기 전에, 이 글의 결론까지 포함해 실제 프롬프트로 테스트해야 합니다.

지금 전환할 사용자와 기다릴 사용자

에이전트를 만들거나 Claude Code에서 코드를 배포하거나, 툴 중심 자동화를 운영한다면 해당합니다. effort=high의 Sonnet 5는 Sonnet 가격으로 Opus에 가까운 작업 완수 능력을 제공합니다. 전환하되 먼저 토큰 예산을 다시 계산해야 합니다.

Sonnet 5 전환 여부를 판단하는 결정 지도
유지할지 전환할지 빠르게 판단하는 결정 지도입니다.
Claude Sonnet 5는 이미 사용할 수 있나요?

그렇습니다. 2026년 6월 30일 출시됐으며 Free 및 Pro 플랜의 기본 모델입니다. Max, Team, Enterprise 사용자도 이용할 수 있고, Claude Code와 Claude API에서 claude-sonnet-5로 사용할 수 있습니다.

Claude Sonnet 5 가격은 얼마인가요?

API 출시 가격은 2026년 8월 31일까지 입력 토큰 백만 개당 $2, 출력 토큰 백만 개당 $10이며, 이후 입력 $3, 출력 $15로 바뀝니다. 이는 출시 가격 기준 Opus 4.8 요금의 40%, 이후에는 60%입니다. 단, 새 토크나이저는 같은 텍스트를 Sonnet 4.6보다 약 30% 더 많은 토큰으로 계산합니다.

Sonnet 5는 실제로 좋은 모델인가요, 아니면 다운그레이드인가요?

에이전트 작업, 코딩, 툴 사용에서는 Sonnet 4.6보다 분명히 향상됐고, 높은 effort에서는 Opus 4.8에 근접합니다. 일부 사용자가 더 나빠졌다고 느끼는 주된 이유는 adaptive thinking이 이제 기본으로 켜지고, 비용을 다시 측정하기 전에는 토크나이저 변경으로 비용이 더 높아 보이기 때문입니다. 실제 프롬프트로 직접 테스트해야 합니다.

Claude Sonnet 5가 GPT-5.6보다 좋은가요?

작업에 따라 서로 앞서는 영역이 다릅니다. Sonnet 5의 강점은 저렴한 가격으로 제공하는 에이전트 작업 완수 능력과 툴 사용입니다. 반대편의 비교 관점은 GPT-5.6 리뷰에서 확인할 수 있습니다.

코딩 또는 에이전트 환경을 마이그레이션하면서 핵심 설정부터 제대로 맞추고 싶다면 무료 Claude Code + Codex 설정 체크리스트를 받아보세요. 운영 환경에서 모델을 바꾸기 전에 점검할 구성 및 비용 관리 절차와 새 모델 분석을 출시 때마다 확인할 수 있습니다.

마지막 업데이트

2026년 9월 3일

카테고리AI

Google에서 이 사이트를 우선하기

Google 검색에서 omidsaffari.com을 선호 소스로 추가

omidsaffari.com을 선호 소스로 지정하면 Google이 Top Stories, AI Overviews, AI Mode에서 우선적으로 보여 줍니다.

AI의 다른 글

AI 글 전체 보기
뉴스레터

매주 일요일, 한 통의 편지. 뜨거운 의견이 아닌, 돌아가는 시스템.

AI 벤처 포트폴리오 운영에서 나오는 빌드 로그, 가동 중인 시스템, 현장 노트.

주간 발행. 스팸 없음. 언제든 해지 가능합니다.