AI & Tech

클로드 소네트 5 API 가격 정리: 2달러 확정과 실제 비용 계산

앤트로픽이 2026년 8월 10일 Claude Sonnet 5의 도입 요금(입력 100만 토큰당 2달러, 출력 10달러)을 표준 가격으로 확정했습니다. 9월 1일로 예정됐던 인상은 시행되지 않습니다. 요금 체계와 모델별 비교, 표시가와 실제 청구액이 다를 수 있는 토크나이저 변수까지 정리했습니다.

Share
클로드 소네트 5 API 가격 정리: 2달러 확정과 실제 비용 계산 대표 이미지

앤트로픽은 2026년 8월 10일 Claude Sonnet 5의 도입 요금, 즉 입력 100만 토큰당 2달러와 출력 100만 토큰당 10달러를 표준 가격으로 확정했습니다. 공식 발표문의 편집 노트와 요금 문서 각주 기준으로, 2026년 9월 1일 시행 예정이었던 3달러/15달러로의 인상은 시행되지 않습니다.

API로 클로드를 쓰는 팀이라면 9월 인상을 전제로 예산을 잡아 뒀을 수 있습니다. 그 전제가 사라졌다는 것이 이번 소식에서 실제로 달라지는 부분입니다. 다만 이 발표를 "가격 인하"로 읽으면 어긋나고, "소네트 5가 전 세대보다 33% 싸졌다"로 읽어도 절반만 맞습니다. 어디까지가 사실이고 어디부터가 계산이 필요한 영역인지 구분해 보겠습니다.

앤트로픽 공식 발표문과 요금 문서를 근거로, 2026년 8월 12일 기준으로 정리합니다.

앤트로픽이 공개한 Claude Sonnet 5 발표 이미지

무슨 일이 있었는지: 인하가 아니라 인상 철회

시간 순서로 보면 성격이 분명해집니다.

시점내용
2026년 6월 30일Sonnet 5 출시. 입력 2달러, 출력 10달러의 도입가로 제공 시작
출시 당시 안내도입가는 8월 31일까지, 9월 1일부터 3달러/15달러로 인상 예정
2026년 8월 10일도입가를 표준 가격으로 확정. 예정된 인상 철회

그러니까 이번 발표로 누군가의 청구서가 당장 내려가지는 않습니다. 이미 모두 2달러/10달러로 쓰고 있었기 때문입니다. 바뀐 것은 미래입니다. 인상 폭으로 보면 입력과 출력 모두 50% 오를 예정이었던 것이 사라졌고, 예정 정가였던 3달러/15달러는 소네트 4.6, 4.5와 같은 가격이었으니 "전 세대와 같은 가격으로 돌아갈 계획"이 취소된 셈입니다.

앤트로픽은 이 결정의 이유를 발표문에 적지 않았습니다. 경쟁 상황이나 수요를 이유로 드는 해설이 돌지만 전부 외부의 추정이라, 이 글에서는 다루지 않습니다.

Sonnet 5 요금 체계 전체

입력과 출력 단가 외에 실무 비용을 좌우하는 항목까지 공식 요금 문서 기준으로 정리하면 이렇습니다.

항목요금 (100만 토큰당)
입력$2
출력$10
프롬프트 캐시 쓰기 (5분)$2.50
프롬프트 캐시 쓰기 (1시간)$4
캐시 읽기$0.20
배치 API 입력$1 (50% 할인)
배치 API 출력$5

함께 알아 둘 조건이 하나 있습니다. 소네트 5는 100만 토큰 컨텍스트 전 구간이 같은 단가입니다. 긴 문서를 넣는다고 할증이 붙지 않는 구조라, 롱 컨텍스트 작업이 많은 워크로드에서는 이 균일가 자체가 비교 우위가 됩니다.

앤트로픽 공식 요금 문서의 모델별 가격표 화면. Claude Sonnet 5가 입력 2달러, 출력 10달러로 등재되어 있고 Opus 5는 5달러와 25달러, Sonnet 4.6은 3달러와 15달러로 표시되어 있다

위 화면은 앤트로픽 공식 요금 문서를 2026년 8월에 직접 캡처한 것입니다. 라인업 안에서의 위치를 보면 소네트 5(2달러/10달러)는 하이쿠 4.5(1달러/5달러)의 2배, 오푸스 5(5달러/25달러)의 40% 수준입니다. 상위 모델인 파블 5는 10달러/50달러입니다.

표시가와 청구액은 다르다: 토크나이저 변수

이 글에서 가장 중요한 대목입니다. "소네트 5가 4.6보다 33% 싸다"는 문장은 표시가 기준으로만 참입니다.

앤트로픽 스스로 발표문에 밝힌 내용인데, 소네트 5는 새 토크나이저를 씁니다. 토크나이저는 글을 토큰이라는 과금 단위로 쪼개는 장치인데, 새 방식은 같은 글을 넣어도 콘텐츠 종류에 따라 대략 1.0~1.35배 더 많은 토큰으로 셉니다. 미터기의 단가는 내렸는데 미터기가 도는 속도는 빨라진 셈이라, 실제 청구액은 워크로드에 따라 이전 세대와 비슷하거나 오히려 높아질 수도 있습니다.

이 변수 앞에서 실무자가 할 일은 단가 비교가 아니라 실측입니다.

  • 자기 워크로드로 잽니다. 앤트로픽 API의 토큰 계산 기능(count_tokens)에 대표적인 프롬프트를 넣어 소네트 4.6과 소네트 5에서 각각 토큰 수를 재면, 우리 작업이 몇 배로 세지는지 바로 나옵니다.
  • 언어별 배율은 다릅니다. 공개된 측정들은 언어와 콘텐츠 종류마다 증가율이 다르다는 것을 보여줍니다. 한국어의 배율은 공식 측정치가 없으므로, 한국어 중심 워크로드라면 직접 재는 것 말고는 확인할 방법이 없습니다.
  • 판단 기준은 태스크당 비용입니다. 100만 토큰당 단가가 아니라 "우리 작업 하나를 끝내는 데 드는 금액"으로 환산해야 모델 간 비교가 성립합니다.

경쟁 모델과의 가격 비교

경쟁사 대비 위치도 티어를 맞춰 봐야 정확합니다. 2026년 8월 기준 각 사 공식 요금 페이지의 수치입니다.

모델입력출력비고
Claude Sonnet 5$2$10100만 토큰 컨텍스트 전 구간 균일가
GPT-5.6 Terra (OpenAI)$2$12200K 초과 구간은 $4/$18로 할증
Gemini 3.1 Pro Preview (구글)$2$12200K 초과 구간은 $4/$18로 할증

같은 중간 티어끼리 보면 입력은 2달러로 나란하고, 출력에서 소네트 5가 10달러로 조금 낮습니다. 차이가 커지는 지점은 긴 컨텍스트입니다. 경쟁 두 모델은 200K 토큰을 넘는 구간에 할증이 붙는 반면 소네트 5는 균일가라, 대용량 문서 처리에서는 격차가 벌어집니다. 다만 위에서 본 토크나이저 변수가 있으므로, 이 표 역시 최종 판단은 태스크당 비용 실측으로 하는 것이 안전합니다. 참고로 OpenAI의 상위 모델(Sol, $5/$30)이나 경량 모델(Luna, $0.2/$1.2)과 비교하면 결론이 달라지므로, 비교할 때는 티어를 반드시 명시해야 합니다.

실무에서 이번 발표를 반영하는 법

  • 9월 예산을 되돌립니다. 인상을 전제로 9월 이후 API 예산을 1.5배로 잡아 뒀다면, 2달러/10달러 기준으로 되돌려 계산하면 됩니다.
  • 모델 선택을 다시 검토할 계기입니다. "도입가라서 곧 오른다"는 이유로 소네트 5 채택을 미뤘던 팀이라면 그 보류 사유가 사라졌습니다. 다만 채택 판단에는 토크나이저 실측을 포함해야 합니다.
  • 배치와 캐시로 추가 절감이 가능합니다. 실시간이 필요 없는 작업은 배치 API로 50%를 아끼고, 반복되는 프롬프트는 캐시 읽기(0.2달러)로 처리하는 구조가 단가 확정과 별개로 유효합니다.

그래서 실제로 33% 싸진 건가요?

표시가 기준으로는 그렇습니다. 소네트 4.6의 3달러/15달러 대비 소네트 5는 2달러/10달러로 3분의 1이 낮습니다. 다만 미터기 단가가 내려도 미터기가 빨리 돌면 요금이 그대로이듯, 새 토크나이저가 같은 글을 더 많은 토큰으로 세기 때문에 같은 작업의 실제 청구액 차이는 그보다 작거나 없을 수 있습니다. 우리 워크로드의 토큰 수를 두 모델에서 재 보기 전까지는 "33% 절감"을 예산에 반영하지 않는 것이 안전합니다.

이제 이 가격은 안 오르는 건가요?

이번에 확정된 것은 "예정됐던 인상의 철회"입니다. 앤트로픽은 permanent(영구)라는 표현을 썼고 현재 요금표에도 표준가로 등재되어 있지만, 이것이 미래의 어떤 가격 변경도 없다는 계약상 보증은 아닙니다. 시점을 명시해 "2026년 8월 기준 표준 가격"으로 이해하는 것이 정확합니다.

3줄 요약:

  • 앤트로픽이 2026년 8월 10일 Claude Sonnet 5의 도입가(입력 $2, 출력 $10)를 표준 가격으로 확정했습니다. 9월 1일 예정이었던 $3/$15 인상은 시행되지 않습니다.
  • 가격이 내린 것이 아니라 인상이 취소된 것이라 청구서는 그대로입니다. 표시가는 전 세대보다 33% 낮지만, 새 토크나이저가 토큰을 1.0~1.35배로 세므로 실제 비용은 워크로드별 실측이 필요합니다.
  • 같은 티어의 GPT-5.6 Terra, Gemini 3.1 Pro Preview와 입력가는 같고 출력가는 낮으며, 100만 토큰 균일가가 롱 컨텍스트에서의 차별점입니다.

Sources:

이 글이 도움이 되셨다면 공유해 주세요

메신저로 바로 보내거나 링크를 복사할 수 있습니다.

디지털마케터 뉴스레터

GA4, SEO, AI 마케팅 실무 인사이트를 월 1~2회 이메일로 보내드립니다.

다음으로 읽어볼 글

미니맥스 H3 정리: 스펙, 요금, 한국 제외 라이선스 쟁점 썸네일
AI & Tech미니맥스 H3 정리: 스펙, 요금, 한국 제외 라이선스 쟁점

미니맥스 H3는 텍스트, 이미지, 영상, 오디오를 한 컨텍스트로 읽어 최대 15초 영상을 스테레오 음향과 함께 생성하는 옴니모달 영상 생성 모델입니다. 스펙과 2단계 2K 구조, API 요금, 그리고 오픈 웨이트 라이선스가 한국을 제외 지역으로 명시한 쟁점까지 원문 기준으로 정리했습니다.

2026. 8. 12.
챗GPT 무료로 어디까지 되는지, 무제한 개방의 정확한 범위 썸네일
AI & Tech챗GPT 무료로 어디까지 되는지, 무제한 개방의 정확한 범위

오픈AI가 2026년 8월 6일 무료와 Go 요금제 이용자에게 GPT-5.6 루나를 기본 모델로 제공하고 일상 텍스트 대화를 무제한으로 열었습니다. 무제한의 정확한 범위, 루나 모델의 위치, 한국에서 진행 중인 시범 광고의 형태까지 정리했습니다.

2026. 8. 12.
OpenAI 사이버보안 이니셔티브 Daybreak 확장과 GPT-5.6-Cyber 공개 정리 썸네일
AI & TechOpenAI 사이버보안 이니셔티브 Daybreak 확장과 GPT-5.6-Cyber 공개 정리

OpenAI가 2026년 8월 10일 사이버보안 이니셔티브 Daybreak를 Blue와 Red 두 티어로 확장하고, 인가된 방어팀 전용 모델 GPT-5.6-Cyber를 공개했습니다. 두 티어의 차이와 접근 조건, 안전장치를 정리합니다.

2026. 8. 11.
RAG와 파인튜닝 차이: 고르는 기준 다섯 가지와 GraphRAG 썸네일
AI & TechRAG와 파인튜닝 차이: 고르는 기준 다섯 가지와 GraphRAG

RAG는 모델이 답하기 전에 학습 데이터 밖의 자료를 찾아 참고하게 만드는 방식이고, 파인튜닝은 예시를 학습시켜 모델이 답하는 방식을 바꾸는 작업입니다. 두 방식이 각각 무엇을 바꾸는지와 고르는 기준을 공식 문서 기준으로 정리합니다.

2026. 8. 8.
퀴즈

이번 발표로 Claude Sonnet 5를 쓰는 팀의 API 비용은 어떻게 되는 것일까요?