컨텍스트 윈도우 (Context Window) 들여다보기
홍승협(준이아빠) / 데이터 분석, AI 실무 교육
AI 모델이 한 번의 대화에서 동시에 처리할 수 있는 입력, 출력 토큰의 총량입니다. 컨텍스트 윈도우 크기에 따라 한 번에 던질 수 있는 자료의 분량과 대화 길이가 결정됩니다.
이 글은 앤트로픽이 운영하는 platform.claude.com/docs의 컨텍스트, 토큰 관련 자료를 한국 입문자가 보기 편하게 정리한 글입니다. 수치는 2026년 7월 기준 공식 문서를 그대로 옮겼습니다.
🤔 왜 긴 PDF를 통째로 못 받을 때가 있을까요?
두꺼운 PDF를 AI에 올리면 어떤 모델은 한 번에 받고, 어떤 모델은 "분량을 줄여서 다시 올려달라"고 합니다. 같은 자료인데 결과가 다릅니다.
이 차이는 모델의 컨텍스트 윈도우 크기에서 옵니다. 컨텍스트 윈도우는 AI가 한 번에 처리할 수 있는 자료의 양을 정하는 한계선입니다. 이 개념을 이해하면 어떤 모델을 골라야 할지가 분명해집니다.
🔑 컨텍스트 윈도우, 한마디로
컨텍스트 윈도우(Context Window)는 AI 모델이 한 번의 대화에서 동시에 처리할 수 있는 입력, 출력 토큰의 총량입니다.
토큰은 모델이 글을 잘라 보는 단위입니다. 영어는 보통 한 단어가 1~2 토큰이고, 한국어는 글자에 따라 1~3 토큰까지 다양합니다. 모델은 입력된 모든 토큰을 한 번에 보면서 답을 만들기 때문에, 입력이 컨텍스트 윈도우를 넘어서면 더 받을 수 없습니다.
📏 토큰, 단어로 환산하면
영어와 한국어 환산은 다음과 같이 정리할 수 있습니다.
- 1 토큰: 영어 약 0.75단어, 한국어 약 0.4글자
- 1,000 토큰: 영어 약 750단어, 한국어 약 400~600자
- 100K 토큰: 영어 약 7만 5천 단어(중편 소설 한 권), 한국어 약 단행본 1/3
- 200K 토큰: 한국어 단행본 절반~한 권 분량
- 1M 토큰: 한국어 단행본 한 권에서 두 권 사이
이 환산을 머릿속에 두면 자료 분량과 모델 한도를 빠르게 비교할 수 있습니다.
📊 Claude 모델별 컨텍스트 (2026년 7월 기준)
Claude 모델 패밀리 클래스에서 자세히 다뤘지만, 컨텍스트 관점만 다시 정리하면 다음과 같습니다.
| 모델 | 컨텍스트 윈도우 | 한국어 환산 |
|---|---|---|
| Claude Fable 5 | 1M 토큰 | 단행본 1~2권 |
| Claude Opus 5 | 1M 토큰 | 단행본 1~2권 |
| Claude Sonnet 5 | 1M 토큰 | 단행본 1~2권 |
| Claude Haiku 4.5 | 200K 토큰 | 단행본 절반~1권 |
Fable, Opus, Sonnet은 같은 1M 토큰을 가집니다. 단행본 한 권을 통째로 입력해도 잘라 보낼 필요가 없는 규모입니다.
같은 1M 토큰이라도 세대에 따라 담기는 글자 수는 다릅니다. Opus 4.7 세대부터 새 토크나이저를 쓰기 때문에, 같은 글이 이전 모델보다 약 30% 많은 토큰으로 계산됩니다. 그래서 현행 세대의 1M 토큰은 영어 약 55만 5천 단어에 해당하고, 이전 세대에서는 약 75만 단어였습니다.
🪟 컨텍스트가 작동하는 방식
대화가 길어질수록 다음과 같은 일이 일어납니다.
- 입력 + 출력 모두 컨텍스트에 누적됨: 사용자의 질문, AI의 답, 다시 사용자의 추가 질문이 모두 같은 컨텍스트에 쌓입니다.
- 첨부 자료도 토큰 사용: PDF, 이미지, 표를 업로드하면 그 내용이 토큰으로 변환되어 컨텍스트에 들어갑니다.
- 한도에 가까워지면 앞부분이 흐릿해짐: 모델은 컨텍스트의 모든 위치를 균등하게 보지 않습니다. 한도에 가까워질수록 앞부분 자료의 정확도가 떨어지는 경향이 있습니다.
대화가 길어졌는데 답이 점점 흐려진다면 컨텍스트가 한도에 차고 있다는 신호입니다.
⚙️ 컨텍스트를 잘 다루는 4가지 방법
1. 새 대화 시작하기
- 작업이 바뀌면 같은 대화에 이어 붙이지 말고 새 대화를 엽니다.
- 같은 컨텍스트에 너무 많은 주제를 섞으면 답 품질이 떨어집니다.
2. 자료를 미리 요약하기
- 매우 긴 자료를 그대로 던지지 말고, 먼저 요약을 받은 뒤 요약을 다시 입력에 쓰는 두 단계 흐름이 효율적입니다.
3. 핵심만 골라 첨부하기
- 100쪽 PDF에서 필요한 부분이 5쪽이라면, 5쪽만 따로 잘라 첨부합니다.
4. 모델 골라 쓰기
- 짧은 작업은 Haiku, 긴 자료는 Sonnet/Opus로 분기합니다. 200K 토큰으로 충분한 작업에 1M 모델을 쓸 필요는 없습니다.
💼 컨텍스트 윈도우가 결정적인 시나리오
1. 두꺼운 자료 분석
- 회의록 1년치, 책 한 권, 논문 모음 같은 자료를 통째로 던지려면 1M 컨텍스트가 필요합니다.
2. 코드베이스 전체 검토
- 회사 코드베이스 전체를 한 번에 읽혀서 리팩터링, 취약점 검토를 시킬 때 컨텍스트가 클수록 일관된 답이 나옵니다.
3. 멀티턴 대화 워크플로
- 같은 자료를 두고 단계별로 작업할 때(요약 → 분석 → 결론 → 슬라이드 변환), 컨텍스트가 작으면 앞 단계 자료가 잘려 결과 품질이 떨어집니다.
프롬프트 엔지니어링 기본에서 다룬 다섯 요소도 컨텍스트 안에서 함께 살아 있어야 효과가 납니다.
📋 3줄 요약
-
컨텍스트 윈도우는 모델이 한 번의 대화에서 동시에 처리할 수 있는 입력과 출력 토큰의 총량입니다.
-
2026년 7월 기준 Fable 5와 Opus 5, Sonnet 5는 1M 토큰이고 Haiku 4.5는 200K 토큰이라 한국어로는 단행본 한두 권과 절반에서 한 권 분량에 해당합니다.
-
질문과 답이 모두 같은 창에 쌓여서 대화가 길어지면 남는 자리가 줄어들고 Opus 4.7 세대부터는 토크나이저가 바뀌어 같은 글이 약 30퍼센트 많은 토큰으로 계산됩니다.
📚 참고 자료
- Claude 모델 개요: https://platform.claude.com/docs/en/about-claude/models/overview
- 토큰, 가격 안내: https://platform.claude.com/docs/en/about-claude/pricing
- Anthropic Academy: https://www.anthropic.com/learn
이 글이 도움이 되셨다면 공유해 주세요
메신저로 바로 보내거나 링크를 복사할 수 있습니다.
Claude Sonnet 5의 컨텍스트 윈도우 1M 토큰은 한국어 기준 대략 어느 정도 분량일까요?
이어서 배우면 좋은 개념
클로드 모델 패밀리(Opus, Sonnet, Haiku) 비교하기
Claude는 단일 모델이 아니라 Fable, Opus, Sonnet, Haiku 등 여러 라인업으로 구성된 모델 패밀리입니다. 작업의 난이도, 속도, 비용에 따라 다른 모델을 골라 쓰도록 설계되었습니다.
프롬프트 엔지니어링 기본 익히기
AI에게 일을 시킬 때 결과 품질을 결정하는 지시 작성법입니다. 역할, 맥락, 작업, 제약, 예시를 갖춘 프롬프트가 좋은 결과를 안정적으로 만듭니다.
생성형 엔진 최적화 (GEO) 이해하기
생성형 엔진 최적화(GEO)는 챗GPT, 제미나이 같은 AI가 만드는 답변에 내 콘텐츠가 인용되도록 만드는 작업입니다.
답변 엔진 최적화 (AEO) 이해하기
답변 엔진 최적화(AEO)는 검색과 AI가 질문에 바로 내놓는 답변에 내 콘텐츠가 뽑히도록, 콘텐츠를 질문과 완결된 답의 구조로 정리하는 작업입니다.
관련 인사이트
- AI 모델 증류 뜻과 과정: 로컬 LLM이 좋아지는 이유AI 모델 증류는 큰 원본 모델에 문제를 대량으로 풀린 뒤 그 답을 받아 작은 모델에 담는 방법입니다. 술을 내리는 공정과 어디까지 같은지, 원본과 증류본 사이에 무엇이 오가는지, 로컬 LLM은 2027년에 어디까지 갈지 정리했습니다.
- ChatGPT Images 2.5 정리: 달라진 점과 API 모델 2종ChatGPT Images 2.5는 오픈AI가 2026년 9월 8일 공개한 이미지 생성 모델입니다. 지정한 부분만 고치고 나머지를 유지하는 편집 정확도와 최대 50% 줄어든 생성 지연, API에 함께 나온 Flare와 Sunburst의 차이를 공식 발표문으로 정리했습니다.
- 클로드 맥스 집단소송 정리: 5배와 20배가 무엇의 배수인지클로드 맥스 집단소송은 앤트로픽이 Max 요금제의 사용 한도를 실제보다 크게 보이도록 광고했다는 미국 구독자들의 소송입니다. 5배와 20배가 5시간 세션을 기준으로 한 수치라는 점, 공식 요금제 페이지에서 그 조건이 어디에 적혀 있는지, 구독 전에 확인할 것을 정리했습니다.
- 메타 뮤즈 정리: 개인 AI 에이전트가 하는 일과 보안 구조메타 뮤즈(Meta Muse)는 메타가 2026년 9월 8일 공개한 개인 AI 에이전트입니다. 질문에 답하는 대신 메일을 보내고 예약과 결제를 대신하며, 전용 가상 머신과 감시 에이전트를 나눠 둔 구조와 연결 서비스, 요금제를 공식 발표문으로 정리했습니다.
- OpenAI 나비에 스토크스 증명 정리: 밀레니엄 문제와 공적 논란OpenAI 나비에 스토크스 증명은 3차원 유체 방정식이 유한 시간 안에 특이점을 만들 수 있음을 보인 결과입니다. 공개되지 않은 내부 모델을 쓴 에이전트 약 1만 개가 88시간 만에 도달했고, 같은 경로를 1년 가까이 연구하던 수학자들이 공적 문제를 제기한 경위를 공식 발표문을 근거로 정리했습니다.
- AI 생산성 역설, 일이 늘어난 게 아니라 눈높이가 올라간 것AI 생산성 역설은 개인의 작업 속도는 빨라졌는데 조직의 생산성 지표는 거의 움직이지 않는 현상입니다. 일하는 시간이 늘었다는 말이 함께 나오는 배경을, 속도가 느려진 쪽이 아니라 그동안 넘어가던 품질을 이제야 챙기기 시작한 쪽에서 살펴봤습니다.
