클로드 확장 추론(Extended Thinking) 알아보기
홍승협(준이아빠) / 데이터 분석, AI 실무 교육
Claude가 최종 답을 내기 전에 내부 추론 단계를 별도 블록으로 펼쳐 깊게 생각하는 모드입니다. 복잡한 분석, 다단계 추론, 코드 작성에서 결과 품질을 끌어올리는 데 쓰입니다.
이 글은 앤트로픽이 운영하는 platform.claude.com/docs의 Extended Thinking 자료를 한국 입문자가 보기 편하게 정리한 글입니다.
🤔 같은 모델인데 답이 더 좋아질 수 있나요?
Claude 같은 모델에 같은 질문을 던졌는데 어떤 날은 답이 깊고, 어떤 날은 표면적인 답만 나옵니다. 모델은 같은데 결과가 다릅니다.
답을 만들기 전에 내부 추론 단계를 길게 거치도록 설정할 수 있다면 결과가 안정적으로 깊어집니다. 이게 Extended Thinking이 다루는 자리입니다.
🔑 Extended Thinking, 무엇일까요?
Extended Thinking은 Claude가 최종 답을 내기 전에 내부 추론 단계를 별도 thinking 블록으로 펼쳐 깊게 생각하는 모드입니다.
공식 문서는 이 기능을 다음과 같이 설명합니다.
"Extended thinking gives Claude enhanced reasoning capabilities for complex tasks by creating thinking content blocks where it outputs internal reasoning before delivering the final answer."
일반 모드에서는 모델이 답을 한 번에 만들어 내놓습니다. Extended Thinking 모드에서는 답을 만들기 전에 내부 추론을 한 단계 더 거칩니다. 사용자에게 보이는 답에는 큰 차이가 없는 듯해도, 답의 일관성, 정확도, 깊이가 분명히 달라집니다.
🌐 어떤 모델에서 동작하나요?
(2026년 7월 기준) 모델별 지원 상황은 다음과 같습니다.
| 모델 | Adaptive Thinking | Extended Thinking |
|---|---|---|
| Claude Fable 5 | 지원 (항상 켜짐) | 미지원 |
| Claude Opus 5 | 지원 (권장) | 미지원 |
| Claude Sonnet 5 | 지원 (권장) | 미지원 |
| Claude Haiku 4.5 | 미지원 | 지원 |
Adaptive Thinking과 Extended Thinking은 사촌 관계입니다.
- Extended Thinking: 사용자가 추론 깊이(
budget_tokens)를 직접 정하는 수동 모드 - Adaptive Thinking: Claude가 작업 난이도에 맞춰 추론 깊이를 자동 조절하는 모드
현행 세대에서는 Extended Thinking을 쓸 수 있는 모델이 Haiku 4.5뿐입니다. Fable 5, Opus 5, Sonnet 5는 Adaptive 방식만 지원하고, Fable 5는 끄고 켜는 선택 없이 항상 켜진 상태로 동작합니다. Sonnet 4.6 같은 이전 세대 모델에서는 두 방식을 모두 쓸 수 있었습니다.
⚙️ 동작 방식
API 응답을 보면 다음 형태로 결과가 옵니다.
{
"content": [
{
"type": "thinking",
"thinking": "Let me analyze this step by step..."
},
{
"type": "text",
"text": "Based on my analysis..."
}
]
}thinking 블록은 모델의 내부 사고 과정이 펼쳐진 곳이고, text 블록은 사용자에게 보여주는 최종 답입니다. 일반 모드에서는 thinking 블록이 없고 text만 옵니다.
💡 어떤 작업에 가장 효과적일까요?
Extended Thinking은 다음과 같은 작업에서 큰 차이를 만듭니다.
- 여러 단계 추론: "이 데이터의 패턴을 분석한 뒤 가설 3개를 세우고 각각 검증해 달라"
- 복잡한 코드 작성: 다중 파일을 한 번에 수정해야 하는 리팩터링
- 긴 자료 분석: 두꺼운 보고서 전체를 보고 결론을 도출
- 수학, 논리, 증명: 단계별 풀이가 필요한 문제
반면 다음과 같은 작업에는 일반 모드로 충분합니다.
- 단순 사실 답변, 짧은 번역, 인사, 잡담
- 한 줄 요약, 단순 질문 응답
작업이 복잡할수록 Extended Thinking의 가치가 커집니다.
🔗 다른 기능과의 묶음
1. Projects + Extended Thinking
- 프로젝트 안에서 정해진 자료 위에 추론을 깊게 거치면 결과 품질이 매우 안정됩니다.
2. Tool Use + Extended Thinking
- 외부 도구(검색, DB, 계산)를 호출하는 작업에서 추론을 함께 거치면 도구 호출 사이의 일관성이 살아납니다.
3. Claude Cowork + Extended Thinking
- 자동화 작업에 깊은 분석을 결합하고 싶다면 Cowork 안에서 Extended Thinking을 사용 설정합니다.
⚠️ 주의할 점 3가지
1. 비용, 속도 트레이드오프
- 추론 블록도 토큰을 사용합니다. 비용과 응답 시간이 늘어나는 만큼, 단순 작업에는 켜지 않는 게 맞습니다.
2. thinking 블록 보존 (Tool Use 때)
- 도구를 호출하고 다시 답변을 이어 갈 때, 이전 thinking 블록을 함께 넘겨야 추론 일관성이 유지됩니다(API 사용자 한정).
3. 모델 선택과 함께 결정
- Claude 모델 패밀리에서 다룬 대로, 모델별 지원 여부가 다릅니다. 작업 성격에 맞춰 모델과 추론 모드를 함께 골라야 합니다.
💼 직무별 활용 시나리오
마케터, 기획자
- 분기별 시장 분석: 깊은 추론으로 가설, 검증, 결론 흐름이 살아 있는 보고서 초안
디자이너, PM
- 사용자 인터뷰 50건에서 패턴 추출: 단순 요약이 아니라 의미 있는 그룹화
개발자
- 다중 파일 리팩터링: 코드 의존성을 함께 추론하며 안전한 변경
이런 작업에서 Extended Thinking을 켜고 끈 결과를 비교해 보면 차이가 분명히 보입니다.
📋 3줄 요약
-
Extended Thinking은 Claude가 최종 답을 내기 전에 내부 추론 단계를 따로 펼쳐 깊게 생각하는 모드입니다.
-
추론 깊이를 사용자가 직접 정하는 Extended Thinking과 모델이 난이도에 맞춰 조절하는 Adaptive Thinking으로 나뉩니다.
-
2026년 7월 기준 Extended Thinking을 쓸 수 있는 모델은 Haiku 4.5뿐이고 Fable 5와 Opus 5, Sonnet 5는 Adaptive 방식만 지원합니다.
📚 참고 자료
- Extended Thinking 공식 문서: https://platform.claude.com/docs/en/build-with-claude/extended-thinking
- Adaptive Thinking 공식 문서: https://platform.claude.com/docs/en/build-with-claude/adaptive-thinking
- Claude 모델 개요: https://platform.claude.com/docs/en/about-claude/models/overview
이 글이 도움이 되셨다면 공유해 주세요
메신저로 바로 보내거나 링크를 복사할 수 있습니다.
Extended Thinking이 가장 큰 효과를 내는 작업 유형은 무엇일까요?
이어서 배우면 좋은 개념
클로드 모델 패밀리(Opus, Sonnet, Haiku) 비교하기
Claude는 단일 모델이 아니라 Fable, Opus, Sonnet, Haiku 등 여러 라인업으로 구성된 모델 패밀리입니다. 작업의 난이도, 속도, 비용에 따라 다른 모델을 골라 쓰도록 설계되었습니다.
클로드 프로젝트(Claude Projects) 활용하기
claude.ai에서 같은 자료, 지시, 대화 기록을 묶어 두는 작업 공간입니다. 매번 새 대화에서 컨텍스트를 다시 깔지 않고, 정해진 맥락 위에서 일관된 결과를 받기 위한 기능입니다.
생성형 엔진 최적화 (GEO) 이해하기
생성형 엔진 최적화(GEO)는 챗GPT, 제미나이 같은 AI가 만드는 답변에 내 콘텐츠가 인용되도록 만드는 작업입니다.
답변 엔진 최적화 (AEO) 이해하기
답변 엔진 최적화(AEO)는 검색과 AI가 질문에 바로 내놓는 답변에 내 콘텐츠가 뽑히도록, 콘텐츠를 질문과 완결된 답의 구조로 정리하는 작업입니다.
관련 인사이트
- AI 생산성 역설, 일이 늘어난 게 아니라 눈높이가 올라간 것AI 생산성 역설은 개인의 작업 속도는 빨라졌는데 조직의 생산성 지표는 거의 움직이지 않는 현상입니다. 일하는 시간이 늘었다는 말이 함께 나오는 배경을, 속도가 느려진 쪽이 아니라 그동안 넘어가던 품질을 이제야 챙기기 시작한 쪽에서 살펴봤습니다.
- BYOK 뜻과 AI 도구에서 쓰이는 상황: 내 API 키로 쓰기와 암호화 키 직접 관리BYOK(Bring Your Own Key)는 도구가 정해 준 계정 대신 내가 직접 받은 API 키나 암호화 키를 가져와 쓰는 방식입니다. AI 도구의 설정 화면에 자주 보이는 이 말이 어디서 왔는지, 구독과 무엇이 다른지, 개인과 코딩 도구와 회사와 도구 제작자의 네 가지 상황에서 어떤 판단이 필요한지 2026년 9월 기준으로 정리했습니다.
- 클로드 커머스 에이전트 정리: 쇼핑 에이전트와 판매자 에이전트가 하는 일과 GA4 측정클로드 커머스 에이전트(Claude Commerce Agents)는 앤트로픽이 2026년 9월 2일 공개한, 쇼핑 에이전트와 판매자 에이전트를 만드는 공개 청사진입니다. 두 에이전트가 무엇을 하고 무엇을 하지 않는지, 결제를 뺀 설계가 챗GPT와 구글의 접근과 어떻게 다른지, 장바구니 35%와 구매 완료 60%라는 수치를 어떻게 읽을지, 에이전트가 만든 방문과 주문이 GA4에서 어디로 잡히는지 정리했습니다.
- 힉스필드 N3on 무한 AI 라이브 정리: GPT-6 아스트라로 24시간 돌아가는 AI 스트리머의 실제힉스필드 무한 AI 라이브는 힉스필드가 만들고 GPT-6 아스트라가 움직이는, 스트리머 N3on의 모습을 실시간으로 계속 생성하는 킥 방송입니다. 2026년 9월 7일 시작된 이 방송이 어떻게 굴러가는지, 무한이라는 말과 달리 킥 채널에 남은 실제 길이는 얼마인지, 처음이 아니라는 커뮤니티 노트와 팔아넘겼다는 반응은 무엇인지, 스트리머와 마케터에게 무엇이 남는지 정리했습니다.
- 오픈클로 2.0에서 달라진 것과 업그레이드 전 확인할 점오픈클로 2.0은 오픈클로 재단이 2026년 8월 30일 공개한 개인 AI 에이전트 v2026.8.1입니다. 혼자 쓰던 도구에 여러 사람이 같은 세션으로 들어오는 공유 기능이 붙었고, 저장 방식이 SQLite로 바뀌면서 업그레이드가 막히는 문제도 함께 보고됐습니다.
- SSOT(Single Source of Truth) 뜻과 AI 시대에 문서를 한곳에서만 고쳐야 하는 이유SSOT(Single Source of Truth)는 하나의 정보를 한곳에서만 고치고 나머지 곳은 전부 그곳을 참조하게 만드는 원칙입니다. 데이터베이스 설계에서 나온 이 말이 지표 정의서와 노션 문서, 클로드 코드의 CLAUDE.md까지 이어지는 이유와 작은 팀에서 만드는 순서를 정리했습니다.
