AI & Tech

GPT-5.6 Luna 파격적인 가격 공개와 GPT의 역습

GPT-5.6 Luna는 OpenAI GPT-5.6 제품군의 최소형 경량 모델로, 2026년 7월 30일 API 가격이 80% 인하되었습니다. 인하 내용과 기술적 배경, Claude와 Gemini를 겨냥한 경쟁 구도 변화를 정리했습니다.

2026. 7. 31.
GPT-5.6 Luna 파격적인 가격 공개와 GPT의 역습 대표 이미지

GPT-5.6 Luna는 OpenAI가 2026년 7월 9일 공개한 GPT-5.6 제품군에서 가장 작고 빠른 경량 모델입니다. OpenAI는 2026년 7월 30일, 출시 3주 만에 Luna의 API 가격을 80% 인하한다고 발표했습니다. 입력 100만 토큰당 0.20달러, 출력 100만 토큰당 1.20달러입니다. 비슷한 지능 점수를 받는 모델 가운데 가장 낮은 수준입니다.

모델을 새로 내놓은 지 3주 만에 가격을 5분의 1로 내리는 일은 흔치 않습니다. 2026년 상반기까지 벤치마크 점수로 겨루던 AI 모델 경쟁이 하반기 들어 가격 경쟁으로 무게를 옮기고 있다는 신호로 보입니다. 이 글에서는 인하 내용, 인하가 가능했던 배경, Claude와 Gemini를 겨냥한 경쟁 구도 변화를 정리했습니다.

OpenAI 공식 가격 페이지의 Flagship models 표. gpt-5.6-luna가 입력 0.20달러, 캐시 입력 0.02달러, 출력 1.20달러로 표시되어 있다

위 이미지는 인하가 반영된 OpenAI 공식 가격 페이지의 플래그십 모델 표입니다. 상위 모델인 gpt-5.6-sol, gpt-5.6-terra와 나란히 놓고 보면 Luna의 가격이 얼마나 낮아졌는지 한눈에 들어옵니다.

100만 토큰당 0.20달러는 어느 정도 금액일까요?

토큰은 AI 모델이 글을 읽고 쓸 때 사용하는 최소 단위입니다. 일상에서 쓰는 단위가 아니라서 숫자만 봐서는 감을 잡기 어렵습니다. 영어 기준 1토큰은 대략 0.75단어이므로, 100만 토큰은 영어 단어 약 75만 개입니다. 장편 소설 7~8권, A4 문서로는 약 1,500장에 해당하는 분량입니다. 한국어는 영어보다 토큰 소모가 커서 같은 토큰으로 처리되는 글자 수는 이보다 줄어듭니다.

이 분량 전체를 Luna에 읽히는 비용이 0.20달러입니다. 1달러를 1,500원으로 계산하면 약 300원입니다. 실무 상황으로 바꿔 보면 다음과 같습니다.

  • 장편 소설 1권 분석: 약 13만 토큰이므로 입력 비용은 약 0.03달러, 45원 정도입니다.
  • 1시간 분량 회의록 요약: 약 1만 토큰이므로 입력 비용은 0.002달러, 3원 수준입니다.
  • 하루 1,000건 문의 메일 분류: 건당 500토큰으로 잡아도 하루 입력 비용은 0.10달러, 150원 정도입니다.

같은 100만 입력 토큰을 다른 모델에 읽히면 비용 차이가 뚜렷해집니다. 2026년 7월 기준 입력 토큰 가격입니다.

모델100만 입력 토큰 비용원화 환산 (1,500원 기준)
GPT-5.6 Luna$0.20약 300원
Claude Haiku 4.5$1.00약 1,500원
Gemini 3.6 Flash$1.50약 2,250원
GPT-5.6 Terra$2.00약 3,000원
Claude Sonnet 5$3.00 (2026년 8월 31일부터 표준 요금)약 4,500원
GPT-5.6 Sol, Claude Opus 5$5.00약 7,500원

소설책 7~8권 분량을 읽히는 데 Luna는 300원, 같은 경량 모델인 Haiku 4.5는 1,500원, 최상위 모델인 Opus 5는 7,500원이 드는 셈입니다. 모델이 생성하는 답변, 즉 출력 토큰 비용은 별도이며 Luna는 100만 출력 토큰당 1.20달러입니다.

GPT-5.6 Luna 가격은 얼마나 내려갔을까요?

2026년 7월 기준, 이번 인하로 바뀐 가격은 다음과 같습니다. 모든 가격은 100만 토큰당 미국 달러 기준입니다.

모델기존 (입력/출력)변경 (입력/출력)인하 폭
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.2080%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.0020%
GPT-5.6 Sol$5.00 / $30.00$5.00 / $30.00유지

가격 인하와 함께 몇 가지 변화가 더 있었습니다.

  • 캐시 입력 가격: Luna의 캐시된 입력은 100만 토큰당 0.02달러입니다. 같은 프롬프트를 반복 사용하는 서비스라면 입력 비용이 추가로 90% 내려갑니다.
  • Fast mode 도입: 기존 Priority Processing을 대체하는 옵션입니다. 표준 대비 최대 2.5배 빠른 속도를 2배 가격에 제공합니다. Sol 기준 입력 10달러, 출력 60달러입니다.
  • Codex와 ChatGPT Work 반영: 인하된 가격이 Codex와 ChatGPT Work의 사용량 계산에도 그대로 반영됩니다. 같은 요금제에서 쓸 수 있는 작업량이 늘어나는 셈입니다.

GPT-5.6 Luna의 인하 후 가격은 출시 시점 가격의 정확히 5분의 1입니다. 입력 기준으로 Anthropic의 경량 모델인 Claude Haiku 4.5보다 약 5배 저렴한 수준입니다.

OpenAI는 어떻게 80%나 내릴 수 있었을까요?

단순히 손해를 감수하는 출혈 경쟁이라면 오래가기 어렵습니다. OpenAI는 인하 발표 전날인 7월 29일에 공개한 기술 문서에서 인하의 근거를 설명했습니다.

  • GPU 커널 재작성: 추론 서빙 코드의 GPU 커널을 다시 작성해 전체 서빙 비용을 20% 줄였다고 밝혔습니다.
  • 스페큘레이티브 디코딩 개선: 토큰 생성 효율을 15% 이상 끌어올렸다고 설명했습니다.

스페큘레이티브 디코딩이라는 용어가 낯설 수 있습니다. 쉽게 말하면 작은 모델이 다음 단어들을 미리 초안으로 적어 두고, 큰 모델은 그 초안이 맞는지 확인만 하는 방식입니다. 큰 모델이 모든 단어를 처음부터 만들 때보다 같은 시간에 더 많은 토큰이 나옵니다.

흥미로운 대목은 이 최적화 작업에 GPT-5.6 자신이 참여했다는 점입니다. OpenAI는 모델이 운영 코드를 재작성하고 최적화하는 능력이 비용 절감에 기여했다고 설명했습니다. 모델이 자기 자신을 서빙하는 코드를 개선해 자기 가격을 낮춘 구조입니다. 이런 방식이 앞으로도 반복된다면, AI 모델의 가격 인하 주기는 지금보다 더 짧아질 가능성이 적지 않아 보입니다.

Claude와 Gemini를 겨냥한 역습일까요?

이번 발표에서 OpenAI가 어디를 겨냥했는지는 공식 X 계정의 발표문과 함께 실린 차트에서 드러납니다.

저희는 비용 효율성, 기능 및 속도 측면에서 모델의 한계를 뛰어넘기 위해 최선을 다하고 있습니다. 오늘부터 GPT-5.6 Luna의 가격을 80%, GPT-5.6 Terra의 가격을 20% 인하하고, API에서 GPT-5.6 Sol의 더 빠른 옵션을 제공합니다.

OpenAI 공식 X 계정의 가격 인하 발표. GPT-5.6 Luna가 Artificial Analysis Intelligence Index v4.1에서 비슷한 지능 점수의 모델 대비 훨씬 낮은 작업당 비용을 기록한 산점도 차트가 함께 실려 있다

Artificial Analysis Intelligence Index라는 지표가 낯설 수 있습니다. 독립 벤치마크 기관인 Artificial Analysis가 여러 시험 결과를 종합해 모델의 지능을 하나의 점수로 나타낸 지수입니다. 위 차트는 가로축이 작업당 비용(로그 스케일), 세로축이 이 지수 점수입니다. 왼쪽 위에 있을수록 싸고 똑똑한 모델입니다.

차트에서 GPT-5.6 Luna는 왼쪽 위 끝에 홀로 자리 잡고 있습니다. 비슷한 점수대의 Claude Opus 5(Low), Gemini 3.6 Flash, GLM-5.2 Max는 모두 오른쪽, 즉 더 비싼 자리에 놓였습니다. OpenAI가 전하려는 메시지는 명확합니다. 같은 지능이라면 Luna가 몇 배 싸다는 것입니다.

경쟁 구도를 가격 축으로 정리하면 다음과 같습니다.

  • 경량 모델 구간: Luna(입력 $0.20)는 Claude Haiku 4.5 대비 입력 기준 약 5분의 1 가격입니다. Gemini의 Flash 계열과도 정면으로 겹치는 구간입니다.
  • 중간 모델 구간: Terra(입력 $2.00)는 Claude Sonnet 5의 표준 요금(2026년 8월 31일부터 입력 $3.00) 아래로 내려갔습니다.
  • 최상위 구간: Sol(출력 $30.00)은 Claude Opus 5(출력 $25.00)보다 여전히 비쌉니다. 최상위 구간에서는 가격보다 성능으로 승부하겠다는 구도로 읽힙니다.

2026년 상반기는 Claude가 코딩 성능으로, Gemini가 멀티모달과 검색 연동으로 각자 영역을 넓힌 시기였습니다. OpenAI가 하반기 들어 최상위가 아닌 경량 구간의 가격을 먼저 움직인 것은, 대량 호출이 발생하는 기업용 시장에서 점유율을 되찾으려는 선택으로 보입니다. 기업 고객이 모델 비용에 민감해지고 있다는 외신 분석도 이런 해석을 뒷받침합니다.

이번 발표를 진행해 온 인물이 OpenAI의 Codex 엔지니어링 리드인 Thibault Sottiaux라는 점도 눈여겨볼 만합니다. Sottiaux는 GPT-5.6 공개 방송을 진행했고, 출시 이후에는 X에서 추론 최적화 진행 상황과 Codex 사용량 정책 조정 내용을 계속 공유해 왔습니다. 모델 발표와 가격 정책이 코딩 에이전트 제품과 한 묶음으로 움직이고 있다는 뜻입니다.

실무에서는 무엇을 점검하면 될까요?

가격이 5분의 1로 내려가면 기존의 모델 선택 기준이 달라집니다. 간단한 계산 예시로 확인해 보겠습니다.

월 1억 입력 토큰, 2천만 출력 토큰을 쓰는 고객 상담 챗봇을 Luna로 운영한다고 가정합니다.

항목인하 전인하 후
입력 비용 (1억 토큰)$100$20
출력 비용 (2천만 토큰)$120$24
월 합계$220$44

같은 트래픽 기준으로 월 비용이 220달러에서 44달러로 줄어듭니다. 반대로 예산이 그대로라면 같은 돈으로 5배의 트래픽 처리가 가능합니다. 이 정도 차이라면 점검해 볼 항목이 생깁니다.

  • 모델 라우팅 재검토: 비용 때문에 상위 모델 호출을 아끼도록 설계한 분기 로직이 있다면, 기준값을 새 가격으로 다시 계산해 보세요.
  • 캐시 활용 확인: 시스템 프롬프트가 긴 서비스라면 캐시 입력 가격(100만 토큰당 $0.02)을 적용받고 있는지 확인해 보세요.
  • 속도가 병목인 기능 점검: 응답 속도 때문에 기능을 줄였던 곳이 있다면 Fast mode(2배 가격, 최대 2.5배 속도)가 대안이 될 수 있습니다.
  • 가격 재확인 습관: 이번 사례처럼 출시 3주 만에 가격이 바뀌기도 합니다. 비용 관련 의사결정 전에는 공식 가격 페이지를 기준으로 확인하는 편이 안전합니다.

3줄 요약:

  • OpenAI는 2026년 7월 30일 GPT-5.6 Luna의 API 가격을 80% 인하해 입력 100만 토큰당 0.20달러, 출력 1.20달러로 조정했고, Terra는 20% 인하했습니다.
  • 인하의 근거는 GPU 커널 재작성으로 서빙 비용을 20% 줄이고 스페큘레이티브 디코딩으로 토큰 생성 효율을 15% 이상 높인 기술 개선입니다.
  • 경량 모델 구간에서 Claude Haiku 4.5, Gemini Flash 계열을 가격으로 압박하는 구도이며, 대량 호출 기업 시장을 겨냥한 경쟁 전략으로 해석됩니다.

Sources

다음으로 읽어볼 글

퀴즈

2026년 7월 30일 인하 이후 GPT-5.6 Luna의 API 가격은 100만 입력 토큰당 얼마일까요?