커뮤니티 입장하기

제미나이 4 아르곤 공개 정리: 가격, 벤치마크, 누가 먼저 쓰는지와 SNS 반응

구글이 9월 30일(미국 시각) 차세대 모델 제미나이 4 아르곤을 발표했습니다. 지금 쓸 수 있는 곳은 사이버 보안 방어 기관과 구글 내부뿐이고, 다음 순서는 유료 API 고객과 AI 울트라 요금제 사용자입니다. 소개 가격 100만 토큰당 입력 2달러와 출력 10달러, 출력 한도 100만 토큰, 구글이 공개한 19개 벤치마크, 해커뉴스와 X, 블룸버그 보도에 나온 반응을 정리했습니다.

새로 올라온 글이에요. 먼저 읽어 보고 퀴즈도 풀어 보세요
Share
제미나이 4 아르곤 공개 정리: 가격, 벤치마크, 누가 먼저 쓰는지와 SNS 반응 대표 이미지
목차
  1. 지금 쓸 수 있는 곳과 다음 순서
  2. 가격과 출력 한도
  3. 구글이 공개한 벤치마크 19개
  4. 구글이 밝힌 내부 사용 사례
  5. 해커뉴스와 X, 언론 반응
  6. 발표 전 목격담과 실제 발표 대조
  7. 지금 준비할 것과 확인할 순서
  8. 참고한 자료

세 줄로 먼저 읽기

이번 방문에서 한 편은 바로 볼 수 있습니다.

구글이 9월 30일 미국 시각 오후 4시(한국 시각 10월 1일 오전 5시) 차세대 모델 제미나이 4 아르곤을 발표했습니다. 9월 내내 X에서 코드명으로만 돌던 아르곤이 실제 제품 이름이 됐습니다. 다만 발표문 첫 문단부터 지금 바로 쓸 수 있는 모델은 아니라고 적혀 있어서, 출시됐다는 소식만 보고 제미나이 앱이나 AI 스튜디오를 열면 찾을 수 없습니다.

이 글은 2026년 10월 1일 오전 기준으로 누가 먼저 쓰는지, 가격과 출력 한도, 구글이 공개한 벤치마크, 해커뉴스와 X, 블룸버그 보도에 나온 반응을 나눠 정리합니다. 발표 전 목격담과 유출 수치는 제미나이 4 프로 아르곤 정리에 있고, 이 글 뒤쪽에서 그때 돌던 수치가 실제와 얼마나 맞았는지 대조합니다.

지금 쓸 수 있는 곳과 다음 순서

구글 딥마인드 코라이 카부크추올루 수석 부사장이 쓴 발표문에 적힌 공개 순서는 이렇습니다.

  1. 지금: 페어윈드 프로그램에 참여한 사이버 보안 방어 기관과 구글 내부 팀
  2. 함께 진행 중: 미국 정부의 출시 전 모델 접근 절차에 자발적으로 참여하고, 초기 시험자 의견을 받아 안전장치를 고칩니다
  3. 다음: 유료 API 고객과 구글 AI 울트라 요금제 사용자
  4. 그 뒤: 더 넓은 범위의 개발자, 기업, 일반 소비자

페어윈드 프로그램은 구글 딥마인드가 9월 초 사이버 보안 특화 모델 제미나이 3.8 플래시 사이버를 내놓으면서 만든 사전 제공 프로그램입니다. 정부, 의료기관, 통신사처럼 중요한 시설을 지키는 조직이 대상이고, 신청서를 내면 구글이 심사합니다. 실리콘앵글 보도에 따르면 9월 3일 시작해 크라우드스트라이크, 팔로알토 네트웍스를 포함한 650개가 넘는 조직이 참여하고 있습니다. 3.8 플래시 사이버가 무엇인지는 제미나이 3.8 플래시와 3.8 플래시 사이버 공개에 정리해 두었습니다.

3단계와 4단계에는 날짜가 없습니다. 발표문 표현은 가능한 한 빨리입니다. 10월 1일 한국 시각 오전 10시에 제미나이 API 모델 문서와 가격 페이지, 변경 이력을 다시 열어 봤을 때 gemini-4로 시작하는 모델 ID는 어디에도 없었습니다. 개인 개발자가 지금 아르곤을 호출할 방법은 없다는 뜻입니다.

페어윈드 참여 기관과 구글 내부 팀에는 사이버 보안 관련 안전장치를 끈 판이 제공됩니다. 보안 회사 위즈(Wiz)는 이 모델로 전 세계 병원이 쓰는 의료 소프트웨어에서 민감한 개인정보가 노출되는 심각한 취약점을 찾았고, 이전 최상위 모델들은 이 취약점을 놓쳤다고 구글은 설명했습니다. 발표문은 단계 공개의 이유를 이 수준의 능력을 안전하게 내놓으려면 단계를 나눠야 한다고만 설명합니다. 취약점을 스스로 찾고 고치는 능력은 공격에도 그대로 쓰일 수 있으니, 방어하는 쪽에 먼저 준 것도 같은 이유로 보입니다.

가격과 출력 한도

발표문에 적힌 API 가격은 소개 가격과 이후 가격 두 가지입니다.

구분입력 (100만 토큰당)출력 (100만 토큰당)캐시된 입력
소개 가격2달러10달러입력 가격의 95% 할인 (0.10달러)
소개 기간 이후4달러20달러발표문에 없음

소개 기간이 언제 끝나는지는 적혀 있지 않습니다. 제미나이 3.1 프로 프리뷰처럼 20만 토큰을 넘는 긴 입력에 다른 단가를 매기는지도 발표문에는 나오지 않았습니다. 모델 문서와 가격 페이지에 항목이 올라와야 확정됩니다.

이미 공개된 모델과 견주면 위치가 보입니다. 아래 가격은 각 회사 공식 가격 페이지 기준입니다.

모델입력 (100만 토큰당)출력 (100만 토큰당)
제미나이 4 아르곤 (소개 가격)2달러10달러
제미나이 4 아르곤 (이후)4달러20달러
제미나이 3.1 프로 프리뷰 (20만 토큰 이하)2달러12달러
제미나이 3.8 플래시 (12월 31일까지 할인가)0.75달러3.75달러
클로드 오퍼스 5.54달러20달러
클로드 페이블 5.110달러50달러

소개 가격은 지금 쓰는 3.1 프로 프리뷰와 입력 단가가 같고 출력은 오히려 2달러 낮습니다. 소개 기간이 끝나면 클로드 오퍼스 5.5와 같은 가격이 됩니다. GPT-6 아스트라는 공식 API 가격을 확인하지 못해 표에서 뺐습니다.

출력 한도도 크게 바뀌었습니다. 출력 한도는 모델이 답 하나로 한 번에 내놓을 수 있는 최대 토큰 수이고, 토큰은 모델이 글을 쪼개 처리하는 단위입니다. 구글은 아르곤의 출력 한도를 이전 제미나이 모델의 6만4,000 토큰에서 100만 토큰으로 늘렸다고 밝혔습니다. 모델이 깊게 생각하면서 한 번의 작업에 수십만 토큰을 만들 수 있어야 어려운 문제를 한 번에 푼다는 설명입니다.

100만 토큰을 꽉 채운 답 하나의 출력 비용을 계산해 보면, 소개 가격에서 10달러, 이후 가격에서 20달러입니다. 생각하는 과정에 쓰인 토큰도 출력으로 청구되는 것이 지금 제미나이 API의 방식이라, 긴 작업을 맡길수록 출력 쪽 비용이 커집니다. 반대로 모델에 넣을 수 있는 입력의 크기, 즉 컨텍스트 창은 발표문에 없습니다. 해커뉴스에서도 입력 한도는 어디 있느냐는 질문이 나왔습니다.

구글이 공개한 벤치마크 19개

구글 딥마인드 제미나이 페이지에는 아르곤과 GPT-6 아스트라, 클로드 페이블 5.1, 클로드 오퍼스 5.5를 견준 표가 있습니다. 시험 19개 가운데 아르곤이 1위인 것이 13개, 공동 1위가 1개, 다른 모델보다 낮은 것이 5개입니다. 모두 구글이 직접 돌린 결과이고, 측정 방법은 딥마인드 평가 방법 페이지에 따로 공개했습니다.

아르곤이 앞선 시험부터 보면 지식 업무와 긴 입력 처리에서 차이가 큽니다.

시험무엇을 보는지아르곤GPT-6 아스트라페이블 5.1오퍼스 5.5
Vals Index금융, 코딩, 법률, 세무 업무를 미국 GDP 비중으로 가중한 점수68.9%63.1%65.8%67.0%
AutomationBench재피어가 만든 업무 자동화 처음부터 끝까지 실행51.3%41.4%31.4%42.5%
Vals Finance Agent v2여러 단계의 금융 조사65.4%53.5%58.9%58.6%
Harvey Legal Agent법률 조사와 문서 작성19.6%5.4%6.7%3.8%
DeepSWE v1.1실제 소프트웨어 개발의 긴 작업77.9%74.1%67.4%74.2%
GraphWalks 256K~1M25만~100만 토큰 입력 속 관계 추적84.2%71.8%65.0%66.8%
LVBench긴 영상 이해91.7%87.5%79.7%83.7%
CWE-bench v1보안 취약점 수정68.0%68.0%58.0%67.0%

뒤진 시험은 대부분 코딩과 컴퓨터 조작 쪽입니다.

시험무엇을 보는지아르곤가장 높은 모델
FrontierSWE v2에이전트 코딩55.0%GPT-6 아스트라 65.5%
Terminal-bench 4.0터미널에서 명령을 실행하며 하는 코딩 작업57.4%오퍼스 5.5 66.4%
PostTrainBench머신러닝 엔지니어링45.3%오퍼스 5.5 49.3%
Terminal-Bench Science 0.1터미널에서 하는 과학 계산57.6%GPT-6 아스트라 68.1%
OSWorld-2.0컴퓨터 화면을 직접 조작하는 작업69.2%GPT-6 아스트라 72.6%

두 표를 같이 보면 성격이 드러납니다. 여러 단계를 거치는 문서와 데이터 분석 업무, 긴 영상과 긴 입력에서는 아르곤이 앞서고, 터미널이나 화면을 직접 다루며 코드를 고치는 에이전트 작업에서는 오퍼스 5.5와 아스트라가 여전히 앞섭니다. 같은 에이전트 코딩인데 DeepSWE에서는 1위, FrontierSWE에서는 10%포인트 넘게 뒤진다는 점은 해커뉴스에서도 지적됐습니다. 어느 시험이 자기 작업과 비슷한지 보고 판단하는 편이 낫습니다.

구글이 밝힌 내부 사용 사례

발표문은 아르곤이 이미 구글 내부 업무에 쓰이고 있다며 사례 세 가지를 들었습니다. 모두 구글이 밝힌 결과이고 외부에서 검증된 것은 아닙니다.

  • 메모리 절감: 아르곤 에이전트 여러 개가 구글 데이터센터 전체의 성능 측정 기록을 분석해 메모리 최적화를 찾아 적용했고, 300TiB 넘는 메모리를 확보했다고 합니다. 전체 절감 예상치는 500TiB에서 1PiB입니다
  • C/C++ 코드를 러스트로 옮기기: 정규식 라이브러리 re2부터 80만 줄이 넘는 퓨시아 운영체제의 지르콘 커널까지 옮기는 중입니다. 영상 디코더 libgav1에서는 기존 러스트 판보다 2.7배 빠르면서 출력은 똑같은 결과를 냈다고 합니다
  • 양자 알고리즘: 양자컴퓨팅 연구에서 큐비트와 게이트 사용량을 줄이는 작업에서 논문에 발표된 기준보다 40% 나은 결과를 몇 분 만에 냈다고 합니다

러스트는 메모리 관련 오류를 컴파일 단계에서 막아 주는 프로그래밍 언어입니다. 해커뉴스에서는 이 대목에 답글이 많이 달렸는데, 구글 핵심 라이브러리를 대규모로 옮길 수 있다면 C++의 앞날이 달라질 수 있다는 의견과, 구글 안에서 러스트 도입을 오래 미뤄 왔다는 이야기가 함께 나왔습니다.

해커뉴스와 X, 언론 반응

해커뉴스에서는 발표 직후 올라온 글이 10월 1일 오전 기준 924점, 댓글 636개를 받았습니다. 많이 나온 의견은 네 가지입니다.

  • 못 쓰는 모델을 왜 발표하느냐는 불만이 가장 많았습니다. 첫 댓글부터 모델을 내놓지 못한다는 평판을 이번에도 벗지 못했다는 내용이었고, 일반 사용자에게는 아직 풀리지 않았다, 공개 날짜라도 알려 달라는 댓글이 이어졌습니다. AI 플러스 요금제를 쓰는데 제미나이 앱에서 고를 수 있는 최신 모델이 아직 3.6 플래시 라이트라는 불만도 있었습니다
  • 가격에는 놀랐다는 반응이 나왔습니다. 소개 가격 문장을 인용하고 감탄사만 단 댓글에 답글이 열 개 달렸습니다
  • 벤치마크를 그대로 믿기 어렵다는 의견도 있었습니다. 요즘 벤치마크가 포화 상태라 직접 써 보기 전에는 판단을 미루겠다, 점수만 높이도록 맞춘 것 아니냐는 댓글이 있었습니다
  • 안전 대목은 호평을 받았습니다. 모델의 사고 과정을 감시한 결과를 다시 학습에 넣지 않아 감시를 피하는 쪽으로 사고가 바뀌지 않게 했다는 대목을 인용하며, 이런 신중함 때문에 구글이 느리다는 평을 듣는다는 댓글이 있었습니다

X에서는 구글 AI 스튜디오를 맡은 로건 킬패트릭이 발표 직후 사이버 방어 기관부터 공개하고 가능한 한 빨리 넓히겠다며 소개 가격을 강조했습니다. 외부 평가를 돌리는 한 계정은 자체 지표에서 아르곤이 4위였고, 우주선 시뮬레이션 게임 케르발 스페이스 프로그램을 끝까지 깨는 시험에서 페이블 5.1, GPT-6 아스트라, 오퍼스 5.5와 함께 성공한 몇 안 되는 모델이라고 올렸습니다. 다만 일반 이용자가 직접 써 본 후기는 아직 나올 수 없는 상황이라, X 반응은 구글 관계자와 발표문 수치를 옮긴 게시물이 대부분입니다.

언론은 제목부터 접근 제한을 짚었습니다. XDA 디벨로퍼스는 아르곤을 공개했지만 쓰는 건 허락되지 않는다고, 더뉴스택은 훌륭하지만 아직 가질 수 없다고 제목을 달았습니다. XDA는 앤트로픽이 미토스를 일부 기관에만 먼저 주고 일반에는 페이블과 오퍼스로 내놓은 흐름과 같다고 봤고, 일반 공개 때 이름이 바뀔 수도 있다고 추측했습니다. 이름 변경은 구글이 밝힌 내용이 아닙니다.

반응 가운데 주가까지 움직인 것은 블룸버그 보도입니다. 같은 날 나온 이 기사는 개발 상황을 직접 아는 구글 직원들을 인용해 아르곤이 벤치마크에서는 잘하지만 실제 업무에 써 보면 그만큼 잘하지 못하고, 일부 코딩 작업과 앱 화면 디자인 같은 프런트엔드 작업에 약하다고 전했습니다. 앤트로픽과 오픈AI 모델이 더 빨리 좋아지고 있다는 내부 의견도 소개했습니다. 구글은 코딩에서 성능이 떨어진다는 말은 사실과 다르다고 반박했고, 내부에 아르곤이 최상위 수준이라는 공감대가 크다는 다른 직원 발언도 같은 기사에 실렸습니다. 인베스팅닷컴에 따르면 알파벳 주가는 보도 뒤 장 막판에 2% 넘던 상승 폭이 0.5%로 줄었습니다.

국내 매체는 10월 1일 아침 일제히 공개 소식을 전했고, 대부분 성능 1위와 일반 사용 제한을 함께 제목에 넣었습니다.

발표 전 목격담과 실제 발표 대조

9월 한 달 동안 X에 돌던 이야기 가운데 맞은 것과 틀린 것이 이번 발표로 나뉘었습니다.

발표 전 이야기출처실제 발표
내부 코드명 아르곤X 계정 Lentils, 9월 14일맞음. 코드명이 아니라 정식 이름이 됨
제미나이 4 프로라는 등급 이름여러 X 게시물발표문에 프로라는 말은 없음
출력 한도 256K 토큰Lentils, 9월 14일실제는 100만 토큰
컨텍스트 창 2M 토큰Lentils, 9월 14일 (미정이라고 적음)발표문에 입력 한도 없음
입력 2.25달러, 출력 11.25달러익명 이미지실제 소개 가격은 2달러, 10달러
10월 초중순 출시X 게시물 추측9월 30일 발표, 일반 공개 날짜는 없음

출력 한도가 이전 모델보다 크다는 방향은 맞았지만 수치는 네 배가 아니라 열다섯 배 넘게 늘었습니다. 유출 가격표도 수준은 비슷했지만 숫자는 달랐습니다. 아레나에서 gemini-3.8-flash 이름 뒤로 아르곤이 돌았는지는 이번 발표에서도 확인되지 않았습니다. 블룸버그 보도에 나온 프런트엔드 디자인 약점은 아레나 시험자들이 디자인을 가장 높이 평가했던 것과 반대인데, 시험자들이 본 모델이 아르곤이었는지부터 확인되지 않아 둘을 견주기는 어렵습니다.

지금 준비할 것과 확인할 순서

일반 공개 첫 순서가 유료 API 고객과 AI 울트라 요금제 사용자이니, API로 쓸 계획이라면 결제가 연결된 제미나이 API 프로젝트를 미리 만들어 두면 열리는 날 바로 시험할 수 있습니다. 무료 요금제와 제미나이 앱의 일반 요금제에 언제 들어올지는 발표문에 한 줄도 없습니다.

공개 여부는 아래 순서로 확인하는 편이 확실합니다.

  1. 제미나이 API 모델 문서(ai.google.dev/gemini-api/docs/models)에 gemini-4로 시작하는 모델 ID가 올라왔는지 봅니다
  2. 가격 페이지에서 소개 가격이 언제까지인지, 긴 입력에 다른 단가가 붙는지 봅니다
  3. 모델 문서에서 입력 토큰 한도를 확인합니다. 출력 100만 토큰은 발표됐지만 입력 한도는 아직 공개되지 않았습니다

어느 모델로 옮길지는 벤치마크 표에서 자기 작업과 비슷한 시험을 골라 보고 정하는 편이 좋습니다. 계약서와 재무 자료처럼 긴 문서를 분석하는 일이 많다면 아르곤의 지식 업무 점수와 가격이 눈에 띄고, 터미널에서 돌리는 코딩 에이전트가 주 업무라면 지금 표만으로는 오퍼스 5.5나 아스트라에서 옮길 이유가 약합니다. 앞서 본 구글 내부 의견처럼 점수와 실제 작업 결과가 다를 수 있으니, 공개되면 지금 쓰는 모델과 같은 작업을 나란히 돌려 결과와 비용을 기록해 두면 같은 조건으로 견줄 수 있습니다.

참고한 자료

  • Google, "Gemini 4 Argon: our next era of frontier intelligence" (2026년 9월 30일)
  • Google DeepMind, Gemini 모델 페이지 벤치마크 표 (2026년 10월 1일 확인)
  • Google DeepMind, Fairwind Program 안내 페이지 (2026년 10월 1일 확인)
  • Google, Gemini API 모델 문서와 가격 페이지, 변경 이력 (2026년 10월 1일 확인)
  • Anthropic, Claude 모델 개요 문서 (오퍼스 5.5, 페이블 5.1 가격)
  • Bloomberg, "Google Grapples With Employee Skepticism About New Gemini Model" (2026년 9월 30일)
  • Investing.com, 알파벳 주가 관련 보도 (2026년 9월 30일)
  • SiliconANGLE, "Google's new frontier AI model Gemini 4 Argon goes to cybersecurity defenders first" (2026년 9월 30일)
  • XDA Developers, "Google reveals Gemini 4 Argon, but you're not allowed to use it" (2026년 9월 30일)
  • The New Stack, "Gemini 4 Argon is here: It's great, and you can't have it yet" (2026년 9월 30일)
  • Hacker News, "Gemini 4 Argon" 토론 (2026년 10월 1일 오전 확인)
  • Logan Kilpatrick, X 게시물 (2026년 9월 30일)
Share

제대로 이해했는지 한 문제로 확인해 볼까요?

답을 고르면 바로 풀이가 나와요.

2026년 10월 1일 기준으로 제미나이 4 아르곤을 쓸 수 있는 곳은 어디일까요?

이 글이 도움이 되었나요?

이 글 다음 배우기제미나이 입문입문 코스 · 11편

제미나이 앱, 모델, 워크스페이스 안의 기능을 구분하는 것부터 시작합니다

  1. 1제미나이(Gemini) 뜻과 앱, 모델, API 구분하기
  2. 2제미나이 모델 라인업 읽는 법과 확인된 모델 구분하기
  3. 3제미나이 요금제와 무료 범위, 학생 요금제 이해하기
코스 전체 보기 →
이어서 읽기 좋은 글제미나이 4 프로 아르곤 정리: 아레나 목격담과 구글이 밝힌 출시 일정 →

아르곤은 제미나이 4 프로 시험판의 내부 코드명으로 X의 한 계정이 처음 전한 이름입니다. 9월 14일부터 26일까지 나온 목격담과 256K 출력 한도의 출처, 9월 23일 구글 딥마인드 책임자가 밝힌 일정을 나눠 정리했습니다. 2026년 9월 30일 기준으로 구글은 아르곤과 제미나이 4 프로라는 이름을 확인하지 않았습니다.