AI & Tech

제미나이 3.8 라이브 정리: 기본형과 확장 추론형 차이와 가격

/ 데이터 분석, AI 실무 교육

제미나이 3.8 라이브는 구글이 2026년 9월 15일 공개한 실시간 음성 대화 모델입니다. 기본형과 확장 추론형의 차이, 언어 97개 전환과 배경 도구 호출, 벤치마크 점수와 가격을 정리합니다.

2026. 9. 16.14
Share
제미나이 3.8 라이브 정리: 기본형과 확장 추론형 차이와 가격 대표 이미지

3줄 요약

이번 방문에서 한 편은 바로 볼 수 있습니다.

제미나이 3.8 라이브(Gemini 3.8 Live)는 구글이 2026년 9월 15일 공개한 실시간 음성 대화 모델입니다. 같은 날 추론을 강화한 제미나이 3.8 라이브 확장 추론(Gemini 3.8 Live Extended Thinking)도 함께 나왔습니다.

AI와 말로 대화하는 기능은 이미 여러 서비스에 들어와 있습니다. 스마트폰 비서에게 말을 걸거나 AI 앱의 음성 대화 버튼을 눌러 본 분들이 많습니다.

덜 알려진 것은 이 모델들이 실제 상담 창구를 대신할 수 있는지입니다. 안내원이 서류를 찾는 동안 말을 이어 가듯, 음성 에이전트도 조회하면서 대화를 이어 가야 통화가 끊기지 않습니다. 이번 발표는 그 처리 방식을 바꿨습니다. 구글 공식 발표와 제미나이 API 문서를 근거로 2026년 9월 16일 기준의 내용을 정리합니다.

제미나이 3.8 라이브와 확장 추론형의 쓰임 차이

같은 날 나온 두 모델은 쓰임이 다릅니다. 구글은 기본형을 규모와 비용 효율에 맞춘 선택지로, 확장 추론형을 복잡한 작업용으로 설명합니다.

항목제미나이 3.8 라이브제미나이 3.8 라이브 확장 추론
모델 이름gemini-3.8-livegemini-3.8-live-extended-thinking
겨냥한 용도지연 없는 음성 응대와 실시간 대화여러 단계를 처리해야 하는 작업
추론 방식대화 흐름 우선말하면서 동시에 추론
배경 작업도구와 API 호출여러 에이전트 조율까지

확장 추론형의 특징은 말을 멈추지 않는다는 것입니다. 답을 찾는 동안 침묵이 이어지면 통화가 끊긴 것처럼 느껴지는데, 이 모델은 확인해 보겠다는 식의 말을 먼저 꺼내고 진행 상황을 소리로 알려 주며 작업을 이어 갑니다.

제미나이 3.8 라이브 대화에서 달라진 세 가지

발표에서 밝힌 변화는 세 가지로 묶입니다. 세 가지 모두 두 모델에 함께 들어갑니다.

  • 언어 97개 자동 전환: 대화 도중 언어가 바뀌면 알아서 감지하고 넘어갑니다. 설정에서 언어를 미리 고르지 않아도 됩니다.
  • 시각 입력 처리: 카메라로 비춘 화면을 거의 실시간으로 함께 봅니다. 눈앞의 물건을 보여 주면서 묻는 방식이 가능해집니다.
  • 배경 도구 호출: 요청을 받아들였다고 먼저 말하고, 도구 호출과 API 조회는 대화를 이어 가는 동안 뒤에서 처리합니다.

세 번째가 음성 상담에 직접 영향을 줍니다. 조회가 끝날 때까지 침묵하는 구간이 사라지면 사람이 응대하는 통화에 가까워집니다.

공개 자료에는 실제 사용 예시도 함께 나와 있습니다. 화면을 비추면 신입 교육 절차를 단계별로 안내하거나, 손으로 그린 스케치와 음성 지시를 받아 화면 구성 요소를 만들어 내는 예시도 함께 공개되었습니다.

벤치마크 점수와 경쟁 모델 비교

구글이 공개한 점수는 다음과 같습니다. 독립 평가 기관의 음성 품질 지수와 음성 에이전트 대상 평가가 섞여 있습니다.

평가3.8 라이브 확장 추론3.8 라이브비교 대상
음성 품질 지수82.676.0GPT 라이브 1 아스트라(GPT-Live-1 Astra) 81.5, 그록 보이스 싱크 패스트 2.0(Grok Voice Think Fast 2.0) 81.3
에이전트 작업 완수68.6%공개되지 않음GPT 라이브 1 아스트라 67.9%, 그록 보이스 싱크 패스트 2.0 56.5%
금융 상담 평가35.1%공개되지 않음GPT 라이브 1 아스트라 32.0%
오디오 추론97.7%공개되지 않음공개되지 않음

확장 추론형은 음성 품질 지수에서 1위를 기록했고, 기본형은 사용자 선호를 겨루는 음성 에이전트 아레나에서 2위에 올랐습니다.

눈여겨볼 것은 금융 상담 평가의 절대 점수입니다. 1위가 35.1%라는 것은 실제 상담 업무를 끝까지 처리하는 일이 아직 어렵다는 뜻입니다. 음성 품질이 좋아진 것과 업무를 완결하는 것은 다른 문제이므로, 상담 전체를 맡기기보다 앞단 응대와 정보 조회부터 적용하는 순서가 안전하다고 봅니다.

두 모델의 가격과 실제 비용 차이

공식 가격표에 나온 두 모델의 단가는 같습니다. 2026년 9월 유료 등급 가격입니다.

구분단가
오디오 입력100만 토큰당 3달러 또는 분당 0.005달러
오디오 출력100만 토큰당 12달러 또는 분당 0.018달러
텍스트 입력100만 토큰당 0.75달러
텍스트 출력100만 토큰당 4.50달러

단가가 같다고 해서 청구액이 같아지지는 않습니다. 확장 추론형은 배경에서 추론에 쓰는 토큰이 더 붙기 때문입니다. 입력 오디오 한 시간을 기준으로 계산한 한 분석에서는 기본형이 0.84달러, 확장 추론형이 3.50달러로 나왔고, 같은 기준에서 경쟁 모델은 4.80달러와 5.83달러로 계산되었습니다. 계산 방식에 따라 달라지는 수치이므로 차이의 크기만 참고하면 됩니다.

통화 한 건의 평균 길이와 하루 건수부터 정리해 두면 비용을 미리 가늠할 수 있습니다. 분당 단가가 나와 있으므로 곱셈으로 월 비용을 대략 계산할 수 있습니다.

제미나이 3.8 라이브를 지금 써 볼 수 있는 경로

개발자가 쓰는 길은 두 가지입니다. 제미나이 API와 구글 AI 스튜디오에서 두 모델을 모두 고를 수 있습니다. 기업용인 제미나이 엔터프라이즈에서는 비공개 프리뷰 단계입니다.

연결에 쓰는 것은 Live API이고, 문서에는 프리뷰 단계라고 표시되어 있습니다. 앱과 모델이 웹소켓으로 계속 연결된 채 오디오와 영상, 텍스트를 주고받는 구조입니다.

개발 없이 써 보는 방법도 있습니다. 확장 추론형은 제미나이 라이브와 구글 워크스페이스의 문서, 지메일, 킵에서 쓸 수 있고, 기본형은 검색 라이브에 들어갔습니다. 워크스페이스 쪽은 구독 등급에 따라 제공 범위가 달라집니다.

음성 인프라를 직접 만들지 않으려면 연동 도구를 쓰는 선택지도 있습니다. 라이브키트(LiveKit)나 파이프캣(Pipecat), 랭체인(LangChain) 같은 플랫폼이 Live API 연동을 제공합니다.

음성 에이전트를 만들 때 먼저 정할 것

모델을 고르기 전에 정해 두면 시행착오가 줄어드는 항목이 있습니다.

  1. 끊김을 어디까지 허용할지 정합니다. 조회가 오래 걸리는 업무라면 배경 처리 중 무슨 말을 할지 대본을 먼저 만듭니다.
  2. 사람에게 넘기는 조건을 정해 둡니다. 금융 상담 평가 점수가 보여 주듯 끝까지 처리하지 못하는 문의가 남습니다.
  3. 음성 기록의 보관 범위를 미리 잡습니다. 통화 내용에는 개인정보가 섞이므로 저장 여부와 기간을 먼저 확인합니다.

구글이 만든 음성에는 SynthID 워터마크가 들어갑니다. 사람 귀로는 알아채기 어렵지만 AI가 만든 소리인지 판별할 수 있게 표시를 넣는 방식이라, 안내 음성을 외부에 내보낼 때 함께 확인합니다.

자주 묻는 질문

한국어 음성 대화도 자연스럽게 되나요?

언어 97개에 한국어가 포함되고 대화 도중 언어 전환도 안내되어 있습니다. 다만 구글이 공개한 점수는 언어별로 나뉘어 있지 않아서, 한국어 통화 품질은 구글 AI 스튜디오에서 직접 말해 보고 판단해야 합니다.

기본형과 확장 추론형 가운데 무엇을 고르면 되나요?

문의 유형으로 나누는 편이 쉽습니다. 영업시간 안내나 주문 조회처럼 한 번에 끝나는 문의가 많으면 기본형으로 충분하고, 조건을 따져 여러 시스템을 거쳐야 하는 업무라면 확장 추론형 쪽이 맞습니다. 단가는 같지만 실제 비용은 확장 추론형이 더 나옵니다.

기존 전화 시스템에 바로 붙일 수 있나요?

모델은 Live API로 연결되므로 전화망과 잇는 부분은 따로 필요합니다. 실시간 음성 스트리밍을 다루는 플랫폼들이 Live API 연동을 제공하고 있어서, 직접 만들지 않고 그 구성을 쓰는 방법이 있습니다.

3줄 요약

  • 제미나이 3.8 라이브와 3.8 라이브 확장 추론은 구글이 2026년 9월 15일 공개한 실시간 음성 대화 모델이고 제미나이 API와 구글 AI 스튜디오에서 바로 쓸 수 있습니다.
  • 두 모델 모두 대화 도중 언어 97개를 자동으로 바꿔 알아듣고, 말을 이어가면서 배경에서 도구와 API를 호출하며, 카메라 입력을 거의 실시간으로 함께 봅니다.
  • 확장 추론형은 음성 품질 지수 82.6으로 1위를 기록했고 공식 단가는 기본형과 같지만 배경 추론에 토큰을 더 쓰므로 실제 비용은 더 나옵니다.

Sources:

이 글이 도움이 되셨다면 공유해 주세요

메신저로 바로 보내거나 링크를 복사할 수 있습니다.

Author

Written by

데이터로 설명하는 마케터

퀴즈

제미나이 3.8 라이브 확장 추론형이 기본형과 다른 점은 무엇일까요?

이 글이 도움이 되었나요?

다음 단계

이어서 읽기 좋은 글

딥시크(DeepSeek) 정리: 무료 사용 범위와 데이터 처리, 고르는 기준

딥시크(DeepSeek)는 중국 항저우의 AI 기업 딥시크가 만든 대화형 AI 서비스이자 그 회사가 공개하는 언어모델의 이름입니다. 무료로 쓸 수 있는 범위와 API 요금, 공식 개인정보처리방침에 적힌 데이터 처리 조건, 챗지피티나 클로드 대신 고를 기준을 2026년 9월 15일 자료로 정리했습니다.

다음 글 읽기

같이 보면 좋은 글

GPT-5.6 모델 정리: 정의와 성능, GPT-5.5와 달라진 점 썸네일
AI & TechGPT-5.6 모델 정리: 정의와 성능, GPT-5.5와 달라진 점

GPT-5.6은 OpenAI가 2026년 7월 9일 정식 출시한 AI 모델 세대입니다. 이름 규칙과 토큰 효율 중심의 설계, 공식 발표에 실린 벤치마크 수치, 새로 생긴 max와 ultra 설정을 GPT-5.5와 나란히 놓고 정리했습니다.

2026. 9. 15.
GLM 모델 정리: Z.ai 버전별 차이와 쓰는 방법 4가지 썸네일
AI & TechGLM 모델 정리: Z.ai 버전별 차이와 쓰는 방법 4가지

GLM은 중국 AI 기업 Z.ai가 만드는 오픈 웨이트 언어 모델 계열입니다. 2026년 9월 기준 현행 모델 네 가지의 규모와 가격, 라이선스를 나란히 놓고 웹 화면과 API, 코딩 구독, 가중치 내려받기까지 쓰는 방법을 공식 자료로 정리했습니다.

2026. 9. 15.
재귀적 자기개선(RSI) 뜻과 구글 딥마인드 루머 정리 썸네일
AI & Tech재귀적 자기개선(RSI) 뜻과 구글 딥마인드 루머 정리

재귀적 자기개선은 AI가 자기 코드와 학습 절차를 스스로 고쳐 다음 판을 더 낫게 만드는 상태입니다. 트윗 한 줄에서 시작해 API 유출과 구글의 키 회수로 번진 2026년 9월 루머를 시간 순서로 정리하고, 확인된 사실과 추측의 경계를 나눴습니다.

2026. 9. 15.
GPT-6 아스트라 사용법: 요금제별 제공 범위와 모델 확인 순서 썸네일
AI & TechGPT-6 아스트라 사용법: 요금제별 제공 범위와 모델 확인 순서

GPT-6 아스트라는 OpenAI가 2026년 9월 3일 공개한 모델이고, 컴퓨터를 사람처럼 직접 조작하는 작업에 초점을 두고 있습니다. 구독 중인데도 모델 목록에 아스트라가 없는 경우가 많은데, 대부분은 계정 문제가 아니라 요금제마다 열리는 화면이 다르기 때문입니다. 요금제별 제공 범위, 확인 순서, 회사 계정의 관리자 설정, API 요금 계산을 공식 문서로 확인해 정리했습니다.

2026. 9. 14.

ADVERTISEMENT

이 글의 학습 경로

글 전체 보기

관련 개념

무료 셀프 교육으로 배워보세요

코스 전체 보기