구글이 2026년 9월 15일 제미나이 3.8 Live와 제미나이 3.8 Live Extended Thinking을 공개했다. 실시간 대화(live dialogue)에 특화된 모델 계열로, 병렬 추론이 강화돼 음성으로 복잡한 작업을 지시하고 진행시키는 데 초점이 맞춰져 있다.
가장 눈에 띄는 특징은 대화를 중단하지 않은 채 복잡한 추론, 실시간 시각 맥락 처리, 백그라운드 작업 실행을 동시에 다룬다는 점이다. 두 모델 모두 제미나이 API, 구글 워크스페이스, 제미나이 앱에서 즉시 사용할 수 있다.
음성 인터페이스의 오랜 불편함은 "기다림"이었다. 뭔가를 시키면 모델이 생각하는 동안 대화가 멈춘다. 사람 사이 대화에서는 상대가 생각하는 동안에도 "잠깐만요, 확인해 볼게요" 같은 말이 오가는데, 음성 AI에서는 그 구간이 통째로 침묵이었다. 이번 발표에서 반복해서 강조된 백그라운드 작업 실행은 정확히 그 침묵을 겨냥한다.
두 모델의 분업
| 모델 | 겨냥하는 작업 | 특징 |
|---|---|---|
| Gemini 3.8 Live | 일반적인 실시간 대화 | 저지연 응답, 실시간 시각 맥락 처리 |
| Gemini 3.8 Live Extended Thinking | 고난도·다단계 작업 | 추론 강화, 다단계 계획 수행 |
구조는 최근 모델 시장의 일반적인 분화와 같다. 빠른 티어와 깊게 생각하는 티어를 나누고, 애플리케이션이 상황에 따라 고르게 한다. 여기서 실무 과제는 "언제 어느 쪽을 부를 것인가"라는 라우팅 결정이 된다.
실시간 음성 애플리케이션에서 진짜 어려운 것들
음성 에이전트를 만들어 본 팀은 안다. 모델 품질보다 먼저 무너지는 건 대화 관리다. 구체적으로 네 가지가 어렵다.
개발자가 지금 점검할 것
시장 맥락 — 9월의 모델 러시는 계속된다
9월 들어 프런티어 벤더의 발표가 촘촘하다. 월초에 이미 여러 모델이 쏟아졌고, 중순에 구글이 실시간 대화 축으로 다시 한 번 밀어붙였다. 이런 국면에서 특정 모델에 애플리케이션을 고착시키는 건 위험하다. 벤치마크 순위는 몇 주 단위로 뒤집히고, 그때마다 코드를 뜯어고칠 수는 없다.
현실적인 방어는 단순하다. 모델 호출을 얇은 어댑터 뒤에 두고, 작업 유형별 평가 세트를 유지하며, 교체 비용을 항상 하루 안쪽으로 유지하는 것. 화려한 추상화는 필요 없다. 필요한 건 바꿀 수 있는 상태를 유지하는 규율이다.
출처
- Google Blog, "Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking" (2026-09-15) — https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/
- 9to5Google, "Gemini 3.8 Live Extended Thinking powers Gemini Live, Gmail, & Keep" — https://9to5google.com/2026/09/15/gemini-3-8-live-announced/
- Google Blog, "Build real-time voice applications with Gemini 3.8 Live and 3.5 Transcribe" — https://blog.google/innovation-and-ai/technology/developers-tools/build-real-time-voice-applications-gemini-audio/
자주 묻는 질문
제미나이 3.8 Live는 기존 모델과 무엇이 다른가요?
실시간 대화에 특화된 모델로, 병렬 추론이 강화돼 대화를 중단하지 않고 복잡한 작업을 수행하는 데 초점이 맞춰져 있습니다. 실시간 시각 맥락 처리와 백그라운드 작업 실행이 함께 강조됐습니다.
Extended Thinking 버전은 언제 써야 하나요?
다단계 추론이 필요한 고난도 작업에 적합합니다. 단순 질의응답이나 빠른 응답이 중요한 구간에는 기본 Live 모델이 유리합니다. 실제 서비스에서는 작업 유형에 따라 두 티어를 라우팅하는 구성이 일반적입니다.
어디서 사용할 수 있나요?
발표 시점 기준 제미나이 API, 구글 워크스페이스, 제미나이 앱에서 사용할 수 있다고 안내됐습니다. API로 접근하면 자체 애플리케이션에 실시간 음성 기능을 붙일 수 있습니다.
음성 에이전트에서 가장 신경 써야 할 부분은 무엇인가요?
모델 품질보다 대화 관리입니다. 끼어들기 처리, 턴 경계 판정, 첫 소리까지의 지연, 지연 변동성이 체감 품질을 좌우합니다. 평균 지연이 낮아도 가끔 크게 튀면 대화가 어색해집니다.
모델이 자주 바뀌는데 어떻게 대응해야 하나요?
모델 이름을 코드에 하드코딩하지 말고 설정으로 분리하며, 작업 유형별 평가 세트를 유지해 교체 시 회귀를 측정하세요. 교체 비용을 낮게 유지하는 것이 특정 모델을 잘 고르는 것보다 장기적으로 중요합니다.

댓글 0