Gemini 3.8 & 3.8 Live Extended Thinking
Gemini 3.8 Live 및 3.8 Live Extended Thinking은 동시 추론, 백그라운드 도구 호출, 실시간 대화형 음성 워크플로를 위해 설계된 실시간 음성 및 멀티모달 대화 모델입니다.
Gemini 3.8 Live 및 3.8 Live Extended Thinking은 동시 추론, 백그라운드 도구 호출, 실시간 대화형 음성 워크플로를 위해 설계된 실시간 음성 및 멀티모달 대화 모델입니다.
제품의 기능과 공식 포지셔닝
Gemini 3.8 Live 및 Gemini 3.8 Live Extended Thinking은 거의 실시간에 가까운 음성 상호작용, 시각적 접지(visual grounding), 다단계 추론을 위해 설계된 대화형 모델입니다.
Gemini 3.8 Live는 97개 언어의 자동 언어 전환을 갖춘 확장 가능한 대화 지능에 집중하며, 3.8 Live Extended Thinking은 동시 병렬 추론, 초기 대화 단서, 지속적인 백그라운드 작업 내레이션을 제공합니다.
공식 출처로 확인된 활용 사례
실시간 시각적 맥락을 활용하여 질문에 답변함으로써 직원 온보딩 세션을 동적으로 안내합니다.
실시간 음성 대화를 중단하지 않고 다단계 예약을 조율하고 백그라운드 함수 호출을 실행합니다.
손으로 그린 시각적 스케치와 음성 안내를 작동 가능한 React 컴포넌트로 변환합니다.
Gemini 3.8 Live Extended Thinking은 추론과 발화를 동시에 수행하여 음성 워크플로의 중단 문제를 해결합니다. 복잡한 요청을 처리하는 동안 대화를 멈추는 대신, 모델은 언어적 확인 및 진행 상황 내레이션과 같은 대화형 단서를 도입합니다.
백그라운드 실행 기능을 통해 두 모델 모두 비동기적으로 API 호출을 수행하고, 외부 도구를 실행하며, 다단계 작업을 처리할 수 있습니다. 기본 작업이 완료되는 동안 음성 상호작용은 일시 중지 없이 계속 이어집니다.
본인의 자료와 작업 흐름으로 직접 확인할 항목
확인한 출처와 확인 시점
출처를 확인한 제품 정보를 바탕으로 한 답변
다단계 작업이 실행되는 동안 대화가 원활하게 이어지도록 자연스러운 언어적 확인과 실시간 진행 상황 내레이션을 활용하여 추론과 발화를 동시에 진행합니다.
이 모델들은 수동으로 설정을 조정할 필요 없이 대화 도중에 지원되는 97개 언어를 자동으로 감지하고 자연스럽게 전환합니다.
모델이 생성하는 모든 오디오 출력에는 눈에 띄지 않는 SynthID 워터마크가 직접 삽입되어 AI 생성 콘텐츠로서의 감지 가능성을 유지합니다.
개발자는 Gemini API 및 Google AI Studio는 물론 지원되는 파트너 스트리밍 플랫폼을 통해서 두 모델 모두에 접근할 수 있습니다.
예, Gemini 3.8 Live는 시각적 입력을 거의 실시간으로 처리하므로 모델이 시각적 맥락을 바탕으로 대화를 진행하고 질문에 답변할 수 있습니다.