Gemini 3.8 & 3.8 Live Extended Thinking favicon

Gemini 3.8 & 3.8 Live Extended Thinking

Gemini 3.8 Live 및 3.8 Live Extended Thinking은 동시 추론, 백그라운드 도구 호출, 실시간 대화형 음성 워크플로를 위해 설계된 실시간 음성 및 멀티모달 대화 모델입니다.

챗봇동시 음성 대화 및 다단계 백그라운드 추론97개 언어에 대한 자동 식별 및 대화 중 언어 전환실시간 대화 지원을 위한 시각적 맥락 처리비동기 백그라운드 도구 실행 및 API 연동
Gemini 3.8 & 3.8 Live Extended Thinking product interface screenshot
예상 월간 방문 수
880만
데이터 기준:
AIToolly 등록일

Gemini 3.8 & 3.8 Live Extended Thinking란? 제품 개요

제품의 기능과 공식 포지셔닝

Gemini 3.8 Live 및 Gemini 3.8 Live Extended Thinking은 거의 실시간에 가까운 음성 상호작용, 시각적 접지(visual grounding), 다단계 추론을 위해 설계된 대화형 모델입니다.

Gemini 3.8 Live는 97개 언어의 자동 언어 전환을 갖춘 확장 가능한 대화 지능에 집중하며, 3.8 Live Extended Thinking은 동시 병렬 추론, 초기 대화 단서, 지속적인 백그라운드 작업 내레이션을 제공합니다.

Gemini 3.8 & 3.8 Live Extended Thinking으로 무엇을 할 수 있나요?

공식 출처로 확인된 활용 사례

실시간 직원 온보딩

실시간 시각적 맥락을 활용하여 질문에 답변함으로써 직원 온보딩 세션을 동적으로 안내합니다.

비동기 예약 조율

실시간 음성 대화를 중단하지 않고 다단계 예약을 조율하고 백그라운드 함수 호출을 실행합니다.

스케치를 통한 시각적 코드 생성

손으로 그린 시각적 스케치와 음성 안내를 작동 가능한 React 컴포넌트로 변환합니다.

병렬 추론 및 백그라운드 도구 실행

Gemini 3.8 Live Extended Thinking은 추론과 발화를 동시에 수행하여 음성 워크플로의 중단 문제를 해결합니다. 복잡한 요청을 처리하는 동안 대화를 멈추는 대신, 모델은 언어적 확인 및 진행 상황 내레이션과 같은 대화형 단서를 도입합니다.

백그라운드 실행 기능을 통해 두 모델 모두 비동기적으로 API 호출을 수행하고, 외부 도구를 실행하며, 다단계 작업을 처리할 수 있습니다. 기본 작업이 완료되는 동안 음성 상호작용은 일시 중지 없이 계속 이어집니다.

  • 수신된 요청을 자연스럽게 확인하기 위해 언어적 승인과 같은 초기 대화 단서를 활용합니다.
  • 백그라운드에서 다단계 작업이 실행될 때 이를 설명해 주는 실시간 진행 상황 내레이션을 제공합니다.
  • 외부 도구 실행 및 API 호출 중에도 끊김 없는 실시간 음성 대화를 지속해서 유지합니다.

Gemini 3.8 & 3.8 Live Extended Thinking 선택 전에 확인할 사항

본인의 자료와 작업 흐름으로 직접 확인할 항목

  • 자동 감지되는 97개 지원 언어 중에 필요한 대화 언어가 포함되어 있는지 확인하십시오.
  • 조직에서 Gemini Enterprise 배포를 위한 비공개 프리뷰 프로그램에 접근할 수 있는지 확인하십시오.
  • 대상 워크플로에 3.8 Live를 통한 표준 실시간 대화가 필요한지, 3.8 Live Extended Thinking을 통한 동시 다단계 추론이 필요한지 검토하십시오.

Gemini 3.8 & 3.8 Live Extended Thinking 출처 및 확인일

확인한 출처와 확인 시점

마지막 확인
카테고리
챗봇

Gemini 3.8 & 3.8 Live Extended Thinking 자주 묻는 질문

출처를 확인한 제품 정보를 바탕으로 한 답변

Gemini 3.8 Live Extended Thinking은 통화 중 복잡한 작업을 어떻게 처리하나요?

다단계 작업이 실행되는 동안 대화가 원활하게 이어지도록 자연스러운 언어적 확인과 실시간 진행 상황 내레이션을 활용하여 추론과 발화를 동시에 진행합니다.

이 모델들은 실시간 대화에서 몇 개의 언어를 지원하나요?

이 모델들은 수동으로 설정을 조정할 필요 없이 대화 도중에 지원되는 97개 언어를 자동으로 감지하고 자연스럽게 전환합니다.

생성된 오디오가 인공지능 출력물인지 어떻게 검증하나요?

모델이 생성하는 모든 오디오 출력에는 눈에 띄지 않는 SynthID 워터마크가 직접 삽입되어 AI 생성 콘텐츠로서의 감지 가능성을 유지합니다.

개발자는 이러한 음성 모델에 어디서 접근할 수 있나요?

개발자는 Gemini API 및 Google AI Studio는 물론 지원되는 파트너 스트리밍 플랫폼을 통해서 두 모델 모두에 접근할 수 있습니다.

Gemini 3.8 Live는 음성과 함께 시각적 맥락을 처리할 수 있나요?

예, Gemini 3.8 Live는 시각적 입력을 거의 실시간으로 처리하므로 모델이 시각적 맥락을 바탕으로 대화를 진행하고 질문에 답변할 수 있습니다.

같은 카테고리에 최근 등록된 다른 도구를 살펴보세요.