AI와 음성으로 대화하는 기능은 이제 낯설지 않습니다.
그런데 Google이 새롭게 공개한 Gemini 3.8 Live는 단순히 질문을 듣고 말로 답하는 수준에서 한 단계 더 나아가는 모습입니다.
대화하면서 추론하고, 필요한 도구를 호출하고, 화면이나 카메라를 보면서 상황을 이해하는 방향으로 발전했습니다.
Google이 2026년 9월 공개한 Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking이 무엇이 달라졌는지 핵심만 정리해보겠습니다.
🎙️ Gemini 3.8 Live란?
Gemini 3.8 Live는 Google의 새로운 실시간 음성 대화 모델입니다.
사람이 말하면 음성을 텍스트로 바꾼 뒤 다시 답을 만드는 단순한 방식이 아니라 오디오를 직접 입력받고 오디오로 응답하는 실시간 모델입니다.
Google은 이를 지금까지 자사가 공개한 실시간 대화형 모델 가운데 가장 뛰어난 모델이라고 소개했습니다.
두 종류가 있습니다.
Gemini 3.8 Live
빠른 응답이 필요한 일반적인 실시간 음성 대화를 위한 모델입니다.
Gemini 3.8 Live Extended Thinking
대화가 진행되는 동안 더 많은 추론이 필요한 복잡한 작업을 위한 모델입니다.
🧠 말하는 동안 뒤에서 생각한다
Extended Thinking에서 특히 흥미로운 부분은 백그라운드 추론입니다.
사람과 음성 대화를 계속하면서 동시에 뒤에서는 더 복잡한 문제를 분석할 수 있습니다.
즉,
질문 → 오래 기다림 → 답변
이라는 흐름보다
대화를 이어가면서 필요한 분석도 병행하는 방식
에 가까워집니다.
복잡한 일정 조정이나 여러 조건을 비교하는 작업, 단계가 많은 문제를 음성으로 처리할 때 활용 가능성이 커지는 이유입니다.
🛠️ 대화 중 필요한 도구도 호출
Gemini 3.8 Live에는 비동기 함수 호출 기능도 포함됩니다.
쉽게 말하면 AI가 사용자와 대화를 이어가는 동안 필요한 외부 기능이나 도구를 호출할 수 있다는 뜻입니다.
예전처럼
“잠시만요. 처리하고 다시 답하겠습니다.”
식으로 대화가 끊기는 것을 줄이고, 작업과 대화를 동시에 진행하는 방향입니다.
개발자가 Live API를 이용해 서비스를 만든다면 예약이나 정보검색, 각종 업무 처리 같은 기능과 음성 AI를 연결하는 데 활용할 수 있습니다.
🌍 97개 언어를 지원
지원 언어 범위도 넓습니다.
Gemini 3.8 Live는 97개 언어를 대상으로 실시간 음성 대화를 지원합니다.
여러 언어를 사용하는 환경에서 별도로 모델을 전환하지 않고 자연스럽게 대화를 이어가는 활용도 가능합니다.
한국어 역시 중요한 활용 대상입니다.
👀 카메라와 화면을 보면서 대화
음성만 이해하는 것도 아닙니다.
Gemini Live는 카메라와 화면 공유를 통해 사용자가 보고 있는 내용을 바탕으로 대화할 수 있습니다.
예를 들어 스마트폰 카메라로 물건을 보여주면서
“이게 뭔지 알려줘.”
라고 묻거나,
화면을 공유한 상태에서
“여기에서 어떤 메뉴를 눌러야 해?”
처럼 질문하는 방식입니다.
음성 AI가 단순한 ‘말하는 챗봇’에서 사용자가 보고 있는 상황까지 이해하는 도우미로 바뀌는 부분입니다.
🔎 Google Search Live에도 적용
Gemini 3.8 Live 기술은 Google의 실시간 검색 경험에도 확대되고 있습니다.
검색어를 한 번 입력하고 결과를 읽는 기존 방식과 달리 사용자가 음성으로 질문하고 후속 질문을 이어가며 정보를 탐색하는 형태입니다.
따라서 앞으로 검색도
검색어 입력 → 링크 선택
방식에서
질문 → 답변 → 추가 질문 → 필요한 정보 탐색
형태가 더 중요해질 가능성이 있습니다.
🤔 기존 Gemini Live와 가장 큰 차이는?
사용자 입장에서 가장 중요한 변화는 단순히 모델 번호가 올라갔다는 것이 아닙니다.
핵심은
✔ 더 자연스러운 실시간 음성 대화
✔ 향상된 추론
✔ 대화와 동시에 진행되는 백그라운드 작업
✔ 외부 도구 호출
✔ 카메라·화면을 이용한 시각적 이해
등이 하나의 실시간 경험으로 연결된다는 점입니다.
결국 목표는 AI와 대화하면서 실제 작업까지 처리하는 것에 가깝습니다.
⚠️ 모든 기능이 모든 사용자에게 똑같이 보이는 것은 아닙니다
여기서 주의할 점도 있습니다.
Google의 모델 발표에는 일반 Gemini 사용자가 사용하는 기능뿐 아니라 개발자가 Gemini API와 Live API를 통해 이용하는 기능도 포함돼 있습니다.
따라서 발표된 기능 하나하나가 현재 모든 스마트폰의 Gemini 앱에 동일한 형태로 즉시 나타난다고 이해하면 안 됩니다.
앱, Search Live, Workspace, API 등 적용되는 서비스가 서로 다를 수 있고 지역과 계정에 따라 제공 시점도 달라질 수 있습니다.
💡 일반 사용자에게 왜 중요할까?
기술적인 모델 이름보다 중요한 것은 앞으로 AI 사용법이 바뀔 가능성입니다.
현재는 AI에게
질문을 입력하고 → 답을 읽고 → 다시 명령을 입력하는 방식이 일반적입니다.
하지만 실시간 음성 AI가 발전하면
“말하면서 같이 일을 처리하는 AI”
에 가까워질 수 있습니다.
길을 걸으면서 정보를 찾거나, 화면을 보며 설정을 해결하거나, 여러 조건을 비교하면서 추가 질문을 이어가는 방식이 자연스러워질 수 있습니다.
❓ 자주 묻는 질문
Q. Gemini 3.8 Live는 일반 Gemini와 다른 건가요?
Gemini 서비스 안에서 실시간 음성 상호작용을 담당하는 새로운 모델 계열로 이해하면 쉽습니다.
Q. 한국어도 사용할 수 있나요?
Gemini 3.8 Live는 97개 언어를 지원합니다.
Q. Extended Thinking은 무엇인가요?
실시간 음성 대화를 진행하면서 더 많은 백그라운드 추론이 필요한 작업을 처리하기 위한 모델입니다.
Q. 말하면서 검색도 할 수 있나요?
Google은 Gemini 3.8 Live 기술을 Search Live 등 실시간 검색 경험에도 적용하고 있습니다. 다만 서비스와 지역에 따라 제공 여부가 달라질 수 있습니다.
Q. 모든 기능을 지금 스마트폰에서 바로 사용할 수 있나요?
아닙니다. 일부는 Gemini 앱이나 Google 서비스에 적용되는 기능이고 일부는 개발자를 위한 Live API 기능입니다. 계정·지역·서비스별 제공 여부를 확인해야 합니다.
📌 정리하면
Gemini 3.8 Live에서 중요한 변화는 단순히 “AI가 말을 더 잘한다”는 것이 아닙니다.
대화를 이어가면서 추론하고 필요한 도구를 사용하며, 카메라나 화면을 통해 상황까지 이해하는 방향으로 발전하고 있다는 점이 핵심입니다.
특히 Extended Thinking처럼 실시간 대화와 복잡한 추론을 함께 처리하는 기술이 발전한다면 앞으로 음성 AI는 단순 질문·답변 기능보다 실제로 함께 일을 처리하는 인터페이스에 가까워질 가능성이 있습니다.
※ 2026년 9월 19일 Google 공식 발표 및 Gemini API 문서를 기준으로 작성했습니다. 실제 사용 가능한 기능은 서비스·계정·지역에 따라 다를 수 있습니다.
#Gemini38 #GeminiLive #제미나이 #제미나이라이브 #구글AI #GoogleAI #음성AI #AI비서 #생성형AI #GeminiAPI #LiveAPI #AI검색 #구글검색 #SearchLive #AI활용법 #인공지능 #AI업데이트
