AI 뉴스 · Gemini 음성 AI
Gemini 3.8 Live 공개: 대화 중 도구를 실행하는 구글 음성 AI
Gemini 3.8 Live는 대화 중 도구를 실행하고, Extended Thinking은 다단계 추론과 진행 상황 안내를 더합니다. 실제 이용 범위는 서비스별 구독 조건과 제공 단계에 따라 다릅니다.
이 글에서 다룰 내용
두 모델의 차이, 도구 실행, 언어·시각 지원, 서비스별 구독 조건, 기업용 프리뷰
대화를 이어가며 작업하는 음성 AI
음성 AI에게 일을 부탁한 뒤, 처리가 끝날 때까지 대화가 멈춘다면 어떨까요? 말을 알아듣는 능력이 좋아도 요청 이후의 흐름이 끊기면 자연스러운 협업으로 이어지기는 어렵습니다.
구글이 공식 표기 기준 2026년 9월 15일 공개한 Gemini 3.8 Live는 이 지점에 초점을 맞춥니다. 필요한 작업을 백그라운드에서 실행하면서도 사용자와 대화를 이어가는 방식입니다.
이번 발표의 핵심은 목소리가 얼마나 자연스러운지를 넘어섭니다. 음성으로 요청을 받고 도구를 실행하고 작업 중에도 소통하는 과정을 하나의 대화로 연결하려는 변화입니다.
Gemini 3.8 Live와 Extended Thinking은 역할이 다릅니다
구글은 Gemini 3.8 Live를 대규모 활용과 비용 효율성을 중심으로 설계한 모델로 소개했습니다. 대화 능력과 유연한 대화 흐름, 시각적 맥락 이해를 결합하는 것이 기본 방향입니다.
Gemini 3.8 Live Extended Thinking은 복잡도가 높은 작업을 겨냥합니다. 여러 단계를 거쳐야 하는 업무에서 추론 능력을 강화하면서도 대화의 흐름을 유지하도록 설계됐다는 설명입니다.
특히 Extended Thinking은 추론과 발화를 동시에 수행합니다. 요청을 받으면 “확인해 보겠습니다”와 같은 말로 먼저 반응하고 다단계 백그라운드 작업이 진행되는 동안 현재 상황을 음성으로 안내합니다.
여기서 중요한 것은 단순히 응답을 먼저 들려준다는 점만이 아닙니다. 복잡한 요청을 처리하는 과정에서도 사용자가 작업 진행 상황을 파악하며 대화를 계속할 수 있다는 점입니다.
따라서 두 모델을 단순히 빠른 버전과 느린 버전으로 나누는 것은 발표의 취지를 충분히 설명하지 못합니다. 공식적으로 강조된 차이는 규모와 비용 효율성에 둔 초점, 그리고 복잡한 작업을 위한 다단계 추론입니다.
대화 중 도구 실행이 음성 AI의 역할을 바꿉니다
Gemini 3.8 Live는 도구와 API를 백그라운드에서 실행하면서 사용자와 계속 대화할 수 있습니다. 요청을 접수했다는 응답을 먼저 전달한 뒤에도, 작업이 끝날 때까지 대화를 중단하지 않는 구조입니다.
이는 요청을 이해하는 일과 실제 처리가 완료되는 일을 구분한다는 의미입니다. 작업 완료를 기다리는 동안에도 대화가 이어지고 Extended Thinking은 여러 단계의 작업 진행 상황을 말로 전달할 수 있습니다.
공식 발표에는 Extended Thinking이 다단계 예약과 비동기 함수 호출을 조율하는 시연이 소개됐습니다. 스케치와 음성 피드백을 바탕으로 작동하는 React 컴포넌트를 만드는 사례도 함께 제시됐습니다.
이 사례들은 음성 대화가 단순한 질의응답을 넘어 작업 수행의 접점이 될 수 있음을 보여줍니다. 다만 구글의 시연을 모든 사용자가 모든 앱에서 그대로 실행할 수 있는 기능 목록으로 받아들여서는 안 됩니다.
공식 글은 모델의 도구 호출 능력을 설명하지만 서비스마다 연결되는 도구와 세부 권한을 모두 열거하지는 않습니다. 모델이 작업을 수행할 수 있다는 설명과 특정 계정에서 해당 작업을 실행할 수 있다는 보장은 별개의 문제입니다.
97개 언어와 시각 입력으로 대화의 맥락을 넓힙니다
Gemini 3.8 Live는 시각 입력을 실시간에 가깝게 처리해 대화에 필요한 맥락을 보완합니다. 사용자의 말뿐 아니라 시각 정보도 활용해 응답한다는 의미이며 모든 상황에서 지연이 없다는 뜻은 아닙니다.
구글은 시각적 맥락을 활용해 직원의 입사 적응 과정을 안내하고 질문에 답하는 사례를 소개했습니다. 체스 상황을 보면서 추론과 자연스러운 대화를 이어가는 시연도 공식 글에 포함됐습니다.
언어 측면에서는 97개 언어를 지원한다고 밝혔습니다. 대화 도중 사용 언어를 자동으로 감지하고 지원하는 언어 사이에서 전환할 수 있다는 설명입니다.
다만 지원 언어 수가 곧 모든 언어에서 동일한 품질을 보장한다는 의미는 아닙니다. 이번 공식 글에는 한국어만의 별도 평가 결과나 한국에서의 모든 서비스 이용 가능성을 보장하는 내용이 없습니다.
생성 오디오의 식별 장치도 언급됐습니다. 구글은 자사 AI 제품이 생성한 모든 오디오에 사람이 알아채기 어려운 SynthID 워터마크를 삽입해, AI 생성 콘텐츠를 식별할 수 있도록 한다고 설명했습니다.
Search Live·Gemini Live·Workspace의 조건을 나눠 봐야 합니다
두 모델의 순차 제공 시작일은 Google 발표 표기 기준 2026년 9월 15일입니다. 발표 당일부터 제공을 시작한다는 안내와 모든 계정에서 즉시 사용할 수 있다는 설명은 구분해야 합니다.
Search Live에는 Gemini 3.8 Live가 순차 적용됩니다. Gemini Live에는 Gemini 3.8 Live Extended Thinking이 순차 제공되므로, 이름에 Live가 들어간다고 같은 모델이 적용되는 것은 아닙니다.
공식 발표는 Search Live와 Gemini Live를 일반 사용자 대상 항목인 ‘For everyone’ 아래에 배치했습니다. 다만 이 글만으로 지역별 적용 시점이나 계정별 세부 이용 한도까지 확정할 수는 없습니다.
Workspace에서는 Docs Live, Gmail Live, Keep Live에 Extended Thinking을 적용하는 경험을 소개했습니다. 이때 Docs와 Gmail·Keep의 구독 조건을 하나로 묶지 않는 것이 중요합니다.
Docs의 대상은 Google AI Pro와 Ultra 구독자입니다. Gmail과 Keep은 모든 Google AI 구독자를 대상으로 명시돼 있어, Docs에 적힌 조건과 구분해서 읽어야 합니다.
여기서 ‘모든 Google AI 구독자’는 무료 이용자를 포함한 모든 Google 계정 사용자를 뜻하지 않습니다. Gmail과 Keep의 구독자 조건을 무료 전체 사용자 대상으로 확대하거나, 반대로 Gemini Live에도 같은 구독 조건이 명시된 것처럼 해석해서는 안 됩니다.
실제 활용 가능성을 판단하려면 서비스명, 적용 모델, 구독 조건을 함께 확인해야 합니다. 음성 AI 모델이 공개됐다는 사실만으로 각 서비스의 기능과 접근 조건이 같아지는 것은 아닙니다.
기업용 비공개 프리뷰와 추후 제공은 다른 단계입니다
개발자에게는 두 모델 모두 Gemini API와 Google AI Studio를 통해 순차 제공됩니다. 이는 개발자가 음성 기반 서비스를 구축할 때 모델을 활용하는 경로이며 일반 사용자용 앱의 제공 조건과는 구분됩니다.
기업용으로는 두 모델 모두 Gemini Enterprise에서 비공개 프리뷰로 제공된다고 밝혔습니다. 비공개 프리뷰는 일반 공개와 다른 제공 단계이므로, 모든 기업 고객이 바로 사용할 수 있다고 표현하면 정확하지 않습니다.
Gemini Enterprise for Customer Experience에는 두 모델 모두 추후 제공될 예정입니다. Extended Thinking은 Google Workspace 비즈니스 고객에게도 향후 제공된다고 별도로 안내했습니다.
따라서 Gemini Enterprise의 비공개 프리뷰와 Customer Experience의 추후 제공을 같은 상태로 묶어서는 안 됩니다. Workspace의 개인 Google AI 구독자 대상 안내 역시 비즈니스 고객 대상 향후 제공 계획과 나눠 읽어야 합니다.
이번 발표를 해석할 때는 모델의 기능, 적용 서비스, 제공 단계를 각각 확인하는 것이 핵심입니다. 순차 제공을 시작한 기능과 비공개 프리뷰, 앞으로 제공할 기능은 실제 도입 판단에서 서로 다른 의미를 갖습니다.
마무리: 모델의 능력과 이용 조건을 함께 확인합니다
Gemini 3.8 Live가 보여주는 방향은 음성 답변의 자연스러움만이 아닙니다. 대화를 유지하면서 도구와 API를 실행하고 Extended Thinking으로 복잡한 작업의 추론과 진행 상황 안내까지 연결하는 데 있습니다.
실제 활용 가능성을 판단할 때도 모델의 능력과 서비스의 제공 조건을 분리해 확인하는 것이 중요합니다. 발표된 기능이 곧 모든 계정에서 동일하게 제공되는 기능을 뜻하지는 않기 때문입니다.
한 줄 요약: Gemini 3.8 Live는 대화하면서 도구를 실행하는 음성 AI로 나아가지만 실제 이용 범위는 적용 서비스와 구독 조건, 제공 단계를 확인해야 합니다.
