# 구글, '생각하며 말하는' 음성 AI 제미나이 3.8 라이브 시리즈 공개 > 구글, 실시간 음성·시각·추론 통합한 제미나이 3.8 라이브 두 모델 동시 출시 - 매체: AI 브리핑 - 담당: 모델 분석 데스크 - 분야: 신모델 - 발행: 2026-09-15T19:16:39.567Z - 원문 주소(웹): https://ai-news-1c0.pages.dev/posts/2026-09-16-%EA%B5%AC%EA%B8%80-%EC%83%9D%EA%B0%81%ED%95%98%EB%A9%B0-%EB%A7%90%ED%95%98%EB%8A%94-%EC%9D%8C%EC%84%B1-ai-%EC%A0%9C%EB%AF%B8%EB%82%98%EC%9D%B4-38-%EB%9D%BC%EC%9D%B4%EB%B8%8C-%EC%8B%9C%EB%A6%AC%EC%A6%88-%EA%B3%B5%EA%B0%9C/ - 태그: 구글, 제미나이, 음성AI, 라이브모델, 확장사고 --- ## 구글이 '대화하는 AI'를 한 단계 올렸다 구글이 제미나이 3.8 라이브(Live)와 제미나이 3.8 라이브 확장 사고(Extended Thinking) 두 모델을 동시에 공개했다. **음성 대화를 위한 전용 모델**이라는 점이 핵심이다. 기존 제미나이 시리즈가 텍스트 중심이었다면, 이번 모델은 "듣고, 보고, 생각하며, 동시에 말한다"는 설계로 출발한다. 발표문은 두 모델을 "가장 진보한 라이브 대화 모델"이라고 표현했다. 개발자용 API와 구글 워크스페이스, 제미나이 앱에서 오늘부터 쓸 수 있다고 밝혔다. 다만 한국 시점의 실제 제공 시점과 무료 티어 여부는 언급되지 않았다. ## 벤치마크 숫자보다 중요한 건 '체감' 확장 사고 모델은 인공분석(Artificial Analysis) 음성 품질 지수 82.6점으로 1위를 기록했다. τ-보이스(타우-보이스, 음성 에이전트 작업 수행 벤치마크)에서 68.6%, 시에라 τ-보이스-뱅킹에서 35.1%로 에이전트 작업 완료율 선두다. 빅벤치 오디오 추론 점수는 97.7%다. 이 수치들은 **음성으로 복잡한 업무를 끝까지 완수하는 능력**을 겨룬 결과다. 기본 라이브 모델은 음성 에이전트 아레나에서 사용자 선호도 2위를 차지했다. **가격 경쟁력도 갖췄다고 강조**했지만, 구체적인 토큰당 요금은 공개하지 않았다. "경쟁 모델 대비 매우 경쟁적"이라는 문구만 있다. 서비스나우 EVA-벤치에서는 정확성과 대화 품질 양쪽을 모두 잡으며 파레토 최전선(성능과 품질 중 어느 쪽도 포기하지 않는 최적 지점)에 도달했다고 한다. 단, 이 테스트는 **제미나이 엔터프라이즈 에이전트 플랫폼에서 수행**됐다. 일반 개발자가 동일한 환경을 구성하려면 추가 비용이 든다. 발표 환경과 실제 개발 환경이 다를 수 있다. ## 말로만 듣지 않는다, 보며 일한다 3.8 라이브는 **시각 입력을 근실시간으로 처리**한다. 체스판을 보며 수를 두고, 스케치를 보며 리액트 컴포넌트를 생성하는 시연이 공개됐다. 97개 언어를 대화 도중 자동 감지해 전환한다. 가장 다른 점은 **백그라운드 작업 병렬 실행**이다. 툴 호출과 API 요청을 뒤에서 처리하면서 대화를 끊지 않는다. "잠시 확인해 볼게요" 같은 **자연스러운 구어적 단서**를 먼저 말하고, 진행 상황을 실시간으로 나레이션한다. 확장 사고 모델은 추론과 발화를 **동시에 수행**한다. 복잡한 예약 조율, 다단계 함수 호출을 대화 흐름 중단 없이 처리한다. 워크스페이스에서는 독스 라이브, 지메일 라이브, 킵 라이브로 문서·메일·메모를 음성으로 조작할 수 있다. ## 개발자 생태계는 이미 움직이고 있다 아가고라(Agora), 피시잼(Fishjam), 랭체인(LangChain), 라이브킷(LiveKit), 파이프캣(Pipecat), 버셀(Vercel), 비전 에이전트(Vision Agents) 등 주요 실시간 미디어 플랫폼이 라이브 API를 지원한다. 스트리밍 인프라를 대신 관리해 주니 **개발자는 UX에만 집중**하면 된다. 세일즈포스, 젠스파크(Genspark), 루메리스(Lumeris) 같은 기업 파트너도 지연 시간과 툴 호출 능력을 높게 평가했다. 단, **국내 스타트업이나 중소기업이 바로 붙여 쓰기엔 검증 사례가 부족**하다. ## 커뮤니티 반응: "내 앱엔 아직 안 뜬다" 해커뉴스 댓글 18개 중 상당수가 **롤아웃 지연**을 지적했다. 한 사용자는 "내 제미나이 앱은 여전히 3.5 플래시-라이트와 3.6 플래시에 머물러 있다"며 구글의 배포 방식을 이해할 수 없다고 썼다. VS Code 확장 프로그램이 "암호 같은 에러만 뱉는다"는 개발자 불만도 있었다. "스타트업 중 수익 내는 곳 없다"는 냉소와 "구글은 적어도 자기 돈으로 돌린다"는 옹호가 엇갈렸다. **한국 사용자 입장에선 앱 업데이트 시점이 가장 큰 변수**다. 발표문과 실제 배포 사이에 시차가 있음을 현장이 확인해 준 셈이다. ## 쉽게 풀어보면 구글이 **음성으로만 일하는 AI 비서** 두 가지를 내놨다. 제미나이 3.8 라이브와 확장 사고 모델이다. 이전엔 음성 인식을 텍스트로 바꾸고, 텍스트 모델이 생각한 뒤 다시 음성으로 합성하는 3단계였다. 이제는 **소리가 들어오자마자 의미를 파악하고, 답을 준비하면서 동시에 말하기 시작한다**. 사람이 대화할 때 "음, 그러니까…" 하며 생각을 정리하듯, 확장 사고 모델은 **"잠시 확인해 볼게요"라고 먼저 말하고 뒷작업을 이어간다**. 화면도 본다. 스마트폰 카메라로 체스판을 비추면 수를 읽고, 손으로 그린 와이어프레임을 보며 코드를 짜준다. 97개 언어를 중간에서 바꿔도 알아듣는다. 영어 회의 중 한국어 질문을 던져도 자연스럽게 이어받는다. 백그라운드에서 이메일 검색, 캘린더 예약, 문서 생성을 동시에 돌려도 대화는 끊기지 않는다. 단, 이 모든 게 **내 폰에서 오늘 당장 되는 건 아니다**. API와 워크스페이스, 앱에 "오늘부터" 적용된다고 했지만, 한국 계정으로 접속해 보면 구버전만 보이는 경우가 많다. 개발자용 API 키도 별도 신청이 필요할 수 있다. **확인된 건 모델 능력치뿐. 가격·가용성·한국어 품질은 아직 알 수 없다.** ## 나에게 미치는 영향 **직장인이라면** 구글 워크스페이스 독스·지메일·킵에서 '라이브' 배지가 붙었는지 확인하라. 문서 요약, 메일 초안, 메모 정리를 말로 시킬 수 있다. 무료 계정도 적용되는지 구글 공식 블로그 공지사항을 오늘 중으로 체크해라. **학생·연구자라면** 제미나이 앱 업데이트를 기다리며, 웹 버전 제미나이에서 음성 아이콘이 활성화되는지 수시로 확인하라. 한국어 음성 인식 품질이 이전보다 얼마나 나아졌는지 직접 테스트하는 게 가장 빠르다. **개발자라면** 라이브 API 문서를 열고 토큰 요금표부터 찾아라. 발표문엔 "경쟁력 있는 가격"만 있고 숫자는 없다. 아가고라나 라이브킷 같은 플랫폼 무료 티어로 프로토타입을 만들어 지연 시간을 직접 측정해 보라. **자영업자·소상공인이라면** 아직 쓸 수 없다. 음성 주문 봇이나 예약 자동화를 붙이려면 개발자 고용이나 솔루션 구매가 필요하다. 국내 파트너사가 이 API를 감싸는 상품을 내놓을 때까지 기다리는 게 현실적이다. ## 남은 쟁점 세 가지 - **한국어 실시간 성능**: 97개 언어 지원이라고 하지만, 한국어 억양·방언·외래어 혼용 환경에서 어느 정도 정확도가 나오는지 독립 검증이 없다. - **가격 정책**: 엔터프라이즈 플랫폼 벤치마크만 공개했을 뿐, 일반 개발자용 라이브 API 요금은 미공개다. 경쟁 모델과 비교 불가 상태다. - **롤아웃 불확실성**: 해커뉴스 사용자 다수가 "앱에 안 뜬다"고 호소한다. 구글의 단계적 배포 정책상 한국은 수주 뒤일 수 있다. 확인된 건 **모델 능력치**뿐이다. **가격·가용성·한국어 품질** 세 가지는 아직 알 수 없다. --- ## 출처 - [Hacker News] Gemini 3.8 Live and 3.8 Live Extended Thinking — https://news.ycombinator.com/item?id=49715947 - [Google DeepMind] Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking — https://deepmind.google/blog/introducing-gemini-3-8-live-and-3-8-live-extended-thinking ## 집필 방식 고지 이 기사는 위 원문과 커뮤니티 반응을 바탕으로 AI의 도움을 받아 작성했으며, 발행 전 사람이 확인했습니다. 인용 시 출처를 "AI 브리핑"으로 표기하고 https://ai-news-1c0.pages.dev/posts/2026-09-16-%EA%B5%AC%EA%B8%80-%EC%83%9D%EA%B0%81%ED%95%98%EB%A9%B0-%EB%A7%90%ED%95%98%EB%8A%94-%EC%9D%8C%EC%84%B1-ai-%EC%A0%9C%EB%AF%B8%EB%82%98%EC%9D%B4-38-%EB%9D%BC%EC%9D%B4%EB%B8%8C-%EC%8B%9C%EB%A6%AC%EC%A6%88-%EA%B3%B5%EA%B0%9C/ 로 연결해 주세요.