구글 ‘Gemini 3.8 Live with Live Avatar’ 공개와 97개 언어 동기화 지원

구글 ‘Gemini 3.8 Live with Live Avatar’ 공개와 97개 언어 동기화 지원

기사 이해를 돕기 위한 이미지

구글은 2026년 9월 24일(현지시각) 음성과 영상을 실시간으로 처리하는 Google Gemini 3.8 Live with Live Avatar를 공개했다. 구글은 다국어 음성 간 동기화를 97개 언어로 지원하고, AI가 생성한 콘텐츠에는 SynthID 워터마크를 적용한다고 밝혔다.

기업용 콘솔과 API로 제공

구글은 “오늘부터 Gemini 3.8 Live with Live Avatar를 Gemini Enterprise에서 이용할 수 있다”고 발표했다. Google Cloud는 9월 25일 이 기능이 정식 출시됐으며 미국과 유럽연합 지역 엔드포인트에서 Gemini Enterprise 콘솔과 Gemini Live API를 통해 제공된다고 밝혔다. 프로비저닝 처리량 옵션도 지원한다.

Live Avatar용 맞춤형 아바타 생성은 현재 기업 허용 목록에 포함된 고객만 이용할 수 있다. Android Headlines는 이 기능이 Google Cloud Next 2026에서 처음 프리뷰된 뒤 미국과 유럽연합 엔드포인트의 Gemini Enterprise 고객에게 기업 규정 준수 보장과 함께 정식 제공됐다고 전했다.

모델 ID와 공개된 요금

Google Cloud가 제시한 모델 ID는 Gemini 3.8 Live이며, 아바타 기능에 별도의 정식 출시용 ID는 명시하지 않았다. Gemini 3.8 Live Extended Thinking은 비공개 프리뷰 상태다. DataCamp가 공개한 모델 ID는 gemini-3.8-live와 gemini-3.8-live-extended-thinking이다.

Google Cloud 발표문에는 구체적인 가격이 없고 Gemini Enterprise와 Agent Platform의 별도 가격 페이지를 안내한다. DataCamp가 제시한 가격은 100만 토큰당 오디오 입력 $3.00, 오디오 출력 $12.00, 텍스트 입력 $0.75, 텍스트 출력 $4.50이다. 오디오 출력 가격에는 thinking tokens가 포함된다. Google Search grounding은 월 5,000건 무료 제공 이후 1,000건당 $14다.

독립 평가에서 엇갈린 지표

구글의 발표 페이지에는 벤치마크나 성능 수치, 경쟁 모델 비교가 없다. 독립 평가 기관 Artificial Analysis의 Speech to Speech Index에서 Gemini 3.8 Live Extended Thinking의 High 설정은 82.6, Agentic Performance는 68.6%, Arena Preference Elo는 990, Task Success Rate는 89.1%였다. 표준 Gemini 3.8 Live는 각각 76.0, 30.1%, 1083, 93.2%를 기록했다. 같은 Task Success Rate에서 GPT-Live-1의 Sol·low 설정은 90.9%였다.

DataCamp가 제시한 τ-Voice 결과에서는 Gemini 3.8 Live Extended Thinking이 68.6%, GPT-Live-1 Astra가 67.9%, Grok Voice Think Fast 2.0이 56.5%였다. Speech to Speech Index는 같은 순서로 82.6, 81.5, 81.3이었다. 반면 BeInCrypto가 인용한 Artificial Analysis 자료에 따르면 speech reasoning 벤치마크에서는 Qwen Audio 3.0이 99.2%로 Gemini 3.8 Live Extended Thinking의 97.7%보다 높았다.

사람의 블라인드 선호도 결과는 출처에 따라 차이가 있다. Artificial Analysis 페이지는 평가 모델 가운데 Gemini 3.8 Live가 Arena Preference Elo 1083으로 가장 높았다고 설명한다. 반면 Artificial Analysis 데이터를 인용한 BeInCrypto는 Gemini 3.1 Flash Live가 1096으로 두 Gemini 3.8 Live 변형보다 높다고 전했다. 같은 보도에서 Extended Thinking의 Elo는 990으로 제시됐다.

비교 범위와 확인된 한계

Memeburn은 Claude Sonnet 4.6이 SWE-bench Verified에서 82.1%, Gemini 3.1 Pro가 63.8%를 기록했다고 전했다. 이 비교의 대상은 Gemini 3.8 Live가 아니라 Gemini 3.1 Pro다. 매체는 “구글은 최신 모델의 SWE-bench 수치를 공개하지 않았다”고 밝혔다. 또 Gemini를 비디오와 오디오를 기본 입력 방식으로 처리하는 유일한 주요 모델로 설명하며 Claude와 GPT-5는 해당 입력 방식을 제공하지 않는다고 전했다.

DataCamp는 Gemini 3.8 Live 계열이 “여전히 환각을 일으킬 수 있고”, “탈옥 공격에 대한 저항은 계속 개선 중이며”, “간헐적인 속도 저하나 시간 초과가 발생할 수 있다”고 한계를 적었다. Android Headlines는 구글 주가가 Gemini 3.5 Pro의 지연 보도 이후 최근 수개월 동안 약 20% 하락했다며 Live Avatar를 독립적인 돌파구보다 경쟁 대응으로 평가했다.

참고 자료 바로가기

관련 기사 바로가기