Pular para o conteúdo principal

Gemini 3.8 Live e Live Extended Thinking: voice agents com raciocínio em paralelo

· 2 min para ler
gui
Capa do conteúdo: Gemini 3.8 Live e Live Extended Thinking: voice agents com raciocínio em paralelo

O acontecimento

Em 15 de setembro de 2026 o Google lançou o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking - descritos como os modelos de diálogo live mais avançados da família até aqui. O 3.8 Live combina inteligência conversacional com grounding visual e eficiência de escala; o Extended Thinking sobe a régua de inteligência e raciocínio multi-step para tarefas complexas, mantendo o fluxo de fala.

Disponibilidade no dia do anúncio: Gemini API e Google AI Studio para desenvolvedores; private preview no Gemini Enterprise (e, em breve, Gemini Enterprise for Customer Experience); consumidores no Search Live (3.8 Live) e no Gemini Live / Workspace (Docs, Gmail, Keep conforme plano) para o Extended Thinking. Parceiros de plataforma citados incluem Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel e Vision Agents. Áudio gerado leva watermark SynthID.

Benchmarks citados pelo Google: Extended Thinking no topo do Speech-to-Speech Quality Index da Artificial Analysis (82,6), 68,6% no τ-Voice, 35,1% no τ-Voice-banking (Sierra) e 97,7% no Big Bench Audio; 3.8 Live em segundo na Speech Agent Arena. EVA-Bench (ServiceNow) aparece como evidência de equilíbrio entre acurácia e qualidade conversacional na Live API.

Por que importa

Distinto do eixo Flash/Cyber da edição 01, o peso aqui é infra de voice agent: conversa fluida + tool calls em background + raciocínio narrado em voz. Isso muda o contrato de UX - o modelo não precisa “calar” para pensar - e o contrato de harness (streaming de mídia, interrupções, estado de tools assíncronas).

Aplicabilidade prática

  • Avalie a Live API com um harness de voz real (LiveKit/Pipecat/etc.), não só chat texto.
  • Separe o modelo de escala (3.8 Live) do de complexidade (Extended Thinking) por rota de tarefa.
  • Trate SynthID e model card como parte do checklist de transparência de áudio sintético.
  • Em enterprise, confirme se o caso de uso cabe no private preview antes de cravar roadmap.

Limitações e incertezas

Não executei os modelos. Números de bench são os reportados pelo Google no post oficial; EVA-Bench rodou na Live API do Gemini Enterprise Agent Platform. Disponibilidade enterprise ainda em private preview no launch. Enterprise for Customer Experience e partes do Workspace seguem “coming soon” conforme o plano.

Fontes originais