Google lançou os modelos Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, que permitem que a IA raciocine enquanto conversa por voz e rode ferramentas em segundo plano sem interromper a interação.
Raciocínio em tempo real e processamento visuao
Os modelos trocam de idioma automaticamente entre 97 línguas em uma única conversa, mantendo o contexto da fala. Câmeras em tempo real alimentam imagens que viram parte do diálogo. Enquanto trabalham, podem dizer coisas como “deixe-me verificar isso para você”, sem travar a conversa. O áudio carrega a marca d'água SynthID, que sinaliza conteúdo gerado por IA.
Integração nos produtos Google e desempenho
O Search Live agora devolve respostas com hiperlinks. Em Gmail, Docs e Keep, comandos de voz editam documentos diretamente. A disponibilidade vai para API do Gemini, Google AI Studio, pré-visualização do Gemini Enterprise e Gemini Live. No Speech Agent Arena, o Gemini 3.8 Live ficou em segundo. A versão Extended Thinking marcou 82,6 no Speech to Speech Quality Index, 68,6% no T-Voice, 35,1% no benchmark bancário da Sierra e 97,7% no Big Bench Audio. Desenvolvedores usam Agora, LiveKit, Vercel, Pipecat, Fishjam e Vision Agents para integrar.
Contexto do lançamento
O anúncio saiu nesta terça-feira, 15 de setembro de 2026. Segundo o Google, a ideia é aproximar o diálogo com IA do que já existe em assistentes humanos: interrupções naturais, multitarefa e respostas que soam conversacionais. O Extended Thinking é o mais avançado: pensa em etapas, explica o progresso e segue falando enquanto trabalha.


