O avanço das tecnologias de inteligência artificial nunca para, e o Google acaba de dar um passo importante nesse sentido. Na última terça-feira, 15 de setembro de 2026, a empresa revelou duas versões atualizadas de sua IA focada em diálogo por voz: o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking. Ambas prometem transformar a maneira como interagimos com assistentes virtuais, tornando a comunicação mais fluida, natural e inteligente.
O que há de novo no Gemini 3.8 Live
O Gemini 3.8 Live é a evolução do sistema que permite conversas em tempo real com assistentes de voz. Sua principal característica é a capacidade de executar tarefas em segundo plano enquanto mantém o diálogo com o usuário ativo. Isso significa que você não precisa pausar ou esperar a IA concluir uma ação para continuar falando com ela.
- Consegue operar ferramentas e chamadas de API silenciosamente durante a interação.
- Interpreta informações visuais quase instantaneamente, a partir de câmeras ou outros dispositivos conectados.
- Suporta alternância automática entre 97 idiomas, facilitando diálogos multilíngues.
- Alcançou o segundo lugar no Speech Agent Arena, um importante índice que avalia sistemas conversacionais por voz.
- Está disponível para desenvolvedores e empresas via Gemini API e Google AI Studio, com foco em alta performance e custo-benefício.
Gemini 3.8 Live Extended Thinking: raciocínio em múltiplas etapas
Já o Gemini 3.8 Live Extended Thinking leva o conceito de conversa inteligente a um outro nível. Além de ouvir e responder, essa versão é capaz de raciocinar enquanto fala, processando tarefas complexas em várias etapas sem interromper o diálogo.
Imagine um assistente que, ao receber um pedido detalhado, diga “deixe-me verificar isso para você” e continue explicando o andamento da tarefa enquanto executa os passos necessários. Essa abordagem traz uma experiência muito mais humana e engajadora, reduzindo o tempo de espera e aumentando a transparência do processo.
Integração com produtos do Google Workspace e análise de desempenho
O Google também confirmou que esses avanços não ficarão restritos a laboratórios e APIs para desenvolvedores. O Gemini 3.8 Live Extended Thinking será incorporado a ferramentas amplamente usadas no ambiente corporativo, como Gmail, Google Docs e Google Keep. Com comandos de voz, será possível redigir documentos, gerenciar emails e anotações de maneira mais intuitiva e eficiente.
Além disso, o recurso Search Live permitirá interações por voz com o motor de busca do Google, recebendo orientações e instruções em tempo real.
Quanto ao desempenho, o modelo Extended Thinking atingiu 82,6 pontos no Speech to Speech Quality Index, índice que mede a qualidade das interações por voz. Em testes específicos, como o τ-Voice, voltado à execução de tarefas, obteve 68,6%, e 35,1% no τ-Voice-banking, que avalia operações financeiras. Esses resultados indicam um sistema robusto e versátil, ainda que com espaço para aprimoramentos em nichos especializados.
Perspectivas e impactos da nova geração Gemini
Essa atualização do Gemini reforça o compromisso do Google em desenvolver assistentes virtuais mais inteligentes e adaptáveis. A capacidade de “pensar enquanto fala” representa uma evolução significativa, aproximando a interação homem-máquina da naturalidade das conversas humanas.
Para empresas, isso significa automatizar processos complexos com menos fricções e maior agilidade. Já para usuários finais, especialmente os que lidam com múltiplos idiomas, a função multilíngue do Gemini 3.8 Live abre portas para comunicação global simplificada.
Contudo, o avanço também levanta questões sobre privacidade e controle do uso de dados, especialmente com o processamento simultâneo de informações visuais e voz. É fundamental que o Google mantenha transparência e segurança para conquistar a confiança dos usuários.
Além disso, o acesso diferenciado por planos pagos no Google Workspace indica um caminho em que a democratização total da tecnologia ainda depende de investimentos. Resta acompanhar se o Google expandirá essas funcionalidades a um público mais amplo no futuro.
Conclusão
O lançamento das versões Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking marca um momento importante na evolução das inteligências artificiais conversacionais. Ao unir raciocínio avançado, interação contínua e suporte multilíngue, o Google constrói o que pode ser o futuro das interfaces por voz.
Para desenvolvedores, empresas e usuários, esse é um convite para explorar novas formas de produtividade e comunicação. A tecnologia promete simplificar tarefas complexas e tornar a experiência digital mais orgânica e eficiente. Resta acompanhar de perto sua implementação e os próximos passos desta jornada.
Referência: olhardigital.com.br
Revisado em 15 de setembro de 2026. Conteúdo revisado editorialmente antes da publicação.
Fontes consultadas: olhardigital.com.br
















