Home / NOTÍCIAS / Google lança nova versão do Gemini que raciocina enquanto conversa por voz

Google lança nova versão do Gemini que raciocina enquanto conversa por voz

Imagem ilustrativa: Google lança nova versão do Gemini que raciocina enquanto conversa por voz
Advertisements
Advertisements

O avanço das tecnologias de inteligência artificial nunca para, e o Google acaba de dar um passo importante nesse sentido. Na última terça-feira, 15 de setembro de 2026, a empresa revelou duas versões atualizadas de sua IA focada em diálogo por voz: o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking. Ambas prometem transformar a maneira como interagimos com assistentes virtuais, tornando a comunicação mais fluida, natural e inteligente.

O que há de novo no Gemini 3.8 Live

O Gemini 3.8 Live é a evolução do sistema que permite conversas em tempo real com assistentes de voz. Sua principal característica é a capacidade de executar tarefas em segundo plano enquanto mantém o diálogo com o usuário ativo. Isso significa que você não precisa pausar ou esperar a IA concluir uma ação para continuar falando com ela.

Advertisements
Advertisements
  • Consegue operar ferramentas e chamadas de API silenciosamente durante a interação.
  • Interpreta informações visuais quase instantaneamente, a partir de câmeras ou outros dispositivos conectados.
  • Suporta alternância automática entre 97 idiomas, facilitando diálogos multilíngues.
  • Alcançou o segundo lugar no Speech Agent Arena, um importante índice que avalia sistemas conversacionais por voz.
  • Está disponível para desenvolvedores e empresas via Gemini API e Google AI Studio, com foco em alta performance e custo-benefício.

Gemini 3.8 Live Extended Thinking: raciocínio em múltiplas etapas

Já o Gemini 3.8 Live Extended Thinking leva o conceito de conversa inteligente a um outro nível. Além de ouvir e responder, essa versão é capaz de raciocinar enquanto fala, processando tarefas complexas em várias etapas sem interromper o diálogo.

Imagine um assistente que, ao receber um pedido detalhado, diga “deixe-me verificar isso para você” e continue explicando o andamento da tarefa enquanto executa os passos necessários. Essa abordagem traz uma experiência muito mais humana e engajadora, reduzindo o tempo de espera e aumentando a transparência do processo.

Integração com produtos do Google Workspace e análise de desempenho

O Google também confirmou que esses avanços não ficarão restritos a laboratórios e APIs para desenvolvedores. O Gemini 3.8 Live Extended Thinking será incorporado a ferramentas amplamente usadas no ambiente corporativo, como Gmail, Google Docs e Google Keep. Com comandos de voz, será possível redigir documentos, gerenciar emails e anotações de maneira mais intuitiva e eficiente.

Além disso, o recurso Search Live permitirá interações por voz com o motor de busca do Google, recebendo orientações e instruções em tempo real.

Quanto ao desempenho, o modelo Extended Thinking atingiu 82,6 pontos no Speech to Speech Quality Index, índice que mede a qualidade das interações por voz. Em testes específicos, como o τ-Voice, voltado à execução de tarefas, obteve 68,6%, e 35,1% no τ-Voice-banking, que avalia operações financeiras. Esses resultados indicam um sistema robusto e versátil, ainda que com espaço para aprimoramentos em nichos especializados.

Perspectivas e impactos da nova geração Gemini

Essa atualização do Gemini reforça o compromisso do Google em desenvolver assistentes virtuais mais inteligentes e adaptáveis. A capacidade de “pensar enquanto fala” representa uma evolução significativa, aproximando a interação homem-máquina da naturalidade das conversas humanas.

Para empresas, isso significa automatizar processos complexos com menos fricções e maior agilidade. Já para usuários finais, especialmente os que lidam com múltiplos idiomas, a função multilíngue do Gemini 3.8 Live abre portas para comunicação global simplificada.

Contudo, o avanço também levanta questões sobre privacidade e controle do uso de dados, especialmente com o processamento simultâneo de informações visuais e voz. É fundamental que o Google mantenha transparência e segurança para conquistar a confiança dos usuários.

Além disso, o acesso diferenciado por planos pagos no Google Workspace indica um caminho em que a democratização total da tecnologia ainda depende de investimentos. Resta acompanhar se o Google expandirá essas funcionalidades a um público mais amplo no futuro.

Conclusão

O lançamento das versões Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking marca um momento importante na evolução das inteligências artificiais conversacionais. Ao unir raciocínio avançado, interação contínua e suporte multilíngue, o Google constrói o que pode ser o futuro das interfaces por voz.

Para desenvolvedores, empresas e usuários, esse é um convite para explorar novas formas de produtividade e comunicação. A tecnologia promete simplificar tarefas complexas e tornar a experiência digital mais orgânica e eficiente. Resta acompanhar de perto sua implementação e os próximos passos desta jornada.

Referência: olhardigital.com.br

Revisado em 15 de setembro de 2026. Conteúdo revisado editorialmente antes da publicação.

Fontes consultadas: olhardigital.com.br

Advertisements
Advertisements