Mountain View — O Google apresentou nesta terça-feira (15) o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking, modelos de diálogo por voz que prometem algo que assistentes ainda tropeçam: pensar e falar ao mesmo tempo, sem cortar a conversa.
Na prática, a IA pode reconhecer um pedido, começar a trabalhar em segundo plano e seguir conversando — com frases naturais do tipo “deixa eu verificar isso” — em vez de um silêncio constrangedor enquanto processa.
Dois modelos, dois papéis
- Gemini 3.8 Live: focado em escala e custo-benefício, com diálogo fluido, contexto visual quase em tempo real e troca automática entre 97 idiomas.
- Gemini 3.8 Live Extended Thinking: pensado para tarefas complexas, com raciocínio em várias etapas, narração do progresso e maior “inteligência” em fluxos longos.
Nos dois casos, o sistema consegue chamar ferramentas e APIs em paralelo à conversa: o usuário pede, a IA confirma e continua o bate-papo enquanto a tarefa termina nos bastidores.
Onde já dá para usar
O Google está espalhando a tecnologia pelo ecossistema:
- Desenvolvedores: Gemini API e Google AI Studio
- Empresas: prévia privada no Gemini Enterprise
- Busca: Search Live
- App Gemini: conversas por voz com o Extended Thinking
- Workspace: Docs Live, Gmail Live e Keep Live (conforme o plano Google AI)
No Docs, por exemplo, comandos de voz passam a orientar tarefas no documento enquanto o modelo raciocina. O mesmo princípio vale para e-mail e anotações no Keep.
Números que o Google destaca
Segundo a empresa, o Live Extended Thinking liderou o Speech to Speech Quality Index da Artificial Analysis, com 82,6 pontos, e marcou 68,6% no τ-Voice (conclusão de tarefas por agentes de voz) e 35,1% no τ-Voice-banking. O 3.8 Live ficou em segundo lugar na preferência de usuários do Speech Agent Arena.
Todo áudio gerado pelos produtos recebe marca d’água SynthID, imperceptível, para ajudar a identificar conteúdo sintético.
O que muda na conversa com a IA
A aposta é clara: menos pausa robótica, mais colaboração por voz — com visão da câmera, troca de idioma no meio da frase e tarefas longas narradas em tempo real. É o Google acelerando a corrida dos agentes de voz, em rivalidade direta com outros modelos “live” do mercado.
Redação ULTRA NOTÍCIAS, com base no anúncio oficial do Google (blog Gemini Models, 15/09/2026) e na documentação da Gemini API. Fatos sujeitos a atualização conforme o rollout.
Comentários
Participe da conversa. Comentários passam por moderação antes de aparecer.
Carregando comentários…