Produto · 19 de setembro de 2026

Também publicado em Français, עברית, Русский

Google lança Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking com tradução em tempo real para 97 idiomas

A Dell laptop with a blue desktop screen on a white surface
Erick Cerritos / Unsplash

O Google anunciou o lançamento de dois novos modelos de IA de voz: o Gemini 3.8 Live, projetado para operar com eficiência e baixo custo, e o Gemini 3.8 Live Extended Thinking, focado em tarefas complexas que exigem múltiplas etapas de raciocínio. Ambos os modelos visam reduzir o tempo de resposta, permitindo conversas fluidas sem interrupções. O Techsauce relatou a novidade em 16 de setembro de 2026. Um dos principais desafios dos assistentes de voz automáticos é a latência entre a fala do usuário e a resposta da IA. O Google busca resolver esse problema, não apenas melhorando a inteligência, mas também a fluidez da conversa. Isso inclui a capacidade de processar imagens em tempo real como contexto, realizar tarefas em segundo plano enquanto se fala, e fornecer respostas parciais antes da conclusão do processamento. Para desenvolvedores e organizações, ambos os modelos servem como componentes básicos para criar assistentes de voz de produção. Os usuários finais poderão acessar essas funcionalidades através do aplicativo Gemini, Google Workspace e Google Search. O Gemini 3.8 Live Extended Thinking alcançou a primeira posição no índice de qualidade de conversa voz para voz da Artificial Analysis, com uma pontuação de 82,6. Ele também liderou em testes de eficiência de agentes, como o τ-Voice e o τ-Voice-banking da Sierra, que simulam serviços de atendimento ao cliente bancário.

Além disso, obteve 97,7% de precisão no Big Bench Audio, mantendo preços competitivos em relação a outros modelos avançados. O Gemini 3.8 Live, por sua vez, ficou em segundo lugar no Speech Agent Arena, destacando-se pela preferência dos usuários e pelo baixo custo operacional, tornando-o ideal para aplicações que exigem múltiplas instâncias simultâneas. Ambos os modelos também foram testados no EVA-Bench da ServiceNow, demonstrando alta precisão sem comprometer a qualidade da conversa. Uma das características mais notáveis do Gemini 3.8 Live é a capacidade de processar imagens em tempo real, permitindo respostas baseadas no que a câmera vê, além de suportar 97 idiomas e detectar automaticamente mudanças de idioma durante a conversa. O modelo também pode executar tarefas em segundo plano sem interromper a conversa, mantendo o usuário informado sobre o progresso. O Gemini 3.8 Live Extended Thinking aborda o mesmo problema de forma diferente, permitindo que o processo de pensamento e a fala ocorram simultaneamente. Durante o raciocínio complexo, o modelo emite sinais de voz, como 'Vou verificar isso...', para indicar que a solicitação foi recebida e está sendo processada, mantendo o usuário engajado. Ambos os modelos estão disponíveis através do Gemini Live API e são suportados por várias plataformas de desenvolvimento, como Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel e Vision Agents.

Essas plataformas ajudam a gerenciar a infraestrutura de streaming de mídia em tempo real, permitindo que os desenvolvedores se concentrem na experiência do usuário. O Google está colaborando com empresas como Salesforce, Genspark e Lumeris, que valorizam a baixa latência, a fluidez da conversa e a capacidade de integração com ferramentas. Todas as vozes geradas pelos produtos de IA do Google são marcadas com um watermark digital chamado SynthID, que é imperceptível para os ouvintes, mas pode ser detectado por sistemas de verificação. Essa medida visa combater o uso indevido de vozes sintéticas para manipulação de informações. Os detalhes de segurança e responsabilidade estão disponíveis no documento do modelo (Model Card) publicado pelo Google. Atualmente, ambos os modelos estão sendo lançados gradualmente. Desenvolvedores podem acessá-los através do Gemini API e do Google AI Studio, enquanto organizações têm acesso em versão prévia limitada no Gemini Enterprise. O público geral encontrará o Gemini 3.8 Live no Search Live, e o Extended Thinking estará disponível no Gemini Live, incluindo no Docs para assinantes dos pacotes Google AI Pro e Ultra, e no Gmail e Keep para todos os níveis de assinatura do Google AI.