Serrana FM

Notícia

TECNOLOGIA

Notícias/TECNOLOGIA25/09/2026· KF News

Google lança modelos de voz com IA que clona uma gravação em apenas 30 segundos

Foto: Marcelo Fischer/Canaltech

O Google anunciou dois novos modelos de geração de voz por inteligência artificial: o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS. A grande novidade é a clonagem de voz — com apenas 30 segundos de gravação, a IA consegue reproduzir uma voz existente. Os modelos também interpretam instruções de atuação e adicionam elementos como risadas, sussurros, suspiros e interjeições nas falas.

O Gemini 3.8 Flash TTS tem foco em vozes expressivas e personalizadas, com aplicações em audiobooks, podcasts e personagens de jogos. Ele cria vozes do zero a partir de descrições em texto, com sotaque e características definidas. O modelo também consegue encenar diálogos entre duas vozes diferentes a partir de um único roteiro, o que é útil em produções com múltiplos personagens. Em conteúdos longos, ele busca manter o timbre e o tom consistentes por horas, reduzindo o chamado speaker drift — variação indesejada na voz ao longo do tempo.

Já o Gemini 3.8 Flash-Lite TTS foi criado pra dublagem e localização de conteúdo em larga escala, com suporte a mais de 100 idiomas e dialetos, incluindo português brasileiro, francês do Quebec e espanhol mexicano. O modelo também atende à criação de agentes de voz interativos.

O catálogo dos dois modelos já oferece mais de 2.000 vozes prontas. O Google também prepara uma opção pra personalizar essas vozes com ajustes de timbre, tom, ritmo e sotaque via texto. Antes de clonar qualquer voz, o Google exige uma gravação de consentimento verbal. Os áudios gerados recebem o SynthID, uma marca d'água invisível, e credenciais C2PA, que registram a origem e autenticidade do conteúdo. A função de clonagem não está disponível no Reino Unido, no Espaço Econômico Europeu, na Suíça, na Índia e nos estados americanos de Illinois e Texas.

Fonte: Ler matéria original