Pular para o conteúdo principal
Aracaju, Segunda-feira, 28 de setembro de 2026
Pular para o conteúdo
Tecnologia

Google lança Gemini 3.8: clona vozes em 30s e insere risos e sussurros

Google lança Gemini 3.8 Flash TTS e Flash-Lite: clonagem de voz com 30s, risos e sussurros, suporte a 100+ idiomas e medidas de identificação.

28/09/2026 · 07h45
Google lança Gemini 3.8: clona vozes em 30s e insere risos e sussurros

O Google anunciou os novos modelos Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS, voltados à geração de voz por inteligência artificial. As ferramentas trazem recursos para criar vozes personalizadas e mais expressivas, incluindo a reprodução de uma voz existente a partir de uma amostra de apenas 30 segundos. A tecnologia também consegue interpretar instruções de atuação e adicionar elementos como risadas, sussurros e suspiros às falas.

Os novos modelos foram desenvolvidos para aplicações diversas: audiobooks, podcasts, criação de vozes para personagens de jogos, dublagens e narração de vídeos. A função atende a simulações de atendimento ao cliente, treinamentos e produções narrativas. Empresas poderão, inclusive, criar perfis de voz para manter uma identidade sonora consistente em diferentes conteúdos.

Publicidade

Em materiais de longa duração, a tecnologia busca manter a qualidade, o timbre e o tom da voz ao longo de horas de áudio, reduzindo o chamado speaker drift. Esse recurso é apontado como especialmente útil para audiobooks e podcasts, nos quais alterações na voz podem ficar mais perceptíveis para o ouvinte.

Os modelos também suportam dublagem e localização de conteúdo, com cobertura para mais de 100 idiomas e dialetos. A lista inclui, entre outros, o português brasileiro, o francês do Quebec e o espanhol mexicano. Há ainda um catálogo com mais de 2.000 vozes prontas para produção, e está prevista uma opção para personalizar as vozes da biblioteca via instruções em texto, permitindo ajustes de timbre, tom, ritmo e sotaque sem criar uma voz do zero.

Você pode se interessarConteúdo patrocinado · MGID

O Flash TTS tem foco em direção criativa e design de personagens, oferecendo controles detalhados para orientar a interpretação linha por linha. Já o Flash-Lite TTS foi desenvolvido para geração em alta escala, com foco em eficiência de custos. Para preservar consentimento, o Google solicita uma gravação de consentimento verbal correspondente ao locutor de referência antes da reprodução de uma voz existente.

Os áudios gerados pelos modelos Gemini Audio recebem o SynthID, uma marca d’água imperceptível incorporada ao conteúdo para auxiliar na identificação de material sintético, além de credenciais C2PA que registram informações sobre a origem e a autenticidade do conteúdo. A função de clonagem de voz no Google AI Studio apresenta restrições regionais e não estará disponível no Reino Unido, no Espaço Económico Europeu (EEE), na Suíça, na Índia e nos estados americanos de Illinois e Texas.

Quanto a integrações, o Gemini 3.8 Flash TTS será integrado ao Gemini Notebook, enquanto o Gemini 3.8 Flash-Lite TTS chegará ao Google Vids para gerar narrações e dublagens em apresentações e outros conteúdos em vídeo. Para desenvolvedores, os modelos já estão disponíveis na Gemini API e no Google AI Studio, que oferece um ambiente para testar a geração de voz e criar diálogos entre múltiplos personagens. Há, ainda, previsão de disponibilidade para clientes do Gemini Enterprise, com detalhes de recursos a serem divulgados.

Publicidade

Gostou? Compartilhe com quem precisa saber:

Recomendado para vocêConteúdo patrocinado · MGID
Publicidade
Mais conteúdos para vocêConteúdo patrocinado · MGID
Sugeridas pra vocêConteúdo patrocinado · MGID
Publicidade
3 min de leitura

O Google anunciou os novos modelos Gemini 3.8 Flash TTS e Gemini 3.8 Flash-Lite TTS, voltados à geração de voz por inteligência artificial. As ferramentas trazem recursos para criar vozes personalizadas e mais expressivas, incluindo a reprodução de uma voz existente a partir de uma amostra de apenas 30 segundos. A tecnologia também consegue interpretar instruções de atuação e adicionar elementos como risadas, sussurros e suspiros às falas.

Os novos modelos foram desenvolvidos para aplicações diversas: audiobooks, podcasts, criação de vozes para personagens de jogos, dublagens e narração de vídeos. A função atende a simulações de atendimento ao cliente, treinamentos e produções narrativas. Empresas poderão, inclusive, criar perfis de voz para manter uma identidade sonora consistente em diferentes conteúdos.

Em materiais de longa duração, a tecnologia busca manter a qualidade, o timbre e o tom da voz ao longo de horas de áudio, reduzindo o chamado speaker drift. Esse recurso é apontado como especialmente útil para audiobooks e podcasts, nos quais alterações na voz podem ficar mais perceptíveis para o ouvinte.

Os modelos também suportam dublagem e localização de conteúdo, com cobertura para mais de 100 idiomas e dialetos. A lista inclui, entre outros, o português brasileiro, o francês do Quebec e o espanhol mexicano. Há ainda um catálogo com mais de 2.000 vozes prontas para produção, e está prevista uma opção para personalizar as vozes da biblioteca via instruções em texto, permitindo ajustes de timbre, tom, ritmo e sotaque sem criar uma voz do zero.

O Flash TTS tem foco em direção criativa e design de personagens, oferecendo controles detalhados para orientar a interpretação linha por linha. Já o Flash-Lite TTS foi desenvolvido para geração em alta escala, com foco em eficiência de custos. Para preservar consentimento, o Google solicita uma gravação de consentimento verbal correspondente ao locutor de referência antes da reprodução de uma voz existente.

Os áudios gerados pelos modelos Gemini Audio recebem o SynthID, uma marca d’água imperceptível incorporada ao conteúdo para auxiliar na identificação de material sintético, além de credenciais C2PA que registram informações sobre a origem e a autenticidade do conteúdo. A função de clonagem de voz no Google AI Studio apresenta restrições regionais e não estará disponível no Reino Unido, no Espaço Económico Europeu (EEE), na Suíça, na Índia e nos estados americanos de Illinois e Texas.

Quanto a integrações, o Gemini 3.8 Flash TTS será integrado ao Gemini Notebook, enquanto o Gemini 3.8 Flash-Lite TTS chegará ao Google Vids para gerar narrações e dublagens em apresentações e outros conteúdos em vídeo. Para desenvolvedores, os modelos já estão disponíveis na Gemini API e no Google AI Studio, que oferece um ambiente para testar a geração de voz e criar diálogos entre múltiplos personagens. Há, ainda, previsão de disponibilidade para clientes do Gemini Enterprise, com detalhes de recursos a serem divulgados.

Gostou? Compartilhe com quem precisa saber:

Receba as notícias no seu WhatsApp

Entre no nosso canal oficial e fique por dentro de tudo que acontece em Sergipe

Entrar no canal →

Publicidade

EM ALTA AGORA