🤖 IA & Automação · · 3 min de leitura

Google lança ferramentas de IA para criação de vozes personalizadas

Gemini 3.8 permite criação de vozes realistas e personalizadas

ia automação google deepmind gemini

Publicidade

A Google acaba de lançar novas ferramentas de IA que permitem criar e personalizar vozes realistas a partir do zero. Com o Gemini 3.8, é possível direcionar essas vozes para soar exatamente como desejado, desde o sotaque até o tom emocional. Isso é perfeito para criar audiobooks, jogos ou podcasts que soam como pessoas reais conversando.

Essas ferramentas são parte da família Gemini, que inclui modelos de texto-para-fala (TTS) como o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS. Esses modelos permitem que criadores, desenvolvedores e empresas criem experiências de áudio mais ricas e expressivas, enquanto melhoram a experiência do usuário em produtos como o Gemini Notebook e o Google Vids.

O Gemini 3.8 Flash TTS é capaz de criar vozes personalizadas a partir de uma biblioteca infinita, permitindo que os usuários criem vozes únicas e consistentes para suas marcas ou personagens. Além disso, o modelo permite um controle preciso sobre a entrega de cada linha, permitindo que os criadores direcionem a vocalização de forma mais natural e expressiva.

Publicidade

As ferramentas de IA da Google também incluem recursos de segurança para garantir que as vozes sejam usadas de forma responsável. Por exemplo, o sistema de replicação de voz requer uma gravação de consentimento verbal do proprietário da voz antes de criar uma voz replicada. Além disso, todos os clips de áudio gerados pelos modelos de áudio da Gemini são marcados com um watermark imperceptível chamado SynthID, que ajuda a prevenir a disseminação de informações falsas.

A Google está trabalhando em parceria com empresas como Figma, HeyGen, Linguana, Wondercraft, 99.co e Ollang para integrar os modelos de TTS mais recentes e acelerar a dublagem global, localizar mídia com sotaques regionais nuances e alimentar agentes de voz conversacional em escala.

Com o lançamento do Gemini 3.8, a Google está revolucionando a forma como as vozes são criadas e usadas em diferentes aplicações. Isso pode ter um impacto significativo em indústrias como a de entretenimento, educação e marketing, onde as vozes personalizadas e realistas podem ser usadas para criar experiências mais imersivas e envolventes.

Além disso, a tecnologia de IA da Google pode ser usada para criar vozes em diferentes idiomas, o que pode ser útil para empresas que operam em mercados globais. Com o suporte a mais de 100 idiomas, os modelos de TTS da Gemini podem ser usados para criar experiências de áudio de alta qualidade em diferentes partes do mundo.

No entanto, é importante notar que a tecnologia de IA da Google também levanta questões sobre a privacidade e a segurança. Por exemplo, como as vozes replicadas serão usadas e quem terá acesso a elas? Além disso, como a Google garantirá que as vozes sejam usadas de forma responsável e não para fins mal-intencionados?

Em resumo, o lançamento do Gemini 3.8 é um passo significativo na direção da criação de vozes personalizadas e realistas usando IA. Com suas ferramentas de segurança e recursos de controle preciso, a Google está revolucionando a forma como as vozes são criadas e usadas em diferentes aplicações. No entanto, é importante considerar as implicações éticas e de segurança da tecnologia de IA e garantir que ela seja usada de forma responsável.

Fontes

Esta análise é original do i-a-trend e foi elaborada a partir das reportagens publicadas pelas fontes acima, consultadas para apuração dos fatos. O crédito pela apuração é dos veículos citados — recomendamos a leitura das matérias originais.

Texto produzido com apoio de inteligência artificial e publicado sob responsabilidade editorial do i-a-trend. Encontrou um erro? Escreva para contato@i-a-trend.com.

Publicidade

Leia também

Receba as tendências de IA

As 10 melhores notícias de automação com IA toda semana no seu email.

Sem spam. Cancelamento a qualquer momento.