🤖 IA & Automação · · 3 min de leitura

Google Lança Modelos de Diálogo Avançados

Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking são lançados

ia automação google gemini

Publicidade

A Google acaba de lançar dois novos modelos de diálogo avançados, chamados Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking, que prometem tornar as interações por voz mais naturais, fluidas e inteligentes. Esses modelos são capazes de lidar com raciocínio complexo, contexto visual em tempo real e execução de tarefas em segundo plano sem interromper a conversa.

Com esses modelos, os usuários podem começar a usar recursos avançados de diálogo por voz através da API Gemini, Google Workspace e do aplicativo Gemini. Além disso, os desenvolvedores e empresas podem aproveitar esses modelos para criar agentes de voz confiáveis e prontos para produção, tornando a conversa com a IA mais intuitiva e inteligente.

Um dos principais recursos do Gemini 3.8 Live é a capacidade de processar entradas visuais em tempo real, enriquecendo as conversas com contexto para respostas mais úteis. Além disso, ele pode detectar e mudar entre 97 idiomas suportados durante a conversa, executar ferramentas e chamadas de API em segundo plano enquanto continua a conversa, permitindo que o modelo reconheça solicitações e continue conversando enquanto as tarefas são concluídas em segundo plano.

Publicidade

O Gemini 3.8 Live Extended Thinking, por outro lado, fornece conclusão de tarefas de empresa de classe e inteligência, capturando o primeiro lugar geral no Índice de Qualidade de Fala para Fala da Análise Artificial, com 82,6%, e lidera na conclusão de tarefas agênticas com 68,6% no benchmark τ-Voice e 35,1% no benchmark τ-Voice-banking da Sierra. Além disso, ele fornece fortes capacidades de raciocínio, marcando 97,7% no Big Bench Audio, mantendo um ponto de preço altamente competitivo em comparação com outros modelos de fronteira.

Esses modelos também podem ser usados para guiar o processo de integração de funcionários em tempo real, usando contexto visual para responder a perguntas ao vivo. Além disso, eles podem jogar xadrez em tempo real usando contexto visual, raciocínio e fluxo de conversa natural.

Para tarefas que exigem raciocínio mais profundo, o Gemini 3.8 Live Extended Thinking pode raciocinar e falar simultaneamente, fornecendo inteligência aumentada para fluxos de trabalho complexos enquanto mantém um fluxo de conversa ininterrupto. Isso é alcançado usando pistas verbais iniciais, como "Vou verificar isso...", para reconhecer naturalmente os prompts, e narração de progresso ao vivo para levar os usuários através de tarefas de múltiplos passos em segundo plano à medida que elas progridem.

Os modelos Gemini 3.8 Live e Gemini 3.8 Live Extended Thinking estão disponíveis para uso em várias plataformas, incluindo Google Workspace, Search e o aplicativo Gemini. Além disso, os desenvolvedores podem usar a API Gemini Live para criar interfaces de usuário impulsionadas por voz de alto desempenho com facilidade, graças a plataformas de desenvolvimento como Agora, Fishjam, LangChain, LiveKit, Pipecat, Vercel e Vision Agents.

A Google também está trabalhando em parceria com empresas como Salesforce, Genspark e Lumeris, que estão entusiasmadas com os modelos 3.8 Live e 3.8 Live Extended Thinking, destacando sua latência impressionante, fluidez e capacidades de chamada de ferramentas.

Todos os áudios gerados pelos produtos de IA da Google são marcados com SynthID, uma marca d'água imperceptível que é tecida diretamente na saída de áudio, garantindo que o conteúdo gerado por IA permaneça detectável para ajudar a prevenir a desinformação. Para obter mais detalhes sobre a abordagem da empresa em relação à segurança e responsabilidade, é possível revisar o cartão do modelo.

Com o lançamento desses modelos avançados de diálogo, a Google está mais uma vez inovando no campo da inteligência artificial e automação, oferecendo recursos poderosos para empresas e usuários que desejam melhorar a eficiência e a produtividade em suas operações diárias.

Fontes

Esta análise é original do i-a-trend e foi elaborada a partir das reportagens publicadas pelas fontes acima, consultadas para apuração dos fatos. O crédito pela apuração é dos veículos citados — recomendamos a leitura das matérias originais.

Texto produzido com apoio de inteligência artificial e publicado sob responsabilidade editorial do i-a-trend. Encontrou um erro? Escreva para contato@i-a-trend.com.

Publicidade

Leia também

Receba as tendências de IA

As 10 melhores notícias de automação com IA toda semana no seu email.

Sem spam. Cancelamento a qualquer momento.