O Google anunciou o Gemini 3.8 Live com Live Avatar, novidade que adiciona uma representação visual em tempo real às conversas com a inteligência artificial. O recurso usa diálogo por voz e transmissão de vídeo de baixa latência para exibir um avatar que consegue falar, movimentar os lábios e reagir durante a interação.
A tecnologia processa entradas de áudio e vídeo simultaneamente para manter conversas mais naturais. Os avatares contam com sincronização labial, expressões faciais e alternância de turnos durante o diálogo. A IA também consegue executar tarefas em segundo plano sem interromper a conversa.
O Live Avatar também foi desenvolvido para uso em diferentes idiomas. O sistema suporta 97 línguas e mantém a sincronização entre fala e movimentos do avatar mesmo quando o idioma muda durante a conversa. Todo o conteúdo gerado pelo recurso, incluindo áudio e vídeo, recebe a marca d'água SynthID. A tecnologia fica incorporada ao material produzido por IA e serve para ajudar na identificação desse tipo de conteúdo.
:quality(85)/ffe2e854-0638-41d8-b26b-5662b6c0e8d0.png)
Os avatares em vídeo estão disponíveis para quem?
O Gemini 3.8 Live com Live Avatar está disponível inicialmente para usuários do Gemini Enterprise. As empresas que utilizam a plataforma podem recorrer à documentação da API para integrar os avatares a serviços próprios, como atendimento ao cliente e tutoriais interativos.
O Google oferece diferentes opções de personalização. Entre elas estão:
-
Avatares prontos: empresas podem escolher personagens com estilos 2D, animações 3D e aparência humana;
-
Avatares personalizados: organizações podem criar uma persona própria a partir de uma imagem de referência para representar uma marca ou identidade visual;
-
Acesso restrito: a criação de avatares personalizados ainda depende de aprovação do Google por meio de uma lista de permissões.
Se você gostou do conteúdo, talvez também se interesse por conferir “Como usar o Google Vids para criar vídeos profissionais com IA sem gastar nada”.
{{WHATSAPP_CHANNEL}}

