PUBLICIDADE

Google dá rosto e expressões ao Gemini: Live Avatar promete conversas animadas em tempo real e fluência em 97 idiomas

24/09/2026
9 visualizações
3 min de leitura
Imagem principal do post

Gemini ganha rosto animado em tempo real com novo recurso Live Avatar do Google

O Google apresentou nesta quinta-feira (24) o Live Avatar, um novo recurso integrado ao Gemini 3.8 Live que adiciona uma persona animada à tela durante conversas com a inteligência artificial. A novidade permite que o assistente virtual apresente expressões faciais e sincronize os movimentos da boca com a fala em tempo quase real, tornando a interação mais natural.

Imagem complementar

A tecnologia combina geração de vídeo de baixa latência com os recursos de diálogo ao vivo do Gemini, que já havia sido apresentado em setembro voltado para conversas por voz em tempo quase real. Com o Live Avatar, a inteligência artificial deixa de responder apenas por áudio e passa a contar com uma presença visual durante o diálogo, ampliando a forma como usuários e empresas podem interagir com o modelo.

PUBLICIDADE

O recurso foi pensado principalmente para aplicações corporativas dentro do Gemini Enterprise, a versão da plataforma voltada para organizações. Entre os usos previstos estão atendimento ao cliente e experiências interativas, áreas nas quais a combinação de voz e imagem pode tornar a comunicação mais envolvente. O sistema é capaz de processar simultaneamente informações visuais e de áudio ao longo da conversa, o que permite respostas mais contextuais.

Um dos destaques técnicos é a capacidade de alternar entre 97 idiomas diferentes durante uma mesma conversa. Segundo o Google, o avatar consegue adaptar a sincronização labial e as expressões faciais a cada idioma sem perda de fidelidade visual nem a introdução de desvio visual. Em uma demonstração divulgada pela empresa, o mesmo personagem animado conversou em inglês e em japonês, com os movimentos da boca acompanhando a fala em ambos os idiomas.

Além da fala sincronizada, o Live Avatar também consegue exibir informações na tela enquanto mantém o diálogo ativo, funcionando como um complemento visual à conversa. Outro recurso disponível é a execução de ferramentas em segundo plano, que permite à inteligência artificial buscar dados ou realizar tarefas específicas sem interromper a comunicação com o usuário. O Google cita como exemplo uma situação de check-in em hotel, na qual o avatar poderia acionar sistemas internos enquanto continua conversando com o hóspede.

As organizações interessadas poderão escolher entre uma biblioteca de avatares prontos disponibilizada pelo Google ou criar personagens personalizados. No segundo caso, desenvolvedores podem partir de uma imagem de referência para gerar um avatar animado, preservando características visuais, identidade de personagem ou elementos ligados à marca da empresa. A criação de avatares personalizados, porém, está restrita inicialmente a uma lista de empresas autorizadas pelo Google.

A empresa também reforça os mecanismos de identificação de conteúdo gerado por inteligência artificial. Segundo o Google, todo o material produzido por seus produtos de IA recebe a marca d'água invisível SynthID, incorporada tanto ao áudio quanto ao vídeo. O recurso tem como objetivo ajudar a identificar conteúdos criados por inteligência artificial, um tema cada vez mais relevante diante do avanço de ferramentas generativas.

Enquanto apresenta essa nova camada visual para o Gemini, o Google também se prepara para o próximo grande salto na família de modelos. O Gemini 4 está em fase de refinamento e deve ser lançado antes do fim de 2026, de acordo com Koray Kavukcuoglu, chefe do Google DeepMind. Em entrevista ao The Information, o executivo afirmou que a empresa pretende disponibilizar uma primeira versão do modelo assim que possível, após a conclusão do treinamento final.

Kavukcuoglu também disse que o Google pretende manter um ritmo acelerado de novas versões, buscando permanecer na fronteira do desenvolvimento de inteligência artificial. Reportagens publicadas na mesma quinta-feira indicam que o Gemini 4 já entrou na etapa de pós-treinamento, fase em que o comportamento do modelo é refinado por meio de testes internos e implementação de mecanismos de segurança antes do lançamento oficial.

O novo Live Avatar e a expectativa em torno do Gemini 4 mostram que o Google segue expandindo os recursos e a ambição da família Gemini. Com a adição da camada visual às conversas e a perspectiva de uma nova geração de modelo chegando em um futuro próximo, a empresa busca reforçar a presença da sua inteligência artificial tanto em aplicações empresariais quanto no debate sobre os rumos da tecnologia.

PUBLICIDADE

Leitura recomendada

Comentários

Nenhum comentário ainda. Seja o primeiro a comentar!