A rede neural generativa VASA-1 da Microsoft cria vídeo a partir de uma única imagem

Nos últimos anos, as redes neurais generativas superaram um importante estágio de desenvolvimento, tornando-se mais poderosas e capazes de criar não apenas imagens, mas também vídeos baseados em descrições de texto. O novo algoritmo VASA-1 da Microsoft provavelmente surpreenderá muitos porque não requer nenhuma descrição para funcionar. Basta fornecer uma imagem de uma pessoa e uma trilha de áudio, a partir da qual a rede neural gerará um vídeo de uma pessoa falante com uma ampla gama de emoções e expressões faciais naturais.

Fonte da imagem: Microsoft

O resultado do VASA-1 parece muito natural e verossímil. A partir de apenas uma foto de um rosto e uma gravação de voz, o algoritmo cria um vídeo realista em que a pessoa capturada na foto literalmente “ganha vida” e suas expressões faciais, movimentos de lábios e cabeça parecem completamente naturais. Como os vídeos criados com o VASA-1 são difíceis de distinguir imediatamente dos reais, já existem preocupações de que o algoritmo possa ser usado por invasores para criar falsificações.

Quanto à própria rede neural, seu principal diferencial em relação a outros algoritmos semelhantes é a presença de um modelo holístico para geração de expressões faciais e movimentos de cabeça. A Microsoft conduziu uma extensa pesquisa, incluindo a avaliação de uma série de novas métricas. Como resultado, eles descobriram que o novo algoritmo supera significativamente os análogos apresentados anteriormente em muitos aspectos.

«Nosso método não apenas gera vídeo de alta qualidade com expressões faciais e movimentos de cabeça realistas, mas também suporta a geração de vídeo online de 512×512 pixels a 40 quadros por segundo com atraso inicial insignificante. Isso abre caminho para interações em tempo real com avatares realistas que imitam o comportamento conversacional humano”, afirmou a Microsoft em comunicado.

Em outras palavras, a rede neural pode criar vídeos falsos de alta qualidade baseados em apenas uma imagem. Portanto, não é surpreendente que a Microsoft chame o VASA-1 de “demonstração de pesquisa” e não tenha planos de trazê-lo ao mercado comercial, pelo menos não tão cedo.

avalanche

Postagens recentes

O Alibaba não atingiu as expectativas dos investidores no quarto trimestre, com o lucro líquido caindo 66%.

Hoje, a gigante chinesa de tecnologia Alibaba anunciou uma queda de 66% no lucro líquido…

13 minutos atrás

A Valve mudou o funcionamento do recarregamento no Counter-Strike após 26 anos.

Nos 26 anos desde o lançamento do Counter-Strike clássico, os jogadores se acostumaram com o…

36 minutos atrás

MicroLEDs substituem lasers: Microsoft cria interconexões ópticas de última geração com eficiência energética para data centers de IA.

Pesquisadores da Microsoft em Cambridge, no Reino Unido, estão explorando o uso de interconexões ópticas…

49 minutos atrás

O CEO da Ferrari explica a popularidade das telas sensíveis ao toque nos carros: elas custam metade do preço dos botões.

O CEO da Ferrari, Benedetto Vigna, concedeu recentemente uma longa entrevista à publicação britânica Autocar.…

2 horas atrás

A Arctic apresentou o Senza AI 370, um PC para instalação sob a mesa — e ele também é silencioso.

A Arctic apresentou o Senza AI 370, um computador de mesa sem ventoinhas que se…

2 horas atrás