Categorias: Mercado de tecnologia e TI. notíciaProgramas

NVIDIA apresenta AI que gera vídeo de alta resolução a partir de descrição de texto

A NVIDIA revelou seu modelo de IA de texto para vídeo chamado VideoLDM, desenvolvido em colaboração com pesquisadores da Cornell University. O modelo é capaz de gerar vídeo com resolução de até 2048 × 1280 pixels, frequência de 24 quadros e duração de até 4,7 segundos com base em uma descrição de texto.

Fonte da imagem: NVIDIA

O modelo é baseado nos desenvolvimentos da rede neural Stable Diffusion. A solução NVIDIA tem até 4,1 bilhões de parâmetros, mas apenas 2,7 bilhões deles usaram vídeo para treinamento. Isso é bastante modesto para os padrões da IA moderna. No entanto, com uma abordagem eficiente de modelo de difusão latente (LDM), os desenvolvedores conseguiram criar vídeos de alta definição diversificados e consistentes no tempo com qualidade muito alta.

Os pesquisadores destacam as seguintes características desse modelo: geração de vídeo personalizada e síntese convolucional no tempo. Camadas temporais que foram treinadas no VideoLDM para transformar texto em vídeo são inseridas em redes de referência de imagens LDM que são ajustadas antecipadamente no conjunto de imagens DreamBooth. As camadas temporais são resumidas pelos pontos de interrupção do DreamBooth, permitindo que você personalize a conversão de texto para vídeo. Ao aplicar as camadas temporais aprendidas de forma convolucional ao longo do tempo, você pode obter clipes ligeiramente mais longos com pouca degradação na qualidade.

O modelo também é capaz de gerar vídeos de cenas de direção. Os vídeos têm resolução de 1024 × 512 pixels e duram até 5 minutos. É possível simular um cenário de direção específico, quando caixas delimitadoras são tomadas como base para criar um ambiente interessante, um quadro inicial apropriado é sintetizado e, então, vídeos verossímeis são criados. Além disso, o modelo pode fazer previsão de cenário de movimento multimodal, gerando várias implantações plausíveis com base em um único quadro inicial.

Este trabalho de pesquisa é um participante da Conferência de Visão de Máquina e Reconhecimento de Padrões, que acontece em Vancouver de 18 a 22 de junho. Até agora, a rede neural apresentada é apenas um projeto de pesquisa e não está claro quando a NVIDIA lançará algo assim ao público.

avalanche

Próximo A Stability AI publicou um conjunto de pequenas redes neurais StableLM de código aberto para competir com o GPT-4 »

Anterior « Resident Evil 4 Remake lidera a parada de jogos mais vendidos nos EUA em março, PS5 começa a vender mais rápido que o PS4

Deixar comentário

Publicado por

avalanche

3 anos atrás

Postagens recentes

Aplicativos Android

As Aventuras de Elliot: Contos do Milênio – Um Retorno à Moda Antiga. Análise / Jogos

Jogado no Xbox Series S Em 2018, foi lançado Octopath Traveler, o primeiro jogo feito…

3 horas atrás

Sistemas operacionais

As Aventuras de Elliot: Contos do Milênio – Um Retorno à Moda Antiga. Resenha

Jogado no Xbox Series S Em 2018, foi lançado Octopath Traveler, o primeiro jogo feito…

3 horas atrás

Memória antiga de uma nova maneira: ASIC Meta✴ Vistara te ajudará a instalar DDR4 a partir de memória usada.

A Meta✴ desenvolveu o ASIC Vistara que, utilizando a tecnologia CXL, permitirá a instalação de…

3 horas atrás

Na vanguarda da ciência

Uma galáxia distante explodiu em um aglomerado galáctico e proporcionou um espetáculo de luzes que ocupou metade do céu.

Astrônomos relataram a descoberta de uma radiogaláxia incomum, RAD-BAARG, ao redor da qual se formou…

5 horas atrás

Consoles de jogos

O Ayaneo Pocket Micro 2, um console portátil compacto com um processador Snapdragon 865 personalizado, foi lançado por US$ 239.

A Ayaneo lançou o Pocket Micro 2, seu segundo console Android em miniatura e formato…

7 horas atrás

Os Raspberry Pi 4 Modelo B com clock reduzido já estão disponíveis para compra.

Uma nova versão do computador de placa única Raspberry Pi 4 Modelo B já está…

8 horas atrás

NVIDIA apresenta AI que gera vídeo de alta resolução a partir de descrição de texto

Conteúdo relacionado

Postagens recentes

As Aventuras de Elliot: Contos do Milênio – Um Retorno à Moda Antiga. Análise / Jogos

As Aventuras de Elliot: Contos do Milênio – Um Retorno à Moda Antiga. Resenha

Memória antiga de uma nova maneira: ASIC Meta✴ Vistara te ajudará a instalar DDR4 a partir de memória usada.

Uma galáxia distante explodiu em um aglomerado galáctico e proporcionou um espetáculo de luzes que ocupou metade do céu.

O Ayaneo Pocket Micro 2, um console portátil compacto com um processador Snapdragon 865 personalizado, foi lançado por US$ 239.

Os Raspberry Pi 4 Modelo B com clock reduzido já estão disponíveis para compra.