Uma divisão da LG introduziu o Captioning AI, um sistema generativo de IA capaz de reconhecer elementos de imagem e gerar descrições e palavras-chave para eles – é difícil superestimar os benefícios que essa tecnologia pode proporcionar, por exemplo, na organização de bancos de dados de imagens de grandes empresas.

Talvez nem todas as imagens sejam fáceis de descrever. Fonte da imagem: Rick Rothenberg/unsplash.com

O desenvolvedor de legendas AI LG AI Research falou na Computer Vision and Pattern Recognition 2023, a maior conferência de “visão computacional” do mundo, realizada no domingo em Vancouver, Canadá. De acordo com a LG, o serviço é baseado na tecnologia Zero-shot Image Captioning desenvolvida pela LG AI Research, que permite que a IA “entenda” e descreva objetos ou cenas que a rede neural avalia pela primeira vez sem prompts adicionais, com base em sua experiência anterior – assim como as pessoas.

A empresa explicou que a tecnologia é diferente de serviços de IA como o Midjourney, nos quais tudo acontece exatamente ao contrário – os usuários inserem texto ou fazem upload de uma imagem, com base na qual a IA gera sua própria criação. Criar “legendas” para fotos pode parecer bem fácil, já que o conceito não é novo. No entanto, a tecnologia atingiu um novo nível. Por exemplo, a inteligência artificial pode realmente tirar conclusões e descrever algo que nunca “viu” antes – olhar para uma paisagem ou uma pessoa e descobrir que lugar é. A tecnologia permite reconhecer o fundo, os personagens e até mesmo a atividade na imagem e descrever a interação dos elementos.

Fonte da imagem: LG

A Caption AI pode gerar descrições de texto e palavras-chave para 10.000 imagens em menos de dois dias, o que, em teoria, poderia melhorar a eficiência e a produtividade de empresas que precisam gerenciar grandes matrizes de imagens. Em média, o sistema pode gerar 5 frases e 10 palavras-chave em 10 segundos.

O serviço foi desenvolvido em colaboração com a Shutterstock, uma das maiores plataformas de postagem de conteúdo visual – de imagens a vídeos. A LG AI Research já colaborou com esta empresa americana no passado e pretende continuar a expandir a cooperação com outros parceiros. De acordo com a Shutterstock, a tecnologia Caption AI está evoluindo por meio de “acesso antecipado” ao programa de dez clientes globais.

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *