A LG introduziu a rede neural Captioning AI, que cria descrições de texto para imagens

Uma divisão da LG introduziu o Captioning AI, um sistema generativo de IA capaz de reconhecer elementos de imagem e gerar descrições e palavras-chave para eles – é difícil superestimar os benefícios que essa tecnologia pode proporcionar, por exemplo, na organização de bancos de dados de imagens de grandes empresas.

Talvez nem todas as imagens sejam fáceis de descrever. Fonte da imagem: Rick Rothenberg/unsplash.com

O desenvolvedor de legendas AI LG AI Research falou na Computer Vision and Pattern Recognition 2023, a maior conferência de “visão computacional” do mundo, realizada no domingo em Vancouver, Canadá. De acordo com a LG, o serviço é baseado na tecnologia Zero-shot Image Captioning desenvolvida pela LG AI Research, que permite que a IA “entenda” e descreva objetos ou cenas que a rede neural avalia pela primeira vez sem prompts adicionais, com base em sua experiência anterior – assim como as pessoas.

A empresa explicou que a tecnologia é diferente de serviços de IA como o Midjourney, nos quais tudo acontece exatamente ao contrário – os usuários inserem texto ou fazem upload de uma imagem, com base na qual a IA gera sua própria criação. Criar “legendas” para fotos pode parecer bem fácil, já que o conceito não é novo. No entanto, a tecnologia atingiu um novo nível. Por exemplo, a inteligência artificial pode realmente tirar conclusões e descrever algo que nunca “viu” antes – olhar para uma paisagem ou uma pessoa e descobrir que lugar é. A tecnologia permite reconhecer o fundo, os personagens e até mesmo a atividade na imagem e descrever a interação dos elementos.

Fonte da imagem: LG

A Caption AI pode gerar descrições de texto e palavras-chave para 10.000 imagens em menos de dois dias, o que, em teoria, poderia melhorar a eficiência e a produtividade de empresas que precisam gerenciar grandes matrizes de imagens. Em média, o sistema pode gerar 5 frases e 10 palavras-chave em 10 segundos.

O serviço foi desenvolvido em colaboração com a Shutterstock, uma das maiores plataformas de postagem de conteúdo visual – de imagens a vídeos. A LG AI Research já colaborou com esta empresa americana no passado e pretende continuar a expandir a cooperação com outros parceiros. De acordo com a Shutterstock, a tecnologia Caption AI está evoluindo por meio de “acesso antecipado” ao programa de dez clientes globais.

avalanche

Postagens recentes

A SMIC registrou um aumento de 61% na receita em meio ao boom da IA, sanções e substituição de importações.

Embora o boom da IA ​​esteja impulsionando as receitas das gigantes globais de semicondutores, na…

2 horas atrás

A Microsoft aprendeu a corromper modelos de IA com uma única consulta.

Uma única consulta relativamente simples durante a fase de aprendizado por reforço pode alterar o…

3 horas atrás

É hora de começar a juntar dinheiro para um PS6: jornalistas revelaram a data de lançamento da sequência de Horizon Forbidden West.

O repórter da Kotaku, Ethan Gach, citando fontes, revelou quanto tempo os fãs dos jogos…

3 horas atrás

O Xiaomi SU7, carro elétrico remodelado, foi revelado em fotos – ele oferecerá uma autonomia de até 902 km.

Este mês de março marca uma data simbólica para a Xiaomi: há dois anos, a…

3 horas atrás

Constatou-se que usuários ativos de IA apresentam um risco maior de esgotamento profissional.

Os otimistas em relação às tecnologias de inteligência artificial afirmam que elas não tornarão as…

4 horas atrás

Rumor: o dono da Arc Raiders está desenvolvendo um ambicioso jogo de tiro baseado em StarCraft.

Há rumores de que a Nexon (The Finals, Arc Raiders), editora e desenvolvedora sul-coreana, esteja…

5 horas atrás