ChatGPT ganhou visão – o bot aprendeu a entender as transmissões de vídeo da câmera e da tela de um smartphone

A OpenAI anunciou que o chatbot ChatGPT, alimentado por inteligência generativa, tem a capacidade de processar um stream de vídeo e conversar com os usuários sobre o que está “observando” usando um smartphone ou câmera de computador, ou o que vê na tela do dispositivo. O novo recurso está disponível no Modo de Voz Avançado.

Fonte da imagem: OpenAI

A empresa anunciou que o ChatGPT receberá uma função de visão computacional que permite “ver” pela câmera do smartphone do usuário ou por meio de transmissão de tela. Proprietários de assinaturas pagas ChatGPT Plus, Team e Pro agora têm acesso ao ChatGPT Enhanced Voice com reconhecimento de vídeo. A empresa afirma que os assinantes do ChatGPT Enterprise e Edu não receberão o recurso até janeiro e que não há cronograma para seu lançamento na UE, Suíça, Islândia, Noruega e Liechtenstein.

Em uma demonstração recente no programa 60 Minutes da CNN, o presidente da OpenAI, Greg Brockman, testou um modo de voz avançado com reconhecimento visual com o apresentador de TV Anderson Cooper sobre as habilidades anatômicas do chatbot. Quando Cooper desenhou partes do corpo no quadro, ChatGPT “entendeu” o que ele estava desenhando. Ao mesmo tempo, o ChatGPT cometeu um erro em uma tarefa de geometria neste modo, o que indica sua tendência a alucinar.

Desde seu anúncio em maio, a empresa atrasou diversas vezes o lançamento de um modo de voz aprimorado com reconhecimento visual. Em abril, a OpenAI prometeu que o modo estaria disponível para os usuários “dentro de algumas semanas”, mas admitiu meses depois que demoraria mais do que o planejado. E quando o Enhanced Voice foi lançado para alguns usuários em setembro, ele não tinha funcionalidade de visão computacional.

Google e Meta✴ também estão trabalhando em recursos semelhantes para seus chatbots. Esta semana, o Google disponibilizou seu recurso de IA de análise de vídeo em tempo real, Projeto Astra, para um grupo de “testadores confiáveis” na plataforma Android.

avalanche

Postagens recentes

A AMD apresentou o Ryzen AI Pro 400 para dispositivos móveis, destinado a laptops empresariais e estações de trabalho móveis.

Além dos processadores para desktop Ryzen AI 400 e Ryzen AI Pro 400 para a…

18 minutos atrás

AMD revela o Ryzen AI 400 para Socket AM5 — até 8 núcleos Zen 5, gráficos RDNA 3.5 e uma NPU de 50 TOPS.

Na MWC 2026, a AMD confirmou o lançamento dos processadores para desktops Ryzen AI 400…

45 minutos atrás

NVIDIA, Ericsson, Nokia e parceiros irão impulsionar o 6G utilizando IA e plataformas abertas.

A NVIDIA anunciou sua intenção de trabalhar com parceiros para desenvolver redes móveis 6G utilizando…

1 hora atrás

Investigadores descobriram que contrabandistas compravam abertamente aceleradores de IA da Nvidia nos EUA para entrega na China.

Até recentemente, acreditava-se que países terceiros desempenhavam um papel fundamental no contrabando de aceleradores de…

1 hora atrás

Uma disputa de marca registrada obrigou a Take-Two a atualizar seus números de vendas de GTA: Vice City Stories pela primeira vez em 18 anos.

A Take-Two Interactive, editora da franquia, divulga regularmente os números de vendas dos jogos GTA,…

2 horas atrás