O presidente da OpenAI publicou uma imagem criada pelo GPT-4o – é muito impressionante

Esta semana, a OpenAI revelou seu modelo de inteligência artificial de próxima geração, GPT-4o. O “o” em seu nome significa Omni, o que implica que ele oferece suporte nativo a vários formatos de entrada – anteriormente, multimodalidade significava converter todos os formatos não textuais em texto. O presidente e cofundador da OpenAI, Greg Brockman, divulgou a imagem criada pelo GPT-4o pela primeira vez.

A mesma imagem gerada pelo GPT-4o. Fonte da imagem: twitter.com/gdb

Suportar texto, imagens e áudio como entrada significa que o modelo também é capaz de gerá-los. A imagem acima não é uma fotografia, mas sim uma criação do GPT-4o. Mostra um homem vestindo uma camiseta com o logotipo da OpenAI escrito em um quadro branco. Na parte superior há uma inscrição parcialmente apagada “Transferência entre modalidades”. O texto segue: “Suponha que modelemos P diretamente (texto, pixels, som) usando um único transformador autorregressivo. Quais são os prós e contras?

Se você olhar de perto, poderá ver alguns sinais de que a imagem foi criada pela IA. A prancha está pendurada em um ângulo não natural, outra está inexplicavelmente localizada embaixo dela, a mão do homem tem um formato estranho e a iluminação é irregular. Ao mesmo tempo, a capacidade da IA ​​de gerar longos fragmentos de texto coerente parece incrível – mesmo o DALL-E 3 dificilmente consegue lidar com isso. O gerador de imagens GPT-4o ainda não está disponível para o público em geral: usuários do ChatGPT com conexão. o modelo de próxima geração só pode gerar imagens com DALL -E 3. Mas o presidente da OpenAI, Greg Brockman, garante que a empresa está fazendo esforços significativos para abrir acesso total ao modelo de nova geração.

avalanche

Postagens recentes

O modelo de IA Claude descobriu uma vulnerabilidade e desenvolveu um exploit funcional para o FreeBSD.

O modelo de IA Claude, em conjunto com o pesquisador Nicholas Carlini, criou autonomamente dois…

58 minutos atrás

A Asus economizou na embalagem, fazendo com que monitores OLED de US$ 1.299 chegassem rachados.

O Asus ROG Swift OLED PG32UCDM Gen3 (PG32UCDM3) é um dos melhores e mais caros…

58 minutos atrás

Um entusiasta japonês conseguiu conectar um SSD M.2 ao console Switch 2 através do slot microSD Express.

Um modder japonês demonstrou um método funcional para conectar um SSD M.2 NVMe a um…

58 minutos atrás

O RPG de fantasia Songs of Glimmerwick leva você a um mundo onde a magia nasce da música — novo trailer, lançamento em 2026 e demo em breve.

A desenvolvedora americana Eastshade Studios (Eastshade) revelou o primeiro trailer inédito de seu jogo de…

1 hora atrás

As autoridades chinesas estão reprimindo os usuários da internet.

A Administração do Ciberespaço da China publicou um projeto de conjunto de regras que regulamentam…

1 hora atrás