O presidente da OpenAI publicou uma imagem criada pelo GPT-4o – é muito impressionante

Esta semana, a OpenAI revelou seu modelo de inteligência artificial de próxima geração, GPT-4o. O “o” em seu nome significa Omni, o que implica que ele oferece suporte nativo a vários formatos de entrada – anteriormente, multimodalidade significava converter todos os formatos não textuais em texto. O presidente e cofundador da OpenAI, Greg Brockman, divulgou a imagem criada pelo GPT-4o pela primeira vez.

A mesma imagem gerada pelo GPT-4o. Fonte da imagem: twitter.com/gdb

Suportar texto, imagens e áudio como entrada significa que o modelo também é capaz de gerá-los. A imagem acima não é uma fotografia, mas sim uma criação do GPT-4o. Mostra um homem vestindo uma camiseta com o logotipo da OpenAI escrito em um quadro branco. Na parte superior há uma inscrição parcialmente apagada “Transferência entre modalidades”. O texto segue: “Suponha que modelemos P diretamente (texto, pixels, som) usando um único transformador autorregressivo. Quais são os prós e contras?

Se você olhar de perto, poderá ver alguns sinais de que a imagem foi criada pela IA. A prancha está pendurada em um ângulo não natural, outra está inexplicavelmente localizada embaixo dela, a mão do homem tem um formato estranho e a iluminação é irregular. Ao mesmo tempo, a capacidade da IA ​​de gerar longos fragmentos de texto coerente parece incrível – mesmo o DALL-E 3 dificilmente consegue lidar com isso. O gerador de imagens GPT-4o ainda não está disponível para o público em geral: usuários do ChatGPT com conexão. o modelo de próxima geração só pode gerar imagens com DALL -E 3. Mas o presidente da OpenAI, Greg Brockman, garante que a empresa está fazendo esforços significativos para abrir acesso total ao modelo de nova geração.

avalanche

Postagens recentes

Cansado de esperar: vendas de S.T.A.L.K.E.R. 2: Heart of Chornobyl ultrapassou um milhão de cópias dois dias após o lançamento

O jogo de tiro pós-apocalíptico de mundo aberto S.T.A.L.K.E.R. 2: Heart of Chornobyl dos desenvolvedores…

34 minutos atrás

TSMC começará a produzir chips de 1,6 nm em dois anos

Os planos da TSMC para os próximos anos permanecem praticamente inalterados - no final de…

34 minutos atrás

O YouTube adicionou o recurso Dream Screen aos Shorts – um gerador de fundo de IA para vídeos

A administração do YouTube anunciou que o recurso Dream Screen atualizado agora está disponível na…

44 minutos atrás

PCs com IA reduzem a produtividade do usuário – as pessoas não sabem como se comunicar adequadamente com IA

Usuários de PCs com sistemas de inteligência artificial demonstram menor produtividade em comparação com aqueles…

44 minutos atrás