OpenAI expandiu as opções de interação com ChatGPT. A nova versão do chatbot agora aceita não apenas texto, mas também imagens e comandos de voz como prompts. Para usuários comerciais, novos recursos estarão disponíveis nas próximas duas semanas, mas outros terão que esperar um pouco.

Fonte da imagem: The Verge

As conversas de voz com ChatGPT são um tanto semelhantes às conversas com qualquer assistente de voz, mas a OpenAI afirma que a qualidade das respostas é significativamente maior devido à tecnologia subjacente aprimorada. O usuário pressiona um botão e faz uma pergunta, o ChatGPT converte em texto e a alimenta em um modelo de linguagem maior, recebe a resposta, converte de volta em fala e fala a resposta em voz alta.

Os novos recursos do ChatGPT contam com o modelo maior de linguagem Whisper, que faz grande parte do trabalho de conversão de fala em texto e vice-versa. De acordo com a OpenAI, o novo modelo pode gerar “uma voz humana a partir de um texto e uma amostra de fala com alguns segundos de duração”. Existem atualmente cinco opções de voz ChatGPT disponíveis, mas a OpenAI vê muito mais potencial neste modelo.

A capacidade de criar uma voz sintetizada de qualquer pessoa com base em apenas alguns segundos de sua fala oferece um amplo campo de atividade para os cibercriminosos, admite a OpenAI no anúncio de novos recursos: “São novos riscos, como a capacidade dos invasores de personificar figuras públicas ou cometer fraude.” Segundo a empresa, o modelo não está disponível para uso generalizado por este motivo: a OpenAI planeja limitar o modelo a casos de uso específicos e acordos de parceria.

Já para fazer uma solicitação no ChatGPT por meio de uma imagem, basta o usuário tirar uma foto ou desenhar um item de seu interesse e enviar para o bot. Durante a comunicação, você pode usar instruções de texto ou voz para esclarecer sua solicitação ou limitar a área de pesquisa.

Obviamente, usar imagens como dicas do chatbot também tem seus problemas potenciais. Trata-se principalmente de uma consulta sobre a identidade de uma pessoa em uma foto, embora a OpenAI afirme que limitou a “capacidade do ChatGPT de analisar e fazer declarações diretas sobre as pessoas” por razões de precisão e privacidade.

Quase um ano após o lançamento inicial do ChatGPT, a OpenAI continua a ultrapassar os limites da aplicação e da utilização do seu chatbot, tentando evitar os problemas e deficiências a ele associados. Em particular, a empresa limita deliberadamente as capacidades dos seus novos modelos de IA. Mas esta abordagem não funcionará para sempre. À medida que mais pessoas usam o controle de voz e a pesquisa de imagens, e o ChatGPT se torna um assistente virtual multimodal e útil, manter a IA alinhada se tornará cada vez mais difícil.

avalanche

Postagens recentes

Prazos irreais, má gestão e medo de cancelamento: jornalistas revelam os problemas por trás do desenvolvimento do novo jogo Ghost Recon.

A direção da Ubisoft tem grandes expectativas para o próximo jogo principal da série de…

2 horas atrás

Crimson Desert continua a evoluir para um simulador de criação de gado – detalhes da atualização 1.11.00

As atualizações pós-lançamento transformaram gradualmente o jogo de ação e aventura de mundo aberto e…

3 horas atrás

O Facebook e o Instagram sofreram uma grande interrupção – os feeds não estão atualizando, vídeos e imagens não estão carregando.

Segundo fontes online, uma grande interrupção está afetando as plataformas de mídia social Facebook✴ e…

3 horas atrás

A SpaceX realizou o maior IPO da história, arrecadando US$ 75 bilhões e tornando Musk o primeiro trilionário.

As ações da SpaceX começaram a ser negociadas na Nasdaq New York Stock Exchange sob…

3 horas atrás

A BMW apresentou o conceito de carro esportivo elétrico Neue Klasse M.

A BMW apresentou um novo carro-conceito M Performance baseado na arquitetura da próxima geração da…

4 horas atrás

A DJI entrou com um processo contra a Insta360, acusando-a de roubo de tecnologia para sua câmera compacta de vlogs.

As operações da empresa chinesa DJI não se limitam à produção de quadricópteros com sistemas…

5 horas atrás