Os requisitos de hardware de grandes modelos de linguagem de IA são reduzidos pela metade a cada oito meses

Os grandes modelos de linguagem que alimentam os chatbots de IA estão avançando tão rapidamente que, em apenas oito meses, os recursos de hardware necessários para funcionar foram reduzidos pela metade – os próprios chips estão fazendo um progresso muito mais modesto.

Fonte da imagem: Gerd Altmann / pixabay.com

Existem duas maneiras de melhorar o desempenho dos sistemas de IA, observa Tamay Besiroglu, pesquisador do MIT: aumentar o tamanho de grandes modelos de linguagem, o que exigirá um aumento proporcional no poder de computação, embora o hardware de IA seja atualmente escasso; ou otimizar algoritmos subjacentes para fazer uso mais eficiente do hardware existente. Os atuais desenvolvedores de grandes modelos de linguagem parecem preferir a segunda abordagem.

Os cientistas analisaram o desempenho de 231 grandes modelos de linguagem desenvolvidos entre 2012 e 2023 e descobriram que a capacidade computacional necessária para executá-los caiu pela metade a cada oito meses, em média. Isto é significativamente mais rápido do que a Lei de Moore empírica, que afirma que o número de transistores num chip (uma medida do seu desempenho) duplica a cada 18 a 24 meses. Os investigadores observam que este aumento no desempenho dos sistemas de IA se deve em parte à otimização do código, embora isto não possa ser determinado com precisão porque os algoritmos de IA muitas vezes não podem ser analisados. O desenvolvimento de componentes de hardware, é claro, também desempenhou um papel importante.

A diferença nas taxas de desenvolvimento é um indicador da eficácia com que os desenvolvedores de grandes modelos de linguagem utilizam os recursos disponíveis. Não será possível otimizar algoritmos indefinidamente, acredita Besiroglou, e não está claro se esse ritmo de desenvolvimento continuará no longo prazo. Há também preocupações de que melhorar a eficiência dos modelos possa, pelo contrário, aumentar o consumo de energia da indústria de IA, pelo que é impossível focar apenas num aspecto e ignorar o resto, alertam os cientistas.

avalanche

Postagens recentes

A SkyDrive planeja lançar táxis voadores nos céus do Japão em 2028.

O pequeno setor de aviação elétrica atraiu um número significativo de startups, e a japonesa…

20 minutos atrás

O aplicativo oficial do Telegram para Apple Watch foi lançado.

Mais de dez anos após o lançamento da primeira versão do aplicativo Telegram para Apple…

56 minutos atrás

O mecanismo de busca Alice, do Yandex, praticamente parou de incluir links para sites que não estejam entre os dez primeiros resultados.

O serviço de resposta neural Alice, do Yandex, direciona, com maior frequência, para sites que…

56 minutos atrás

A Rivian iniciou as entregas do crossover elétrico R2, com preços a partir de US$ 58.000.

A startup americana de veículos elétricos Rivian seguiu os passos da Tesla, oferecendo inicialmente modelos…

56 minutos atrás

O sonho de voar até estrelas vizinhas em velas solares esbarrou nas duras leis da física.

A ideia mais viável para viajar a outras estrelas continua sendo uma vela solar que,…

1 hora atrás

“Fico feliz pelos meus tataranetos que viverão para ver o lançamento”: Kingdom Hearts 4 retorna do esquecimento com um novo trailer.

O ambicioso RPG de ação Kingdom Hearts 4, da desenvolvedora e publicadora japonesa Square Enix,…

2 horas atrás