O rei do acelerador Cerebras WSE-3 treinou sozinho um modelo de IA com 1 trilhão de parâmetros

A Cerebras Systems, em colaboração com o Departamento de Energia dos EUA (DOE) Sandia National Laboratories (SNL), conduziu um experimento bem-sucedido para treinar um modelo de IA com 1 trilhão de parâmetros usando um único sistema CS-3 com um acelerador czar WSE-3 e 55 TB de memória externa MemoryX.

Modelos de treinamento dessa escala normalmente requerem milhares de aceleradores baseados em GPU que consomem megawatts de energia, dezenas de especialistas e semanas de ajustes de hardware e software, diz Cerebras. No entanto, os cientistas do SNL conseguiram treinar o modelo em um único sistema sem fazer alterações no modelo ou no software de infraestrutura. Além disso, eles conseguiram atingir uma escala quase linear – 16 sistemas CS-3 mostraram um aumento de 15,3 vezes na velocidade de aprendizagem.

Fonte da imagem: Cerebras

Um modelo desta escala requer terabytes de memória, milhares de vezes mais do que está disponível em uma única GPU. Em outras palavras, clusters clássicos de milhares de aceleradores devem estar corretamente conectados entre si antes do início do treinamento. Os sistemas Cerebras para armazenamento de balanças usam memória MemoryX externa baseada em nós de 1U com o DDR5 mais comum, tornando tão fácil treinar um modelo com um trilhão de parâmetros quanto um modelo pequeno em um único acelerador, diz a empresa.

Anteriormente, o SNL e a Cerebras implantaram o cluster Kingfisher baseado em sistemas CS-3, que será utilizado como plataforma de teste para o desenvolvimento de tecnologias de IA para garantir a segurança nacional.

avalanche

Postagens recentes

Uma versão reforçada do cão robô chinês Lynx M20S escalou encostas de montanhas em temperaturas de -30 graus.

A empresa chinesa DEEP Robotics demonstrou a incrível resistência e capacidade de transposição de terrenos…

3 horas atrás

O aclamado simulador de sobrevivência DayZ ganhará uma sequência – a Bohemia Interactive anunciou oficialmente DayZ 2.

Os desenvolvedores do estúdio tcheco Bohemia Interactive confirmaram o desenvolvimento de uma sequência para o…

5 horas atrás

Em busca de férmions de Majorana: cientistas questionam novamente a tecnologia de computação quântica da Microsoft.

Uma nova crítica publicada na revista científica Nature levanta questões sobre o avanço da computação…

6 horas atrás

A Zoox atualizou seu serviço de robotáxis, com o lançamento do transporte público pago previsto para o final do ano.

A Zoox, empresa pertencente à Amazon, atualizou o design de seu robotáxi especializado. A Zoox…

8 horas atrás

Warhammer 40.000: Rogue Trader atingiu um novo pico de vendas e chegará ao formato físico pela primeira vez.

Após o fracasso do Owlcat Launcher, a Owlcat Games anunciou o sucesso de seu jogo…

8 horas atrás

O Telescópio Espacial James Webb ajudou a desvendar o mistério de um estranho planeta rosa localizado a 57 anos-luz da Terra.

O planeta GJ504b orbita uma estrela semelhante ao Sol a aproximadamente 57 anos-luz da Terra…

9 horas atrás