Categorias: Mercado de tecnologia e TI. notícia

A Cerebras Systems estabeleceu um recorde em aprendizado de máquina para sistemas únicos

O sucesso da Cerebras Systems com seus descendentes incomuns, processadores Cerebras supergrandes que ocupam todo um substrato de silício, é no mínimo interessante de se observar. Seus sistemas são incomuns, mas no campo de aprendizado de máquina eles parecem não ter igual – uma única plataforma Cerebras CS-2 pode substituir quase um cluster inteiro ao treinar um modelo grande. E a empresa provou isso por ação, estabelecendo um novo recorde.

A essência do registro é que o maior modelo de IA do mundo já treinado em um único dispositivo foi treinado no Cerebras CS-2 (sistemas de cluster não contam). É claro que a “singleness” do CS-2 é um tanto arbitrária, mas ainda pode ser considerada como tal, pois um gabinete de equipamento CS-2 contém exatamente um chip WSE-2 e o complexo HPE Superdome Flex, que “alimenta” dados a ele, é considerado auxiliar.

Características comparativas de WSE-1 e WSE-2. Fonte: Cerebras Systems

Estamos falando de treinar um modelo com 20 bilhões de parâmetros, o que nenhum outro sistema no mundo pode fazer. Ao abrir o acesso ao treinamento de redes neurais tão complexas, o Cerebras está atendendo pesquisadores de máquinas de linguagem natural, pois o tempo de treinamento para um modelo sério pode ser reduzido de meses para minutos, eliminando a necessidade de particionamento demorado do modelo entre os nós de um sistema de cluster tradicional – tudo isso é executado no modo “monolítico”.

Projeto do CS-2 e alguns de seus parâmetros técnicos. Fonte: Cerebras Systems

Além disso, modelos desse tamanho exigem muito dinheiro – nem todo pesquisador tem orçamento suficiente para alugar um cluster. Mas o CS-2 democratizará até modelos enormes como GPT-3 1.3B, GPT-J 6B, GPT-3 13B e GPT-NeoX 20B. Seu lançamento tornou-se possível com a última atualização do software proprietário Cerebras Software Platform. Os geneticistas da GSK também estão entusiasmados com a nova oportunidade, usando enormes conjuntos de dados.

Lembre-se que o coração do CS-2, o processador WSE-2, é legitimamente considerado o maior do mundo – contém 850 mil núcleos otimizados para tarefas específicas de aprendizado de máquina. Para “alimentar” esse neuroprocessador com dados e eliminar o tempo de inatividade, são usados 12 canais de uma só vez a uma velocidade de 100 Gb / s. Um superservidor HPE Superdome Flex 280 separado é responsável pelo fornecimento de dados, que por si só tem características muito impressionantes.

avalanche

Próximo Enorme simulador de caça em mundo aberto Way of the Hunter está chegando ao PC e consoles em 16 de agosto »

Anterior « Jogo de tiro cooperativo Deep Rock Galactic atinge novo pico de vendas

Deixar comentário

Publicado por

avalanche

4 anos atrás

Postagens recentes

Desenvolvimento e fabricação de eletrônicos

A AMD vai abandonar a arquitetura IDT, que é obsoleta e lenta — os futuros processadores Ryzen e Epyc receberão a tecnologia FRED, desenvolvida pela Intel.

A AMD publicou documentação técnica em seu site, revelando uma das principais características de suas…

28 minutos atrás

Comentários sobre eventos recentes

A Microsoft substitui seu chefe de segurança após uma repreensão das autoridades americanas.

A Microsoft nomeou Hayete Gallot como a nova chefe de sua divisão de segurança. Ela…

1 hora atrás

Jogos

Novo Capítulo, Nome Antigo: Blizzard Anuncia Reboot de Overwatch 2

Conforme prometido, em 4 de fevereiro, durante a transmissão do Overwatch Spotlight, os desenvolvedores da…

2 horas atrás

Jogos

Assassinatos cometidos por bêbados, maçãs comidas e atos de misericórdia: os desenvolvedores de Kingdom Come: Deliverance 2 revelaram as estatísticas de jogadores referentes ao ano desde o lançamento do jogo.

Hoje, 4 de fevereiro, o RPG de ação medieval em mundo aberto Kingdom Come: Deliverance…

3 horas atrás

Telefones celulares, smartphones, comunicações celulares, comunicadores, PDAs

O lançamento do Pixel 10a do Google foi um tanto quanto uma jogada de marketing, sem preço ou especificações divulgadas, mas com uma data de pré-venda.

O Google lançou um breve vídeo sobre seu próximo smartphone de gama média, o Pixel…