Categorias: Inteligência Artificial, Aprendizado de Máquina, Redes NeuraisMercado de tecnologia e TI. notícia

A OpenAI só pode invejar: treinar o modelo de IA chinês DeepSeek R1 custou apenas US$ 294.000.

A empresa chinesa DeepSeek informou que gastou US$ 294.000 treinando seu modelo de inteligência artificial R1, significativamente menos do que seus concorrentes americanos. A informação foi publicada na revista acadêmica Nature. Analistas esperam que a publicação renove as discussões sobre o lugar da China na corrida pelo desenvolvimento da inteligência artificial.

Fonte da imagem: DeepSeek

O lançamento de sistemas de IA de custo relativamente baixo pela DeepSeek em janeiro levou investidores globais a se desfazerem de ações de tecnologia, temendo uma queda nos preços. Desde então, a DeepSeek e seu fundador, Liang Wenfeng, praticamente desapareceram da vista do público, exceto por alguns anúncios de atualizações de produtos. Ontem, a revista Nature publicou um artigo coautorado por Liang. O artigo divulgou oficialmente pela primeira vez o custo do treinamento do modelo R1, bem como o modelo e o número de aceleradores de IA utilizados.

O custo do treinamento de grandes modelos de linguagem, que sustentam os chatbots de IA, refere-se aos custos associados ao uso de sistemas computacionais poderosos por semanas ou meses para processar grandes volumes de texto e código.

O artigo afirma que o treinamento do modelo de raciocínio R1 custou US$ 294.000 e exigiu 512 aceleradores Nvidia H800. Sam Altman, chefe da OpenAI, líder americana em IA, afirmou em 2023 que o treinamento de um modelo base custava “bem mais” de US$ 100 milhões, embora a empresa não tenha fornecido uma análise detalhada desses custos. Se compararmos esses números diretamente, a diferença nos custos de treinamento de modelos de IA é de 340 vezes!

Algumas das alegações da DeepSeek sobre os custos de desenvolvimento e as tecnologias utilizadas foram questionadas por empresas e autoridades americanas. Os aceleradores H800 foram desenvolvidos pela Nvidia para o mercado chinês depois que os EUA proibiram a empresa de exportar suas soluções H100 e A100 mais potentes para a China em outubro de 2022. Em junho, as autoridadesOs EUA alegaram que a DeepSeek tinha acesso a “grandes volumes” de dispositivos H100 adquiridos após a introdução dos controles de exportação. A Nvidia refutou essa alegação, afirmando que a DeepSeek utilizou chips H800 adquiridos legalmente, e não H100s.

Agora, em um documento informativo suplementar que acompanha o artigo da Nature, a DeepSeek reconheceu a posse de aceleradores A100 e relatou tê-los utilizado em estágios preparatórios de desenvolvimento. “Para o nosso estudo DeepSeek-R1, usamos GPUs A100 para nos prepararmos para experimentos com um modelo menor”, escreveram os pesquisadores. Após essa fase inicial de treinamento, o modelo R1 foi treinado por um total de 80 horas em um cluster de 512 aceleradores H800.

A Reuters relatou anteriormente que um dos motivos pelos quais a DeepSeek conseguiu atrair os melhores talentos em IA foi o fato de ser uma das poucas empresas chinesas a operar o cluster de supercomputadores A100.

admin

Próximo A Corsair revelou um mouse gamer ultraleve, pesando 36 gramas e com até 70 horas de duração de bateria. »

Anterior « Os fones de ouvido Nothing Ear (3) TWS receberam um design atualizado e um case com sistema de microfone Super Mic.

Deixar comentário

Publicado por

admin

10 meses atrás

Postagens recentes

Programas

O criador do WinRAR explicou por que o arquivador não obrigou você a comprar uma licença por 30 anos

\nHá mais de 30 anos, o arquivador WinRAR trabalha em um modelo de pagamento voluntário.…

60 minutos atrás

Vírus, cavalos de Troia, vulnerabilidades de software, problemas de segurança

Descobriu-se que a Microsoft pode rastrear todos os dispositivos Windows – um identificador exclusivo ajudou o FBI a identificar o hacker

\nUsando um GDID criado pela Microsoft, os investigadores do FBI conseguiram vincular o adolescente a…

1 hora atrás

Jogos

Uma fonte revelou o que esperar do remake de Splinter Cell – uma reimaginação do icônico jogo de ação furtiva da Ubisoft em um “estado extremamente frágil”

\nAnunciado em dezembro de 2021, o ambicioso remake do icônico jogo de ação furtiva Tom…

2 horas atrás

Jogos

O Xbox esperava atingir 77 milhões de assinantes do Game Pass até 2026, mas falhou miseravelmente

\nA Microsoft não informa o número de assinantes do seu serviço de jogos Game Pass…

2 horas atrás

Notícias da rede

Apple e Epic Games convenceram o tribunal a suspender o processo na App Store

\nNo início do mês, soube-se que a Apple e a Epic Games entraram com uma…

3 horas atrás

Servidores, clusters, supercomputadores, computadores industriais e multiprocessadores

As empresas chinesas estão dispostas a gastar até metade do seu orçamento na compra de chips de IA para produtos de fornecedores locais

\nInformações sobre a promoção ativa de aceleradores de IA chineses no mercado interno apareceram mais…