A empresa chinesa DeepSeek demonstrou inicialmente um sucesso impressionante no treinamento de seus modelos de linguagem usando recursos computacionais limitados, mas as sanções dos EUA a impediram de avançar em um ritmo constante. Como observa o Financial Times, a empresa teve que adiar o lançamento de um novo modelo de linguagem devido à baixa eficiência dos aceleradores de computação da Huawei que utilizava.

Fonte da imagem: Huawei Technologies

Após o lançamento do modelo de linguagem R1 com grande sucesso em janeiro deste ano, a empresa chinesa recebeu recomendações das autoridades locais para migrar para os aceleradores Huawei Ascend. Como se sabe, muitos desenvolvedores de IA chineses enfrentam tais recomendações e, há algum tempo, são obrigados a apresentar justificativas sólidas para continuar comprando os aceleradores Nvidia.

A DeepSeek encontrou problemas técnicos ao utilizar aceleradores da Huawei para treinar seus modelos de linguagem e, como resultado, optou por reorientá-los para o trabalho de inferência e continuar o treinamento usando aceleradores da Nvidia. O lançamento do modelo de linguagem R2 estava originalmente previsto para maio, mas a estreia teve que ser adiada devido a esses problemas. Esse atraso afetou negativamente a posição competitiva da DeepSeek.

Os representantes da Huawei estavam cientes dos problemas do DeepSeek e, portanto, enviaram uma equipe de especialistas para auxiliar os desenvolvedores. No entanto, não houve progresso no treinamento do modelo R2 nos chips da Huawei. Mesmo a adaptação dos chips desta marca para trabalhar com a formação de conclusões lógicas (inferências) ainda não foi concluída. A gerência do DeepSeek acredita que o progresso atual no desenvolvimento do R2 é insuficiente e, portanto, levará mais tempo para que o modelo seja implementado. No entanto, algumas fontes esperam que o R2 seja lançado em breve.

Os concorrentes não estão dormindo; o próprio Alibaba tentou adotar as principais soluções conceituais do DeepSeek em seu modelo Qwen3, mas tornou seu desenvolvimento mais eficiente. Especialistas esperam que modelos de linguagem bem-sucedidos treinados em chips da Huawei ainda apareçam com o tempo.

admin

Postagens recentes

A Microsoft anunciou uma grande apresentação de jogos, o Xbox Games Showcase 2026, e a primeira revelação de Gears of War: E-Day em dois anos.

A Microsoft, empresa americana detentora da plataforma, confirmou oficialmente a próxima apresentação de jogos da…

43 minutos atrás

As autoridades russas planejam punir os usuários de VPN, inicialmente com sanções financeiras.

Em 28 de março, o chefe do Ministério do Desenvolvimento Digital, Maksut Shadayev, realizou reuniões…

1 hora atrás

A Microsoft recolheu a atualização mais recente do Windows 11 devido a arquivos ausentes ou corrompidos.

A insistência da Microsoft em incorporar IA em todos os seus produtos está colocando o…

1 hora atrás

A Microsoft vai melhorar significativamente a busca no Windows 11 após anos de reclamações.

A Microsoft confirmou um extenso trabalho de aprimoramento da Busca do Windows, após anos de…

1 hora atrás

O ponto de virada do ChatGPT em robôs humanoides ainda está a até 10 anos de distância.

Embora especialistas debatam a validade do termo "inteligência artificial", poucos duvidam do impacto significativo que…

2 horas atrás