O Alibaba revelou o primeiro modelo de IA aberto baseado na nova arquitetura Qwen3-Next — dez vezes mais rápido que seu antecessor direto, mas com um custo de desenvolvimento dez vezes menor. Em termos de qualidade e precisão de respostas, é comparável ao carro-chefe da geração anterior.

Fonte da imagem: qwen.ai

O Alibaba Qwen3-Next-80B-A3B, com 80 bilhões de parâmetros, exigiu cerca de dez vezes menos custos de treinamento em comparação com seu antecessor, o Qwen3-32B, mas o novo modelo executa algumas tarefas dez vezes mais rápido. Em termos de precisão e qualidade de resposta, ele funciona no mesmo nível do carro-chefe Qwen3-235B-A22B; os modelos de nova geração são otimizados para implantação e operação eficientes, mesmo em hardware de consumo, afirmou o Alibaba.

A empresa também apresentou uma versão de raciocínio do modelo na mesma arquitetura. O Alibaba Qwen3-Next-80B-A3B-Thinking superou seu antecessor, o Qwen3-32B-Thinking, e o Google Gemini-2.5-Flash-Thinking, em vários parâmetros, afirmou o desenvolvedor, citando testes de terceiros.

A empresa aprimorou a eficiência do novo modelo combinando diversas técnicas, incluindo um mecanismo de “atenção híbrida”, que ajudou a simplificar o processamento de dados de texto de entrada, e uma arquitetura de “mistura altamente esparsa de especialistas” (MoE), que envolve a divisão do modelo em sub-redes especializadas em diferentes subconjuntos de dados de entrada para resolver problemas em conjunto. Outra inovação foi a estratégia de “previsão multitoken”, bem como uma série de medidas destinadas a aumentar a estabilidade do modelo durante o processo de treinamento.

O modelo Qwen3-Next-80B-A3B já está disponível na infraestrutura do Alibaba Cloud para uso via API; ele também pode ser usado nas plataformas Hugging Face e ModelScope.

admin

Postagens recentes

A mineradora de criptomoedas Riot Platforms mudará seu perfil e alugará 25 MW de capacidade de data center para a AMD.

A empresa de mineração de criptomoedas Riot Platforms (anteriormente Riot Blockchain) é a mais recente…

44 minutos atrás

A Sony transferiu o controle de sua divisão de TVs Bravia para a empresa chinesa TCL.

A Sony e a TCL assinaram um acordo não vinculativo para criar uma joint venture…

44 minutos atrás

A China devolveu à Terra a espaçonave Shenzhou-20 com uma rachadura em sua vigia.

A espaçonave chinesa Shenzhou-20 retornou à Terra em segurança em 19 de janeiro de 2026,…

1 hora atrás

Antrópico: Os chatbots de IA podem mudar suas personalidades, e isso pode ser perigoso.

Segundo um estudo publicado pela Anthropic, os chatbots de IA sofrem mudanças drásticas de personalidade…

1 hora atrás

“O trabalho vai avançar rapidamente”: a Riot contratou um dos principais produtores de World of Warcraft para criar um MMO baseado em League of Legends.

Confirmado há mais de cinco anos, o promissor MMO ambientado no universo de League of…

2 horas atrás