O Alibaba revelou o primeiro modelo de IA aberto baseado na nova arquitetura Qwen3-Next — dez vezes mais rápido que seu antecessor direto, mas com um custo de desenvolvimento dez vezes menor. Em termos de qualidade e precisão de respostas, é comparável ao carro-chefe da geração anterior.

Fonte da imagem: qwen.ai

O Alibaba Qwen3-Next-80B-A3B, com 80 bilhões de parâmetros, exigiu cerca de dez vezes menos custos de treinamento em comparação com seu antecessor, o Qwen3-32B, mas o novo modelo executa algumas tarefas dez vezes mais rápido. Em termos de precisão e qualidade de resposta, ele funciona no mesmo nível do carro-chefe Qwen3-235B-A22B; os modelos de nova geração são otimizados para implantação e operação eficientes, mesmo em hardware de consumo, afirmou o Alibaba.

A empresa também apresentou uma versão de raciocínio do modelo na mesma arquitetura. O Alibaba Qwen3-Next-80B-A3B-Thinking superou seu antecessor, o Qwen3-32B-Thinking, e o Google Gemini-2.5-Flash-Thinking, em vários parâmetros, afirmou o desenvolvedor, citando testes de terceiros.

A empresa aprimorou a eficiência do novo modelo combinando diversas técnicas, incluindo um mecanismo de “atenção híbrida”, que ajudou a simplificar o processamento de dados de texto de entrada, e uma arquitetura de “mistura altamente esparsa de especialistas” (MoE), que envolve a divisão do modelo em sub-redes especializadas em diferentes subconjuntos de dados de entrada para resolver problemas em conjunto. Outra inovação foi a estratégia de “previsão multitoken”, bem como uma série de medidas destinadas a aumentar a estabilidade do modelo durante o processo de treinamento.

O modelo Qwen3-Next-80B-A3B já está disponível na infraestrutura do Alibaba Cloud para uso via API; ele também pode ser usado nas plataformas Hugging Face e ModelScope.

admin

Postagens recentes

O GitHub zombou da Sony e pediu aos desenvolvedores que enviassem seus repositórios em CDs.

Menos de dois dias após a divisão PlayStation da Sony anunciar que deixaria de dar…

1 hora atrás

A Roboruka iniciou o transporte de alimentos na fábrica da Yandex Lavka em São Petersburgo.

A unidade de São Petersburgo do serviço Yandex Lavka lançou um braço robótico, o "Roboruka".…

1 hora atrás

Lacunas antrópico-fechadas que permitiram às empresas chinesas usar Claude

A Anthropic intensificou os esforços para impedir o acesso não autorizado aos seus modelos de…

1 hora atrás

A Cloudflare declarou guerra aos bots de IA – eles agora serão bloqueados por padrão.

A Cloudflare anunciou planos para bloquear automaticamente bots web de propósito misto que indexam sites…

3 horas atrás

Nos vemos em agosto: Starship aciona todos os seis motores em preparação para seu 13º voo de teste.

No centro de testes Starbase, no Texas, a SpaceX realizou um teste estático de ignição…

3 horas atrás