A empresa chinesa Z.ai publicou os pesos de seu modelo de IA GLM-5.3 na plataforma Hugging Face, mas abandonou a licença MIT. Provedores de serviços com faturamento superior a US$ 10 bilhões agora são obrigados a passar por verificação de segurança pelo desenvolvedor.

Fonte da imagem: Milad Fakurian / unsplash.com

Uma característica distintiva do modelo GLM-5.3 da Z.ai são seus mecanismos de pós-treinamento, que melhoraram significativamente seu desempenho em comparação com o GLM-5.2 e o colocaram em pé de igualdade com os principais modelos americanos. Ao mesmo tempo, o desenvolvedor alterou a licença: o GLM-5.2 era licenciado sob a licença padrão MIT, enquanto o GLM-5.3 utiliza uma licença especial. Empresas que desejam lançá-lo e que tenham receita superior a US$ 10 bilhões em qualquer período de 12 meses “devem passar pela análise de segurança da Z.ai antes de usar o software ou seus derivados para quaisquer fins comerciais”.

O endurecimento da licença do GLM-5.3 parece ser um afastamento significativo da prática estabelecida na China de maximizar a distribuição gratuita de modelos de IA de código aberto, mas não significa que a Z.ai a tenha abandonado. Para a maioria dos desenvolvedores, os termos permaneceram praticamente inalterados: o modelo ainda pode ser lançado, modificado, treinado e usado em produtos comerciais livremente. A restrição visa principalmente os maiores provedores de nuvem e IA, que desejariam lucrar com o GLM-5.3 oferecendo-o como um serviço independente. A Z.ai busca, portanto, equilibrar a ampla adoção de sua tecnologia com o controle sobre seu uso comercial por grandes empresas e os riscos de segurança associados.

O desenvolvedor precisou de um período de duas semanas entre o anúncio e a publicação das escalas abertas para avaliar sua segurança, embora as escalas do GLM-5.2 tenham sido lançadas no mesmo dia. O GLM-5.3 obteve 84,5% no teste CyberGym, o melhor resultado entre todos, enfatizou o desenvolvedor. A Z.ai o utilizou para analisar 269 projetos de código aberto, incluindo o kernel do Linux, e descobriu 2.436 vulnerabilidades.O modelo GLM-5.3 apresenta vulnerabilidades; no entanto, nem todos os resultados estão disponíveis publicamente. O GLM-5.3 possui uma arquitetura de Mistura de Especialistas, 753 bilhões de parâmetros, uma janela de contexto de 1 milhão de tokens e uma saída máxima de 128.000 tokens. Os pesos são fornecidos nos formatos BF16 e FP8; o modelo é executado usando vLLM, SGLang, Ktransformers e Hugging Face Transformers.

Executar o Z.ai GLM-5.3 em hardware de consumo será um desafio: mesmo com quantização de 2 bits e 86% de precisão, ele requer 245 GB de memória e, com quantização de 8 bits, requer 810 GB. O acesso ao modelo via API custa US$ 1,40 por 1 milhão de tokens de entrada e US$ 4,40 por 1 milhão de tokens de saída. A Z.ai também disponibilizou os pesos do modelo GLM-5.3-Flash, que estreou como o anônimo Ox Alpha. Está disponível por US$ 0,15/US$ 0,47, respectivamente, funciona em aceleradores de IA chineses e é licenciado sob a licença MIT tradicional.

Até agora, a abertura tem sido uma das principais vantagens competitivas dos desenvolvedores chineses de IA. DeepSeek, Alibaba, Moonshot AI e a própria Z.ai distribuíram os pesos de seus modelos de ponta, permitindo que empresas terceirizadas criem seus próprios produtos com base neles gratuitamente, expandindo rapidamente o ecossistema de IA chinês globalmente. A nova licença GLM-5.3 demonstra que, à medida que esses modelos se aproximam da vanguarda, os desenvolvedores começam a encontrar um equilíbrio entre abertura, segurança e a capacidade de lucrar com suas tecnologias.

By admin

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *