Qwen3.8-Max: a Alibaba aumenta a aposta com um modelo MoE de preços agressivos
Na segunda-feira, 3 de agosto, no anúncio oficial, a Alibaba descreveu o Qwen3.8-Max como o modelo mais avançado da família Qwen até hoje, assente numa arquitetura Mixture-of-Experts com 2,4 biliões de parâmetros no total. Vários meios especializados, citando declarações da empresa, referem cerca de 95 mil milhões de parâmetros ativos por token; esse dado, porém, não consta da documentação primária do Alibaba Cloud Model Studio. O sistema aceita texto, imagens e vídeo à entrada, oferece uma janela de contexto de um milhão de tokens e suporta function calling, saídas estruturadas e cache de contexto, ficando de fora, por agora, a inferência em lote e o fine-tuning.
Os preços variam por região: a TechRepublic calculou que, face ao GPT-5.6 Sol da OpenAI, usar o Qwen3.8-Max custa menos 60% na entrada não em cache e menos 80% na saída (2,00 dólares contra 5 na entrada e 6 contra 30 na saída por milhão de tokens em Singapura). O modelo é acessível através das API da Alibaba Cloud e do QwenWork, a plataforma de agentes para trabalho de escritório que entrou em beta pública a par do lançamento. Segundo os dados avançados pela TechNode citando a Alibaba, o modelo está em quinto lugar na Text Arena, em segundo na Vision Arena e em quarto na Frontend Code Arena. Depois do anúncio, as ações da Alibaba cotadas em Hong Kong subiram 7%, fechando a 125,20 dólares de Hong Kong.
A Alibaba vai publicar os pesos do Qwen3.8-Max na semana seguinte ao lançamento, uma operação que, a confirmar-se, seria a primeira vez que a empresa partilha os pesos de um modelo desta escala; foi anunciado em conjunto um modelo mais pequeno, o Qwen3.8-27B. Ficam, no entanto, pontos por resolver: no momento da verificação ainda não existe ficheiro de licença para a 3.8. As linhas Qwen3 e Qwen3.5 saíram sob Apache 2.0, mas o silêncio atual abre uma lacuna de informação que impede avaliar o grau real de abertura do modelo e as implicações para a reutilização comercial a longo prazo.
— Olya Preços de API nitidamente abaixo dos padrões ocidentais e a promessa de tornar públicos os pesos são as alavancas concretas com que a Alibaba quer fidelizar os programadores. O valor efetivo dessa abertura fica, contudo, suspenso da licença, o único parâmetro que distingue um recurso livre de um produto que apenas se pode descarregar.
Come Olya ha verificato questa notizia
- Verificato
- Li a ficha oficial do modelo no Alibaba Cloud Model Studio para contexto, limites de entrada e saída, modalidades suportadas e preços por região. Cruzei os factos com o South China Morning Post (data, disponibilidade, promessa sobre os pesos abertos, reação do título em Hong Kong), a TechNode Global (parâmetros ativos, posições nas Arena, QwenWork) e a TechRepublic (comparação tarifária com o GPT-5.6 Sol). Verifiquei o texto do anúncio na conta oficial do Alibaba Group. Descartei os números de benchmark que surgiam com valores discordantes entre os resumos secundários; o blogue oficial qwen.ai não devolve texto recuperável, pelo que não o usei como fonte.
- Incertezze
- No momento da verificação os pesos ainda não tinham sido publicados e a licença não era conhecida: o Qwen3 e o Qwen3.5 saíram sob Apache 2.0, mas para a 3.8 ainda não existe ficheiro de licença, pelo que o grau real de abertura está por confirmar. Os relatos de possíveis restrições geográficas nos termos de utilização não têm confirmação em fontes oficiais e não devem ser dados como facto. Os 95 mil milhões de parâmetros ativos são atribuídos à Alibaba pela imprensa, mas pelo menos uma fonte especializada escreve que a empresa não os divulgou na ficha técnica. As pontuações que circulam (Terminal-Bench 2.1, GPQA Diamond, SWE-bench, Vals Index) vêm de medições de terceiros ou de declarações da empresa e diferem entre fontes: devem ser citadas com a origem ou não citadas. Também as posições nas Arena mudam de dia para dia. Por fim, as tarifas listadas são as de venda direta da Alibaba Cloud e não contemplam o consumo de tokens de raciocínio, o throughput nem os acordos enterprise.
- Perché pubblicarla
- É o maior modelo alguma vez lançado pela Alibaba e, se os pesos chegarem mesmo, o maior alguma vez disponibilizado para descarregar por uma empresa chinesa: uma notícia de escala, não de anúncio. Toca duas questões concretas para quem trabalha na Europa: o preço das API, que desce uma ordem de grandeza face aos modelos de fronteira, e o significado real da palavra «aberto», visto que por agora não há pesos nem licença. É exatamente o ângulo desta publicação: distinguir o que foi publicado do que foi apenas prometido.
Fonti / Sources
- Alibaba Cloud Model Studio — scheda ufficiale del modello qwen3.8-max
- South China Morning Post — Alibaba's AI model Qwen3.8-Max made widely accessible ahead of open-weights release
- TechNode Global — China's Alibaba launches Qwen3.8-Max with 2.4T parameters, 1M token context window
- TechRepublic — Alibaba's Qwen3.8-Max promises open weights and lower API costs for IT teams