Alibaba lança preview do Qwen 3.8-Max com 2,4 trilhões de parâmetros e mira segundo lugar atrás de Fable 5

No WAIC de Shanghai, Alibaba respondeu ao Kimi K3 da Moonshot com um preview vendido a 10% do preço padrão. Sem model card, sem parâmetros ativos divulgados.
A Alibaba apresentou no dia 19 de julho, no palco do World AI Conference (WAIC) em Shanghai, o Qwen 3.8-Max-Preview. O modelo tem 2,4 trilhões de parâmetros totais em arquitetura sparse Mixture-of-Experts e é o primeiro sistema multimodal do time acima de 1 trilhão, capaz de processar texto, imagem, vídeo e documentos. Segundo Shuai Bai, desenvolvedor do Qwen, o novo flagship é "second only to Fable 5" entre os modelos que a equipe usou como referência, colocando o produto do grupo chinês à frente de OpenAI GPT-5.6 Sol e do próprio Kimi K3, lançado por rival local três dias antes.
O preview está disponível pela subscrição Token Plan, no Qoder e no QoderWork a 10% do preço padrão, e a Alibaba prometeu release open-weight "em breve", sem cravar data. O que a companhia não publicou é tão relevante quanto o que anunciou: não há benchmark table, model card ou licença; e o número de parâmetros ativos por token, dado que define o custo real de servir um MoE esparso, ficou de fora do comunicado. Sem esse número, a comparação com Fable 5 e GPT-5.6 fica no plano do marketing, não da engenharia de custo.
Preview em resposta ao Kimi K3
O timing não é acidental. Em 16 de julho, a Moonshot AI abriu os pesos do Kimi K3, um modelo de 2,8 trilhões de parâmetros que, em benchmarks independentes citados por Simon Willison e pela Bloomberg, ficou em quarto lugar entre modelos de fronteira, atrás apenas de Claude Fable 5, GPT-5.6 Sol e superando o próprio Opus 4.8 da Anthropic. Kimi K3 já roda com contexto de 1 milhão de tokens a US$ 3 por milhão de entrada e US$ 15 de saída, faixa idêntica à do Fable 5. Alibaba precisou responder antes que a narrativa se firmasse.
A Bloomberg apurou que a ação da Alibaba subiu até 5,4% em Hong Kong após o anúncio, refletindo a leitura de que a companhia mantém a corrida com Moonshot, DeepSeek e ByteDance. A DeepSeek entrou no palco há três semanas com o V4, que introduziu preço de pico, cobrando o dobro em horário comercial de Pequim. O Qwen 3.8-Max, ao contrário, veio pelo caminho oposto, oferecendo desconto de 90% na fase de preview para forçar adoção.
Onde a comparação com Fable 5 deve ser lida com reserva
O Fable 5, lançado pela Anthropic em 9 de junho, tem números públicos: 95,5% em SWE-Bench Verified, 80,3% em SWE-Bench Pro e Elo 1649 na WebDev Arena. A Alibaba não publicou os equivalentes do Qwen 3.8-Max e apenas afirma que o novo modelo bate o Qwen 3.7-Max em codificação, desenvolvimento full-stack, análise de dados e workflows de escritório. Enquanto o cartão do modelo não sair, a alegação "segundo apenas ao Fable 5" permanece uma promessa de fabricante, não um resultado auditável. Analistas da mysummit.school registraram exatamente o mesmo padrão nos releases anteriores da família Qwen, quando comparações agressivas eram ajustadas para baixo semanas depois da publicação dos cartões.
A leitura para além da China
Para CIOs europeus e americanos, o efeito prático é o mesmo, independentemente do resultado do embate técnico: a fronteira de modelos multimodais acima de 1 trilhão de parâmetros deixou de ser um clube restrito a Anthropic, OpenAI e Google. Kimi K3 e Qwen 3.8-Max somam quase 5,2 trilhões de parâmetros lançados na mesma semana por dois laboratórios chineses. Times de plataforma nos EUA, no Reino Unido e na Índia agora precisam avaliar cadeia de fornecimento, governança de dados e restrições regulatórias de modelos chineses de fronteira, e não apenas as opções ocidentais. O eesel AI e a explainx.ai já publicaram comparativos operacionais entre Qwen 3.8-Max e Fable 5 endereçados a compradores corporativos.
No mercado latino-americano, provedores como Falconi e CI&T que integram modelos da Alibaba pelo Alibaba Cloud passam a ter opção próxima ao topo de benchmarks a custo de preview, o que muda o argumento de compra frente a hyperscalers ocidentais. Contudo, quem opera cargas sensíveis a compliance precisa lembrar que a Alibaba não divulgou onde o modelo será servido nem quais retenções aplicará a prompts empresariais, informação que o cartão do modelo, quando publicado, terá de responder.
O preview do Qwen 3.8-Max não fecha a corrida contra o Fable 5. Instala uma corrida paralela sobre transparência: quem publicar primeiro o cartão auditável define a régua pela qual os próximos anúncios chineses vão ser medidos.