Alibaba mostra Qwen 3.8 Max no WAIC e coloca modelo chinês atrás só do Fable 5

Preview do modelo de 2,4 trilhões de parâmetros chega três dias depois do Kimi K3 da Moonshot. Ações da Alibaba subiram até 5,4% em Hong Kong e devolveram a China ao topo da conversa sobre fronteira em IA.
A Alibaba abriu o World AI Conference em Xangai no domingo, 19 de julho, apresentando o Qwen 3.8 Max Preview, modelo multimodal de 2,4 trilhões de parâmetros que a própria empresa posiciona como o segundo mais capaz do mundo, atrás apenas do Fable 5 da Anthropic. É o segundo lançamento chinês na faixa de fronteira em uma semana. Em 16 de julho, a Moonshot AI colocou no ar o Kimi K3, com 2,8 trilhões de parâmetros em arquitetura mixture-of-experts.
A ficha técnica compartilhada pela integração do Qwen Cloud lista 983.616 tokens de janela de contexto e 131.072 tokens de saída máxima. O modelo processa texto, imagens, vídeo e documentos no mesmo pipeline. A empresa ainda não publicou model card completo, contagem de parâmetros ativos, benchmarks oficiais nem tabela de comparação com Fable 5 ou GPT-5.6 Sol. O Preview está disponível pelo Token Plan, Qoder e QoderWork, a 10% do preço regular. Os pesos abertos, prometidos pela equipe do Qwen para "em breve", ainda não têm data.
Bolsa reage rápido, chips tremem
Ações da Alibaba em Hong Kong (9988.HK) subiram até 5,4% na segunda-feira, com o ADR nova-iorquino batendo em US$ 120,84. A onda começou uma semana antes. A chegada do Kimi K3 apagou cerca de US$ 3,3 trilhões em capitalização de fabricantes de chips ao longo de 48 horas. A Z.ai caiu 27% e a MiniMax perdeu 16% no mesmo intervalo em Hong Kong. O KOSPI, principal índice sul-coreano, recuou 4,5%, com investidores realizando lucro em fabricantes de equipamento semicondutor e migrando para plataformas chinesas de IA.
A sequência ancora um plano de infraestrutura que Eddie Wu, CEO da Alibaba Group, apresentou em 24 de fevereiro de 2025: 380 bilhões de yuans (US$ 53 bilhões) em capex de nuvem e IA nos três anos seguintes, o maior programa de investimento em compute já anunciado por uma empresa privada na China. O Qwen 3.8 Max é o marco público que ancora essa fatura, e amplia a pressão sobre laboratórios ocidentais que operam em regime fechado.
O que muda para quem compra IA
Para o comprador corporativo, um pacote de 2,4 trilhões de parâmetros com licença permissiva tem duas consequências concretas. A primeira é preço. O Kimi K3 estreou a US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de saída, valores em linha com o Sonnet 5 da Anthropic. O Qwen 3.8 chega em faixa comparável, com desconto de 90% na fase Preview. A segunda é opção. Rodar um modelo aberto na própria nuvem privada, em São Paulo, Cingapura ou Frankfurt, muda a equação de residência de dados para bancos e advocacias regidos por normas locais rígidas.
Nem tudo é aceleração. Nenhum banco de dados público verificou o desempenho do Qwen 3.8 fora dos benchmarks internos, e a comparação com Fable 5 vem só do time da Alibaba. O Kimi K3, por exemplo, ficou em quarto no ranking do Artificial Analysis, atrás de Fable 5 e GPT-5.6 Sol, e não em segundo, como Moonshot havia divulgado no lançamento. Esperar dois ou três benchmarks independentes antes de escrever política de arquitetura em pedra segue válido.
Duas geografias que sentem antes
O impacto do preço versus capacidade chega em ondas diferentes conforme o mercado.
Na Coreia do Sul, o barulho é imediato. O KOSPI já responde à percepção de que a arquitetura eficiente do Kimi K3 pode reduzir a intensidade de compra de HBM e equipamento de fotolitografia por labs chineses, fornecedos por Samsung e SK Hynix. A queda de 4,5% no índice mostra como capex de IA chinesa e cotação de memória agora andam ligados dentro do mesmo pregão.
Na Índia, o efeito é industrial e mais lento. Provedores como TCS, Infosys e Wipro montaram Acceleration Centers para revender consultoria em modelos fechados via Azure e AWS. Um Qwen 3.8 aberto, rodando em nuvem privada do cliente final, encurta o intermediário. A TCS demitiu mais de 23.000 pessoas no FY26, o maior corte anual da história da empresa, e a Infosys desligou mais de 950 pessoas silenciosamente desde janeiro, enquanto dizia a investidores que "não planeja demissões em massa". A renegociação de contratos de serviço que estava programada para 2027 se antecipa em pelo menos 18 meses.
O CIO que precisa fechar orçamento de agosto tem uma foto nova. Seis semanas atrás, Fable 5 e GPT-5.6 Sol pareciam ter uma pista praticamente vazia. Agora dividem a fronteira com pelo menos dois modelos chineses de dimensão comparável, e um deles vira código aberto até o fim de julho.