O Qwen 4, próximo grande modelo de inteligência artificial da Alibaba, está oficialmente em treinamento. No entanto, uma publicação anônima nas redes sociais foi além e afirmou que ele já rivaliza com o Claude, da Anthropic. Nesse sentido, a tarefa aqui é separar o que a empresa confirmou do que ainda não passa de especulação.
Da Conferência Apsara ao boato: o que realmente se sabe sobre o próximo modelo
Em 22 de setembro de 2026, durante a Conferência Apsara, em Hangzhou, o líder do projeto Qwen, Liu Dayiheng, confirmou publicamente que o novo modelo está sendo treinado com uma arquitetura de nova geração. Ainda assim, ele não deu data, especificações técnicas nem comparações com rivais: disse apenas que o lançamento acontece “muito em breve”. Além disso, a Alibaba mostrou uma prévia de quatro variantes planejadas para a família, sem detalhar nenhuma delas. Por outro lado, a companhia estabeleceu uma meta ambiciosa para as gerações seguintes, Qwen 4.5 e Qwen 5: algo entre 5 e 10 trilhões de parâmetros. Parâmetros, em outras palavras, são os “ajustes internos” que o modelo aprende durante o treinamento, algo como as conexões de um cérebro. Diante disso, o rumor que circula nas redes pegou carona em um anúncio real e acrescentou afirmações que ninguém da empresa fez.
A pista técnica mais concreta sobre a nova família vem de um modelo que já existe. Em 26 de agosto de 2026, a Alibaba lançou o Qwen3.8-Flash-Next, que ela mesma descreveu como uma “prévia antecipada da arquitetura que vai sustentar o Qwen 4”. Trata-se de um modelo MoE (mixture of experts, ou mistura de especialistas), que funciona como um hospital com vários médicos: para cada pergunta, só os especialistas certos são chamados. Dessa forma, dos 125 bilhões de parâmetros totais, apenas 6 bilhões trabalham em cada token, que é um pedaço de palavra. Inclusive, ele usa uma combinação chamada GDN + QSA (Gated DeltaNet e Qwen Sparse Attention), dois mecanismos que decidem em quais partes do texto o modelo deve prestar atenção, como um leitor que grifa só os trechos importantes. Como resultado, a Alibaba afirma que o treinamento custou cerca de um nono do valor gasto no Qwen3.7-Plus.
- Confirmado: o Qwen 4 está em treinamento com arquitetura de nova geração, segundo Liu Dayiheng, sem data, especificações ou comparações oficiais divulgadas.
- Rumor: a publicação anônima diz que o modelo chega ao nível do Fable e do Opus, da família Claude, mas não mostrou nenhum número; o próprio autor prometeu “postar em breve”.
- Na prática: o Qwen3.8-Flash-Next já pode ser testado, com repositório público no GitHub e card no Hugging Face, e dá uma ideia concreta do que vem aí.
- Em números: esse modelo lê nativamente 262.144 tokens, extensíveis a 1 milhão, o que equivale a analisar vários livros inteiros de uma vez, além de entender texto e imagens.
Por que o Qwen 4 mexe com a disputa global de IA mesmo antes de existir
O boato também tratou como novidade o plano pago do Qwen, que na verdade foi lançado em 10 de agosto de 2026. Naquela data, o aplicativo Qwen App criou a Professional Membership, uma assinatura voltada ao assistente de escritório, além de planos pagos para geração de vídeo. São três níveis: Premium (19 yuans por mês ou 200 por ano), Elite (49 yuans mensais ou 568 anuais) e Flagship (128 yuans mensais ou 1.499 anuais). Apesar disso, o uso básico continua gratuito. Com essa decisão, a Alibaba virou a segunda grande plataforma de IA chinesa a colocar funções profissionais atrás de um paywall, depois do Doubao, da ByteDance. Portanto, o cenário é de monetização: a empresa precisa mostrar que seus modelos justificam a cobrança. De fato, os números do Flash-Next ajudam nesse discurso, como os 91,7 no GPQA Diamond, prova de perguntas científicas de nível de pós-graduação, e os 62,5 no SWE-bench Pro, que mede a capacidade de corrigir problemas reais de programação.
Para quem usa IA no Brasil, a mensagem prática é ter cautela. Em vez de mudar seu fluxo de trabalho por causa de um post sem autoria confirmada, vale destacar que já há um modelo real e público para avaliar. Desenvolvedores podem baixar o Qwen3.8-Flash-Next e testá-lo em tarefas de código e de escritório, áreas em que a Alibaba diz ter melhorado. Ao mesmo tempo, os benchmarks oficiais divulgados, que são provas padronizadas para comparar modelos, não trazem confronto direto com o Claude. Assim sendo, qualquer afirmação de que a próxima geração da Alibaba “bate” os modelos da Anthropic ainda carece de evidência. Por fim, sobre a data: o rumor fala em “começo de outubro”, enquanto a empresa manteve apenas o vago “muito em breve”. Quem planeja projetos deve considerar o que é oficial, e não o calendário de um boato.
Perguntas frequentes
Quando o Qwen 4 será lançado?
A Alibaba não divulgou data oficial. Dessa forma, na Conferência Apsara, em setembro de 2026, Liu Dayiheng disse apenas que o Qwen 4 chega “muito em breve”. A informação de que o lançamento acontece no começo de outubro vem de uma publicação não oficial nas redes sociais e não foi confirmada pela empresa.
O Qwen 4 é melhor que o Claude?
Não há como afirmar isso hoje. Dessa forma, a comparação com o Fable e o Opus, modelos da família Claude, aparece só no rumor, que não apresentou benchmarks nem números. Oficialmente, a Alibaba não divulgou nenhum comparativo do Qwen 4 com modelos de outras empresas, e até os dados do Qwen3.8-Flash-Next não trazem confronto direto com o Claude.
Análise Crítica
A Alibaba joga um jogo inteligente: confirma o treinamento, mostra uma prévia técnica gratuita e deixa o mercado preencher o resto com expectativa. O Flash-Next funciona como vitrine, e o boato, venha de onde vier, faz o marketing que a empresa não pode assinar. Enquanto isso, o paywall de agosto revela a urgência real: transformar popularidade em receita antes que o Doubao, da ByteDance, consolide o hábito de pagamento dos usuários chineses. Quem mais perde com essa narrativa é a Anthropic, porque cada comparação com Opus, mesmo sem prova, reforça a ideia de que modelo de ponta virou commodity, e isso corrói diretamente o argumento de preço premium do Claude. Pense numa startup brasileira de SaaS que paga caro por API da Anthropic para um produto de atendimento: se um modelo aberto com custo de treinamento nove vezes menor entrega resultado parecido, o cálculo de margem muda, e a migração passa a ser questão de sobrevivência, não de preferência. O risco é o padrão clássico do hype pré-lançamento: decisões de arquitetura tomadas com base em promessa, seguidas de um lançamento que entrega menos que o boato. A pergunta que a Alibaba preferiria evitar: se o Qwen 4 realmente rivaliza com o Claude, por que nenhum número oficial foi mostrado?
A visão do canal Invente com IA
Olha, se você tá pensando em trocar de modelo por causa desse vazamento, segura a mão. Mas tem uma coisa concreta pra fazer nos próximos 30 dias: pega o Qwen3.8-Flash-Next, que já tá no Hugging Face, e roda ele nas tarefas que hoje você paga caro pra fazer, tipo revisão de código ou resumo de documento longo. Monta uma planilha simples comparando custo e qualidade com o que você usa hoje. Se ele der conta de uns 70% dos casos, você já corta uma fatia boa da conta de API. E quando o Qwen 4 sair, seu teste tá pronto pra comparar na hora, sem depender de boato.




