PUBLICIDADE

Alibaba Surpreende e Libera Pesos do Qwen3.8-Flash-Next: Um Primeiro Olhar na Arquitetura que Promete Revolucionar a Geração Qwen4

26/08/2026
89 visualizações
2 min de leitura
Imagem principal do post

Alibaba disponibiliza pesos do modelo Qwen3.8-Flash-Next como prévia da arquitetura Qwen4

A Alibaba liberou os pesos do modelo Qwen3.8-Flash-Next como uma prévia da próxima arquitetura Qwen4, permitindo que desenvolvedores experimentem e avaliem a nova tecnologia. A iniciativa marca mais um movimento da empresa chinesa no cenário de modelos de linguagem de grande porte de código aberto, disponibilizando recursos avançados para a comunidade técnica antes do lançamento oficial da nova geração.

O Qwen3.8-Flash-Next é um modelo multimodal baseado na arquitetura de mistura de especialistas, conhecida como MoE, do inglês Mixture of Experts. Esse tipo de arquitetura divide o processamento entre diferentes submodelos especializados, ativando apenas uma parte dos parâmetros para cada tarefa. No caso do Qwen3.8-Flash-Next, o modelo possui 176 bilhões de parâmetros totais, sendo 51 bilhões dedicados a embeddings de N-gramas, que são representações numéricas de sequências de palavras usadas para capturar padrões linguísticos. A cada token processado, apenas 6 bilhões de parâmetros são ativados, o que contribui para maior eficiência computacional.

Imagem complementar

Outra característica destacada do modelo é a janela de contexto nativa de 262.144 tokens, que pode ser estendida para até 1 milhão de tokens com o uso do YaRN. A janela de contexto representa a quantidade de texto que o modelo consegue analisar de uma só vez para gerar respostas, e a extensão por meio do YaRN permite que o sistema lide com documentos muito maiores. Essa capacidade é especialmente relevante para tarefas que exigem compreensão de textos extensos, como análise de código, revisão de documentos longos e fluxos de trabalho agênticos, nos quais agentes de inteligência artificial executam múltiplas etapas de forma autônoma.

A liberação antecipada dos pesos do Qwen3.8-Flash-Next tem como objetivo preparar a comunidade para a chegada da família Qwen4. Segundo informações divulgadas, a Alibaba optou por tornar públicas as inovações arquiteturais antes do lançamento completo para que desenvolvedores possam testar, identificar possíveis aplicações e contribuir com avaliações. A estratégia segue uma tendência do setor de abrir o acesso a modelos grandes de linguagem, permitindo que pesquisadores e empresas explorem as capacidades dos sistemas e adaptem-nos a diferentes casos de uso.

PUBLICIDADE

A disponibilização dos pesos representa um passo relevante no desenvolvimento de modelos multimodais de grande escala, especialmente voltados para tarefas de codificação agêntica e raciocínio prolongado. A combinação entre a arquitetura MoE, a ampla janela de contexto e a eficiência no uso de parâmetros ativos posiciona o Qwen3.8-Flash-Next como uma peça importante na transição entre as gerações de modelos da Alibaba, antecipando os rumos técnicos da futura linha Qwen4.

PUBLICIDADE
Este post foi útil para você?

Leitura recomendada

💬 Comentários

Nenhum comentário ainda. Conte o que achou, tire uma dúvida ou discorde. Seja o primeiro!

Deixe seu comentário
O e-mail não aparece. Serve só para avisar quando responderem você.
Os comentários passam por aprovação antes de aparecer. Crie uma conta de leitor e, depois do primeiro aprovado, os próximos saem na hora.
Apoie o ConexãoTC

O ConexãoTC é independente e gratuito. Se as notícias fazem parte do seu dia, contribua com qualquer valor pelo PIX e ajude a manter o blog no ar.

QR code PIX para apoiar o ConexãoTC
Aponte a câmera do app do banco
Favorecido: Jean Dgardany C. Lima, editor do ConexãoTC
🗳️ O que você quer ler aqui?

Marque os assuntos que te interessam. Os mais pedidos viram os próximos artigos.

Leitores cadastrados têm as sugestões atendidas primeiro e recebem um aviso quando o artigo sai.
Fique por dentro

Os destaques do dia no seu e-mail, todo dia às 8h.

PUBLICIDADE