PUBLICIDADE

DeepSeek V4.1-Flash chega para revolucionar: nova IA promete respostas mais rápidas com apenas 1/4 da memória e custos bem menores

10/09/2026
6 visualizações
3 min de leitura
Imagem principal do post

DeepSeek lança V4.1-Flash, novo modelo de IA com promessa de respostas mais ágeis e menor custo de operação

A startup chinesa DeepSeek apresentou o V4.1-Flash, mais recente modelo de inteligência artificial da empresa, descrito como o menor integrante de uma nova família de arquiteturas. O lançamento foi divulgado em meio à preparação da companhia para uma oferta pública inicial de ações no mercado STAR, em Xangai, segundo informações da Reuters. A novidade também marca o início da substituição gradual dos modelos anteriores pelo novo sistema.

Imagem complementar

Apesar de ser considerado o mais compacto da nova família, o V4.1-Flash reúne 552 bilhões de parâmetros, que são elementos internos usados pela inteligência artificial para processar informações e produzir respostas. O modelo adota uma arquitetura do tipo mistura de especialistas, na qual apenas parte desses recursos é mobilizada em cada tarefa. São 8 bilhões de parâmetros ativos para receber informações e 16 bilhões para gerar as respostas ao usuário. O objetivo declarado é oferecer maior velocidade de execução e capacidade de atender um volume maior de solicitações sem exigir tantos recursos computacionais.

PUBLICIDADE

O novo modelo também conta com capacidade nativa de compreensão visual, permitindo interpretar imagens além de textos. Segundo a DeepSeek, testes conduzidos por diferentes partes indicaram que o V4.1-Flash superou o V4-Pro em métricas como desempenho geral, custo, velocidade e tempo total de execução. A empresa afirma ainda que a arquitetura foi desenhada para facilitar a criação de modelos maiores no futuro.

Outra mudança relevante está na forma como o V4.1-Flash gerencia o armazenamento temporário de informações durante uma tarefa, fator que pode pesar nos custos de serviços baseados em inteligência artificial que funcionam por períodos prolongados. Na comparação com a geração anterior, a DeepSeek afirma que o novo modelo precisa de um quarto da memória HBM, que é o tipo de memória de alta velocidade usada em processadores especializados em IA, além de um oitavo do espaço de armazenamento em SSD para o cache de pares chave-valor. O sistema também exige menos espaço para manter informações das interações e menos recursos para lidar com esses dados, o que, segundo a empresa, pode reduzir significativamente os custos operacionais, em especial para agentes de inteligência artificial, sistemas capazes de realizar tarefas com menor intervenção humana.

O V4.1-Flash já está disponível na API da DeepSeek, interface que permite que outras aplicações integrem o modelo em seus serviços. Os modelos V4-Flash e V4-Flash-Vision-Exp foram retirados e, temporariamente, suas solicitações são encaminhadas para o novo sistema. O V4-Pro também será descontinuado de forma gradual. A partir de 14 de setembro de 2026, as requisições feitas a ele serão redirecionadas automaticamente para o V4.1-Flash, com a cobrança passando a seguir a tabela de preços do novo modelo. Esse redirecionamento permanecerá ativo até o lançamento do V4.1-Pro.

A nova tabela de preços da API entra em vigor em 10 de setembro. A DeepSeek mantém valores diferenciados para períodos de maior e menor demanda, com a tarifa fora do horário de pico equivalente à metade do preço cobrado nos momentos de maior uso. A empresa afirma que a redução de custos obtida com o modelo está sendo repassada aos usuários. A companhia também pretende trabalhar com a comunidade de código aberto para ampliar o suporte ao V4.1-Flash e estudar outras formas de implantação do sistema.

Com a chegada do V4.1-Flash, a DeepSeek consolida sua estratégia de oferecer modelos de inteligência artificial que buscam equilíbrio entre desempenho e eficiência de recursos. A combinação de menor consumo de memória e armazenamento, preços reduzidos na API e disponibilidade de compreensão visual nativa posiciona o novo modelo como peça central na transição da empresa para uma nova geração de arquitetura, ao mesmo tempo em que sinaliza os próximos passos da startup chinesa no competitivo mercado global de IA.

PUBLICIDADE

Leitura recomendada

Comentários

Nenhum comentário ainda. Seja o primeiro a comentar!