PUBLICIDADE

Meta Revoluciona o Ecossistema de Código Aberto com o Lançamento do Muse Glimmer

10/08/2026
94 visualizações
3 min de leitura
Imagem principal do post

Meta retorna ao ecossistema de código aberto com o lançamento do Muse Glimmer

A Meta voltou a investir em modelos de inteligência artificial de código aberto com o lançamento do Muse Glimmer, um modelo denso de 30 bilhões de parâmetros que se destaca por oferecer uma janela de contexto superior a 120 mil tokens e por ser otimizado para execução local em tarefas agentes de longa duração. O anúncio marca a primeira liberação de pesos abertos da Meta Superintelligence Labs e coloca a empresa novamente no centro das discussões sobre modelos abertos voltados para fluxos de trabalho agentic, isto é, sistemas de IA capazes de executar ações de forma autônoma em múltiplas etapas.

O Muse Glimmer foi projetado para rodar inteiramente em dispositivos equipados com processadores gráficos da NVIDIA, incluindo as placas GeForce RTX 5090, os sistemas DGX Spark, DGX Station e os módulos Jetson. Essa compatibilidade ampla abrange desde hardware de borda, voltado para aplicações embarcadas, até estações de trabalho de alto desempenho, oferecendo flexibilidade para desenvolvedores que precisam executar agentes de IA diretamente em suas máquinas, sem depender de servidores em nuvem.

Imagem complementar

Uma das principais características técnicas do modelo é a chamada arquitetura densa, na qual todos os 30 bilhões de parâmetros são ativados a cada token processado. Esse formato garante maior confiabilidade nas respostas, coerência em contextos longos e latência previsível, fatores considerados essenciais para fluxos agentic complexos que envolvem múltiplas etapas sequenciais. Segundo a descrição técnica divulgada, o modelo evita a sobrecarga de roteamento presente em arquiteturas baseadas em mistura de especialistas, conhecidas como mixture-of-experts, nas quais apenas parte dos parâmetros é acionada por token.

Em termos de desempenho, o Muse Glimmer alcança 20 mil tokens por segundo em uma única unidade de processamento gráfico, taxa que viabiliza agentes sempre ativos capazes de processar grandes volumes de dados localmente e executar cadeias complexas de raciocínio e ação. A alta velocidade de inferência é considerada um diferencial importante para aplicações que exigem respostas em tempo real, como automação de software e agentes autônomos.

PUBLICIDADE

O modelo também oferece múltiplas opções de implantação, podendo ser executado por meio de contêineres NVIDIA NIM, da ferramenta SGLang ou do servidor de inferência vLLM. Essa variedade permite que equipes de desenvolvimento escolham a infraestrutura mais adequada ao seu ambiente, facilitando a integração com pipelines existentes e acelerando a adoção em projetos que demandam inferência privada e eficiente.

Distribuído sob a licença Apache 2.0, o Muse Glimmer adota um regime de pesos abertos, o que significa que desenvolvedores podem acessar, modificar e redistribuir o modelo de acordo com os termos dessa licença permissive. A escolha da licença reforça o compromisso da empresa com a transparência e com a comunidade de código aberto, setores que aguardavam há tempos um novo lançamento da Meta nessa linha.

Além do foco em tarefas agentic, o modelo é multimodal, ou seja, capaz de processar diferentes tipos de dados de entrada, ampliando suas possibilidades de aplicação em cenários que combinam texto, imagem e outras modalidades. A janela de contexto estendida, que pode ultrapassar 128 mil tokens conforme indicado por algumas das fontes técnicas da comunidade, permite que o modelo mantenha coerência em conversas longas e em tarefas que envolvem a análise de grandes volumes de informação em uma única sessão.

Com o Muse Glimmer, a Meta pretende oferecer uma alternativa aberta e localmente executável para desenvolvedores que constroem soluções de IA agente, reforçando a tendência de levar modelos cada vez mais poderosos para dispositivos próximos do usuário final. A combinação de arquitetura densa, alta velocidade de inferência e suporte a uma ampla gama de GPU NVIDIA posiciona o lançamento como uma das opções mais relevantes no segmento de modelos abertos voltados para execução local e fluxos de trabalho autônomos.

PUBLICIDADE
Este post foi útil para você?
🖥️
Quer ter o seu próprio servidor?

Para rodar sites, automações ou IA do seu jeito, uma VPS resolve. Este blog roda numa VPS da Hostinger, e pelo link abaixo você ganha desconto na contratação.

Ver planos de VPS da Hostinger →
Link de indicação: o blog recebe uma comissão, sem custo extra para você.
🛒
De olho no None?

Compare os preços e as ofertas de hoje na Amazon antes de decidir.

Ver preços na Amazon →
Como associado da Amazon, o blog ganha com compras qualificadas, sem custo extra para você.

Leitura recomendada

💬 Comentários

Nenhum comentário ainda. Conte o que achou, tire uma dúvida ou discorde. Seja o primeiro!

Deixe seu comentário
O e-mail não aparece. Serve só para avisar quando responderem você.
Os comentários passam por aprovação antes de aparecer. Crie uma conta de leitor e, depois do primeiro aprovado, os próximos saem na hora.
Apoie o ConexãoTC

O ConexãoTC é independente e gratuito. Se as notícias fazem parte do seu dia, contribua com qualquer valor pelo PIX e ajude a manter o blog no ar.

QR code PIX para apoiar o ConexãoTC
Aponte a câmera do app do banco
Favorecido: Jean Dgardany C. Lima, editor do ConexãoTC
🗳️ O que você quer ler aqui?

Marque os assuntos que te interessam. Os mais pedidos viram os próximos artigos.

Leitores cadastrados têm as sugestões atendidas primeiro e recebem um aviso quando o artigo sai.
Fique por dentro

Os destaques do dia no seu e-mail, todo dia às 8h.

PUBLICIDADE