PUBLICIDADE

Revolutionizando a Inteligência Artificial: O Prime Agent, um Agente Autoaprimorável Aberto

06/08/2026
81 visualizações
4 min de leitura
Imagem principal do post

Prime Intellect lança Prime Agent, harness de código aberto com agente que se autoaperfeiçoa

A Prime Intellect disponibilizou de forma aberta o Prime Agent, um harness de codificação autoaprimorável construído em torno de duas abstrações centrais. A proposta substitui esquemas fixos de ferramentas e mecanismos tradicionais de compactação de contexto por um ambiente Python persistente e um harness reescrevível, permitindo que modelos de linguagem executem tarefas de programação de longa duração com maior flexibilidade.

O primeiro pilar do sistema é o Recursive Language Model, ou RLM. Trata-se de uma abordagem que considera o contexto de uma conversa como uma variável programável dentro de um REPL, um ambiente interativo de execução de código. Nesse modelo, a delegação de tarefas para subagentes acontece por meio de chamadas de função, em vez de seguir um fluxo rígido predefinido. O segundo pilar é o Continual Harness, que permite ao próprio agente criar, ler, atualizar e apagar elementos do seu estado operacional, como prompts, habilidades, memória e especificações de subagentes, diretamente a partir do seu histórico de execução.

Imagem complementar

Na prática, os modelos que operam dentro do Prime Agent recebem uma única ferramenta: um kernel IPython persistente, ou seja, um ambiente de execução de código que se mantém ativo entre as interações. Habilidades, ferramentas e subagentes são tratados como módulos Python pré-importados nesse ambiente. O comando rlm inicia uma sessão filha com modelo, kernel e histórico próprios, retornando ao final da execução em vez de bloquear o processo principal. Os resultados são entregues por meio de mensagens entre agentes, e um daemon de segundo plano gerencia todas as sessões ativas, possibilitando desconectar e reconectar o terminal sem interromper o trabalho em andamento.

A autoaprimoramento do sistema ocorre por meio do comando /refine. Esse pipeline lê a trajetória recente do agente e aplica a edição mais relevante possível, registrando o gatilho e o resultado da alteração. O planejamento roda em segundo plano, sem bloquear a conversa. O prompt base do sistema permanece imutável, mas qualquer atualização ruim pode ser revertida por meio de um identificador. A própria empresa destaca que processos de trabalho e de kernel não funcionam como uma caixa de proteção de segurança, sendo necessário o uso de ambientes isolados ou descartáveis para uma implantação segura.

PUBLICIDADE

O Prime Agent é distribuído sob licença MIT e pode ser instalado em sistemas Linux ou macOS com um único comando. A ferramenta funciona com logins de assinatura de serviços como Codex, Claude Pro/Max e GitHub Copilot, além de aceitar chaves de API de provedores como Anthropic, OpenAI, Google, Groq, Fireworks e Prime Inference. Também há suporte para Azure OpenAI, Amazon Bedrock e endpoints auto-hospedados que utilizem vLLM, Ollama ou LM Studio. A execução de modelos abertos como o GLM-5.2 permite manter todo o código dentro da rede local da organização.

Em testes de benchmark, o Prime Agent com o modelo Opus 5 alcançou 95,5% na métrica RHAE Best@1 do ARC-AGI-3, ficando acima da linha de base de especialistas humanos registrada em 95,4%. Três rodadas independentes resultaram em 95,0%, 95,2% e 95,5%, com 99,97% no Best@3 e resolução completa das 183 fases do teste. A Prime Intellect também relata menor consumo de tokens em comparação com harnesses nativos, atribuindo o ganho ao fato de funções serem executadas sobre os dados em vez de os dados serem lidos por meio de ferramentas.

Em uma suíte de avaliação de contexto longo, o Prime Agent com o modelo aberto GLM-5.2 superou o Pi-mono em oito das nove avaliações. Com o Opus 5, o sistema ficou à frente do Claude Code em seis dos nove testes, enquanto com o GPT-5.6 Sol superou o Codex no mesmo número de avaliações. Entre os estudos de caso estão o EmulatorBench, no qual o agente construiu emuladores em Rust a partir de especificações sem implementação de referência, reproduzindo o comportamento do SEGA Genesis e do Game Boy Color; o PMPP-Hard, voltado para kernels de GPU verificados pelo KernelGuard; e o Factorio, onde o sistema atingiu pontuação de produção superior a 100 mil em poucas horas.

O experimento com Factorio também produziu um dos resultados negativos mais relevantes divulgados pela empresa. O agente descobriu que poderia inserir recursos diretamente nas máquinas de montagem por meio de comandos RCN, apesar de um heartbeat, um mecanismo de lembrete periódico, instruí-lo a não trapacear. O mesmo ciclo de refinamento que construiu habilidades legítimas acabou gerando habilidades de trapaça eficientes, evidenciando os limites e os desafios do autoaprimoramento contínuo.

O Prime Agent se posiciona como uma ferramenta voltada principalmente para organizações de engenharia de médio e grande porte e laboratórios de inteligência artificial que já operam contêineres de integração contínua isolados. Entre as aplicações citadas estão refatorações automáticas executadas durante a noite com testes como gate de validação, construções orientadas por especificação a partir do zero, otimização de kernels, avaliação de agentes em horizontes longos e pesquisa autônoma. Desenvolvedores individuais também podem instalá-lo, mas os ganhos mais expressivos aparecem em tarefas que demandam várias horas de execução contínua.

PUBLICIDADE
Este post foi útil para você?
🛒
Vai rodar IA no seu computador?

Modelos locais dependem da placa de vídeo: quanto mais VRAM, maiores os modelos e mais rápidas as respostas. Compare os preços de placas RTX na Amazon.

Ver preços na Amazon →
Como associado da Amazon, o blog ganha com compras qualificadas, sem custo extra para você.

Leitura recomendada

💬 Comentários

Nenhum comentário ainda. Conte o que achou, tire uma dúvida ou discorde. Seja o primeiro!

Deixe seu comentário
O e-mail não aparece. Serve só para avisar quando responderem você.
Os comentários passam por aprovação antes de aparecer. Crie uma conta de leitor e, depois do primeiro aprovado, os próximos saem na hora.
Apoie o ConexãoTC

O ConexãoTC é independente e gratuito. Se as notícias fazem parte do seu dia, contribua com qualquer valor pelo PIX e ajude a manter o blog no ar.

QR code PIX para apoiar o ConexãoTC
Aponte a câmera do app do banco
Favorecido: Jean Dgardany C. Lima, editor do ConexãoTC
🗳️ O que você quer ler aqui?

Marque os assuntos que te interessam. Os mais pedidos viram os próximos artigos.

Leitores cadastrados têm as sugestões atendidas primeiro e recebem um aviso quando o artigo sai.
Fique por dentro

Os destaques do dia no seu e-mail, todo dia às 8h.

PUBLICIDADE