PUBLICIDADE

Exa apresenta Agent Ultra: enxame de subagentes promete revolucionar a pesquisa profunda na web

26/09/2026
7 visualizações
4 min de leitura
Imagem principal do post

Exa lança Agent Ultra, modo de pesquisa profunda baseado em enxames de subagentes

A Exa anunciou o lançamento do Agent Ultra, o nível máximo de esforço da sua API de agentes, voltado para pesquisas extensas que exigem exaustão. O novo modo é indicado para construção de grandes listas, enriquecimento de entidades e perguntas que precisam consultar milhares de fontes, segundo a própria empresa. O Agent Ultra está disponível como API hospedada e pode ser acionado definindo o parâmetro de esforço como "ultra". A solução não é disponibilizada em pesos abertos e não pode ser instalada localmente.

Imagem complementar

O funcionamento do Agent Ultra se baseia na divisão de uma tarefa em subtarefas menores, com subagentes sendo alocados para pesquisar diferentes domínios em paralelo. O sistema direciona modelos de fronteira, isto é, os mais avançados disponíveis no mercado, para etapas que realmente exigem esse tipo de capacidade, e utiliza modelos mais rápidos quando eles são suficientes para o trabalho. O Ultra representa o modo de maior consumo de processamento dentro da Agent API. De acordo com a documentação oficial, as execuções típicas concluem tarefas complexas em cerca de 30 minutos, enquanto casos muito difíceis podem se estender por até três horas.

PUBLICIDADE

Nos testes divulgados pela Exa, o Agent Ultra superou os concorrentes Opus 5.5, GPT-6 Astra e Perplexity Agent, cada um operando em seu nível máximo de esforço, em quatro benchmarks voltados para pesquisa. Os números foram apresentados no comunicado de lançamento da empresa. No WANDR, benchmark da Perplexity que reúne 500 tarefas de coleta de dados amplas e profundas, o Agent Ultra atingiu 81,4% em revocação suave, contra 72,3% do Opus 5.5, 40,1% do Perplexity Agent e 26,0% do GPT-6 Astra.

No DeepSearchQA, benchmark de busca multi-etapas do Google DeepMind composto por 900 comandos, o Agent Ultra alcançou pontuação F1 de 93,9%, à frente do Perplexity Agent com 89,7%, do GPT-6 Astra com 85,3% e do Opus 5.5 com 77,6%. Já no WideSearch, que testa a capacidade de reunir informações de forma abrangente, o Agent Ultra registrou 58,9% em F1 no nível de linha, comparado a 56,0% do Perplexity Agent, 54,7% do GPT-6 Astra e 51,6% do Opus 5.5. O destaque mais expressivo apareceu no Company Find-All, que mede a média de entidades válidas retornadas por tarefa: o Agent Ultra localizou 2.451 entidades, contra 146 do Opus 5.5, 113 do GPT-6 Astra e 98 do Perplexity Agent.

A Exa também apresentou estimativas de custo relativo. No WANDR, a melhoria de 12,6% sobre o Opus 5.5 foi alcançada com metade do custo por tarefa. No DeepSearchQA, os 4,7% acima do Perplexity Agent vieram com um custo 46% menor por tarefa em relação ao GPT-6 Astra. No WideSearch, o ganho de 5,2% sobre o Perplexity foi combinado ao menor custo por tarefa entre os quatro sistemas. Por fim, no Company Find-All, a superioridade de 1579% sobre o Opus 5.5 veio acompanhada do menor custo por entidade encontrada. Os resultados, segundo a própria Exa, ainda não foram reproduzidos de forma independente.

A documentação do Agent Ultra limita as avaliações a até 200 tarefas para WANDR e DeepSearchQA e até 100 tarefas para WideSearch e Company Find-All, com quantidades de tarefas efetivamente avaliadas variando por provedor. O WANDR utiliza a lógica de avaliação aberta do benchmark da Perplexity, mas com adaptações no conteúdo e no juiz empregado. Os demais benchmarks, como DeepSearchQA e WideSearch, são apresentados pela Exa como testes de ampla coleta de informações.

A empresa destaca três públicos prioritários para o Agent Ultra. Provedores de modelos podem reunir dados de treinamento, como todos os artigos e repositórios que implementam determinada técnica, além de verificar critérios como a disponibilização de pesos abertos. Equipes de serviços financeiros podem construir mapas de mercado para diligência, conduzir pesquisas de KYC com base em registros e decisões judiciais e monitorar sinais em portfólios. Já times de vendas e marketing podem montar listas de contas e enriquecer registros com campos interpretativos, sempre acompanhados de URL citada. Também é possível expandir uma lista pré-existente: basta enviar as linhas já conhecidas para que sejam excluídas dos novos resultados.

No aspecto técnico, o Agent Ultra utiliza o endpoint padrão de execução do Agent da Exa, com suporte a esquemas de saída, dados de entrada e streaming. A cobrança segue as tarifas habituais do Agent, com teto padrão de 20 dólares por execução. Execuções que terminam antes consomem menos. O orçamento pode ser ajustado entre 1 e 100 dólares por meio do parâmetro maxCostDollars, enquanto a duração varia de 300 a 10.800 segundos via maxDurationSeconds. O sistema também oferece compatibilidade com a interface de respostas da OpenAI, bastando definir o esforço de raciocínio como "ultra" em modo de streaming ou em segundo plano.

O Agent Ultra já pode ser testado no playground da API da Exa, segundo o anúncio.

PUBLICIDADE

Leitura recomendada

Comentários

Nenhum comentário ainda. Seja o primeiro a comentar!