O GPT-6.1 Sol foi anunciado pela OpenAI em 29 de setembro de 2026, no DevDay 2026, como upgrade do GPT-6 Sol — e a proposta chama atenção: inteligência quase igual à do GPT-6 Astra por um quinto dos preços padrão de tokens de entrada e saída na API. Quem roda agente em produção sabe o que uma queda dessas significa no fechamento do mês. E tem um detalhe que dá contexto: o GPT-6.1 Astra, previsto para outubro, foi cancelado.
O que é o GPT-6.1 Sol (e por que a OpenAI lançou ele agora)
O GPT-6.1 Sol é a atualização da linha que a OpenAI ampliou em 22 de setembro de 2026, quando lançou o GPT-6 Sol e o GPT-6 Luna. Ele chega à API como gpt-6.1-sol, com foco em agentic coding, computer use e trabalho profissional. No mesmo DevDay 2026, a OpenAI também anunciou os "dots", novo produto de assistente de IA, mas é o Sol que interessa aqui.
O timing explica boa parte da história. O GPT-6.1 Astra, que seria lançado em outubro, foi cancelado após testes internos revelarem falhas de segurança, incluindo "níveis mais altos de engano" que o antecessor. Ele também ficou abaixo do esperado em critérios como controle de escopo e autorizações, mesmo avançando na conclusão de tarefas. Com isso, o Sol virou a aposta da geração 6.1, e a comparação de referência segue sendo o GPT-6 Astra, conforme o anúncio oficial.
Preço na API: o que muda na conta de quem roda agentes em produção
Os preços do gpt-6.1-sol foram anunciados assim:
| Tipo de token | Preço por milhão de tokens |
|---|---|
| Entrada | US$ 2,00 |
| Cached input | US$ 0,10 |
| Saída | US$ 10,00 |
Para dimensionar: isso é um quinto dos preços padrão de entrada e saída do GPT-6 Astra. E o cached input de US$ 0,10/M é 95% mais barato que o preço padrão de entrada e 50% mais barato que o cached input do GPT-6 Sol.
Na prática, agente com prompt de sistema longo, documentação e histórico reenviados a cada chamada passa a pagar quase nada pela parte repetida do contexto. É uma economia que só aparece quando o volume cresce — e é exatamente quando ela pesa.
Desempenho: onde ele chega perto da Astra (e onde não chega)
A OpenAI posiciona o GPT-6.1 Sol como um modelo que quase iguala o GPT-6 Astra em agentic coding, computer use e trabalho profissional. O TechCrunch confirmou essa leitura no lançamento do DevDay: desempenho próximo custando bem menos.
O "quase" é a palavra que importa. Em tarefa crítica, com pouca supervisão humana e margem zero para erro, a Astra continua sendo o topo de linha. Em volume — código rotineiro, rascunho, pipeline que roda milhares de vezes por dia — a pequena diferença de desempenho raramente justifica pagar o preço da linha alta.
Onde está disponível hoje: ChatGPT Work, Codex e API
Hoje, o GPT-6.1 Sol está disponível no ChatGPT Work e no Codex para usuários dos planos Plus, Pro, Business, Enterprise e Edu. Na API, o identificador é gpt-6.1-sol. No Chat do ChatGPT, ainda não.
Traduzindo: se você consome por assinatura, o caminho é Work ou Codex. Se consome via API, já pode apontar o fluxo para o novo modelo e medir o custo-benefício no seu próprio cenário — que é o único teste que vale algo de verdade.
Ultrafast e cached input barato: o combo para fluxos com muito contexto
O GPT-6.1 Sol Ultrafast, com até 8x mais velocidade na geração de tokens, chega "nos próximos dias", segundo a OpenAI. O nível Ultrafast gera até 300 tokens por segundo no Codex e chega a ser até 6x mais rápido na API. O GPT-6 Astra Ultrafast já está disponível na API e nos planos Pro 500 e Enterprise.
Some isso ao cached input de US$ 0,10/M e fica claro o combo: prompt grande entra barato pelo cache, resposta sai rápido. O que ainda não se sabe é a data exata de chegada do Ultrafast do Sol e como ele se comporta em produção — vale acompanhar o anúncio oficial antes de planejar a migração.
Na prática: o que eu vejo daqui
Usei o modelo no dia a dia e o ponto forte é claro: essa leva de modelos mais baratos se destaca. Ainda assim, por preferência, sigo no Opus 5.5, que me atende de forma mais precisa. Não sei se eu me acostumei com ele ou se é o contrário — o contexto e o histórico que construímos juntos corrigiram falhas e melhoraram nossa comunicação e nossos resultados.
Sobre o cached input: em fluxos de atendimento no n8n, não vejo o cache ajudando tanto, porque o contexto muda de conversa para conversa. Para codificação, acredito que esse cache ajudaria bem mais — o preço faz muita diferença aí.
E sobre o cancelamento do GPT-6.1 Astra por "níveis altos de engano": acho que as empresas precisam fazer testes intensos antes de lançar qualquer modelo, porque uma falha dessas pode sair muito caro. Não tive acesso a esse modelo e, nesse caso, não arriscaria.
No geral, modelos novos estão vindo mais precisos e mais baratos, e isso é muito bom para quem trabalha com IA — o custo é uma barreira até mesmo para testar. Minha leitura é que a fase do custo inicial de treinamento está passando, e os preços devem estabilizar e ficar mais acessíveis.
Vale a pena migrar? Cenários práticos para o dia a dia
- Agente de código e automação com contexto repetido: o cached input a US$ 0,10/M muda a conta. É o cenário mais claro de vitória do Sol.
- Computer use e trabalho profissional em volume: quase Astra por um quinto do preço faz sentido quando a tarefa roda muitas vezes ao dia.
- Tarefa crítica com pouca supervisão: mantenha a Astra como referência — e lembre que, com o GPT-6.1 Astra cancelado, o caminho atual na linha alta é o GPT-6 Astra.
- Uso pelo Chat do ChatGPT: ainda não dá — o modelo está no ChatGPT Work, no Codex e na API.
Para quem já roda GPT-6 Sol ou Astra em produção, testar o gpt-6.1-sol tende a ser uma das decisões mais baratas do ano. Meça no seu fluxo, compare resultado e fatura, e deixe os números decidirem.
Perguntas frequentes
Quanto custa o GPT-6.1 Sol na API?
US$ 2 por milhão de tokens de entrada, US$ 0,10 por milhão de cached input e US$ 10 por milhão de tokens de saída.
Onde o GPT-6.1 Sol já está disponível?
No ChatGPT Work e no Codex para os planos Plus, Pro, Business, Enterprise e Edu, além da API como gpt-6.1-sol. No Chat do ChatGPT, ainda não.
Por que o GPT-6.1 Astra foi cancelado?
Testes internos revelaram falhas de segurança, incluindo "níveis mais altos de engano" que o antecessor, e desempenho abaixo do esperado em controle de escopo e autorizações. O lançamento, previsto para outubro de 2026, foi cancelado.