GPT-6.1 Sol: quanto custa e quando sai mais barato que Claude Sonnet 5.5 e Opus 5.5

GPT-6.1 Sol custa $2 por milhão de tokens de entrada, $10 por milhão de saída e $0,10 por milhão de entrada em cache: o mesmo preço de tabela que Claude Sonnet 5.5 e a metade que Opus 5.5. Na maioria dos turnos de um agente de código sai mais barato que ambos, exceto quando o prompt ultrapassa os 272K tokens de entrada, onde a sobretaxa da OpenAI inverte o resultado.

OpenAI lançou GPT-6.1 Sol no DevDay em 29 de setembro, uma semana depois de GPT-6 Sol. O título que OpenAI escolheu é „inteligência quase de Astra a um quinto do preço‟. Para quem paga por token, essa não é a comparação útil. A útil é contra o modelo que você já roda dentro do seu agente, que em muitos times é um modelo de Claude. E contra Claude, a resposta depende de quanto cresce seu contexto.

O que é GPT-6.1 Sol?

GPT-6.1 Sol é o nível intermediário da família GPT-6 da OpenAI, entre GPT-6 Astra (o mais capaz e o mais caro) e GPT-6 Luna (o barato, pensado para volume). É uma atualização de GPT-6 Sol. OpenAI o apresenta como um modelo que quase iguala Astra em agentic coding, computer use e trabalho profissional, a um quinto dos preços padrão de entrada e saída de Astra. Se quer o outro lado dessa comparação, nós detalhamos em quanto custa GPT-6 Astra.

Os dados da página do modelo na documentação de OpenAI:

  • ID do modelo: gpt-6.1-sol
  • Contexto: janela de 1.050.000 tokens e até 128.000 tokens de saída
  • Data limite de conhecimento: 30 de abril de 2026
  • Esforço de raciocínio: low, medium (padrão), high, xhigh e max. Não admite none nem minimal.
  • Tool calling: através da Responses API. Chat Completions funciona, mas sem tool calling.

Quanto custa GPT-6.1 Sol?

Por 1M de tokens GPT-6.1 Sol
Entrada $2,00
Entrada em cache $0,10
Escrita em cache $2,50
Saída $10,00

A entrada em cache custa 5% da tarifa padrão de entrada: esse é o desconto de 95% que OpenAI destaca. As escritas em cache são cobradas a 1,25 vezes a tarifa de entrada. Batch e Flex custam 50% menos que o nível padrão, e o modo Fast custa o dobro.

E há uma linha que muda as contas em sessões longas: os prompts de mais de 272K tokens de entrada são cobrados ao dobro em entrada e cache, e a 1,5 vezes em saída, sobre a solicitação completa, não apenas sobre os tokens que passam do limite.

Estos são os preços em 30 de setembro de 2026. GPT-6 Sol foi substituído sete dias depois do seu lançamento, então confira a página de preços de OpenAI antes de montar um orçamento sobre esta tabela.

O que mudou em relação a GPT-6 Sol?

Em preço, só se moveu um número. A entrada e a saída padrão continuam em $2 e $10; a entrada em cache caiu pela metade, de $0,20 a $0,10. Se sua carga de trabalho é principalmente prompts novos, a atualização custa o mesmo. Se é um agente que relê o mesmo contexto do repositório a cada turno, sua fatura desce.

Em capacidade, OpenAI reporta o seguinte. Todos os números são da própria OpenAI e ainda não há replicação independente:

  • DeepSWE v1.1: 6,4 pontos acima da melhor pontuação de GPT-6 Sol, com menor esforço de raciocínio e menor custo. OpenAI diz que aí iguala Astra a cerca de um quinto do custo.
  • OSWorld 2.0 offline (computer use): 7 pontos acima de GPT-6 Sol em esforço máximo, e a 2,1 pontos de Astra a cerca de um sétimo do custo por tarefa.
  • Terminal-Bench Science 0.1: mais do dobro da pontuação de GPT-6 Sol em esforço máximo.
  • Factualidade: em esforço baixo, a proporção de respostas com pelo menos um erro factual cai de 11,4% a 7,7%.

Claude vs ChatGPT: GPT-6.1 Sol sai mais barato que Sonnet 5.5 e Opus 5.5?

Sim, na maioria dos turnos, porque o único que muda em relação a Sonnet 5.5 é o preço de leitura de cache, e aí GPT-6.1 Sol cobra a metade. Estes são os preços de tabela, extraídos da documentação de preços de Anthropic:

Por 1M de tokens GPT-6.1 Sol Sonnet 5.5 Opus 5.5
Entrada $2 $2 $4
Saída $10 $10 $20
Escrita em cache $2,50 $2,50 (5 min) $5
Leitura de cache $0,10 $0,20 $0,20

As duas primeiras linhas são idênticas às de Sonnet 5.5. E uma sessão de agentic coding é, acima de tudo, leitura de cache: cada turno reenvia a conversa, o contexto do repositório e os resultados das ferramentas.

Retomei o turno ilustrativo de nossa análise de Sonnet 5.5 vs Opus 5.5 e movi o contexto em cache para cima e para baixo. É minha aritmética com preços de tabela, não uma medição:

Contexto em cache (+5K de entrada, 2K de saída) GPT-6.1 Sol Sonnet 5.5 Opus 5.5
100K $0,040 $0,050 $0,080
265K $0,057 $0,083 $0,113
300K $0,110 $0,090 $0,120

O que acontece se seu contexto ultrapassa os 272K tokens?

Até o limite, GPT-6.1 Sol vence com clareza, e sua vantagem cresce conforme cresce o contexto em cache. Acima de 272K, toda a solicitação muda de preço e Sonnet 5.5 passa a ser o mais barato. O cálculo assume que o contexto em cache conta para os 272K, o que deveria ser assim, porque faz parte do prompt. Anthropic, em contrapartida, cobra a janela completa de 1M de tokens de Claude a tarifa padrão. É um precipício, não uma ladeira, e as sessões longas de Codex ou Claude Code se aproximam dele sem que ninguém note.

Uma nuance antes de tomar a tabela como um veredicto: os preços por token só se comparam corretamente se os dois modelos contam o mesmo texto como a mesma quantidade de tokens, e não é assim. Cada provedor usa seu próprio tokenizador; a própria Anthropic aponta que seu tokenizador atual gera cerca de 30 % mais tokens que o anterior para o mesmo texto. Passe seu próprio repositório por ambos antes de tirar conclusões.

Se o que você busca é uma comparação mais ampla entre assistentes e não apenas de preços, fizemos em qual é a melhor IA para programar.

GPT-6.1 Sol é melhor que Opus 5.5 em benchmarks?

Nas tarefas que OpenAI escolheu publicar, GPT-6.1 Sol fica à frente de Opus 5.5 e a menor custo. São medições da OpenAI sobre o modelo de um concorrente:

  • AutomationBench: 2,2 pontos acima de Opus 5.5 em esforço médio, a cerca de um terço do custo.
  • GDP.pdf: pontuação maior que “Opus 5.5 com fallbacks”, a menos da metade do custo por tarefa.
  • Terminal-Bench Science: $5,47 por tarefa em esforço máximo, contra $23,21 do Opus 5.5 e $23,80 do Astra. Daí sai a cifra de “mais de 75 % mais barato” que circula esses dias. Corresponde a um benchmark, não ao modelo em geral.

Nesse mesmo benchmark, OpenAI reconhece que Astra ainda tem a pontuação mais alta, 68,1 %, e que deve continuar sendo a opção para a pesquisa mais difícil. É o próprio provedor te apontando onde termina seu modelo barato.

É possível usar GPT-6.1 Sol no Codex?

Sim. Está disponível no ChatGPT Work e no Codex para usuários de Plus, Pro, Business, Enterprise e Edu, e na API como gpt-6.1-sol. No momento da publicação desta nota, ainda não está disponível no chat normal do ChatGPT.

O nível mais rápido ainda não chega. O nível Ultrafast da OpenAI oferece geração de tokens até 8 vezes mais rápida no Codex (cerca de 300 tokens por segundo) e até 6 vezes na API, mas hoje só funciona com GPT-6 Astra, nos planos Pro 500 e Enterprise. Em 30 de setembro, OpenAI lista GPT-6.1 Sol Ultrafast como “em breve”.

Uma distinção prática: se você usar Codex com uma assinatura do ChatGPT, as contas por token acima não o afetam de forma direta. Importam quando você executa agentes com suas próprias chaves de API, ou em CI, bots e pipelines. Cobrimos essa configuração em Claude Code vs Codex: como rodar os dois com suas próprias chaves.

O que um time técnico deveria fazer com isso?

Minha leitura: GPT-6.1 Sol torna mais interessante a decisão por token, não mais simples.

  • Para trabalho de agente bem delimitado, com menos de 272K tokens de contexto (bots de revisão, agentes em CI, features especificadas, bugs com reprodução conhecida), hoje é a opção mais capaz mais barata segundo o preço de lista. Merece um teste com sua própria carga de trabalho.
  • Para sessões longas, o tamanho do contexto passa a ser uma variável de custo que você precisa gerenciar propositalmente. A compactação, as sessões novas e um contexto de repositório mais ajustado eram higiene; com GPT-6.1 Sol decidem se um turno custa $0,06 ou $0,11.
  • Para o trabalho aberto mais difícil, nada disso muda o que dissemos na semana passada: os próprios provedores apontam Opus 5.5 e Astra como os modelos para o critério sustentado.

O padrão de fundo para CTOs é que dois provedores vendem agora seus modelos intermediários a preços de lista quase idênticos, e a diferença se mudou para as regras de cache e os limites. Essas regras vão em uma política de roteamento escrita, que seu time revisa cada vez que um provedor muda sua página de preços. No ritmo atual, isso é a cada par de semanas.