GPT-6.1 Sol custa $2 por milhão de tokens de entrada, $10 por milhão de saída e $0,10 por milhão de entrada em cache: o mesmo preço de tabela que Claude Sonnet 5.5 e a metade que Opus 5.5. Na maioria dos turnos de um agente de código sai mais barato que ambos, exceto quando o prompt ultrapassa os 272K tokens de entrada, onde a sobretaxa da OpenAI inverte o resultado.
OpenAI lançou GPT-6.1 Sol no DevDay em 29 de setembro, uma semana depois de GPT-6 Sol. O título que OpenAI escolheu é „inteligência quase de Astra a um quinto do preço‟. Para quem paga por token, essa não é a comparação útil. A útil é contra o modelo que você já roda dentro do seu agente, que em muitos times é um modelo de Claude. E contra Claude, a resposta depende de quanto cresce seu contexto.
O que é GPT-6.1 Sol?
GPT-6.1 Sol é o nível intermediário da família GPT-6 da OpenAI, entre GPT-6 Astra (o mais capaz e o mais caro) e GPT-6 Luna (o barato, pensado para volume). É uma atualização de GPT-6 Sol. OpenAI o apresenta como um modelo que quase iguala Astra em agentic coding, computer use e trabalho profissional, a um quinto dos preços padrão de entrada e saída de Astra. Se quer o outro lado dessa comparação, nós detalhamos em quanto custa GPT-6 Astra.
Os dados da página do modelo na documentação de OpenAI:
- ID do modelo:
gpt-6.1-sol - Contexto: janela de 1.050.000 tokens e até 128.000 tokens de saída
- Data limite de conhecimento: 30 de abril de 2026
- Esforço de raciocínio:
low,medium(padrão),high,xhighemax. Não admitenonenemminimal. - Tool calling: através da Responses API. Chat Completions funciona, mas sem tool calling.
Quanto custa GPT-6.1 Sol?
| Por 1M de tokens | GPT-6.1 Sol |
|---|---|
| Entrada | $2,00 |
| Entrada em cache | $0,10 |
| Escrita em cache | $2,50 |
| Saída | $10,00 |
A entrada em cache custa 5% da tarifa padrão de entrada: esse é o desconto de 95% que OpenAI destaca. As escritas em cache são cobradas a 1,25 vezes a tarifa de entrada. Batch e Flex custam 50% menos que o nível padrão, e o modo Fast custa o dobro.
E há uma linha que muda as contas em sessões longas: os prompts de mais de 272K tokens de entrada são cobrados ao dobro em entrada e cache, e a 1,5 vezes em saída, sobre a solicitação completa, não apenas sobre os tokens que passam do limite.
Estos são os preços em 30 de setembro de 2026. GPT-6 Sol foi substituído sete dias depois do seu lançamento, então confira a página de preços de OpenAI antes de montar um orçamento sobre esta tabela.
O que mudou em relação a GPT-6 Sol?
Em preço, só se moveu um número. A entrada e a saída padrão continuam em $2 e $10; a entrada em cache caiu pela metade, de $0,20 a $0,10. Se sua carga de trabalho é principalmente prompts novos, a atualização custa o mesmo. Se é um agente que relê o mesmo contexto do repositório a cada turno, sua fatura desce.
Em capacidade, OpenAI reporta o seguinte. Todos os números são da própria OpenAI e ainda não há replicação independente:
- DeepSWE v1.1: 6,4 pontos acima da melhor pontuação de GPT-6 Sol, com menor esforço de raciocínio e menor custo. OpenAI diz que aí iguala Astra a cerca de um quinto do custo.
- OSWorld 2.0 offline (computer use): 7 pontos acima de GPT-6 Sol em esforço máximo, e a 2,1 pontos de Astra a cerca de um sétimo do custo por tarefa.
- Terminal-Bench Science 0.1: mais do dobro da pontuação de GPT-6 Sol em esforço máximo.
- Factualidade: em esforço baixo, a proporção de respostas com pelo menos um erro factual cai de 11,4% a 7,7%.
Claude vs ChatGPT: GPT-6.1 Sol sai mais barato que Sonnet 5.5 e Opus 5.5?
Sim, na maioria dos turnos, porque o único que muda em relação a Sonnet 5.5 é o preço de leitura de cache, e aí GPT-6.1 Sol cobra a metade. Estes são os preços de tabela, extraídos da documentação de preços de Anthropic:
| Por 1M de tokens | GPT-6.1 Sol | Sonnet 5.5 | Opus 5.5 |
|---|---|---|---|
| Entrada | $2 | $2 | $4 |
| Saída | $10 | $10 | $20 |
| Escrita em cache | $2,50 | $2,50 (5 min) | $5 |
| Leitura de cache | $0,10 | $0,20 | $0,20 |
As duas primeiras linhas são idênticas às de Sonnet 5.5. E uma sessão de agentic coding é, acima de tudo, leitura de cache: cada turno reenvia a conversa, o contexto do repositório e os resultados das ferramentas.
Retomei o turno ilustrativo de nossa análise de Sonnet 5.5 vs Opus 5.5 e movi o contexto em cache para cima e para baixo. É minha aritmética com preços de tabela, não uma medição:
| Contexto em cache (+5K de entrada, 2K de saída) | GPT-6.1 Sol | Sonnet 5.5 | Opus 5.5 |
|---|---|---|---|
| 100K | $0,040 | $0,050 | $0,080 |
| 265K | $0,057 | $0,083 | $0,113 |
| 300K | $0,110 | $0,090 | $0,120 |
O que acontece se seu contexto ultrapassa os 272K tokens?
Até o limite, GPT-6.1 Sol vence com clareza, e sua vantagem cresce conforme cresce o contexto em cache. Acima de 272K, toda a solicitação muda de preço e Sonnet 5.5 passa a ser o mais barato. O cálculo assume que o contexto em cache conta para os 272K, o que deveria ser assim, porque faz parte do prompt. Anthropic, em contrapartida, cobra a janela completa de 1M de tokens de Claude a tarifa padrão. É um precipício, não uma ladeira, e as sessões longas de Codex ou Claude Code se aproximam dele sem que ninguém note.
Uma nuance antes de tomar a tabela como um veredicto: os preços por token só se comparam corretamente se os dois modelos contam o mesmo texto como a mesma quantidade de tokens, e não é assim. Cada provedor usa seu próprio tokenizador; a própria Anthropic aponta que seu tokenizador atual gera cerca de 30 % mais tokens que o anterior para o mesmo texto. Passe seu próprio repositório por ambos antes de tirar conclusões.
Se o que você busca é uma comparação mais ampla entre assistentes e não apenas de preços, fizemos em qual é a melhor IA para programar.
GPT-6.1 Sol é melhor que Opus 5.5 em benchmarks?
Nas tarefas que OpenAI escolheu publicar, GPT-6.1 Sol fica à frente de Opus 5.5 e a menor custo. São medições da OpenAI sobre o modelo de um concorrente:
- AutomationBench: 2,2 pontos acima de Opus 5.5 em esforço médio, a cerca de um terço do custo.
- GDP.pdf: pontuação maior que “Opus 5.5 com fallbacks”, a menos da metade do custo por tarefa.
- Terminal-Bench Science: $5,47 por tarefa em esforço máximo, contra $23,21 do Opus 5.5 e $23,80 do Astra. Daí sai a cifra de “mais de 75 % mais barato” que circula esses dias. Corresponde a um benchmark, não ao modelo em geral.
Nesse mesmo benchmark, OpenAI reconhece que Astra ainda tem a pontuação mais alta, 68,1 %, e que deve continuar sendo a opção para a pesquisa mais difícil. É o próprio provedor te apontando onde termina seu modelo barato.
É possível usar GPT-6.1 Sol no Codex?
Sim. Está disponível no ChatGPT Work e no Codex para usuários de Plus, Pro, Business, Enterprise e Edu, e na API como gpt-6.1-sol. No momento da publicação desta nota, ainda não está disponível no chat normal do ChatGPT.
O nível mais rápido ainda não chega. O nível Ultrafast da OpenAI oferece geração de tokens até 8 vezes mais rápida no Codex (cerca de 300 tokens por segundo) e até 6 vezes na API, mas hoje só funciona com GPT-6 Astra, nos planos Pro 500 e Enterprise. Em 30 de setembro, OpenAI lista GPT-6.1 Sol Ultrafast como “em breve”.
Uma distinção prática: se você usar Codex com uma assinatura do ChatGPT, as contas por token acima não o afetam de forma direta. Importam quando você executa agentes com suas próprias chaves de API, ou em CI, bots e pipelines. Cobrimos essa configuração em Claude Code vs Codex: como rodar os dois com suas próprias chaves.
O que um time técnico deveria fazer com isso?
Minha leitura: GPT-6.1 Sol torna mais interessante a decisão por token, não mais simples.
- Para trabalho de agente bem delimitado, com menos de 272K tokens de contexto (bots de revisão, agentes em CI, features especificadas, bugs com reprodução conhecida), hoje é a opção mais capaz mais barata segundo o preço de lista. Merece um teste com sua própria carga de trabalho.
- Para sessões longas, o tamanho do contexto passa a ser uma variável de custo que você precisa gerenciar propositalmente. A compactação, as sessões novas e um contexto de repositório mais ajustado eram higiene; com GPT-6.1 Sol decidem se um turno custa $0,06 ou $0,11.
- Para o trabalho aberto mais difícil, nada disso muda o que dissemos na semana passada: os próprios provedores apontam Opus 5.5 e Astra como os modelos para o critério sustentado.
O padrão de fundo para CTOs é que dois provedores vendem agora seus modelos intermediários a preços de lista quase idênticos, e a diferença se mudou para as regras de cache e os limites. Essas regras vão em uma política de roteamento escrita, que seu time revisa cada vez que um provedor muda sua página de preços. No ritmo atual, isso é a cada par de semanas.