GPT-6.1 Sol: cuánto cuesta y cuándo sale más barato que Claude Sonnet 5.5 y Opus 5.5

GPT-6.1 Sol cuesta $2 por millón de tokens de entrada, $10 por millón de salida y $0,10 por millón de entrada en caché: el mismo precio de lista que Claude Sonnet 5.5 y la mitad que Opus 5.5. En la mayoría de los turnos de un agente de código sale más barato que ambos, salvo cuando el prompt supera los 272K tokens de entrada, donde el recargo de OpenAI invierte el resultado.

OpenAI lanzó GPT-6.1 Sol en DevDay el 29 de septiembre, una semana después de GPT-6 Sol. El titular que eligió OpenAI es “inteligencia casi de Astra a una quinta parte del precio”. Para quien paga por token, esa no es la comparación útil. La útil es contra el modelo que ya corres dentro de tu agente, que en muchos equipos es un modelo de Claude. Y contra Claude, la respuesta depende de cuánto crece tu contexto.

¿Qué es GPT-6.1 Sol?

GPT-6.1 Sol es el nivel intermedio de la familia GPT-6 de OpenAI, entre GPT-6 Astra (el más capaz y el más caro) y GPT-6 Luna (el barato, pensado para volumen). Es una actualización de GPT-6 Sol. OpenAI lo presenta como un modelo que casi iguala a Astra en agentic coding, computer use y trabajo profesional, a una quinta parte de los precios estándar de entrada y salida de Astra. Si quieres el otro lado de esa comparación, lo desglosamos en cuánto cuesta GPT-6 Astra.

Los datos de la página del modelo en la documentación de OpenAI:

  • ID del modelo: gpt-6.1-sol
  • Contexto: ventana de 1.050.000 tokens y hasta 128.000 tokens de salida
  • Fecha de corte de conocimiento: 30 de abril de 2026
  • Esfuerzo de razonamiento: low, medium (por defecto), high, xhigh y max. No admite none ni minimal.
  • Tool calling: a través de la Responses API. Chat Completions funciona, pero sin tool calling.

¿Cuánto cuesta GPT-6.1 Sol?

Por 1M de tokens GPT-6.1 Sol
Input $2,00
Cached input $0,10
Escritura en caché $2,50
Output $10,00

La entrada en caché cuesta el 5 de la tarifa estándar de entrada: ese es el descuento del 95 que destaca OpenAI. Las escrituras en caché se cobran a 1,25 veces la tarifa de entrada. Batch y Flex cuestan un 50 % menos que el nivel estándar, y el modo Fast cuesta el doble.

Y hay una línea que cambia las cuentas en las sesiones largas: los prompts de más de 272K tokens de entrada se cobran al doble en entrada y caché, y a 1,5 veces en salida, sobre la solicitud completa, no solo sobre los tokens que pasan del umbral.

Estos son los precios al 30 de septiembre de 2026. GPT-6 Sol fue reemplazado siete días después de su lanzamiento, así que revisa la página de precios de OpenAI antes de armar un presupuesto sobre esta tabla.

¿Qué cambió frente a GPT-6 Sol?

En precio, solo se movió un número. La entrada y la salida estándar siguen en $2 y $10; la entrada en caché bajó a la mitad, de $0,20 a $0,10. Si tu carga de trabajo son sobre todo prompts nuevos, la actualización te cuesta lo mismo. Si es un agente que relee el mismo contexto del repositorio en cada turno, tu factura baja.

En capacidad, OpenAI reporta lo siguiente. Todas las cifras son de la propia OpenAI y todavía no hay replicación independiente:

  • DeepSWE v1.1: 6,4 puntos por encima del mejor puntaje de GPT-6 Sol, con menor esfuerzo de razonamiento y menor costo. OpenAI dice que ahí iguala a Astra a cerca de una quinta parte del costo.
  • OSWorld 2.0 offline (computer use): 7 puntos por encima de GPT-6 Sol en esfuerzo máximo, y a 2,1 puntos de Astra a cerca de una séptima parte del costo por tarea.
  • Terminal-Bench Science 0.1: más del doble del puntaje de GPT-6 Sol en esfuerzo máximo.
  • Factualidad: en esfuerzo bajo, la proporción de respuestas con al menos un error factual baja de 11,4 a 7,7 .

Claude vs ChatGPT: ¿GPT-6.1 Sol sale más barato que Sonnet 5.5 y Opus 5.5?

Sí, en la mayoría de los turnos, porque lo único que cambia frente a Sonnet 5.5 es el precio de lectura de caché, y ahí GPT-6.1 Sol cobra la mitad. Estos son los precios de lista, tomados de la documentación de precios de Anthropic:

Por 1M de tokens GPT-6.1 Sol Sonnet 5.5 Opus 5.5
Input $2 $2 $4
Output $10 $10 $20
Escritura en caché $2,50 $2,50 (5 min) $5
Lectura de caché $0,10 $0,20 $0,20

Las dos primeras filas son idénticas a las de Sonnet 5.5. Y una sesión de agentic coding es, sobre todo, lectura de caché: cada turno reenvía la conversación, el contexto del repositorio y los resultados de las herramientas.

Retomé el turno ilustrativo de nuestro análisis de Sonnet 5.5 vs Opus 5.5 y moví el contexto en caché hacia arriba y hacia abajo. Es mi aritmética con precios de lista, no una medición:

Contexto en caché (+5K de input, 2K de output) GPT-6.1 Sol Sonnet 5.5 Opus 5.5
100K $0,040 $0,050 $0,080
265K $0,057 $0,083 $0,113
300K $0,110 $0,090 $0,120

¿Qué pasa si tu contexto supera los 272K tokens?

Hasta el umbral, GPT-6.1 Sol gana con claridad, y su ventaja crece a medida que crece el contexto en caché. Por encima de 272K, toda la solicitud cambia de precio y Sonnet 5.5 pasa a ser el más barato. El cálculo asume que el contexto en caché cuenta para los 272K, lo que debería ser así, porque forma parte del prompt. Anthropic, en cambio, cobra la ventana completa de 1M de tokens de Claude a tarifa estándar. Es un precipicio, no una pendiente, y las sesiones largas de Codex o Claude Code se acercan a él sin que nadie lo note.

Un matiz antes de tomar la tabla como un veredicto: los precios por token solo se comparan limpiamente si los dos modelos cuentan el mismo texto como la misma cantidad de tokens, y no es así. Cada proveedor usa su propio tokenizer; la propia Anthropic señala que su tokenizer actual genera cerca de un 30 % más de tokens que el anterior para el mismo texto. Pasa tu propio repositorio por ambos antes de sacar conclusiones.

Si lo que buscas es una comparación más amplia entre asistentes y no solo de precios, la hicimos en cuál es la mejor IA para programar.

¿GPT-6.1 Sol es mejor que Opus 5.5 en benchmarks?

En las tareas que OpenAI eligió publicar, GPT-6.1 Sol queda por delante de Opus 5.5 y a menor costo. Son mediciones de OpenAI sobre el modelo de un competidor:

  • AutomationBench: 2,2 puntos por encima de Opus 5.5 en esfuerzo medium, a cerca de un tercio del costo.
  • GDP.pdf: mayor puntaje que “Opus 5.5 con fallbacks”, a menos de la mitad del costo por tarea.
  • Terminal-Bench Science: $5,47 por tarea en esfuerzo máximo, frente a $23,21 de Opus 5.5 y $23,80 de Astra. De ahí sale la cifra de “más de 75 % más barato” que circula estos días. Corresponde a un benchmark, no al modelo en general.

En ese mismo benchmark, OpenAI reconoce que Astra sigue teniendo el puntaje más alto, 68,1 %, y que debería seguir siendo la opción para la investigación más difícil. Es el propio proveedor diciéndote dónde termina su modelo barato.

¿Se puede usar GPT-6.1 Sol en Codex?

Sí. Está disponible en ChatGPT Work y en Codex para usuarios de Plus, Pro, Business, Enterprise y Edu, y en la API como gpt-6.1-sol. Al momento de publicar esta nota, todavía no está disponible en el chat normal de ChatGPT.

El nivel más rápido todavía no llega. El nivel Ultrafast de OpenAI ofrece generación de tokens hasta 8 veces más rápida en Codex (unos 300 tokens por segundo) y hasta 6 veces en la API, pero hoy solo corre sobre GPT-6 Astra, en los planes Pro 500 y Enterprise. Al 30 de septiembre, OpenAI lista GPT-6.1 Sol Ultrafast como “próximamente”.

Una distinción práctica: si usas Codex con una suscripción de ChatGPT, las cuentas por token de arriba no te afectan de forma directa. Importan cuando corres agentes con tus propias API keys, o en CI, bots y pipelines. Cubrimos esa configuración en Claude Code vs Codex: cómo correr los dos con tus propias claves.

¿Qué debería hacer un equipo técnico con esto?

Mi lectura: GPT-6.1 Sol vuelve más interesante la decisión por token, no más simple.

  • Para trabajo de agente bien acotado, con menos de 272K tokens de contexto (bots de review, agentes en CI, features especificadas, bugs con reproducción conocida), hoy es la opción capaz más barata según el precio de lista. Merece una prueba con tu propia carga de trabajo.
  • Para sesiones largas, el tamaño del contexto pasa a ser una variable de costo que tienes que gestionar a propósito. La compactación, las sesiones nuevas y un contexto de repositorio más ajustado eran higiene; con GPT-6.1 Sol deciden si un turno cuesta $0,06 o $0,11.
  • Para el trabajo abierto más difícil, nada de esto cambia lo que dijimos la semana pasada: los propios proveedores señalan a Opus 5.5 y a Astra como los modelos para el criterio sostenido.

El patrón de fondo para CTOs es que dos proveedores venden ahora sus modelos intermedios a precios de lista casi idénticos, y la diferencia se mudó a las reglas de caché y a los umbrales. Esas reglas van en una política de enrutamiento escrita, que tu equipo revisa cada vez que un proveedor cambia su página de precios. Al ritmo actual, eso es cada par de semanas.