Modelos de IA

GPT-6.1 Sol estrena Ultrafast: hasta 8 veces más rápido y seis veces más caro en la API

OpenAI activa Ultrafast para GPT-6.1 Sol en la API, Codex y ChatGPT Work. La API cuesta 12 dólares de entrada y 60 de salida por millón de tokens.

OpenAI ha activado el modo Ultrafast para GPT-6.1 Sol, una modalidad pensada para reducir la latencia cuando la velocidad de generación resulta más importante que el coste. Desde el 8 de octubre está disponible en la Responses API y también ha comenzado a llegar a Codex y ChatGPT Work para determinados planes.

La mejora tiene un precio considerable. En la API, GPT-6.1 Sol Ultrafast cuesta 12 dólares por cada millón de tokens de entrada y 60 dólares por cada millón de tokens de salida. El procesamiento Standard del mismo modelo cuesta 2 y 10 dólares respectivamente, por lo que utilizar Ultrafast multiplica el precio por seis.

OpenAI promete hasta ocho veces más velocidad en Codex

OpenAI presentó GPT-6.1 Sol con la promesa de que su variante Ultrafast puede generar tokens hasta ocho veces más rápido que Sol Standard en Codex.

Ese máximo no debe interpretarse como una garantía de que cualquier llamada a la API vaya a completarse exactamente ocho veces antes. La mejora real depende de la carga de trabajo, la longitud de la respuesta y otros factores de ejecución.

Ultrafast está pensado sobre todo para escenarios donde la latencia tiene un impacto directo, como depuración interactiva, agentes que controlan aplicaciones o experiencias que necesitan generar respuestas mientras el usuario espera.

Cómo activar GPT-6.1 Sol Ultrafast en la API

Los desarrolladores pueden utilizar el mismo modelo gpt-6.1-sol en la Responses API y seleccionar el nuevo nivel de servicio mediante:

service_tier: "ultrafast"

No se trata por tanto de un modelo separado con capacidades distintas, sino de una modalidad de procesamiento más rápida del mismo GPT-6.1 Sol.

OpenAI indica que Ultrafast está disponible para los usuarios de la API sujeto a los límites de uso correspondientes. También admite procesamiento global y residencia de datos en Estados Unidos y la Unión Europea.

La diferencia de precio frente a Standard es exactamente de seis veces

Los precios por un millón de tokens quedan así:

  • GPT-6.1 Sol Standard: 2 dólares de entrada y 10 dólares de salida.
  • GPT-6.1 Sol Ultrafast: 12 dólares de entrada y 60 dólares de salida.

El coste de entrada y salida es por tanto seis veces mayor en Ultrafast.

Para cargas que generan una gran cantidad de tokens, esa diferencia puede acumularse rápidamente. Una aplicación que utilizara 10 millones de tokens de salida pagaría 100 dólares con Standard frente a 600 dólares con Ultrafast, antes de considerar otros costes.

Ultrafast no ha llegado al chat normal de ChatGPT

La disponibilidad necesita otra aclaración importante. Ultrafast no es una nueva opción para las conversaciones normales de ChatGPT.

GPT-6.1 Sol está disponible en ChatGPT Work y Codex para una gama más amplia de planes, pero el acceso específico a Ultrafast es más limitado.

En Work y Codex, OpenAI lo ofrece inicialmente a usuarios de Pro 500 y a determinados espacios Enterprise y Edu que utilizan créditos. En organizaciones empresariales, el administrador también debe permitir su uso.

Plus, Pro 100, Pro 200 y Business no incluyen Ultrafast en Work o Codex en este lanzamiento.

GPT-6.1 Sol mantiene el mismo modelo, pero cambia el coste por latencia

OpenAI presentó GPT-6.1 Sol como una alternativa orientada a acercarse al rendimiento de Astra en tareas complejas de programación, uso de ordenador y trabajo profesional con un coste considerablemente inferior.

Su precio Standard continúa en 2 dólares por millón de tokens de entrada, 0,10 dólares para entrada almacenada en caché y 10 dólares por millón de tokens de salida.

Ultrafast cambia esa ecuación: no busca reducir el coste de inferencia, sino pagar una prima elevada para obtener respuestas con una cadencia de generación mucho mayor.

Para aplicaciones donde unos segundos adicionales no suponen un problema, Standard continúa siendo mucho más económico. Ultrafast cobra sentido principalmente cuando el tiempo de respuesta forma parte del propio producto o del flujo de trabajo.