Modelos de IA

Cómo usar GPT-6 Astra en la API de OpenAI: guía para desarrolladores

GPT-6 Astra llega con Responses API, razonamiento configurable, llamadas asíncronas a herramientas y un contexto de hasta 1,05 millones de tokens.

OpenAI presentó GPT-6 Astra el 3 de septiembre de 2026 como su modelo más avanzado para trabajos complejos de razonamiento, programación, investigación, uso de ordenadores y flujos de trabajo con varias etapas. Los desarrolladores pueden utilizarlo con el identificador gpt-6-astra, aunque el acceso comenzó con un despliegue limitado y se está ampliando gradualmente.

Qué necesitas para utilizar GPT-6 Astra

  • Una cuenta de OpenAI con acceso habilitado al modelo.
  • Una clave de la API configurada de forma segura.
  • Una versión actual del SDK oficial de OpenAI si utilizas Python, JavaScript u otro lenguaje compatible.
  • La Responses API si tu aplicación necesita utilizar herramientas con Astra.

OpenAI recomienda Responses API para las integraciones nuevas. GPT-6 Astra también admite Chat Completions para determinados usos, pero las llamadas a herramientas con este modelo requieren Responses API.

Cómo hacer una petición básica a GPT-6 Astra con Python

Después de configurar la variable de entorno OPENAI_API_KEY, puedes crear una petición mediante el SDK oficial. El modelo se selecciona mediante gpt-6-astra.

python
from openai import OpenAI client = OpenAI() response = client.responses.create( model="gpt-6-astra", reasoning={"effort": "low"}, input="Explica las diferencias entre TCP y UDP en cinco puntos." ) print(response.output_text)

El campo reasoning.effort controla cuánto esfuerzo de razonamiento dedica el modelo a la petición. Astra admite los niveles low, medium, high, xhigh y max. No admite el nivel none.

Ejemplo con JavaScript

javascript
import OpenAI from "openai"; const client = new OpenAI(); const response = await client.responses.create({ model: "gpt-6-astra", reasoning: { effort: "low" }, input: "Revisa esta función y explica cualquier problema de rendimiento." }); console.log(response.output_text);

Para aplicaciones de producción conviene empezar con un nivel de razonamiento moderado y medir calidad, latencia y coste antes de aumentar el esfuerzo. Las tareas sencillas no necesitan necesariamente la configuración más alta.

Qué cambia al migrar una aplicación a GPT-6 Astra

OpenAI identifica varios cambios que los desarrolladores deben revisar antes de sustituir un modelo anterior por Astra.

  • Utiliza gpt-6-astra como identificador del modelo.
  • Si utilizabas none o minimal como esfuerzo de razonamiento, OpenAI recomienda comenzar las pruebas con low.
  • Elimina temperature, top_p y top_logprobs, ya que Astra no admite estos parámetros.
  • En Chat Completions tampoco se admite logprobs.
  • Utiliza Responses API cuando la aplicación dependa de herramientas.
  • Revisa la configuración de caché si estás migrando desde GPT-5.5 o modelos anteriores.

Hasta 1,05 millones de tokens de contexto

GPT-6 Astra admite una ventana de contexto de 1.050.000 tokens y hasta 128.000 tokens de salida. Esto permite trabajar con repositorios, documentación o conjuntos extensos de información dentro de una misma operación, aunque una ventana mayor también puede incrementar el consumo y el coste.

OpenAI aplica además precios diferentes a las peticiones que superan determinados tamaños de entrada, por lo que utilizar todo el contexto disponible no debería ser la opción predeterminada si la tarea puede resolverse con menos información.

Cómo funcionan las llamadas asíncronas a herramientas

Una de las novedades de Astra es Async tool calling. Una herramienta declarada con async: true puede empezar a ejecutarse mientras el modelo continúa razonando, utilizando otras herramientas o resolviendo partes independientes de la tarea.

La aplicación sigue siendo responsable de ejecutar la herramienta. Cuando el resultado esté disponible, debe devolverlo utilizando el call_id original. Este sistema está pensado especialmente para operaciones que pueden tardar, como consultas a servicios externos o búsquedas complejas.

Qué es el mid-turn steering

Astra también permite modificar las instrucciones mientras una tarea está en ejecución. Mediante una conexión WebSocket, una aplicación puede enviar una nueva indicación antes de que termine el trabajo, por ejemplo para corregir un requisito o cambiar una condición.

La Responses API conserva el trabajo completado y continúa a partir de la nueva instrucción. Esta capacidad resulta especialmente relevante para agentes y tareas prolongadas en las que el usuario necesita intervenir sin reiniciar todo el proceso.

Cambiar el nivel de razonamiento durante una conversación

Las aplicaciones compatibles pueden utilizar un elemento configuration_update para modificar el esfuerzo de razonamiento durante una conversación. Así es posible aumentar el nivel para una tarea difícil y reducirlo posteriormente para operaciones rutinarias sin reescribir el prefijo original de la petición.

OpenAI recomienda este método cuando una aplicación cambia el nivel de razonamiento entre respuestas, ya que permite conservar mejor las ventajas de la caché del prompt.

Qué capacidades admite GPT-6 Astra

Además de las novedades específicas del modelo, Astra es compatible con funciones ya disponibles en generaciones anteriores, entre ellas:

  • Structured Outputs.
  • Streaming.
  • Computer use.
  • Programmatic Tool Calling.
  • Orquestación multiagente.
  • Prompt caching.
  • Persistencia del razonamiento.
  • Compaction para conversaciones extensas.

OpenAI recomienda utilizar ejecución de código como método principal para los nuevos proyectos de computer use con GPT-6 Astra, aunque la herramienta estructurada de control del ordenador continúa siendo compatible.

Precio de GPT-6 Astra en la API

La tarifa estándar publicada por OpenAI es de 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida. La entrada almacenada en caché tiene un precio inferior. Las peticiones con entradas superiores a 272.000 tokens utilizan una estructura de precios diferente para la solicitud completa.

Disponibilidad de GPT-6 Astra

OpenAI comenzó el lanzamiento con un grupo limitado de organizaciones y anunció una ampliación progresiva del acceso mediante la API y los planes compatibles de ChatGPT. Por ello, que el identificador gpt-6-astra aparezca en la documentación no garantiza que todas las cuentas tengan acceso inmediato.

Si una aplicación devuelve un error de acceso al intentar utilizar el modelo, conviene comprobar primero que GPT-6 Astra esté habilitado para el proyecto y la organización antes de modificar el código de integración.