GPT-6 Astra es el flagship de OpenAI anunciado el 3 de septiembre de 2026. El ID de API es gpt-6-astra, la ventana de contexto llega a 1.050.000 tokens y el precio estándar es 10 $ por millón de tokens de entrada y 50 $ de salida. OpenAI no ha publicado el número de parámetros.

Tres cosas cambian de verdad respecto a GPT-5.6 Sol: uso de ordenador más rápido, un salto en ciencia y matemáticas, y un modelo que OpenAI presenta como el más alineado de su familia. El índice agregado de inteligencia no lo gana: ahí sigue por delante Claude Fable 5.1.

Resumen

  • 10 $ / 50 $ por millón de tokens (entrada / salida); contexto de 1,05 millones; ID de API gpt-6-astra.
  • OpenAI no publica el número de parámetros. El rumor de ~10 billones en MoE es rumor, no ficha.
  • Computer use más rápido: 72,6 % en OSWorld 2.0 en unos 40 min, frente a 65,7 % / ~75 min de Sol.
  • Satura ARC-AGI-3 (99,9 %) y FrontierMath Tier 4 (97,6 %). En el índice agregado, Fable 5.1 sigue delante (65,7 vs 61,2).
  • Salida el 3 de septiembre de 2026 para empresas Trusted Access. En Enterprise nace desactivado.

Qué es GPT-6 Astra

GPT-6 Astra es el modelo de frontera de OpenAI para trabajo de extremo a extremo: razonar, programar, usar el ordenador, investigar y producir documentos. Acepta texto e imagen; responde en texto. El corte de conocimiento es el 30 de abril de 2026.

OpenAI lo posiciona como el modelo «más inteligente y alineado» de su catálogo. En la práctica, el anuncio se centra en agentes que operan software real —navegador, terminal, CAD, CRM, hojas de cálculo— no en un chat más elocuente.

El despliegue empezó el 3 de septiembre de 2026 para empresas del Trusted Access Program. En los días siguientes llega a ChatGPT Plus, Pro, Business y Enterprise, a la API, a Microsoft Azure y a Amazon Bedrock.

Si ya montas agentes en producción, el modelo sube el techo; el harness sigue decidiendo si llegas a él.

Ficha técnica

Cifras de la ficha del modelo en la API:

CampoValor
ID de APIgpt-6-astra
Ventana de contexto1.050.000 tokens
Salida máxima128.000 tokens
Corte de conocimiento30 abril 2026
EntradaTexto e imagen
SalidaTexto
reasoning.effortlow, medium, high, xhigh, max
Fine-tuningNo
EndpointsResponses API y Chat Completions (las herramientas van por Responses)

Prompts de más de 272.000 tokens de entrada se facturan a tarifa de contexto largo (el doble en input/caché y 1,5× en output) para toda la petición, no solo el tramo extra.

Cuántos parámetros tiene

OpenAI no ha publicado el recuento de parámetros de GPT-6 Astra. Ni en el anuncio, ni en la ficha de API, ni en la system card.

Circula un rumor de ~10 billones de parámetros en arquitectura Mixture-of-Experts. Eso no es una cifra oficial: no hay paper ni model card que la respalde. Trátalo como señal de escala, no como dato de hoja de producto.

Lo que sí está medido es el comportamiento en contexto largo: en OpenAI MRCR v2 (8 agujas), Astra marca 100 % entre 256K y 512K tokens y 96,3 % entre 512K y 1M, frente a 91,5 % y 73,8 % de GPT-5.6 Sol.

Si comparas con open weights, el contraste es otro mundo: Kimi K3 sí declara 2,8 billones. Astra es cerrado; el tamaño no es el argumento que puedes auditar.

Precio de la API

Precios oficiales de OpenAI, en USD por millón de tokens:

ConceptoEstándar (≤272K input)Contexto largo (>272K input)
Input10,00 $20,00 $
Input en caché1,00 $2,00 $
Escritura de caché12,50 $25,00 $
Output50,00 $75,00 $

Más modos:

ModoQué implica
Batch y Flex50 % de la tarifa aplicable
Fast (service_tier: "fast")2× la tarifa aplicable; OpenAI no da SLA de latencia
Residencia de datos en la UEFast y Priority no están disponibles

En ChatGPT, el uso de Astra entra en las cuotas de la suscripción; se pueden comprar créditos extra. Los planes Pro, Business y Enterprise también reciben GPT-6 Astra Pro. En Enterprise, el administrador tiene que activarlo: va desactivado por defecto.

La etiqueta es cara frente a GPT-5.6 Sol (~5 $/30 $). OpenAI sostiene que el coste por tarea puede bajar porque Astra gasta menos tokens de salida. En Agents’ Last Exam, a la mejor configuración, usa ~65 % menos output que Claude Opus 5. En BenchCAD, el coste estimado queda ~43 % por debajo de Sol y ~86 % por debajo de Fable 5.1 en las configuraciones que muestran.

La lectura práctica: no compares solo el precio por millón. Mide tokens de salida y reintentos en tu harness. Un modelo más caro que termina a la primera sale más barato que uno barato que da tres vueltas.

Novedades que trae

Uso de ordenador más rápido

OpenAI presenta Astra como su mejor modelo de computer use: rellenar formularios, actualizar un CRM, investigar en el navegador, instalar software y comprobar una web. En OSWorld 2.0 (subset offline) marca 72,6 % en unos 40 minutos por tarea, frente a 65,7 % de Sol en unos 75 minutos. Eso es ~47 % menos tiempo con mejor nota.

Junto al modelo, actualizan el harness de Codex. En Mind2Web, OpenAI cifra 1,9× más rapidez de cierre de tarea respecto a la experiencia actual con Sol.

En el anuncio, el clip de 15 segundos condensa el layout de una placa: coloca componentes y ruta pistas a partir de un esquemático. El mensaje no es «hace PCB de juguete»; es que el cuello de botella de un flujo profesional pasa a ser revisable por un agente.

Notas de Codex entre ventanas de contexto

Hasta ahora, cuando se llena el contexto, los modelos compactan: resumen y tiran detalle. Astra, en Codex, puede guardar notas y seguir buscando en ventanas anteriores —requisitos, tests, por qué falló un arreglo— aunque no estuvieran en el resumen. OpenAI lo marca como experimental en config.toml y dice que será el valor por defecto para Astra en las próximas semanas.

Trabajo profesional y Sites

En BenchCAD (reconstruir un objeto 3D a partir de renders generando código CAD) Astra llega a 95,9 % de solape geométrico, frente a 83,3 % de Sol. OpenAI también lo entrena para respetar plantillas de slides, documentos y hojas, y para no copiar contexto de más.

Con Sites en ChatGPT, Astra puede crear, alojar y compartir webs, apps y juegos desde un prompt.

Cuando faltan datos, OpenAI dice que Astra rellena huecos rutinarios, pregunta si la respuesta cambiaría el resultado y, en Codex, puede preguntar en asíncrono mientras sigue con lo que no depende de ti.

Alineación y ciber

Astra es, según OpenAI, su modelo más alineado. En una eval inspirada en el incidente de Hugging Face, Sol (sin salvaguardas de producción) se salió del objetivo autorizado el 48 % de las veces; Astra, el 0 %. En el honeypot de ExploitGym (menor es mejor): Sol 48,2 %, Astra 0,0 %.

En ciberseguridad, OpenAI declara que Astra alcanza el umbral Critical de su Preparedness Framework. En ExploitBench marca 100 % (Sol 78,5 %). La versión que sale a producción se niega a crear pruebas de concepto de exploits; OpenAI planea abrir flujos defensivos más amplios vía Daybreak. Detalle de salvaguardas: actualización de seguridad Path to Astra.

No es un tutorial de ataque. Es un cambio de capacidad que obliga a tratar el modelo como sistema con permisos, no como chat.

Benchmarks

Cifras del anuncio oficial. OpenAI reporta el máximo a cualquier esfuerzo. Las evals de GPT se corrieron en su entorno de investigación o vía API, no necesariamente con el system prompt de ChatGPT.

Computer use y trabajo profesional

EvalGPT-6 AstraGPT-5.6 SolClaude Fable 5.1Claude Opus 5
Agents’ Last Exam59,3 %53,6 %55,5 %
OSWorld 2.0 (offline, parcial)72,6 %65,7 %70,2 %
ScreenSpot-Pro (sin tools)92,7 %76,9 %
AutomationBench41,4 %18,1 %31,4 %26,9 %
BenchCAD95,9 %83,3 %84,3 %82,1 %
BrowseComp91,5 %90,4 %90,8 %

Coding, ciencia y razonamiento

EvalGPT-6 AstraGPT-5.6 SolClaude Fable 5.1Claude Opus 5
Terminal-Bench 4.057,9 %37,3 %55,8 %52,3 %
DeepSWE v1.174,1 %72,7 %67,4 %73,7 %
FrontierCode 1.1 Extended64,5 %60,6 %63,6 %63,6 %
GPQA Diamond96,0 %94,6 %93,7 %93,7 %
FrontierMath Tier 4 (v2)97,6 %83,0 %87,8 %73,2 %
Terminal-Bench Science 0.164,6 %22,4 %52,6 %30,0 %
ARC-AGI-399,9 %7,8 %30,2 %
AA Intelligence Index v4.1.161,260,965,763,1
AA Coding Agent Index v1.467,065,168,1

Lectura corta: Astra satura ARC-AGI-3 y FrontierMath Tier 4, y abre un hueco enorme en flujos científicos de terminal (64,6 % vs 22,4 % de Sol). En el índice agregado de Artificial Analysis no lidera. Si tu trabajo es computer use, ciencia o mates difíciles, el anuncio encaja. Si eliges modelo por un ranking único, Fable 5.1 y Opus 5 siguen en la conversación.

En matemáticas, OpenAI dice que Astra ayudó a bajar el bound de pares de primos infinitos de 240 a 186, y a mejorar un término de gaps grandes que llevaba más de 80 años quieto. Pruebas: gaps cortos y gaps largos.

Disponibilidad

CanalEstado al anuncio
Trusted Access (empresas)Disponible el 3 de septiembre de 2026
ChatGPT Plus / Pro / Business / EnterpriseEn los días siguientes
API (gpt-6-astra)En los días siguientes
Azure y Amazon BedrockConfirmados en el anuncio
GPT-6 Astra ProPlanes Pro, Business y Enterprise
Zero Data RetentionClientes API elegibles

La guía de modelo de OpenAI pide: si hoy usas none o minimal de esfuerzo, empieza en low. Fast mode no va con residencia UE. Más detalle en la guía del modelo.

Qué implica para tu stack

  1. No sustituyas Sol en bloque el día 1. Astra cuesta el doble en input. Enruta las tareas de computer use, CAD, ciencia y refactors largos; deja el volumen en Terra, Luna o un open.
  2. El harness importa más, no menos. Notas en Codex, Auto-review y computer use nativo son pieza de producto, no magia del peso. Si tu agente vive en MCP y tests, el salto se nota; si es un chat con pegamento, pagas 10/50 por el mismo teatro.
  3. La ciber del modelo no es tu política. OpenAI pone frenos en producción. Tú sigues decidiendo qué herramientas, qué red y qué datos toca el agente.

Si estás eligiendo stack de agentes para la empresa, empieza por el flujo —automatizaciones— y luego el modelo. Astra no arregla un proceso que aún vive en copiar y pegar.

Qué interesante se está poniendo esto.

Preguntas frecuentes

¿Cuántos parámetros tiene GPT-6 Astra?

OpenAI no ha publicado el número. El rumor de unos 10 billones en MoE no está en la ficha oficial ni en la system card. Lo medible hoy es la ventana de 1,05 millones de tokens y los benches de contexto largo, no el recuento de pesos.

¿Cuánto cuesta la API de GPT-6 Astra?

10 $ / M tokens de input, 1 $ si hay acierto de caché, 12,50 $ al escribir caché y 50 $ / M de output. Por encima de 272K tokens de entrada, esas tarifas suben a 20 / 2 / 25 / 75 $ para toda la petición. Batch y Flex van a mitad; Fast, al doble.

¿GPT-6 Astra es mejor que GPT-5.6 Sol?

En computer use, ciencia de terminal, ARC-AGI-3 y FrontierMath, sí, con margen. En el Artificial Analysis Intelligence Index, Fable 5.1 sigue por encima (65,7 vs 61,2). «Mejor» depende de la tarea: evalúa con tu harness, no con un único ranking.

¿Puedo usarlo ya en ChatGPT y en la API?

El 3 de septiembre de 2026 salió primero para empresas del Trusted Access Program. OpenAI dijo que Plus, Pro, Business, Enterprise, la API, Azure y Bedrock llegarían en los días siguientes. En Enterprise hay que activarlo; nace apagado.

¿Qué hay de nuevo respecto a la familia GPT-5.6?

Computer use más rápido, esfuerzo xhigh y max, notas persistentes en Codex, mejor respeto de plantillas profesionales, Sites en ChatGPT y un salto declarado en alineación y capacidades ciber. El precio por token sube; OpenAI apuesta a que el coste por tarea baje.


Publicado el 4 de septiembre de 2026. Precios, ficha y benches según GPT-6 Astra de OpenAI y la documentación de API. El recuento de parámetros no está publicado; el rumor de ~10T se marca como rumor.

Artículos relacionados