Un modelo de próxima generación
Iniciamos una vista previa limitada de la serie GPT‑5.6: Sol, nuestro modelo insignia; Terra, un modelo equilibrado para el trabajo cotidiano; y Luna, un modelo rápido y asequible. Terra ofrece un rendimiento competitivo frente a GPT‑5.5 y cuesta la mitad, mientras que Luna brinda una capacidad sólida a nuestro costo más bajo.
GPT‑5.6 Sol se lanza con nuestro sistema de seguridad por capas más sólido hasta la fecha. Reforzamos las protecciones para actividades de mayor riesgo, solicitudes sensibles de ciberseguridad y uso indebido repetido, y dedicamos varias semanas a encontrar debilidades, someter nuestro sistema a pruebas de resistencia y fortalecerlo frente a ataques del mundo real.
Creemos en el acceso amplio y planeamos poner GPT‑5.6 Sol, Terra y Luna a disposición general en las próximas semanas. Como parte de nuestra colaboración continua con el gobierno de EE. UU., presentamos un adelanto de nuestros planes y de las capacidades de los modelos antes del lanzamiento de hoy. A solicitud del gobierno, comenzamos con una vista previa limitada para un pequeño grupo de socios de confianza cuyos nombres se compartieron con el gobierno, antes de un lanzamiento más amplio. Durante esta vista previa, seguiremos probando y coordinando estrechamente con estos socios mientras avanzamos hacia una disponibilidad general. No creemos que este tipo de proceso de acceso gubernamental deba convertirse en la norma a largo plazo. Mantiene las mejores herramientas fuera del alcance de usuarios, desarrolladores, empresas, defensores de la ciberseguridad y socios globales que las necesitan. Estamos dando este paso de corto plazo porque creemos que es la forma más sólida de avanzar hacia una disponibilidad general en las próximas semanas, mientras trabajamos con la Administración para desarrollar el marco de la Orden Ejecutiva sobre ciberseguridad y un proceso repetible para futuros lanzamientos de modelos.
GPT‑5.6 Sol es nuestro modelo más potente hasta ahora. Para ofrecer una vista previa del rendimiento del modelo, compartimos un conjunto de evaluaciones que destacan mejores capacidades agénticas en programación, biología y ciberseguridad, con evaluaciones adicionales de seguridad y preparación disponibles en nuestra tarjeta del sistema(se abre en una nueva ventana). Compartiremos un conjunto ampliado de resultados de evaluación cuando pongamos el modelo a disposición general.
Con GPT‑5.6, presentamos un nuevo nivel de esfuerzo de razonamiento `max` para darle a Sol el mayor tiempo posible para razonar en profundidad. Además, presentamos un nuevo modo `ultra` que va más allá de las capacidades de un solo agente al aprovechar subagentes para acelerar tareas complejas.
Para flujos de trabajo de programación, GPT‑5.6 Sol marca un nuevo estándar en Terminal‑Bench 2.1, que evalúa flujos de trabajo en la línea de comandos que requieren planificación, iteración y coordinación de herramientas.