OpenAI creó un modelo que escribe exploits y lo entregó a una breve lista de empresas
GPT-5.6-Cyber responde al 95 por ciento de las solicitudes de piratería avanzada, mientras que el modelo normal responde al 1,5 por ciento. Ya encontró una vulnerabilidad real en Chrome y más de 400 errores del kernel.
Tres días después de advertir que su próximo modelo podría alcanzar el nivel de riesgo cibernético más alto que ha definido, OpenAI envió un modelo de ciberseguridad de todos modos a una lista controlada de socios. GPT-5.6-Cyber está disponible a través de un nuevo nivel llamado Daybreak Red y está diseñado para hacer lo que todos los demás modelos rechazan: encontrar vulnerabilidades desconocidas y convertirlas en exploits que funcionen.
El programa de acceso ahora tiene dos niveles. Daybreak Blue ofrece a los defensores aprobados el modelo de frontera normal, GPT-5.6 Sol, con los filtros de seguridad habituales relajados para trabajos de seguridad legítimos, como análisis de malware, respuesta a incidentes y revisión de códigos. Daybreak Red agrega los modelos entrenados específicamente. La diferencia es marcada en los propios números de OpenAI: en una prueba interna de solicitudes avanzadas que cubren cadenas de exploits, omisión de autenticación y escalada de privilegios, GPT-5.6-Cyber completa el 95,0 por ciento, frente al 1,5 por ciento del modelo estándar y el 2,0 por ciento a través de Daybreak Blue. El modelo cibernético anterior logró el 57,3 por ciento.
Esto no es teórico. OpenAI usó el modelo en V8, el motor JavaScript dentro de Chrome, y encontró dos fallas previamente desconocidas que se encadenan para corromper la memoria y salir del sandbox del motor. Los investigadores los verificaron, los informaron a Google y Google envió una solución como CVE-2026-15903. La compañía también enumera al menos cinco vulnerabilidades en un popular sistema operativo móvil, tres críticas en una base de datos ampliamente utilizada y más de 400 errores de escalada de privilegios en el núcleo de un sistema operativo, todos ellos aún por revelar. Según el propio Preparedness Framework de OpenAI, el modelo tiene una calificación Alta para la capacidad cibernética, por debajo del umbral Crítico, aunque aún está por llegar una tarjeta de sistema completa.
El razonamiento detrás de esto es una carrera, y OpenAI lo dice claramente: los atacantes usarán IA para ataques automatizados, por lo que los defensores necesitan primero la misma potencia de fuego. Este argumento es genuinamente controvertido. Todo lo que encuentra un agujero más rápido también lo abre más rápido, y las salvaguardas aquí son de procedimiento más que técnicas: controles de identidad, monitoreo, certificaciones legales, restricciones de uso aprobadas y claves de seguridad de hardware obligatorias para cuentas individuales a partir del 1 de septiembre. OpenAI también aleja a los clientes de Daybreak que usan Codex del modo de acceso completo hacia la revisión automática, que verifica las acciones riesgosas antes de ejecutarlas. Los primeros socios incluyen SpecterOps, SentinelOne y Palo Alto Networks.
Qué significa esto para ti: nada que puedas usar, y eso es deliberado. No puedes conseguir este modelo y ningún chatbot de consumo te ayudará a escribir un exploit. La parte que vale la pena destacar es de segunda mano: si esto funciona como se anuncia, el software que ya ejecuta se parchea más rápido, porque una máquina ahora está leyendo el código del kernel en busca de errores a un ritmo que ningún equipo humano iguala. La otra cara de la moneda es que la misma capacidad se pierde con el tiempo, a través de modelos open weight o de un socio con controles débiles. Si se cuidan los sistemas en el trabajo, la acción práctica hoy en día es anticuada y poco glamorosa: parchear rápidamente, porque la ventana entre la detección de un error y su explotación es cada vez más corta.
Fuentes
Fuentes: https://openai.com/index/expanding-daybreak-as-the-cyber-defense-window-narrows/
OpenAI agrega un asiento de 125 dólares al negocio ChatGPT, porque los agentes comen mucho más que el chat
Cinco veces la capacidad, sin límite de cinco horas, cinco veces el precio. El asiento estándar se mantiene en 25 dólares y la división le indica qué cambió en la forma en que la gente usa estas herramientas.