Los modelos GPT-5.6 de OpenAI se lanzan públicamente este jueves
Tras semanas de acceso restringido, GPT-5.6 Sol, Terra y Luna de OpenAI llegan al público el jueves, con victorias frente a Claude Mythos 5 en las pruebas y precios notablemente inferiores.
La espera ha terminado: la familia GPT-5.6 de OpenAI, Sol, Terra y Luna, se lanza públicamente este jueves. Los modelos se presentaron a finales de junio, pero en un principio se limitaron a determinados socios mientras el Center for AI Standards and Innovation (CAISI) del Gobierno estadounidense realizaba pruebas de seguridad adicionales. Según Axios, el Departamento de Comercio ya ha autorizado su lanzamiento público.
Merece la pena examinar las cifras compartidas por OpenAI. En TerminalBench 2.1, una prueba que mide la capacidad de un modelo para abordar trabajos de programación reales en un terminal, el entorno de línea de comandos que utilizan los desarrolladores, GPT-5.6 Sol Ultra obtuvo un 91,9 por ciento y el Sol estándar, un 88,8 por ciento. Ambos superaron por poco a Claude Mythos 5 de Anthropic, con un 88,0 por ciento. Gemini 3.1 Pro Preview de Google quedó por detrás con un 70,7 por ciento. En tareas de ciberseguridad, según se informa, Sol igualó a Mythos 5 utilizando solo un tercio de los tokens, los pequeños fragmentos de texto que lee y escribe un modelo y por los que también pagas.
Ese último punto importa más que presumir de resultados. Sol cuesta $5 por millón de tokens de entrada y $30 por millón de tokens de salida. Fable 5 de Anthropic cuesta casi el doble, $10 y $50, y al parecer tiende además a utilizar más tokens para el mismo trabajo. Si estas afirmaciones sobre eficiencia se confirman en la práctica, la diferencia de costes real podría ser aún mayor de lo que sugiere la lista de precios.
Esto es lo que hay detrás de un proceso de lanzamiento tan poco habitual: GPT-5.6 es el primer gran modelo que pasa por una revisión gubernamental antes de llegar al público. OpenAI criticó abiertamente la paralización y argumentó que privaba a los desarrolladores de las mejores herramientas. El modelo más capaz de Anthropic pasó recientemente por un proceso parecido. Lo que todavía no existe es un conjunto de normas vinculantes que determine cuándo y cómo deben realizarse estas revisiones. Por ahora se decide caso por caso, y eso es precisamente lo que frustra a los laboratorios.
Qué significa esto para ti: Si utilizas ChatGPT, cabe esperar que los nuevos modelos aparezcan poco después del jueves, probablemente con mejoras apreciables en programación y tareas de varios pasos. Si desarrollas sobre la API, el titular son los precios: un modelo de primera línea a la mitad de la tarifa de Anthropic ejerce una presión real sobre el mercado, y esa presión suele terminar beneficiando a los usuarios. Una salvedad razonable: las pruebas de la semana de lanzamiento proceden de la propia empresa. Espera a las evaluaciones independientes antes de reorganizar tus herramientas.
Fuentes
Microsoft sustituye discretamente a OpenAI y Anthropic en Copilot para reducir costes
Los modelos MAI propios de Microsoft están sustituyendo a OpenAI y Anthropic en Excel y Outlook; los clientes podrían recibir una IA menos capaz por el mismo precio de suscripción.