Gemini 3.8 Flash de Google mantiene el precio anterior y trae un Cyber Twin
Google DeepMind lanzó Gemini 3.8 Flash el 2 de septiembre a 0,75 dólares por millón de tokens de entrada, sin cambios desde 3.7 Flash. Una variante cibernética separada para encontrar vulnerabilidades y parchear está dirigida únicamente a defensores examinados.
Google DeepMind lanzó Gemini 3.8 Flash el miércoles pasado, su tercer lanzamiento Flash en seis semanas. El discurso es inusualmente claro: la misma velocidad y el mismo precio que 3.7 Flash, con mejor razonamiento y codificación. La entrada cuesta 0,75 dólares por millón de tokens, la producción 3,75 dólares, y esa es una tasa introductoria que vence el 31 de diciembre de 2026. A partir del 1 de enero, esas cifras se duplican a 1,50 dólares y 7,50 dólares.
Google informa avances en ingeniería de software a largo plazo, es decir, tareas en las que un modelo tiene que seguir trabajando en un problema en muchos pasos en lugar de responder de una sola vez. Obtiene una puntuación del 54,9% en HLE-Verified, una dura prueba de razonamiento de múltiples temas, y Google dice que 3.8 Flash supera a los modelos más grandes y caros en DeepSWE v1.1. Hay una advertencia honesta en la propia publicación de Google: 3.8 Flash “trabaja más duro”, ejecuta pasos de razonamiento adicionales y llama a herramientas repetidamente, lo que significa que puede quemar más tokens que 3.7 Flash en el mismo trabajo. Google les dice explícitamente a los desarrolladores que más se preocupan por el costo que permanezcan en 3.7 Flash o reduzcan el nivel de esfuerzo.
El segundo modelo es el interesante. Gemini 3.8 Flash Cyber está optimizado para encontrar vulnerabilidades de software y escribir parches para ellas, y no está disponible de manera general. El acceso se realiza a través de un nuevo Programa Fairwind dirigido a organismos gubernamentales, operadores de infraestructura crítica y mantenedores de software. Google dice que priorizó deliberadamente corregir fallas antes que explotarlas. Algunos resultados concretos: el equipo de seguridad de Chrome informó 2,6 veces más parches correctos que los de modelos comerciales mucho más grandes, y el equipo de vulnerabilidad de la nube de Google dice que encontró un error fundamental crítico en menos de dos horas, un trabajo que normalmente llevaría meses. En CWE-Bench, un punto de referencia de parcheo externo, obtiene una puntuación del 47,2% frente al 47,8% de un modelo líder, a una fracción del costo.
El patrón detrás de la división. Dos laboratorios en dos días han enviado un modelo público más un hermano cibernético cerrado. La razón es que la misma habilidad se lee en ambos sentidos: un modelo lo suficientemente bueno como para encontrar el agujero en su código es lo suficientemente bueno como para encontrar el agujero en el de otra persona. En lugar de elegir entre enviarlo a todos o a nadie, ambas empresas han creado un nivel intermedio con un formulario de solicitud. Google también informa de un gran aumento en la resistencia a la inyección de prompts, el truco mediante el cual instrucciones ocultas en una página web o documento secuestran un modelo que lo está leyendo. Podría decirse que esta es la mejora de seguridad más útil para los usuarios comunes, ya que la inyección de prompts es el modo de falla que es más probable que encuentre.
Qué significa esto para ti. Si usas la aplicación Gemini en un plan Pro o Ultra, 3.8 Flash ya está disponible y en modo AI en la Búsqueda y en Google Sheets. Para la mayoría de las preguntas cotidianas no lo notarás. Si construye con la API, tenga en cuenta el calendario: el precio al que se registra hoy se duplica en enero, por lo que presupuestará el número de 2027 en lugar del actual. Y si ejecuta una infraestructura de la que depende la gente, el Programa Fairwind está abierto a solicitudes, que es una opción genuinamente nueva que no existía hace un año.
Fuentes
OpenAI envía GPT-6 Astra y lo llama su primer modelo cibernético crítico
OpenAI lanzó GPT-6 Astra el 3 de septiembre con una ventana de contexto de 1,1 millones de tokens a 10 dólares por millón de tokens de entrada y 50 dólares por millón de salida. Es el primer modelo que, según la compañía, cumple con su umbral crítico de ciberseguridad.