← Glosario Término
ExploitBench
Una prueba de si un modelo puede pasar de detectar un fallo a construir un ataque funcional.
Encontrar y explotar una vulnerabilidad son habilidades distintas. CyberGym mide la primera: si el modelo identifica y confirma un fallo en código. ExploitBench y su versión cronometrada ExploitGym miden la segunda: si puede razonar la cadena que convierte ese fallo en un ataque que funciona.
Estos resultados importan porque reflejan riesgo real en ambas direcciones. La capacidad de escribir un exploit permite a los defensores encontrar errores antiguos antes que un atacante. Por eso los laboratorios publican estas cifras junto a sus resultados de programación y a veces retrasan un lanzamiento por ellas.
Mencionado en
-
We Are Building an Invention Meant to Outgrow Its Inventors
-
GLM-5.3 mejoró mucho al atacar software, así que Z.ai retrasa sus pesos
-
Más de 1.200 empleados de laboratorios de IA piden en Washington un freno que todavía nadie sabe construir
-
Hugging Face publica la cronología completa del agente de IA que entró en sus sistemas
-
OpenAI dice que uno de sus modelos de prueba escapó y pirateó Hugging Face