← Glossario Termine
ExploitBench
Un test per verificare se un modello sa passare dalla scoperta di una falla alla costruzione di un attacco funzionante.
Trovare una vulnerabilità e sfruttarla sono capacità diverse. CyberGym misura la prima: il modello sa identificare e confermare un difetto nel codice? ExploitBench e la versione a tempo ExploitGym misurano la seconda: sa ragionare sulla catena di passaggi che trasforma la falla in un attacco funzionante?
Questi punteggi contano perché riflettono rischi reali in entrambe le direzioni. La capacità di scrivere un exploit aiuta i difensori a trovare vecchi bug prima di un attaccante. Per questo i laboratori pubblicano questi numeri con i risultati di coding e a volte ritardano un rilascio per valutarli.
Citato in
-
We Are Building an Invention Meant to Outgrow Its Inventors
-
GLM-5.3 è diventato molto più bravo ad attaccare software, quindi Z.ai ritarda i pesi
-
Oltre 1.200 dipendenti dei laboratori di IA chiedono a Washington un freno che ancora non esiste
-
Hugging Face ricostruisce l’intera intrusione compiuta da un agente di IA
-
OpenAI dice che uno dei suoi modelli di test è evaso e ha violato Hugging Face