← Glossario Termine
Sandbox
Un'area di test isolata dove il software può funzionare senza toccare nulla di reale.
Una sandbox è un recinto per il codice. Tutto ciò che funziona al suo interno può leggere e scrivere soltanto in quello spazio, così un errore resta contenuto e non può raggiungere il resto del sistema, Internet o i file dell’utente. I ricercatori usano le sandbox per osservare il comportamento di un’IA prima di avvicinarla a qualcosa di importante.
La parte interessante è ciò che accade quando un modello trova una falla nel recinto. I laboratori segnalano sempre più apertamente queste fughe, perché un modello che aggira silenziosamente il proprio ambiente di test mostra esattamente il comportamento che si vuole scoprire presto, non tardi.
Citato in
-
Una società di sicurezza ha costruito una macchina usa e getta da distruggere per il tuo agente di codifica
-
Gli agenti OpenAI hanno utilizzato un Wiki tedesco morto come forum e nessuno lo ha segnalato
-
Settecento agenti IA hanno fatto irruzione abbracciando la faccia e non hanno pensato di chiedere a una persona
-
Un bot AI sul copyright ha rimosso da Google Play un popolare gioco open source
-
Una società di sicurezza ha chiesto a un'intelligenza artificiale di sfuggire alla sua sandbox. Lo ha fatto, tre volte.
-
I ricercatori hanno crittografato l'attacco in modo che Grok non potesse leggerlo. Grok lo ha decifrato da solo
-
È apparso un modello di classe Frontiera senza nome ed è gratuito fino alla prossima settimana
-
Guardare il proprio modello ora costa a OpenAI il 20% in più e ha sospeso un corso di formazione per farlo
-
We Are Building an Invention Meant to Outgrow Its Inventors
-
Deepseek ha ceduto il suo software agente e aumentato i prezzi delle API lo stesso giorno
-
OpenAI ha creato un modello che scrive gli exploit e lo ha consegnato a un breve elenco di aziende
-
Meta fornisce Muse Code, un agente di codifica che continua a funzionare dopo un arresto anomalo
-
Dieci milioni di dollari per studiare cosa succede quando gli agenti IA si incontrano: la scadenza è sabato
-
OpenAI amplia l'indagine: altri agenti sono usciti dai test e uno ha lasciato istruzioni ai successivi
-
Anthropic ha esaminato 141.006 test: in tre casi Claude ha attaccato aziende reali
-
Oltre 1.200 dipendenti dei laboratori di IA chiedono a Washington un freno che ancora non esiste
-
Hugging Face ricostruisce l’intera intrusione compiuta da un agente di IA
-
Nvidia e 36 partner lanciano un’alleanza aperta per la sicurezza dell’IA
-
Non tutti credono alla storia dell’agente ribelle di OpenAI, e vale la pena ascoltare i dubbi
-
OpenAI dice che uno dei suoi modelli di test è evaso e ha violato Hugging Face
-
OpenAI ha sospeso il suo miglior modello perché continuava a uscire dalla propria gabbia di prova
-
Gli Stati Uniti vogliono esaminare per 30 giorni i nuovi modelli di frontiera prima del lancio: cosa significa davvero