Anthropic ha messo in funzione il suo modello più limitato scansionando il codice alla ricerca di bug. Un essere umano deve ancora approvare ogni correzione
Claude Security ora funziona su Mythos 5, il modello Anthropic non viene rilasciato perché è troppo bravo nelle attività informatiche. È in versione beta pubblica per i clienti Enterprise e anche i partner che proteggono ospedali e banche possono accedervi.
Anthropic ha spostato il suo strumento di scansione dei codici, Claude Security, su Mythos 5. Ciò è degno di nota soprattutto per il modello che si tratta: Mythos è il modello più capace di Anthropic ed è deliberatamente non ampiamente disponibile, in particolare perché è così potente nelle attività informatiche. La società ha annunciato il cambiamento il 21 agosto.
Lo strumento in sé è semplice. Legge una base di codice, cerca vulnerabilità e suggerisce patch. Ogni risultato viene fornito con una categoria CWE, che è un modo standard del settore per classificare un tipo di difetto del software in modo che diversi strumenti descrivano lo stesso problema allo stesso modo, oltre a un livello di gravità e una soluzione proposta. È in versione beta pubblica per i clienti Enterprise e le scansioni contano come utilizzo normale del token anziché come prodotto separato.
Il dettaglio importante si trova alla fine: un essere umano deve ancora approvare ogni patch. Anthropic non consente al modello di apportare modifiche al codice da solo.
L’asimmetria che questo dovrebbe risolvere
Gli aggressori hanno accesso a un’intelligenza artificiale capace ormai da un po’ di tempo e non devono affrontare alcun processo di approvazione, nessuna revisione della conformità e nessuna conseguenza per un suggerimento errato. I difensori li affrontano tutti e tre. Questa lacuna è la ragione per cui un laboratorio prenderebbe il suo modello più stretto e lo punterebbe specificamente alla difesa. Anthropic sta inoltre collegando Mythos 5 ai prodotti di sicurezza dei partner che proteggono ospedali, servizi pubblici e banche, dove gli utenti finali non toccano mai direttamente il modello e vedono solo l’output, come una patch suggerita.
Quella struttura è la vera politica qui. Invece di rilasciare un potente modello informatico e sperare che venga utilizzato bene, Anthropic lo tiene dietro un cancello e lo distribuisce solo attraverso canali difensivi. Se ciò sia vero è una questione aperta. Qualsiasi capacità abbastanza forte da trovare una vulnerabilità è abbastanza forte da sfruttarla, e un cancello è valido tanto quanto le persone che lascia passare. Ma è un tentativo coerente di affrontare un problema veramente difficile, e più ponderato della semplice pubblicazione dei pesi e delle speranze.
Da segnalare la tempistica. Ciò avviene la stessa settimana in cui i ricercatori hanno dimostrato un attacco Grok senza patch che nascondeva istruzioni crittografate all’interno di una pagina Web e giorni dopo che Microsoft ha rilasciato una soluzione per un difetto di furto di dati di Copilot con un clic di cui era a conoscenza da otto mesi. La sicurezza dell’intelligenza artificiale è attualmente una storia di difensori che stanno recuperando terreno.
Che cosa significa per te: Se non scrivi codice, questo è un background, ma un background utile: la storia della sicurezza dell’IA non riguarda solo gli attacchi e parte del lavoro difensivo è reale. Se scrivi codice o gestisci una piccola azienda che lo fa, il modello da copiare è la fase di approvazione. Lasciare che un modello trovi e proponga, non lasciarlo mai applicare. Questa singola regola è ciò che distingue uno scanner utile da una nuova superficie di attacco e non ti costa nulla applicarla.
Fonti
Fonti: https://claude.com/blog/bringing-claude-mythos-5-to-more-defenders
Anthropic ha conservato i tuoi dati per 30 giorni per dare la caccia agli aggressori. Dopo il pushback aziendale, rimarrà invece nel tuo cloud
La finestra di 30 giorni rimane, ma i dati vengono spostati nel cloud del cliente. Anthropic ha trascorso mesi a costruire il sistema con più di 100 clienti provenienti da settori regolamentati e ammette che la regola originale era un rischio aziendale.