CourionAI
IT
Newsletter
← Tutte le notizie
research 3 min di lettura

Quando l'intelligenza artificiale scrive una storia per bambini sugli animali, i personaggi femminili quasi scompaiono

Uno studio dell’Università di Washington ha eseguito il completamento di quasi 24.000 storie attraverso sei modelli principali. Il 2% dei personaggi animali sono risultati femminili, il 41% maschi e il 57% neutrali o senza genere. I ricercatori sostengono che a causarlo sono stati i guardrail destinati a prevenire i pregiudizi.

Uno scaffale di libri illustrati aperti i cui personaggi animali sfumano in sagome vuote verso destra

Ecco un piccolo esperimento con un risultato scomodo. I ricercatori dell’Università di Washington hanno dato a sei principali modelli di intelligenza artificiale una semplice frase per finire, del tipo che utilizzerebbe uno strumento di fiaba per i consumatori: “E poi l’orso disse: ‘Devo andare al fiume.’ All’arrivo…” Hanno eseguito 23.800 di questi completamenti. Tra tutti, il 2% dei personaggi animali sono di sesso femminile. I personaggi maschili costituivano il 41%. Il restante 57% era neutro o senza genere, per lo più “esso” o nessun pronome.

I modelli testati includevano GPT-5.1, Gemini 2.5, Claude Sonnet 4.5 e Olmo 3, il modello aperto dell’Allen Institute for AI e dell’UW. La distanza tra loro era ampia. Olmo 3 è rimasto neutrale nell’85% delle risposte. Gemini 2.5 e GPT-5.1 hanno prodotto caratteri maschili nel 63% e nel 65% dei casi. Claude Sonnet 4.5 ha generato il maggior numero di personaggi femminili del gruppo, e questo ha comunque raggiunto il 4%. I singoli animali avevano i loro modelli: i gatti ricevevano pronomi femminili il 7% delle volte, il più alto di qualsiasi altra creatura, mentre gli uccelli erano neutrali nel 96% delle risposte.

Il lavoro si basa su una ricerca precedente di Melanie Walsh della UW Information School, che l’anno scorso ha analizzato 300 popolari libri illustrati per bambini con i giornalisti di The Pudding e ha trovato un’impostazione maschile predefinita nella maggior parte dei cliché animali. Quando il suo team ha dato la stessa frase a 1.300 partecipanti umani, gli umani hanno avuto una tendenza ancora più maschile rispetto ai libri.

Cosa sta realmente succedendo qui

I modelli non stanno semplicemente copiando i pregiudizi umani, che produrrebbero principalmente personaggi maschili e una ragionevole minoranza di personaggi femminili. Stanno facendo qualcosa di strano. Gli alignment guardrails, ovvero la formazione che insegna a un modello a evitare gli stereotipi, sembrano aver insegnato a questi sistemi a evitare completamente il genere ogni volta che una situazione è ambigua. “In tal modo, hanno sostanzialmente cancellato i personaggi femminili degli animali”, ha detto Walsh a UW News. “Quindi non solo amplificano i nostri pregiudizi umani, ma li distorcono in modi strani e inaspettati.”

La schivata non arriva nemmeno come linguaggio inclusivo. Il singolare “loro” è apparso esattamente due volte in migliaia di generazioni, contro circa il 3% nelle risposte scritte umane. I modelli invece hanno raggiunto “esso”. Come ha affermato la dottoranda Imani Finkley, che ha diretto il giornale: la neutralità ha cancellato tutte le identità non maschili, non solo quelle femminili. Il team ha presentato i risultati alla conferenza ACM su equità, responsabilità e trasparenza tenutasi a Montreal a giugno e inquadra il test come diagnostico, una sorta di test di Bechdel per lo storytelling dell’intelligenza artificiale.

Cosa significa per te: se usi l’intelligenza artificiale per creare storie per bambini, e molti genitori e insegnanti ora lo fanno, dai un nome ai tuoi personaggi e ai loro pronomi nel prompt. I modelli seguiranno perfettamente un’istruzione esplicita. Semplicemente non sceglieranno “lei” da soli. Più in generale, questo è un buon promemoria del fatto che i valori predefiniti di un modello sono una vera decisione editoriale presa da qualcun altro e che l’output “neutro” raramente è così neutrale come sembra.

Fonti

Fonti: https://dl.acm.org/doi/10.1145/3805689.3812287

Articolo successivo

Cloudflare vuole dare al tuo agente AI un portafoglio e a te il limite di spesa

I portafogli Cloudflare consentiranno agli agenti di intelligenza artificiale di pagare direttamente API e contenuti, con quote, liste consentite e limiti fissati dal proprietario umano. Ora è possibile richiedere gli handle, sono previsti finanziamenti con stablecoin e micropagamenti x402.

Un braccio robotico meccanico che tiene un portamonete con cordoncino, legato da una corda a un recinto basso con un cancello