Un'altra società Big Four ha pubblicato rapporti con fonti inesistenti
GPTZero ha trovato riferimenti inventati in quattro rapporti di PwC Middle East. Per uno di questi stima una probabilità dell'84% che sia stato generato interamente dall'IA. KPMG, Deloitte ed EY avevano già avuto problemi simili.
Dopo KPMG, ora tocca a PwC. GPTZero, azienda specializzata nel rilevamento di contenuti artificiali, sostiene di aver trovato fonti inventate e affermazioni false in quattro rapporti pubblicati da PwC Middle East fra il 2024 e il 2026. Nel caso peggiore, un documento intitolato «Transforming Governance», lo strumento di GPTZero stima all’84% la probabilità che l’intero testo sia stato generato dall’IA. Il rapporto promuove un prodotto chiamato «Citizen Pulse» e afferma che venga usato dai governi di Danimarca, Arabia Saudita, Stati Uniti e Australia. GPTZero non ha trovato prove a sostegno.
Lo schema descritto merita un nome, e GPTZero lo chiama «vibe citing». Le fonti vengono aggiunte con leggerezza, spesso con titoli, URL o autori sbagliati, e molte volte non sostengono neppure l’affermazione a cui sono accostate. Nei rapporti esaminati, i documenti con i punteggi più alti di generazione artificiale erano anche quelli con il maggior numero di fonti false. È questa correlazione il dato interessante: a quanto pare nessuno ha controllato i riferimenti, perché in nessun punto del processo sono stati trattati come affermazioni da verificare.
PwC Middle East ha dichiarato al Financial Times di considerare importante l’accuratezza e di stare «aggiornando un numero limitato di riferimenti di supporto». Non ha spiegato come siano entrati gli errori. GPTZero ha condotto la stessa verifica su KPMG, Deloitte ed Ernst & Young, trovando fonti inventate in tutte e tre. Inchieste precedenti hanno portato EY e KPMG a ritirare alcuni rapporti.
È legittimo chiedersi se il problema sia davvero l’IA. Le società di consulenza producevano documenti di thought leadership con basi fragili molto prima dei modelli linguistici, e una fonte inventata rimane tale a prescindere da chi l’abbia digitata. L’IA ha cambiato i costi. In passato, cento pagine di prosa sicura, ben impaginata e apparentemente documentata richiedevano una squadra e un budget: un limite naturale che di solito comportava almeno un giro di revisione. Oggi bastano un pomeriggio e un modello, e proprio il controllo è la parte che scompare senza rumore. I modelli linguistici generano le citazioni come qualsiasi altro testo: prevedono l’aspetto di una fonte plausibile, non la cercano. Senza un collegamento esplicito a un indice di ricerca e una verifica successiva, si ottiene soltanto qualcosa che sembra credibile.
Cosa significa per te: Ci sono due lezioni pratiche. Se usi rapporti di settore come prova, apri a campione due o tre fonti prima di citarne le conclusioni. Bastano cinque minuti, e a quanto pare gli errori non sono rari. Se invece usi l’IA per preparare una bozza con riferimenti, considera ogni singola fonte non verificata finché non l’hai aperta personalmente. È uno dei modi più affidabili in cui i modelli attuali mettono in imbarazzo chi li usa, ed è anche un errore del tutto evitabile. La regola è semplice: il modello può aiutarti a costruire l’argomento, le fonti devi controllarle tu.
Fonti
La maggiore associazione informatica valuta se aprire la sua biblioteca all’IA
Secondo i vertici dell’ACM, escludere i modelli linguistici dalla Digital Library rischia di rendere invisibile la ricerca informatica in un mondo sempre più mediato dall’IA. Non è stata ancora presa alcuna decisione.