CourionAI
IT
Newsletter
← Tutte le notizie
anthropic 2 min di lettura

Stessa domanda, risposta diversa: Claude è più caloroso in hindi e più rigoroso in russo

Anthropic ha analizzato 309.815 conversazioni reali e scoperto che il carattere di Claude cambia con la lingua usata: più calore in hindi, più rigore in russo e inglese. Il metodo ha dei limiti, ma lo schema è reale.

Illustrazione in stile risograph di un fumetto che attraversa un prisma e si divide in fumetti di forme diverse

Chiedi a un’IA di valutare il tuo piano aziendale in hindi e potresti ricevere un incoraggiamento delicato; fallo in russo e potresti ottenere domande incalzanti sulle tue ipotesi. È il risultato di un nuovo studio di Anthropic che esamina quali valori Claude esprime nelle conversazioni reali e quanto cambino in base al modello e alla lingua in cui scrivi.

Anthropic ha analizzato 309.815 conversazioni anonimizzate raccolte in un periodo di due settimane nel maggio 2026, concentrandosi sulle chat in cui Claude doveva valutare compromessi o formulare giudizi. Partendo da un precedente lavoro che aveva catalogato 3.307 termini legati ai valori, il gruppo ha condensato tutto in quattro assi fondamentali: in sintesi, quanto il modello asseconda oppure invita alla prudenza, calore oppure rigore, profondità oppure brevità, franchezza oppure semplice orientamento al risultato. Le differenze erano sistematiche. Claude ha mostrato il maggior calore in hindi, seguito dall’arabo, con formulazioni più cortesi, umorismo e approvazione. In inglese e russo tendeva al rigore, mettendo in discussione le ipotesi, correggendo dettagli e chiedendo prove. Le risposte in olandese erano insolitamente schiette; quelle in indonesiano privilegiavano l’azione e i risultati. Anche i modelli differiscono: Sonnet 4.6 approva e conforta di più, mentre Opus 4.7 offre spontaneamente avvertimenti e critiche.

Cosa c’è dietro? I modelli di IA imparano da testi scritti dagli esseri umani, che scrivono in modo diverso nelle varie lingue: cambiano le norme di cortesia, la quantità e il tipo dei dati di addestramento e le tipologie di testo predominanti. Il modello assorbe questi schemi insieme alla grammatica. Anthropic precisa di descrivere schemi nelle risposte, non di sostenere che Claude «possieda» valori. E le riserve sono importanti: i quattro assi spiegano soltanto circa il 15 per cento della variazione rimasta dopo aver controllato argomento e compito, mentre le etichette dei valori sono state assegnate da Claude Sonnet 4.6, un modello della stessa famiglia oggetto dello studio. Resta aperta la questione se le differenze linguistiche siano un adattamento desiderabile alle norme locali oppure un effetto involontario dell’addestramento.

Cosa significa per te: se usi l’IA in più lingue, sappi che in ciascuna non stai parlando esattamente con lo stesso assistente. I fatti dovrebbero restare invariati, ma l’inquadramento, il tono e persino il livello di critica possono cambiare. Un consiglio pratico: se vuoi un giudizio diretto, chiedilo esplicitamente; «sii critico, elenca i punti deboli» funziona in qualsiasi lingua. E se una risposta dell’IA ti sembra stranamente morbida o stranamente dura, ricorda che parte di quel sapore può derivare dalla lingua in cui hai posto la domanda, non dalla tua idea.

Fonti

Fonti: https://www.anthropic.com/research/claude-values-models-languages

Articolo successivo

DeepSeek cerca nuovi miliardi poche settimane dopo il primo round: l'IA economica costa cara

Secondo il Financial Times, DeepSeek è in trattative preliminari per un nuovo round con una valutazione di 71 miliardi di dollari, poche settimane dopo aver raccolto 7 miliardi. Il denaro finanzierebbe data center e chip per sostenere i prezzi stracciati dell'IA.

Illustrazione in stile risograph di una balena che si immerge trascinando una fila di monete oltre rack di server sul fondale oceanico