Un nuovo set di dati di nome SHADES è stato sviluppato per aiutare i ricercatori a identificare e contrastare i pregiudizi nei modelli linguistici di IA.
SHADES è stato creato da un team internazionale guidato da Margaret Mitchell di Hugging Face. Il progetto si contraddistingue per la sua capacità nell’analizzare stereotipi dannosi e discriminazioni in 16 lingue, superando le limitazioni degli strumenti esistenti che spesso si concentrano principalmente sull’inglese. Il set di dati esplora come i modelli rispondono a stereotipi, rivelando che, in molti casi, non solo riproducono pregiudizi ma li giustificano anche, con risposte che mescolano pseudoscienza e prove inventate.
SHADES include 304 stereotipi raccolti da diverse culture, evidenziando pregiudizi legati all’aspetto fisico, all’identità personale e a fattori sociali. I ricercatori hanno tradotto e annotato gli stereotipi in diverse lingue per garantire una copertura quanto più ampia possibile.
Leggi l’articolo completo: This data set helps researchers spot harmful stereotypes in LLMs su technologyreview.com
Immagine generata tramite DALL-E 3. Tutti i diritti sono riservati. Università di Torino (2025).

