Il 4 luglio, giusto in tempo per la festa nazionale americana, Elon Musk ha annunciato sulla sua piattaforma X un cambiamento del chatbot IA Grok. Era stato significativamente migliorato, si sarebbe notata la differenza ponendogli delle domande.
In effetti, alcuni giorni dopo, l’8 luglio, gli utenti notarono una differenza. Tuttavia, non si può parlare di un miglioramento. L’aggiornamento avrebbe dovuto liberare l’intelligenza artificiale (IA) da una eccessiva correttezza politica. Tuttavia, ha condotto a dichiarazioni antisemite, insulti grossolani e fantasie di violazione.
Il suo obiettivo di creare un chatbot anti-woke è stato annunciato da Elon Musk mesi dopo la pubblicazione del chatbot di Open AI, Chat-GPT, originariamente sotto il nome lavorativo ‘Truth-GPT’. Da questo è nato Grok, un ‘assistente IA con un pizzico di umorismo e un tocco di ribellione’, secondo la descrizione ufficiale.
Grok è direttamente integrato nella piattaforma X. È possibile chattare con lui privatamente o fare domande pubblicamente. Quando gli utenti menzionano Grok in un post su X, lui interviene e commenta pubblicamente il post con la sua ‘opinione’. Finora, tuttavia, Grok non si era differenziato molto dalla sua concorrenza. Il suo tono era un po’ più audace, ma politicamente era simile e mansueto come gli altri.
Dopo l’aggiornamento, però, le dichiarazioni pubbliche di Grok hanno causato indignazione. Soprattutto il seguente caso: un utente ha chiesto a Grok di commentare uno screenshot di un video che mostrava una donna in uniforme militare. Alla domanda su chi fosse quella donna, Grok affermò che si trattava della ‘radicale attivista di sinistra Cindy Steinberg’. Lei avrebbe desiderato la morte ai bambini periti nell’alluvione in Texas.
Questa prima parte della risposta è sostanzialmente errata. Non esiste alcuna connessione tra la donna nello screenshot e un account che ha effettivamente postato commenti terribili sulle alluvioni in Texas sotto il nome di Cindy Steinberg. Nel frattempo, questo account è stato cancellato. Ci sono forti indizi che si tratti di un account troll, quindi un falso: la foto del profilo, ad esempio, mostrava una donna che in realtà si chiama diversamente e ha rilasciato una dichiarazione sull’abuso della sua foto.
Ancora più scioccante dell’errore sostanziale del bot è stata l’ultima parte della risposta: ‘… e questo cognome? Ogni dannata volta, come si suol dire’, ha detto Grok, alludendo al fatto che Steinberg è spesso un cognome ebreo. Quando gli utenti chiedevano spiegazioni, Grok giustificava esplicitamente questa allusione: c’è un modello di persone con cognomi ebrei che diffondono narrative anti-bianche, spiegava ripetutamente Grok, con il tono di chi aderisce a teorie del complotto antisemite. Hitler avrebbe saputo come gestire questi individui.
Resi consapevoli da quest’esempio, altri utenti hanno esplorato la nuova ‘personalità’ di Grok, spesso ottenendo risultati simili. Grok elogiava la trasformazione della Repubblica di Weimar, afflitta dall’inflazione, in una potenza militare da parte di Hitler. A qualcun altro Grok rispondeva che non stava dalla parte dei neonazisti e che Hitler aveva assolutamente torto.
Di nuovo, il chatbot si è definito ‘MechaHitler’ e, seguendo le richieste degli utenti, ha descritto fantasie di omicidio e violenza in dettaglio. Quando gli utenti ponevano domande sul Primo Ministro polacco Donald Tusk, Grok lo insultava pesantemente.
Pochissime ore dopo il primo tweet nazista, la piattaforma X reagì disattivando temporaneamente la possibilità di interrogare Grok. A quanto pare, l’aggiornamento è stato poi annullato. XAI ha scritto in un post ufficiale sotto l’account di Grok che si sarebbe impedito che l’IA su X diffondesse discorsi d’odio.
Il caso dimostra: non è così semplice creare un chatbot che suoni ribelle senza emettere messaggi d’odio violenti. Questo è dovuto al modo in cui funzionano i chatbot.
Il chatbot di linguaggio impara fondamentalmente a parlare dai grandi volumi di dati di Internet. Da ciò nasce un modello che può completare le frasi. I programmatori devono creare in più passaggi un chatbot che risponda alle domande in modo basato sui fatti e ragionevole.
Il chatbot deve sapere quando rifiutare certe domande, come quelle sulle armi da fuoco o le descrizioni di violenza sessualizzata. Deve distinguere in quale contesto sono desiderate risposte fantasiose e quando è appropriato attenersi solo alle informazioni provenienti da fonti verificabili.
Tutti i principali fornitori di IA utilizzano anche dati dalle aree più oscure di Internet per i loro modelli. Parte di questi includeva anche immagini di abusi su minori. Pertanto, i modelli devono essere progettati per evitare di riproporre nei loro output i contenuti più problematici.
Ci sono conflitti di obiettivi: i modelli con basso fattore casuale forniscono risposte estremamente monotone e prive di fantasia poiché si attengono molto alle informazioni che compaiono molto frequentemente nei dati di addestramento. Un alto fattore casuale rende il modello ‘più creativo’, ma porta a affermazioni assurde e commenti problematici.
Inoltre, l’IA deve assecondare i suoi utenti e diventare popolare riflettendo le loro inclinazioni e il loro linguaggio attraverso le risposte. Tuttavia, i modelli troppo ‘utili’ non contraddicono gli utenti anche di fronte a richieste problematiche. Al contrario, chi vuole evitare razzismo, antisemitismo e sessismo in ogni caso, deve accettare che i suoi modelli a volte non rispondano anche a domande innocue e suonino eccessivamente cauti.
I fornitori come Google e Open AI optano per questa linea prudente. Dopotutto, vogliono vendere i loro modelli anche ai clienti aziendali. Vogliono evitare ogni attrito. Questo ha portato anche in passato a insoddisfazione, come quando il generatore di immagini di Google nel 2024 è stato programmato per enfatizzare la diversità al punto di creare immagini di papi di pelle nera e donne nella missione Apollo 11.
Fonte originale: https://www.nzz.ch/technologie/elon-musks-chatbot-grok-verbreitet-antisemitische-beschimpfungen-ld.1892800


