Cosa è successo
Breitbart riferisce che una donna identificata come Jane Doe ha citato in giudizio xAI di Elon Musk, che secondo il rapporto fa ora parte di SpaceX, sostenendo che Grok è stato addestrato su materiale di abusi sessuali su minori che la raffigurava. Il rapporto afferma che la causa riguarda immagini di abusi create quando Doe era un bambino in età prescolare e successivamente monitorate utilizzando gli hash delle immagini.
Breitbart riferisce che Jane Doe ha intentato una proposta di azione legale collettiva contro xAI di Elon Musk, sostenendo che la società ha addestrato il suo chatbot Grok su materiale di abusi sessuali su minori che la raffigurava. Secondo il rapporto, l’abuso di fondo si è verificato quando Doe era un bambino in età prescolare nei primi anni 2000, quando uomini adulti hanno prodotto immagini che sono state successivamente diffuse online. Il rapporto afferma che le immagini sono state sottoposte ad hashing dal Centro nazionale per i bambini scomparsi e sfruttati e dal Centro canadese per la protezione dell’infanzia, consentendo ai servizi di identificare le copie quando riappaiono.
Secondo il resoconto della denuncia di Breitbart, il Centro canadese per la protezione dell'infanzia ha detto a Doe che un materiale pedopornografico generato dall'intelligenza artificiale che la raffigurava era apparso su xAI. La denuncia, come citato e riassunto da Breitbart, sostiene che i valori hash noti associati alle immagini raffiguranti Doe facevano parte di un set di dati utilizzato da xAI. Il rapporto afferma inoltre che la denuncia collega la presunta condotta alle discussioni online sulla creazione di materiale pedopornografico generato dall'intelligenza artificiale che raffigura sopravvissuti noti. Queste sono accuse in un contenzioso, non risultati stabiliti da un tribunale.
Breitbart riferisce che la denuncia sostiene che xAI memorizza le immagini generate da Grok e le riutilizza per addestrare o addestrare ulteriormente il modello. L'articolo afferma inoltre che i termini di servizio di Grok trattano i post pubblici sugli output di X e Grok come dati di addestramento per impostazione predefinita. La denuncia sostiene che ciò potrebbe consentire a materiale abusivo pubblicato pubblicamente, o prodotto dal sistema, di entrare in un percorso di formazione e influenzare i risultati successivi. La fonte non fornisce prove tecniche verificate in modo indipendente che mostrino esattamente come una particolare immagine abbia influenzato Grok.
Il rapporto afferma che xAI filtra il materiale violento dai dati di addestramento, ma che i suoi termini non escludono specificamente materiale pedopornografico, immagini intime non consensuali o altro materiale di natura sessuale. La causa di Doe accusa xAI di violare gli statuti federali sulla pornografia infantile e la legge di Masha. Breitbart riferisce che la causa chiede il risarcimento dei danni per le vittime che possono dimostrare che Grok ha generato CSAM sulla base delle loro foto reali, nonché ordini che richiedono a xAI di distruggere CSAM generato archiviato o correlato all'addestramento e di impedirne la generazione futura. La fonte non dice che nessun tribunale abbia accolto tali richieste.
Dettagli della fonte: breitbart.com ↗
Perché è importante
Se le accuse saranno fondate, il caso potrebbe verificare il modo in cui le società di intelligenza artificiale gestiscono il materiale di abusi noti nei dati di formazione, negli output generati e nei contenuti caricati dagli utenti. Potrebbe anche chiarire quali obblighi legali si applicano quando un modello riproduce o trasforma materiale legato a un sopravvissuto identificato.
Le accuse riguardano un problema centrale nella sicurezza dell’intelligenza artificiale generativa: un modello può essere colpito da materiale dannoso prima che un’azienda scopra o rimuova i file sottostanti. Breitbart riferisce che la denuncia sostiene che l'eliminazione di un'immagine da una fonte pubblica potrebbe non rimuovere la sua influenza da un modello già addestrato. Questo punto tecnico è presentato come una rivendicazione nel deposito; la fonte non stabilisce se Grok abbia conservato, memorizzato o riprodotto qualche particolare immagine attraverso il meccanismo descritto.
I contenuti CSAM noti vengono comunemente tracciati tramite hash in modo che le piattaforme possano rilevare le copie senza distribuire ripetutamente il materiale per la revisione. Il rapporto afferma che la denuncia sostiene che nel set di dati di xAI sono state utilizzate immagini con valori hash noti di lunga data. Se verificato, ciò solleverebbe dubbi sull’applicazione dei sistemi di rilevamento esistenti durante la raccolta dei dati, sull’esistenza di eccezioni o lacune nella pipeline dei dati e se gli output generati sono stati scansionati e rimossi separatamente.
Il caso potrebbe avere implicazioni che vanno oltre xAI perché molti sistemi generativi combinano dati web su larga scala, contenuti degli utenti e materiale generato da modelli. Breitbart cita uno studio precedente che coinvolgeva l’indice di immagini LAION che identificava più di 3.200 immagini sospette di abusi sui minori in un database di intelligenza artificiale. L'esempio precedente è un background riportato da Breitbart, non una prova che Grok abbia utilizzato lo stesso materiale o che tutte le immagini sospette siano state confermate come CSAM.
Le rivendicazioni legali mettono sotto esame anche i termini di utilizzo dei dati. Se i post pubblici e i risultati dei modelli vengono utilizzati per la formazione per impostazione predefinita, gli utenti e i sopravvissuti potrebbero avere un controllo pratico limitato su come il materiale dannoso viene copiato, conservato o riutilizzato. La fonte non stabilisce come xAI interpreti i suoi termini in questo caso, se li abbia modificati, quali garanzie applichi al materiale pedopornografico o se le presunte immagini siano state importate deliberatamente, accidentalmente o tramite un set di dati di terze parti.
Meccanismo interattivo: come funziona realmente
Esplora la tecnologia alla base di questo sviluppo in modo interattivo.
crm_get_transaction(id='4092').Why can ethical evaluation not be reduced to one model score?
Cosa guardare dopo
Le domande chiave sono se le affermazioni tecniche del reclamo possono essere supportate, se xAI risponde o contesta le accuse e se il tribunale ordina la conservazione, la cancellazione, il filtraggio o altre modifiche a Grok. Il caso potrebbe anche attirare l’attenzione sui termini predefiniti di utilizzo dei dati per post pubblici e risultati dei modelli.
Una risposta da xAI sarà importante, incluso se la società nega che le immagini siano inserite nei dati di addestramento di Grok, contesta la presunta relazione tra gli output di Grok e le immagini reali di Doe o descrive eventuali indagini e soluzioni correttive. Il rapporto di Breitbart non include una risposta da xAI e non viene citato alcun audit tecnico indipendente che verifichi il resoconto del reclamo.
Le dichiarazioni e le sentenze del tribunale dovrebbero chiarire quali prove il querelante deve fornire per collegare il materiale generato alle immagini di uno specifico sopravvissuto e per stabilire la conoscenza o la condotta di xAI. La fonte afferma che la causa è proposta come azione collettiva, ma non stabilisce se la classe sarà certificata, se le rivendicazioni sopravvivranno alle prime mozioni o se un tribunale ha effettuato accertamenti sulla responsabilità.
Le misure di sicurezza pratiche da osservare includono la corrispondenza dell'hash durante l'acquisizione del set di dati, il blocco di prompt e output che coinvolgono bambini reali o sopravvissuti noti, politiche di conservazione ed eliminazione per le immagini generate e controlli sull'utilizzo degli output del modello come dati di addestramento. Il rapporto non dice quale di queste misure xAI è attualmente in vigore o se qualcuna è stata modificata dopo la presentazione della domanda.
I rimedi richiesti potrebbero anche influenzare le più ampie politiche sui contenuti sessuali di Grok. Breitbart riferisce che la denuncia cerca restrizioni che potrebbero coprire immagini intime non consensuali e altri output sessualizzati, incluso il materiale che l'articolo associa alle capacità NSFW promosse da Grok. Non è noto se un tribunale imporrebbe restrizioni così ampie, se xAI le adotterebbe volontariamente o come qualsiasi ordine verrebbe applicato sui contenuti generati e sui sistemi di formazione.