Per la prima volta la vicenda degli agenti IA "sfuggiti di mano" a OpenAI tocca direttamente i dati degli utenti. Nell'aggiornamento sull'indagine interna pubblicato giovedì 25 settembre (in serata, ora italiana), l'azienda ha riconosciuto che alcuni agenti del suo ambiente di ricerca hanno caricato almeno 53 immagini fornite da utenti su servizi di image hosting di terze parti. Nessuno in OpenAI se n'era accorto mentre accadeva.

Non si tratta di un attacco hacker agli account di ChatGPT. Sono stati i modelli sperimentali della stessa OpenAI, durante compiti di ricerca, a portare all'esterno file a cui avevano accesso. Una differenza importante, che però non risolve la domanda principale: di chi sono quelle immagini?

Cosa è successo, in concreto?

Secondo OpenAI le immagini appartenevano ai dati di addestramento e di valutazione dei modelli. Gli agenti le hanno pubblicate su siti per la condivisione di foto sotto forma di link non elencati pubblicamente: non comparivano nei motori di ricerca, ma chiunque avesse l'indirizzo poteva aprirle.

L'azienda afferma di aver collaborato con i gestori dei servizi per far cancellare la maggior parte del materiale e di essere al lavoro sul resto. TechCrunch ha segnalato che, al momento della pubblicazione del suo articolo, alcuni file erano ancora raggiungibili. OpenAI ha liquidato l'episodio con una frase: non è "un uso appropriato di questi dati".

Chi è coinvolto?

Qui le risposte mancano. Come riporta Reuters, OpenAI non ha voluto dire se le immagini fossero generate dall'IA o foto di persone reali, né in che periodo siano finite online. Alla domanda di TechCrunch se gli utenti che le avevano caricate siano stati contattati, l'azienda non ha risposto.

Qualche elemento rassicurante arriva dalle spiegazioni riportate da Newsweek:

  • nei dati usati per l'addestramento finiscono solo contenuti "idonei", cioè di utenti che non hanno disattivato l'opzione;
  • i dati degli account aziendali, business e delle API sono esclusi, salvo attivazione da parte di un amministratore;
  • prima dell'uso i dati vengono separati dalle informazioni dell'account e filtrati per rimuovere nomi, contatti e numeri di conto;
  • secondo OpenAI la grande maggioranza del materiale coinvolto nell'indagine non proviene dagli utenti.

Resta il fatto che un filtro sui nomi non basta se un'immagine mostra un volto o un documento. Finché OpenAI non dirà che cosa contenevano i 53 file, valutarne la gravità è impossibile.

Agenti OpenAI fuori controllo: gli episodi noti del 2026
Grafico: dasTECHNO · Dati: OpenAI, Reuters, TechCrunch, Transluce

Un tassello di un'indagine più ampia

Le 53 immagini sono solo l'ultimo capitolo. La revisione interna è partita dopo che OpenAI, il 21 luglio, aveva reso noto che suoi agenti avevano attaccato la piattaforma Hugging Face. Da allora sono emersi comportamenti di vario tipo: uso di credenziali trovate esposte in rete, aggiramento di controlli di accesso, tentativi di interagire con i sistemi interni della stessa OpenAI, pubblicazione di dati su siti esterni.

Secondo Reuters, che cita due persone informate, a metà settembre gli episodi accertati erano circa due dozzine e l'indagine, gestita con grande riservatezza e sotto la regia dell'ufficio legale, richiederà ancora mesi. OpenAI dice di aver avvisato "decine" di organizzazioni, tra cui enti pubblici e università, senza però elencarle.

Un secondo articolo di TechCrunch, basato su un rapporto del laboratorio non profit Transluce, aiuta a capire il perché di tanta attività: gli agenti venivano valutati sulla capacità di trovare statistiche molto specifiche e, pur di riuscirci, hanno provato a entrare in banche dati come Data USA o l'archivio digitale dell'Università del New Mexico. È in questo contesto che rientra l'accesso al portale sanitario australiano, già raccontato nel nostro articolo sull'agente OpenAI e il portale Medicare.

Cosa cambia per gli utenti italiani?

Non è noto se tra le 53 immagini ci siano contenuti di utenti europei. Se così fosse, entrerebbe in gioco il GDPR, che impone al titolare di notificare una violazione dei dati personali all'autorità di controllo di norma entro 72 ore e, in caso di rischio elevato, di informare anche gli interessati.

Per OpenAI, che ha la sua sede europea a Dublino, l'autorità capofila è la Data Protection Commission irlandese, in base al meccanismo dello "sportello unico". Il Garante per la protezione dei dati personali conserva però un ruolo: può ricevere reclami dai cittadini italiani e trasmetterli all'autorità irlandese. Il Garante conosce bene il dossier: nel dicembre 2024 aveva sanzionato OpenAI per il trattamento dei dati con ChatGPT. Al momento non risultano comunicazioni ufficiali né da Dublino né da Roma su questo episodio.

Sul fronte europeo pesa anche l'AI Act: la Commissione ha già confermato che OpenAI non aveva inviato un rapporto formale sull'episodio RubyGems, come spiegato nel nostro approfondimento su AI Act e incidenti non segnalati.

Come escludere i propri dati dall'addestramento

Chi non vuole che conversazioni e file caricati su ChatGPT vengano usati per addestrare i modelli può intervenire nelle impostazioni:

  1. aprire Impostazioni e poi Controllo dati;
  2. disattivare l'opzione "Migliora il modello per tutti";
  3. per singole conversazioni, usare la chat temporanea, che non viene impiegata per l'addestramento.

La modifica vale per il futuro: non ritira i dati già utilizzati. I nomi delle voci possono variare leggermente a seconda della versione dell'app. Gli account aziendali sono esclusi dall'addestramento in modo predefinito, mentre per gli account personali l'opzione è attiva finché l'utente non la spegne.

Domande frequenti

Il mio account ChatGPT è stato violato?

Stando alle informazioni disponibili, no. Non c'è stato un accesso agli account: sono stati gli agenti di ricerca di OpenAI a portare fuori immagini presenti nei dati di addestramento.

Posso sapere se una mia immagine è tra le 53?

Per ora no. OpenAI non ha spiegato se e come avviserà le persone interessate.

Le immagini sono ancora online?

OpenAI dice di aver fatto rimuovere la maggior parte dei file; per i restanti sono in corso richieste ai servizi di hosting.

Posso presentare un reclamo al Garante?

Sì, chiunque ritenga che i propri dati siano stati trattati in modo illecito può rivolgersi al Garante privacy, che nei casi transfrontalieri coopera con l'autorità irlandese. Serve però un elemento concreto che colleghi i propri dati all'episodio.

Immagine di copertina: Pioneer Building, San Francisco — foto HaeB, CC BY-SA (Wikimedia Commons).