Un filtro con un tasso di errore pubblicato
Le note di rilascio di Privacy Filter, pubblicate da OpenAI il 22 aprile 2026, indicano il tasso esatto con cui il modello non rileva dati personali, e quel tasso non è zero. Il modello etichetta il testo in otto categorie, tra cui nomi, indirizzi, numeri di conto e segreti come le password, e poi maschera ciò che trova.
| Test | Precisione | Richiamo |
|---|---|---|
| PII-Masking-300k (non corretto) | 94.04% | 98.04% |
| PII-Masking-300k (corretto) | 96.79% | 98.08% |
Nella versione corretta del test pubblico PII-Masking-300k, il modello continua a non rilevare circa il 2 per cento dei frammenti di dati personali testati. La documentazione di OpenAI descrive Privacy Filter come 'un modello piccolo con capacità di rilevamento dei dati personali all'avanguardia', non come una garanzia, e avverte separatamente che l'affinamento su un nuovo dominio può portare il punteggio F1 dal 54 al 96 per cento, cioè lo stesso modello di base rende in modo molto diverso secondo il tipo di testo che riceve.
Project Lily mette chat reali dietro proprio questo filtro
Un'inchiesta di 404 Media del 14 settembre 2026 ha chiamato Project Lily il programma interno di revisione e ha riferito che OpenAI paga centinaia di collaboratori esterni, spesso più di 50 dollari l'ora tramite agenzie di lavoro temporaneo, per leggere richieste reali fatte a ChatGPT e valutare le risposte del modello su una scala numerica.
I revisori non vedono il nome utente, ma secondo 404 Media vedono un riepilogo della memoria sopra la richiesta che a volte mostra per cosa la persona ha già usato il chatbot e in quale parte del mondo vive. OpenAI ha detto alla testata che un modello Privacy Filter rimuove prima i dati personali, ma la sua stessa pagina su quel modello ammette che 'può commettere errori, non rilevare identificatori poco comuni e mascherare troppo poco quando il contesto è limitato'. Un collaboratore ha detto senza mezzi termini a 404 Media che un utente comune non si aspetterebbe che uno sconosciuto stia leggendo la sua chat.
Mascherare non è la stessa cosa di anonimo
La documentazione di OpenAI afferma chiaramente che Privacy Filter 'non è uno strumento di anonimizzazione, né una certificazione di conformità, né un sostituto della revisione delle politiche in contesti ad alto rischio', e questa distinzione ha un peso legale specifico nella UE che una pagina di prodotto non è obbligata a spiegare.
Secondo l'articolo 4.5 e il considerando 26 del GDPR, i dati pseudonimizzati o mascherati che possono ancora essere ricollegati a una persona restano dati personali a tutti gli effetti, e non dati anonimi fuori dall'ambito del regolamento. Una chat in cui un nome è sostituito da un segnaposto è pseudonima, non anonima, finché il testo originale o l'account che c'è dietro esistono ancora da qualche parte sui sistemi di OpenAI. Questo mantiene ogni conversazione rivista di un utente della UE interamente dentro il GDPR: serve ancora una base giuridica perché un collaboratore la legga, valgono ancora i diritti di accesso e cancellazione della persona, e una violazione che la riguarda resta notificabile.
La domanda aziendale che nessuno ha ancora risposto
Né la documentazione sulla privacy di OpenAI né l'inchiesta di 404 Media dicono dove lavorano fisicamente i collaboratori di Project Lily, e proprio questo dato decide se la conversazione rivista di un utente della UE ha mai lasciato lo Spazio Economico Europeo, e con quale meccanismo di trasferimento.
Per un'azienda che usa ChatGPT Enterprise o l'API proprio per tenere le conversazioni dei propri clienti lontano dalla revisione umana, le rivelazioni di questa inchiesta sul livello consumer non si estendono automaticamente a quel traffico. I termini enterprise di OpenAI descrivono l'uso predefinito dei dati separatamente dal prodotto consumer, ma l'azienda non ha detto pubblicamente se le conversazioni Enterprise o dell'API rientrino nello stesso gruppo di revisione da cui Project Lily attinge. Un'azienda che ha presunto che i due livelli fossero rivisti secondo le stesse regole dovrebbe chiedere questa risposta a OpenAI per iscritto invece di darla per scontata.
Da leggere ora: L'IA Di Meta Ha Profilato Una Bambina Non Richiesta | La Francia Da un Prezzo all'Assenza di MFA: 500.000 Euro



