Een filter met een gepubliceerd foutpercentage
OpenAI's eigen release notes voor Privacy Filter, gepubliceerd op 22 april 2026, noemen het exacte percentage waarbij het model persoonsgegevens niet herkent, en dat percentage is niet nul. Het model labelt tekst in acht categorieën, waaronder namen, adressen, rekeningnummers en geheimen zoals wachtwoorden, en maskeert vervolgens wat het vindt.
| Test | Precisie | Recall |
|---|---|---|
| PII-Masking-300k (ongecorrigeerd) | 94.04% | 98.04% |
| PII-Masking-300k (gecorrigeerd) | 96.79% | 98.08% |
Op de gecorrigeerde versie van de publieke PII-Masking-300k-benchmark mist het model nog steeds ongeveer 2 procent van de getoetste stukjes persoonsgegevens. OpenAI's eigen documentatie noemt Privacy Filter 'een klein model met detectievermogen voor persoonsgegevens van topniveau', geen garantie, en waarschuwt apart dat finetunen op een nieuw domein de F1-score van 54 naar 96 procent kan tillen, wat betekent dat hetzelfde basismodel sterk verschillend presteert afhankelijk van het type tekst dat het krijgt.
Project Lily legt echte chats achter precies dit filter
Een onderzoek van 404 Media van 14 september 2026 noemde het interne beoordelingsprogramma Project Lily en meldde dat OpenAI honderden externe contractanten betaalt, vaak meer dan 50 dollar per uur via bemiddelingsbureaus, om echte ChatGPT-prompts te lezen en de antwoorden van het model op een cijferschaal te beoordelen.
Beoordelaars zien geen gebruikersnaam, maar volgens 404 Media wel een geheugensamenvatting boven de prompt die soms laat zien waarvoor de persoon de chatbot al eerder heeft gebruikt en in welk deel van de wereld die persoon woont. OpenAI zei tegen het medium dat een Privacy Filter-model persoonsgegevens eerst verwijdert, maar de eigen pagina over dat model erkent dat het 'fouten kan maken, ongewone identificatoren kan missen en te weinig kan maskeren als de context beperkt is'. Een contractant zei ronduit tegen 404 Media dat een gewone gebruiker niet zou verwachten dat een vreemde zijn chat zit te lezen.
Maskeren is niet hetzelfde woord als anoniem
OpenAI's eigen documentatie stelt duidelijk dat Privacy Filter 'geen anonimiseringstool, geen compliancecertificering en geen vervanging voor beleidsbeoordeling in risicovolle situaties' is, en dat onderscheid heeft binnen de EU een specifiek juridisch gewicht dat een productpagina niet hoeft uit te leggen.
Volgens artikel 4, lid 5, en overweging 26 van de AVG blijven gegevens die gepseudonimiseerd of gemaskeerd zijn maar nog aan een persoon te koppelen zijn, volledig persoonsgegevens, en geen anonieme gegevens buiten de reikwijdte van de verordening. Een gesprek waarin een naam is vervangen door een plaatshouder is gepseudonimiseerd, niet anoniem, zolang de oorspronkelijke tekst of het account daarachter nog ergens op OpenAI's systemen bestaat. Daardoor blijft elk beoordeeld gesprek van een EU-gebruiker volledig binnen de AVG: er blijft een rechtsgrond nodig om het door een contractant te laten lezen, de inzage- en verwijderingsrechten van de persoon blijven gelden, en een incident daarmee blijft meldingsplichtig.
De zakelijke vraag die nog niemand heeft beantwoord
Noch OpenAI's privacydocumentatie noch het onderzoek van 404 Media noemt waar de contractanten van Project Lily fysiek werken, en precies dat feit bepaalt of het beoordeelde gesprek van een EU-gebruiker ooit de Europese Economische Ruimte heeft verlaten, en via welk doorgiftemechanisme.
Voor een bedrijf dat ChatGPT Enterprise of de API gebruikt om klantgesprekken juist weg te houden van menselijke beoordeling, gelden de onthullingen uit dit onderzoek over de consumentenlaag niet automatisch voor dat verkeer. OpenAI's zakelijke voorwaarden beschrijven het standaardgebruik van data los van het consumentenproduct, maar het bedrijf heeft niet publiekelijk gezegd of Enterprise- of API-gesprekken in dezelfde beoordelingspool vallen waaruit Project Lily put. Een bedrijf dat aannam dat beide niveaus volgens dezelfde regels werden beoordeeld, moet dat antwoord schriftelijk bij OpenAI opvragen in plaats van het te veronderstellen.
Lees hierna: Meta's AI Bouwde Een Ongevraagd Kinderprofiel | Frankrijk Beprijst Ontbrekende MFA op 500.000 Euro



