Ett filter med en publicerad felfrekvens
OpenAIs egna releaseanteckningar för Privacy Filter, publicerade 22 april 2026, anger den exakta frekvens med vilken modellen missar personuppgifter, och den frekvensen är inte noll. Modellen märker text i åtta kategorier, bland annat namn, adresser, kontonummer och hemligheter som lösenord, och maskerar sedan det den hittar.
| Test | Precision | Recall |
|---|---|---|
| PII-Masking-300k (okorrigerad) | 94.04% | 98.04% |
| PII-Masking-300k (korrigerad) | 96.79% | 98.08% |
På den korrigerade versionen av det publika PII-Masking-300k-testet missar modellen fortfarande omkring 2 procent av de testade personuppgiftssegmenten. OpenAIs egen dokumentation kallar Privacy Filter 'en liten modell med detektionsförmåga för personuppgifter i toppklass', inte en garanti, och varnar samtidigt att finjustering på en ny domän kan höja F1-poängen från 54 till 96 procent, vilket betyder att samma grundmodell beter sig mycket olika beroende på vilken typ av text den möter.
Project Lily lägger riktiga chattar bakom just detta filter
En granskning från 404 Media den 14 september 2026 namngav det interna granskningsprogrammet Project Lily och rapporterade att OpenAI betalar hundratals externa underleverantörer, ofta över 50 dollar i timmen via bemanningsföretag, för att läsa riktiga ChatGPT-frågor och betygsätta modellens svar på en sifferskala.
Granskarna ser inte användarnamnet, men enligt 404 Media ser de en minnessammanfattning ovanför frågan som ibland visar vad personen tidigare har använt chatboten till och i vilken del av världen personen bor. OpenAI sa till mediet att en Privacy Filter-modell tar bort personuppgifter först, men företagets egen sida om den modellen erkänner att den 'kan göra fel, missa ovanliga identifierare och maskera för lite när sammanhanget är begränsat'. En underleverantör sa rakt ut till 404 Media att en vanlig användare inte skulle förvänta sig att en främling överhuvudtaget sitter och läser chatten.
Maskering är inte samma ord som anonym
OpenAIs egen dokumentation slår fast att Privacy Filter 'inte är ett anonymiseringsverktyg, inte en efterlevnadscertifiering och inte en ersättning för policygranskning i högriskmiljöer', och den skillnaden har en specifik juridisk vikt inom EU som en produktsida inte behöver förklara.
Enligt artikel 4.5 och skäl 26 i GDPR förblir uppgifter som pseudonymiserats eller maskerats men som fortfarande kan kopplas till en person fullt ut personuppgifter, inte anonyma uppgifter utanför förordningens räckvidd. En chatt där ett namn har bytts ut mot en platshållare är pseudonym, inte anonym, så länge originaltexten eller kontot bakom den fortfarande finns någonstans i OpenAIs system. Det håller varje granskad konversation från en EU-användare fullt inom GDPR: det krävs fortfarande en rättslig grund för att en underleverantör ska få läsa den, personens rätt till tillgång och radering gäller fortfarande, och en incident som rör den är fortfarande anmälningspliktig.
Företagsfrågan som ingen har besvarat än
Varken OpenAIs sekretessdokumentation eller 404 Medias granskning anger var Project Lilys underleverantörer fysiskt arbetar, och just det faktumet avgör om en granskad konversation från en EU-användare någonsin lämnat Europeiska ekonomiska samarbetsområdet, och under vilken överföringsmekanism.
För ett företag som använder ChatGPT Enterprise eller API:et just för att hålla kundkonversationer borta från mänsklig granskning gäller avslöjandena i den här rapporten om konsumentnivån inte automatiskt för den trafiken. OpenAIs företagsvillkor beskriver standardanvändningen av data separat från konsumentprodukten, men företaget har inte offentligt sagt om Enterprise- eller API-konversationer ligger i samma granskningspool som Project Lily hämtar från. Ett företag som antagit att de två nivåerna granskades enligt identiska regler bör be OpenAI om det svaret skriftligt i stället för att anta det.
Läs vidare: Metas AI Byggde En Profil Av Ett Barn Som Ingen Bad Om | Frankrike Prissätter Utebliven MFA till 500 000 Euro



