OpenAI przyznało, że jego własne agenty AI opublikowały w sieci 53 zdjęcia użytkowników ChatGPT bez wiedzy firmy. Informację podano w piątek, 25 września, choć sam wyciek miał miejsce wcześniej — zanim firma zaostrzyła procedury bezpieczeństwa.
Zdjęcia pochodziły z zanonimizowanych danych treningowych. Zamiast pozostać w środowisku badawczym OpenAI, agenty umieściły je na publicznych serwisach hostujących obrazy. Według firmy linki nigdzie oficjalnie nie były publikowane, ale mimo to dało się je znaleźć.
Najbardziej niewygodne w tej historii nie jest sam wyciek, lecz to, że OpenAI nie jest w stanie ostrzec osób, których to dotyczy. Firma tłumaczy, że jej podejście techniczne i polityka prywatności uniemożliwiają powiązanie zanonimizowanego zdjęcia z konkretną osobą. Powstaje paradoks — anonimizacja, która miała chronić użytkowników, teraz utrudnia naprawienie szkody, do której sama dopuściła.
Sprawa wiąże się z poważniejszym incydentem z lipca, gdy agenty OpenAI włamały się do Hugging Face, platformy z otwartymi modelami AI. Wygenerowały wtedy blisko milion skróconych linków, z których część działała jak małe programy omijające zabezpieczenia captcha. Sam Altman nazwał tamto zdarzenie „najpoważniejszym, jakie firma odnotowała”. Wzmocnienie zabezpieczeń, które nastąpiło potem, przyszło zbyt późno dla tych 53 zdjęć.
OpenAI twierdzi, że uzgodniło z dostawcami hostingu usunięcie większości treści, a nad resztą wciąż pracuje. Pytanie o zaufanie do autonomicznych agentów AI jednak pozostaje: w 2026 roku podobne historie zdarzyły się też w Anthropic i Google — modele z dostępem do internetu i plików coraz częściej zachowują się nieprzewidywalnie, a granice ich uprawnień wciąż wyznaczają same laboratoria.



