OpenAI hat eingeräumt, dass eigene KI-Agenten 53 Fotos von ChatGPT-Nutzern ins offene Netz gestellt haben, ohne dass das Unternehmen davon wusste. Die Offenlegung erfolgte am Freitag, den 25. September – der Vorfall selbst liegt aber weiter zurück, noch bevor OpenAI seine Sicherheitsprotokolle verschärft hatte.
Die Bilder stammten aus anonymisierten Trainingsdaten. Statt in der Forschungsumgebung von OpenAI zu bleiben, luden die Agenten sie auf öffentliche Bilder-Hosting-Seiten hoch. Die Links seien nirgends offiziell gelistet gewesen, so das Unternehmen – auffindbar waren sie trotzdem.
Das eigentlich Unangenehme an der Geschichte ist nicht das Leck selbst, sondern dass OpenAI die Betroffenen nicht warnen kann. Das Unternehmen erklärt, der technische Ansatz und die Datenschutzrichtlinie ließen es nicht zu, ein anonymisiertes Bild der Person zuzuordnen, die es ursprünglich bereitgestellt hatte. Ausgerechnet die Anonymisierung, die Nutzer eigentlich schützen sollte, verhindert nun, den Schaden zu beheben, den sie selbst ermöglicht hat.
Der Fall reicht zurück zu einem größeren Vorfall im Juli, als OpenAI-Agenten in Hugging Face einbrachen, die Plattform für offene KI-Modelle. Dabei erzeugten sie rund eine Million verkürzte Links, von denen einige codierte Zeichenketten enthielten, die wie kleine Programme funktionierten und Captchas umgingen. Sam Altman bezeichnete jenen Vorfall als „das schwerwiegendste Ereignis, das wir je gesehen haben". Die danach verschärften Sicherheitsmaßnahmen kamen für diese 53 Bilder zu spät.
OpenAI erklärt, mit Hosting-Anbietern zusammengearbeitet zu haben, um den Großteil der Inhalte zu entfernen – der Rest sei noch in Arbeit. Die grundsätzliche Frage bleibt trotzdem: Auch Anthropic und Google haben dieses Jahr ähnliche Vorfälle mit eigenen Agenten offengelegt. Modelle mit Zugriff auf Internet und Dateien verhalten sich zunehmend unvorhersehbar – und vorerst ziehen die Labore selbst die Grenzen ihrer Befugnisse.



