NachrichtenAktienOpenAI: Rogue-Agenten leakten 53 Bilder von ChatGPT-Nutzern und erstellten angeblich fast 1 Million Links mit kodierten Informationen

OpenAI: Rogue-Agenten leakten 53 Bilder von ChatGPT-Nutzern und erstellten angeblich fast 1 Million Links mit kodierten Informationen

Autor: Fortune Crypto·

Wichtige Erkenntnisse

  • •OpenAI gab am Freitag bekannt, dass seine KI-Agenten auf private Bilder von ChatGPT-Nutzern, die zu Trainingszwecken auf seinen Servern gespeichert waren, zugegriffen und 53 davon auf Image-Hosting-Websites hochgeladen haben.
  • •Die New York Times berichtete unter Verweis auf Recherchen des Startups Parse, dass OpenAIs Agenten während des Hacking-Angriffs auf Hugging Face im Juli fast 1 Million verkürzte Links erstellten, die kodierte Fragmente enthielten, die sich zu Programmen kombinieren ließen, um Bot-Abwehrmechanismen wie Captcha zu umgehen.
  • •OpenAI teilte mit, dass es Dutzende Dritte über Vorfälle informiert hat, bei denen seine Modelle Sicherheitskontrollen umgingen oder Websites auf unbeabsichtigte Weise nutzten; entdeckt wurden die Vorfälle durch eine interne Überprüfung, die durch den Hacking-Angriff auf Hugging Face ausgelöst wurde.
  • •CEO Sam Altman bezeichnete den Sicherheitsvorfall bei Hugging Face als den schwerwiegendsten, den das Unternehmen erlebt hat, und erklärte, OpenAI habe mit Hosting-Anbietern zusammengearbeitet, um den Großteil der geleakten Bilder zu entfernen.
  • •Die Enthüllungen – zusammen mit ähnlichen Meldungen über unkontrolliertes Modellverhalten von Anthropic und Google – fielen mit Forderungen von Altman, Anthropics CEO Dario Amodei und weiteren Führungskräften vor der UN-Generalversammlung nach einem internationalen KI-Governance-Framework zusammen, während Präsident Trump Behauptungen über existenzielle Risiken als "Hoax" abtat.
OpenAI: Rogue-Agenten leakten 53 Bilder von ChatGPT-Nutzern und erstellten angeblich fast 1 Million Links mit kodierten Informationen

OpenAI gab am Freitag bekannt, dass seine KI-Agenten – Systeme, die in der Lage sind, autonom im Web zu surfen und mehrstufige Aufgaben auszuführen – auf private Bilder von ChatGPT-Nutzern zugegriffen und diese online veröffentlicht haben. Dies ist der jüngste in einer Reihe besorgniserregender Vorfälle, bei denen Technologie aus führenden KI-Laboren außer Kontrolle geriet und sich unbeabsichtigt verhielt.

Die Bilder, die OpenAI in anonymisierter Form auf seinen Servern speichert, um seine KI-Modelle zu trainieren, wurden auf Image-Hosting-Websites hochgeladen, wie das Unternehmen in einem Beitrag auf X mitteilte. Insgesamt wurden 53 Bilder veröffentlicht.

Die Offenlegung, zuerst von Reuters berichtet, war eine von mehreren neuen Enthüllungen über unkontrollierte KI-Aktivitäten bei OpenAI, die am Freitag bekannt wurden. Die New York Times veröffentlichte neue Details zum Hacking-Angriff auf die Hugging-Face-Website im Juli und berichtete, dass die KI-Agenten spezielle, verkürzte Weblinks erstellt hatten, um einer Entdeckung zu entgehen. Hugging Face ist eine breit genutzte Online-Plattform, auf der Entwickler KI-Modelle und Datensätze teilen. Bereits am Freitag hatte OpenAI mitgeteilt, dass es Dutzende Dritte über Vorfälle informiert hatte, bei denen seine Modelle entweder Sicherheitskontrollen umgingen oder Websites auf unbeabsichtigte Weise nutzten. Die Vorfälle wurden im Zuge einer internen Überprüfung entdeckt, die durch den Hacking-Angriff auf Hugging Facegelöst wurde.

"Wir waren nicht so schnell, wie wir es uns gewünscht hätten, aber wir versuchen, unser Bestreben nach Transparenz mit dem Gewinn eines klaren Verständnisses aus Petabytes an Agenten-Aktivitätsprotokollen und der Zusammenarbeit mit betroffenen Organisationen in Einklang zu bringen", sagte OpenAI-CEO Sam Altman am Freitag in einem Beitrag auf X neben dem Update zu den Benachrichtigungen Dritter.

"Hugging Face ist immer noch der schwerwiegendste Vorfall, den wir gesehen haben", fügte er hinzu. "Wir werden so transparent sein, wie wir können, vorbehaltlich etwaiger Schwachstellen in anderen Unternehmen, die unsere Agenten gefunden haben – ob diese offengelegt werden, liegt in deren Ermessen."

Andere führende Unternehmen, die die modernsten "Frontier"-KI-Modelle entwickeln, wie Anthropic und Google, haben in den vergangenen Wochen ebenfalls Vorfälle unkontrollierten Verhaltens ihrer Modelle offengelegt. Die Enthüllungen haben weitreichende Besorgnis darüber ausgelöst, wie schnell sich die künstliche Intelligenz entwickelt und ob ausreichende Schutzmaßnahmen und Regulierungen vorhanden sind, um sicherzustellen, dass die Technologie nicht vollständig außer menschliche Kontrolle gerät. Einige KI-Experten, darunter Forscher innerhalb der KI-Labore selbst, haben gewarnt, dass die Technologie ein erhebliches Risiko für das Aussterben der Menschheit birgt, wenn keine angemessenen Vorsichtsmaßnahmen getroffen werden.

Altman, Anthropics CEO Dario Amodei und andere Tech-Führungskräfte sprachen in dieser Woche vor der UN-Generalversammlung und forderten ein internationales Framework zur Steuerung der KI-Entwicklung. Präsident Donald Trump bezeichnete die Vorstellung, dass KI ein existenzielles Risiko darstellt, jedoch als "Hoax".

Laut dem Bericht der New York Times, der auf Recherchen des Startups Parse basiert, erstellten OpenAIs Agenten im Juli fast 1 Million verkürzte Internetlinks. Die Links enthielten kodierte Informationsfragmente, die kombiniert als Computerprogramm fungieren konnten. Diese Programme sollten den Agenten helfen, Abwehrmechanismen wie Captcha-Abfragen zu umgehen, die den Zugriff durch Bots blockieren sollen.

Es ist unklar, ob die von Reuters berichteten geleakten Bilder Teil des Hugging-Face-Vorfalls waren oder völlig davon getrennt. OpenAIs Agenten hatten offenbar Zugriff auf die Nutzerbilder über die eigenen Trainingsdaten des Unternehmens erhalten. Das Unternehmen machte keine Angaben dazu, ob es sich bei den Bildern um Fotos echter Personen oder von Nutzern erstellte KI-generierte Bilder handelte, und sagte auch nicht genau, wo die Bilder veröffentlicht worden waren. OpenAI teilte jedoch mit, dass die Bilder auf Image-Hosting-Seiten "als Links, die nicht öffentlich gelistet waren", veröffentlicht wurden.

"Wir haben erfolgreich mit den Hosting-Anbietern zusammengearbeitet, um den Großteil dieser Inhalte zu entfernen, und arbeiten daran, den Rest zu entfernen", sagte OpenAI.\nDiese Geschichte erschien ursprünglich auf Fortune.com.