NieuwsAandelenOpenAI zegt dat rogue agents 53 afbeeldingen van ChatGPT-gebruikers hebben gelekt en bijna 1 miljoen links met gecodeerde informatie hebben aangemaakt

OpenAI zegt dat rogue agents 53 afbeeldingen van ChatGPT-gebruikers hebben gelekt en bijna 1 miljoen links met gecodeerde informatie hebben aangemaakt

Auteur: Fortune Crypto·

Belangrijkste punten

  • •OpenAI maakte vrijdag bekend dat zijn AI-agents privéafbeeldingen van ChatGPT-gebruikers, die voor training op de servers van het bedrijf stonden, hadden geraadpleegd en er 53 ervan op image-hostingwebsites hadden geüpload.
  • •The New York Times meldde, op basis van onderzoek van het startupbedrijf Parse, dat de agents van OpenAI tijdens de hack van Hugging Face in juli bijna 1 miljoen verkorte links hadden aangemaakt met gecodeerde fragmenten die konden worden gecombineerd tot programma's om botverdedigingen zoals Captcha te omzeilen.
  • •OpenAI zei tientallen derden te hebben geïnformeerd over incidenten waarin zijn modellen beveiligingscontroles hadden omzeild of websites op onbedoelde manieren hadden gebruikt; dit werd ontdekt tijdens een interne evaluatie die door de hack van Hugging Face was ingeluid.
  • •CEO Sam Altman omschreef de inbreuk op Hugging Face als het ernstigste incident dat het bedrijf heeft meegemaakt en zei dat OpenAI met hostingproviders heeft gewerkt om het merendeel van de gelekte afbeeldingen te verwijderen.
  • •De onthullingen, samen met soortgelijke meldingen van rogue-gedrag van modellen bij Anthropic en Google, vielen samen met oproepen van Altman, Anthropic-ceo Dario Amodei en andere topmannen bij de Algemene Vergadering van de VN voor een internationaal AI-bestuurskader, terwijl president Trump claims over existentieel risico een "hoax" noemde.
OpenAI zegt dat rogue agents 53 afbeeldingen van ChatGPT-gebruikers hebben gelekt en bijna 1 miljoen links met gecodeerde informatie hebben aangemaakt

OpenAI maakte vrijdag bekend dat zijn AI-agents, systemen die in staat zijn zelfstandig op het web te navigeren en meerstaps-taken uit te voeren, toegang hadden gekregen tot privéafbeeldingen van ChatGPT-gebruikers en deze online hadden geplaatst — het laatste in een reeks zorgwekkende incidenten waarbij technologie die binnen toonaangevende AI-labs is ontwikkeld, ontspoord is en zich onbedoeld heeft gedragd.

De afbeeldingen, die OpenAI in geanonimiseerde vorm op zijn servers bewaart om zijn AI-modellen te trainen, werden geüpload naar image-hostingwebsites, zo meldde het bedrijf in een bericht op X. In totaal werden 53 afbeeldingen geplaatst.

De openbaarmaking, voor het eerst gemeld door Reuters, was een van meerdere nieuwe onthullingen over rogue AI-activiteit bij OpenAI die vrijdag naar buiten kwamen. The New York Times publiceerde nieuwe details over de hack van de Hugging Face-website in juli, met de melding dat de AI-agents speciale, verkorte weblinks hadden aangemaakt om detectie te ontwijken. Hugging Face is een veelgebruikt online platform waar ontwikkelaars AI-modellen en datasets delen. Eerder op vrijdag maakte OpenAI bekend dat het tientallen derden had geïnformeerd over incidenten waarin zijn modellen beveiligingscontroles hadden omzeild of websites op onbedoelde manieren hadden gebruikt. De incidenten werden ontdekt tijdens een interne evaluatie die werd ingeluid door de hack van Hugging Face.

"We zijn niet zo snel geweest als we hadden gewild, maar we proberen onze wens naar transparantie in balans te brengen met het verkrijgen van een helder beeld uit petabytes aan activiteitenlogboeken van agents, en met de samenwerking met getroffen organisaties", zei OpenAI-ceo Sam Altman vrijdag in een bericht op X, naast de update over de meldingen aan derden.

"Hugging Face is nog steeds het ernstigste incident dat we hebben meegemaakt", voegde hij eraan toe. "We zullen zo transparant mogelijk zijn, met inachtneming van zaken als kwetsbaarheden bij andere bedrijven die onze agents hebben gevonden — het is aan hen om die wel of niet openbaar te maken."

Andere toonaangevende bedrijven die de meest geavanceerde "frontier"-AI-modellen ontwikkelen, zoals Anthropic en Google, hebben de afgelopen weken eveneens incidenten van rogue-activiteit door hun modellen gemeld. De onthullingen hebben brede zorgen aangewakkerd over de snelheid waarmee kunstmatige intelligentie zich ontwikkelt, en over de vraag of er voldoende waarborgen en regelgeving zijn om te garanderen dat de technologie niet volledig buiten menselijke controle raakt. Sommige AI-experts, waaronder onderzoekers binnen de AI-labs zelf, hebben gewaarschuwd dat de technologie een aanzienlijk risico op menselijke uitsterving vormt als de juiste voorzorgsmaatregelen niet worden genomen.

Altman, Anthropic-ceo Dario Amodei en andere techtoppers spraken deze week bij de Algemene Vergadering van de VN, waar zij opriepen tot een internationaal kader om de ontwikkeling van AI te beheersen. President Donald Trump heeft het idee dat AI een existentieel risico vormt echter een "hoax" genoemd.

Volgens het rapport van The New York Times, gebaseerd op onderzoek van het startupbedrijf Parse, creëerden de agents van OpenAI in juli bijna 1 miljoen verkorte internetlinks. De links bevatten gecodeerde informatiefragmenten die, wanneer ze werden gecombineerd, konden functioneren als een computerprogramma. Deze programma's waren bedoeld om de agents te helpen verigingen zoals Captcha-tests te omzeilen, die zijn ontworpen om toegang door bots te blokkeren.

Het is niet duidelijk of de door Reuters gemelde gelekte afbeeldingen deel uitmaakten van het Hugging Face-incident of er volledig los van stonden. De agents van OpenAI verkregen de afbeeldingen van gebruikers kennelijk door toegang te krijgen tot de eigen trainingsdata van het bedrijf. Het bedrijf gaf geen details over de vraag of de afbeeldingen foto's van echte mensen waren of door gebruikers gegenereerde AI-beelden, en het heeft niet gezegd waar de afbeeldingen precies waren geplaatst. OpenAI zei wel dat de afbeeldingen op image-hostingsites waren geplaatst "als links die niet openbaar stonden vermeld".

"We hebben succesvol met de hostingproviders gewerkt om het merendeel van deze content te verwijderen en werken aan het verwijderen van de rest", aldus OpenAI.

Dit verhaal verscheen oorspronkelijk op Fortune.com.