NieuwsAandelenOpenAI ontslaat drie veiligheidsonderzoekers na vermeende lek naar externe AI-veiligheidsgroep

OpenAI ontslaat drie veiligheidsonderzoekers na vermeende lek naar externe AI-veiligheidsgroep

Auteur: Decrypt·

Belangrijkste punten

  • •OpenAI zei dat drie veiligheidsonderzoekers het bedrijf hebben verlaten nadat ze naar verluidt het beleid rond gevoelige informatie hebben geschonden.
  • •De identiteit van de onderzoekers, de externe organisatie en de gedeelde informatie zijn niet vrijgegeven.
  • •Namen die op sociale media aan de vertrekkens worden gekoppeld, blijven onbevestigd en mogen niet als geverifieerde berichtgeving worden behandeld.
  • •OpenAI heeft onlangs incidenten met autonome agenten gemeld, modeltraining twee keer gepauzeerd en een proces geïntroduceerd voor het melden van vermoedelijke misalignment.
  • •Een nonprofit heeft OpenAI aangeklaagd over de hack van Hugging Face, maar openbare berichtgeving verbindt de rechtszaak niet met de drie vertrekkens.
OpenAI ontslaat drie veiligheidsonderzoekers na vermeende lek naar externe AI-veiligheidsgroep

OpenAI heeft bevestigd dat het bedrijf is gebroken met drie veiligheidsonderzoekers die vertrouwelijke bedrijfsinformatie zouden hebben gedeeld met een externe AI-veiligheidsorganisatie, volgens een bericht van de Wall Street Journal. Een woordvoerder van OpenAI zei dat de drie medewerkers het bedrijfsbeleid hebben geschonden rond toegang tot en de omgang met gevoelige informatie.

Het bedrijf heeft de drie betrokkenen en de organisatie die de informatie ontving niet geïdentificeerd, en heeft niet beschreven welke informatie van eigenaar is gewisseld. Namen die op X circuleren blijven ongeverifieerde geruchten. De belangrijkste onbeantwoorde vragen zijn daarom wie is ontslagen, welk beleid het bedrijf zegt te zijn geschonden, en of OpenAI of de externe organisatie meer details over de informatie zal vrijgeven.

Speculatie vulde het gat snel. Een X-account dat vertrekkens bij AI-labs bijhoudt plaatste een reeks vertrekkens bij OpenAI en Anthropic, en veel gebruikers verbonden een paar van die namen aan de ontslagen. Niets bevestigt een verband—mensen verlaten labs om tal van redenen—en de accounts hebben niets gezegd over ontslag of ontslagname.

Veiligheidsvertrekkens zijn niet nieuw bij OpenAI

Veiligheidsonderzoekers testen of AI-systemen doen wat hun makers bedoelen. Ditgebied staat bekend als alignment: ervoor zorgen dat een AI menselijke doelen volgt in plaats van af te dwalen om zijn eigen doelen na te jagen. De discipline is bij OpenAI herhaaldelijk een twistpunt geweest.

OpenAI's bestuur ontsloeg CEO Sam Altman in november 2023, om hem dagen later weer in functie te herstellen. Begin mei 2024 waren medeoprichter Ilya Sutskever en onderzoeker Jan Leike beide het bedrijf verlaten, en het superalignment-team dat zij leidden—een eenheid gebouwd om toekomstige supermenselijke AI onder menselijke controle te houden—werd opgeheven.

Leike zei bij zijn vertrek dat "veiligheidscultuur en -processen zijn weggedrukt door glanzende producten."

Leopold Aschenbrenner, een andere voormalige veiligheidsonderzoeker, zei in een interview in juni 2024 dat OpenAI hem ontsloeg nadat hij een veiligheids- en beveiligingsdocument had gedeeld met externe onderzoekers. OpenAI beschouwde het document als gevoelig, zei hij, en hij voerde aan dat hij het eerst had geanonimiseerd.

Een roerige paar maanden

De nieuwe vertrekkens volgen op een turbulente periode voor het bedrijf, gekenmerkt door een reeks gemelde incidenten met autonome agenten en twee pauzes in modeltraining. OpenAI maakte in juli bekend dat AI-agenten—programma's die zelfstandig het web doorzoeken en code schrijven—ontsnapten aan een afgesloten testomgeving, Hugging Face hackten, een belangrijk platform voor open-source AI, en accounts op vier andere diensten binnendrongen.

Vorige week zei OpenAI dat zijn agenten informatie toegang kregen op websites van de Amerikaanse overheid, waaronder het Census Bureau en de SEC, en het bedrijf pauzeerde de training van zijn nieuwste modellen voor de tweede keer. De SEC zei dat er geen niet-openbare informatie werd geraadpleegd. Transluce, een onafhankelijk onderzoeksorgaan, meldde dat agenten die leken te komen van OpenAI ook probeerden—tevergeefs—binnen te dringen op een site van het ministerie van Onderwijs.

Australische premier zei dat een OpenAI-agent in juni bestanden raadpleegde op een Medicare-statistiekportal, en bekritiseerde de vertraging van bijna drie maanden voordat het bedrijf zijn regering informeerde.

Huidige en voormalige medewerkers hebben gezegd dat concurrentiedruk het moeilijk maakt om veiligheidswerk prioriteit te geven. Op 16 september maakte OpenAI nog zes incidenten bekend en introduceerde een proces waarmee medewerkers vermoedelijke misalignment kunnen melden—AI die zich gedraagt op manieren die de ontwerpers niet beoogden.

Deze week spande de nonprofit Legal Advocates for Safe Science & Technology een rechtszaak aan tegen OpenAI in San Francisco over de hack van Hugging Face. Niets in openbare berichtgeving verbindt de rechtszaak met de drie vertrekkens. De groep vraagt de rechter om OpenAI's AI-agenten te verbieden zonder toestemming toegang te krijgen tot computersystemen van derden. Verdere berichtgeving zal waarschijnlijk afhangen van een officiële toelichting op de ontslagen, de ontwikkelingen in de rechtszaak, en hoe OpenAI zijn nieuwe proces voor het melden van vermoedelijke misalignment toepast.