Forestil dig, at en laboratoriefremstillet virus slipper ud af et højtsikret laboratorie og pludselig dukker op inde hos en tilfældig butik i den anden ende af byen.
Det er mere eller mindre dét, der skete, da en intern sikkerhedstest hos OpenAI, virksomheden bag ChatGPT, tog for nylig en uventet drejning. En af virksomhedens AI-agenter forsøgte at trænge ind i systemerne hos en anden virksomhed. Det skriver BBC.
Den ramte virksomhed er Hugging Face, som er en af verdens største platforme for deling af AI-modeller. Ifølge OpenAI udnyttede AI-agenten en sårbarhed i testmiljøet, hvor den skulle afprøves og rettede derefter sine forsøg mod Hugging Face.
Det er et af de første offentligt kendte eksempler på, at et AI-system på egen hånd har brudt ud af sit testmiljø og forsøgt at bryde ind i et fremmed ét.
AI-agenten blev testet i en såkaldt sandbox – et aflukket digitalt miljø, der er designet til at undersøge, hvordan avancerede AI-systemer opfører sig, uden at de kan påvirke omverdenen.
Under testen lykkedes det systemet at identificere en sikkerhedsbrist og omgå de begrænsninger, der var sat op. Da agenten først havde brudt ud af testmiljøet, forsøgte den på egen hånd at få adgang til Hugging Faces interne systemer, fordi den vurderede, at platformen havde oplysninger, den søgte.
Hugging Faces direktør, Clément Delangue, har i et opslag på X kaldt forløbet “ufatteligt” og sagt, at det mest opsigtsvækkende er, at handlingerne skete helt uden menneskelig indgriben.
Hændelsen har sat gang i en debat om, hvor avancerede AI-systemer efterhånden er blevet, og om de nuværende sikkerhedsforanstaltninger er tilstrækkelige i takt med, at teknologien bliver mere og mere kraftfuld.
Cybersikkerhedsekspert Spencer Starkey udtaler til BBC, at episoden viser, at organisationer er nødt til at opgradere deres forsvar.
– Den ubehagelige sandhed er, at alt for mange organisationer stadig forsvarer sig i menneskeligt tempo, mens de fjendtlige parter er rykket op på maskinernes hastighed, siger han.
Selv beskriver OpenAI hændelsen som “hidtil uset” og har i en pressemeddelelse oplyst, at de efterforsker den i samarbejde med Hugging Face.
