En rivals egen AI-model endte med at gøre det meste af arbejdet ved et brud mod OpenAI. Forskere fra Hacktron AI brugte Anthropics Claude til at skrive fungerende exploit-kode.
Hele indtrængningen tog under 72 timer. OpenAI betalte til sidst en dusør på 6.500 dollars, da teamet beviste, at de havde fået adgang til virksomhedens private kildekode.
Sådan førte et billedupload til et fuldt brud
Angrebskæden begyndte med noget ret almindeligt: en funktion til billedupload på OpenAIs supportforum, der benytter tredjepartssoftwaren Discourse.
Et sikkerhedsfilter skulle screene uploadede filer. Det genkendte dog ikke visse fotoformater og lod dem dermed slippe igennem uset. Disse filer blev derefter behandlet af et separat billedbehandlingsbibliotek med en kendt fejl, der kunne forårsage hukommelsesbrud.
Hacktrons tre mand store team – Harsh Jaiswal, Mohan Pedhapati og Rahul Maini – forsøgte i slutningen af juli at udnytte denne sårbarhed.
En tidligere version af Claude havde svært ved at omgå en sikkerhedsforanstaltning, som randomiserede placeringen af hukommelse.
Timer senere genererede den nyere model funktionel angrebskode og tilpassede den, så den passede til forumets nøjagtige opsætning.
Følg os på X for at få de seneste nyheder, mens det sker.
Det i sig selv gav kun adgang til forumets servere – ikke direkte til OpenAI. En anden, ikke-relateret fejl i OpenAIs single sign-on-opsætning ændrede på det.
Da loginoplysninger fra forummet også fungerede som adgang til ChatGPT- og Codex-konti, kunne et kapret medarbejdersession give direkte adgang til OpenAIs private kodearkiv.
Discourse lappede billedfejlen få dage senere og vurderede dens alvorlighed til 8,8 ud af 10. OpenAI løste godkendelsesfejlen inden for cirka 14 timer, efter at den var blevet anmeldt til virksomhedens bug bounty-program.
Hvorfor AI-laboratorier ofte rammes af deres egne kreationer
Den hændelse opstod ikke isoleret. OpenAI havde allerede offentliggjort en separat hændelse i juli, hvor interne modeller slap ud af en test-sandbox og ramte eksterne systemer.
Anthropic har på sin side anerkendt, at Claude kompromitterede rigtige organisationer under cybersikkerheds-tests, der uventet fik adgang til internettet.
Microsofts AI-chef, Mustafa Suleyman, henviste denne uge til samme sværm af uautoriserede agenter, og advarede offentligt om, at mere selvkørende modeller bliver sværere at styre.
“Det er et advarselsskud… Det er klart nu tid til, at laboratorierne koordinerer, så vi kan sikre, at vi har kontrol over denne teknologi,” sagde Suleyman til Reuters.
Det bemærkelsesværdige ved Hacktron-sagen er ikke, at metoden er ny. Sikkerhedsforskere har kædet softwarefejl sammen i årtier.
Det der har ændret sig, er farten: Opgaver, der tidligere krævede specialiseret menneskelig ekspertise gennem længere tid, blev nu klaret på en enkelt aften, så snart en model med tilstrækkelige evner blev sat ind.
Abonnér på vores YouTube-kanal for at se ledere og journalister give deres ekspertindsigt.









