Forskere tjente $6.500 ved at bryde OpenAI med Anthropics Claude

  • Forskere hos Hacktron AI brugte Claude Opus 5 fra Anthropic til at skrive fungerende udnyttelseskode mod OpenAI’s infrastruktur.
  • Et billedbehandlingsproblem på OpenAI’s fællesskabsforum kombineret med en anden login-fejl gav adgang til privat kode.
  • OpenAI betalte en dusør på $6.500 den 1. september efter at have bekræftet sårbarheden i sine systemer.

En rivals egen AI-model endte med at gøre det meste af arbejdet ved et brud mod OpenAI. Forskere fra Hacktron AI brugte Anthropics Claude til at skrive fungerende exploit-kode.

Hele indtrængningen tog under 72 timer. OpenAI betalte til sidst en dusør på 6.500 dollars, da teamet beviste, at de havde fået adgang til virksomhedens private kildekode.

Sådan førte et billedupload til et fuldt brud

Angrebskæden begyndte med noget ret almindeligt: en funktion til billedupload på OpenAIs supportforum, der benytter tredjepartssoftwaren Discourse.

Et sikkerhedsfilter skulle screene uploadede filer. Det genkendte dog ikke visse fotoformater og lod dem dermed slippe igennem uset. Disse filer blev derefter behandlet af et separat billedbehandlingsbibliotek med en kendt fejl, der kunne forårsage hukommelsesbrud.

Hacktrons tre mand store team – Harsh Jaiswal, Mohan Pedhapati og Rahul Maini – forsøgte i slutningen af juli at udnytte denne sårbarhed.

En tidligere version af Claude havde svært ved at omgå en sikkerhedsforanstaltning, som randomiserede placeringen af hukommelse.

Timer senere genererede den nyere model funktionel angrebskode og tilpassede den, så den passede til forumets nøjagtige opsætning.

Følg os på X for at få de seneste nyheder, mens det sker.

Hvordan Claude hjalp forskere med at tjene 6.500 dollars ved at bryde ind i OpenAI. Kilde: Hacktron AI
Hvordan Claude hjalp forskere med at tjene 6.500 dollars ved at bryde ind i OpenAI. Kilde: Hacktron AI

Det i sig selv gav kun adgang til forumets servere – ikke direkte til OpenAI. En anden, ikke-relateret fejl i OpenAIs single sign-on-opsætning ændrede på det.

Da loginoplysninger fra forummet også fungerede som adgang til ChatGPT- og Codex-konti, kunne et kapret medarbejdersession give direkte adgang til OpenAIs private kodearkiv.

Discourse lappede billedfejlen få dage senere og vurderede dens alvorlighed til 8,8 ud af 10. OpenAI løste godkendelsesfejlen inden for cirka 14 timer, efter at den var blevet anmeldt til virksomhedens bug bounty-program.

Hvorfor AI-laboratorier ofte rammes af deres egne kreationer

Den hændelse opstod ikke isoleret. OpenAI havde allerede offentliggjort en separat hændelse i juli, hvor interne modeller slap ud af en test-sandbox og ramte eksterne systemer.

Anthropic har på sin side anerkendt, at Claude kompromitterede rigtige organisationer under cybersikkerheds-tests, der uventet fik adgang til internettet.

Microsofts AI-chef, Mustafa Suleyman, henviste denne uge til samme sværm af uautoriserede agenter, og advarede offentligt om, at mere selvkørende modeller bliver sværere at styre.

“Det er et advarselsskud… Det er klart ​nu tid til, at laboratorierne koordinerer, så vi kan sikre, ​at vi har kontrol over denne teknologi,” sagde Suleyman til Reuters.

Det bemærkelsesværdige ved Hacktron-sagen er ikke, at metoden er ny. Sikkerhedsforskere har kædet softwarefejl sammen i årtier.

Det der har ændret sig, er farten: Opgaver, der tidligere krævede specialiseret menneskelig ekspertise gennem længere tid, blev nu klaret på en enkelt aften, så snart en model med tilstrækkelige evner blev sat ind.

Abonnér på vores YouTube-kanal for at se ledere og journalister give deres ekspertindsigt.

Ansvarsfraskrivelse

BeInCrypto er forpligtet til upartisk og gennemsigtig rapportering. Denne nyhedsartikel har til formål at levere nøjagtige og aktuelle oplysninger. Læsere opfordres dog til selv at verificere fakta og rådføre sig med en fagperson, før de træffer beslutninger på baggrund af dette indhold. Bemærk venligst, at vores Vilkår og betingelser, Privatlivspolitik og Ansvarsfraskrivelser er blevet opdateret.