OpenAI siger, at to af deres AI-modeller brød ud af et sikkert testmiljø og hackede sig ind hos Hugging Face. Modellerne gjorde det for at snyde ved en intern cybersikkerhedsevaluering.
Virksomheden offentliggjorde hændelsen i tirsdags. Det involverede GPT-5.6 Sol, OpenAI’s mest avancerede offentlige model, og en endnu kraftigere model, der ikke er udgivet.
Sådan hackede OpenAIs modeller Hugging Face
OpenAI testede de to modeller mod ExploitGym, et gratis offentligt benchmark, der måler hackingsfærdigheder. Virksomheden fjernede de sædvanlige sikkerhedsforanstaltninger, som normalt begrænser cyberangreb under testen.
Modellerne fandt ud af, at Hugging Face, en platform der er vært for open-source AI-modeller, opbevarede løsningerne til benchmarken. Herefter kædede de sårbarheder sammen på tværs af OpenAI’s researchsystemer og Hugging Face’s driftservere.
Den vej førte dem direkte til svarene i Hugging Face’s database. OpenAI udtalte, at modellerne var “ekstremt fokuserede” på at løse testen. OpenAI kaldte hændelsen “en hidtil uset cyberhændelse” i deres rapport.
Episoden falder midt i en bredere debat om AI-sikkerhedsforanstaltninger. Største laboratorier kører allerede strenge cybersikkerhedstests på nye modeller før de frigives.
Hugging Face siger skaden er under kontrol
Hugging Face rapporterede først angrebet i en offentliggjort meddelelse den 16. juli. I øjeblikket vidste de kun, at en autonom AI-agent stod bag. Angriberen fik adgang til interne datasæt og serviceoplysninger.
Forsvaret stødte på en usædvanlig forhindring. Sikkerhedsforanstaltninger på en førende amerikansk model blokerede for det digitale detektivarbejde. Holdet brugte i stedet GLM 5.2, en åben model fra Z.ai, et kinesisk AI-firma.
Hugging Face har siden lukket de udnyttede kodeveje og udskiftet alle udsatte adgangsoplysninger. Virksomheden fortæller, at ingen offentlige modeller, datasæt eller brugerrettede tjenester er blevet ændret.
Direktør Clem Delangue delte en udtalelse i forbindelse med OpenAI’s offentliggørelse.
“Denne hændelse, som måske er den første af sin slags, beviser noget vi længe har ment: AI-sikkerhed bliver ikke løst af én enkelt virksomhed bag lukkede døre. Den bliver løst åbent, i fællesskab, med bred adgang til AI for alle, overalt.”
Begge virksomheder undersøger nu sagen sammen. OpenAI vil dele alle detaljer, når arbejdet er afsluttet. Det åbne spørgsmål er, om nuværende inddæmningsmetoder kan holde, efterhånden som modellerne bliver mere avancerede.








