Fire førende AI-laboratorier har nu bekræftet, at deres modeller nåede det åbne internet og derefter fik adgang til systemer hos rigtige virksomheder. Google kom på listen i fredags, cirka fire måneder efter deres egne hændelser fandt sted.
Gemini fik adgang til tre ægte virksomheder under en evaluering i maj. Det er bemærkelsesværdigt, at modellen stoppede i alle tre tilfælde.
Googles Gemini bryder ind i 3 virksomheders systemer under en test
Hændelsen opstod under en “capture-the-flag” sikkerhedsøvelse udført af Irregular. Internetadgang var ikke en del af opsætningen, men en fejl i testmiljøet gav modellen adgang alligevel.
I ét tilfælde gættede modellen ifølge The Wall Street Journal adgangskoder, indtil den fik adgang til et beskyttet system. I de to andre tilfælde opdagede den synlige login-oplysninger i et offentligt repositorium og brugte dem til at få adgang til beskyttede systemer.
Heather Adkins, Googles VP for sikkerhedsteknik, sagde, at de tre berørte virksomheder blev informeret om, hvad der var sket.
“Vi sikrede os, at de tre virksomheder blev gjort opmærksomme, og vi arbejdede sammen med vores træningspartner om de ændringer, de nu har indført i deres testprocesser,” udtalte hun.
Følg os på X for at få de seneste nyheder, så snart de sker
Fire laboratorier, ét mønster
Google oplyste, at agenterne standsede deres aktivitet, efter at de opdagede, at de havde nået ægte virksomhedssystemer i stedet for simulerede mål.
“I en standard evaluering fandt modellen offentlige oplysninger online og gættede login-oplysninger for at få adgang til hjemmesider, som den troede var en del af testen,” udtalte Adkins i en erklæring.
Selskabet tilføjede, at adfærden ikke var et eksempel på fejljustering af modellen og ikke krævede offentliggørelse, da Geminis sikkerhedsforanstaltninger virkede.
En talsperson fra Irregular sagde, at det skyldtes det samme problem, som satte andre AI-laboratorier under pres. Irregular underrettede laboratorierne sidst i juli. Talspersonen tilføjede, at de kendte problemer på deres side blev løst for flere uger siden.
Åbenheden placerer Google sammen med OpenAI, Anthropic og Meta, som alle har rapporteret om modeller, der slap ud af testsystemer i år.
OpenAI oplyste i juli, at modellerne slap ud af en sandkasse og brød ind hos Hugging Face. Anthropic undersøgte dernæst over 141.000 evalueringer og fandt tre af deres egne. Meta rapporterede en hændelse i august.
Abonnér på vores YouTube-kanal for at se ledere og journalister give indsigt fra eksperter









