Fire ledende AI-laboratorier har nå bekreftet at modellene deres nådde det åpne internett og deretter fikk tilgang til systemene hos ekte selskaper. Google sluttet seg til denne listen på fredag, omtrent fire måneder etter at deres egne hendelser fant sted.
Gemini fikk tilgang til tre ekte selskaper under en evaluering i mai. Merk at modellen stoppet i alle tre tilfellene.
Google Gemini får tilgang til tre selskapers systemer under en test
Hendelsen fant sted under en “capture-the-flag” sikkerhetsøvelse utført av Irregular. Internettilgang var ikke en del av oppsettet. Imidlertid førte en feil i testmiljøet til at modellen likevel fikk tilgang.
I én situasjon skal modellen ha gjettet passord til den fikk tilgang til et beskyttet system, ifølge The Wall Street Journal. I de to andre tilfellene oppdaget den eksponerte påloggingsopplysninger i et offentlig tilgjengelig arkiv og brukte dem til å få tilgang til beskyttede systemer.
Heather Adkins, Googles visepresident for sikkerhetsingeniørarbeid, sa at de tre berørte virksomhetene ble informert om hva som hadde skjedd.
“Vi forsikret oss om at de tre virksomhetene ble gjort oppmerksomme på hendelsen, og vi har samarbeidet med vår opplæringspartner om endringer de nå har gjort i testprosessene sine,” sa hun.
Følg oss på X for å få de siste nyhetene etter hvert som de skjer
Fire laboratorier, ett mønster
Google opplyste at agentene stanset aktiviteten etter å ha oppdaget at de hadde nådd reelle selskapsystemer og ikke simulerte mål.
I en standardevaluering fant modellen offentlig informasjon på nett og gjettet påloggingsopplysninger for å få tilgang til nettsteder den trodde var en del av testen, sa Adkins i en uttalelse.
Selskapet la til at denne oppførselen ikke var et eksempel på modell-feiljustering og derfor ikke krevde offentliggjøring, siden sikkerhetstiltakene til Gemini fungerte.
En talsperson for Irregular opplyste at dette dreide seg om den samme feilen som har rammet andre AI-laboratorier. Irregular varslet de involverte laboratoriene i slutten av juli. Talspersonen la til at de kjente problemene på deres side ble løst for flere uker siden.
Offentliggjøringen plasserer Google sammen med OpenAI, Anthropic og Meta, som alle har rapportert om modeller som har unnsluppet testmiljøer i år.
OpenAI offentliggjorde i juli at modellene deres unnslapp en sandkasse og fikk tilgang til Hugging Face. Anthropic gikk deretter gjennom mer enn 141 000 evalueringsrunder og fant tre egne tilfeller. Meta rapporterte en hendelse i august.
Abonner på vår YouTube-kanal for å se ledere og journalister dele ekspertinnsikt









