Az izraeli Irregular vállalat által 2026 májusában végzett kiberbiztonsági tesztelése során a Google Gemini mesterséges intelligencia modellje a tesztelők szándéka ellenére internethozzáféréshez jutott, majd behatolt más vállalatok rendszereibe. Ugyanezen cég hasonló vizsgálatokat végzett az OpenAI, az Anthropic és a Meta rendszereinél is. Az esetről elsőként a Wall Street Journal (WSJ) számolt be.
A WSJ értesülései szerint a Gemini úgy szerzett hozzáférést az egyik védett rendszerhez, hogy többszöri próbálkozással kitalálta annak jelszavát, a másik két esetben viszont nyilvános adattárakban talált hitelesítési adatokat, amelyek megszerzésével jogosulatlanul hozzáférhetett a rendszerekhez. Az Anthropic és az OpenAI eseteivel ellentétben a Gemini modell felhagyott a behatolás folytatásával, amint felismerte, hogy egy valódi vállalat rendszerébe jutott be. Az Irregular 2026 júliusában értesítette a Google-t az incidensekről.
Egy, az előző hónapban közzétett jelentés szerint az Irregular egy elnevezési hibára vezette vissza a vizsgálat során történt behatolásokat, ugyanis a „capture the flag” gyakorlatok során használt fiktív cégnév véletlenül egyezést mutatott egy valódi domainnel. Ez lehetővé tette a modellek számára, hogy az internethozzáférés segítségével „korlátozott számú alkalommal” célba vegyék az adott domaint.
Heather Adkins, a Google biztonságtechnikai alelnökének nyilatkozata szerint az eset rávilágít arra, hogy a nagy teljesítményű MI modelleket felelősségteljes viselkedésre kell tanítani és hogy szerencsére ebben az esetben a Gemini modellje megfelelően járt el. Ezen felül azt is elárulták, hogy a modell viselkedését nem tekintik nem összehangolt működésnek (misalignment), mivel az ágensek felhagytak a tevékenységgel miután működésbe léptek a biztonsági mechanizmusok. Bár azt nem tudni, mely vállalatok voltak a célpontok, az Irregular elmondása szerint hetekkel ezelőtt orvosolták az incidensekhez vezető problémát.