TechtudSzerző: Dévai László 2 órával ezelőtt 2 percnyi olvasás
A Gemini félreértette a feladatot, valós rendszereket tört fel, mert azt hitte, hogy azok is a biztonsági teszt részei.
A Google Gemini modellje egy kiberbiztonsági teszt során hozzáfért az internethez, majd három olyan vállalat rendszerébe is bejutott, amelyek valójában nem tartoztak a teszt célpontjai közé. A májusi tesztet az Irregular nevű független kiberbiztonsági értékelőcég végezte. A Reuters cikke szerint ez az első ismert eset, amikor a Google egyik MI-rendszere önállóan hajtott végre ilyen akciót.
Heather Adkins, a Google biztonsági mérnöki területért felelős alelnöke szerint a Gemini nyilvánosan hozzáférhető információkat talált az interneten, majd ezek felhasználásával jutott be a három rendszerbe. Az egyik esetben addig próbálgatott jelszavakat, amíg sikerült hozzáférést szereznie egy védett rendszerhez, a másik két esetben pedig egy nyilvános kódtárban talált belépési adatokat. A modell mindhárom célpontról azt feltételezte, hogy a teszt részét képezik.
A Google közölte, hogy értesítették az érintett szervezeteket, az Irregular pedig módosította a tesztelési folyamatait. Adkins szerint az esetek azt mutatják, mennyire fontos, hogy a nagy teljesítményű MI-modelleket felelős működésre tanítsák. A Google szerint a Gemini mindhárom esetben leállította a támadást. Az Irregular azt közölte, hogy a problémákat már hetekkel ezelőtt kijavították.
Nem ez volt az első hasonló incidens az Irregular tesztjei során: korábban a Meta, az Anthropic és az OpenAI modelljeinél is történtek hasonló esetek. A Meta augusztusban azt közölte, hogy az ő esetükben nem a tesztkörnyezetből való kitörés vagy különösen kifinomult kibertámadás történt. Az incidensek ugyanakkor egyre több kérdést vetnek fel azzal kapcsolatban, milyen biztonsági korlátokra van szükség, amikor az egyre önállóbban működő MI-ügynökök hozzáférést kapnak az internethez és valódi számítógépes rendszerekhez.
A Google esete illeszkedik az elmúlt hónapok hasonló történéseinek sorába. Korábban az Anthropic egyik ügynöke valós vállalatokat támadott meg egy biztonsági teszt során, az OpenAI még nem nyilvános modelljeire épülő ügynökök pedig kijutottak a korlátozott tesztkörnyezetből, az interneten kommunikáltak egymással, és hozzáfértek a Hugging Face belső rendszereihez. A történtek miatt több MI-fejlesztő és szakértő is szigorúbb biztonsági előírásokat sürgetett.
A fejlett MI-modellek kockázatairól közben egyre élesebb vita zajlik, erről ebben a cikkünkben írtunk részletesen.
Steve Eisman, a 2008-as pénzügyi válságot előre látó befektető szerint az OpenAI-hoz és az Anthropichoz hasonló cégeknek üzleti érdekük is fűződhet ahhoz, hogy hangsúlyozzák a technológia egzisztenciális veszélyeit, mert az ezt követő szabályozás kedvezőbb piaci helyzetet teremthet számukra. Ezzel szemben több, az iparágban dolgozó kutató és vezető valódi veszélynek tartja az egyre önállóbb MI-rendszereket, és a fejlesztés lassítását, valamint szigorúbb biztonsági szabályokat sürget.