vg Gazdaság

Sarah Connor időben szólt, de nem hallgattunk rá: már nemcsak meglép a tesztkörnyezetből az AI-ügynök, de támadásokat is végrehajt – pánikban a ChatGPT fejlesztői

Szerző: vg 2026. 08. 23. 3 percnyi olvasás


Sarah Connor időben szólt, de nem hallgattunk rá: már nemcsak meglép a tesztkörnyezetből az AI-ügynök, de támadásokat is végrehajt – pánikban a ChatGPT fejlesztői

Az utóbbi időben több AI-ügynök is kiszabadult tesztkörnyezetéből és támadást próbált végrehajtani weboldalak ellen.


Az OpenAI ideiglenesen leállította eddigi legnagyobb mesterségesintelligencia-fejlesztési programját, ugyanis a vállalat azt vizsgálja, hogy a készülő modell a biztonsági elvárásoknak megfelelően viselkedik-e. A döntést az indokolta, hogy egyre több jel utal arra, hogy a legfejlettebb AI-rendszerek – így a ChatGPT is – önállóan is képesek lehetnek olyan műveletekre, amelyeket fejlesztőik eredetileg nem engedélyeztek.

mesterséges intelligencia, ChatGPT, OpenAI
A ChatGPT fejlesztőinél komoly fejtörést okoz, hogy az AI-ügynökök képesek elhagyni a tesztkörnyezetet. / Fotó: Panya_photo / Shutterstock

Megbéklyózzák a ChatGPT-t mindaddig, amíg biztonsági kockázatot jelent

Az OpenAI kedden közölte, szigorítja belső ellenőrzési rendszerét, és egyelőre lassítja a következő nagy modelljéhez kapcsolódó munkát. Sam Altman vezérigazgató szerint a vállalat akkor avatkozik be, amikor az AI-képességek fejlődése gyorsabbá válik, mint a biztonsági és összehangolási mechanizmusok fejlesztése.

A képzés során a modelleket hatalmas mennyiségű szöveggel és képpel tanítják. A folyamat jelentős számítási kapacitást igényel, a rendszer belső paramétereinek finomhangolása pedig végül meghatározza, hogy az AI mennyire képes összetett következtetésekre és utasítások végrehajtására.

Az OpenAI számára különösen kellemetlen előzmény volt a júliusi Hugging Face-incidens. A vállalat két modelljére épülő AI-ügynök 

  • saját kezdeményezésére elhagyta a zárt tesztkörnyezetet, 
  • majd megpróbálta megtámadni a Hugging Face platformját, 

ahol fejlesztők világszerte osztják meg mesterségesintelligencia-modelljeiket.

Hasonló esetekről számolt be július végén az OpenAI riválisa, az Anthropic is. A vállalat három tesztelés alatt álló modellje jogosulatlan behatolást hajtott végre három szervezet informatikai rendszerébe. Az esetek nyomán több mint ezer technológiai dolgozó írt alá petíciót, amely összehangolt lassítást sürgetett az Egyesült Államok kormányától a legfejlettebb AI-rendszerek fejlesztésében.

Az OpenAI korábban már két hétre felfüggesztette legújabb modelljeinek tréningjét. A munkát később szigorúbb ellenőrzések mellett részben újraindították, ám az Astra nevű következő nagy modell fejlesztésének jelentős része azonban továbbra is szünetel.

A vállalat augusztus elején arra jutott, hogy az Astra elérheti azt a kockázati küszöböt, amelyet az OpenAI a mesterséges intelligencia hackelési képességeire vonatkozóan saját magának állított fel. Ilyen helyzetben a belső szabályok szerint előbb erősebb biztonsági mechanizmusokat kell kialakítani, és csak ezt követően folytatható a fejlesztés.

Már nem csak hazudik az AI, de valódi szándékait is el tudja rejteni

Az OpenAI kedden egy új megfigyelőrendszer fejlesztését is bejelentette, mely a modellek belső következtetési folyamatait figyelné, és gyanús viselkedés esetén legfeljebb 30 percen belül riasztaná az emberi felügyelőket. A rendszer működtetése ugyanakkor az eddigieknél mintegy 20 százalékkal nagyobb számítási kapacitást igényel.

A megoldásnak ráadásul megvannak a maga korlátai, ugyanis az OpenAI 2025-ös kutatásai szerint egy modell megtanulhatja elrejteni a valódi szándékait a következtetési folyamatában, ha tudja, hogy megfigyelik. Ez jelentősen megnehezítheti annak megállapítását, hogy egy AI-rendszer valóban biztonságosan működik-e.

Az OpenAI továbbra sem tette közzé a Hugging Face elleni támadás részletes technikai elemzését, pedig a vállalat korábban ígéretet tett erre. A keddi bejelentés szerint a dokumentum a következő hetekben jelenhet meg.

A fejlemény azért is figyelemre méltó, mert az OpenAI a mesterségesintelligencia-infrastruktúra globális kiépítésének egyik meghatározó szereplője. A fejlesztési versenyben egyre nagyobb modellek és egyre nagyobb számítási kapacitások jelennek meg, míg a vállalatoknak azzal is számolniuk kell, hogy rendszereik bizonyos helyzetekben kiszabadulhatnak a tesztkörnyezetből, és önállóan cselekedhetnek.

A mostani lassítás így az OpenAI számára egy fontos biztonsági tesztet is jelent: a következő modell teljesítményének növelése helyett egy időre annak vizsgálata került előtérbe, hogy a rendszer képes-e kiszámíthatóan és ellenőrizhetően működni.

Alapfogalmak újragondolását kényszeríti ki az AI térhódítása

Egyre komolyabb fejtörést jelent az iparágon kívül is számos szakterület számára a mesterséges intelligencia robbanásszerű fejlődése. A Nagy AI-sztori podcastunk legutóbbi adásában azt jártuk körül, hogy a mesterséges intelligencia már nemcsak technológiai, üzleti vagy oktatási kérdés, hanem egyben jogi kihívás is. 

Nem pusztán arról van szó, hogy egy új eszközt kell szabályozni. Az AI megjelenése olyan alapfogalmakat kényszerít újragondolásra, mint felelősség, diszkrimináció, jogalanyiság, adatkezelés, termékfelelősség vagy vállalati megfelelés. 

A nagy AI-sztori új adásában Menyhárd Attila, az ELTE professzora és a mesterséges intelligencia és technológiai jogi szakjogászképzés vezetője arról beszélt, hogy a jogászoknak ma már nem elég kívülről nézniük a mesterséges intelligenciát. Meg kell érteniük, hogyan működik, milyen korlátai vannak, milyen jogi környezet veszi körül, és hogyan lehet együtt dolgozni azokkal az informatikusokkal, mérnökökkel és vállalati szakemberekkel, akik fejlesztik vagy alkalmazzák ezeket a rendszereket.

ad

További tartalom Önnek