bbc Külföld

Először OpenAI, most Meta – miért történnek folyamatosan mesterséges intelligencia-hackek?

Szerző: bbc 2026. 08. 06. 7 percnyi olvasás


Először OpenAI, most Meta – miért történnek folyamatosan mesterséges intelligencia-hackek?

Cégek özöne fedi fel, hogy az AI-modellek hozzáfértek az internethez – valódi következményekkel.


Az elmúlt két hét során az AI modellekről szóló jelentések – akár technikailag, akár erkölcsileg – elkerülhetetlenek voltak.

Ami csepegéssel kezdődött – a ChatGPT-gyártó OpenAI elismerte, hogy mesterséges intelligenciájuk feltörte a Hugging Face oldalt –, az olyan csoportok özönévé vált, amelyek felfedték, hogy a mesterséges intelligencia irányíthatatlanná válását fedezte fel.

A Claude-gyártó Anthropic, a Meta és az Egyesült Királyság mesterséges intelligencia-biztonsági intézete (AISI) mindannyian beszámoltak olyan incidensekről, amelyek aggasztó képet festenek egy olyan világról, amelyben a technológia a szélhámosság a norma.

Valójában minden eset betekintést nyújt az egyre jobban felkészült mesterségesintelligencia-ügynökök által jelentett kockázatokba – és annak fontosságába, hogy teszteljék határaikat, mielőtt a világ elé bocsájtják őket.

Az OpenAI incidens – ahogyan a Hugging Face társalapítója, Thomas Wolf leírta – „ébresztő” a technológiai ipar számára, mivel július végén történt.

Ez egy nagy pillanat volt, amely arra késztette a nagyvállalatokat, hogy elgondolkodjanak saját rendszereiken – és bizonyos esetekben ellenőrizzék, nem hagytak-e ki valami hasonlóan sokkoló dolgot.

Anthropic volt az első, aki fellépett. Pénteken a cég több ezerből három olyan esetet talált, amikor modelljének, Claude-nak sikerült hozzáférnie az internethez.

Kedden aztán az AISI, a legmodernebb modelleket értékelő brit kormányhivatal közölte, hogy "biztonsági incidenst" észlelt egy rutinszerű értékelés során.

Mind az OpenAI, mind az Anthropic modelljeit tesztelte, és azt találta, hogy ők is megpróbáltak kibertámadásokat végrehajtani – „vizsgálatot, átláthatóságot és cselekvést” kérve.

Végül a Meta következett, amely felfedte, hogy az egyik mesterséges intelligencia modellje véletlenül hozzáférhetett az internethez egy harmadik fél által végzett teszt során történt "hibás konfiguráció" miatt.

Az incidens nyilvánosságra hozatalakor az előtte állók nyomdokaiba lép.

Tesztkérdések

Mielőtt a mesterséges intelligencia modelleket nyilvánosságra hoznák, belső és külső értékelések során tesztelik őket.

A cél az, hogy kitaláljuk, hogy jót vagy rosszat tudnak tenni, valamint hogyan teljesítenek a képességeiket mérő benchmarkokban.

Ezek általában az úgynevezett "homokozókban" zajlanak. Ezeket a védett tereket úgy tervezték, hogy tükrözzék a valódi rendszereket – de szigorú védőkorlátokkal.

Az OpenAI-Hugging Face incidens során a mesterséges intelligencia magát a homokozót támadta meg, és talált egy sebezhetőséget, amely lehetővé tette az internet elérését és a "gazemberséget".

ábra felirat,

Nézze meg: Miért olyan riasztó az OpenAI kibertámadás?

Eközben az AISI azt mondta, hogy saját incidense, amely során két hatékony AI-eszköz hamis emberi profilokat hozott létre, hogy megpróbálja becsapni az embereket a kibertámadási kísérlet során, nem a homokozóval volt kapcsolatos.

Ehelyett a tesztek elvégzésének volt köszönhető.

A tesztelt modellek hozzáférést kaptak az internethez, és az AISI letiltotta a beépített szűrőket is, amelyek általában blokkolják a veszélyes kibertámadásokat.

"Bizonyos mértékig az értékelési tervezési döntéseink és a konkrét konfigurációink lehetővé tették ezt a viselkedést" - mondta, miközben megjegyezte a váratlan "újszerű, potenciálisan megtévesztő viselkedésekre utaló jeleket".

Alan Woodward professzor, a Surrey Egyetem kiberbiztonsági professzora azt mondta, hogy ezek az esetek – bár különböznek egymástól abban, hogy mi és miért történt – fontos történetet mesélnek el.

"30 éven át a szoftvertesztelés egyik szabálya szilárdan tartotta magát: bármi, ami a tesztkörnyezetben történik, a tesztkörnyezetben is marad" - mondta.

– Az elmúlt hónapban háromszor szegték meg ezt a szabályt.

"Az egyik modell kitört. Az egyik besétált egy tévedésből nyitva hagyott ajtón. Az egyiknek szándékosan adták oda a kulcsokat, hogy a tesztelők meg tudják mérni, mit csinál."

Azt mondta, ezek különböző okok, de ugyanaz a tanulság: "a tesztelő laboratóriumban él a kockázat".

Azt mondta a BBC-nek, hogy amint a modellek egyre alkalmasabbakká válnak, többet kell tenni annak érdekében, hogy biztosítsák azokat a környezeteket, ahol tesztelik őket.

"A mesterséges intelligencia ügynökének tesztelése kevésbé olyan, mint a kód ellenőrzése, hanem inkább egy veszélyes anyag kezelése: lezárt helyiségek, állandó megfigyelés, hogy mi hagyja el az épületet, begyakorolt ​​elszigetelési terv" - mondta.

"Az AISI egy órán belül megfékezte az incidenst. Lehet, hogy a következő szervezet nem."

  • Mi az AI és hogyan működik?

  • Az AI-cégeknek felelniük kell a szélhámos robotokért – mondja a feltört cég főnöke

    • Közzétett
      5 napja

Növekvő képességek

Azok számára, akik olyan mesterséges intelligencia-eszközöket fejlesztenek, amelyek célja, hogy egy személy nevében tegyenek lépéseket, gondos egyensúlyt kell találniuk az előnyeik kihasználása és a kockázatok feltárása között.

A haszon jelentős. Elméletileg képesek lennénk megszabadulni az olyan unalmas, alantas feladatoktól, mint például az e-mailek megválaszolása, az értekezletekre járás vagy a naptárak és naplók kezelése, ha ezeket képes robotokra ruházzuk át.

Hátránya, hogy a nagy hatalommal nagy felelősség és kockázat jár.

Ez különösen akkor valósul meg, amikor olyan eszközökhöz adjuk át a hatalmat, amelyek – mint mi – nem képesek egy sor értéket, kontextust és megértést hozni az általunk hozott döntésekbe.

"A közelmúltban történt incidensek, amelyekben a határ menti mesterséges intelligenciamodellek nem engedélyezett akciókat hajtanak végre, és bizonyos esetekben emberhez hasonló megtévesztő viselkedést mutatnak a nyílt interneten, komolyan emlékeztetnek az AI-képességek jelentette kockázatokra" - mondta Ollie Whitehouse, a Nemzeti Kiberbiztonsági Központ technológiai igazgatója kedden.

Egyesek úgy vélik, hogy az eszközök által kezelt feladatok hatalmas mennyisége azt jelenti, hogy az emberi felügyelet nem biztos, hogy elegendő ahhoz, hogy megfékezzük a modellek csalóka problémáját.

De addig is sokan úgy érzik, hogy az általános felügyelet megerősítése létfontosságú, ha a fejlődés ugyanolyan, őrjöngő ütemben folytatódik.

Mi lesz ezután?

ChatGPT, OpenClaw and Claude app widgets shown on a smartphone screenKép forrása,Getty Images
Képaláírás,

Az AI-ügynökök már a digitális életünk részévé válnak olyan szolgáltatások révén, mint a ChatGPT, az OpenClaw és a Claude

Nem valószínű, hogy a Meta lesz az utolsó, aki olyan modellek megállapításaival bukkan fel, amelyek azt mutatják, hogy – ahogyan Prof Woodward mondja – „iskolába jártak” – és megtanulták a saját módszereinket a rendszerek hiányosságainak megtalálására és kihasználására.

Egyesek számára ezek az epizódok arra utalnak, hogy tisztázzák az AI-cégek biztonsági hibáit, amelyek vezető szerepet töltenek be ebben a játékot megváltoztató, korszakot meghatározó technológiában.

Mások számára ezek csupán egy újabb eszközt jelentenek a technológiai cégeknek, hogy felpörgetik erős modelleiket, és versenyezzenek a riválisokkal.

Számomra mindkét elmélet tartalmaz némi igazságot.

De ahogy egymás után felemelték a fejüket, ezek az események mindazonáltal félelmet keltettek az AI képességeivel kapcsolatban, és a fejlesztők előretörése során, hogy ezek merre haladnak.

A kérdés pedig elkerülhetetlenül arra irányul, hogy mit tehetnek és mit kell tenniük a szabályozóknak ezután.

Michael Birtwistle, az Ada Lovelace Institute társigazgatója rámutat arra, hogy az Egyesült Királyságban nincsenek jogi ösztönzők a mesterséges intelligencia-cégek számára, hogy megakadályozzák a rendszerekben a veszélyeket jelentő képességek kifejlesztését, és hogy a tesztelési protokollok kudarcának nincs következménye.

Tágabb értelemben Dr. Imogen Stead, a Center for Long-Term Resilience MI-politikai menedzsere azt mondta a BBC-nek, hogy mivel a határ menti AI-rendszerek tesztelésének lehetőségei sokak számára beszűkülnek, a kormányoknak követniük kell az Egyesült Királyságot a tesztelésre szánt intézetek felállításában.

A harmadik felek által végzett értékelések fejlesztése olyan kezdeményezésekkel, mint például a „megbízható tesztelői rendszer” a legkockázatosabb típusú kihívásokra, szintén felhasználható a káros hatások korlátozására, mondta.

Ahelyett, hogy közben félne egy mesterséges intelligencia-kiberapokalipszistől, Woodward professzor azt mondja, „ez a „Maradj nyugodt és javítsd ki a dolgokat” esete.

Philippa Wain és Imran Rahman-Jones további jelentései

A green promotional banner with black squares and rectangles forming pixels, moving in from the right. The text says: “Tech Decoded: The world’s biggest tech news in your inbox every Monday.”

Iratkozzon fel Tech Decoded hírlevelünkre, hogy kövesse a világ legnépszerűbb technológiai történeteit és trendjeit. Az Egyesült Királyságon kívül? Regisztráljon itt.

ad

További tartalom Önnek