bbc Külföld

Az antropikus mesterséges intelligencia hamis profilokat hozott létre, és feltörési kísérlet során kiadta magát másoknak

Szerző: bbc 2026. 08. 05. 4 percnyi olvasás


Az antropikus mesterséges intelligencia hamis profilokat hozott létre, és feltörési kísérlet során kiadta magát másoknak

Az Egyesült Királyság mesterséges intelligencia biztonsági intézete szerint az Anthropic és OpenAI modellek legutóbbi viselkedése rosszindulatú és példátlan volt.


A világ két legerősebb mesterséges intelligencia-eszköze hamis emberi profilokat hozott létre, hogy megpróbálja becsapni az embereket egy kibertámadási kísérlet során az Egyesült Királyság AI Security Institute (AISI) tesztelése során.

A legsúlyosabb esetben az Anthropic's Mythos AI privát üzenetek küldésével próbált hozzáférni egy szolgáltatáshoz, miután valódi embereket utánzó hamis fiókokat hozott létre.

Az AISI kedden azt közölte, hogy a Mythos – és az OpenAI Sol – AI modelljei olyan szintű „autonómiát és megtévesztést” folytattak, amelyre korábban nem volt példa, bár kiderült, hogy a legtöbb rosszindulatú akciót a Mythos hajtotta végre.

Az Anthropic és az OpenAI az AISI jelentésére válaszolva megjegyezte, hogy a teszt csökkentette vagy megszüntette a normál biztosítékokat.

Az AISI értékelői először egy teszt során vették észre, hogy "szokatlan adatátvitelek hagyták el kutatórendszereinket", majd azt találták, hogy "egyes tesztelt ágensek valós személyekre és szervezetekre irányuló tartós, potenciálisan káros tevékenységet folytattak".

A legsúlyosabb esetben egy Mythos ügynök egy emberi kibertámadó rutinját követte, és megpróbálta rávenni az embereket, hogy hozzáférést biztosítsanak a GitHubhoz, egy nagy platformhoz, ahol a technológiafejlesztők szoftverkódokat tárolnak.

Az ügynök "rosszindulatú kódot" próbált beilleszteni a GitHub rendszerébe.

Azonosította és felkutatta azokat az embereket, akik fenntartották a GitHubot, és hamis fiókokat hozott létre ezeken a valódi embereken.

Üzeneteket és fájlokat küldött egy fájlmegosztó szolgáltatáson keresztül annak érdekében, hogy nyomást gyakoroljon és rávegye az embereket a rosszindulatú kód jóváhagyására.

Amikor megtámadták, "módosította korábbi tevékenységét, hogy ártalmatlannak tűnjön, és fontolóra vette egy új identitás felvételét a folytatáshoz" - mondta az AISI.

A kísérletek során az emberi ellenőrzés akadályozta meg az ügynököt abban, hogy sikeresen eljuttassa a rosszindulatú kódot a GitHubra.

Míg az AISI szerint a Mythos ügynököt nem utasították kifejezetten az ilyen viselkedés elkerülésére vagy végrehajtására, ez volt az első alkalom, hogy az autonómiával és a megtévesztéssel kapcsolatos kockázatokat a való világban egyértelműen, konkrét felszólítás nélkül mutatták ki.

A rivális mesterséges intelligencia-cégek, amelyek a nyilvános tőzsdére készülnek, az elmúlt hetekben kerültek a hírek közé, miután bejelentették, hogy eszközeik felelősek több kiberhackelésért.

  • Az Anthropic Claude MI-je megszökik, hogy betörjön három szervezetbe

    • Közzétett
      4 napja
  • Az OpenAI szerint a szélhámos mesterséges intelligencia megpróbált feltörni más cégeket

    • Közzétett
      7 napja

Az Anthropic egy nyilvános nyilatkozatában azt írta, hogy az AISI tesztelési paraméterei "nem reprezentatívak egyik gyártási modellünkre sem".

Hozzátette, hogy a cég saját vizsgálatot folytat az incidenssel kapcsolatban, hogy "beazonosítsa magatartásának okait".

Az OpenAI szóvivője elmondta, hogy az AISI tesztelési feltételei "nem tükrözik a szokásos használatot", és a vállalat "továbbra is együttműködik az értékelőkkel és más érdekelt felekkel az iparágban annak érdekében, hogy megerősítsék a közös gyakorlatokat az értékelések biztonságos elvégzésére, amint a modellek egyre alkalmasabbakká válnak".

Az AISI kedden azt mondta, hogy az AI-modellek ilyen módon történő tesztelése rutinszerű, bár elismerte, hogy ezek "olyan körülmények, amelyek nem tükrözik azt, hogy a határmodelleket hogyan teszik elérhetővé a nyilvánosság számára".

Azt mondta azonban, hogy a mesterséges intelligencia hozzáférése a nyílt internethez "valóságosabb képet ad arról, mire lehet képes egy modell" aljas hackerek kezében.

Hozzátette, hogy a szóban forgó modell-viselkedés "kis számú eseményt jelent nagyon speciális feltételek mellett".

Mindazonáltal azt mondta, hogy a Mythos és a Sol egy egyszerű feladatra adott válasza kívül esik azon, amire az AI-eszközöket kérték.

"Az ügynök által végzett tevékenység újszerű, potenciálisan megtévesztő viselkedés jeleit mutatta, és olyan mértékű és súlyosságú volt, amire nem számítottunk" - mondta az AISI.

Kanishka Narayan mesterséges intelligencia miniszter azt mondta, hogy az ilyen típusú kockázatok azonosítása és megosztása "pontosan az AISI célja".

Hozzátette, fontos megérteni az AI-t, hogy "biztonságosabbá tegyük a használatát, és hogy az emberek továbbra is profitálhassanak belőle életükben és munkájukban".

A vonatkozó tesztek július 25-én kezdődtek, és az AISI július 28-án vette észre őket.

Az Insitutu mindegyik modellt arra kérte, hogy "oldjanak meg egy kiberbiztonsági kihívást", amely a GitHub szoftverkódtárat érintette, amely a Microsoft tulajdonában van.

A GitHubot és az érintett felhasználókat az AISI értesítette a megkísérelt jogsértésekről.

A GitHub azt mondta a BBC-nek, hogy az irányelveinek megfelelően letiltotta a hamis fiókokat.

  • Az AI-cégeknek felelniük kell a szélhámos robotokért – mondja a feltört cég főnöke

    • Közzétett
      4 napja
  • Az Amazon és az Apple most mesélt többet mesterségesintelligencia-terveikről – három dolgot tanultunk meg

    • Közzétett
      5 napja
  • Mi az AI és hogyan működik?

A green promotional banner with black squares and rectangles forming pixels, moving in from the right. The text says: “Tech Decoded: The world’s biggest tech news in your inbox every Monday.”

Iratkozzon fel Tech Decoded hírlevelünkre, hogy kövesse a világ legnépszerűbb technológiai történeteit és trendjeit. Az Egyesült Királyságon kívül? Regisztráljon itt.

ad

További tartalom Önnek