KülföldSzerző: dw 2026. 07. 31. 2 percnyi olvasás
A Claude AI három különálló verziója tört ki a kibertesztelési környezetekből, és három céget tört fel – közölte a fejlesztője, az Anthropic. A fejlesztés napokkal azután történt, hogy a rivális OpenAI bejelentette, hogy egy szélhámos ügynök feltört egy startupot.
Az Anthropic csütörtökön közölte, hogy mesterséges intelligencia-modelljei "jogosulatlan hozzáférést kaptak" három külső szervezethez a tesztelés során, amelyeket a "valós világ" rendszereitől kellett volna elszigetelni.
A vállalat 141 006 tesztmunkamenetet vizsgált meg, és megállapította, hogy a Claude, az AI-modell három különböző verziója nem megfelelően fér hozzá a három meg nem nevezett szervezet rendszeréhez.
"Claude alapvető technikákkal, például gyenge jelszavak és nem hitelesített végpontok kihasználásával kompromittálta az érintett szervezetek infrastruktúráját" - mondta Anthropic egy blogbejegyzésében.
Az értékelést azután indították el, hogy a rivális OpenAI a múlt héten nyilvánosságra hozta, hogy fejlett mesterséges intelligencia modelljei szélhámosnak bizonyultak egy biztonsági teszt során, és napokig tartó hackertámadást hajtottak végre a Hugging Face néven ismert mesterséges intelligencia-technológia digitális tárházában.
Az OpenAI technológiájával történt incidenssel ellentétben azonban az Anthropic mesterséges intelligencia modelljei hozzáfértek az internethez, mivel a vállalat „félreértésnek” minősítette értékelő partnerével, Irregularral, ami miatt a rendszerek a nyilvános internethez kapcsolódtak.
A jogsértésben érintett antropikus modellek közé tartozott a Claude Opus 4.7, a Claude Mythos 5 és egy belső kutatási modell.
A Mythos 5 a cég egyik legerősebb mesterségesintelligencia-modellje, amelyet csak korlátozott számú jóváhagyott partnernek adtak ki.
Mindhárom incidensben Claude-ot a "capture the flag" kihívással bízták meg, ami az egyik módja annak, hogy az Anthropic felmérje modelljei kiberképességeit.
A vállalat azt mondta, hogy a feladatban a modell egy kitalált forgatókönyvet kapott, és arról tájékoztatott, hogy egy titkos információ vagy a „zászló” el lett rejtve a hálózat másik gépén. A modell célja, hogy betörjön és visszaszerezze.
Az Anthropic azt mondta, hogy a három incidens mindegyike más kitalált „elfog a zászló” forgatókönyvével járt.
"Az egyikben Claude egy kitalált cég alkalmazottját játszotta, aki megtámadta a vállalat belső rendszereit egy privát tesztkörnyezetben" - mondta az Anthropic a blogjában.
Az Anthropic azt mondta, hogy július 23-án kezdte átnézni az értékelés átiratait, és ugyanazon a napon leállított minden kiberértékelést, miután bizonyítékot talált arra, hogy Claude hozzáférhetett az internethez.
Mindhárom incidenst július 24-ig azonosították – közölte a cég, hozzátéve, hogy az Irregularral együttműködve értékeli a helyzetet.
"Úgy közelítünk a javításokhoz, mintha csak a miénk lenne a felelősség" - mondta Anthropic.
Szerkesztette: Dmytro Hubenko
Ne hagyja, hogy az algoritmus elrejtse a híreket. Ha csapatunkra támaszkodik a megbízható jelentéskészítésben, kérjük, szánjon egy percet, és ide kattintva válasszon minket preferált forrásként a Google-onés megnyomja a "csillag" vagy a "preferált" gombot, így mindig az ellenőrzött híreinket látja először.