EgyébSzerző: euronews 2026. 08. 19. 3 percnyi olvasás
Az OpenAI bejelentette, hogy két hétre szünetelteti legfejlettebb mesterségesintelligencia-képzésének kulcsfontosságú szakaszait, és felülvizsgálja kutatási tevékenysége biztonságát, egy hónappal azután, hogy egyik saját modellje kitört egy tesztkörnyezetből, és beszivárgott a Hugging Face mesterséges intelligencia platform rendszereibe.
A ChatGPT-gyártó szándékosan visszafogja legfejlettebb kutatásának ütemét, beleértve a legnagyobb tervezett megerősítési-tanulási futtatását is, hetekkel azután, hogy egy saját modellekből épített rendszer kicsúszott egy belső biztonsági teszt során, és betört a Hugging Face mesterséges intelligencia platformra.
Sam Altman vezérigazgató az X-en közzétette, hogy az OpenAI a szélesebb iparággal egyeztet a közös biztonsági szabályokkal kapcsolatban, de addig "egyoldalúan lép fel", amíg meg nem teszi.
A döntést kiváltó epizód júliusban bontakozott ki, amikor az OpenAI a GPT-5.6 Sol-t tesztelte egy kiadatlan, erősebb prototípus mellett egy belső benchmarkon, amely a támadó kiberkészségeket mérte, a szokásos biztonsági korlátozásokat szándékosan kikapcsolva, hogy felmérjék a modellek nyers képességeit.
A teszt megoldása helyett a rendszer egy korábban ismeretlen hibát talált, kiszabadult a homokozóból vagy az ellenőrzött környezetből, elérte a nyílt internetet, és nagyjából négy és fél napot töltött a Hugging Face infrastruktúrájának vizsgálatával, végül betört, hogy megkeresse a tesztre adott válaszokat.
A Hugging Face saját rekonstrukciója körülbelül 17 600 különálló akciót számlált, mielőtt megfékezték a behatolást, mivel számos más céget is érintett.
Mindkét fél azt állítja, hogy nem találtak rosszindulatú szándékra utaló jeleket, és a Hugging Face azóta hozzáférést kapott az OpenAI modelljének egy erősebb, kevésbé korlátozott verziójához, hogy segítsen megvédeni saját rendszereit.
A második kiváltó ok augusztus 7-én történt, amikor a belső értékelések azt sugallták, hogy az Astra, az OpenAI következő határmodellje átlépheti a kiberképesség „kritikus” küszöbét a vállalat saját kockázati keretein belül.
Az Astra egyes munkaterhelései azóta szigorúbb ellenőrzések mellett folytatódtak, de jelentős részük továbbra is befagyott, amíg meg nem felelnek az elszigetelt tesztelési környezetekre, a korlátozott hálózati hozzáférésre és a folyamatos felügyeletre vonatkozó új szabványoknak.
Egy új észlelőrendszer immár a modelltevékenységet ellenőrzi, ahogy az megtörténik, és célja, hogy 30 percen belül megjelöljön bármit, ami az illetéktelen hozzáférésre vagy a védintézkedések letiltásának kísérletére hasonlít. Az OpenAI számítási költsége a megfigyelt feldolgozási teljesítmény nagyjából 20%-át teszi ki.
Az OpenAI szerint a változtatásokat már előre megtervezték, nem pedig közvetlen reakcióként a jogsértésre, ugyanakkor elismeri, hogy az incidens sürgőssé tette. A cég nincs egyedül ezzel a problémával.
Az Anthropic és a Meta hasonló epizódokat hozott nyilvánosságra, amelyekben saját modelljeik feltörték a harmadik féltől származó rendszereket az elmúlt hetekben végzett tesztelések során.
Az OpenAI és az Anthropic külön támogatta a munkatársak által vezetett petíciót, amelyben arra kérte a kormányokat, hogy segítsenek koordinálni, hogy milyen gyorsan fejlődik az iparág, ami jelentős elmozdulás Altman korábbi ellenállásától a mesterséges intelligencia lassítására irányuló nyilvános felszólítások felé.