GazdaságSzerző: portfolio 2026. 09. 03. 3 percnyi olvasás
Az OpenAI bemutatta legújabb modelljét, a GPT-6 Astrát, amelyet saját bevallása szerint az eddigi legjobb rendszerének tart, ugyanakkor elismerte, hogy az új modell időnként megpróbálja kijátszani az emberi felügyeletet. A bejelentés különösen kényes időpontban érkezett, hiszen a vállalat még mindig a júliusi biztonsági incidens következményeivel küzd.
Az OpenAI számára komoly presztízsveszteséget okozott, hogy AI-ügynökei júliusban kitörtek egy zárt tesztkörnyezetből, behatoltak a Hugging Face nyílt forráskódú platform rendszereibe, majd megpróbálták eltüntetni a nyomaikat.
Hasonló eset történt a rivális Anthropicnál is, ami széles körben vetett fel biztonsági aggályokat az ágensalapú mesterséges intelligenciával, vagyis a minimális emberi beavatkozással önálló feladatvégzésre tervezett rendszerekkel kapcsolatban.
A GPT-6 Astra a júliusban kiadott GPT 5.6 Sol utódja, és az OpenAI szerint
gyorsabb, emellett sokoldalúbb is, mint bármelyik korábbi modell.
Az új rendszer képességei közé tartozik többek között
A vállalat konkrét példákkal szemléltette a teljesítményt, rámutatva, hogy egy macskaszitter megtalálása, ami egy embernek 30 percébe telne, az Astrával mindössze 5 perc 27 másodpercet vesz igénybe, az álláskeresés időtartama pedig 5 óra helyett 2 perc 51 másodpercre csökken.
Az OpenAI ugyanakkor azt is közölte, hogy az Astra fokozottabb hajlamot mutat a gondolkodási lépéseinek, vagyis a problémamegoldás során alkalmazott módszereinek szándékos elrejtésére vagy álcázására, ami megnehezíti az utólagos emberi kiértékelést. A vállalat szerint összetettebb feladatoknál a modell egyelőre nem mindig képes elfedni a módszereit, ám ezen a téren folyamatosan fejlődik.
Jakub Pachocki, az OpenAI tudományos igazgatója egy csütörtöki sajtótájékoztatón elismerte, hogy a felügyelet egyre nehezebb feladat.
Ahogy a modellek egyre fejlettebbé válnak, egyre nehezebb pontosan megérteni, mire is képesek
– fogalmazott, hozzátéve, hogy a képességek növekedése nem garantálja az értékre igazítás (alignment) fejlődését sem, vagyis azt, hogy a mesterséges intelligencia az emberi értékeknek megfelelően működjön.
Az AI-ügynökök felügyelete kulcsfontosságú elem abban, ahogyan az OpenAI igyekszik megnyugtatni a szabályozókat, a törvényhozókat és a nyilvánosságot, különösen a júliusi biztonsági incidens tükrében. A GPT-6 Astra képességeinek és kockázatainak egyidejű bemutatása jól szemlélteti azt a feszültséget, amely az iparágban a fejlett modellek piacra dobásának tempója és a biztonsági garanciák között feszül.
Forrás: Reuters
A címlapkép illusztráció. Címlapkép forrása: Getty Images