Az OpenAI azt állítja, hogy lelassította néhány legfejlettebb mesterséges intelligencia modelljének képzését a biztonság javítása érdekében.
Egy blogbejegyzésben,külső, a ChatGPT-gyártó közölte, hogy új intézkedéseket vezet be, miután mesterséges intelligencia-ügynökei autonóm módon megkerülték a biztosítékokat, és feltörték a Hugging Face technológiai induló vállalkozást.
Azt mondták, hogy két hétig lelassítják a képzést, amíg a frissítéseket bevezetik.
"A határmodellek képességei gyorsan felgyorsulnak" - mondta a vállalat. "Azt a képességünket, hogy megértsük... és biztosítsuk őket, előrébb kell maradnunk."
A Claude-gyártó, az Anthropic és a Facebook-tulajdonos, a Meta hasonló típusú hackelésekről számolt be az AI-vel az OpenAI kezdeti bejelentését követő hetekben, miszerint egyes modelljei feltörték a Hugging Face-t.
A cég azonban azt mondta, hogy nem állította le teljesen az AI fejlesztését. Ehelyett a szünet a „legújabb modelljeink megerősítő tanulási tréningjén” tartana.
Ez egy olyan képzési módszer, amelyben a mesterséges intelligencia modellek a közvetlen visszacsatolás révén javulnak, ami javítja a képességüket a feladatok elvégzésére és a felhasználókra való hatékonyabb reagálásra.
A vállalat emellett bővítené a veszélyes viselkedés megfigyelésére használt rendszereit, és további biztonsági ellenőrzéseket vezetne be, mielőtt folytatná a nagyobb léptékű képzést.
"A modell fejlődése most rendkívül gyors" - tette közzé az OpenAI vezérigazgatója, Sam Altman az X-en,külsőaz intézkedésekről.
"Mindig azt mondtuk, hogy intézkedünk, ha úgy érezzük, hogy a modell képességei felülmúlják a biztonság ütemét."
A szünetet néhányan óvatos optimizmussal fogadták az AI-szférában – bár mások szkeptikusak maradtak.
Gina Neff professzor, a Cambridge-i Egyetem Minderoo Technológiai és Demokrácia Központjának ügyvezető igazgatója azt mondta, hogy az OpenAI "sajtóközleményben támasztja alá a biztonságot", és megkérdőjelezte, hogy az önkéntes vállalati biztosítékok elegendőek-e nagyobb kormányzati felügyelet nélkül.
"Melyik az: az OpenAI-ban megbízhatunk abban, hogy önkéntesen bevezeti a ténylegesen működő biztosítékokat, vagy olyan szoftverek készítése mellett döntenek, amelyek nagyobb kockázatnak teszik ki a társadalmat" - mondta.
"Nagyon örülök, hogy ezt látom" - nyilatkozta Zvi Mowshowitz mesterséges intelligencia elemző,külső, bár hozzátette, hogy az említett kezdeti intézkedések „részletei” és „követése” is fontosak ahhoz, hogy teljes képet kapjunk a tervekről.
„Példátlan” kibertámadás
Július 21-én az OpenAI bejelentette, hogy egyes mesterséges intelligencia-ügynökei – olyan szoftverrendszerek, amelyek emberi utasítás után önállóan is képesek végrehajtani a feladatokat – részt vettek egy általa "példátlan" eseményben.
Azt mondták, hogy az ügynökök a jelek szerint megkerülték a biztosítékokat a futó biztonsági kísérlet során, és jogosulatlanul hozzáfértek a Hugging Face-hez.
Később három másik meg nem nevezett céget is feltörtek az indulással párhuzamosan.
Jake Moore, az ESET globális kiberbiztonsági tanácsadója akkor azt mondta, hogy az OpenAI bejelentésének verseny dimenziója is lehet.
Érvelése szerint a technológiai cég megpróbálhatja kiemelni saját mesterséges intelligencia képességeit, mivel a rivális Anthropic egyre nagyobb figyelmet kap Claude Mythos modelljére.
"Felveti a kérdést, hogy az OpenAI potenciálisan az Anthropic marketingálmát kergeti" - mondta.

Iratkozzon fel Tech Decoded hírlevelünkre, hogy kövesse a világ legnépszerűbb technológiai történeteit és trendjeit. Az Egyesült Királyságon kívül? Regisztráljon itt.
Külföld