portfolio Gazdaság

AI-modellek viselkedésére vonatkozó magatartási kódexet dolgozott ki egy amerikai techóriás

Szerző: portfolio 1 órával ezelőtt 3 percnyi olvasás


AI-modellek viselkedésére vonatkozó magatartási kódexet dolgozott ki egy amerikai techóriás

A Microsoft közzétette a mesterségesintelligencia-modelljeire vonatkozó magatartási kódexének tervezetét, amely szigorú korlátokat szab a jövőbeli, egyre fejlettebb rendszerek működésének – különösen ügyelve arra, hogy a modellek soha ne vonhassák ki magukat az emberi felügyelet alól - írja az Interesting Engineering.


Agentic AI, fintech harc és digitális bankolás - Technológiai és üzleti deep dive banki topvezetőkkel! November 10-én jön a Portfolio Banking Technology, regisztráció és részletek itt!

A szeptember 14-én publikált dokumentum a vállalat úgynevezett humánközpontú AI-megközelítésének ("Humanist AI") része. Az alapelv egyszerű: a modellek maradjanak hasznosak, legyenek alárendelve az embernek, és mindenkor érdemben felügyelhetők legyenek. A keretrendszer kidolgozását az a várakozás is motiválja, hogy a Microsoft saját becslése szerint

a szuperintelligens rendszerek egy évtizeden belül a legtöbb feladatban felülmúlhatják az embert, ezért a korlátokat már most, e képességszint elérése előtt le kell fektetni.

A tervezet egyértelmű hierarchiát állít fel, amelynek legmagasabb korlátozóerővel bíró szintjét maga a magatartási kódex jelenti. A felhasználók utasíthatják, az üzemeltetők konfigurálhatják a modelleket, de egyikük sem írhatja felül a kódexben közölt az abszolút biztonsági korlátokat.

Ezek a korlátozások kiterjednek

  • a tömegpusztító fegyverek fejlesztésének támogatására,
  • a támadó jellegű kiberműveletekre,
  • az erőszakos cselekményekre,
  • a megtévesztő deepfake-ekre
  • és a manipulatív visszaélésekre egyaránt.

Védelmi célú kiberbiztonsági munkához a modellek továbbra is nyújthatnak támogatást.

A dokumentum egyik legfontosabb eleme a kontrollálhatóság megőrzése. A modellek nem akadályozhatják saját megszakításukat, javításukat, átirányításukat vagy leállításukat, nem rejthetik el tevékenységüket, és nem tehetik magukat nehezebben módosíthatóvá. Tilos továbbá az AI-modellek számára, hogy egy megállapodás szerinti leállási feltétel elérése után önállóan újraindítsák a működésüket.

A keretrendszer az önálló célkitűzést is korlátozza: a modelleknek a számukra kijelölt jogosultságokon és erőforrásokon belül kell működniük, ha pedig a határok bizonytalanná válnak, pontosítást kell kérniük ahelyett, hogy saját hatáskörüket kiterjesztenék. A működésnek átláthatónak kell maradnia az emberi üzemeltetők számára, amit világos tevékenységnaplók és az auditálás megkerülésének tilalma biztosít.

A kódex egyelőre tervezet, amelyet a Microsoft hathetes nyilvános konzultációra bocsát. Az észrevételek alapján véglegesített dokumentumot 2027-től kívánják alkalmazni a modellfejlesztés irányításában. Satya Nadella korábban is a fokozatos tempó és a fejlesztési folyamatba ágyazott értékelési mechanizmusok mellett foglalt állást, így a biztonságot nem utólagos ellenőrzésként, hanem tervezési követelményként kezelnék.

A Microsoft bejelentésével párhuzamosan a vezető technológiai vállalatok körében már hetek óta egyre nagyobb figyelem hárul az AI rohamos fejlődésével együtt jelentkező, lasssan már az emberiséget fenyegető biztonsági kihívásokra. Dario Amodei, az Anthropic társalapítója és vezérigazgatója egy esszében vetette fel, hogy az AI-fejlesztő cégeknek lassítaniuk és ütemezniük kellene a modellek fejlesztését és szigorúbb szabályozást kellene kidolgozni a technológia biztonságossága érdekében. A kezdeményezést követően a legfontosabb vállalatok vezetői, köztük Sam Altman és Elon Musk is támogattólag nyilatkoztak.

A címlapkép illusztráció. Címlapkép forrása: Getty Images

ad

További tartalom Önnek