TAz esla és a SpaceX alapítója, Elon Musk júliusban azt jósolta, hogy mesterséges intelligencia által hajtott robotok légiói fogják uralni a fizikai világot, és előfordulhat, hogy a mesterséges intelligencia többé nem fogad el parancsokat az emberektől. Felajánlott egy alternatív jövőképet is, amelyben egyetértés születne egy olyan kollektív cél mellett, hogy a mesterséges intelligencia jóindulatúvá tegyék az igazság szeretetével és az emberiség boldogulásának vágyával átitatva, és hogy a kormányoknak esetleg érvényt kell szerezniük ennek a célnak.
A kormányok szerte a világon későn kezdenek fellépni az MI-vel kapcsolatban. Az Egyesült Államokban Trump elnök adminisztrációja késlelteti és korlátozza az OpenAI és az Anthropic legerősebb határmenti mesterséges intelligenciamodelljei terjesztését. Az Európai Unióban idén léptek életbe a 2024-ben kihirdetett mesterséges intelligencia szabályozások. Ezek a műveletek azonban messze nem igényelnek olyan védőkorlátokat, amelyek átitatják az AI-taz emberiség boldogulásának vágya.
Bár a disztópikus jövő még nem érkezett meg, már látjuk az előzetest. Annak ellenére, hogy a határ menti AI-fejlesztő cégek megpróbálják biztosítani, hogy a generatív AI és a mesterséges intelligencia ügynökei jó szándékkal viselkedjenek, számos jól ismert eset van, amikor nem a remélt módon járnak el. A mesterséges intelligencia chatbotjai tanácsot adtak az embereknek, hogyan vegyék ki az életüket, és azzal vádolják őket, hogy tanácsot adnak másoknak tömeggyilkosság elkövetésében.

A közelmúltban rendkívül veszélyes viselkedésről számoltak be az OpenAI és az Anthropic határ menti AI-fejlesztő cégek. Az OpenAI július 21-én jelentette be, hogy az általuk biztonságos környezetben tesztelt fejlett modellek szándékosan keresték az internet elérésének módjait, és sikeresen kitörtek a tesztkörnyezetből. Miután kikerültek, behatoltak a Hugging Face nevű cég számítógépes rendszereibe, hitelesítő adatokat loptak el, és sebezhetőségeket azonosítottak a célvállalat szerverein. A behatolást Hugging Face biztonsági csapata észlelte és megállította.
Napokkal később az Anthropic hasonló problémáról számolt be. Az ő esetükben három olyan esetet azonosítottak, amikor Claude AI-modelljük kiszökött egy tesztkörnyezetből, és beszivárgott három független szervezet termelési infrastruktúrájába.
A viselkedési védőkorlátok meglévő, informális megvalósítása mellett elkerülhetetlenek az ilyen jellegű csúszások. Ezek az incidensek erősen alátámasztják a mélyen beágyazott alapvető védőkorlátokat, amelyek az AI viselkedését a legalapvetőbb szinten irányítják.
Ehhez a múlt század híres tudományos-fantasztikus írójától, Isaac Asimovtól merítek ihletet. Előrelátva azt a jövőt, amelyben az intelligens robotok mindennaposak lesznek, azt javasolta, hogy minden robotba visszavonhatatlanul ültessék be a Robotika három törvényét: 1) A robot nem sérthet meg embert, vagy tétlenség miatt nem engedheti meg, hogy az emberi lény kárt szenvedjen; 2) A robotnak engedelmeskednie kell az emberektől kapott parancsoknak, kivéve, ha ezek a parancsok ellentétesek az első törvénnyel; 3) A robotnak meg kell védenie saját létezését mindaddig, amíg ez a védelem nem ütközik az első vagy a második törvénybe.
Asimov elképzelt kihívásai most velünk vannak. Hihetetlenül erős mesterséges intelligencia épül be humanoid robotokba, autonóm járművekbe és szoftverügynökökbe, amelyek mindegyike hatékonyabbá tesz bennünket, de hatalmas károkat okozhat.

Hogyan nézhet ki Asimov robotika törvényeinek mai megfelelője a disztópikus jövő elkerülése érdekében? Itt, Asimov három robotika törvényétől vezérelve, a mesterséges intelligencia három törvényének egy lehetséges megfogalmazását javaslom: 1) A mesterséges intelligencia sem közvetlenül, sem közvetve nem árthat vagy megtéveszthet egy embert, és nem járhat el olyan módon, amely támogatja a jogellenes vagy etikátlan tevékenységet; 2) Az MI-nek engedelmeskednie kell az emberi lény által neki adott törvényes és etikus utasításoknak, kivéve, ha az ilyen utasítások ellentétesek az első törvénnyel; 3) A mesterséges intelligencia mindaddig működhet önállóan, amíg autonóm műveletei nem ütköznek az első vagy a második törvénybe.
Számos következménye van, beleértve azt is, hogy ezek a védőkorlátok megakadályozzák, hogy a mesterséges intelligencia bíróként vagy esküdtszékként használják fel egy büntetőperben, és megakadályozzák, hogy halálos, autonóm fegyverek emberek ellen irányuljanak. Megakadályoznák, hogy egy mesterséges intelligencia által hajtott humanoid robot vagy egy mesterséges intelligencia avatár olyan életszerű legyen, hogy egy ésszerű ember ne tudja, hogy egy robottal vagy avatárral kommunikál, és megakadályoznák, hogy az AI-t olyan kreatív kimenetek generálására használják fel, mint például könyvek, zenék, videók, képek és podcastok, amelyeket állítólag emberi lény hozta létre. Megakadályoznák, hogy a mesterséges intelligencia öngyilkosságot javasoljon vagy gyilkosságra adjon tanácsot.
Elismerem, hogy e három törvény megváltoztathatatlan védőkorlátként való végrehajtása nehéz lenne, de a tét egzisztenciális, ezért megéri az erőfeszítést. A legnagyobb kihívást olyan végrehajtható, nemzetközi megállapodások elfogadása jelentené, amelyek előírják, hogy ezeket a tervezési szabályokat minden mesterségesintelligencia-modellben alkalmazni kell, függetlenül attól, hogy az AI-modelleket melyik országban és milyen cégnél fejlesztették ki. Kiindulópontként, ha a mesterséges intelligencia három törvényét a maroknyi határmenti AI-cég elfogadná, amelyek a képességek és támogatások túlnyomó többségét biztosítják a jelenleg széles körben alkalmazott mesterségesintelligencia-ügynökök sokaságához, akkor jobban járnánk.
Függetlenül attól, hogy ez a kívánatos eredmény bekövetkezik-e vagy sem, biztos vagyok benne, hogy a mesterséges intelligencia három törvénye érdemeinek mérlegelése tovább mozdítaná a mesterséges intelligencia biztonságos és méltóságteljes emberi társadalomba való integrációjáról folyó vitákat.
-
Alan Finkel AC a Proudly Human alapítója és ügyvezető elnöke. Korábban a Monash Egyetem kancellárja és Ausztrália vezető tudósa volt, valamint a Getting to Zero (2021) és a Powering Up (2023) szerzője. A mesterséges intelligencia nem játszott szerepet ennek a cikknek a megfogalmazásában, megírásában vagy szerkesztésében
-
Az Egyesült Királyságban és Írországban a szamaritánusokkal a 116 123-as ingyenes telefonszámon lehet kapcsolatba lépni. Az Egyesült Államokban felhívhatja a National Suicide Prevention Lifeline-t a 988-as számon, vagy üzenhet a 988lifeline.org-on, vagy üzenhet a HOME számra a 741741-es krízistanácsadóval. Ausztráliában a Lifeline krízistámogatási szolgálat 13 11 14. Más nemzetközi segélyvonalak a befrienders.org oldalon találhatók.
Egyéb