forbes Gazdaság

RLHF-t építettünk. Most az RHLCF korszakát éljük – ha helyesen használjuk.

Szerző: forbes 2026. 08. 03. 8 percnyi olvasás


RLHF-t építettünk. Most az RHLCF korszakát éljük – ha helyesen használjuk.

Az RHLCF vagy a számítógépes visszajelzésekből történő emberi tanulás megerősítése a munkahelyi fejlődés következő lépése a mesterséges intelligencia korában.


Az utolsó darabom kbtőke: hogy a mesterséges intelligencia fokozza a tulajdonjoghoz való visszatérést, ennek az évtizednek az a feladata, hogy a hétköznapi embereket a gazdaság összetett oldalára irányítsa, mielőtt a megosztottság kanyonná szilárdulna. Ez kbmunkaerő- az emberek még mindig a szobában vannak, amikor a gépek megérkeznek, és csendesen megnyílik közöttük a második szakadék.

Mára már szinte mindennapos a megfigyelés: a mesterséges intelligencia egyeseket tompábbá, másokat élesebbé tesz.

Mindenki megnézte már a változatát: a diák, aki hagyja, hogy a modell megírja az esszét, és nem tart meg semmit, és az a diák, aki éjfélig vitatkozik vele, és úgy jön el, hogy egy hónapnyi gondolkodást végzett és megértett. Ugyanaz az eszköz, ellentétes eredménnyel. Egy személy kiszervezte az elméjét, és az csendesen összezsugorodott; a másik sparringpartnerként használta, és olyan ötleteket ért el, amelyek korábban kívül estek.

Ugyanez a megosztottság jön a munkahelyre is, és itt a választás ugyanúgy a munkáltatóé, mint a munkavállalóé. A mesterséges intelligencia egyes dolgozókat mérhetően élesebbé tesz, néhányat pedig nem. És hogy az emberei melyik oldalon szállnak le, sokkal kevésbé múlik rajtuk, mint attól, hogy milyen átgondoltsággal adják a technológiát a kezükbe.

Hatalmas erőfeszítések folynak az AI-nak a szervezetekbe való beépítésére, a folyamatok automatizálására, a hatékonyság növelésére és a profit növelésére. Ez jó dolog. De talán más kérdéseket is fel kellene tennünk:

  • Hogyan vihetjük be az AI-t minden munkafolyamatba a hatékonyság javítása érdekében?ésegyszerre nő az emberi tehetség és az intelligencia?
  • Hogyan tehetünk minden alkalmazottat olyan elemzővé, aki egy hónapig gondolkodott, és egy délután alatt továbbfejlesztette saját elméjét?

Ha egyedül hagyjuk, a húzóerő egyedül a hatékonyság felé irányul – minden kényelmes funkció csendben egy kicsit többet tesz kigondolkodásamíg az illető nem tudja. De ugyanez a tény a másik irányban fut, és ez a reményteli rész. Ha egy munkás melyik oldalon száll le, az megtervezhető, akkor meg lehet terveznijól.Képzelje el, hogy az élezést közvetlenül a munkafolyamatba építi be – úgy tervezze meg az eszközt, hogy már a használat során is többet tudjon a dolgozó, mint előző nap. Az okosabb elemző mérnöki döntés lehet.

Ennek egy kicsi, konkrét változatába botlottam bele, miközben építettem a TraversalIQ-t, egy mesterséges intelligencia réteget, amely a mesterséges intelligencia oktató cégemnél, az Amplifire-nél a CRM (a cég értékesítési, marketing- és ügyfélkapcsolat-kezelésének nyomkövető szoftvere) tetején dolgozik. Elérkezett a pillanat egy olyan tervezési döntéshez, amelyet a legtöbb cég gondolkodás nélkül meghozna, olyat, amely semminek tűnik a tervezési értekezleten, és csendben eldönti, hogy kikké váljanak.

A megbeszélés lépése

A TraversalIQ egyik sarka felkészíti a fiókvezetőket a felfedezésre – az első igazi találkozásra a potenciális ügyféllel, ahol a feltett kérdések minőségében, valamint az azt követő meghallgatásban és interakcióban csendben megnyerik vagy elveszítik az üzletet.

Adjon a fiókvezetőnek (AE) egy listát a standard felderítési kérdésekről és egy mesterséges intelligencia eszközről, a leghatékonyabb pedig egy gomb: kattintson rá, és az AI-rendszer megvizsgálja a vállalatot és mindenkit, aki részt vesz rajta, majd visszaadja a felderítési kérdések tiszta, személyre szabott listáját, pontosan ehhez a fiókhoz és az emberekhez szabva, az AI sebességével. Az AE tökéletes forgatókönyvvel lép be, de semmit sem tanult, mert a rendszer végezte a tanulást, és a hangosan felolvasott forgatókönyv nem egyenlő a szoba megértésével, amelyben éppen áll.

Most emlékezzen arra, hogy mi is valójában a felfedező találkozó. Ez nem egy kérdőív; Ez egy élő beszélgetés, ahol az értéket a váratlan válaszok követése, a helyén elmozduló személy elolvasása és a második olyan kérdés feltevése adja, amelyre semmilyen lista nem számított. Egy generált szkriptből dolgozó AE csak az első kérdést teheti fel.

Így az előkészítő lépést másképp építettük fel. A szkript létrehozása helyett az AI feltárja a fiókot az AE-vel. Leírja, mit talált.

  • Ez a cég csakátszerveztékkörül apontosproblémát megoldunk
  • Valaki a szobábanmondott valami sokatmondóataz elmúlt negyedévi eredményhívás során
  • Az értekezlet vezető ügyvezetője közzétetteeztegnap a közösségi médiában

Aztán visszatereli a kérdést az AE-hez: Mindezek alapján mit is akarunk tanulni ezen a találkozón, és kitől? A mesterséges intelligencia könnyedén kezdeményezhette a hívást, és átadhatta volna a kész forgatókönyvet, de pontosan ezen a ponton megterveztünk egy szünetet. A kérdések a cserében formálódnak, nem adják át. Az AE úgy jön ki, hogy őszintén és kíváncsian megvizsgálta a fiókot, és úgy lép be, hogy kezelni tudja a beszélgetést, nem pedig listáról olvas. Okosabb, nem csak gyorsabb. Remélem, hogy az így készülő képviselők idővel jobb eladókká válnak, nem csak jobban eligazítottuk.

Ez egy kis súrlódási darab, szándékosan elhelyezve, pontosan arra a helyre, ahol az embernek tanulnia kell. És ez az egész játék, mert végül az AE a szobában van, és nincs mesterséges intelligencia az asztalnál.

Az RLHF megfordítása

Ez a kis dizájnválasztás valami nagyobb példája – ennek a huroknak csak a felét nevezte meg az iparág.

A technika, amiről mindenki beszél, az RLHF,megerősítő tanulás emberi visszajelzésekből: a gép tanul tőlünk, hatalmas mennyiségű emberi ítélőképesség ömlik be, hogy hasznos legyen. De van egy második ember-számítógép hurok, amelyet szándékosan meg kell terveznünk –Az emberi tanulás megerősítése számítógépes visszajelzésből (RHLCF), a szakma egyik kedvenc betűszójának tükörképe.

Bárhol, ahol egy személy és egy mesterséges intelligencia együtt dolgozik egy feladaton, ez a hurok fut, akár gondosan tervezték, akár nem. Építse fel a munkafolyamatot gombként, és megtanítja az embereket arra, hogy kevésbé legyenek intelligensek. És ez történik, ha csak a sebességre optimalizálunk. A fordított hurok mindig be van kapcsolva. A kérdés csak az, hogyan tervezted. És természetesen mindig azt szeretné, ha a hurok mindkét irányban futna, ezért az AI-t is úgy terveztük, hogy tanuljon minden emberi interakcióból, és okosabbá váljon az út során.

A befejezés nem kompetencia

A tudomány tanulása nyersen megmagyarázza, miért nem működik a gomb: a befejezés nem kompetencia. A képzés befejezése nem egyenlő a dolog ismeretével. Az ember átkattinthat a képzésen, magabiztosnak érezheti magát, és még mindig magabiztosan tévedhet – ez az állapot drágább, mint a puszta tudatlanság. Az egykattintásos szkript pontosan ezt állítja elő: egy olyan érzést, amikor egy munka elvégzése, anélkül, hogy megértette volna.

A beszélgetés hozzáteszi azt, amit Robert Bjork pszichológus akívánatos nehézség— egy apró, szándékos erőfeszítés, amelyet pontosan ott kell elhelyezni, ahol a tanulásnak meg kell történnie. A rossz helyen történő súrlódás csak a hatékonyság hiánya, és a mesterséges intelligencia kímélet nélkül el kell törölnie: a fáradságot, a formázást, az üres oldalt. De a súrlódás a megfelelő helyen a pedagógia. Az AI-eszközök tervezésének mestersége az, hogy megtanulják megkülönböztetni a kettőt egymástól, automatizálni a munkát, és pontosan ott hagyni a kívánatos nehézséget, ahol az embernek növekednie kell.

A csábító gomb

Ezek egyike sem történik meg magától, mert a piac a másik irányba tolja. Minden termék ütemtervében még egy kattintást kell eltávolítani. Friction demók rosszul; a gomb mindig jobban néz ki a színpadon, mint a beszélgetés. Bármely eszköznek az a verziója, amely gyorsabbá teszi a felhasználókat, minden negyedéves pénzügyi jelentést nyer, és csendben elveszíti a később megjelenő dolgokat. Így azok a munkaadók, akik élesebb embereket keresnek, azok lesznek, akik szándékosan elutasítják saját eszközeik legcsábítóbb változatát, és meghagyják a lépést, amikor minden, ami a reklámban szerepel, vegye ki.

Ez a választás, és ez most történik, csendesen, több ezer terméken és munkafolyamaton belül, többnyire alapértelmezés szerint és többnyire a gomb felé.

Az a szakadék, amelyet a mesterséges intelligencia a dolgozók között nyit meg, végső soron nem a tehetségek szakadéka. Ez egy tervezési rés a gondolkodásunkat végrehajtó eszközök és az olyan eszközök között, amelyek megtanítanak minket jobban gondolkodni, miközben lecsupaszítanak.kis értékű súrlódásmindenhol máshol, és olyan munkaadók között, akik elég bölcsek ahhoz, hogy tudják, melyiket adják át az embereiknek. A jó hír az, hogy ez egy választás, ami azt jelenti, hogy jól meg lehet csinálni.

A könyvembenFelbukkanás, azt vizsgálom, hogyan oldotta meg húsz wattos agyunk a biológián túli intelligenciát, amely az elektromos hálózathoz van csatlakoztatva, és mi történik ezután. Van egy sor a könyvben, amelyhez a cikk írásakor folyamatosan visszatérek:

"Van benne egy bizonyos költészet – az intelligencia, amelynek a szilíciumban való megjelenését segítjük, most visszakerül, hogy segítsen felerősíteni az elmét, amely létrehozta."
— Felbukkanás

Ez a visszafelé körözés a fordított hurok, és be tudjuk építeni a munkahelyre. De ez csak felerősít bennünket, ha ezzel a szándékkal alkalmazzuk. RLHF-t készítettünk a gépek betanítására; most abban a korszakban élünk, amikor ezeket a rendszereket be lehet vetni, hogy intelligensebbek legyünk olyan módon, amely korábban elérhetetlen volt. Ez a hurok mindkét irányban futni fog. Az, hogy felemeli-e az embereket, vagy kiüresíti őket, a munkahelyen továbbra is a mi döntésünk.

ad

További tartalom Önnek