Papírkivágás-dioráma, amely egy nyitott könyvből emelkedik ki, és egy teljesen megépített, kivilágított várost mutat utcákkal és emberekkel: a különbség egy cselekvés szavakkal való leírása és egy ügynök között, aki elmegy és valóban megteszi
AI és bizalom

A valódi különbség egy csevegőbot és egy ügynök között

Az egyik válaszol egy kérdésre. A másik eldönti, mit kell tenni, megteszi, ellenőrzi a saját munkáját, és továbblép a következő lépésre — anélkül, hogy megvárná, amíg ön kéri. Ez a különbség nem akadémiai. Megváltoztatja, mi mehet rosszul, és kinek kellene elkapnia.

FabricLoop szerkesztőség
1,850 szó
8 perc olvasás

Egy csevegőbot elveszi, amit beír, választ állít elő, és megáll. Egy ügynök elveszi, amit beír, eldönti, minek kell történnie, tesz valamit, ellenőrzi, hogy az bevált-e, és eldönti, mit tegyen ezután — magától, gyakran sok lépésen át — mielőtt egy ember bármit is látna belőle. Ez az egész különbség. Minden, amin az emberek vitáznak, amikor „MI-ügynökökről” vitáznak — a kockázat, a felügyelet, amire egy rendszernek szüksége van, és a marketingzavar nagy része — ebből az egy különbségből következik.

Mit csinál valójában egy csevegőbot

A csevegőbot egyetlen menetű rendszer. Szöveget ad neki, szöveget ad vissza, és az interakció ott véget ér. Még egy csevegőbot is, amelynek hosszú memóriája van a beszélgetésről, körönként továbbra is egy dolgot csinál: elolvassa mindazt, ami eddig elhangzott, és megjósolja a következő üzenetet. Soha nem kérdez le egy adatbázist, hogy ellenőrizzen egy tényt, soha nem küld semmit az ön nevében, és soha nem jön vissza később megnézni, megállt-e a válasza. Ha téved, a kár egy mondat, amelyet egy ember elolvas — és amelyet a dolgok szokásos menetében elkaphat, mielőtt aszerint cselekszik.

A legtöbb, amit az emberek a csevegőbotoktól kérnek, ezt a formát ölti anélkül, hogy bárki észrevenné: foglald össze ezt a dokumentumot, írj egy születésnapi üzenetet, magyarázd el a visszatérítési szabályzatunkat, írj három címmondat-változatot. Ezek egyike sem kívánja meg, hogy a rendszer bármit is ellenőrizzen a való világhoz képest, vagy cselekedjen a csevegőablakon kívül. Ez akkor is igaz, ha a felület „MI-asszisztens” vagy „copilot”, nem pedig „csevegőbot” — a dobozon lévő címke nem változtatja meg, mi történik belül.

Mit csinál valójában egy ügynök

Egy ügynök hurkot futtat, nem egyetlen menetet: megtervez egy lépést, cselekvést hajt végre egy valódi eszköz hívásával — keres egy adatbázisban, üzenetet küld, fájlt szerkeszt, eléri az API-t — megnézi, mit adott vissza valójában az a cselekvés, és ezt az eredményt használja a következő lépés eldöntésére. Addig ismétli, amíg a feladat kész, elakad, vagy úgy építették, hogy egy embernél érdeklődjön. A lényeg az, hogy senki sem hagy jóvá minden egyes lépést útközben. A rendszer maga dönti el, mit próbáljon legközelebb, aszerint, ami valójában történt, amikor legutóbb cselekedett — és e döntési pontok mindegyikén tévedhet, nem csak egy végső válaszban.

Ez a hurok nem új és nem egzotikus. A kutatók évek óta leírják a változatait — gondolkodás arról, mit tegyen, cselekvés, az eredmény megfigyelése, újra gondolkodás —, és pontosan ez fut azok alatt a termékek alatt, amelyek ügynöknek nevezik magukat, a költségelszámolást benyújtó szoftvertől a kódeszközökig, amelyek terminált nyitnak és a saját parancsaikat futtatják. Ami valamit ügynökké tesz egy nagyon beszédes csevegőbot helyett, az az, hogy hat a világra, figyeli, mi történt, és igazodik — újra és újra, anélkül, hogy egy ember minden lépést jóváhagyna.

Ugyanaz a kérés, kétféleképpen

Így néz ki a különbség, amikor két rendszer hasonlóan hangzó utasítást kap.

Csevegőbot

„Foglald össze ezt a dokumentumot.”

  • 1Elolvassa a beillesztett szöveget.
  • 2Előállít egy összefoglaló bekezdést.
Itt megáll — a csevegésen kívül semmi sem változott
Ügynök

„Keresd meg a három nyitott számlát, amely több mint 30 napja lejárt, készíts mindegyikhez emlékeztető e-mail-piszkozatot, és tedd őket a piszkozatok mappámba.”

  • 1Lekérdezi a számlázórendszert, és kiszűri a több mint 30 napja nyitott számlákat.
  • 2Ellenőrzi, hogy valóban hármat talált, nem kettőt vagy ötöt — jelzi az eltérést, ahelyett hogy találgatna.
  • 3Kiveszi minden számlához a helyes összeget, a határidőt és a kapcsolattartót, és megírja az emlékeztetőt.
  • 4Minden piszkozatot elment a valódi piszkozatmappába a levelezőeszközön keresztül.
  • 5Visszajelzi, mit talált és mit készített.
Cselekszik — három valódi piszkozat most már létezik, átnézetlenül

Tegye fel a második kérdést egy csevegőbotnak, és akkor is ad valamit, ami válasznak látszik: három hihetően hangzó emlékeztető e-mailt, abból előállítva, amit éppen beillesztett a beszélgetésbe. Amit nem tesz: nem kérdezi le a valódi számlázórendszerét, nem ellenőrzi a darabszámot, és nem tesz semmit egy valódi piszkozatmappába. A kimenet hasonlónak tűnhet. Amit a rendszer valójában tett, az nem az.

Miért nem pusztán szóvita ez

A különbség számít, mert megváltoztatja, mi mehet rosszul, és ki kapja el. Egy csevegőbot legrosszabb esete egy rossz válasz. Valaki elolvassa, és a dolgok szokásos menetében vagy elkapja a hibát, vagy úgy dönt, nem cselekszik aszerint — a tévedés soha nem hagyja el a beszélgetést. Egy ügynök legrosszabb esete egy rossz cselekvés, amely a való világban már megtörtént: az emlékeztető, amely a rossz ügyfélhez ment a rossz egyenleggel, a rekord, amelyet rossz értékkel frissítettek, a visszatérítés, amelyet kétszer állítottak ki — mielőtt bárki bármit átnézett volna. A tévedés már nem mondat. Esemény, és az eseményeket nem lehet meg nem történtté tenni.

Egy csevegőbot legrosszabb esete egy rossz válasz, amelyet valaki elolvas. Egy ügynök legrosszabb esete egy rossz cselekvés, amely már megtörtént — mielőtt bárki bármit is olvasott volna.

Ezért az ügynöknek másfajta felügyeletre van szüksége, mint a csevegőbotnak. A csevegőbotnak többnyire arra van szüksége, hogy valaki ellenőrizze a válaszait, amikor ráér. Az ügynöknek arra van szüksége, hogy a tervezői már eldöntsék, mielőtt valaha is futna, mely cselekvéseket teheti meg kérdezés nélkül, melyek kívánják meg, hogy egy ember előbb lássa a tervet, és mi történik, ha elakad. Ha ezt utólag tisztázza, a nehezebb úton tudja meg, mit tett már az ügynök.

Csak abban bízhat, amit lát

Ugyanez az ötlet áll a FabricLoop Olvashatóság fogalma mögött: csak azt a hozzáférést és azt a viselkedést lehet kormányozni, amelyet valóban látni lehet. Egy csevegőbotnál ez szinte automatikus — a teljes kimenete egy üzenet, amelyet egy ember elolvas, tehát a cselekvés és a cselekvés feljegyzése ugyanaz. Egy ügynöknél nem. A cselekvései más rendszerekben történnek — egy CRM-ben, egy bejövő mappában, egy adatbázisban, egy fájlban —, és ha semmi nem naplózza, mihez nyúlt, mit változtatott vagy mit küldött, nincs mód utólag átnézni, még kevésbé előtte megállítani. Az Olvashatóság nem egy megfelelőségi extra, amelyet egy ügynök tetejére tesznek. Egy ügynöknél ez az egész kérdés, mert a „válasza” nem egy mondat, amelyet lektorálni lehet — cselekvések halmaza, amelyekről talán soha nem tudja meg, hogy megtörténtek, hacsak a rendszert nem úgy építették, hogy megmutassa önnek.

Ez a gyakorlati kapocs a két ötlet között: egy ügynök több és más kockázatot vállal, mint egy csevegőbot, és pontosan ezért van szüksége látható nyomra arról, amit tett, és a nagyobb tétű esetekben egy ellenőrzőpontra, mielőtt cselekszik — arra, amit a FabricLoop Emberi beavatkozás aránya fogalma számként kezel, amelyet megtervez és mér, nem utólagos gondolatként, amelyet akkor csavaroz fel, amikor már valami rosszul sült el.

A piac ezt folyton visszafelé árazza

Ha megvan a valódi teszt, nyilvánvaló, milyen gyakran hazudik a címke mindkét irányban. Rengeteg termék, amelyet keményen „MI-ügynökként” árulnak — a szó a nyitó címben, az árszintekben — alatta egyetlen jól hangolt prompt: olvasd be a bemenetet, állítsd elő a kimenetet, kész. Nincs önálló eszközhívás, nincs hurok, nincs döntés anélkül, hogy egy ember jóváhagyná a következő kattintást. Eközben rengeteg szoftver, amely soha nem használja az „ügynök” szót — egy automatizált számlázási munkafolyamat, egy figyelőrendszer, amely magától tereli a forgalmat, egy üzemeltetési szkript, amely újraindít egy elhasalt szolgáltatást, és ellenőrzi, hogy ez javított-e — csendben pontosan a fent leírt hurkot futtatja. A címkén lévő szó semmi megbízhatót nem mond arról, melyik gépet használja valójában.

A kétkérdéses teszt

1. Egynél több lépés kell ahhoz, hogy elvégezze a dolgot? 2. Ő dönti el, mi a következő lépés, vagy egy ember dönt minden lépésről, egyenként egy kattintással? Ha egy ember választ minden lépést, egy csevegőbotot néz extra gombokkal — hívja úgy, ahogy a marketingoldal hívja. Ha a rendszer maga választja a következő lépését egynél több lépésen át, ügynököt néz, és úgy kell kormányozni: látható naplók, meghatározott határok arra, mit tehet kérdezés nélkül, és valódi válasz arra, ki nézi át, és mikor.

FL
Hol húzza meg ezt a vonalat a FabricLoop

A FabricLoop saját MI-terméke, a Loop Agent, ezt a hurkot futtatja — keres, piszkozatot ír, ellenőrzi a saját munkáját MCP-n csatlakozó eszközökön —, de úgy épült, hogy megmutassa a munkáját, és a nagyobb tétű lépések előtt kérdezzen, ne pedig csendben cselekedjen, és utólag jelentsen. Minden MCP-kapcsolat, amelyet használ, egy személyhez van kötve, és az Enterprise-ban az, amit tett, egy auditnaplóban jelenik meg, ahelyett hogy csak a beszélgetésről őrzött saját memóriájában élne.

Ugyanez a logika van az Olvashatóság és az Emberi beavatkozás aránya mögött — érdemes ezeket olvasni tovább, ha ez az első a három ötlet közül, amelyik a helyére került.

Ehhez semmire nincs szükség technikai háttérből. Amikor legközelebb egy szállító vagy egy kolléga valamit ügynöknek nevez, kérdezze meg, mit tett valójában az ön utasítása és az eredmény között — és hány lépésről döntött maga.


Főbb tanulságok
01
Egy csevegőbot egy menetben válaszol: olvasd a bemenetet, állítsd elő a kimenetet, állj meg. Soha nem ellenőriz egy tényt élő rendszerhez képest, nem küld semmit az ön nevében, és nem jön vissza később igazolni a saját válaszát.
02
Egy ügynök hurkot futtat: tervezz, cselekedj egy valódi eszközön át, figyeld meg, mi történt valójában, döntsd el a következő lépést, ismételd — anélkül, hogy egy személy minden egyes lépést jóváhagyna.
03
Hasonlóan hangzó kérések két különböző gépet adhatnak. A „foglald össze ezt a dokumentumot” csevegőbot-viselkedés. A „keresd meg a három számlát, amely több mint 30 napja lejárt, készíts emlékeztetőket, és tedd őket a piszkozatok mappámba” ügynökviselkedés — valódi lekérdezéseket, ellenőrzést és önálló döntéseket kíván a lépések között.
04
Egy csevegőbot legrosszabb esete egy rossz válasz, amelyet egy ember elolvas, és dönthet úgy, hogy nem cselekszik aszerint. Egy ügynök legrosszabb esete egy rossz cselekvés, amely a való világban már megtörtént — egy elküldött e-mail, egy megváltozott rekord — mielőtt bárki átnézte volna.
05
Mivel az ügynökök az átnézés előtt cselekszenek, előre megtervezett felügyeletre van szükségük: mely cselekvések kívánják meg, hogy egy ember előbb lássa a tervet, melyek nem, és mi történik, ha az ügynök elakad. Ezt egy incidens után tisztázni késő.
06
Olvashatóság — a képesség, hogy lássa, ki mit tett, és hogyan — az ügynököknél többet számít, mint a csevegőbotoknál, mert egy ügynök cselekvései más rendszerekben történnek, nem egy olvasható üzenetben. Látható nyom nélkül nincs valódi felügyelet.
07
Az „ügynök” szó egy árképző oldalon nem megbízható jel. Alkalmazza maga a tesztet: egynél több lépést tesz, és maga dönt a következő lépésről? Ha egy ember választ minden lépést, az csevegőbot, bárminek is hívja a marketing.