A valódi különbség egy csevegőbot és egy ügynök között
Az egyik válaszol egy kérdésre. A másik eldönti, mit kell tenni, megteszi, ellenőrzi a saját munkáját, és továbblép a következő lépésre — anélkül, hogy megvárná, amíg ön kéri. Ez a különbség nem akadémiai. Megváltoztatja, mi mehet rosszul, és kinek kellene elkapnia.
Egy csevegőbot elveszi, amit beír, választ állít elő, és megáll. Egy ügynök elveszi, amit beír, eldönti, minek kell történnie, tesz valamit, ellenőrzi, hogy az bevált-e, és eldönti, mit tegyen ezután — magától, gyakran sok lépésen át — mielőtt egy ember bármit is látna belőle. Ez az egész különbség. Minden, amin az emberek vitáznak, amikor „MI-ügynökökről” vitáznak — a kockázat, a felügyelet, amire egy rendszernek szüksége van, és a marketingzavar nagy része — ebből az egy különbségből következik.
Mit csinál valójában egy csevegőbot
A csevegőbot egyetlen menetű rendszer. Szöveget ad neki, szöveget ad vissza, és az interakció ott véget ér. Még egy csevegőbot is, amelynek hosszú memóriája van a beszélgetésről, körönként továbbra is egy dolgot csinál: elolvassa mindazt, ami eddig elhangzott, és megjósolja a következő üzenetet. Soha nem kérdez le egy adatbázist, hogy ellenőrizzen egy tényt, soha nem küld semmit az ön nevében, és soha nem jön vissza később megnézni, megállt-e a válasza. Ha téved, a kár egy mondat, amelyet egy ember elolvas — és amelyet a dolgok szokásos menetében elkaphat, mielőtt aszerint cselekszik.
A legtöbb, amit az emberek a csevegőbotoktól kérnek, ezt a formát ölti anélkül, hogy bárki észrevenné: foglald össze ezt a dokumentumot, írj egy születésnapi üzenetet, magyarázd el a visszatérítési szabályzatunkat, írj három címmondat-változatot. Ezek egyike sem kívánja meg, hogy a rendszer bármit is ellenőrizzen a való világhoz képest, vagy cselekedjen a csevegőablakon kívül. Ez akkor is igaz, ha a felület „MI-asszisztens” vagy „copilot”, nem pedig „csevegőbot” — a dobozon lévő címke nem változtatja meg, mi történik belül.
Mit csinál valójában egy ügynök
Egy ügynök hurkot futtat, nem egyetlen menetet: megtervez egy lépést, cselekvést hajt végre egy valódi eszköz hívásával — keres egy adatbázisban, üzenetet küld, fájlt szerkeszt, eléri az API-t — megnézi, mit adott vissza valójában az a cselekvés, és ezt az eredményt használja a következő lépés eldöntésére. Addig ismétli, amíg a feladat kész, elakad, vagy úgy építették, hogy egy embernél érdeklődjön. A lényeg az, hogy senki sem hagy jóvá minden egyes lépést útközben. A rendszer maga dönti el, mit próbáljon legközelebb, aszerint, ami valójában történt, amikor legutóbb cselekedett — és e döntési pontok mindegyikén tévedhet, nem csak egy végső válaszban.
Ez a hurok nem új és nem egzotikus. A kutatók évek óta leírják a változatait — gondolkodás arról, mit tegyen, cselekvés, az eredmény megfigyelése, újra gondolkodás —, és pontosan ez fut azok alatt a termékek alatt, amelyek ügynöknek nevezik magukat, a költségelszámolást benyújtó szoftvertől a kódeszközökig, amelyek terminált nyitnak és a saját parancsaikat futtatják. Ami valamit ügynökké tesz egy nagyon beszédes csevegőbot helyett, az az, hogy hat a világra, figyeli, mi történt, és igazodik — újra és újra, anélkül, hogy egy ember minden lépést jóváhagyna.
Ugyanaz a kérés, kétféleképpen
Így néz ki a különbség, amikor két rendszer hasonlóan hangzó utasítást kap.
„Foglald össze ezt a dokumentumot.”
- 1Elolvassa a beillesztett szöveget.
- 2Előállít egy összefoglaló bekezdést.
„Keresd meg a három nyitott számlát, amely több mint 30 napja lejárt, készíts mindegyikhez emlékeztető e-mail-piszkozatot, és tedd őket a piszkozatok mappámba.”
- 1Lekérdezi a számlázórendszert, és kiszűri a több mint 30 napja nyitott számlákat.
- 2Ellenőrzi, hogy valóban hármat talált, nem kettőt vagy ötöt — jelzi az eltérést, ahelyett hogy találgatna.
- 3Kiveszi minden számlához a helyes összeget, a határidőt és a kapcsolattartót, és megírja az emlékeztetőt.
- 4Minden piszkozatot elment a valódi piszkozatmappába a levelezőeszközön keresztül.
- 5Visszajelzi, mit talált és mit készített.
Tegye fel a második kérdést egy csevegőbotnak, és akkor is ad valamit, ami válasznak látszik: három hihetően hangzó emlékeztető e-mailt, abból előállítva, amit éppen beillesztett a beszélgetésbe. Amit nem tesz: nem kérdezi le a valódi számlázórendszerét, nem ellenőrzi a darabszámot, és nem tesz semmit egy valódi piszkozatmappába. A kimenet hasonlónak tűnhet. Amit a rendszer valójában tett, az nem az.
Miért nem pusztán szóvita ez
A különbség számít, mert megváltoztatja, mi mehet rosszul, és ki kapja el. Egy csevegőbot legrosszabb esete egy rossz válasz. Valaki elolvassa, és a dolgok szokásos menetében vagy elkapja a hibát, vagy úgy dönt, nem cselekszik aszerint — a tévedés soha nem hagyja el a beszélgetést. Egy ügynök legrosszabb esete egy rossz cselekvés, amely a való világban már megtörtént: az emlékeztető, amely a rossz ügyfélhez ment a rossz egyenleggel, a rekord, amelyet rossz értékkel frissítettek, a visszatérítés, amelyet kétszer állítottak ki — mielőtt bárki bármit átnézett volna. A tévedés már nem mondat. Esemény, és az eseményeket nem lehet meg nem történtté tenni.
Egy csevegőbot legrosszabb esete egy rossz válasz, amelyet valaki elolvas. Egy ügynök legrosszabb esete egy rossz cselekvés, amely már megtörtént — mielőtt bárki bármit is olvasott volna.
Ezért az ügynöknek másfajta felügyeletre van szüksége, mint a csevegőbotnak. A csevegőbotnak többnyire arra van szüksége, hogy valaki ellenőrizze a válaszait, amikor ráér. Az ügynöknek arra van szüksége, hogy a tervezői már eldöntsék, mielőtt valaha is futna, mely cselekvéseket teheti meg kérdezés nélkül, melyek kívánják meg, hogy egy ember előbb lássa a tervet, és mi történik, ha elakad. Ha ezt utólag tisztázza, a nehezebb úton tudja meg, mit tett már az ügynök.
Csak abban bízhat, amit lát
Ugyanez az ötlet áll a FabricLoop Olvashatóság fogalma mögött: csak azt a hozzáférést és azt a viselkedést lehet kormányozni, amelyet valóban látni lehet. Egy csevegőbotnál ez szinte automatikus — a teljes kimenete egy üzenet, amelyet egy ember elolvas, tehát a cselekvés és a cselekvés feljegyzése ugyanaz. Egy ügynöknél nem. A cselekvései más rendszerekben történnek — egy CRM-ben, egy bejövő mappában, egy adatbázisban, egy fájlban —, és ha semmi nem naplózza, mihez nyúlt, mit változtatott vagy mit küldött, nincs mód utólag átnézni, még kevésbé előtte megállítani. Az Olvashatóság nem egy megfelelőségi extra, amelyet egy ügynök tetejére tesznek. Egy ügynöknél ez az egész kérdés, mert a „válasza” nem egy mondat, amelyet lektorálni lehet — cselekvések halmaza, amelyekről talán soha nem tudja meg, hogy megtörténtek, hacsak a rendszert nem úgy építették, hogy megmutassa önnek.
Ez a gyakorlati kapocs a két ötlet között: egy ügynök több és más kockázatot vállal, mint egy csevegőbot, és pontosan ezért van szüksége látható nyomra arról, amit tett, és a nagyobb tétű esetekben egy ellenőrzőpontra, mielőtt cselekszik — arra, amit a FabricLoop Emberi beavatkozás aránya fogalma számként kezel, amelyet megtervez és mér, nem utólagos gondolatként, amelyet akkor csavaroz fel, amikor már valami rosszul sült el.
A piac ezt folyton visszafelé árazza
Ha megvan a valódi teszt, nyilvánvaló, milyen gyakran hazudik a címke mindkét irányban. Rengeteg termék, amelyet keményen „MI-ügynökként” árulnak — a szó a nyitó címben, az árszintekben — alatta egyetlen jól hangolt prompt: olvasd be a bemenetet, állítsd elő a kimenetet, kész. Nincs önálló eszközhívás, nincs hurok, nincs döntés anélkül, hogy egy ember jóváhagyná a következő kattintást. Eközben rengeteg szoftver, amely soha nem használja az „ügynök” szót — egy automatizált számlázási munkafolyamat, egy figyelőrendszer, amely magától tereli a forgalmat, egy üzemeltetési szkript, amely újraindít egy elhasalt szolgáltatást, és ellenőrzi, hogy ez javított-e — csendben pontosan a fent leírt hurkot futtatja. A címkén lévő szó semmi megbízhatót nem mond arról, melyik gépet használja valójában.
1. Egynél több lépés kell ahhoz, hogy elvégezze a dolgot? 2. Ő dönti el, mi a következő lépés, vagy egy ember dönt minden lépésről, egyenként egy kattintással? Ha egy ember választ minden lépést, egy csevegőbotot néz extra gombokkal — hívja úgy, ahogy a marketingoldal hívja. Ha a rendszer maga választja a következő lépését egynél több lépésen át, ügynököt néz, és úgy kell kormányozni: látható naplók, meghatározott határok arra, mit tehet kérdezés nélkül, és valódi válasz arra, ki nézi át, és mikor.
A FabricLoop saját MI-terméke, a Loop Agent, ezt a hurkot futtatja — keres, piszkozatot ír, ellenőrzi a saját munkáját MCP-n csatlakozó eszközökön —, de úgy épült, hogy megmutassa a munkáját, és a nagyobb tétű lépések előtt kérdezzen, ne pedig csendben cselekedjen, és utólag jelentsen. Minden MCP-kapcsolat, amelyet használ, egy személyhez van kötve, és az Enterprise-ban az, amit tett, egy auditnaplóban jelenik meg, ahelyett hogy csak a beszélgetésről őrzött saját memóriájában élne.
Ugyanez a logika van az Olvashatóság és az Emberi beavatkozás aránya mögött — érdemes ezeket olvasni tovább, ha ez az első a három ötlet közül, amelyik a helyére került.
Ehhez semmire nincs szükség technikai háttérből. Amikor legközelebb egy szállító vagy egy kolléga valamit ügynöknek nevez, kérdezze meg, mit tett valójában az ön utasítása és az eredmény között — és hány lépésről döntött maga.
