Todellinen ero keskustelubotin ja agentin välillä
Toinen vastaa kysymykseen. Toinen päättää, mitä tehdään, tekee sen, tarkistaa oman työnsä ja siirtyy seuraavaan askeleeseen — odottamatta, että pyydät. Ero ei ole akateeminen. Se muuttaa sen, mikä voi mennä pieleen ja kenen pitäisi huomata se.
Keskustelubotti ottaa sen, mitä kirjoitat, tuottaa vastauksen ja pysähtyy. Agentti ottaa sen, mitä kirjoitat, päättää mitä pitää tapahtua, tekee asialle jotain, tarkistaa toimiko se ja päättää mitä tehdä seuraavaksi — itse, usein monen askeleen yli — ennen kuin ihminen näkee siitä mitään. Siinä on koko ero. Kaikki, mistä ihmiset kiistelevät puhuessaan «tekoälyagenteista» — riski, järjestelmän tarvitsema valvonta ja suurin osa markkinointisekaannuksesta — seuraa tästä yhdestä erosta.
Mitä keskustelubotti oikeasti tekee
Keskustelubotti on yhden kierroksen järjestelmä. Annat sille tekstiä, se tuottaa tekstiä takaisin, ja vuorovaikutus päättyy siihen. Jopa keskustelubotti, jolla on pitkä muisti keskustelustasi, tekee yhä yhden asian kierrosta kohti: lukee kaiken tähän asti sanotun ja ennustaa seuraavan viestin. Se ei koskaan kysy tietokannasta tarkistaakseen faktan, ei lähetä mitään puolestasi eikä palaa myöhemmin katsomaan, pitikö vastaus. Jos se on väärässä, vahinko on lause, jonka ihminen lukee — ja jonka hän tavallisessa asioiden kulussa voi huomata ennen kuin toimii sen mukaan.
Suurin osa siitä, mitä ihmiset pyytävät keskusteluboteilta, sopii tähän muotoon kenenkään huomaamatta: tiivistä tämä asiakirja, luonnostele syntymäpäiväviesti, selitä hyvityskäytäntömme, kirjoita kolme otsikkovaihtoehtoa. Mikään näistä ei vaadi, että järjestelmä tarkistaa mitään todellista maailmaa vasten tai tekee toiminnon keskusteluikkunan ulkopuolella. Tämä pitää yhä paikkansa, kun käyttöliittymä on brändätty «tekoälyavustajaksi» tai «copilotiksi» eikä «keskustelubotiksi» — laatikon etiketti ei muuta sitä, mitä sisällä tapahtuu.
Mitä agentti oikeasti tekee
Agentti ajaa silmukkaa, ei yhtä kierrosta: suunnittelee askeleen, tekee toiminnon kutsumalla oikeaa työkalua — hakee tietokannasta, lähettää viestin, muokkaa tiedostoa, kutsuu API:a — katsoo, mitä tuo toiminto oikeasti palautti, ja käyttää tulosta päättääkseen seuraavan askeleen. Se toistaa tätä, kunnes tehtävä on tehty, se juuttuu tai se on rakennettu tarkistamaan ihmiseltä. Tärkeää on, ettei kukaan hyväksy jokaista yksittäistä askelta matkan varrella. Järjestelmä päättää itse, mitä kokeilla seuraavaksi sen perusteella, mitä oikeasti tapahtui viimeksi kun se toimi — ja se voi olla väärässä jokaisessa näistä päätöskohdista, ei vain lopullisessa vastauksessa.
Tämä silmukka ei ole uusi eikä eksoottinen. Tutkijat ovat kuvanneet sen versioita — pohdintaa siitä mitä tehdä, toimintaa, tuloksen havaitsemista, uutta pohdintaa — vuosia, ja juuri se pyörii tuotteiden alla, jotka kutsuvat itseään agenteiksi, kuluraportteja jättävästä ohjelmistosta koodityökaluihin, jotka avaavat terminaalin ja ajavat omia komentojaan. Sen, mikä tekee jostakin agentin eikä hyvin puheliaan keskustelubotin, on se, että se toimii maailmassa, katsoo mitä tapahtui ja säätää — toistuvasti, ilman että ihminen hyväksyy jokaista siirtoa.
Sama pyyntö, kahdella tavalla
Tältä ero näyttää, kun kaksi järjestelmää saa ohjeet, jotka kuulostavat samanlaisilta.
«Tiivistä tämä asiakirja.»
- 1Lukee tekstin, jonka liitit.
- 2Tuottaa tiivistelmäkappaleen.
«Etsi kolme avointa laskua, jotka ovat yli 30 päivää erääntyneitä, luonnostele muistutusviesti kustakin ja laita ne luonnoskansiooni.»
- 1Kyselee laskutusjärjestelmää ja suodattaa laskut, jotka ovat olleet auki yli 30 päivää.
- 2Tarkistaa, että se todella löysi kolme, ei kahta tai viittä — merkitsee ristiriidan arvailun sijaan.
- 3Hakee kullekin laskulle oikean summan, eräpäivän ja yhteystiedon ja luonnostelee muistutuksen.
- 4Tallentaa kunkin luonnoksen oikeaan luonnoskansioon sähköpostityökalun kautta.
- 5Raportoi takaisin, mitä se löysi ja mitä se luonnosteli.
Kysy keskustelubotilta toinen kysymys, ja se antaa silti jotain, joka näyttää vastaukselta: kolme uskottavalta kuulostavaa muistutusviestiä, tuotettuna siitä, mitä satuit liittämään keskusteluun. Mitä se ei tee, on kysyä todellista laskutusjärjestelmääsi, varmistaa lukumäärää tai laittaa mitään oikeaan luonnoskansioon. Tuloste voi näyttää samanlaiselta. Se, mitä järjestelmä oikeasti teki, ei ole.
Miksi tämä ei ole vain sanakiista
Ero merkitsee, koska se muuttaa sen, mikä voi mennä pieleen ja kuka sen huomaa. Keskustelubotin pahin tapaus on väärä vastaus. Joku lukee sen ja tavallisessa kulussa joko huomaa virheen tai päättää olla toimimatta sen mukaan — virhe ei koskaan poistu keskustelusta. Agentin pahin tapaus on väärä teko, joka on jo tehty todellisessa maailmassa: muistutus, joka meni väärälle asiakkaalle väärällä saldolla, tietue joka päivitettiin väärällä arvolla, hyvitys joka tehtiin kahdesti — ennen kuin kukaan tarkisti mitään. Virhe ei ole enää lause. Se on tapahtuma, eikä tapahtumia saa tapahtumattomiksi.
Keskustelubotin pahin tapaus on väärä vastaus, jonka joku lukee. Agentin pahin tapaus on väärä teko, joka on jo tehty — ennen kuin kukaan luki yhtään mitään.
Siksi agentti tarvitsee toisenlaista valvontaa kuin keskustelubotti. Keskustelubotti tarvitsee enimmäkseen jonkun tarkistamaan vastauksensa, sitten kun ehtii. Agentti tarvitsee, että sen suunnittelijat ovat jo päättäneet, ennen kuin se koskaan ajetaan, mitkä toiminnot se saa tehdä kysymättä, mitkä vaativat että ihminen näkee suunnitelman ensin ja mitä tapahtuu kun se juuttuu. Jos selvität sen jälkikäteen, saat tietää kantapään kautta, mitä agentti on jo tehnyt.
Voit luottaa vain siihen, minkä näet
Tämä on sama ajatus FabricLoopin Selkeys-käsitteen takana: voit hallita vain sellaista pääsyä ja käyttäytymistä, jonka oikeasti näet. Keskustelubotille se on lähes automaattista — sen koko tuloste on viesti, jonka ihminen lukee, joten teko ja teon kirjaus ovat sama asia. Agentille ne eivät ole. Sen teot tapahtuvat muiden järjestelmien sisällä — CRM:ssä, saapuneissa, tietokannassa, tiedostossa — ja ellei jokin kirjaa, mihin se koski, mitä se muutti tai mitä se lähetti, sitä ei voi jälkikäteen tarkastaa, saati pysäyttää etukäteen. Selkeys ei ole vaatimustenmukaisuuden kiva lisä agentin päälle. Agentille se on koko kysymys, koska sen «vastaus» ei ole lause, jonka voit oikolukea — se on joukko tekoja, joiden tapahtumisesta et ehkä koskaan saa tietää, ellei järjestelmää rakennettu näyttämään ne sinulle.
Siinä on kahden ajatuksen käytännön yhteys: agentti ottaa enemmän ja erilaista riskiä kuin keskustelubotti, ja juuri siksi se tarvitsee näkyvän jäljen siitä mitä se teki ja korkeamman panoksen tapauksissa tarkistuspisteen ennen kuin se toimii — sen, mitä FabricLoopin käsite Ihmisen väliintulo-osuus käsittelee lukuna, jonka suunnittelet ja mittaat, ei jälkiajatuksena, jonka pulttaat kiinni kun jokin on jo mennyt pieleen.
Markkina hinnoittelee tämän takaperin, jatkuvasti
Kun oikea testi on käsissä, on ilmeistä kuinka usein etiketti valehtelee molempiin suuntiin. Paljon tuotteita, joita markkinoidaan kovaa «tekoälyagentteina» — sana pääotsikossa, hintaportaissa — on alta yksi hyvin viritetty kehote: lue syöte, tuota tuloste, valmis. Ei itsenäistä työkalukutsua, ei silmukkaa, ei päätöstä ilman että ihminen hyväksyy seuraavan napsautuksen. Samaan aikaan paljon ohjelmistoa, joka ei koskaan käytä sanaa «agentti» — automatisoitu laskutuksen työnkulku, valvontajärjestelmä joka reitittää liikennettä itse, käyttöskripti joka käynnistää kaatuneen palvelun uudelleen ja tarkistaa korjasiko se asian — ajaa hiljaa täsmälleen yllä kuvattua silmukkaa. Sanalla etiketissä ei ole luotettavaa sanottavaa siitä, mitä konetta oikeasti käytät.
1. Tarvitseeko se enemmän kuin yhden askeleen tehdäkseen asian? 2. Päättääkö se itse, mikä seuraava askel on, vai päättääkö ihminen jokaisen askeleen, yhden napsautuksen kerrallaan? Jos ihminen valitsee jokaisen askeleen, katsot keskustelubottia, jossa on ylimääräisiä painikkeita — kutsu sitä miksi markkinointisivu sitä kutsuu. Jos järjestelmä valitsee oman seuraavan askeleensa yli yhden askeleen, katsot agenttia, ja sitä on hallittava sellaisena: näkyvät lokit, määritellyt rajat sille mitä se saa tehdä kysymättä, ja oikea vastaus siihen, kuka sen tarkistaa ja milloin.
FabricLoopin oma tekoälytuote, Loop Agent, ajaa tuota silmukkaa — hakee, luonnostelee, tarkistaa omaa työtään MCP:hen kytketyillä työkaluilla — mutta se on rakennettu näyttämään työnsä ja kysymään ennen korkeamman panoksen askeleita, ei toimimaan hiljaa ja raportoimaan jälkikäteen. Jokainen MCP-yhteys, jota se käyttää, on rajattu henkilölle, ja Enterprisessa se mitä se teki näkyy auditointilokissa sen sijaan, että se eläisi vain sen omassa muistissa keskustelusta.
Sama logiikka on käsitteissä Selkeys ja Ihmisen väliintulo-osuus — lukemisen arvoisia seuraavaksi, jos tämä on ensimmäinen näistä kolmesta ajatuksesta, joka loksahti kohdalleen.
Mikään tästä ei vaadi teknistä taustaa sovellettavaksi. Kun toimittaja tai kollega seuraavan kerran kutsuu jotain agentiksi, kysy mitä se oikeasti teki ohjeesi ja tuloksen välillä — ja kuinka monesta noista askeleista se päätti itse.
