Paperileikkausdioraama, joka nousee avoimesta kirjasta ja näyttää valmiiksi rakennetun valaistun kaupungin katuineen ja ihmisineen: ero sen välillä, että toimintaa kuvaillaan sanoin, ja agentin, joka menee ja tekee sen
Tekoäly ja luottamus

Todellinen ero keskustelubotin ja agentin välillä

Toinen vastaa kysymykseen. Toinen päättää, mitä tehdään, tekee sen, tarkistaa oman työnsä ja siirtyy seuraavaan askeleeseen — odottamatta, että pyydät. Ero ei ole akateeminen. Se muuttaa sen, mikä voi mennä pieleen ja kenen pitäisi huomata se.

FabricLoopin toimitus
1,850 sanaa
8 minuutin lukuaika

Keskustelubotti ottaa sen, mitä kirjoitat, tuottaa vastauksen ja pysähtyy. Agentti ottaa sen, mitä kirjoitat, päättää mitä pitää tapahtua, tekee asialle jotain, tarkistaa toimiko se ja päättää mitä tehdä seuraavaksi — itse, usein monen askeleen yli — ennen kuin ihminen näkee siitä mitään. Siinä on koko ero. Kaikki, mistä ihmiset kiistelevät puhuessaan «tekoälyagenteista» — riski, järjestelmän tarvitsema valvonta ja suurin osa markkinointisekaannuksesta — seuraa tästä yhdestä erosta.

Mitä keskustelubotti oikeasti tekee

Keskustelubotti on yhden kierroksen järjestelmä. Annat sille tekstiä, se tuottaa tekstiä takaisin, ja vuorovaikutus päättyy siihen. Jopa keskustelubotti, jolla on pitkä muisti keskustelustasi, tekee yhä yhden asian kierrosta kohti: lukee kaiken tähän asti sanotun ja ennustaa seuraavan viestin. Se ei koskaan kysy tietokannasta tarkistaakseen faktan, ei lähetä mitään puolestasi eikä palaa myöhemmin katsomaan, pitikö vastaus. Jos se on väärässä, vahinko on lause, jonka ihminen lukee — ja jonka hän tavallisessa asioiden kulussa voi huomata ennen kuin toimii sen mukaan.

Suurin osa siitä, mitä ihmiset pyytävät keskusteluboteilta, sopii tähän muotoon kenenkään huomaamatta: tiivistä tämä asiakirja, luonnostele syntymäpäiväviesti, selitä hyvityskäytäntömme, kirjoita kolme otsikkovaihtoehtoa. Mikään näistä ei vaadi, että järjestelmä tarkistaa mitään todellista maailmaa vasten tai tekee toiminnon keskusteluikkunan ulkopuolella. Tämä pitää yhä paikkansa, kun käyttöliittymä on brändätty «tekoälyavustajaksi» tai «copilotiksi» eikä «keskustelubotiksi» — laatikon etiketti ei muuta sitä, mitä sisällä tapahtuu.

Mitä agentti oikeasti tekee

Agentti ajaa silmukkaa, ei yhtä kierrosta: suunnittelee askeleen, tekee toiminnon kutsumalla oikeaa työkalua — hakee tietokannasta, lähettää viestin, muokkaa tiedostoa, kutsuu API:a — katsoo, mitä tuo toiminto oikeasti palautti, ja käyttää tulosta päättääkseen seuraavan askeleen. Se toistaa tätä, kunnes tehtävä on tehty, se juuttuu tai se on rakennettu tarkistamaan ihmiseltä. Tärkeää on, ettei kukaan hyväksy jokaista yksittäistä askelta matkan varrella. Järjestelmä päättää itse, mitä kokeilla seuraavaksi sen perusteella, mitä oikeasti tapahtui viimeksi kun se toimi — ja se voi olla väärässä jokaisessa näistä päätöskohdista, ei vain lopullisessa vastauksessa.

Tämä silmukka ei ole uusi eikä eksoottinen. Tutkijat ovat kuvanneet sen versioita — pohdintaa siitä mitä tehdä, toimintaa, tuloksen havaitsemista, uutta pohdintaa — vuosia, ja juuri se pyörii tuotteiden alla, jotka kutsuvat itseään agenteiksi, kuluraportteja jättävästä ohjelmistosta koodityökaluihin, jotka avaavat terminaalin ja ajavat omia komentojaan. Sen, mikä tekee jostakin agentin eikä hyvin puheliaan keskustelubotin, on se, että se toimii maailmassa, katsoo mitä tapahtui ja säätää — toistuvasti, ilman että ihminen hyväksyy jokaista siirtoa.

Sama pyyntö, kahdella tavalla

Tältä ero näyttää, kun kaksi järjestelmää saa ohjeet, jotka kuulostavat samanlaisilta.

Keskustelubotti

«Tiivistä tämä asiakirja.»

  • 1Lukee tekstin, jonka liitit.
  • 2Tuottaa tiivistelmäkappaleen.
Pysähtyy tähän — mikään keskustelun ulkopuolella ei muuttunut
Agentti

«Etsi kolme avointa laskua, jotka ovat yli 30 päivää erääntyneitä, luonnostele muistutusviesti kustakin ja laita ne luonnoskansiooni.»

  • 1Kyselee laskutusjärjestelmää ja suodattaa laskut, jotka ovat olleet auki yli 30 päivää.
  • 2Tarkistaa, että se todella löysi kolme, ei kahta tai viittä — merkitsee ristiriidan arvailun sijaan.
  • 3Hakee kullekin laskulle oikean summan, eräpäivän ja yhteystiedon ja luonnostelee muistutuksen.
  • 4Tallentaa kunkin luonnoksen oikeaan luonnoskansioon sähköpostityökalun kautta.
  • 5Raportoi takaisin, mitä se löysi ja mitä se luonnosteli.
Toimii — kolme oikeaa luonnosta on nyt olemassa, tarkistamatta

Kysy keskustelubotilta toinen kysymys, ja se antaa silti jotain, joka näyttää vastaukselta: kolme uskottavalta kuulostavaa muistutusviestiä, tuotettuna siitä, mitä satuit liittämään keskusteluun. Mitä se ei tee, on kysyä todellista laskutusjärjestelmääsi, varmistaa lukumäärää tai laittaa mitään oikeaan luonnoskansioon. Tuloste voi näyttää samanlaiselta. Se, mitä järjestelmä oikeasti teki, ei ole.

Miksi tämä ei ole vain sanakiista

Ero merkitsee, koska se muuttaa sen, mikä voi mennä pieleen ja kuka sen huomaa. Keskustelubotin pahin tapaus on väärä vastaus. Joku lukee sen ja tavallisessa kulussa joko huomaa virheen tai päättää olla toimimatta sen mukaan — virhe ei koskaan poistu keskustelusta. Agentin pahin tapaus on väärä teko, joka on jo tehty todellisessa maailmassa: muistutus, joka meni väärälle asiakkaalle väärällä saldolla, tietue joka päivitettiin väärällä arvolla, hyvitys joka tehtiin kahdesti — ennen kuin kukaan tarkisti mitään. Virhe ei ole enää lause. Se on tapahtuma, eikä tapahtumia saa tapahtumattomiksi.

Keskustelubotin pahin tapaus on väärä vastaus, jonka joku lukee. Agentin pahin tapaus on väärä teko, joka on jo tehty — ennen kuin kukaan luki yhtään mitään.

Siksi agentti tarvitsee toisenlaista valvontaa kuin keskustelubotti. Keskustelubotti tarvitsee enimmäkseen jonkun tarkistamaan vastauksensa, sitten kun ehtii. Agentti tarvitsee, että sen suunnittelijat ovat jo päättäneet, ennen kuin se koskaan ajetaan, mitkä toiminnot se saa tehdä kysymättä, mitkä vaativat että ihminen näkee suunnitelman ensin ja mitä tapahtuu kun se juuttuu. Jos selvität sen jälkikäteen, saat tietää kantapään kautta, mitä agentti on jo tehnyt.

Voit luottaa vain siihen, minkä näet

Tämä on sama ajatus FabricLoopin Selkeys-käsitteen takana: voit hallita vain sellaista pääsyä ja käyttäytymistä, jonka oikeasti näet. Keskustelubotille se on lähes automaattista — sen koko tuloste on viesti, jonka ihminen lukee, joten teko ja teon kirjaus ovat sama asia. Agentille ne eivät ole. Sen teot tapahtuvat muiden järjestelmien sisällä — CRM:ssä, saapuneissa, tietokannassa, tiedostossa — ja ellei jokin kirjaa, mihin se koski, mitä se muutti tai mitä se lähetti, sitä ei voi jälkikäteen tarkastaa, saati pysäyttää etukäteen. Selkeys ei ole vaatimustenmukaisuuden kiva lisä agentin päälle. Agentille se on koko kysymys, koska sen «vastaus» ei ole lause, jonka voit oikolukea — se on joukko tekoja, joiden tapahtumisesta et ehkä koskaan saa tietää, ellei järjestelmää rakennettu näyttämään ne sinulle.

Siinä on kahden ajatuksen käytännön yhteys: agentti ottaa enemmän ja erilaista riskiä kuin keskustelubotti, ja juuri siksi se tarvitsee näkyvän jäljen siitä mitä se teki ja korkeamman panoksen tapauksissa tarkistuspisteen ennen kuin se toimii — sen, mitä FabricLoopin käsite Ihmisen väliintulo-osuus käsittelee lukuna, jonka suunnittelet ja mittaat, ei jälkiajatuksena, jonka pulttaat kiinni kun jokin on jo mennyt pieleen.

Markkina hinnoittelee tämän takaperin, jatkuvasti

Kun oikea testi on käsissä, on ilmeistä kuinka usein etiketti valehtelee molempiin suuntiin. Paljon tuotteita, joita markkinoidaan kovaa «tekoälyagentteina» — sana pääotsikossa, hintaportaissa — on alta yksi hyvin viritetty kehote: lue syöte, tuota tuloste, valmis. Ei itsenäistä työkalukutsua, ei silmukkaa, ei päätöstä ilman että ihminen hyväksyy seuraavan napsautuksen. Samaan aikaan paljon ohjelmistoa, joka ei koskaan käytä sanaa «agentti» — automatisoitu laskutuksen työnkulku, valvontajärjestelmä joka reitittää liikennettä itse, käyttöskripti joka käynnistää kaatuneen palvelun uudelleen ja tarkistaa korjasiko se asian — ajaa hiljaa täsmälleen yllä kuvattua silmukkaa. Sanalla etiketissä ei ole luotettavaa sanottavaa siitä, mitä konetta oikeasti käytät.

Kahden kysymyksen testi

1. Tarvitseeko se enemmän kuin yhden askeleen tehdäkseen asian? 2. Päättääkö se itse, mikä seuraava askel on, vai päättääkö ihminen jokaisen askeleen, yhden napsautuksen kerrallaan? Jos ihminen valitsee jokaisen askeleen, katsot keskustelubottia, jossa on ylimääräisiä painikkeita — kutsu sitä miksi markkinointisivu sitä kutsuu. Jos järjestelmä valitsee oman seuraavan askeleensa yli yhden askeleen, katsot agenttia, ja sitä on hallittava sellaisena: näkyvät lokit, määritellyt rajat sille mitä se saa tehdä kysymättä, ja oikea vastaus siihen, kuka sen tarkistaa ja milloin.

FL
Mihin FabricLoop vetää tämän rajan

FabricLoopin oma tekoälytuote, Loop Agent, ajaa tuota silmukkaa — hakee, luonnostelee, tarkistaa omaa työtään MCP:hen kytketyillä työkaluilla — mutta se on rakennettu näyttämään työnsä ja kysymään ennen korkeamman panoksen askeleita, ei toimimaan hiljaa ja raportoimaan jälkikäteen. Jokainen MCP-yhteys, jota se käyttää, on rajattu henkilölle, ja Enterprisessa se mitä se teki näkyy auditointilokissa sen sijaan, että se eläisi vain sen omassa muistissa keskustelusta.

Sama logiikka on käsitteissä Selkeys ja Ihmisen väliintulo-osuus — lukemisen arvoisia seuraavaksi, jos tämä on ensimmäinen näistä kolmesta ajatuksesta, joka loksahti kohdalleen.

Mikään tästä ei vaadi teknistä taustaa sovellettavaksi. Kun toimittaja tai kollega seuraavan kerran kutsuu jotain agentiksi, kysy mitä se oikeasti teki ohjeesi ja tuloksen välillä — ja kuinka monesta noista askeleista se päätti itse.


Keskeiset nostot
01
Keskustelubotti vastaa yhdellä kierroksella: lue syöte, tuota tuloste, pysähdy. Se ei koskaan tarkista faktaa elävää järjestelmää vasten, lähetä mitään puolestasi tai palaa myöhemmin varmistamaan omaa vastaustaan.
02
Agentti ajaa silmukkaa: suunnittele, toimi oikean työkalun kautta, havainnoi mitä oikeasti tapahtui, päätä seuraava askel, toista — ilman että ihminen hyväksyy jokaista yksittäistä siirtoa.
03
Samalta kuulostavat pyynnöt voivat tuottaa kaksi eri konetta. «Tiivistä tämä asiakirja» on keskustelubotin käytöstä. «Etsi kolme laskua, jotka ovat yli 30 päivää erääntyneitä, luonnostele muistutukset ja laita ne luonnoskansiooni» on agentin käytöstä — se vaatii oikeita hakuja, varmistusta ja itsenäisiä päätöksiä askelten välillä.
04
Keskustelubotin pahin tapaus on väärä vastaus, jonka ihminen lukee ja jonka mukaan hän voi valita olla toimimatta. Agentin pahin tapaus on väärä teko, joka on jo tehty todellisessa maailmassa — lähetetty sähköposti, muutettu tietue — ennen kuin kukaan tarkisti sitä.
05
Koska agentit toimivat ennen tarkistusta, ne tarvitsevat valvonnan, joka on suunniteltu etukäteen: mitkä toiminnot vaativat että ihminen näkee suunnitelman ensin, mitkä eivät, ja mitä tapahtuu kun agentti juuttuu. Sen selvittäminen vasta häiriön jälkeen on liian myöhäistä.
06
Selkeys — kyky nähdä kuka teki mitä ja miten — merkitsee agenteille enemmän kuin keskusteluboteille, koska agentin teot tapahtuvat muiden järjestelmien sisällä, eivät viestissä jonka voit lukea. Ilman näkyvää jälkeä ei ole oikeaa valvontaa.
07
Sana «agentti» hinnastosivulla ei ole luotettava signaali. Sovella testi itse: tarvitaanko useampi kuin yksi askel, ja päättääkö se seuraavan askeleen itse? Jos ihminen valitsee jokaisen askeleen, se on keskustelubotti, kutsui markkinointi sitä miksi tahansa.