Açık bir kitaptan yükselen, sokakları ve insanlarıyla tam olarak kurulmuş ışıklı bir kenti gösteren kâğıt kesim diorama; bir eylemi sözcüklerle anlatmak ile gidip onu gerçekten yapan bir ajan arasındaki fark
Yapay Zeka ve Güven

Bir sohbet botu ile bir ajan arasındaki gerçek fark

Biri bir soruyu yanıtlar. Diğeri ne yapılacağına karar verir, yapar, kendi işini kontrol eder ve sonraki adıma geçer — sizin sormanızı beklemeden. Bu fark akademik değildir. Neyin ters gidebileceğini ve bunu kimin yakalaması gerektiğini değiştirir.

FabricLoop Editör Ekibi
1,850 kelime
8 dakikalık okuma

Bir sohbet botu yazdığınızı alır, bir yanıt üretir ve durur. Bir ajan yazdığınızı alır, ne olması gerektiğine karar verir, bunun için bir şey yapar, bunun işe yarayıp yaramadığını kontrol eder ve sırada ne yapacağına karar verir — kendi başına, çoğu zaman birçok adım boyunca — bir insan bunların herhangi birini görmeden önce. Ayrımın tamamı budur. İnsanlar «YZ ajanları» hakkında tartışırken tartıştıkları her şey — risk, bir sistemin ihtiyaç duyduğu gözetim ve pazarlama karmaşasının çoğu — bu tek farktan çıkar.

Bir sohbet botu aslında ne yapar

Bir sohbet botu tek geçişli bir sistemdir. Ona metin verirsiniz, size metin üretir ve etkileşim orada biter. Konuşmanızın uzun bir belleğine sahip bir sohbet botu bile tur başına hâlâ tek bir şey yapar: o ana kadar söylenen her şeyi okur ve sonraki mesajı tahmin eder. Bir olguyu kontrol etmek için hiçbir zaman bir veritabanını sorgulamaz, sizin adınıza hiçbir şey göndermez ve yanıtının ayakta kalıp kalmadığını görmek için daha sonra geri dönmez. Yanlışsa, zarar bir insanın okuduğu bir cümledir — ve olağan akışta, ona göre hareket etmeden önce yakalayabilir.

İnsanların sohbet botlarından istediklerinin çoğu, kimse fark etmeden bu biçime uyar: bu belgeyi özetle, bir doğum günü mesajı taslağı yaz, iade politikamızı açıkla, üç başlık seçeneği yaz. Bunların hiçbiri sistemin gerçek dünyayla bir şeyi karşılaştırmasını ya da sohbet penceresinin dışında bir eylemde bulunmasını gerektirmez. Arayüz «sohbet botu» yerine «YZ asistanı» ya da «copilot» diye markalandığında da bu geçerlidir — kutunun üzerindeki etiket, içinde olup biteni değiştirmez.

Bir ajan aslında ne yapar

Bir ajan tek bir geçiş değil, bir döngü çalıştırır: bir adım planlar, gerçek bir aracı çağırarak bir eylemde bulunur — bir veritabanında arama yapar, bir mesaj gönderir, bir dosyayı düzenler, bir API çağırır — o eylemin gerçekte ne döndürdüğüne bakar ve sonraki adıma karar vermek için bu sonucu kullanır. Görevi bitene, takılana ya da bir insana danışacak şekilde kurulana kadar bunu tekrarlar. Önemli olan, yol boyunca her bir adımı kimsenin onaylamamasıdır. Sistem, en son hareket ettiğinde gerçekte ne olduğuna bakarak sırada neyi deneyeceğine kendi başına karar verir — ve yalnızca son bir yanıtta değil, bu karar noktalarının her birinde yanılabilir.

Bu döngü yeni ya da egzotik değildir. Araştırmacılar yıllardır bunun çeşitlerini — ne yapılacağını düşünmek, eyleme geçmek, sonucu gözlemlemek, yeniden düşünmek — tarif eder ve ajan diyen ürünlerin altında gerçekten çalışan şey budur: masraf raporu dosyalayan yazılımlardan, bir terminal açıp kendi komutlarını çalıştıran kod araçlarına kadar. Bir şeyi çok konuşkan bir sohbet botu yerine ajan yapan, dünyaya etki etmesi, ne olduğunu izlemesi ve uyum sağlamasıdır — bir insan her hamleyi onaylamadan, tekrar tekrar.

Aynı istek, iki şekilde

Benzer gelen talimatlar iki sisteme verildiğinde bu fark şöyle görünür.

Sohbet botu

«Bu belgeyi özetle.»

  • 1Yapıştırdığınız metni okur.
  • 2Bir özet paragrafı üretir.
Burada durur — sohbetin dışında hiçbir şey değişmedi
Ajan

«Vadesi 30 günden fazla geçmiş üç açık faturayı bul, her biri için bir hatırlatma e-postası taslağı yaz ve bunları taslaklar klasörüme koy.»

  • 1Faturalama sistemini sorgular, 30 günden uzun süredir açık faturaları süzer.
  • 2Gerçekten üç tane bulduğunu kontrol eder, iki ya da beş değil — tahmin etmek yerine uyuşmazlığı işaretler.
  • 3Her fatura için doğru tutarı, vade tarihini ve kişiyi alır ve bir hatırlatma taslağı yazar.
  • 4Her taslağı posta aracı üzerinden gerçek taslaklar klasörüne kaydeder.
  • 5Ne bulduğunu ve ne taslakladığını geri bildirir.
Eylemde bulunur — üç gerçek taslak artık var, incelenmemiş

İkinci soruyu bir sohbet botuna sorun, size yine yanıt gibi görünen bir şey verir: konuşmaya rastgele yapıştırdığınız şeyden üretilmiş, kulağa makul gelen üç hatırlatma e-postası. Yapmayacağı şey, gerçek faturalama sisteminizi sorgulamak, sayıyı doğrulamak ya da gerçek bir taslaklar klasörüne bir şey koymaktır. Çıktı benzer görünebilir. Sistemin gerçekte yaptığı şey benzer değildir.

Bu neden yalnızca bir sözcük tartışması değil

Ayrım önemlidir, çünkü neyin ters gidebileceğini ve bunu kimin yakalayacağını değiştirir. Bir sohbet botunun en kötü hali yanlış bir yanıttır. Birisi onu okur ve olağan akışta ya hatayı yakalar ya da ona göre hareket etmemeye karar verir — hata konuşmadan hiç çıkmaz. Bir ajanın en kötü hali, gerçek dünyada çoktan yapılmış yanlış bir eylemdir: yanlış bakiyeyle yanlış müşteriye giden hatırlatma, yanlış değerle güncellenen kayıt, iki kez kesilen iade — kimse bir şeyi incelemeden önce. Hata artık bir cümle değildir. Bir olaydır ve olaylar geri alınmaz.

Bir sohbet botunun en kötü hali, birinin okuduğu yanlış bir yanıttır. Bir ajanın en kötü hali, çoktan yapılmış yanlış bir eylemdir — kimse henüz bir şey okumadan.

Bir ajanın sohbet botundan farklı bir gözetime ihtiyacı olmasının nedeni budur. Bir sohbet botu çoğunlukla, biri fırsat bulduğunda yanıtlarını kontrol eden birine ihtiyaç duyar. Bir ajan, hiç çalışmadan önce tasarımcılarının çoktan karar vermiş olmasını ister: hangilerini sormadan yapabilir, hangileri bir insanın önce planı görmesini gerektirir ve takıldığında ne olur. Bunu sonradan çözerseniz, ajanın çoktan ne yaptığını zor yoldan öğrenirsiniz.

Yalnızca görebildiğinize güvenebilirsiniz

Bu, FabricLoop’un Okunabilirlik kavramının ardındaki aynı fikirdir: yalnızca gerçekten görebildiğiniz erişimi ve davranışı yönetebilirsiniz. Bir sohbet botu için bu neredeyse kendiliğindendir — tüm çıktısı bir insanın okuduğu bir mesajdır, dolayısıyla eylem ile eylemin kaydı aynı şeydir. Bir ajan için değildir. Eylemleri başka sistemlerin içinde olur — bir CRM, bir gelen kutusu, bir veritabanı, bir dosya — ve bir şey neye dokunduğunu, neyi değiştirdiğini ya da ne gönderdiğini kaydetmezse, sonradan incelemenin yolu yoktur, önceden durdurmanın ise hiç yoktur. Okunabilirlik, bir ajanın üzerine eklenen bir uyum süsü değildir. Bir ajan için sorunun tamamıdır, çünkü «yanıtı» düzeltebileceğiniz bir cümle değildir — sistem size göstermek üzere kurulmadıysa hiç yaşandığını bilmeyebileceğiniz bir eylemler kümesidir.

İki fikir arasındaki pratik bağ budur: bir ajan, sohbet botundan daha fazla ve farklı bir risk üstlenir; tam da bu yüzden ne yaptığının görünür bir izine ve daha yüksek riskli durumlarda harekete geçmeden önce bir kontrol noktasına ihtiyaç duyar — FabricLoop’un İnsan Müdahale Oranı kavramının, bir şey çoktan ters gittikten sonra üzerine cıvatalanan bir sonradan düşünce olarak değil, tasarladığınız ve ölçtüğünüz bir sayı olarak ele aldığı şey.

Piyasa bunu sürekli ters fiyatlar

Gerçek test elinizdeyken, etiketin her iki yönde de ne sıklıkla yalan söylediği açıktır. «YZ ajanı» diye sert pazarlanan pek çok ürün — sözcük kahraman başlıkta, fiyat kademelerinde — altta tek bir iyi ayarlanmış istemdir: girdiyi oku, çıktıyı üret, bitti. Bağımsız bir araç çağrısı yok, döngü yok, bir insan sonraki tıklamayı onaylamadan alınmış bir karar yok. Bu arada «ajan» sözcüğünü hiç kullanmayan pek çok yazılım — otomatik bir faturalama iş akışı, trafiği kendi başına yönlendiren bir izleme sistemi, çöken bir hizmeti yeniden başlatıp bunun düzeltip düzeltmediğini kontrol eden bir operasyon betiği — yukarıda tarif edilen döngünün tam olarak aynısını sessizce çalıştırır. Etiketteki sözcük, gerçekte hangi makineyi kullandığınız hakkında güvenilir hiçbir şey söylemez.

İki soruluk test

1. İşi yapmak için birden fazla adım atıyor mu? 2. O sonraki adımın ne olacağına kendisi mi karar veriyor, yoksa her adımı bir insan, her seferinde bir tıklamayla mı karar veriyor? Her adımı bir insan seçiyorsa, ekstra düğmeleri olan bir sohbet botuna bakıyorsunuz — pazarlama sayfası ne diyorsa onu deyin. Sistem birden fazla adım boyunca kendi sonraki adımını seçiyorsa, bir ajana bakıyorsunuz ve onun gibi yönetilmesi gerekir: görünür kayıtlar, sormadan ne yapabileceğine dair tanımlanmış sınırlar ve onu kimin, ne zaman incelediğine dair gerçek bir yanıt.

FL
FabricLoop bu çizgiyi nerede çizer

FabricLoop’un kendi YZ ürünü Loop Agent bu döngüyü çalıştırır — MCP ile bağlı araçlarda arar, taslak yazar, kendi işini kontrol eder — ama sessizce hareket edip sonradan raporlamak için değil, işini göstermek ve daha yüksek riskli adımlardan önce sormak için kurulmuştur. Kullandığı her MCP bağlantısı bir kişiye kapsamlanır ve Enterprise’ta yaptığı şey, yalnızca konuşmanın kendi belleğinde yaşamak yerine bir denetim günlüğünde görünür.

Bu, Okunabilirlik ve İnsan Müdahale Oranı içinde ele alınan aynı mantıktır — bu üç fikirden ilki size oturduysa, sırada okumaya değer.

Bunların hiçbiri uygulamak için teknik bir altyapı gerektirmez. Bir satıcı ya da bir meslektaş bir sonraki sefer bir şeye ajan dediğinde, talimatınız ile sonuç arasında gerçekte ne yaptığını sorun — ve bu adımların kaçına kendi başına karar verdiğini.


Önemli çıkarımlar
01
Bir sohbet botu tek geçişte yanıtlar: girdiyi oku, çıktıyı üret, dur. Bir olguyu canlı bir sistemle hiç karşılaştırmaz, sizin adınıza hiçbir şey göndermez ve kendi yanıtını doğrulamak için daha sonra geri dönmez.
02
Bir ajan bir döngü çalıştırır: planla, gerçek bir araç üzerinden hareket et, gerçekte ne olduğunu gözlemle, sonraki adıma karar ver, tekrarla — bir kişi her tekil hamleyi onaylamadan.
03
Benzer gelen istekler iki farklı makine üretebilir. «Bu belgeyi özetle» sohbet botu davranışıdır. «Vadesi 30 günden fazla geçmiş üç faturayı bul, hatırlatmalar taslakla ve taslaklar klasörüme koy» ajan davranışıdır — gerçek sorgular, doğrulama ve adımlar arasında bağımsız kararlar gerektirir.
04
Bir sohbet botunun en kötü hali, bir insanın okuduğu ve ona göre hareket etmemeyi seçebileceği yanlış bir yanıttır. Bir ajanın en kötü hali, gerçek dünyada çoktan yapılmış yanlış bir eylemdir — gönderilmiş bir e-posta, değiştirilmiş bir kayıt — kimse incelemeden önce.
05
Ajanlar incelemeden önce hareket ettiği için, önceden tasarlanmış gözetime ihtiyaç duyarlar: hangi eylemler bir insanın önce planı görmesini gerektirir, hangileri gerektirmez ve ajan takıldığında ne olur. Bunu bir olaydan sonra çözmek çok geçtir.
06
Okunabilirlik — kimin ne yaptığını ve nasıl yaptığını görebilmek — ajanlar için sohbet botlarından daha çok önemlidir, çünkü bir ajanın eylemleri okuyabileceğiniz bir mesajın içinde değil, başka sistemlerin içinde olur. Görünür iz yoksa gerçek gözetim de yoktur.
07
Bir fiyatlandırma sayfasındaki «ajan» sözcüğü güvenilir bir sinyal değildir. Testi kendiniz uygulayın: birden fazla adım atıyor mu ve sonraki adıma kendi başına mı karar veriyor? Her adımı bir insan seçiyorsa, pazarlama ne derse desin o bir sohbet botudur.