Bir sohbet botu ile bir ajan arasındaki gerçek fark
Biri bir soruyu yanıtlar. Diğeri ne yapılacağına karar verir, yapar, kendi işini kontrol eder ve sonraki adıma geçer — sizin sormanızı beklemeden. Bu fark akademik değildir. Neyin ters gidebileceğini ve bunu kimin yakalaması gerektiğini değiştirir.
Bir sohbet botu yazdığınızı alır, bir yanıt üretir ve durur. Bir ajan yazdığınızı alır, ne olması gerektiğine karar verir, bunun için bir şey yapar, bunun işe yarayıp yaramadığını kontrol eder ve sırada ne yapacağına karar verir — kendi başına, çoğu zaman birçok adım boyunca — bir insan bunların herhangi birini görmeden önce. Ayrımın tamamı budur. İnsanlar «YZ ajanları» hakkında tartışırken tartıştıkları her şey — risk, bir sistemin ihtiyaç duyduğu gözetim ve pazarlama karmaşasının çoğu — bu tek farktan çıkar.
Bir sohbet botu aslında ne yapar
Bir sohbet botu tek geçişli bir sistemdir. Ona metin verirsiniz, size metin üretir ve etkileşim orada biter. Konuşmanızın uzun bir belleğine sahip bir sohbet botu bile tur başına hâlâ tek bir şey yapar: o ana kadar söylenen her şeyi okur ve sonraki mesajı tahmin eder. Bir olguyu kontrol etmek için hiçbir zaman bir veritabanını sorgulamaz, sizin adınıza hiçbir şey göndermez ve yanıtının ayakta kalıp kalmadığını görmek için daha sonra geri dönmez. Yanlışsa, zarar bir insanın okuduğu bir cümledir — ve olağan akışta, ona göre hareket etmeden önce yakalayabilir.
İnsanların sohbet botlarından istediklerinin çoğu, kimse fark etmeden bu biçime uyar: bu belgeyi özetle, bir doğum günü mesajı taslağı yaz, iade politikamızı açıkla, üç başlık seçeneği yaz. Bunların hiçbiri sistemin gerçek dünyayla bir şeyi karşılaştırmasını ya da sohbet penceresinin dışında bir eylemde bulunmasını gerektirmez. Arayüz «sohbet botu» yerine «YZ asistanı» ya da «copilot» diye markalandığında da bu geçerlidir — kutunun üzerindeki etiket, içinde olup biteni değiştirmez.
Bir ajan aslında ne yapar
Bir ajan tek bir geçiş değil, bir döngü çalıştırır: bir adım planlar, gerçek bir aracı çağırarak bir eylemde bulunur — bir veritabanında arama yapar, bir mesaj gönderir, bir dosyayı düzenler, bir API çağırır — o eylemin gerçekte ne döndürdüğüne bakar ve sonraki adıma karar vermek için bu sonucu kullanır. Görevi bitene, takılana ya da bir insana danışacak şekilde kurulana kadar bunu tekrarlar. Önemli olan, yol boyunca her bir adımı kimsenin onaylamamasıdır. Sistem, en son hareket ettiğinde gerçekte ne olduğuna bakarak sırada neyi deneyeceğine kendi başına karar verir — ve yalnızca son bir yanıtta değil, bu karar noktalarının her birinde yanılabilir.
Bu döngü yeni ya da egzotik değildir. Araştırmacılar yıllardır bunun çeşitlerini — ne yapılacağını düşünmek, eyleme geçmek, sonucu gözlemlemek, yeniden düşünmek — tarif eder ve ajan diyen ürünlerin altında gerçekten çalışan şey budur: masraf raporu dosyalayan yazılımlardan, bir terminal açıp kendi komutlarını çalıştıran kod araçlarına kadar. Bir şeyi çok konuşkan bir sohbet botu yerine ajan yapan, dünyaya etki etmesi, ne olduğunu izlemesi ve uyum sağlamasıdır — bir insan her hamleyi onaylamadan, tekrar tekrar.
Aynı istek, iki şekilde
Benzer gelen talimatlar iki sisteme verildiğinde bu fark şöyle görünür.
«Bu belgeyi özetle.»
- 1Yapıştırdığınız metni okur.
- 2Bir özet paragrafı üretir.
«Vadesi 30 günden fazla geçmiş üç açık faturayı bul, her biri için bir hatırlatma e-postası taslağı yaz ve bunları taslaklar klasörüme koy.»
- 1Faturalama sistemini sorgular, 30 günden uzun süredir açık faturaları süzer.
- 2Gerçekten üç tane bulduğunu kontrol eder, iki ya da beş değil — tahmin etmek yerine uyuşmazlığı işaretler.
- 3Her fatura için doğru tutarı, vade tarihini ve kişiyi alır ve bir hatırlatma taslağı yazar.
- 4Her taslağı posta aracı üzerinden gerçek taslaklar klasörüne kaydeder.
- 5Ne bulduğunu ve ne taslakladığını geri bildirir.
İkinci soruyu bir sohbet botuna sorun, size yine yanıt gibi görünen bir şey verir: konuşmaya rastgele yapıştırdığınız şeyden üretilmiş, kulağa makul gelen üç hatırlatma e-postası. Yapmayacağı şey, gerçek faturalama sisteminizi sorgulamak, sayıyı doğrulamak ya da gerçek bir taslaklar klasörüne bir şey koymaktır. Çıktı benzer görünebilir. Sistemin gerçekte yaptığı şey benzer değildir.
Bu neden yalnızca bir sözcük tartışması değil
Ayrım önemlidir, çünkü neyin ters gidebileceğini ve bunu kimin yakalayacağını değiştirir. Bir sohbet botunun en kötü hali yanlış bir yanıttır. Birisi onu okur ve olağan akışta ya hatayı yakalar ya da ona göre hareket etmemeye karar verir — hata konuşmadan hiç çıkmaz. Bir ajanın en kötü hali, gerçek dünyada çoktan yapılmış yanlış bir eylemdir: yanlış bakiyeyle yanlış müşteriye giden hatırlatma, yanlış değerle güncellenen kayıt, iki kez kesilen iade — kimse bir şeyi incelemeden önce. Hata artık bir cümle değildir. Bir olaydır ve olaylar geri alınmaz.
Bir sohbet botunun en kötü hali, birinin okuduğu yanlış bir yanıttır. Bir ajanın en kötü hali, çoktan yapılmış yanlış bir eylemdir — kimse henüz bir şey okumadan.
Bir ajanın sohbet botundan farklı bir gözetime ihtiyacı olmasının nedeni budur. Bir sohbet botu çoğunlukla, biri fırsat bulduğunda yanıtlarını kontrol eden birine ihtiyaç duyar. Bir ajan, hiç çalışmadan önce tasarımcılarının çoktan karar vermiş olmasını ister: hangilerini sormadan yapabilir, hangileri bir insanın önce planı görmesini gerektirir ve takıldığında ne olur. Bunu sonradan çözerseniz, ajanın çoktan ne yaptığını zor yoldan öğrenirsiniz.
Yalnızca görebildiğinize güvenebilirsiniz
Bu, FabricLoop’un Okunabilirlik kavramının ardındaki aynı fikirdir: yalnızca gerçekten görebildiğiniz erişimi ve davranışı yönetebilirsiniz. Bir sohbet botu için bu neredeyse kendiliğindendir — tüm çıktısı bir insanın okuduğu bir mesajdır, dolayısıyla eylem ile eylemin kaydı aynı şeydir. Bir ajan için değildir. Eylemleri başka sistemlerin içinde olur — bir CRM, bir gelen kutusu, bir veritabanı, bir dosya — ve bir şey neye dokunduğunu, neyi değiştirdiğini ya da ne gönderdiğini kaydetmezse, sonradan incelemenin yolu yoktur, önceden durdurmanın ise hiç yoktur. Okunabilirlik, bir ajanın üzerine eklenen bir uyum süsü değildir. Bir ajan için sorunun tamamıdır, çünkü «yanıtı» düzeltebileceğiniz bir cümle değildir — sistem size göstermek üzere kurulmadıysa hiç yaşandığını bilmeyebileceğiniz bir eylemler kümesidir.
İki fikir arasındaki pratik bağ budur: bir ajan, sohbet botundan daha fazla ve farklı bir risk üstlenir; tam da bu yüzden ne yaptığının görünür bir izine ve daha yüksek riskli durumlarda harekete geçmeden önce bir kontrol noktasına ihtiyaç duyar — FabricLoop’un İnsan Müdahale Oranı kavramının, bir şey çoktan ters gittikten sonra üzerine cıvatalanan bir sonradan düşünce olarak değil, tasarladığınız ve ölçtüğünüz bir sayı olarak ele aldığı şey.
Piyasa bunu sürekli ters fiyatlar
Gerçek test elinizdeyken, etiketin her iki yönde de ne sıklıkla yalan söylediği açıktır. «YZ ajanı» diye sert pazarlanan pek çok ürün — sözcük kahraman başlıkta, fiyat kademelerinde — altta tek bir iyi ayarlanmış istemdir: girdiyi oku, çıktıyı üret, bitti. Bağımsız bir araç çağrısı yok, döngü yok, bir insan sonraki tıklamayı onaylamadan alınmış bir karar yok. Bu arada «ajan» sözcüğünü hiç kullanmayan pek çok yazılım — otomatik bir faturalama iş akışı, trafiği kendi başına yönlendiren bir izleme sistemi, çöken bir hizmeti yeniden başlatıp bunun düzeltip düzeltmediğini kontrol eden bir operasyon betiği — yukarıda tarif edilen döngünün tam olarak aynısını sessizce çalıştırır. Etiketteki sözcük, gerçekte hangi makineyi kullandığınız hakkında güvenilir hiçbir şey söylemez.
1. İşi yapmak için birden fazla adım atıyor mu? 2. O sonraki adımın ne olacağına kendisi mi karar veriyor, yoksa her adımı bir insan, her seferinde bir tıklamayla mı karar veriyor? Her adımı bir insan seçiyorsa, ekstra düğmeleri olan bir sohbet botuna bakıyorsunuz — pazarlama sayfası ne diyorsa onu deyin. Sistem birden fazla adım boyunca kendi sonraki adımını seçiyorsa, bir ajana bakıyorsunuz ve onun gibi yönetilmesi gerekir: görünür kayıtlar, sormadan ne yapabileceğine dair tanımlanmış sınırlar ve onu kimin, ne zaman incelediğine dair gerçek bir yanıt.
FabricLoop’un kendi YZ ürünü Loop Agent bu döngüyü çalıştırır — MCP ile bağlı araçlarda arar, taslak yazar, kendi işini kontrol eder — ama sessizce hareket edip sonradan raporlamak için değil, işini göstermek ve daha yüksek riskli adımlardan önce sormak için kurulmuştur. Kullandığı her MCP bağlantısı bir kişiye kapsamlanır ve Enterprise’ta yaptığı şey, yalnızca konuşmanın kendi belleğinde yaşamak yerine bir denetim günlüğünde görünür.
Bu, Okunabilirlik ve İnsan Müdahale Oranı içinde ele alınan aynı mantıktır — bu üç fikirden ilki size oturduysa, sırada okumaya değer.
Bunların hiçbiri uygulamak için teknik bir altyapı gerektirmez. Bir satıcı ya da bir meslektaş bir sonraki sefer bir şeye ajan dediğinde, talimatınız ile sonuç arasında gerçekte ne yaptığını sorun — ve bu adımların kaçına kendi başına karar verdiğini.
