Diorama guntingan kertas yang timbul daripada buku terbuka, menunjukkan bandar yang lengkap dan bercahaya dengan jalan serta orang, mewakili perbezaan antara menerangkan tindakan dengan kata-kata dan ejen yang benar-benar pergi melakukannya
AI & Kepercayaan

Perbezaan sebenar antara chatbot dan ejen

Satu daripadanya menjawab soalan. Yang satu lagi memutuskan apa yang perlu dilakukan, melakukannya, menyemak kerja sendiri, lalu bergerak ke langkah seterusnya — tanpa menunggu anda bertanya. Perbezaan itu bukan soal akademik. Ia mengubah apa yang boleh menjadi salah, dan siapa yang sepatutnya menangkapnya.

Editorial FabricLoop
1,850 patah perkataan
8 minit membaca

Chatbot mengambil apa yang anda taip, menjana respons, lalu berhenti. Ejen mengambil apa yang anda taip, memutuskan apa yang perlu berlaku, melakukan sesuatu tentangnya, menyemak sama ada itu berjaya, lalu memutuskan apa yang perlu dilakukan seterusnya — sendiri, sering kali merentas banyak langkah — sebelum sesiapa melihat mana-mana bahagiannya. Itulah seluruh perbezaan. Segala yang orang perdebatkan apabila mereka berdebat tentang “ejen AI” — risiko, pengawasan yang diperlukan sistem, dan sebahagian besar kekeliruan pemasaran — mengalir daripada satu perbezaan itu.

Apa yang chatbot sebenarnya lakukan

Chatbot ialah sistem satu laluan. Anda berinya teks, ia menjana teks kembali, dan interaksi tamat di situ. Chatbot yang mempunyai ingatan panjang tentang perbualan anda pun masih melakukan satu perkara setiap giliran: membaca segala yang telah diperkatakan setakat ini dan meramalkan mesej seterusnya. Ia tidak pernah menanya pangkalan data untuk menyemak fakta, tidak pernah menghantar apa-apa bagi pihak anda, dan tidak pernah kembali kemudian untuk melihat sama ada jawapannya bertahan. Jika ia salah, kerosakannya ialah ayat yang dibaca seseorang — dan, dalam perjalanan biasa perkara, orang itu boleh menangkapnya sebelum bertindak atas ayat itu.

Kebanyakan yang orang minta chatbot lakukan muat dengan bentuk ini tanpa sesiapa perasan: ringkaskan dokumen ini, draf mesej hari jadi, terangkan dasar bayaran balik kami, tulis tiga pilihan tajuk. Tiada satu pun menuntut sistem menyemak sesuatu terhadap dunia sebenar atau mengambil tindakan di luar tetingkap sembang. Itu tetap benar apabila antara muka dijenamakan “pembantu AI” atau “copilot” dan bukannya “chatbot” — label pada kotak tidak mengubah apa yang berlaku di dalamnya.

Apa yang ejen sebenarnya lakukan

Ejen menjalankan gelung, bukan satu laluan: merancang satu langkah, mengambil tindakan dengan memanggil alat sebenar — mencari pangkalan data, menghantar mesej, menyunting fail, memanggil API — melihat apa yang tindakan itu sebenarnya kembalikan, lalu menggunakan hasil itu untuk memutuskan langkah seterusnya. Ia mengulang ini sehingga tugas selesai, ia tersekat, atau ia dibina untuk menyemak dengan seseorang. Bahagian penting: tiada siapa meluluskan setiap langkah satu persatu sepanjang jalan. Sistem memutuskan sendiri apa yang hendak dicuba seterusnya berdasarkan apa yang sebenarnya berlaku kali terakhir ia bertindak — dan ia boleh salah pada setiap titik keputusan itu, bukan hanya pada jawapan akhir.

Gelung ini bukan baru dan bukan eksotik. Penyelidik telah menghuraikan versi-versinya — menaakul apa yang perlu dilakukan, bertindak, memerhati hasil, menaakul semula — selama bertahun-tahun, dan itulah yang sebenarnya berjalan di bawah produk yang memanggil diri mereka ejen, daripada perisian yang memfailkan laporan perbelanjaan hingga alat pengekodan yang membuka terminal lalu menjalankan arahan sendiri. Apa yang menjadikan sesuatu ejen dan bukannya chatbot yang sangat banyak bercakap ialah ia bertindak ke atas dunia, memerhati apa yang berlaku, dan menyesuaikan diri — berulang kali, tanpa manusia meluluskan setiap gerak.

Permintaan yang sama, dijalankan dua cara

Beginilah rupa perbezaan itu apabila dua sistem menerima arahan yang kedengaran serupa.

Chatbot

“Ringkaskan dokumen ini.”

  • 1Membaca teks yang anda tampal.
  • 2Menjana satu perenggan ringkasan.
Berhenti di sini — tiada apa di luar sembang berubah
Ejen

“Cari tiga invois terbuka yang lewat lebih 30 hari, draf e-mel peringatan untuk setiap satu, dan letakkan dalam folder draf saya.”

  • 1Menanya sistem invois, menapis invois yang terbuka lebih 30 hari.
  • 2Menyemak bahawa ia benar-benar menemui tiga, bukan dua atau lima — menandakan ketidakpadanan dan bukannya meneka.
  • 3Mengambil jumlah yang betul, tarikh tamat tempoh, dan kenalan setiap invois, lalu mendraf peringatan.
  • 4Menyimpan setiap draf ke folder draf sebenar melalui alat mel.
  • 5Melaporkan apa yang ditemui dan apa yang didraf.
Mengambil tindakan — tiga draf sebenar kini wujud, belum disemak

Tanya chatbot soalan kedua, dan ia tetap akan menyerahkan sesuatu yang kelihatan seperti jawapan: tiga e-mel peringatan yang kedengaran munasabah, dijana daripada apa sahaja yang kebetulan anda tampal ke dalam perbualan. Apa yang tidak akan dilakukannya ialah menanya sistem invois sebenar anda, mengesahkan bilangan, atau meletakkan apa-apa dalam folder draf yang sebenar. Output boleh kelihatan serupa. Apa yang sistem sebenarnya lakukan, tidak.

Mengapa ini bukan sekadar perdebatan semantik

Perbezaan itu penting kerana ia mengubah apa yang boleh menjadi salah, dan siapa yang menangkapnya. Kes terburuk chatbot ialah jawapan yang salah. Seseorang membacanya, dan dalam perjalanan biasa perkara sama ada menangkap ralat itu atau memutuskan untuk tidak bertindak atasnya — kesilapan tidak pernah meninggalkan perbualan. Kes terburuk ejen ialah tindakan yang salah yang sudah diambil di dunia sebenar: peringatan yang pergi kepada pelanggan yang salah dengan baki yang salah, rekod yang dikemas kini dengan nilai yang salah, bayaran balik yang dikeluarkan dua kali — sebelum sesiapa menyemak apa-apa. Kesilapan itu bukan lagi ayat. Ia satu peristiwa, dan peristiwa tidak boleh dibuat tidak berlaku.

Kes terburuk chatbot ialah jawapan salah yang seseorang baca. Kes terburuk ejen ialah tindakan salah yang sudah diambil — sebelum sesiapa membaca apa-apa pun.

Itulah sebabnya ejen memerlukan jenis pengawasan yang berbeza daripada chatbot. Chatbot kebanyakannya memerlukan seseorang yang menyemak jawapannya, bila-bila orang itu sempat. Ejen memerlukan pereka bentuknya sudah memutuskan, sebelum ia pernah berjalan, tindakan mana yang boleh diambilnya tanpa bertanya, tindakan mana yang menuntut seseorang melihat pelan dahulu, dan apa yang berlaku apabila ia tersekat. Jika anda selesaikan itu selepas kejadian, anda akan tahu apa yang ejen sudah lakukan dengan cara yang sukar.

Anda hanya boleh percaya apa yang anda boleh lihat

Ini idea yang sama di sebalik konsep Keterbacaan FabricLoop: anda hanya boleh mentadbir akses, dan tingkah laku, yang anda benar-benar boleh lihat. Bagi chatbot, itu hampir automatik — seluruh outputnya ialah mesej yang dibaca seseorang, jadi tindakan dan rekod tindakan ialah perkara yang sama. Bagi ejen, tidak. Tindakannya berlaku di dalam sistem lain — CRM, peti masuk, pangkalan data, fail — dan melainkan sesuatu merekod apa yang disentuh, diubah, atau dihantarnya, tiada cara untuk menyemaknya selepas kejadian, apatah lagi menghentikannya sebelum itu. Keterbacaan bukan tambahan pematuhan yang ditindih di atas ejen. Bagi ejen, itulah seluruh soalan, kerana “jawapan”nya bukan ayat yang boleh anda baca semak — ia satu set tindakan yang mungkin anda tidak pernah tahu berlaku, melainkan sistem dibina untuk menunjukkannya kepada anda.

Itulah pautan praktikal antara dua idea: ejen memikul lebih banyak risiko, dan risiko yang berbeza, daripada chatbot, dan itulah tepat sebabnya ia memerlukan jejak yang kelihatan tentang apa yang dilakukannya dan, dalam kes pertaruhan lebih tinggi, satu titik semak sebelum ia bertindak — apa yang konsep Kadar Campur Tangan Manusia FabricLoop anggap sebagai nombor yang anda reka bentuk dan ukur, bukan fikiran terkemudian yang dipasang setelah sesuatu sudah menjadi salah.

Pasaran menetapkan harga ini secara terbalik, sentiasa

Sebaik anda ada ujian yang sebenar, jelas betapa kerap label berbohong dalam kedua-dua arah. Banyak produk yang dipasarkan kuat sebagai “ejen AI” — perkataan itu dalam tajuk utama, dalam peringkat harga — di bawahnya hanyalah satu gesaan yang ditala dengan baik: baca input, jana output, siap. Tiada panggilan alat bebas, tiada gelung, tiada keputusan yang dibuat tanpa manusia meluluskan klik seterusnya. Sementara itu, banyak perisian yang tidak pernah menggunakan perkataan “ejen” — aliran kerja invois automatik, sistem pemantauan yang mengubah hala trafik sendiri, skrip operasi yang memulakan semula perkhidmatan yang gagal lalu menyemak sama ada itu membaikinya — secara senyap menjalankan tepat gelung yang diterangkan di atas. Perkataan pada label tidak memberitahu anda apa-apa yang boleh dipercayai tentang mesin mana yang anda sebenarnya gunakan.

Ujian dua soalan

1. Adakah ia mengambil lebih daripada satu langkah untuk melakukan perkara itu? 2. Adakah ia yang memutuskan langkah seterusnya, atau seseorang memutuskan setiap langkah, satu klik pada satu masa? Jika manusia memilih setiap langkah, anda sedang melihat chatbot dengan butang tambahan — panggil ia apa sahaja yang dipanggil halaman pemasaran. Jika sistem memilih langkah seterusnya sendiri merentas lebih daripada satu langkah, anda sedang melihat ejen, dan ia perlu ditadbir seperti ejen: log yang kelihatan, had yang ditetapkan tentang apa yang boleh dilakukannya tanpa bertanya, dan jawapan sebenar tentang siapa yang menyemaknya dan bila.

FL
Di mana FabricLoop melukis garis ini

Produk AI FabricLoop sendiri, Loop Agent, menjalankan gelung itu — mencari, mendraf, menyemak kerja sendiri merentas alat yang disambungkan melalui MCP — tetapi ia dibina untuk menunjukkan kerjanya dan bertanya sebelum langkah pertaruhan lebih tinggi, bukan bertindak secara senyap lalu melapor selepas kejadian. Setiap sambungan MCP yang digunakannya diskopkan kepada seorang, dan pada Enterprise apa yang dilakukannya muncul dalam log audit, bukannya hidup hanya di dalam ingatannya sendiri tentang perbualan.

Itulah logik yang sama yang diliputi dalam Keterbacaan dan Kadar Campur Tangan Manusia — berbaloi dibaca seterusnya jika ini idea pertama daripada tiga idea itu yang membuat anda faham.

Tiada satu pun daripada ini menuntut latar belakang teknikal untuk digunakan. Kali seterusnya vendor, atau rakan sekerja, memanggil sesuatu ejen, tanya apa yang sebenarnya dilakukannya antara arahan anda dan hasilnya — dan berapa banyak langkah itu yang diputuskannya sendiri.


Pengambilan utama
01
Chatbot menjawab dalam satu laluan: baca input, jana output, berhenti. Ia tidak pernah menyemak fakta terhadap sistem yang hidup, tidak menghantar apa-apa bagi pihak anda, dan tidak kembali kemudian untuk mengesahkan jawapannya sendiri.
02
Ejen menjalankan gelung: rancang, bertindak melalui alat sebenar, perhati apa yang sebenarnya berlaku, putuskan langkah seterusnya, ulang — tanpa seseorang meluluskan setiap gerak.
03
Permintaan yang kedengaran serupa boleh menghasilkan dua mesin yang berbeza. “Ringkaskan dokumen ini” ialah tingkah laku chatbot. “Cari tiga invois yang lewat lebih 30 hari, draf peringatan, dan letakkan dalam folder draf saya” ialah tingkah laku ejen — ia menuntut carian sebenar, pengesahan, dan keputusan bebas antara langkah.
04
Kes terburuk chatbot ialah jawapan salah yang seseorang baca dan boleh pilih untuk tidak bertindak atasnya. Kes terburuk ejen ialah tindakan salah yang sudah diambil di dunia sebenar — e-mel yang dihantar, rekod yang diubah — sebelum sesiapa menyemaknya.
05
Kerana ejen bertindak sebelum semakan, mereka memerlukan pengawasan yang direka lebih dahulu: tindakan mana yang menuntut seseorang melihat pelan dahulu, yang mana tidak, dan apa yang berlaku apabila ejen tersekat. Menyelesaikan itu selepas insiden sudah terlambat.
06
Keterbacaan — keupayaan melihat siapa melakukan apa, dan bagaimana — lebih penting bagi ejen daripada chatbot, kerana tindakan ejen berlaku di dalam sistem lain, bukan di dalam mesej yang boleh anda baca. Tiada jejak yang kelihatan bermakna tiada pengawasan sebenar.
07
Perkataan “ejen” pada halaman harga bukan isyarat yang boleh dipercayai. Gunakan ujian itu sendiri: adakah ia mengambil lebih daripada satu langkah, dan adakah ia memutuskan langkah seterusnya sendiri? Jika manusia memilih setiap langkah, itu chatbot, tidak kira apa yang pemasaran panggil.