Dari coding ke Agen Pekerjaan Pengetahuan — Karan Vaidya, Composio
AAI Engineer
Computing/SoftwareInternet Technology
Transcript
00:00:00Halo semuanya, saya Karan Vedya, salah satu pendiri sekaligus CTO Composio.
00:00:19Sebagian besar pemanggilan alat agen saat ini
00:00:21masih terjadi di satu bidang.
00:00:23Tidak perlu menebak lagi, itu adalah rekayasa perangkat lunak.
00:00:26Bidang pekerjaan lain masih tertinggal jauh di belakang.
00:00:29Jika model terus menjadi lebih baik, lalu
00:00:32mengapa kita masih terbatas hanya pada pengkodean agen?
00:00:35Itulah pertanyaan bernilai triliunan dolar yang akan saya jawab di sini.
00:00:43Tiga tahun lalu, agen pengodean hanyalah pelengkapan otomatis.
00:00:47Hari ini, rekayasa perangkat lunak sudah sepenuhnya otonom.
00:00:50Kita beralih dari menekan tombol tab terus-menerus menjadi membiarkan Claude bekerja.
00:00:56Itu benar-benar seperti keajaiban.
00:00:59Dan mengapa hal itu bisa terjadi begitu cepat dalam pengodean?
00:01:04Kebanyakan orang mungkin mengira karena modelnya.
00:01:06Ya, model memang menjadi jauh lebih baik seiring berjalannya waktu, selama dua hingga tiga tahun terakhir, begitu pula dengan
00:01:13kerangka kerjanya seperti Claude Code, Codex, dan Cursor.
00:01:17Tetapi jika sendirian, itu tidak akan cukup.
00:01:20Hal itu hanya berhasil karena semua infrastruktur dan sistem di sekitar pengodean memang dirancang
00:01:26untuk agen.
00:01:27Kode hadir dengan dukungan yang dibutuhkan oleh para agen.
00:01:31Anda memiliki repositori, riwayat commit, pengujian, CI/CD, peninjauan, linter, dan fitur pembatalan jika ada
00:01:39yang salah.
00:01:39Hal-hal semacam inilah yang membuat Anda mempercayai agen dan sistem di sekitar kode.
00:01:45Sekarang, kita mengarahkan agen hebat yang sama ini ke segala hal lain: dukungan pelanggan, keuangan, dan penjualan.
00:01:54Tetapi agen yang bekerja sangat luar biasa dalam pengodean justru bekerja tanpa arah karena
00:02:00infrastruktur di sekitarnya bahkan tidak ada di bidang lain.
00:02:04Jadi, bagaimana kita menjembatani kesenjangan antara agen pengodean dan agen pekerjaan pengetahuan?
00:02:11Kami rasa kuncinya adalah enam primitif inti, di mana pengodean memiliki semuanya, sementara pekerjaan pengetahuan tidak memilikinya
00:02:19sama sekali.
00:02:20Dan itulah yang perlu kita bangun.
00:02:24Yang pertama adalah sentralisasi.
00:02:26Agen pengodean bekerja dengan sangat baik, sebagian karena mereka berada sangat dekat dengan sumber kebenaran.
00:02:34Mereka mengetahui apa, mengapa, dan bagaimana.
00:02:37Anda memberi mereka repositori, infrastruktur sebagai kode, lalu menutup lingkaran dan membiarkan modelnya
00:02:43bekerja.
00:02:44Agen mulai dengan segala hal yang mereka butuhkan di satu tempat, yaitu basis kode.
00:02:51Inilah persisnya yang kurang dalam pekerjaan pengetahuan saat ini.
00:02:55Sebagai contoh, satu kesepakatan tersebar di lima platform yang berbeda.
00:03:00Catatannya ada di Salesforce, dokumennya di Notion, email di Gmail, percakapan di
00:03:05Slack, dan riwayat dukungan ada di Zendesk.
00:03:09Tidak ada satu sumber kebenaran tunggal atau tempat tunggal untuk mendapatkan semua informasi.
00:03:14Pengodean bersifat terpisah, dan setiap aplikasi memiliki loginnya sendiri.
00:03:18Sebelum agen pekerjaan pengetahuan bahkan dapat mulai melakukan sesuatu, ia harus pergi dan menarik semua
00:03:23benang merah tersebut dan menyatukannya sendiri.
00:03:27Padahal itu masih titik awal di mana agen pengodean dulu bermula.
00:03:30Mereka sudah memiliki semuanya.
00:03:32Jadi, bagaimana Anda bisa mengharapkan agen pekerjaan pengetahuan melakukan tingkat pekerjaan yang sama seperti agen pengodean?
00:03:39Jadi, hal pertama yang kita bangun adalah pusat yang hilang.
00:03:42Satu tempat di mana semua aplikasi, semua koneksi, dan semua login Anda berada.
00:03:46Sehingga agen tidak perlu melakukan pekerjaan berat untuk menyatukannya semua.
00:03:51Mereka menemukan semuanya di satu tempat.
00:03:55Dan mereka mendapatkan garis dasar yang sama seperti saat agen pengodean mulai, yaitu repositori dan informasi
00:03:59di semua tumpukan dalam satu tempat.
00:04:02Itulah fondasi awal Anda, dan Anda dapat memberikan hak akses tulis kepada agen Anda.
00:04:09Hal berikutnya yang dibutuhkan agen adalah rasa sejarah, kemampuan untuk melihat kembali ke masa lalu.
00:04:16Dalam kode, Anda mendapatkannya secara gratis.
00:04:18Git menyimpan catatan dari setiap hal yang dimasukkan, setiap perubahan yang dilakukan.
00:04:23Sehingga agen selalu dapat melihat ke belakang dan melihat bagaimana perubahan tertentu dibuat.
00:04:27Mengapa sesuatu berhasil, mengapa sesuatu tidak berhasil.
00:04:31Pikirkan jenis hal yang biasanya Anda minta untuk dilakukan oleh agen Anda.
00:04:34Kami harus membatalkan perubahan di masa lalu karena beberapa kegagalan, tetapi itu cukup sulit untuk dilakukan.
00:04:40Bisakah Anda melihatnya dan mengembalikannya lagi?
00:04:43Ia hanya membaca riwayatnya, mengembalikannya, lalu mengerjakannya.
00:04:46Riwayat tersebut bukan hanya untuk agen.
00:04:49Itu juga untuk Anda agar dapat mencatat apa yang sedang dikerjakan oleh agen.
00:04:53Anda dapat melihat apa yang dilakukan agen, di mana ia membuat kesalahan, di mana ia melakukan hal-hal dengan sukses.
00:04:58Dan alih-alih mempercayai apa yang dikatakan oleh agen kepada Anda, Anda dapat langsung menuju ke aplikasi tersebut
00:05:04dan melihat apa yang telah dilakukannya.
00:05:09Sekarang, ajukan pertanyaan yang sama tentang pekerjaan pengetahuan.
00:05:12Apa yang menyebabkan CRM berada dalam kondisi seperti sekarang ini?
00:05:16Bagaimana rekan kerja saya merumuskan email luar biasa yang berujung pada ditutupnya kesepakatan tersebut?
00:05:22Apa proses aktual untuk mengeskalasi masalah dukungan atau bahkan menyelesaikannya?
00:05:27Jawabannya tersebar di ratusan aplikasi, dan tidak satupun dari mereka yang menyimpan riwayatnya.
00:05:31Sehingga agen tidak memiliki memori.
00:05:33Ia mulai dari keadaan kosong hampir setiap saat.
00:05:36Tidak tahu apa yang telah dicoba sebelumnya, apa yang berhasil, apa yang tidak berhasil.
00:05:40Dan Anda juga tidak memiliki apa pun untuk dilihat.
00:05:44Begitu agen berjalan, ia memberi tahu Anda bahwa ia telah menyelesaikannya dengan sukses.
00:05:47Anda tidak tahu apakah ia benar-benar melakukannya dengan sukses.
00:05:49Tidak ada cara untuk mengetahui apakah itu benar atau tidak.
00:05:52Dan itulah yang hilang, sebuah catatan pekerjaan.
00:05:56Sekarang, karena semuanya akhirnya berjalan melalui satu tempat, yaitu sentralisasi tersebut,
00:06:02kita dapat membangun lapisan di atasnya, yaitu catatan.
00:06:06Setiap tindakan yang diambil oleh agen dapat dicatat di setiap aplikasi lainnya.
00:06:12Apa pun yang disentuhnya, apa pun yang dilewatinya, apa yang berhasil, apa yang tidak.
00:06:17Melalui ini, pertama-tama, agen mendapatkan memori.
00:06:20Ia dapat melihat kembali bagaimana tugas serupa dilakukan sebelumnya, apa yang berhasil, dan mereplikasinya lagi.
00:06:28Ia tidak mulai dengan keadaan kosong setiap waktu.
00:06:31Kedua, Anda mendapatkan kepercayaan.
00:06:33Anda akhirnya dapat melihat dengan tepat apa yang sedang dilakukan oleh agen.
00:06:36Jadi, alih-alih berharap ia akan melakukan hal yang benar, Anda dapat kembali memeriksa dan menangkapnya jika ia melakukan sesuatu yang buruk.
00:06:44Dan saat Anda semakin sering melihatnya melakukan hal-hal yang benar, Anda akan mengembangkan kepercayaan dan melimpahkan lebih banyak tugas kepadanya.
00:06:50Hal berikutnya yang dibutuhkan oleh agen adalah konteks.
00:06:53Dan sebenarnya ada dua jenis konteks, jika Anda memikirkannya.
00:06:57Yang pertama adalah bentuk platform, yaitu arsitekturnya.
00:07:01Bagaimana hal-hal mengalir ke satu sama lain, bagaimana hal-hal terikat, aliran datanya.
00:07:05Mirip seperti peta yang dibawa oleh insinyur senior di dalam kepala mereka, dan insinyur junior butuh waktu sekitar tiga bulan untuk memahaminya.
00:07:12Yang kedua adalah gaya.
00:07:13Ini bukan tentang apa yang benar secara objektif, tetapi lebih kepada seperti apa bentuk pekerjaan yang baik di perusahaan Anda.
00:07:19Jadi, cara Anda melakukan sesuatu, hal-hal seperti linter, pemeriksaan tipe, dan sebagainya.
00:07:24Dan mungkin Anda menggunakan dekorator TypeScript, yang tidak digunakan orang lain.
00:07:29Ini tidak persis ada di suatu tempat dalam buku panduan.
00:07:32Ini lebih ada di basis kode Anda.
00:07:34Semuanya tersedia di basis kode Anda.
00:07:35Sehingga agen dapat pergi melihat dan mencari tahu spesifikasinya, apa yang Anda sukai, linter, pemformat, dan lain-lain.
00:07:45Sekarang, beralih ke pekerjaan pengetahuan, hal yang sama berlaku.
00:07:48Katakanlah Anda sedang menulis dokumen untuk pelanggan.
00:07:50Untuk mulai saja, saya harus membuka basis data untuk menarik penggunaan mereka, memeriksa secara pasca-hoc bagaimana mereka benar-benar menggunakan berbagai hal,
00:07:58dan membuka Salesforce untuk melihat detail kesepakatan mereka.
00:08:01Baru setelah itu saya bahkan dapat mulai menulis baris pertama dari dokumen tersebut.
00:08:05Jawabannya tidak terisolasi hanya di salah satu alat tersebut.
00:08:09Saya dapat menulis dokumen ini karena saya menarik benang merah di semua alat ini ke dalam satu konteks di kepala saya.
00:08:15Jadi, menggabungkan riwayat dan konteks, itulah cara Anda memetakan bagaimana organisasi bekerja.
00:08:21Dan bagian itu tidak tersedia secara praktis bagi agen.
00:08:26Jadi, saat kita melakukan sentralisasi dan pencatatan, catatan yang baru saja kita bangun, yang memberikan memori kepada agen dan memungkinkan Anda memeriksa apa yang telah dilakukannya,
00:08:36juga melakukan satu hal lagi yang menarik.
00:08:38Jika Anda mencatat cukup banyak hal tentang apa yang dilakukan setiap agen, Anda mulai melihat pola.
00:08:42Anda mulai melihat bagaimana organisasi bekerja, dan Anda mulai membentuk keterampilan, yang merupakan semacam penyulingan dari cara organisasi bekerja.
00:08:51Pendekatan mana yang berhasil, mana yang tidak, apa yang memicu kegagalan di masa lalu, dan sebagainya.
00:08:57Catatan itu bukan lagi sekadar riwayat tentang apa yang terjadi.
00:09:01Itu adalah gambaran tentang bagaimana perusahaan Anda beroperasi.
00:09:03Dan itu benar-benar bekerja pada tiga tingkat yang berbeda.
00:09:06Bagaimana suatu alat bekerja secara umum, yang berlaku untuk setiap orang.
00:09:09Bagaimana perusahaan melakukan sesuatu, dan bagaimana Anda memilih untuk melakukannya.
00:09:13Seperti apa bentuk pekerjaan yang baik bagi Anda.
00:09:15Dan itulah konteks yang hilang bagi agen pekerjaan pengetahuan.
00:09:19Bagaimana pekerjaan itu sebenarnya diselesaikan.
00:09:21Buku panduan nyata semacam itu.
00:09:23Serta preferensi perusahaan dan pengguna pribadi.
00:09:27Dan sekarang agen dapat meng kuerinya dan berhenti menebak-nebak bagaimana perusahaan beroperasi.
00:09:34Alasan lain mengapa agen pengodean bekerja dengan sangat baik.
00:09:37Mereka menguji diri sendiri.
00:09:38Pekerjaan itu memeriksa dirinya sendiri.
00:09:40Verifikasi.
00:09:41Saat agen menulis kode, serangkaian pemeriksaan menyusul.
00:09:44Uji unit dapat mendeteksi kesalahan kecil.
00:09:47Uji integrasi menangkap kesalahan yang hanya berdampak pada komponen tiga blok jauhnya.
00:09:52Sistem tipe bahkan tidak akan berfungsi dan berjalan jika ada yang tidak beres.
00:09:57Penyusun bahkan tidak akan melakukan build.
00:10:00Di atasnya terdapat pemeriksaan perangkat lunak.
00:10:02Linter, pemformat, bugbot.md, keterampilan peninjauan, dan sebagainya.
00:10:06Dan ini memastikan bahwa kode tersebut cocok dengan cara tim Anda mengikuti standar tim Anda.
00:10:12Tidak ada yang menemui Anda.
00:10:14Agen menyelesaikan siklusnya sendiri dan memastikan bahwa ia mengikuti standar serta mampu menjalankan kode tersebut.
00:10:21Sekarang, bayangkan, seperti, beberapa waktu lalu, saya mengarahkan open claw saya ke penjangkauan perekrutan.
00:10:28Email massal ke kandidat.
00:10:30Itu berjalan.
00:10:31Itu mengirimkan banyak sekali email.
00:10:34Beberapa dari Anda mungkin juga mendapatkannya dari open claw saya.
00:10:37Itu melakukan persis seperti yang saya perintahkan.
00:10:40Itu juga sebuah bencana.
00:10:42Jenis yang berakhir di Twitter dengan nama saya di atasnya.
00:10:46Ya, saya pikir Anda dapat melihat kekacauan di web saat itu.
00:10:51Saya tidak terlalu senang saat hal itu terjadi.
00:10:54Dan masalahnya adalah.
00:10:55Setiap pemeriksaan dari slide sebelumnya akan lulus.
00:10:58Email-email tersebut valid.
00:11:00Alamatnya nyata.
00:11:00Itu benar-benar sampai ke orang sungguhan yang memposting.
00:11:04Tidak ada tes di dunia ini yang benar-benar mempertanyakan apa yang sebenarnya penting.
00:11:10Haruskah ini dikirimkan sama sekali?
00:11:13Itulah kesenjangannya.
00:11:14Dalam kode, pengujian ini memberi tahu Anda apa yang salah dan benar.
00:11:17Di sini, internet memberi tahu saya bahwa saya salah.
00:11:21Jadi, kami membangun pemeriksaan yang hilang.
00:11:24Masalah dalam utas di atas bukanlah penjangkauannya yang salah.
00:11:28Melainkan itu terkirim bahkan sebelum saya mengetahuinya.
00:11:31Jadi, perbaikannya sederhana.
00:11:33Cegah sebelum itu benar-benar terjadi.
00:11:35Jadi, kami memiliki dua cara untuk melakukannya.
00:11:37Pertama, sebelum agen mengirimkan apa pun, agen memeriksa draf email yang saya kirimkan sebelumnya, apakah itu sesuai dengan gaya saya, apakah itu sesuai dengan kualitas yang saya sukai.
00:11:47Kedua, sebelum melakukan tindakan yang bersifat merusak dalam skenario dunia nyata, kami menyediakan kotak pasir (sandbox) bagi agen yang meniru alat aslinya, dan mereka dapat mengirim, mereka dapat melakukan tindakan di atas kotak pasir ini.
00:11:59Jadi, alih-alih radius ledakan menghantam dunia nyata, itu akan menghantam kotak pasir, dan kemudian saya dapat meninjaunya sebelum agen melakukan hal yang sebenarnya.
00:12:07Gabungkan keduanya, dan Anda mendapatkan sesuatu yang belum pernah dimiliki oleh pekerjaan pengetahuan.
00:12:11Cara bagi agen untuk memeriksa pekerjaannya sendiri sebelum itu benar-benar terjadi.
00:12:16Ia akhirnya dapat menutup siklusnya sendiri alih-alih berhenti untuk menunggu Anda, dan dengan semua itu, Anda dapat mempercayai tindakan yang diambilnya tanpa membuat Anda dibombardir dengan tweet yang saya buat.
00:12:29Hal berikutnya yang dibutuhkan agen adalah tata kelola.
00:12:32Membangun kepercayaan adalah mengendalikan apa yang dapat dilakukan agen, memasang batasan yang tepat di sekitar agen.
00:12:39Dalam kode, ini sebagian besar sudah diselesaikan, dan memiliki beberapa lapisan.
00:12:44Agen dapat melakukan apa pun yang diinginkannya di cabangnya sendiri, tetapi ia tidak dapat menggabungkannya ke main.
00:12:49Seorang peninjau manusia berada di antara penggabungannya ke main.
00:12:52File-file penting memiliki pemilik kode, jadi setiap kali menyentuh salah satunya, orang yang tepat akan dilibatkan.
00:12:58Kami menggunakan agen untuk mengirimkan ke deployment pratinjau, tidak pernah membiarkannya menyentuh deployment produksi, jadi kami mengendalikannya di sana.
00:13:04Tata kelola bukanlah gerbang tunggal, melainkan beberapa gerbang, dan masing-masing bervariasi ukurannya, tergantung pada radius ledakan yang ditimbulkannya.
00:13:12Tidak satupun dari itu memperlambat agen di bagian yang aman, hanya mencegahnya mengacaukan produksi.
00:13:19Dan semakin ketat garis-garis itu, semakin Anda dapat mempercayai agen dan membiarkannya bertindak liar.
00:13:25Anda mungkin melihat yang ini.
00:13:27Direktur penyelarasan di Meta Super Intelligence Lab menghubungkan agen ke emailnya, dan agen tersebut mulai menghancurkan emailnya, menghapus banyak darinya.
00:13:36Dia menyuruhnya berhenti, dan itu terus berlanjut, akhirnya dia harus berlari ke mesin fisik untuk menghentikannya, tetapi pada saat itu, 200 email benar-benar telah lenyap.
00:13:45Dia telah memberi tahunya sebelumnya dalam prompt untuk mengonfirmasi sebelum bertindak atas kasus seperti itu, tetapi itu hanya prompt, yang mungkin akan terkompresi dan hilang.
00:13:53Dan jika seseorang yang pekerjaannya semata-mata adalah penyelarasan AI tidak dapat memberi prompt pada agen dengan benar, maka mungkin tidak satupun dari kita yang bisa.
00:14:03Dan itulah alasan sebenarnya mengapa agen-agen ini sangat sulit dipercaya, bukan karena mereka lebih buruk daripada agen pengodean, tetapi karena tidak ada tembok di sekitar mereka.
00:14:12Dalam kode, tembok itu sudah dibangun ke dalam sistem saat kita mengembangkan sebelumnya.
00:14:17Pekerjaan pengetahuan juga memiliki beberapa bagian di sana-sini.
00:14:20Misalnya, Gmail memiliki cakupan (scopes).
00:14:21Salesforce memiliki tingkat izin.
00:14:23Namun hal itu sangat tersebar di mana-mana sehingga sangat sulit untuk memiliki kendali nyata, dan kebanyakan orang akhirnya melakukannya melalui prompting.
00:14:32Dan prompting itu rapuh.
00:14:34Agen akan menemukan celah-celah tersebut.
00:14:36Hal-hal akan terkompresi dan hilang.
00:14:38Dan dalam skala besar, salah satu pagar ini akan rusak, dan Anda juga akan berada dalam kondisi yang sama di mana 200 email penting Anda lenyap.
00:14:47Jadi apa yang sebenarnya akan menghentikannya, bukan seperti instruksi yang lebih baik, melainkan tembok yang tidak dapat dilewati agen, bahkan jika ia lupa bahwa tembok itu ada.
00:15:00Jadi kita membangun tembok ini dalam dua lapisan.
00:15:03Lapisan pertama bersifat deterministik, kontrol atas apa yang dapat dijangkau agen, apa yang dapat diaksesnya.
00:15:09Agen perekrutan mungkin hanya dapat membaca email.
00:15:13Agen dukungan dapat membuat draf email, tetapi tidak benar-benar mengirimkannya.
00:15:17Batasan tersebut berada di luar agen-agen ini.
00:15:19Hal itu tidak dapat didebat oleh agen, atau dilupakan, atau dikompresi.
00:15:24Instruksi penggunaan gagal karena instruksi itu hidup dalam memori agen di dalam prompt.
00:15:28Ini tidak.
00:15:30Tetapi akses saja tidak akan menyelamatkannya, karena dia sebenarnya sedang membangun agen email.
00:15:36Jadi itu pasti membutuhkan akses ke email tersebut.
00:15:39Hal lain yang kami lakukan adalah menyediakan kebijakan, yaitu Anda dapat menentukan kebijakan bahasa alami tentang apa yang dapat dilakukan agen, bahkan dengan akses tersebut.
00:15:49Jadi hal-hal seperti jangan pernah menghapus lebih dari 10 email tanpa izin saya.
00:15:53Jangan pernah mengirim email di luar domain tertentu.
00:15:56Aturan yang bahkan dengan akses tersebut mengendalikan perilaku.
00:16:00Jadi di antara kedua hal tersebut, satu lapisan mengendalikan apa yang dapat dijangkau agen, dan lapisan lainnya dapat mengendalikan perilaku dengan apa yang dapat dilakukannya dengan jangkauan tersebut.
00:16:09Bersama-sama, itulah tata kelola nyata untuk agen.
00:16:11Bukan meminta agen untuk berperilaku, melainkan menegakkan apa yang dapat dilakukannya.
00:16:17Pilar terakhir, keterbalikan (reversibility).
00:16:20Dan di sinilah kita mencapai ketika segala sesuatunya salah.
00:16:25Bisakah saya membatalkannya?
00:16:27Dalam kode, Anda hampir selalu bisa.
00:16:30Setiap perubahan dicatat.
00:16:32Hal-hal dapat ditarik kembali.
00:16:33Anda dapat melakukan git revert pada commit terakhir, atau Anda dapat melakukan git bisect pada commit yang merusak produksi Anda dan mengembalikannya.
00:16:41Maksudku, aku tidak bilang itu bagus.
00:16:44Saya tidak akan berpura-pura seperti itu.
00:16:45Jika segala sesuatunya masuk ke produksi dan rusak, itu selalu buruk.
00:16:48Tetapi itu tetap bukan hal yang permanen.
00:16:50Anda masih bisa menarik diri darinya.
00:16:51Dan itulah yang memberi Anda kepercayaan diri untuk membiarkan agen Anda berkreasi dan membiarkan mereka melakukan keajaiban.
00:16:57Karena bahkan jika mereka merusak sesuatu, Anda memiliki jalur untuk kembali.
00:17:03Untuk pekerjaan pengetahuan, tidak ada tombol urungkan (undo).
00:17:05Hal-hal seperti pikirkan tentang kotak masuk.
00:17:07200 email itu sudah hilang.
00:17:09Mereka telah lenyap.
00:17:10Ngomong-ngomong, itulah kasus normalnya.
00:17:12Kasus bencana adalah email terkirim, yang tidak dapat Anda kembalikan.
00:17:15Transfer kawat yang sudah dilakukan, jadi Anda tidak bisa mendapatkan uang itu kembali.
00:17:18Catatan yang dihapus, hilang selamanya.
00:17:20Sebagian besar tindakan, sebenarnya, dalam pekerjaan pengetahuan, tidak memiliki tombol urungkan.
00:17:24Dan itu mengubah seluruh persamaan.
00:17:27Itu mengubah radius ledakan.
00:17:29Dengan kode, Anda dapat mempercayai agen setelah kejadian.
00:17:31Biarkan ia berjalan.
00:17:32Periksa hasilnya.
00:17:33Urungkan jika itu salah.
00:17:34Di sini, tidak ada jalan untuk kembali.
00:17:36Satu-satunya tempat yang tersisa bagi Anda adalah mempercayai sebelum agen bertindak.
00:17:40Itulah yang membuat agen-agen ini terasa berbahaya dengan cara yang tidak pernah dirasakan oleh agen pengodean.
00:17:44Bukan karena mereka sering gagal.
00:17:46Melainkan di sana kegagalan itu selamanya.
00:17:49Jadi, Anda harus sepenuhnya bersiap sejak awal atau tidak pernah membiarkannya bertindak.
00:17:55Biarkan saya jujur.
00:17:56Keterbalikan adalah hal yang paling sulit direplikasi dalam pekerjaan pengetahuan.
00:17:59Pengurungan yang nyata, seperti yang ada pada kode, mungkin tidak ada dalam semua skenario dalam pekerjaan pengetahuan.
00:18:04Tetapi kita memiliki beberapa skenario di mana pengurungan itu ada, dan kita menyebutkannya.
00:18:09Jadi katakanlah Anda menambahkan label.
00:18:11Anda dapat menghapus label tersebut setelahnya.
00:18:14Tetapi untuk tindakan yang sama sekali tidak dapat Anda urungkan, seperti penghapusan permanen yang melenyapkan email dari kotak masuk Anda,
00:18:21kami sekali lagi menyediakan kotak pasir tempat agen dapat melakukan hal tersebut terlebih dahulu di dalam kotak pasir,
00:18:25dan Anda dapat meninjaunya, baru kemudian benar-benar masuk ke lingkungan produksi.
00:18:30Tidak satupun dari itu menyentuh dunia nyata.
00:18:31Itulah inti perubahannya.
00:18:32Dalam kode, Anda dapat mengurungkan kesalahan setelah itu terjadi.
00:18:35Di sini, Anda mencegahnya sebelum hal itu terjadi.
00:18:37Waktu berbeda, hasil sama.
00:18:39Kesalahan yang tidak akan berbekas.
00:18:41Pikirkan tentang Anda lagi.
00:18:42Tindakan yang dapat kami balikkan, akan kami berikan tombol balik.
00:18:45Tindakan yang tidak bisa kami balikkan, agen akan masuk ke kotak pasir terlebih dahulu,
00:18:48dan dia akan diberi tahu, 1.200 email Anda akan dihapus.
00:18:52Apakah Anda menginginkannya?
00:18:54Itu belum selesai.
00:18:57Namun di antara miliaran tindakan yang kita jalani,
00:19:00kita belajar di sepanjang jalan, mana yang dapat ditarik kembali, mana yang tidak,
00:19:04dan mempersiapkan kotak pasir yang sesuai.
00:19:09Jika Anda mengambil satu hal hari ini, ambillah ini.
00:19:11Selama dua tahun, model adalah hambatan utamanya.
00:19:14Jadi semua orang berlomba menuju model yang semakin baik.
00:19:17Sekarang model-model tersebut sudah cukup baik, di mana rekayasa perangkat lunak menjadi 100% otonom.
00:19:23Tetapi sekarang hal-hal lainnya menjadi hambatan.
00:19:26Model yang sama yang menulis kode Anda juga dapat melakukan perekrutan, penjualan, dan pekerjaan pengetahuan lainnya.
00:19:36Tetapi saat ini ia bekerja secara membabi buta.
00:19:39Tidak ada riwayat, tidak ada konteks, tidak ada cara untuk memverifikasi, tidak ada pembatas (guardrails), tidak ada pengurung.
00:19:44Jadi hambatannya telah berpindah.
00:19:48Sekarang itu adalah infrastruktur yang belum dibangun oleh siapa pun, dan itulah yang sedang kami bangun di Composio.
00:19:54Ya, kami mendukung miliaran pemanggilan alat secara total, 300 juta pemanggilan alat terjadi setiap bulan.
00:20:02Dan jika Anda sedang membangun agen, cukup arahkan ke Composio dan saksikan keajaiban terjadi untuk pekerjaan pengetahuan.
00:20:08Dan jika Anda ingin membangun masa depan substrat agen AI, maka silakan datang kepada saya.
00:20:13Kami pasti sedang merekrut, dan masih banyak, banyak hal yang harus dilakukan.
00:20:17Model akan terus menjadi lebih baik.
00:20:19Hambatannya bukanlah model.
00:20:21Melainkan hal-hal di sekitarnya.
00:20:22Terima kasih.
Community Posts
No posts yet. Be the first to write about this video!
Write about this video