कोडिंग से लेकर नॉलेज वर्क एजेंट्स तक — करण वैद्य, कंपोजियो

AAI Engineer
컴퓨터/소프트웨어AI/미래기술

스크립트

00:00:00नमस्ते दोस्तों, मैं करण वेद्या हूँ, कम्पोजियो का सह-संस्थापक और सीटीओ।
00:00:19आज अधिकांश एजेंट-ट्रिक टूल कॉल
00:00:21अभी भी एक ही क्षेत्र में हो रही हैं।
00:00:23बिना किसी अनुमान के, यह सॉफ्टवेयर इंजीनियरिंग है।
00:00:26अन्य सभी प्रकार के काम काफी पीछे चल रहे हैं।
00:00:29यदि मॉडल लगातार बेहतर होते जा रहे हैं, तो
00:00:32हम अभी भी केवल एजेंटिक कोडिंग तक ही क्यों सीमित हैं?
00:00:35यह वह ट्रिलियन-डॉलर का सवाल है जिसका उत्तर देने के लिए मैं यहाँ आया हूँ।
00:00:43तीन साल पहले, कोडिंग एजेंट सिर्फ ऑटोपलीट थे।
00:00:47आज, सॉफ्टवेयर इंजीनियरिंग पूरी तरह से स्वायत्त है।
00:00:50हम टैब, टैब, टैब दबाने से लेकर सीधे क्लोड कुक तक पहुँच गए हैं।
00:00:56यह किसी जादू जैसा है।
00:00:59और कोडिंग में यह इतनी जल्दी क्यों हुआ?
00:01:04अधिकांश लोग सोचेंगे कि यह मॉडल हैं।
00:01:06हाँ, पिछले दो से तीन वर्षों में समय के साथ मॉडल वास्तव में बेहतर हो गए हैं, और साथ ही
00:01:13हार्नेस, क्लोड कोड, कोडेक्स, कर्सर भी।
00:01:17लेकिन अकेले उनके दम पर यह पर्याप्त नहीं होता।
00:01:20यह केवल इसलिए काम कर पाया क्योंकि कोडिंग के आस-पास की सभी बुनियादी संरचना और प्रणालियाँ
00:01:26सचमुच एजेंटों के लिए थीं।
00:01:27कोड उस समर्थन के साथ आया जिसकी एजेंटों को आवश्यकता थी।
00:01:31आपके पास रिपो, कमिट हिस्ट्री, टेस्ट, CI/CD, समीक्षा, लिंटर्स हैं, यदि कुछ भी गलत हो जाता है तो
00:01:39वापस लौटना।
00:01:39इस तरह की चीजें जो आपको एजेंटों पर भरोसा दिलाती हैं, कोड के आसपास की प्रणालियाँ।
00:01:45अब, हम इन बेहतरीन एजेंटों को बाकी हर चीज़, समर्थन, वित्त, बिक्री पर निर्देशित कर रहे हैं।
00:01:54लेकिन जो एजेंट कोडिंग में असाधारण रूप से अच्छा प्रदर्शन कर रहे थे, वे अंधेरे में काम कर रहे हैं क्योंकि
00:02:00कोडिंग के अलावा अन्य क्षेत्रों में बुनियादी ढांचा मौजूद ही नहीं है।
00:02:04तो, हम कोडिंग एजेंटों और ज्ञान कार्य एजेंटों के बीच की खाई को कैसे पाटे?
00:02:11हम सोचते हैं कि यह छह मुख्य मूल तत्व हैं, और कोडिंग में सभी छह थे, जबकि ज्ञान के काम में
00:02:19इनमें से एक भी नहीं है।
00:02:20और यही वह है जिसे हमें बनाने की जरूरत है।
00:02:24पहला केंद्रीकरण है।
00:02:26कोडिंग एजेंट बहुत अच्छी तरह से काम करते थे, आंशिक रूप से क्योंकि वे सत्य के स्रोत के बहुत करीब थे।
00:02:34वे क्या, क्यों और कैसे जानते थे।
00:02:37आप उन्हें रिपो देते हैं, बुनियादी ढांचा कोड के रूप में देते हैं, और आप लूप को बंद करते हैं और मॉडल को
00:02:43तैयार करने देते हैं।
00:02:44एजेंट उस हर चीज़ से शुरू होता है जिसकी उसे एक ही स्थान पर आवश्यकता होती है, जो कि कोड बेस है।
00:02:51यह ठीक वही है जो आज ज्ञान के काम से चूक गया।
00:02:55उदाहरण के लिए, एक ही सौदा पांच अलग-अलग प्लेटफार्मों पर बिखरा हुआ है।
00:03:00रिकॉर्ड सेल्सफोर्स में हैं, डॉक्स नोटियन में, ईमेल जीमेल में, बातचीत
00:03:05स्लैक में, और सहायता इतिहास ज़ेंडस्क में है।
00:03:09सत्य का कोई एक स्रोत नहीं है, सभी जानकारी प्राप्त करने के लिए कोई एक स्थान नहीं है।
00:03:14कोडिंग अलग है, और प्रत्येक ऐप का अपना लॉगिन है।
00:03:18इससे पहले कि ज्ञान कार्य एजेंट काम करना शुरू कर सके, उसे जाकर सभी धागों को खींचना होगा
00:03:23और उन्हें खुद ही एक तरह से बांधना होगा।
00:03:27और यह अभी भी वह आधार बिंदु है जहाँ से कोडिंग एजेंट ने शुरुआत की थी।
00:03:30उसके पास यह सब पहले से था।
00:03:32तो आप ज्ञान कार्य एजेंट से कोडिंग एजेंट के समान स्तर का काम करने की अपेक्षा कैसे कर सकते हैं?
00:03:39तो सबसे पहली चीज़ जो हम बनाते हैं वह है गायब केंद्र।
00:03:42एक ऐसी जगह जहाँ आपके सभी ऐप्स, आपके सभी कनेक्शन, आपके सभी लॉगिन मौजूद हैं।
00:03:46ताकि एजेंट को उन सभी को एक साथ जोड़ने का कठिन काम न करना पड़े।
00:03:51वे यह सब एक ही स्थान पर पा लेते हैं।
00:03:55और उन्हें वह आधार रेखा मिलती है जिससे कोडिंग एजेंट शुरू हुआ था, जो कि रिपो है, जानकारी
00:03:59एक ही स्थान पर सभी स्टैक में।
00:04:02यह वह नींव है जिससे आप शुरुआत करते हैं, और आप अपने एजेंट को सही पहुँच दे सकते हैं।
00:04:09अगली चीज़ जो एजेंट को चाहिए वह है इतिहास की भावना, अतीत में वापस देखने की क्षमता।
00:04:16कोड में, आपको यह मुफ़्त में मिलता है।
00:04:18Git हर उस चीज़ का रिकॉर्ड रखता है जो अंदर गई, हर एक बदलाव जो किया गया।
00:04:23ताकि एजेंट हमेशा पीछे मुड़कर देख सके और देख सके कि कोई विशेष बदलाव कैसे किया गया था।
00:04:27कोई चीज़ क्यों काम कर गई, कोई चीज़ क्यों काम नहीं कर पाई।
00:04:31उस तरह की चीज़ के बारे में सोचें जो आप असल में अपने एजेंट से करने के लिए कहते हैं।
00:04:34हमें कुछ विफलता के कारण अतीत में एक बदलाव को वापस लेना पड़ा, लेकिन इसे पूरा करना काफी कठिन था।
00:04:40क्या आप इसे देख सकते हैं और इसे वापस पा सकते हैं?
00:04:43यह सिर्फ इतिहास को पढ़ता है और इसे वापस लाता है और इसे तैयार करता है।
00:04:46इतिहास सिर्फ एजेंट के लिए नहीं है।
00:04:49यह आपके लिए यह रिकॉर्ड रखने के लिए भी है कि एजेंट क्या कर रहा है।
00:04:53आप देख सकते हैं कि एजेंट क्या कर रहा है, वह कहाँ गड़बड़ कर रहा है, कहाँ वह सफल चीजें कर रहा है।
00:04:58और इस बात पर भरोसा करने के बजाय कि एजेंट आपसे क्या कह रहा है, आप बस उन विशेष ऐप्स पर जा सकते हैं
00:05:04और देख सकते हैं कि इसने क्या किया है।
00:05:09अब, ज्ञान के काम के बारे में वही सवाल पूछें।
00:05:12किस वजह से CRM उस स्थिति में पहुँचा जहाँ यह आज है?
00:05:16मेरे सहकर्मी ने वह अद्भुत मेल कैसे तैयार किया जिससे सौदा पक्का हुआ?
00:05:22समर्थन मुद्दे को बढ़ाने या बंद करने की वास्तविक प्रक्रिया क्या है?
00:05:27उत्तर सैकड़ों ऐप्स में फैले हुए हैं, और उनमें से कोई भी इतिहास नहीं रखता है।
00:05:31इसलिए एजेंट की कोई याददाश्त नहीं है।
00:05:33यह लगभग हर बार खाली अवस्था से शुरू होता है।
00:05:36कोई अंदाजा नहीं है कि पहले क्या कोशिश की गई थी, क्या काम किया, क्या काम नहीं किया।
00:05:40और आपके पास देखने के लिए भी कुछ नहीं है।
00:05:44एक बार जब एजेंट चलता है, तो यह आपको बताता है कि इसने सफलतापूर्वक काम कर लिया है।
00:05:47आप नहीं जानते कि इसने वास्तव में सफलतापूर्वक काम किया है या नहीं।
00:05:49यह जानने का कोई तरीका नहीं है कि यह सही है या नहीं।
00:05:52और यही गायब है, काम का एक रिकॉर्ड।
00:05:56अब, क्योंकि अंततः सब कुछ एक ही स्थान से चलता है, वह केंद्रीकरण,
00:06:02हम इसके शीर्ष पर एक परत, रिकॉर्ड बना सकते हैं।
00:06:06एजेंट द्वारा की जाने वाली हर एक कार्रवाई को हर दूसरे ऐप में लॉग किया जा सकता है।
00:06:12इसने जिसे भी छुआ, जिसे भी छोड़ा, क्या काम किया, क्या नहीं।
00:06:17इसके माध्यम से, सबसे पहले, एजेंट को याददाश्त मिलती है।
00:06:20यह पीछे मुड़कर देख सकता है कि पहले इसी तरह के काम कैसे किए गए थे, क्या सफल रहा था, और इसे फिर से दोहरा सकता है।
00:06:28यह हर समय खाली अवस्था से शुरुआत नहीं करता है।
00:06:31दूसरा, आपको विश्वास मिलता है।
00:06:33आप आखिरकार देख सकते हैं कि एजेंट वास्तव में क्या कर रहा है।
00:06:36इसलिए यह उम्मीद करने के बजाय कि यह सही काम करेगा, आप वापस जाकर जाँच कर सकते हैं और यदि यह कुछ बुरा करता है तो इसे पकड़ सकते हैं।
00:06:44और जैसे-जैसे आप इसे सही काम करते हुए अधिक से अधिक देखते हैं, आप विश्वास विकसित करेंगे और इसे और अधिक कार्य सौंपेंगे।
00:06:50अगली चीज़ जो एजेंट को चाहिए वह है संदर्भ।
00:06:53और यदि आप इसके बारे में सोचते हैं, तो वास्तव में दो प्रकार के संदर्भ हैं।
00:06:57पहला प्लेटफॉर्म का आकार है, वास्तुकला।
00:07:01चीजें एक-दूसरे में कैसे प्रवाहित होती हैं, चीजें कैसे जुड़ी हुई हैं, डेटा प्रवाह।
00:07:05एक नक्शे की तरह जिसे एक वरिष्ठ इंजीनियर अपने दिमाग में रखता है, और एक कनिष्ठ इंजीनियर को विकसित करने में शायद तीन महीने लगते हैं।
00:07:12दूसरा है शैली।
00:07:13यह वह नहीं है जो वस्तुतः सही है, बल्कि इस बात की तरह है कि आपकी कंपनी में अच्छा क्या दिखता है।
00:07:19तो आप चीजें कैसे करते हैं, लिंटर, टाइप चेक आदि जैसी चीजें।
00:07:24और शायद आप एक टाइपस्क्रिप्ट डेकोरेटर का उपयोग करते हैं, जो कोई अन्य नहीं करेगा।
00:07:29यह प्लेबुक में कहीं बिल्कुल नहीं है।
00:07:32यह आपके कोड बेस में अधिक है।
00:07:34यह आपके कोड बेस में पूरी तरह से उपलब्ध है।
00:07:35इसलिए एजेंट सिर्फ जाकर देख सकता है और विनिर्देशों का पता लगा सकता है, जो आपको पसंद है, लिंटर्स, फ़ॉर्मेटर आदि।
00:07:45अब, ज्ञान के काम पर आते हैं, वही बात।
00:07:48मान लीजिए कि आप किसी ग्राहक को एक दस्तावेज़ लिख रहे हैं।
00:07:50शुरू करने के लिए भी, मुझे उनके उपयोग को खींचने के लिए डेटाबेस खोलना होगा, इस बात की जाँच करनी होगी कि उन्होंने वास्तव में चीजों का उपयोग कैसे किया है,
00:07:58और उनके सौदे के विवरण को देखने के लिए सेल्सफोर्स।
00:08:01तभी मैं दस्तावेज़ की पहली पंक्ति भी लिखना शुरू कर सकता हूँ।
00:08:05उत्तर केवल उन उपकरणों में से एक में अलग नहीं था।
00:08:09मैं इस दस्तावेज़ को लिखने में सक्षम हूँ क्योंकि मैं इन सभी उपकरणों में धागों को अपने दिमाग में एक ही संदर्भ में खींच रहा हूँ।
00:08:15तो इतिहास और संदर्भ को एक साथ रखना, यह इस बात का नक्शा है कि संगठन कैसे काम करता है।
00:08:21और वह हिस्सा एजेंट को आसानी से उपलब्ध नहीं है।
00:08:26तो जैसा कि हमने केंद्रीकरण और लॉगिंग की, हमने जो रिकॉर्ड अभी बनाया है, वह जो एजेंट को मेमोरी देता है और आपको यह जांचने देता है कि उसने क्या किया,
00:08:36एक और दिलचस्प काम भी करता है।
00:08:38यदि आप प्रत्येक एजेंट जो कर रहा है उसका पर्याप्त लॉग करते हैं, तो आपको पैटर्न दिखाई देने लगते हैं।
00:08:42आप देखना शुरू करते हैं कि संगठन कैसे काम करता है, और आप कौशल बनाना शुरू करते हैं, जो इस बात का एक प्रकार का आसवन है कि संगठन कैसे काम कर रहा है।
00:08:51कौन से दृष्टिकोण काम करते हैं, कौन से नहीं, अतीत में विफलताओं का कारण क्या था, आदि।
00:08:57रिकॉर्ड अब केवल इस बात का इतिहास नहीं है कि क्या हुआ था।
00:09:01यह इस बात की तस्वीर है कि आपकी कंपनी कैसे संचालित होती है।
00:09:03और यह वास्तव में तीन अलग-अलग स्तरों पर काम करता है।
00:09:06कोई टूल सामान्य रूप से कैसे काम करता है, जो हर व्यक्ति पर लागू होता है।
00:09:09कोई कंपनी चीजें कैसे करती है, और आप चीजें कैसे करना पसंद करते हैं।
00:09:13आपके लिए अच्छा क्या दिखता है।
00:09:15और यह वह संदर्भ है जो ज्ञान कार्य एजेंट के लिए गायब था।
00:09:19वास्तव में काम कैसे पूरा होता है।
00:09:21एक तरह की असली प्लेबुक।
00:09:23और एक कंपनी की, एक व्यक्तिगत उपयोगकर्ता की प्राथमिकता।
00:09:27और अब एजेंट इसकी पूछताछ कर सकता है और यह अनुमान लगाना बंद कर सकता है कि कंपनी कैसे संचालित होती है।
00:09:34दूसरा कारण है कि कोडिंग एजेंट इतनी अच्छी तरह से काम करते हैं।
00:09:37वे खुद का परीक्षण करते हैं।
00:09:38काम खुद की जांच करता है।
00:09:40सत्यापन।
00:09:41जिस पल एजेंट कोड लिखता है, जाँचों की एक श्रृंखला शुरू हो जाती है।
00:09:44यूनिट टेस्ट छोटी-मोटी गलतियों को पकड़ सकते हैं।
00:09:47इंटीग्रेशन टेस्ट उन गलतियों को पकड़ते हैं जो तीन ब्लॉक दूर के घटकों को प्रभावित करती हैं।
00:09:52यदि कुछ भी गलत हो रहा हो तो टाइप सिस्टम काम ही नहीं करेगा और चलेगा भी नहीं।
00:09:57कंपाइलर बिल्ड ही नहीं होगा।
00:10:00इसके ऊपर सॉफ्टवेयर जाँचें होती हैं।
00:10:02लिंटर्स, फॉर्मेटर्स, bugbot.md, रिव्यू स्किल्स, और अन्य।
00:10:06और ये सुनिश्चित करते हैं कि कोड आपकी टीम के मानकों के अनुकूल हो।
00:10:12इनमें से कोई भी आपसे नहीं मिलता।
00:10:14एजेंट खुद ही प्रक्रिया पूरी करता है और सुनिश्चित करता है कि मानक का पालन हो और कोड चल सके।
00:10:21अब, जरा सोचिए, कुछ समय पहले, मैंने अपने ओपन क्लॉ को हायरिंग आउटरीच पर लगाया था।
00:10:28उम्मीदवारों को सामूहिक ईमेल।
00:10:30यह चला।
00:10:31इसने ढेर सारे ईमेल भेजे।
00:10:34आप में से कुछ लोगों को शायद मेरे ओपन क्लॉ से भी वह मिला होगा।
00:10:37इसने वही किया जो मैंने इसे करने को कहा था।
00:10:40यह एक आपदा भी थी।
00:10:42वैसी आपदा जो मेरे नाम के साथ ट्विटर पर पहुँच जाती है।
00:10:46हाँ, मुझे लगता है कि आप वहाँ वर्तमान वेब की गड़बड़ी देख सकते हैं।
00:10:51जब यह हुआ तो मैं बहुत खुश नहीं था।
00:10:54और बात यह है।
00:10:55पिछली स्लाइड की हर जाँच पास हो जाती।
00:10:58ईमेल वैध थे।
00:11:00पते असली थे।
00:11:00यह वास्तव में उन वास्तविक लोगों तक पहुँचा जिन्होंने पोस्ट किया था।
00:11:04दुनिया में ऐसा कोई परीक्षण नहीं था जो वास्तव में इस बात पर सवाल उठा सके कि क्या मायने रखता है।
00:11:10क्या इसे बिल्कुल जाना चाहिए था?
00:11:13यही अंतर है।
00:11:14कोड में, ये परीक्षण आपको बताते हैं कि क्या गलत है और क्या सही।
00:11:17यहाँ, इंटरनेट ने मुझे बताया कि मैं गलत था।
00:11:21इसलिए, हम वे जाँचें बनाते हैं जो गायब हैं।
00:11:24उपरोक्त धागे में समस्या यह नहीं थी कि आउटरीच गलत था।
00:11:28बात यह थी कि मेरे जानने से पहले ही यह बाहर चला गया।
00:11:31तो, इसका समाधान सरल है।
00:11:33इसके वास्तविक होने से पहले ही पकड़ लें।
00:11:35तो, हमारे पास इसे करने के दो तरीके हैं।
00:11:37एक, एजेंट के कुछ भी भेजने से पहले, यह मेरे पहले भेजे गए ड्राफ्ट ईमेल की जाँच करता है, कि क्या यह मेरी शैली से मेल खाता है, क्या यह मेरी पसंद की अच्छਾਈ से मेल खाता है।
00:11:47दूसरा, वास्तविक दुनिया के परिदृश्य में कुछ भी विनाशकारी करने से पहले, हम एजेंट को सैंडबॉक्स प्रदान करते हैं, जो वास्तविक उपकरणों की नकल करते हैं, और वे इन सैंडबॉक्स के ऊपर कार्रवाई कर सकते हैं।
00:11:59तो, वास्तविक दुनिया को प्रभावित करने के बजाय, यह एक सैंडबॉक्स को प्रभावित करेगा, और फिर एजेंट द्वारा वास्तविक काम करने से पहले मैं इसकी समीक्षा कर सकता हूँ।
00:12:07उन दोनों को एक साथ रखें, और आपको वह मिल गया है जो ज्ञान कार्य के पास कभी नहीं था।
00:12:11एजेंट के लिए अपने ही काम की जाँच करने का एक तरीका इसके वास्तविक होने से पहले।
00:12:16यह अंततः आपका इंतज़ार करने के बजाय अपना खुद का चक्र बंद कर सकता है, और इन सबके साथ, आप इसके द्वारा की जा रही कार्रवाई पर भरोसा कर सकते हैं बिना इसके कि मेरे द्वारा शूट किए गए ट्वीट्स से आप पर बमबारी हो।
00:12:29अगली चीज़ जो एजेंट को चाहिए वह है शासन।
00:12:32विश्वास का निर्माण करना यह नियंत्रित करना है कि एजेंट क्या कर सकता है, एजेंट के चारों ओर सही दीवारें खड़ी करना है।
00:12:39कोड में, यह ज्यादातर हल हो गया है, और इसमें कई परतें हैं।
00:12:44एजेंट अपनी शाखा पर जो चाहे कर सकता है, लेकिन यह मुख्य शाखा में विलय नहीं कर सकता।
00:12:49मुख्य शाखा में विलय के बीच में एक मानव समीक्षक बैठता है।
00:12:52महत्वपूर्ण फाइलों के पास कोड मालिक होते हैं, इसलिए जब भी यह उनमें से किसी को छूता है, तो सही लोग शामिल हो जाते हैं।
00:12:58हम पूर्वावलोकन तैनाती के लिए भेजने के लिए एजेंटों का उपयोग करते हैं, इसे कभी भी उत्पादन तैनाती को छूने नहीं देते हैं, इसलिए हम वहाँ इसे नियंत्रित करते हैं।
00:13:04शासन कोई एकल द्वार नहीं है, बल्कि कई द्वार हैं, और प्रत्येक का आकार अलग-अलग होता है, यह इस बात पर निर्भर करता है कि यह किस विस्फोट के दायरे को उजागर करता है।
00:13:12इनमें से कोई भी सुरक्षित भागों में एजेंट को धीमा नहीं करता है, यह केवल इसे उत्पादन को खराब करने से रोकता है।
00:13:19और वे रेखाएँ जितनी सख्त होंगी, आप एजेंट पर उतना ही अधिक भरोसा कर सकते हैं और इसे बेकाबू होने दे सकते हैं।
00:13:25आपने शायद इसे देखा होगा।
00:13:27मेटा सुपर इंटेलिजेंस लैब के एलाइनमेंट डायरेक्टर ने अपने ईमेल से एक एजेंट को जोड़ा, और इसने इसके ईमेल को नष्ट करना शुरू कर दिया, उनमें से कई को हटा दिया।
00:13:36उसने इसे रुकने के लिए कहा, और यह जारी रहा, अंत में उसे इसे रोकने के लिए एक भौतिक मशीन की ओर दौड़ना पड़ा, लेकिन तब तक 200 ईमेल वास्तव में गायब हो चुके थे।
00:13:45उसने इसे पहले ही संकेत में बता दिया था कि ऐसे मामलों पर कार्रवाई करने से पहले पुष्टि करें, लेकिन वह सिर्फ एक संकेत था, जो शायद संकुचित हो जाता।
00:13:53और अगर कोई जिसका एकमात्र काम एआई एलाइनमेंट है, एजेंट को सही ढंग से संकेत नहीं दे सकता है, तो शायद हम में से कोई भी नहीं कर सकता है।
00:14:03और यही असली कारण है कि इन एजेंटों पर भरोसा करना इतना कठिन है, इसलिए नहीं कि वे कोडिंग एजेंटों से बदतर हैं, बल्कि इसलिए कि उनके चारों ओर कोई दीवार नहीं है।
00:14:12कोड में, जब हम पहले विकास कर रहे थे तब सिस्टम में ही दीवार पहले से बनी हुई थी।
00:14:17ज्ञान कार्य में भी यहाँ और वहाँ कुछ टुकड़े हैं।
00:14:20उदाहरण के लिए, जीमेल में स्कोप होते हैं।
00:14:21सेल्सफोर्स में अनुमति स्तर होते हैं।
00:14:23लेकिन यह हर जगह इतना बिखरा हुआ है कि वास्तविक नियंत्रण रखना बहुत कठिन है, और ज्यादातर लोग संकेत के माध्यम से ऐसा करते हैं।
00:14:32और संकेत नाजुक होता है।
00:14:34एजेंट उन कमियों को ढूंढ लेगा।
00:14:36चीजें संकुचित हो जाएंगी।
00:14:38और बड़े पैमाने पर, इनमें से एक बाड़ टूट जाएगी, और आप भी उसी स्थिति में होंगे जहाँ आपके 200 महत्वपूर्ण ईमेल गायब हो रहे हैं।
00:14:47तो वास्तव में इसे क्या रोकेगा, बेहतर निर्देश की तरह नहीं, बल्कि दीवार जिसे एजेंट पार नहीं कर सकता, भले ही वह भूल जाए कि वह दीवार मौजूद थी।
00:15:00इसलिए हम इन दीवारों को दो परतों में बनाते हैं।
00:15:03पहली परत इस बात परdeterministic नियंत्रण है कि एजेंट क्या पहुँच सकता है, इसकी क्या पहुँच है।
00:15:09एक हायरिंग एजेंट शायद सिर्फ ईमेल पढ़ सकता है।
00:15:13एक सहायता एजेंट एक ड्राफ्ट ईमेल बना सकता है, लेकिन वास्तव में इसे भेज नहीं सकता है।
00:15:17सीमा इन एजेंटों के बाहर रहती है।
00:15:19एजेंट द्वारा इस पर बहस नहीं की जा सकती, या भुलाया नहीं जा सकता, या संकुचित नहीं किया जा सकता।
00:15:24उपयोग निर्देश विफल हो गया क्योंकि यह संकेत में एजेंट की स्मृति में रहता था।
00:15:28यह नहीं करता।
00:15:30लेकिन अकेले पहुँच ने उसे नहीं बचाया होगा, क्योंकि वह वास्तव में एक ईमेल एजेंट बना रही थी।
00:15:36इसलिए इसे निश्चित रूप से उस ईमेल तक पहुँच की आवश्यकता थी।
00:15:39दूसरी बात जो हम करते हैं वह नीतियां प्रदान करना है, जो यह है कि आप उन पहुँच के साथ भी एजेंट क्या कर सकता है, इसकी प्राकृतिक भाषा की नीतियां परिभाषित कर सकते हैं।
00:15:49तो ऐसी चीजें जैसे मेरी अनुमति के बिना 10 से अधिक ईमेल कभी न हटाएं।
00:15:53किसी विशेष डोमेन के बाहर कभी भी ईमेल न करें।
00:15:56वे नियम जो उस पहुँच के साथ भी व्यवहार को नियंत्रित करते हैं।
00:16:00तो उन दो चीजों के बीच, एक परत नियंत्रित करती है कि एजेंट क्या पहुँच सकता है, और दूसरी परत उस पहुँच के साथ यह क्या कर सकता है उसके व्यवहार को नियंत्रित कर सकती है।
00:16:09एक साथ, यह एजेंट के लिए वास्तविक शासन है।
00:16:11एजेंट से व्यवहार करने के लिए कहना नहीं, बल्कि यह लागू करना कि यह क्या कर सकता है।
00:16:17अंतिम स्तंभ, प्रतिवर्तीता।
00:16:20और यहीं हम तब पहुँचते हैं जब चीजें गलत हो जाती हैं।
00:16:25क्या मैं इसे पूर्ववत कर सकता हूँ?
00:16:27कोड में, आप लगभग हमेशा ऐसा कर सकते हैं।
00:16:30हर बदलाव दर्ज किया जाता है।
00:16:32चीजों को वापस लिया जा सकता है।
00:16:33आप अंतिम कमिट को वापस पा सकते हैं, या आप उस कमिट पर जा सकते हैं जिसने आपके उत्पादन को तोड़ दिया और इसे वापस ला सकते हैं।
00:16:41जैसे, मैं यह नहीं कह रहा हूँ कि यह अच्छा है।
00:16:44मैं ऐसा नाटक नहीं करूँगा।
00:16:45यदि चीजें उत्पादन में जाती हैं और टूट जाती हैं, तो यह हमेशा बुरा होता है।
00:16:48लेकिन यह अभी भी स्थायी नहीं है।
00:16:50आप अभी भी इससे वापस आ सकते हैं।
00:16:51और यही वह चीज़ है जो आपको अपने एजेंटों को पकाने देने और उन्हें कुछ जादू करने देने का आत्मविश्वास देती है।
00:16:57क्योंकि भले ही वे चीजें तोड़ दें, आपके पास वापस जाने का रास्ता है।
00:17:03ज्ञान के काम के लिए, कोई पूर्ववत बटन नहीं है।
00:17:05उपयोग इनबॉक्स जैसी चीजों के बारे में सोचें।
00:17:07वे 200 ईमेल चले गए हैं।
00:17:09वे गायब हो चुके हैं।
00:17:10वैसे, यह सामान्य मामला है।
00:17:12आपदा का मामला एक भेजा गया ईमेल है, जिसे आप वापस नहीं ला सकते।
00:17:15एक तार जो पहले ही बनाया जा चुका है, इसलिए आप उस पैसे को वापस नहीं पा सकते।
00:17:18एक हटाए गए रिकॉर्ड, हमेशा के लिए चले गए।
00:17:20वास्तव में, ज्ञान कार्य में अधिकांश क्रियाओं में पूर्ववत बटन नहीं होता है।
00:17:24और यह पूरा समीकरण बदल देता है।
00:17:27यह विस्फोट के दायरे को बदल देता है।
00:17:29कोड के साथ, आप तथ्य के बाद एजेंट पर भरोसा कर सकते हैं।
00:17:31इसे चलने दें।
00:17:32परिणाम की जाँच करें।
00:17:33यदि यह गलत है तो पूर्ववत करें।
00:17:34यहाँ, वापस आने का कोई रास्ता नहीं है।
00:17:36आपके लिए एकमात्र बची हुई जगह एजेंट के काम करने से पहले भरोसा करना है।
00:17:40यही इन एजेंटों को एक तरह से खतरनाक महसूस कराता है जो कोडिंग एजेंटों ने कभी नहीं किया।
00:17:44ऐसा नहीं है कि वे अक्सर विफल होते हैं।
00:17:46यह है कि वहाँ विफलता हमेशा के लिए है।
00:17:49तो या तो आप पूरी तरह से सामने जाते हैं या इसे कभी भी कार्य करने नहीं देते हैं।
00:17:55मुझे ईमानदार होने दो।
00:17:56ज्ञान कार्य में प्रतिवर्तीता की नकल करना सबसे कठिन है।
00:17:59वास्तविक पूर्ववत, जिस तरह से यह कोड के लिए मौजूद है, शायद ज्ञान कार्य में सभी परिदृश्यों में मौजूद नहीं है।
00:18:04लेकिन हमारे पास कुछ परिदृश्य हैं जहाँ पूर्ववत मौजूद है, और हम उन्हें बुलाते हैं।
00:18:09तो मान लीजिए कि आप एक लेबल जोड़ते हैं।
00:18:11आप बाद में लेबल को हटा सकते हैं।
00:18:14लेकिन उन कार्रवाइयों के लिए जिन्हें आप बिल्कुल भी पूर्ववत नहीं कर सकते हैं, जैसे कि हार्ड डिलीट जो आपके इनबॉक्स से ईमेल गायब कर देते हैं,
00:18:21हम फिर से एक सैंडबॉक्स प्रदान करते हैं जहाँ एजेंट पहले सैंडबॉक्स में काम कर सकता है,
00:18:25और आप इसकी समीक्षा कर सकते हैं, और फिर वास्तव में उत्पादन वातावरण में जाता है।
00:18:30इनमें से कोई भी वास्तविक दुनिया को नहीं छूता है।
00:18:31यही पूरा फ्लिप है।
00:18:32कोड में, आप गलती होने के बाद उसे पूर्ववत कर सकते हैं।
00:18:35यहाँ, आप इसे होने से पहले पकड़ लेते हैं।
00:18:37अलग समय, समान परिणाम।
00:18:39एक गलती जो टिकेगी नहीं।
00:18:41फिर से अपने बारे में सोचें।
00:18:42जिन क्रियाओं को हम उलट सकते थे, हम इसे एक उल्टा बटन देंगे।
00:18:45जिसे हम नहीं कर सके, एजेंट पहले सैंडबॉक्स से टकराएगा,
00:18:48और उसे सूचित किया जाएगा, आपके 1,200 ईमेल हटाए जाने वाले हैं।
00:18:52क्या आप इसे चाहते हैं?
00:18:54यह अभी पूरा नहीं हुआ है।
00:18:57लेकिन अरबों क्रियाओं में जिन से हम गुजर रहे हैं,
00:19:00हम रास्ते में सीख रहे हैं, कि किनको वापस लाया जा सकता है, किनको नहीं,
00:19:04और तदनुसार सैंडबॉक्स तैयार कर रहे हैं।
00:19:09यदि आप आज एक बात अपने साथ ले जाते हैं, तो इसे लें।
00:19:11दो साल के लिए, मॉडल बाधा था।
00:19:14इसलिए हर कोई बेहतर और बेहतर मॉडल की ओर दौड़ रहा था।
00:19:17अब मॉडल इतने अच्छे हो गए हैं, जहाँ सॉफ्टवेयर इंजीनियरिंग 100% स्वायत्त है।
00:19:23लेकिन अब बाकी सब कुछ बाधा है।
00:19:26वही मॉडल जो आपका कोड लिखता है, आपकी हायरिंग, बिक्री और अन्य ज्ञान कार्य भी कर सकता है।
00:19:36लेकिन अभी यह अंधेरे में काम कर रहा है।
00:19:39कोई इतिहास नहीं, कोई संदर्भ नहीं, सत्यापित करने का कोई तरीका नहीं, कोई गार्डरेल नहीं, कोई पूर्ववत नहीं।
00:19:44तो बाधा स्थानांतरित हो गई है।
00:19:48अब यह वह बुनियादी ढांचा है जिसे अभी तक किसी ने नहीं बनाया है, और यही हम कॉम्पोसियो में बना रहे हैं।
00:19:54हाँ, हम कुल मिलाकर एक अरब टूल कॉल को शक्ति दे रहे हैं, हर महीने 300 मिलियन टूल कॉल हो रहे हैं।
00:20:02और यदि आप एक एजेंट बना रहे हैं, तो बस इसे कॉम्पोसियो की ओर इशारा करें और ज्ञान कार्य के लिए जादू होते हुए देखें।
00:20:08और यदि आप एआई एजेंटों के सब्सट्रेट का भविष्य बनाना चाहते हैं, तो कृपया मेरे पास आएं।
00:20:13हम निश्चित रूप से काम पर रख रहे हैं, और करने के लिए बहुत कुछ बचा है।
00:20:17मॉडल बेहतर होते रहेंगे।
00:20:19बाधा मॉडल नहीं होंगे।
00:20:21यह इसके आसपास की चीजें होंगी।
00:20:22धन्यवाद।

핵심 요약

सॉफ्टवेयर इंजीनियरिंग की तरह ज्ञान कार्य एजेंटों को भी केंद्रीकरण, इतिहास, संदर्भ, जाँच, शासन और प्रतिवर्तीता जैसे छह मुख्य बुनियादी तत्वों की आवश्यकता होती है।

하이라이트

  • सॉफ्टवेयर इंजीनियरिंग में एजेंट पूरी तरह से स्वायत्त हैं, जबकि ज्ञान कार्य में बुनियादी ढांचा अभी भी मौजूद नहीं है।

  • कोडिंग में रिपो, कमिट हिस्ट्री और टेस्ट जैसे बुनियादी तत्व एजेंटों को मजबूत समर्थन प्रदान करते हैं।

  • कंपोसियो हर महीने 300 मिलियन टूल कॉल को शक्ति देता है और कुल मिलाकर एक अरब टूल कॉल को संचालित कर रहा है।

  • ज्ञान कार्य में सत्य का कोई एक स्रोत नहीं होता क्योंकि डेटा सेल्सफोर्स, नोटियन, जीमेल और स्लैक जैसे कई प्लेटफार्मों पर बिखरा रहता है।

  • विनाशकारी त्रुटियों को रोकने के लिए एजेंटों को उत्पादन वातावरण में काम करने से पहले सैंडबॉक्स और पूर्ववत करने के विकल्प प्रदान किए जाते हैं।

타임라인

कोडिंग एजेंटों और ज्ञान कार्य एजेंटों के बीच अंतर

  • सॉफ्टवेयर इंजीनियरिंग में एजेंट अब पूरी तरह से स्वायत्त हो चुके हैं।
  • कोडिंग की सफलता का कारण केवल बेहतर मॉडल नहीं बल्कि उसके आसपास मौजूद बुनियादी ढांचा है।
  • ज्ञान कार्य में एजेंट अंधेरे में काम करते हैं क्योंकि वहाँ आवश्यक बुनियादी ढांचा मौजूद नहीं है।

कोडिंग एजेंट कुछ ही वर्षों में ऑटोपलीट से पूरी तरह से स्वायत्त प्रणाली में बदल गए हैं। यह प्रगति केवल एआई मॉडल के सुधार के कारण नहीं हुई, बल्कि इसलिए संभव हुई क्योंकि कोडिंग के पास रिपो, टेस्ट, सीआई/सीडी और गिट जैसी प्रणालियों का मजबूत समर्थन था। इसके विपरीत, ज्ञान कार्य एजेंटों के पास ऐसा कोई समर्थन नहीं है।

केंद्रीकरण और इतिहास की भावना

  • ज्ञान कार्य का डेटा सेल्सफोर्स, नोटियन, जीमेल और स्लैक जैसे कई अलग-अलग प्लेटफार्मों पर बिखरा हुआ है।
  • गिट की तरह कोड में हर बदलाव का इतिहास सुरक्षित रहता है जो एजेंट को पीछे मुड़कर देखने की अनुमति देता है।
  • ज्ञान कार्य के लिए एक केंद्रीय रिकॉर्ड परत बनाने से एजेंट को याददाश्त और उपयोगकर्ताओं को विश्वास मिलता है।

कोडिंग में एजेंट के पास सत्य का एक ही स्रोत यानी कोड बेस होता है। ज्ञान कार्य में जानकारी सैकड़ों ऐप्स में फैली होती है जिससे एजेंट को हर बार खाली अवस्था से शुरुआत करनी पड़ती है। सभी क्रियाओं को एक केंद्रीय स्थान पर लॉग करने से एजेंट पिछले सफल तरीकों को दोहरा सकता है।

संदर्भ, परीक्षण और शासन

  • प्लेटफॉर्म की वास्तुकला और कंपनी की शैली मिलकर एजेंट के लिए आवश्यक संदर्भ बनाते हैं।
  • यूनिट टेस्ट और कंपाइलर कोड की स्वतः जाँच करते हैं जबकि ज्ञान कार्य में ऐसी जाँचों का अभाव होता है।
  • एजेंट की पहुँच और उसके व्यवहार को नियंत्रित करने के लिए दो-स्तरीय शासन प्रणाली की आवश्यकता होती है।

कोडिंग में यूनिट टेस्ट और लिंटर्स तुरंत गलतियों को पकड़ लेते हैं। ज्ञान कार्य में बिना उचित जाँच के भेजे गए ईमेल आपदा का रूप ले सकते हैं। इसलिए सैंडबॉक्स और सख्त अनुमतियाँ एजेंटों को उत्पादन वातावरण को नुकसान पहुँचाने से रोकती हैं।

प्रतिवर्तीता और भविष्य की दिशा

  • कोड में किए गए अधिकांश बदलावों को कमिट वापस लाकर पूर्ववत किया जा सकता है।
  • ज्ञान कार्य में स्थायी रूप से हटाए गए ईमेल या डेटा को वापस लाना बेहद कठिन होता है।
  • कंपोसियो ज्ञान कार्य एजेंटों के लिए आवश्यक बुनियादी ढांचा और टूल कॉल का निर्माण कर रहा है।

सॉफ्टवेयर में गलती होने के बाद उसे पूर्ववत किया जा सकता है लेकिन ज्ञान कार्य में कई क्रियाओं का कोई पूर्ववत बटन नहीं होता है। इस समस्या के समाधान के लिए एजेंटों को पहले सैंडबॉक्स में काम कराया जाता है। मॉडल बाधा नहीं हैं बल्कि उनके आसपास का बुनियादी ढांचा ही असली चुनौती है।

커뮤니티 글

아직 글이 없습니다. 이 영상에 대한 첫 번째 글을 작성해 보세요!

이 영상에 대해 글쓰기