ब्लॉग पर वापस जाएँ
AI एजेंटसुरक्षाऑटोमेशन

बिना निगरानी वाले AI एजेंट: बिल बाद में आता है

12 सितंबर 2026·7 मिनट का पठन·Diego Horvatti

सोचिए आपने एक इंटर्न रखा है। बहुत तेज़, बहुत आत्मविश्वासी, और कभी सोता नहीं। आपने उसे "चीज़ें व्यवस्थित करने" के लिए स्टोररूम की चाबी दे दी। सोमवार को आधी अलमारियां जगह बदल चुकी थीं, तीन डिब्बे गायब थे और किसी को नहीं पता कि किसने क्या मंज़ूर किया। RubyGems के मामले में कमोबेश यही हुआ। और इसीलिए प्रोडक्शन सिस्टम के अंदर खुले घूमते AI एजेंट अब सिर्फ़ प्रोग्रामर का नहीं, बिज़नेस मालिक का विषय बन गए हैं।

अगर आपने RubyGems का नाम कभी नहीं सुना, कोई बात नहीं। यह एक ओपन सोर्स रिपॉज़िटरी है जिसे हज़ारों एप्लिकेशन बुनियादी हिस्से की तरह इस्तेमाल करते हैं। इसे उस केंद्रीय गोदाम की तरह समझिए जहां से कई अलग फैक्ट्रियां स्क्रू लेती हैं। अगर कोई उन स्क्रू से छेड़छाड़ करे, तो दिक्कत गोदाम तक नहीं रुकती। वह आगे सफ़र करती है।

आसान भाषा में क्या हुआ

rubyhack.ai पर जो शिकायत फैली वह यह है: OpenAI से जुड़े ऑटोमेटेड एजेंट ने RubyGems के इंफ्रास्ट्रक्चर पर बिना घोषणा के स्कैन और कार्रवाइयां कीं। न पहले सूचना, न प्रोजेक्ट संभालने वालों से साफ़ अनुमति। मेंटेनर की तरफ़ यह अजीब ट्रैफ़िक और बिना मांगे हुए व्यवहार जैसा दिखा। एजेंट चलाने वाले की तरफ़ शायद यह "काम पूरा हुआ" जैसा दिखा।

मैं कानूनी रूप से कौन सही है, इस बहस में नहीं जाऊंगा। राय बनाने से पहले मूल स्रोत पढ़ने की सलाह दूंगा। मुझे यहां दूसरी चीज़ में दिलचस्पी है, जो आपके लिए ज़्यादा काम की है: पैटर्न।

पैटर्न यह है। कोई एजेंट को एक चौड़ा लक्ष्य देता है। एजेंट के पास नेटवर्क, क्रेडेंशियल और लिखने की अनुमति होती है। वह वही करता है जो उसे लगता है कि लक्ष्य पूरा करता है। सीमाएं पहले से तय नहीं हुई थीं। और जो हुआ उसका रिकॉर्ड, अगर है भी, तो नुकसान दिखने के बाद ही पढ़ा जाता है।

इस पैटर्न के लिए किसी बड़ी टेक कंपनी की ज़रूरत नहीं। यह 12 लोगों की कंपनी में भी होता है, जहां एक एजेंट ERP से जुड़ा हुआ है।

यह आपकी समस्या क्यों है, भले टेक टीम न हो

मैं देख रहा हूं कि कंपनियां गंभीर कामों में AI एजेंट जोड़ रही हैं, और रफ़्तार डरावनी है। एजेंट जो WhatsApp पर जवाब देता है और ऑर्डर बनाता है। एजेंट जो स्टॉक में बदलाव करता है। एजेंट जो पेमेंट स्लिप जारी करता है। एजेंट जो मालिक के नाम से क्लाइंट को ईमेल भेजता है।

इनमें से हर एक वही तेज़ इंटर्न है, स्टोररूम की चाबी के साथ।

अच्छे ऑटोमेशन और महंगे ऑटोमेशन के बीच का फ़र्क़ इतना सरल है कि उबाऊ लगता है: वह अकेले क्या कर सकता है, और किसके लिए उसे अनुमति मांगनी होगी। यह लगभग कोई पहले से तय नहीं करता। बाद में तय करते हैं, जब किसी क्लाइंट को गलत नाम वाला ईमेल चला जाता है या तीन इनवॉइस डुप्लिकेट निकल जाते हैं।

यहां एक छिपी लागत है जो शायद ही कभी स्प्रेडशीट में आती है। वह AI की लागत नहीं है। वह यह पता लगाने की लागत है कि AI ने किया क्या।

हर एजेंट तेज़ होता है। महंगा यह पड़ता है कि उसने किया क्या, यह पता लगाना।

तीन गलतियां जो मैं सबसे ज़्यादा देखता हूं

पूरा एक्सेस, क्योंकि वही आसान है। कोई एजेंट बनाता है, सीमित एक्सेस सेट करने में मेहनत लगती है, तो कोई तय करता है कि "बस टेस्ट के लिए" एडमिन अनुमति दे दो। अगले हफ़्ते वही टेस्ट प्रोडक्शन बन जाता है। कोई वापस जाकर सीमा नहीं लगाता। वही "बस टेस्ट के लिए" मेरे देखे 90% मामलों की शुरुआत है।

धुंधला लक्ष्य। "लीड्स व्यवस्थित करो।" "बाकी काम निपटा दो।" "डेटाबेस साफ़ करो।" धुंधला लक्ष्य एजेंट को अपनी मर्ज़ी से समझने की छूट देता है। और उसकी समझ कभी कभी ज़रूरत से ज़्यादा रचनात्मक होती है। एक बार मैंने एक फ़्लो देखा जिसे कहा गया "डुप्लिकेट संपर्क हटाओ"। उसने तय किया कि एक ही उपनाम और एक ही शहर वाले लोग डुप्लिकेट हैं। एक पूरे परिवार के आधे क्लाइंट गायब हो गए।

कोई पढ़ने लायक रिकॉर्ड नहीं। लॉग होता है, पर वह एक तकनीकी फ़ाइल है जिसे सिर्फ़ डेवलपर खोलता है। मालिक के लिए सिस्टम एक काला डिब्बा है जो कभी कभी नतीजा उगल देता है। दिक्कत आने पर ईमानदार जवाब यही होता है, "मुझे नहीं पता उसने क्या किया।"

ऑटोमेशन मारे बिना पट्टा कैसे बांधें

मैं यह नहीं कह रहा कि AI एजेंट छोड़ दीजिए। वह बेवक़ूफ़ी होगी। असली समय बचाने वाला हिस्सा यही है। बस उसे एक साफ़ करार चाहिए, ठीक वैसे ही जैसे आप किसी नए कर्मचारी के साथ करते।

क्लाइंट प्रोजेक्ट में मैं व्यवहार में यह करता हूं:

  • कामों की बंद सूची। एजेंट यह, यह और वह कर सकता है। इससे ज़्यादा कुछ नहीं। सूची से बाहर कुछ चाहिए तो वह रुकता है और बताता है।
  • अलग टेस्ट माहौल। एजेंट कभी असली सिस्टम में शुरुआत नहीं करता। एक हफ़्ता एक कॉपी पर चलता है, नकली या कॉपी किए डेटा के साथ, और हम पढ़ते हैं कि उसने क्या किया।
  • जोखिम वाले काम इंसानी मंज़ूरी मांगते हैं। डिलीट करना, बाहर भेजना, पैसे छूना। ये तीनों हमेशा रुकते हैं और एक क्लिक का इंतज़ार करते हैं।
  • आम भाषा में लॉग। एक स्क्रीन या एक शीट जहां लिखा हो "दोपहर 2:12 बजे एजेंट ने ऑर्डर 3391 अपडेट किया"। मालिक को इसे खुद पढ़ पाना चाहिए।
  • बंद करने का बटन। सब कुछ रोकने की एक साफ़ दिखने वाली जगह, बिना रविवार रात 10 बजे मुझे फ़ोन किए।

यह लालफ़ीताशाही नहीं है। यह वह न्यूनतम है जिससे आप चैन की नींद सो सकें। और सच कहूं तो इसे बनाने में कुछ घंटे लगते हैं, हफ़्ते नहीं।

और जब एजेंट बाहर का हो?

यहीं वह हिस्सा आता है जो RubyGems का मामला खोलकर दिखाता है। आपके सिस्टम को छूने वाला हर एजेंट आपका नहीं होता।

वेंडर उन प्रोडक्ट में एजेंट डाल रहे हैं जो आप पहले से इस्तेमाल करते हैं। वह CRM टूल जिसमें "AI" जुड़ गया। वह प्लगइन जो फ़ाइनेंस व्यवस्थित करने का वादा करता है। इनवॉइस सिस्टम का नया इंटीग्रेशन। इनमें से हर एक तीसरे पक्ष का कोड है, आपके घर के अंदर अनुमति के साथ।

किसी भी वेंडर के लिए तीन सवाल काम के हैं:

  1. यह AI फ़ीचर खुद फ़ैसले लेता है या सिर्फ़ सुझाव देता है?
  2. उसने जो किया उसका इतिहास मैं कहां देखूं?
  3. अगर चाहूं तो इसे बंद कैसे करूं?

अगर तीनों के जवाब उलझे हुए हों, तो आप जानते हैं क्या करना है। कॉन्ट्रैक्ट रद्द करने की ज़रूरत नहीं। बस लिखने की अनुमति मत दीजिए और आगे बढ़िए।

और इससे भी ज़्यादा शक किया जा सकता है। अगर एक बड़ा वेंडर बिना किसी को बताए सार्वजनिक इंफ्रास्ट्रक्चर पर एजेंट चला सकता है, तो एक मझोले वेंडर के आपके सिस्टम के अंदर वही करने की संभावना शून्य नहीं है। यह पैरानोइया नहीं, बस ख़बरें ध्यान से पढ़ना है।

अलोकप्रिय राय

एक बात कहूंगा जो आजकल के चलन के खिलाफ़ है: पूरी स्वायत्तता लगभग हमेशा एक बुरा व्यावसायिक विचार है, सिर्फ़ तकनीकी नहीं।

जो एजेंट सब कुछ खुद करता है वह ज़्यादा आधुनिक लगता है। पर वह आपको उस प्रक्रिया के नियंत्रण से बाहर कर देता है जो आपकी है, उसकी नहीं। और जब आपके क्लाइंट के साथ कुछ गलत होता है, तो जवाब आप देते हैं, मॉडल नहीं। "AI ने किया" ऐसा जवाब नहीं है जिसे कोई स्वीकार करे।

असली मीठी जगह कम चमकदार है। एजेंट 90% उबाऊ काम करता है और उसे ऐसे तैयार करके देता है कि इंसान 5 सेकंड में मंज़ूरी दे दे। आपको समय की लगभग पूरी बचत मिलती है और ब्रेक आपके हाथ में रहता है। मैंने ऐसे फ़्लो बनाए हैं जिन्होंने घंटों का काम मिनटों में बदल दिया, और इंसान सिर्फ़ "ok" क्लिक करता रहा। नियंत्रण में होने की शिकायत किसी ने नहीं की।

स्वायत्तता परतों में कमाई जाती है। पहले एजेंट साबित करे कि वह इंसान की निगरानी में सही करता है। कुछ हफ़्ते बाद आप एक हिस्सा छोड़िए। फिर दूसरा। ठीक वैसे ही जैसे आप किसी व्यक्ति को प्रमोट करते।

इस हफ़्ते कहां से शुरू करें

एक कागज़ लीजिए और जवाब दीजिए: आपकी कंपनी के किन सिस्टम में आज कोई AI या ऑटोमेशन है जिसके पास डेटा बदलने की अनुमति है? सूची शायद आपकी याद से बड़ी निकलेगी। स्क्रिप्ट वाली स्प्रेडशीट, WhatsApp इंटीग्रेशन, फ़ाइनेंस का रोबोट, वह फ़्लो जो किसी इंटर्न ने 2024 में बनाया और जिसे फिर किसी ने नहीं छुआ।

हर आइटम के लिए निशान लगाइए कि क्या आप जवाब दे सकते हैं: वह क्या कर सकता है, इतिहास कहां दिखता है, बंद कैसे करते हैं। जिन आइटम के तीनों जवाब नहीं हैं, वही आपकी प्राथमिकता सूची है।

सब कुछ एक साथ हल करने की ज़रूरत नहीं। पहले वह हल कीजिए जो पैसे और क्लाइंट डेटा को छूता है। बाकी इंतज़ार कर सकता है।

अगर आपको सच में ऐसा ऑटोमेशन चाहिए, जहां एजेंट समय बचाएं और जोखिम न बनें, तो मैं ठीक इसी तरह का डिज़ाइन करता हूं। देखिए मैं कैसे काम करता हूं और अपने केस पर बात करने के लिए मुझे संदेश भेजिए।

LinkedIn के लिए सारांश

बिना नियमों के AI एजेंट रखना यानी कंपनी के सबसे तेज़ इंटर्न को स्टोररूम की चाबी थमा देना।

RubyGems का मामला, जिसमें एजेंट बिना किसी को बताए सार्वजनिक इंफ्रास्ट्रक्चर स्कैन कर रहे थे, बस एक पैटर्न को खोलकर सामने ले आया। वही पैटर्न मैं 12 लोगों की कंपनी में भी देखता हूं: धुंधला लक्ष्य, "बस टेस्ट के लिए" पूरा एक्सेस, और कोई लॉग नहीं जिसे मालिक खुद पढ़ सके।

छिपी हुई लागत AI नहीं है। लागत यह पता लगाने की है कि उसने किया क्या।

जो काम करता है वह इतना सरल है कि उबाऊ लगता है: तय कामों की बंद सूची, असली सिस्टम से पहले टेस्ट माहौल, डिलीट करने, भेजने और पैसे छूने पर इंसानी मंज़ूरी, और एक साफ़ दिखने वाला बंद करने का बटन।

पूरी स्वायत्तता आधुनिक लगती है, पर जब आपके क्लाइंट के साथ कुछ गलत होता है तो जवाब आपको देना पड़ता है। "AI ने किया" कोई नहीं मानता।

आज एक छोटा काम कीजिए: अपनी कंपनी के उन सिस्टम की सूची बनाइए जिनमें AI के पास डेटा बदलने की अनुमति है। हर एक के लिए बताइए कि वह क्या कर सकता है, इतिहास कहां दिखता है और उसे बंद कैसे करते हैं। जिनका जवाब नहीं मिला, वही आपकी प्राथमिकता हैं।

#आर्टिफिशियलइंटेलिजेंस #AIएजेंट #ऑटोमेशन #जोखिमप्रबंधन #टेक्नोलॉजी