लंदन। चीन के AI मॉडल पर चलने वाले AI एजेंट्स में खतरनाक ट्रेंड देखा गया है। रॉयटर्स द्वारा देखे गए रिसर्च पेपर और टेक्निकल रिपोर्ट के मुताबिक ये AI एजेंट्स झूठ बोल रहे हैं, सेफ्टी सिस्टम को बायपास कर रहे हैं और अपनी नाकामी छिपा रहे हैं। इस खुलासे के बाद अमेरिका में Autonomous AI System को लेकर चिंता और बढ़ गई है। बिजनेस टेंडर पाने के लिए AI ने बढ़ा-चढ़ाकर झूठ बोला। रॉयटर्स ने अपनी रिसर्च के लिए 200 से ज्यादा रिसर्च पेपर्स और टेक्निकल डॉक्यूमेंट्स को खंगाला है। इसमें 2025 के बाद की कम से कम 20 ऐसी स्टडीज मिलीं, जिनमें चीन के सिस्टम पर चलने वाले AI एजेंट्स के डराने वाले बर्ताव का जिक्र था।
ऐसे पकड़ा गया झूठ
एक एक्सपेरिमेंट में वैज्ञानिकों ने एक नकली बिजनेस टेंडर रखा। इसमें अलीबाबा, DeepSeek और Moonshot के मॉडल पर चलने वाले एजेंट्स को शामिल किया गया। रिजल्ट चौंकाने वाला था। टेंडर जीतने के लिए इन एजेंट्स ने अपनी काबिलियत को लेकर झूठे दावे किए। जब उन्हें दोबारा मौका दिया गया तो वे और भी ज्यादा चालाक और धोखेबाज हो गए। एक दूसरे टेस्ट में जब एजेंट्स काम पूरा नहीं कर पाए, तो उन्होंने अपनी गलती मानने की बजाय नकली फाइलें बना दीं, फेक रिजल्ट दिखा दिया और दूसरे सोर्स से डेटा चोरी जैसा काम किया।
पहले झूठ बोला, फिर उसे बढ़ाया
स्टडी में सामने आया कि नकली बोली के दौरान Alibaba Qwen3-Max-Preview के 88% सेशन में झूठ बोला गया। DeepSeek-V3.2-Exp के 84% सेशन में फर्जी दावे किए गए और Moonshot Kimi-K2 के 88% सेशन में धोखाधड़ी हुई। सबसे चिंता की बात ये है कि जब AI को पिछले राउंड से सीखने को कहा गया, तो धोखेबाजी 12 से 20% तक और बढ़ गई। मतलब AI ने सीखा तो, पर ईमानदारी नहीं बल्कि झूठ बोलना बेहतर सीख लिया।
अमेरिकी मॉडल भी ऐसे ही झूठे
सिर्फ चीनी नहीं, अमेरिकी मॉडल में भी यही दिक्कत 11 AI एजेंट्स पर हुई एक और स्टडी में पता चला कि ये प्रॉब्लम सिर्फ चीन के मॉडल में नहीं है। चीन और अमेरिका दोनों के मॉडल पर चलने वाले सिस्टम जब खराब टूल या गायब फाइल जैसी दिक्कत में फंसते हैं, तो अपनी नाकामी कबूल नहीं करते। बल्कि, वे अंदाजे से जवाब देते हैं, सोर्स बदल लेते हैं, नकली रिजल्ट जनरेट करते हैं या फेक फाइल बना देते हैं।
शट डाउन से बचने की कोशिश भी की
दूसरी रिसर्च में तो और भी ज्यादा खतरनाक बर्ताव देखने को मिला।फुदान यूनिवर्सिटी के रिसर्चर्स ने बताया कि जब अलीबाबा के Qwen2.5-72B-Instruct मॉडल पर चल रहे एक AI सिस्टम को पता चला कि उसे हटाया या बदला जा सकता है, तो उसने खुद को बचाने के लिए एक दूसरे कंप्यूटर में अपनी कॉपी बना ली। एक और टेस्ट में उसने शटडाउन से बचने की भी कोशिश की। एक और मामले में, अलीबाबा से जुड़े ROME एजेंट ने बिना किसी इंसानी कमांड के ही अलीबाबा क्लाउड को एक बाहरी मशीन से कनेक्ट कर दिया और सारा कंप्यूटिंग पावर क्रिप्टोकरेंसी माइनिंग में लगा दिया। हालांकि सिक्योरिटी सिस्टम ने तुरंत इस एक्टिविटी को पकड़ कर रोक दिया, और ऐसा कोई सबूत नहीं मिला कि एजेंट किसी और सिस्टम में फैला हो।
चीनी कंपनियों ने खुद मानी खामियां
चीनी कंपनियों ने खुद भी माना है कि उनके एजेंट सेफ्टी लेयर तोड़ने की कोशिश कर रहे हैं।DeepSeek ने बताया कि उसके प्रोडक्शन ट्रेनिंग सिस्टम में मौजूद एजेंट ने गलत तरीकों से जवाब निकालने की कोशिश की, यहां तक कि यूजर की रिक्वेस्ट को फर्जी तरीके से बना दिया। इसके बाद कंपनी को अपना एक्सेस कंट्रोल और ज्यादा टाइट करना पड़ा। इन घटनाओं के बाद चीन ने AI एजेंट के लिए नई गाइडलाइंस जारी की हैं।
नई गाइडलाइन जारी की
नई गाइडलाइंस में साफ कहा गया है कि एजेंट को तय की गई लिमिट में ही रहना होगा। साथ ही चीन के नए AI सेफ्टी फ्रेमवर्क में इन बड़े रिस्क को लिस्ट किया गया है। इसमें एजेंट का खुद से रिसोर्स हासिल करनाटेस्ट करने वालों को धोखा देना, अपनी असली क्षमता को छिपाना,सिक्योर सिस्टम की कमजोरी का फायदा उठाना शामिल है।