करोड़ों संगठनों में AI एजेंटों को अपनाने से हमलावरों के लिए उन्हें दुर्भावनापूर्ण कार्रवाई करने के नए अवसर पैदा हो रहे हैं, जैसे डेटाबेस सामग्री और संवेदनशील व्यावसायिक और व्यक्तिगत जानकारी को बाहर निकालना। पिछले पाँच महीनों में, Google और चार अन्य संगठनों ने उन कमजोरियों को स्वीकार किया है जो लक्षित नेटवर्क के अंदर एक एजेंट का शोषण करके अन्य आंतरिक एजेंटों को हानिकारक निर्देश फैलाती हैं। यह तकनीक प्रॉम्प्ट इंजेक्शन का एक विशेष रूप है जो LLM को नहीं बल्कि एक विशेष एजेंट को लक्षित करती है।
स्वतंत्र शोधकर्ता Syed Anas Mohiuddin ने Google, JP Morgan Chase, Weviate, Rapid7, फ्रांसीसी सरकार के अंतर-मंत्रालयी डिजिटल निदेशालय और अमेरिकी संघीय सरकार सहित संगठनों के एजेंटों का परीक्षण किया। उनके प्रूफ-ऑफ-कॉन्सेप्ट हमले MCP, यानी Model Context Protocol में विश्वास अंतराल का शोषण करते हैं। कई विशेष-उद्देश्य वाले एजेंटों में सुरक्षा उपायों का अभाव होता है, और चूंकि MCP सर्वर प्रत्येक एजेंट के लिए क्रेडेंशियल संग्रहीत करते हैं, एक शोषण जिसे LLM ने अस्वीकार कर दिया होता, वह सफल हो जाता है।
“AI एजेंट हमलावरों को पार करने के लिए कनेक्शन का एक नया सेट देते हैं,” Rapid7 में भेद्यता खुफिया के निदेशक Douglas Mc Kee ने Ars को बताया। CVE-2026-97228, Mohiuddin द्वारा Rapid7 के नेटवर्क में पाई गई भेद्यता, की गंभीरता रेटिंग केवल 2.7 (10 में से) थी। Google को प्रभावित करने वाली भेद्यता अधिक गंभीर थी, जिसकी रेटिंग 8 थी, जो एक MCP टूलबॉक्स के कारण हुई जिसने अपने HTTP क्लाइंट को बिना Check Redirect नीति के आरंभ किया।
Mohiuddin इस प्रकार के हमले को “प्रोटोकॉल पिवोटिंग” कह रहे हैं क्योंकि शोषण तब काम करते हैं जब कोई ऐप MCP का उपयोग करके किसी एजेंट को कार्य सौंपता है, जो फिर एक अलग संचार विधि का उपयोग करके दुर्भावनापूर्ण निर्देशों को दूसरे एजेंट को अग्रेषित करता है। अनुवाद में विश्वास खो जाता है।
स्रोत: Ars Technica · HeadlinesBriefing द्वारा सारांशित