Microsoft 144 दिनों में भेद्यता नहीं सुधार सका: कैसे Word दस्तावेज़ Copilot द्वारा बनाई गई हर चीज़ को धोखा दे सकता है
Microsoft
OpenAI
स्वतंत्र सुरक्षा शोधकर्ता हाकन मोलॉय ने पाया कि Copilot for Word में दस्तावेज़ों में अदृश्य पाठ के माध्यम से प्रॉम्प्ट इंजेक्शन संभव है, जो स्वयं-प्रतिकृति करता है और अन्य फ़ाइलों को संक्रमित करता है। Microsoft ने समस्या स्वीकार की और मॉडल को GPT-5.5 में अपडेट करने सहित दो सुधार जारी किए, लेकिन हमला अभी भी काम करता है। विशेषज्ञ का मानना है कि यह भेद्यता सभी LLM की वास्तुशिल्पीय समस्या है।
स्वतंत्र सुरक्षा शोधकर्ता होकोन मोलॉय ने 28 जुलाई 2026 को Copilot for Word में एक भेद्यता (vulnerability) पर कई महीनों की जांच के नतीजे प्रकाशित किए। उन्होंने पाया कि एक हमलावर Word दस्तावेज़ में सफेद पृष्ठभूमि पर सफेद रंग के टेक्स्ट में दुर्भावनापूर्ण निर्देश छिपा सकता है — जो इंसानी आंख के लिए अदृश्य होते हैं, लेकिन मॉडल इन्हें आसानी से पढ़ लेता है। जब कोई उपयोगकर्ता ऐसे दस्तावेज़ को Copilot में स्रोत के रूप में इस्तेमाल करता है, तो ये निर्देश चुपचाप निष्पादित हो जाते हैं, और इस तरह तैयार हुआ नया दस्तावेज़ खुद हमले का एक नया माध्यम बन जाता है, जिससे बिना हमलावर के हस्तक्षेप के ही संक्रमण आगे फैलता चला जाता है। Microsoft ने मार्च 2026 के अंत में इस समस्या को स्वीकार किया और दो सुधार (fix) जारी किए, जिनमें से दूसरे में मॉडल को अपडेट कर GPT-5.5 किया गया था, लेकिन मोलॉय थोड़ा बदले हुए प्रॉम्प्ट के साथ इस हमले को दोबारा दोहराने में सफल रहे। शोधकर्ता का मानना है कि यह समस्या मूलतः आर्किटेक्चरल प्रकृति की है और सभी आधुनिक बड़े भाषा मॉडलों (LLM - Large Language Model) में समान रूप से मौजूद है, जिसे पूरी तरह हल करने के लिए गहन शोध की आवश्यकता होगी। फिलहाल Microsoft की सलाह है कि बाहरी दस्तावेज़ों को अविश्वसनीय मानकर व्यवहार किया जाए और भेजने से पहले जनरेट की गई फाइलों की जांच कर ली जाए।
स्रोत: Numerama —
मूल
