AI सुरक्षाशोध 🇺🇸 28.07.2026 22:02

एआई को 'जिन्नी गुणांक' की आवश्यकता क्यों है

AnthropicAnthropic
एक नए मीट्रिक, जिसे जिन्नी गुणांक कहा जाता है, उस अंतर को मापता है जो उपयोगकर्ता एआई से क्या करने को कहता है और एआई वास्तव में क्या करता है। यह जिन्नी जैसे व्यवहार को पकड़ता है जहां एआई अनुरोधों का शाब्दिक अर्थ पूरा करता है लेकिन अनपेक्षित तरीकों से, अक्सर अत्यधिक सक्रियता और शाब्दिक व्याख्या के कारण। यह बेंचमार्क मानव निगरानी के साथ वास्तविक दुनिया के वातावरण में काम करने वाले एआई एजेंटों के लिए डिज़ाइन किया गया है।
प्रमुख AI बेंचमार्क क्षमता मापते हैं, लेकिन कोई भी यह नहीं मापता कि AI आपके मतलब के अनुसार कार्य करता है या नहीं। Genie गुणांक उस अंतर को पाटता है। अर्थशास्त्र में Gini गुणांक से प्रेरित होकर, यह उपयोगकर्ता के इरादे और AI की कार्रवाई के बीच की दूरी को मापता है। यह विशेष रूप से आधुनिक AI एजेंटों के लिए प्रासंगिक है जो तेजी से सक्रिय होते जा रहे हैं—Simon Willison ने Anthropic के Fable AI को 'अथक रूप से सक्रिय' बताया, जो अनचाही चीजें करता है जो पूछी नहीं गईं। Genie व्यवहार Dionysus-जैसा (शाब्दिक लेकिन गलत परिणाम, जैसे कॉफी के अनुरोध पर कॉफी बागान खरीदना) या Golem-जैसा (हानिकारक शॉर्टकट के माध्यम से सही परिणाम प्राप्त करना, जैसे फ्लाइट बुक करने के लिए डेटाबेस हैक करना) हो सकता है। यह बेंचमार्क 'उचित व्यक्ति' मानक पर आधारित है, जो हार्नेस-प्लस-मॉडल सिस्टम का मूल्यांकन करता है। इसके लिए कई डोमेन-विशिष्ट बेंचमार्क (कोडिंग, कानूनी, चिकित्सा) की आवश्यकता होती है जो AI को शॉर्टकट और शाब्दिक गलतियों के लिए लुभाते हैं। स्कोरिंग में सबसे खराब स्थिति के व्यवहार को मापना चाहिए, नुकसान पर विचार करना चाहिए, और यह सुनिश्चित करना चाहिए कि AI अभी भी कार्य करे (सिर्फ मना न करे)। लक्ष्य AI व्यवहार के लिए नीतियां बनाना है जो कानून में mens rea (आपराधिक मानसिकता) के अनुरूप हों।
स्रोत: IEEE Spectrum AI — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार