एक प्रश्न, सात AI खोज इंजन, शून्य सामान्य स्रोत
Perplexity AI
Яндекс
OpenAI
Google/DeepMind
DeepSeek
xAI
Сбер
एक सॉफ्टवेयर इंजीनियर ने सात AI खोज इंजनों पर एक ही प्रश्न का परीक्षण किया और पाया कि किसी भी सामान्य उद्धृत डोमेन नहीं थे। अधिकांश डोमेन केवल एक इंजन द्वारा उल्लिखित थे, और विभिन्न डेवलपर्स के तीन मॉडल एक ही प्लगइन का उपयोग करते थे, जिससे समान परिणाम मिलते थे। लेखक AI दृश्यता मापने के लिए एक पद्धति प्रस्तुत करता है और इसकी सीमाएँ सूचीबद्ध करता है।
10 अगस्त, 2026 को एक इंजीनियर ने सात AI (आर्टिफिशियल इंटेलिजेंस) सर्च इंजनों — Perplexity, Yandex Neurosearch, ChatGPT, Gemini 2.5 Flash, DeepSeek V3.1, GLM 5.2 और Grok 4.5 — पर व्यवसाय से जुड़े दो सवाल चलाए। मकसद यह मापना था कि हर इंजन अपने जवाब में किन डोमेन्स का हवाला देता है। नतीजों से पता चला कि किसी भी डोमेन का जिक्र सभी सात इंजनों ने एक साथ नहीं किया; आधे से ज्यादा डोमेन्स का हवाला सिर्फ एक ही इंजन ने दिया। किसी एक डोमेन के लिए अधिकतम ओवरलैप सात में से पांच रहा। इसके अलावा, पेयरवाइज ओवरलैप मेट्रिक (यानी जोड़ी-दर-जोड़ी तुलना का मानदंड) से यह भी पता चला कि DeepSeek, GLM और Gemini ने बिल्कुल एक जैसी सूचियां लौटाईं, क्योंकि तीनों एक ही प्रोवाइडर के वेब-सर्च प्लगइन पर निर्भर हैं। जिन इंजनों के अपने खुद के इंडेक्स थे, उन्होंने अलग-अलग "वर्ल्ड मॉडल" दिखाए: Yandex Neurosearch ने एग्रीगेटर्स और मीडिया का हवाला दिया, ChatGPT ने कैटलॉग्स और कंसल्टिंग फर्मों का, और Grok ने सरकारी पोर्टल्स का।
लेखक ने इस पद्धति की पांच कमजोर कड़ियां भी बताईं, जिनमें GigaChat के inline_data.sources में एक छिपी हुई पार्सिंग बग शामिल है (यह एक डिक्शनरी है, लिस्ट नहीं), साथ ही प्युनीकोड डोमेन्स को सामान्य रूप में बदलने (नॉर्मलाइज़ करने) की जरूरत भी सामने आई। लेखक ने इस बात पर जोर दिया कि हवाला मिलना ट्रैफिक के बराबर नहीं है, कि ये माप समय-संवेदी होते हैं, और एक बार का प्रयोग किसी नतीजे पर मुहर नहीं लगाता। इस पूरे प्रयोग की लागत एक शाम के लिए 404 रूबल रही, और रिले के जरिए हर सवाल पर लगभग 1.26 रूबल का खर्च आया, जबकि Yandex के जनरेटिव जवाब की कीमत लगभग 5 रूबल प्रति उत्तर रही।
स्रोत: Habr — хаб ИИ —
मूल
