मॉडलएजेंट 🇺🇸 27.07.2026 04:07

Fable GPU कोर लिखता है, AI ऑटोमेशन और एनालॉग कंप्यूटिंग: Import AI 464 डाइजेस्ट

OpenAIOpenAI AnthropicAnthropic Moonshot AIMoonshot AI MiniMaxMiniMax Alibaba/QwenAlibaba/Qwen JD.comJD.com
Fable ने KernelBench-Mega के लिए सबसे तेज़ मेगा-कर्नेल बनाया, जिसने 18.71x की गति वृद्धि हासिल की। CAIS और Scale Labs के शोधकर्ताओं ने ऑनलाइन फ्रीलांसिंग पर AI एजेंट की सफलता दर में 2.5% (अक्टूबर 2025) से 16.1% (जुलाई 2026) तक वृद्धि दर्ज की। लंबी अवधि के कंप्यूटर कार्यों (माध्यिका 1.6 घंटे) के मूल्यांकन के लिए OSWORLD 2.0 बेंचमार्क जारी किया गया है; सबसे अच्छा परिणाम 20.6% है। JD ने Huawei Ascend NPUs पर चलने वाली अपनी Oxygen AIIC इन्वेंट्री प्रबंधन प्रणाली का विवरण प्रकाशित किया।
Fable ने KernelBench-Mega के लिए पहला सच्चा मेगा-कर्नेल लिखा है, जो RTX PRO 6000 Blackwell पर PyTorch बेसलाइन की तुलना में 18.71x की स्पीडअप हासिल करता है। यह बेंचमार्क में सबसे अच्छा परिणाम है, जबकि Claude Opus 4.8 14.4x, GLM-5.2 11.14x और GPT 5.5 4.34x दिखाते हैं। Fable का समाधान प्रति टोकन एकल सहकारी कर्नेल लॉन्च का उपयोग करता है, जबकि प्रतियोगी 4-14 लॉन्च करते हैं। रिमोट लेबर इंडेक्स के अनुसार, ऑनलाइन फ्रीलांसिंग पर AI सिस्टम की सफलता दर 8 महीनों में 2.5% से बढ़कर 16.1% हो गई है; जुलाई 2026 तक सबसे अच्छे मॉडल GPT-5.5 (6.3%), Opus 4.8 (8.3%) और Fable 5 (16.1%) हैं। मूल्यांकन में 3D, डिज़ाइन, वीडियो, ऑडियो, डेटा विश्लेषण और वेब एप्लिकेशन के कार्य शामिल थे। OSWORLD 2.0 में 31 वेबसाइटों और सॉफ़्टवेयर (Slack, LinkedIn, REAPER, AWS, आदि) का उपयोग करते हुए 108 लंबी अवधि के कार्य (माध्य 1.6 घंटे) शामिल हैं। सबसे अच्छा एजेंट, Claude Opus 4.8, ने 20.6% सटीकता हासिल की, जो मानव स्तर से बहुत दूर है। JD ने इन्वेंट्री प्रबंधन के लिए Oxygen AI Item Center पेश किया है (700 मिलियन उपयोगकर्ता, अरबों SKU)। सिस्टम ऑन्टोलॉजिकल इंजीनियरिंग, सिमेंटिक सर्च, सेल्फ-लर्निंग LLM/VLM और एकीकृत डेटा टनल का उपयोग करता है। सब कुछ Huawei Ascend NPU पर चलता है।
स्रोत: Import AI — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार