एजेंटओपन सोर्स 🇺🇸 27.07.2026 05:05

स्थानीय AI कोडिंग एजेंट: Qwen3.6, Qwen-Code बनाम Codex और Claude Code सब्सक्रिप्शन

OpenAIOpenAI AnthropicAnthropic CohereCohere MetaMeta
सेबेस्टियन रास्का का ट्यूटोरियल बताता है कि कैसे Qwen3.6 जैसे ओपन-वेट LLM और Qwen-Code, Codex या Claude Code जैसे हार्नेस का उपयोग करके एक स्थानीय कोडिंग एजेंट सेट अप किया जाए। यह लागत, गोपनीयता, पुनरुत्पादकता और ऑफलाइन उपयोग जैसे लाभों पर प्रकाश डालता है। लेख Qwen3.6 35B-A3B और कोहेयर के North Mini Code के प्रदर्शन, मेमोरी उपयोग और गति की तुलना करता है।
सेबेस्टियन रैश्का ओपन-वेट एलएलएम और लोकल कोडिंग हार्नेस का उपयोग करके प्रोडक्शन-रेडी लोकल कोडिंग एजेंट स्थापित करने पर एक ट्यूटोरियल प्रदान करते हैं। वह क्वेन3.6 के साथ क्वेन-कोड को प्राथमिक संयोजन के रूप में उपयोग करते हैं, यह नोट करते हुए कि क्वेन मॉडल क्वेन-कोड के लिए ऑप्टिमाइज़ किए गए हैं। वैकल्पिक हार्नेस में कोडेक्स, क्लॉड कोड और क्लाइन शामिल हैं। वह क्वेन3.6 35बी-ए3बी (22 जीबी डाउनलोड, 30-40 जीबी रैम) या समान आकार के नॉर्थ मिनी कोड 1.0 जैसे मॉडलों को सर्व करने के लिए ओलामा का उपयोग करने की सलाह देते हैं। एक स्पीड बेंचमार्क दिखाता है कि क्वेन3.6 और नॉर्थ मिनी मैक मिनी पर लगभग 40 टोक/सेकंड और डीजीएक्स पर 30 जीबी रैम तथा 50k कॉन्टेक्स्ट में 30 टोक/सेकंड उत्पन्न करते हैं। वह जीएलएम 5.2 जैसे बड़े मॉडलों के लिए क्लाउड विकल्पों का भी उल्लेख करते हैं। लोकल सेटअप पारदर्शी, निरीक्षणीय, मुफ़्त (हार्डवेयर के अलावा) और गोपनीयता प्रदान करता है। वह सुझाव देते हैं कि 20-30 टोक/सेकंड से तेज़ कुछ भी लोकल एजेंट कार्य के लिए उचित है।
स्रोत: Sebastian Raschka — मूल
इस विषय पर हमारी पिछली पोस्ट ↓
ताज़ा समाचार