Agent de codage IA local : Qwen3.6 avec Qwen-Code face aux abonnements Codex et Claude Code
OpenAI
Anthropic
Cohere
Meta
Le tutoriel de Sebastian Raschka explique comment configurer un agent de codage local en utilisant des LLM à poids ouverts comme Qwen3.6 et des harnais comme Qwen-Code, Codex ou Claude Code. Il met en avant les avantages tels que le coût, la confidentialité, la reproductibilité et l'utilisation hors ligne. L'article compare les performances, l'utilisation de la mémoire et la vitesse de Qwen3.6 35B-A3B et de North Mini Code de Cohere.
Sebastian Raschka propose un tutoriel pour configurer un agent de codage local prêt pour la production, en utilisant des LLM open-weight et des environnements de codage locaux. Il utilise principalement la combinaison Qwen3.6 avec Qwen-Code, précisant que les modèles Qwen sont optimisés pour Qwen-Code. Parmi les environnements alternatifs, on trouve Codex, Claude Code et Cline. Il recommande d'utiliser Ollama pour servir des modèles comme Qwen3.6 35B-A3B (téléchargement de 22 Go, 30 à 40 Go de RAM) ou le North Mini Code 1.0 de taille similaire. Un benchmark de vitesse montre que Qwen3.6 et North Mini génèrent environ 40 tok/s sur un Mac Mini et 30 tok/s sur un DGX avec jusqu'à 30 Go de RAM pour un contexte de 50 000 tokens. Il mentionne également des options cloud pour des modèles plus grands comme GLM 5.2. La configuration locale est transparente, inspectable, gratuite (hormis le matériel) et garantit la confidentialité. Il estime qu'une vitesse supérieure à 20-30 tok/s est raisonnable pour un agent local.
Source: Sebastian Raschka —
original
