Même IA, coûts différents : le choix du framework change le prix presque du triple
Anthropic
OpenAI
DeepSeek
Composio a testé Deepseek V4 Flash sur quatre frameworks d'agents : Claude Code, Codex, OpenCode et Oh My Pi. Les résultats montrent des différences significatives de prix et de vitesse : OpenCode était le moins cher, Claude Code le plus rapide mais le plus cher, et Oh My Pi le plus précis mais le plus lent.
La société d'outillage IA Composio a testé Deepseek V4 Flash dans quatre frameworks d'agents différents : Claude Code, Codex, OpenCode et Oh My Pi. Ils ont exécuté 30 tâches en utilisant des outils réels comme Gmail, GitHub, Slack et Notion. Le résultat : aucun framework n'a été le meilleur dans toutes les catégories. Oh My Pi a atteint le taux de réussite le plus élevé (17 sur 30) mais a été le plus lent (272 secondes par tâche). OpenCode a été le moins cher (0,073 dollar par tâche réussie), Claude Code a été le plus rapide (122 secondes) mais le plus cher (0,195 dollar), malgré l'utilisation du moins d'appels d'outils et de jetons de sortie. Sept tâches ont réussi ou échoué uniquement en fonction du framework utilisé. Dans l'ensemble, les taux de réussite étaient proches, OpenCode étant légèrement inférieur avec 14 sur 30. Les plus grandes différences concernaient le prix et la vitesse : le choix du framework a modifié les coûts de près de trois fois et la vitesse de 2,2 fois.
Source: The Decoder (DE) —
original
