AgentsModèles 🇷🇺 30.07.2026 14:02

Juillet chez Claude : d'un chat intelligent à un employé que vous avez montré une fois

AnthropicAnthropic
Anthropic a publié une série de mises à jour en juillet 2025 qui font passer Claude d'un modèle nécessitant une explication verbale de la tâche à chaque fois à un agent qui apprend par démonstration. Les fonctionnalités clés incluent Enregistrer une compétence, qui enregistre l'écran et la voix pour créer des compétences réutilisables, et un régulateur d'effort pour Opus 5 qui contrôle les coûts des jetons de raisonnement. L'article analyse les implications pratiques, les calculs de coûts et les pièges comme le repli silencieux.
En juillet, Anthropic a publié plusieurs mises à jour qui, ensemble, poussent Claude à devenir un agent qui apprend à partir d'une seule démonstration. La fonctionnalité la plus sous-estimée, "Record a Skill", lancée le 21 juillet, permet aux utilisateurs d'enregistrer leur écran et leurs commentaires vocaux pendant qu'ils effectuent une tâche, et Claude construit une compétence réutilisable à partir de cette démonstration. Elle est disponible sur les formules Pro, Max et Team, uniquement sur ordinateur de bureau (Windows et macOS), et se trouve dans l'interface Cowork. Le 24 juillet, Anthropic a lancé Opus 5, qui inclut un régulateur d'effort avec trois niveaux (faible, moyen, élevé) contrôlant le volume de jetons de raisonnement et donc le coût. Le prix d'Opus 5 reste identique à celui d'Opus 4.8 : 5 dollars par million de jetons d'entrée et 25 dollars par million de jetons de sortie, avec une fenêtre de contexte allant jusqu'à 1 million de jetons et une sortie maximale de 128 000 jetons. Le régulateur d'effort affecte les jetons de raisonnement, qui sont facturés comme des sorties. L'auteur conseille d'utiliser le niveau faible pour les erreurs peu coûteuses (paraphrase, extraction JSON) et le niveau élevé uniquement pour les erreurs coûteuses (migrations irréversibles, calculs financiers). Parmi les autres mises à jour de juillet, citons un mode vocal qui prend désormais en charge Opus et Sonnet, 11 langues, et des actions réelles dans Gmail et Slack ; la prise en charge de la spécification MCP pour les serveurs sans état, l'interface utilisateur interactive dans les réponses, l'autorisation OAuth/OIDC et les tableaux de bord d'observabilité ; les artefacts publiés peuvent désormais accéder aux connecteurs MCP en direct ; les agents gérés bénéficient de paramètres de niveau d'effort et de webhooks pour les événements de mémoire et d'environnement. L'auteur recommande d'adopter "Record a Skill" pour les tâches manuelles répétitives, de régler le régulateur d'effort sur faible par défaut pour les tâches à erreurs peu coûteuses, et de journaliser quel modèle répond réellement pour détecter les basculements silencieux. Le thème général du mois de juillet est qu'Anthropic ne vend plus un modèle intelligent, mais assemble un employé que vous montrez une fois : "Record a Skill" enseigne, le régulateur d'effort contrôle les coûts, et MCP ainsi que la voix lui donnent accès aux systèmes.
Source: Habr — хаб ИИ — original
Nos articles précédents sur ce sujet ↓
Infos fraîches