SpaceXAI publie Grok 4.6 : 500K de contexte, nouveau niveau de raisonnement xhigh, à égalité avec GPT-5.6 Sol Max
OpenAI
Anthropic
SpaceXAI a publié Grok 4.6, une mise à niveau post-entraînement par rapport à Grok 4.5, avec une fenêtre de contexte de 500K tokens et un nouveau niveau d'effort de raisonnement xhigh. Le modèle montre des gains modestes sur l'indice d'intelligence de Artificial Analysis, mais reste en retrait sur les principaux benchmarks de codage. Il est disponible via l'API, Cursor et Grok Build, avec des paliers de prix qui doublent au-delà de 200K tokens de prompt.
SpaceXAI a présenté Grok 4.6 comme une amélioration post-entraînement de Grok 4.5, conservant le modèle de base inchangé et progressant grâce à un entraînement supplémentaire plus long, à des trajectoires d'affinage supervisé régénérées et à un apprentissage par renforcement dans des environnements agentiques. Le modèle obtient un score de 61 à l'indice d'intelligence Artificial Analysis, contre 56 auparavant, égalant GPT-5.6 Sol Max, mais reste en retrait sur les benchmarks de codage tels que DeepSWE (65,9 % contre 73 %) et Terminal-Bench (26 %, bien que le double de celui de Grok 4.5, qui était de 15,7 %). La longueur du contexte est de 500 000 jetons avec saisie de texte et d'images et sortie de texte uniquement, et il ajoute un niveau d'effort de raisonnement xhigh. Il est disponible via l'API xAI sous le nom grok-4.6, dans Grok Build, Cursor, OpenRouter, Vercel et Cloudflare, mais aucune pondération ouverte ni hébergement autonome n'est proposé. Les prix commencent à 2 $ pour l'entrée, 0,50 $ pour l'entrée en cache et 6 $ pour la sortie par million de jetons pour les invites de moins de 200 000 jetons, et doublent au-delà de ce seuil. L'article note que les victoires en gras sur GDPval-AA et AA-Briefcase sont des égalités statistiques dans les intervalles de confiance, et que la comparaison exclut Claude Opus 5.
Source: MarkTechPost —
original
