SpaceXAI veröffentlicht Grok 4.6: 500K Kontext, neues xhigh Reasoning, auf Augenhöhe mit GPT-5.6 Sol Max
OpenAI
Anthropic
SpaceXAI hat Grok 4.6 veröffentlicht, ein Post-Training-Upgrade gegenüber Grok 4.5, das ein Kontextfenster von 500.000 Token und eine neue Stufe für den Reasoning-Aufwand namens xhigh bietet. Das Modell zeigt bescheidene Verbesserungen beim Artificial Analysis Intelligence Index, liegt aber bei wichtigen Coding-Benchmarks zurück. Es ist über API, Cursor und Grok Build verfügbar, mit Preisstufen, die sich über 200.000 Prompt-Token hinaus verdoppeln.
SpaceXAI hat Grok 4.6 als eine nachträgliche Trainingsverbesserung von Grok 4.5 vorgestellt, wobei das Basismodell unverändert bleibt und die Verbesserung durch ein längeres ergänzendes Training, neu generierte Supervised-Fine-Tuning-Trajektorien und Reinforcement Learning in agentischen Umgebungen erreicht wird. Das Modell erzielt 61 Punkte im Artificial-Analysis-Intelligence-Index, gegenüber 56, und liegt damit gleichauf mit GPT-5.6 Sol Max, bleibt aber bei Coding-Benchmarks wie DeepSWE (65,9 % gegenüber 73 %) und Terminal-Bench (26 %, allerdings doppelt so viel wie die 15,7 % von Grok 4.5) zurück. Die Kontextlänge beträgt 500.000 Token mit Text- und Bildeingabe sowie reiner Textausgabe, und es wird eine zusätzliche Stufe für hohen Denkaufwand (xhigh reasoning-effort) eingeführt. Verfügbar ist das Modell über die xAI-API als grok-4.6, in Grok Build, Cursor, OpenRouter, Vercel und Cloudflare, jedoch ohne offene Gewichte oder Selbsthosting. Die Preisgestaltung beginnt bei 2 US-Dollar für Eingabe, 0,50 US-Dollar für gecachte Eingabe und 6 US-Dollar für Ausgabe pro Million Token bei unter 200.000 Prompt-Token, ab diesem Schwellenwert verdoppeln sich die Preise. Der Artikel weist darauf hin, dass die fett hervorgehobenen Siege bei GDPval-AA und AA-Briefcase statistische Gleichstände innerhalb der Konfidenzintervalle sind, und der Vergleich Claude Opus 5 ausschließt.
Quelle: MarkTechPost —
Original
