Grok 4.6 Uitgebracht: Verbeterde Agentische AI, Betere Benchmarks, Beschikbaar in Cursor en Grok Build
xAI
xAI heeft Grok 4.6 uitgebracht, een verbeterde versie van zijn AI-model dat zich richt op langlopende agents en complexe interactieve en visuele taken. Het model laat concurrerende prestaties zien op verschillende benchmarks en evenaart of overtreft soms GPT-5.6 Sol en Fable 5. Grok 4.6 is beschikbaar in Cursor en Grok Build, met API-toegang en partnerplatforms.
xAI heeft Grok 4.6 onthuld, voortbouwend op Grok 4.5 met verbeterde mogelijkheden voor langdurige agentische taken, betere verwerking van complexe meerstapsprocessen waaronder onderzoek, coderen en het omzetten van ideeën in gepolijste applicaties. Het model is getraind met een uitgebreide fase van aanvullende training met zorgvuldig geselecteerde, door het model gegenereerde data, een verbeterde optimizer en een bijgewerkte methodologie, gevolgd door SFT- en RL-fasen. Het toont vaardigheden in zelfcontrole en verificatie, en blinkt uit in het omzetten van productideeën naar werkende prototypes, vooral bij visuele en interactieve projecten. Veiligheidsmechanismen zijn geüpgraded en gekalibreerd, waarbij het model de meest uitgebreide tests in de geschiedenis van xAI heeft ondergaan. Benchmarkresultaten tonen Grok 4.6 High met een AA Intelligence Index van 61, GDPVal-AA v2 1753, CursorBench v3.2 69,9%, DeepSWE v1.1 65,9%, FrontierCode v1.1 (Extended) 61,3%, APEX-Agents 57,5%, Terminal-Bench v3.0 26%, APEX-SWE 56,4%, AA-Briefcase 1577 en Harvey LAB (Vals) 15,8%. Grok 4.6 is nu beschikbaar in Cursor en Grok Build, evenals via API en op partnerplatforms zoals OpenRouter, Vercel en Cloudflare. De prijzen beginnen bij $2 per miljoen invoertokens en $6 per miljoen uitvoertokens, met een snellere versie die het dubbele kost. Tijdens de eerste week wordt het inbegrepen gebruik in Grok Build en Cursor verdubbeld.
Bron: Habr — хаб ИИ —
origineel
