Grok 4.6 uitgebracht: benchmarks en de prijs van lange taken
SpaceXAI heeft Grok 4.6 uitgebracht met 500K contexttokens, vier redeneermodi en een focus op langdurig agentisch werk. In vroege tests presteert het op het niveau van de beste concurrenten en leidt het CursorBench met een gemiddelde kostprijs van 2,81 dollar per taak. De prijs verdubbelt echter voor contexten boven de 200K tokens.
Op 12 augustus heeft SpaceXAI Grok 4.6 uitgebracht, met 500 duizend contexttokens, vier redeneermodi en een expliciete focus op uitgebreid agentisch werk. In eerste benchmarks presteert het model op het niveau van de sterkste concurrenten en komt het vooruit in CursorBench, met een gemiddelde kostprijs van 2,81 dollar per taak. Dat aantal ziet er aantrekkelijk uit, maar de lange context werkt als een verborgen extra: na 200 duizend tokens verdubbelt het tarief. Het artikel onderzoekt waar het model echt verbetert, hoeveel een lange run kost en wie het nu zou moeten proberen.
Bron: Habr — хаб ИИ —
origineel
