Grok 4.6 lanzado: puntos de referencia y el precio de las tareas largas
SpaceXAI lanzó Grok 4.6 con 500 mil tokens de contexto, cuatro modos de razonamiento y un enfoque en el trabajo agéntico de larga duración. En pruebas iniciales, se desempeña a la par de los principales competidores, liderando CursorBench con un costo promedio de 2,81 dólares por tarea. Sin embargo, el precio se duplica para contextos de más de 200 mil tokens.
El 12 de agosto, SpaceXAI lanzó Grok 4.6, que cuenta con 500 mil tokens de contexto, cuatro modos de razonamiento y un enfoque explícito en el trabajo agéntico extendido. En los benchmarks iniciales, el modelo se desempeña a la par de los competidores más fuertes y se destaca en CursorBench, con un costo promedio de 2.81 dólares por tarea. Esa cifra parece atractiva, pero el contexto largo actúa como un extra oculto: después de 200 mil tokens, la tarifa se duplica. El artículo examina dónde mejora realmente el modelo, cuánto cuesta una ejecución larga y quién debería probarlo ahora.
Fuente: Habr — хаб ИИ —
original
