Modelos 🇷🇺 13.08.2026 16:04

Grok 4.6 lançado: benchmarks e o preço de tarefas longas

A SpaceXAI lançou o Grok 4.6 com 500 mil tokens de contexto, quatro modos de raciocínio e foco em trabalho agêntico longo. Em testes iniciais, ele se sai ao lado dos principais concorrentes, liderando o CursorBench a um custo médio de US$ 2,81 por tarefa. No entanto, o preço dobra para contextos acima de 200 mil tokens.
Em 12 de agosto, a SpaceXAI lançou o Grok 4.6, que apresenta 500 mil tokens de contexto, quatro modos de raciocínio e um foco explícito em trabalho agêntico estendido. Em benchmarks iniciais, o modelo tem desempenho equivalente aos concorrentes mais fortes e sai à frente no CursorBench, com um custo médio de 2,81 dólares por tarefa. Esse número parece atraente, mas o contexto longo age como um extra oculto: após 200 mil tokens, a taxa dobra. O artigo examina onde o modelo realmente melhora, quanto custa uma execução longa e quem deve experimentá-lo agora.
Fonte: Habr — хаб ИИ — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas