Grok 4.6 Lançado: IA Agêntica Aprimorada, Benchmarks Melhorados, Disponível em Cursor e Grok Build
xAI
A xAI lançou o Grok 4.6, uma versão atualizada do seu modelo de IA focada em agentes de longa duração e tarefas interativas e visuais complexas. O modelo mostra desempenho competitivo em vários benchmarks, às vezes igualando ou superando GPT-5.6 Sol e Fable 5. O Grok 4.6 está disponível no Cursor e no Grok Build, com acesso via API e plataformas parceiras.
A xAI apresentou o Grok 4.6, que se baseia no Grok 4.5 com capacidades aprimoradas para tarefas agênticas de longa duração, melhor tratamento de processos complexos de múltiplas etapas, incluindo pesquisa, codificação e transformação de ideias em aplicativos refinados. O modelo foi treinado com uma fase estendida de treinamento adicional usando dados gerados por modelo cuidadosamente selecionados, otimizador aprimorado e metodologia atualizada, seguidos de fases de ajuste fino supervisionado e aprendizado por reforço. Ele demonstra habilidades de autoverificação e validação, e se destaca em converter ideias de produtos em protótipos funcionais, especialmente em projetos visuais e interativos. Os mecanismos de segurança foram atualizados e calibrados, com o modelo passando pelos testes mais extensos da história da xAI. Os resultados de benchmark mostram que o Grok 4.6 High alcança Índice de Inteligência Artificial 61, GDPVal-AA v2 1753, CursorBench v3.2 69,9%, DeepSWE v1.1 65,9%, FrontierCode v1.1 (Estendido) 61,3%, APEX-Agents 57,5%, Terminal-Bench v3.0 26%, APEX-SWE 56,4%, AA-Briefcase 1577 e Harvey LAB (Vals) 15,8%. O Grok 4.6 já está disponível no Cursor e no Grok Build, além da API e em plataformas parceiras, incluindo OpenRouter, Vercel e Cloudflare. O preço começa em US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída, com uma versão mais rápida custando o dobro. Durante a primeira semana, o uso incluído no Grok Build e no Cursor é dobrado.
Fonte: Habr — хаб ИИ —
original
