Google lança Gemini 3.7 Flash: um modelo de codificação e agente a US$ 0,75 por 1 milhão de tokens de entrada
Google/DeepMind
Anthropic
OpenAI
MiniMax
A Google lançou o Gemini 3.7 Flash, um refinamento do modelo 3.6 Flash, com melhorias na geração de código, compreensão de contexto longo e preço reduzido. O modelo custa US$ 0,75 por 1 milhão de tokens de entrada e US$ 3,75 por 1 milhão de tokens de saída até o final de 2026, tornando-o uma opção econômica para agentes de IA. Ele está disponível apenas via API e plataformas empresariais, sem pesos abertos.
A Google lançou o Gemini 3.7 Flash três semanas após o Gemini 3.6 Flash, descrevendo-o como um refinamento do modelo anterior, com melhorias algorítmicas no raciocínio central. O modelo lida com texto, imagens, áudio e vídeo em uma janela de contexto de 1M de tokens e retorna até 64 mil tokens de saída. Os principais ganhos de desempenho estão em engenharia de software, tarefas com muitos documentos e desenvolvimento web. No FrontierCode 1.1 Main, ele pontua 43,6% contra 34,4% do 3.6 Flash; no DeepSWE v1.1, atinge 65,3%; no WebDev Arena, alcança um Elo de 1588. Os benchmarks de documentos e fluxos de trabalho melhoraram significativamente: o GDP.pdf passou de 22,0% para 34,0%, e o AutomationBench de 17,0% para 30,4%. O GPT-5.6 Terra ainda lidera em alguns benchmarks, e o CharXiv Reasoning mostra uma leve regressão. O preço é promocional: US$ 0,75 por 1M de tokens de entrada e US$ 3,75 por 1M de tokens de saída até 31 de dezembro de 2026, quando dobra. O modelo está disponível apenas via API e plataformas empresariais, sem opções de pesos abertos ou auto-hospedagem.
Fonte: MarkTechPost —
original
