ModelosNegocios y Mercado 🇷🇺 26.07.2026 15:02

Gemini Flash 3.6: no más inteligente, pero notablemente más barato

Google/DeepMindGoogle/DeepMind
Google lanzó tres modelos: Gemini 3.6 Flash (principal), Gemini 3.5 Flash-Lite (rápido/barato) y Gemini 3.5 Flash Cyber (seguridad, restringido). La mejora clave es una reducción del 17% en tokens de salida para las mismas tareas, lo que se traduce en ahorros de costos del 31 al 71% en escenarios de agentes. Sin embargo, el análisis visual del modelo retrocedió, especialmente en gráficos. Gemini 3.5 Flash-Lite es un líder inesperado en relación calidad-precio, superando a veces a modelos antiguos de gama media. Google también anunció pruebas internas de Gemini 3.5 Pro y el inicio del preentrenamiento de Gemini 4.
El 21 de julio, Google publicó tres modelos: Gemini 3.6 Flash (reemplaza a 3.5 Flash, con un precio de 1,50 $/7,50 $ por millón de tokens), Gemini 3.5 Flash-Lite (ultrarrápido y barato a 0,30 $/2,50 $) y Gemini 3.5 Flash Cyber (para búsqueda de vulnerabilidades, solo para gobiernos). El dato destacado es una reducción del 17% en tokens de salida en comparación con 3.5 Flash según Artificial Analysis, alcanzando un ahorro del 65% en el benchmark de codificación DeepSWE (97k tokens frente a 276k). El índice de inteligencia general (50 puntos) no ha variado. En benchmarks, 3.6 Flash mejoró en DeepSWE (37%→49%), MLE-Bench (49,7%→63,9%), OSWorld-Verified (78,4%→83,0%) y recall de contexto largo (~27%→54%), pero se quedó atrás frente a los principales competidores como Grok 4.5 y Claude Sonnet 5 en codificación pura (SWE-Bench Pro 58,7% frente a 64,7%) y tareas de conocimiento (GDPval-AA Elo 1421 frente a 1607 de Sonnet 5). Una regresión notable: el CEO de LlamaIndex, Jerry Liu, encontró que la lectura de gráficos en ParseBench cayó del 45% al 31%, y las puntuaciones en documentos pasaron de 69,9 a 66,8, probablemente como compensación por el enfoque del post-entrenamiento en código y agentes. El modelo Flash-Lite destaca por su relación calidad-precio: 350 tokens/s de salida, supera al antiguo Gemini 3 Flash en algunas pruebas (SWE-Bench Pro 54,2% frente a 49,6%, OSWorld-Verified 74,0% frente a 65,1%) y es más barato que Claude Haiku 4.5. Flash Cyber, basado en 3.5 Flash, encontró 55 problemas únicos en Chrome V8 (frente a 47 del modelo base y 36 de Claude Opus 4.6) y obtuvo un 83,2% en el benchmark CyberGym (cuarto entre modelos especializados). Google también mencionó pruebas internas de Gemini 3.5 Pro con socios y el inicio del pre-entrenamiento de Gemini 4.
Fuente: Habr — хаб ИИ — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas