Google lance Gemini 3.7 Flash : un modèle de codage et agent à 0,75 $/1M de jetons d'entrée
Google/DeepMind
Anthropic
OpenAI
MiniMax
Google a lancé Gemini 3.7 Flash, une version améliorée du modèle 3.6 Flash, avec une meilleure génération de code, une compréhension de longs contextes et un prix réduit. Le modèle coûte 0,75 $ par 1M de jetons d'entrée et 3,75 $ par 1M de jetons de sortie jusqu'à la fin de l'année 2026, ce qui en fait une option économique pour les agents d'intelligence artificielle. Il est disponible uniquement via l'API et les plateformes d'entreprise, sans ouvertures de poids.
Google a publié Gemini 3.7 Flash trois semaines après Gemini 3.6 Flash, le décrivant comme un affinement du modèle précédent avec des améliorations algorithmiques du raisonnement de base. Le modèle traite le texte, les images, l'audio et la vidéo dans une fenêtre de contexte d'un million de jetons et renvoie jusqu'à 64 000 jetons de sortie. Les principaux gains de performance concernent l'ingénierie logicielle, les tâches lourdes en documents et le développement web. Sur FrontierCode 1.1 Main, il obtient 43,6 % contre 34,4 % pour 3.6 Flash ; sur DeepSWE v1.1, il atteint 65,3 % ; sur WebDev Arena, il réalise un Elo de 1588. Les références documentaires et de flux de travail se sont considérablement améliorées : GDP.pdf est passé de 22,0 % à 34,0 %, et AutomationBench de 17,0 % à 30,4 %. GPT-5.6 Terra reste en tête sur certaines références, et CharXiv Reasoning montre une légère régression. Le prix est promotionnel : 0,75 $ par million de jetons en entrée et 3,75 $ par million de jetons en sortie jusqu'au 31 décembre 2026, puis il double. Le modèle n'est disponible que via l'API et les plateformes d'entreprise, sans options de poids ouverts ni d'auto-hébergement.
Source: MarkTechPost —
original
