Google Gemini 3.6 Flash : réduction des coûts IA pour entreprises
Google a dévoilé Gemini 3.6 Flash et 3.5 Flash-Lite, des modèles optimisés pour réduire les coûts et la latence des agents IA en entreprise. Les tests montrent une réduction de 17% à 65% des tokens utilisés, avec des prix compétitifs. Des entreprises comme Figma et Harvey utilisent déjà ces modèles.
« 17 percent fewer output tokens than the prior 3.5 Flash version, based on measurements from the Artificial Analysis Index. » — AI News
Que faut-il retenir ?
- Gemini 3.6 Flash réduit de 17% les tokens de sortie par rapport à la version 3.5 Flash.
- Sur le benchmark DeepSWE, Gemini 3.6 Flash affiche un taux de réussite de 49%, contre 37% pour son prédécesseur.
- Le prix de Gemini 3.6 Flash est de 1,50$/1M de tokens en entrée et 7,50$/1M en sortie.
- Gemini 3.5 Flash-Lite atteint 350 tokens de sortie par seconde, le plus rapide de la série 3.5.
Pourquoi cette nouvelle compte-t-elle ?
Ces nouveaux modèles de Google permettent aux entreprises de réduire significativement les coûts et la latence des agents IA, tout en améliorant les performances. Cela ouvre la voie à des applications plus efficaces et économiques de l'IA générative dans des domaines comme le développement, la recherche et la sécurité.
17% de tokens de sortie en moins avec Gemini 3.6 Flash par rapport à la version 3.5 Flash.
💬 Matt Colyer, Directeur de l'ingénierie produit chez Figma
Public concerné : entreprises, développeurs
Quels sont les avantages de Gemini 3.6 Flash pour les entreprises ?
Gemini 3.6 Flash réduit les coûts et la latence des agents IA, avec une diminution de 17% des tokens de sortie et des performances améliorées sur les benchmarks. Il est déjà utilisé par des entreprises comme Figma et Harvey.
🔧 Outils mentionnés