Ce qui change
Google a livré Gemini 3.6 Flash le 21 juillet 2026 à 1,50 $ par million de tokens d’entrée et 7,50 $ par million de tokens de sortie, disponible le jour même dans Google AI Studio, Android Studio, Google Antigravity et l’application Gemini 1. La métrique de Google : 17 % de tokens de sortie en moins que Gemini 3.5 Flash, mesurés sur l’Artificial Analysis Index 1. Fello AI indique que le prix de sortie de 7,50 $ recule depuis 9,00 $ sur 3.5 Flash, l’entrée restant à 1,50 $, et que la date de connaissance passe de janvier 2025 à mars 2026 2.
Où l’économie tombe vraiment
L’intérêt n’est pas la baisse affichée ; c’est que deux leviers se cumulent. Un prix de sortie plus bas et 17 % de tokens de sortie en moins par tâche se multiplient au lieu de se substituer. Faites le calcul sur les deux chiffres cités : 7,50/9,00, multiplié par la réduction de 17 % des tokens, donne 0,833 x 0,83, soit environ 0,69. Sur une charge riche en sortie, le coût réel par tâche baisse d’environ un tiers, pas des ~17 % que la ligne de prix laisse croire.
| Par 1M de tokens | 3.5 Flash | 3.6 Flash |
|---|---|---|
| entrée | 1,50 $ 2 | 1,50 $ 1 |
| sortie | 9,00 $ 2 | 7,50 $ 1 |
Ce chiffre ne tient que lorsque la sortie domine la facture.
Impact pour une équipe
Si vous routez un fort trafic d’agents par le palier Flash, cela vaut un rechiffrage cette semaine : le gain se concentre là où les boucles d’agents dépensent, la sortie. C’est une option, pas une dépréciation : aucune échéance ni migration forcée, et 3.6 Flash est disponible aujourd’hui sans liste d’attente 1. Aucun score de qualité pour 3.6 Flash n’est capté ici, et Google met en avant le coût et la latence plutôt qu’un écart de justesse : validez sur vos propres évaluations avant de présumer la parité avec 3.5 Flash. Et la date de connaissance repoussée à mars 2026 2 change ce que le modèle sait sans toucher au prompt et peut décaler son comportement sur les tâches sensibles à l’actualité. Rechiffrez maintenant, réévaluez avant de vous engager.