Gemini 3.6 Flash : benchmarks, prix, disponibilité et changements
Google a publié Gemini 3.6 Flash le 21 juillet 2026 comme nouveau cheval de bataille généraliste dans sa gamme Flash. Le modèle cible le codage, l'analyse multimodale, les agents d'utilisation d'ordinateur et les flux de travail multi-étapes, tout en réduisant la consommation de jetons de sortie et en baissant le prix des jetons de sortie par rapport à Gemini 3.5 Flash.
Les chiffres principaux sont considérables : Google rapporte 49 % sur DeepSWE, 63,9 % sur MLE-Bench et 83,0 % sur OSWorld-Verified. Le prix standard de l'API est de 1,50 $ par million de jetons d'entrée et 7,50 $ par million de jetons de sortie. Ce guide explique les benchmarks, les niveaux de prix, la disponibilité, les changements d'API, les outils supportés et les raisons pratiques de migrer.
Points clés à retenir
- Date de sortie : Gemini 3.6 Flash est devenu généralement disponible le 21 juillet 2026.
- Identifiant du modèle : Le code stable du modèle API Gemini est
gemini-3.6-flash. - Prix : Le prix standard est de 1,50 $ par million de jetons d'entrée et de 7,50 $ par million de jetons de sortie.
- Efficacité : Google rapporte 17 % de jetons de sortie en moins sur l'Artificial Analysis Index et jusqu'à 65 % en moins sur DeepSWE que Gemini 3.5 Flash.
- Contexte : Le modèle accepte jusqu'à 1 048 576 jetons d'entrée et produit jusqu'à 65 536 jetons de sortie.
- Disponibilité : Il est disponible via l'API Gemini, Google AI Studio, Android Studio, Google Antigravity, Gemini Enterprise et l'application Gemini.
Gemini 3.6 Flash en un coup d'œil
| Catégorie | Gemini 3.6 Flash |
|---|---|
| Rôle principal | Modèle de raisonnement généraliste rapide pour les charges de travail d'agents et multimodales |
| Identifiant d'API stable | gemini-3.6-flash |
| Niveau de réflexion par défaut | Moyen |
| Modalités d'entrée | Texte, image, vidéo, audio et PDF |
| Modalité de sortie | Texte |
| Statut de production | Généralement disponible |
Qu'est-ce que Gemini 3.6 Flash ?
Gemini 3.6 Flash est un modèle de raisonnement multimodal propriétaire de la famille Flash de Google, axée sur la vitesse et l'efficacité. Google le positionne pour les charges de travail d'agents du monde réel : génération de code, appel de fonctions, utilisation d'ordinateurs, raisonnement spatial, analyse de documents et flux de travail qui peuvent nécessiter plusieurs étapes avant qu'une réponse finale soit prête.
Le modèle n'est pas simplement une version 3.5 renommée. Google affirme qu'il a été peaufiné en fonction des retours des développeurs concernant la verbosité, les modifications de code indésirables et les boucles d'exécution qui consommaient des jetons de raisonnement et des appels d'outils supplémentaires. L'amélioration prévue est donc double : meilleure qualité des tâches et moins de travail requis pour atteindre le résultat.
For developers starting with Google’s platform, Zerlo’s guide pour obtenir une clé API Gemini explique la configuration du compte et de Google AI Studio. Le nom du modèle à sélectionner dans une requête d'API est gemini-3.6-flash.
Qu'est-ce qui a changé par rapport à Gemini 3.5 Flash ?
| Domaine | Modification de Gemini 3.6 Flash | Effet pratique |
|---|---|---|
| Codage | Précision accrue, moins de modifications de fichiers involontaires et moins de boucles de débogage | Mieux adapté aux migrations et au développement itératif d'agents |
| Efficacité des jetons | Moins de jetons de sortie, d'étapes de raisonnement, de tours et d'appels d'outils | Coût potentiellement plus bas par tâche complétée plutôt que par jeton seulement |
| Raisonnement multimodal | Interprétation de graphiques améliorée, conversion de plans et compréhension de la disposition multi-éléments | Flux de travail documentaires, visuels et spatiaux plus performants |
| Utilisation de l'ordinateur | Support natif des outils, actuellement marqué comme Aperçu dans la documentation du modèle | Peut alimenter les flux de travail d'automatisation de navigateur et d'interface pris en charge |
| Prix de sortie | 7,50 $ par million de jetons au lieu de 9,00 $ pour Gemini 3.5 Flash | Une réduction de 16,7 % du taux standard des jetons de sortie |
| Configuration de l'API | Les paramètres d'échantillonnage tels que temperature, top_p et top_k sont obsolètes |
Les intégrations existantes nécessitent une revue de configuration, pas seulement un changement d'ID de modèle |
Il y a une nuance pour le travail frontend. La documentation de migration de Google indique que Gemini 3.6 Flash tend à inspecter un projet par programme avant d'effectuer des modifications. Cela peut améliorer la correction sur des tâches complexes, mais cela peut ajouter des étapes exploratoires à une simple modification visuelle. Google note également que les évaluateurs humains préféraient parfois les modèles précédents pour le style, de sorte que des instructions de conception explicites restent précieuses.
Benchmarks de Gemini 3.6 Flash
Les données de lancement de Google montrent des gains par rapport à Gemini 3.5 Flash dans les tâches de codage, d'ingénierie en apprentissage automatique, de travail de connaissance et d'utilisation d'ordinateur. Ces benchmarks utilisent différentes méthodes de notation, donc leurs valeurs ne doivent pas être moyennées en un seul pourcentage global. Chaque résultat est une preuve pour un type de charge de travail spécifique.
| Benchmark | Ce qu'il teste | Gemini 3.5 Flash | Gemini 3.6 Flash |
|---|---|---|---|
| DeepSWE v1.1 | Agents d'ingénierie logicielle à long terme | 37% | 49% |
| MLE-Bench | Tâches d'ingénierie et de recherche en apprentissage automatique | 49.7% | 63.9% |
| OSWorld-Verified | Utilisation de l'ordinateur dans des environnements de bureau réels | 78.4% | 83.0% |
| GDPval-AA v2 | Qualité des tâches de travail de connaissance | 1349 | 1421 |

Source: blog.google
Les gains publiés les plus forts apparaissent dans l'ingénierie logicielle à long terme et l'ingénierie en apprentissage automatique, tandis que les performances d'utilisation de l'ordinateur augmentent également.
Comment lire ces résultats de benchmark
- DeepSWE est important pour le codage autonome : il est plus pertinent pour le travail à l'échelle du référentiel qu'une courte question de codage autonome.
- MLE-Bench mesure un flux de travail spécialisé : le résultat est utile pour les agents de science des données et d'apprentissage automatique, mais pas pour un score de chatbot général.
- OSWorld-Verified teste les actions : un score plus élevé soutient le récit de l'utilisation de l'ordinateur, bien que la capacité API associée soit toujours marquée comme Aperçu.
- GDPval-AA n'est pas un pourcentage : c'est une évaluation comparative du travail de connaissance et doit être lue dans le cadre de la méthodologie de ce benchmark.
L'efficacité des jetons fait partie de l'histoire des benchmarks
Les scores bruts des tâches ne montrent pas combien de jetons ou d'appels d'outils ont été nécessaires pour obtenir le résultat. Google indique que Gemini 3.6 Flash a généré 17 % de jetons de sortie en moins que Gemini 3.5 Flash sur l'Artificial Analysis Intelligence Index. Sur DeepSWE, l'entreprise rapporte une réduction plus importante : les jetons de sortie moyens par tâche sont passés d'environ 276 000 à 97 000, soit une diminution d'environ 65 %.
Artificial Analysis liste indépendamment la configuration de haute réflexion de Gemini 3.6 Flash avec un score d'Intelligence Index de 50 et une fenêtre de contexte d'un million de jetons. Les résultats des benchmarks peuvent changer à mesure que les évaluateurs mettent à jour les invites, les harnais et les versions de modèles, de sorte que les tests de production avec des tâches représentatives restent plus importants qu'une position dans le classement.

Source: blog.google
La réduction de l'utilisation des jetons de sortie peut réduire le coût des longues boucles d'agents, en particulier lorsque le modèle raisonne, modifie des fichiers et appelle des outils de manière répétée avant de terminer.
Prix de Gemini 3.6 Flash
Le tarif standard publié par Google est de 1,50 $ par million de jetons d'entrée et de 7,50 $ par million de jetons de sortie. Le tarif d'entrée est inchangé par rapport à Gemini 3.5 Flash, tandis que le tarif de sortie passe de 9,00 $ à 7,50 $. Les entrées mises en cache sont listées à 0,15 $ par million de jetons sur la page de prix de la plateforme d'agents de Google Cloud.
| Option de consommation | Entrée par 1 million de jetons | Sortie par 1 million de jetons | Utilisation typique |
|---|---|---|---|
| Standard | $1.50 | $7.50 | Trafic API interactif et de production normal |
| Prioritaire | $2.70 | $13.50 | Charges de travail qui paient plus pour une capacité d'inférence prioritaire |
| Flex ou Batch | $0.75 | $3.75 | Traitement tolérant aux retards ou asynchrone |
Exemples de calculs aux prix standard
| Exemple d'utilisation mensuelle | Coût d'entrée | Coût de sortie | Total estimé |
|---|---|---|---|
| 10 millions d'entrées et 1 million de sorties | $15.00 | $7.50 | $22.50 |
| 50 millions d'entrées et 5 millions de sorties | $75.00 | $37.50 | $112.50 |
| 100 millions d'entrées et 20 millions de sorties | $150.00 | $150.00 | $300.00 |
Ces exemples couvrent uniquement les jetons du modèle. L'ancrage de recherche, l'utilisation de l'ordinateur, l'exécution de code, les services externes et d'autres composants de la plateforme peuvent ajouter des coûts ou de la latence. La métrique interne la plus utile est donc le coût par tâche complétée avec succès, y compris les nouvelles tentatives et les appels d'outils, plutôt que le tarif des jetons seul.
Disponibilité : où pouvez-vous utiliser Gemini 3.6 Flash ?
Gemini 3.6 Flash était disponible dès le jour du lancement sur les surfaces grand public, développeurs et entreprise de Google. Les limites d'utilisation exactes, l'accès régional et les contrôles de sélection de modèle peuvent différer selon le produit, l'abonnement et le compte.
| Groupe d'utilisateurs | Disponible via | Détail important |
|---|---|---|
| Développeurs | API Gemini, Google AI Studio et Android Studio | Utilisez l'ID de modèle stable gemini-3.6-flash |
| Développeurs d'agents | Google Antigravity et Gemini Managed Agents | Google a fait de 3.6 Flash le modèle par défaut pour l'agent géré Antigravity |
| Entreprises | Plateforme d'agents d'entreprise Gemini et application Gemini Enterprise | La facturation d'entreprise, la gouvernance et les paramètres régionaux s'appliquent |
| Utilisateurs généraux | Application Gemini | Les limites d'accès et d'utilisation peuvent dépendre du compte et du niveau d'abonnement |

Source: blog.google
Les journaux et ensembles de données d'AI Studio peuvent aider les équipes à comparer le comportement des modèles, à inspecter les requêtes échouées et à construire des ensembles d'évaluation reproductibles avant de modifier un déploiement de production.
Gemini 3.6 Flash ne doit pas être confondu avec Gemini 3.5 Flash-Lite ou Gemini 3.5 Flash Cyber. Flash-Lite est l'option à faible coût et à haut débit. Flash Cyber est un modèle de sécurité spécialisé prévu pour les gouvernements et les partenaires de confiance via un pilote CodeMender à accès limité, et non un remplacement généralement disponible pour 3.6 Flash.
Fenêtre de contexte, entrées et outils supportés
| Spécification | Gemini 3.6 Flash |
|---|---|
| Types d'entrée | Texte, image, vidéo, audio et PDF |
| Type de sortie | Texte |
| Limite de jetons d'entrée | 1 048 576 jetons |
| Limite de jetons de sortie | 65 536 jetons |
| Capacités supportées | Mise en cache, exécution de code, recherche de fichiers, appel de fonctions, ancrage de recherche, ancrage Maps, sortie structurée, réflexion et contexte URL |
| Utilisation de l'ordinateur | Pris en charge en Aperçu |
| Options de consommation | Standard, API Batch, inférence Flex et inférence Prioritaire |
| Non pris en charge | Génération d'images, génération audio et API Live |
La fenêtre de contexte d'un million de jetons est utile pour les grands ensembles de documents, les référentiels de code, les transcriptions et les enregistrements multimodaux. Elle ne garantit pas un rappel parfait à chaque position dans une longue invite, et l'envoi du contexte maximum peut augmenter les coûts et la latence. La récupération, la recherche de fichiers et la segmentation des invites peuvent toujours produire un système de production plus fiable.

Source: blog.google
File Search est l'un des outils intégrés pris en charge par Gemini 3.6 Flash et peut ancrer les réponses dans les documents de projet indexés au lieu de placer chaque fichier directement dans chaque invite.
Quels outils intégrés sont les plus importants ?
- File Search : utile pour la récupération sur des documents internes, des manuels et des bases de connaissances.
- Exécution de code : permet au modèle de calculer, de transformer des données et de vérifier des parties d'une réponse par programme.
- Appel de fonctions : connecte le modèle à des actions et des sources de données spécifiques à l'application.
- Ancrage de recherche Google et Maps : ajoute des informations actuelles ou dépendantes de la localisation lorsque cela est pris en charge.
- Utilisation de l'ordinateur : permet l'automatisation des interfaces, mais reste une capacité d'Aperçu et nécessite des autorisations et une validation attentives.
Liste de contrôle de migration pour Gemini 3.6 Flash
- Modifiez l'ID du modèle cible en
gemini-3.6-flashdans un environnement de test. - Supprimez les champs d'échantillonnage obsolètes tels que
temperature,top_pettop_k. - Remplacez les anciens paramètres de budget de réflexion par un
thinking_levelapproprié. - Supprimez les tours de modèle pré-remplis et revoyez la gestion de l'état multi-tours.
- Ré-testez les appels de fonctions, les réponses des outils et les schémas de sortie structurée.
- Comparez le succès des tâches, la latence, les jetons d'entrée, les jetons de sortie, les tours et les appels d'outils avec le modèle de production actuel.
- Utilisez un déploiement progressif et conservez un chemin de retour arrière jusqu'à ce que les charges de travail représentatives soient stables.
Devriez-vous migrer de Gemini 3.5 Flash ?
Gemini 3.6 Flash est la cible de migration logique lorsque une application dépend d'agents de codage, d'utilisation d'outils multi-étapes, d'interaction avec l'ordinateur, d'analyse de documents ou de raisonnement visuel et spatial. Le prix de sortie plus bas et la tendance réduite à boucler sont particulièrement pertinents pour les agents qui peuvent appeler le modèle de manière répétée avant de compléter une requête utilisateur.
| Charge de travail | Meilleure orientation actuelle | Raison |
|---|---|---|
| Agent de codage à l'échelle du référentiel | Testez Gemini 3.6 Flash | Précision de codage améliorée et moins de boucles d'exécution |
| Analyse multimodale de documents et de graphiques | Testez Gemini 3.6 Flash | Résultats multimodaux et de travail de connaissance publiés plus performants |
| Classification ou extraction à haut volume | Comparer avec Gemini 3.5 Flash-Lite | Flash-Lite est conçu pour un débit à moindre coût |
| Génération d'images | Choisissez un autre modèle Gemini | Gemini 3.6 Flash produit uniquement des sorties textuelles |
| Application vocale en temps réel | Utilisez un modèle compatible avec l'API Live | L'API Live n'est pas prise en charge par Gemini 3.6 Flash |
| Pipeline hérité stable sans problèmes de qualité | Benchmark avant de migrer | Un changement n'est utile que lorsque la qualité, la latence ou le coût s'améliorent sur la charge de travail réelle |
Pour une perspective plus large de sélection de modèles, le guide de Zerlo Comparaison technique Gemini vs. Claude explique les différents compromis entre l'écosystème de Google et les modèles d'Anthropic. Les utilisateurs axés sur les assistants réutilisables plutôt que sur le déploiement d'API peuvent également trouver le guide Gemini Gems utile.
FAQ
Quand Gemini 3.6 Flash a-t-il été publié ?
Google a annoncé et publié Gemini 3.6 Flash le 21 juillet 2026. Il est devenu généralement disponible via les produits Gemini pour développeurs, entreprises et consommateurs.
Quel est le nom du modèle API de Gemini 3.6 Flash ?
L'ID de modèle stable est gemini-3.6-flash. La documentation du modèle de Google le répertorie comme une version stable plutôt qu'un alias d'aperçu uniquement.
Combien coûte Gemini 3.6 Flash ?
Le prix standard est de 1,50 $ par million de jetons d'entrée et de 7,50 $ par million de jetons de sortie. Google Cloud liste également des tarifs Flex ou Batch plus bas et des tarifs Priority plus élevés. Les outils et autres services de plateforme peuvent entraîner des frais supplémentaires.
Gemini 3.6 Flash est-il moins cher que Gemini 3.5 Flash ?
Oui pour les jetons de sortie standards. Le prix d'entrée reste de 1,50 $ par million de jetons, tandis que le prix de sortie passe de 9,00 $ à 7,50 $ par million de jetons. Google rapporte également une utilisation réduite des jetons de sortie dans ses évaluations.
Gemini 3.6 Flash prend-il en charge les images, l'audio et la vidéo ?
Il accepte le texte, les images, la vidéo, l'audio et les documents PDF en entrée. Sa sortie est du texte. Il ne prend pas en charge la génération d'images, la génération audio ou l'API Live.
Gemini 3.6 Flash est-il disponible dans l'application Gemini ?
Oui. Google a listé l'application Gemini parmi les surfaces de lancement. Les limites spécifiques au compte, les détails de déploiement régionaux et les contrôles de sélection de modèle peuvent toujours varier.
Gemini 3.6 Flash prend-il en charge l'utilisation de l'ordinateur ?
Oui, mais Google marque l'utilisation de l'ordinateur comme une capacité d'Aperçu dans la documentation du modèle. Les systèmes de production doivent limiter les autorisations, valider les actions et conserver la confirmation humaine pour les opérations critiques.
Gemini 3.6 Flash est-il meilleur que Gemini 3.5 Flash ?
Les évaluations publiées par Google montrent des scores plus élevés en codage, en ingénierie d'apprentissage automatique, en travail de connaissance et en utilisation d'ordinateur, ainsi qu'une consommation de jetons de sortie plus faible. L'avantage pratique dépend de la charge de travail, de sorte que les équipes doivent effectuer des tests représentatifs avant de modifier le trafic de production.
Conclusion
Gemini 3.6 Flash est une mise à niveau significative axée sur l'efficacité plutôt qu'un changement de version cosmétique. Il améliore les résultats publiés par Google en matière de codage d'agents, d'ingénierie d'apprentissage automatique, de travail de connaissance et d'utilisation d'ordinateur, tout en réduisant le prix standard des jetons de sortie de 9,00 $ à 7,50 $ par million de jetons. Son argument le plus fort n'est pas simplement que chaque jeton est moins cher, mais que de nombreuses tâches multi-étapes peuvent nécessiter moins de jetons, de tours et d'appels d'outils.
Les développeurs devraient le considérer comme le principal candidat à la migration pour les charges de travail Gemini 3.5 Flash qui dépendent du code, des outils ou du raisonnement multimodal. Flash-Lite reste plus adapté à l'exécution de masse la moins chère, et Gemini 3.6 Flash n'est pas le bon modèle pour la génération d'images, la sortie audio native ou l'utilisation de l'API Live. Les gains de benchmark sont prometteurs, mais les décisions de production devraient toujours être basées sur la précision, la latence, la sécurité et le coût total spécifiques à la tâche.