Gemini 3.6 Flash : benchmarks, prix, disponibilité et changements

Avatar
Lisa Ernst · 23.07.2026 · Intelligence Artificielle · 14 min de lecture

Google a publié Gemini 3.6 Flash le 21 juillet 2026 comme nouveau cheval de bataille généraliste dans sa gamme Flash. Le modèle cible le codage, l'analyse multimodale, les agents d'utilisation d'ordinateur et les flux de travail multi-étapes, tout en réduisant la consommation de jetons de sortie et en baissant le prix des jetons de sortie par rapport à Gemini 3.5 Flash.

Les chiffres principaux sont considérables : Google rapporte 49 % sur DeepSWE, 63,9 % sur MLE-Bench et 83,0 % sur OSWorld-Verified. Le prix standard de l'API est de 1,50 $ par million de jetons d'entrée et 7,50 $ par million de jetons de sortie. Ce guide explique les benchmarks, les niveaux de prix, la disponibilité, les changements d'API, les outils supportés et les raisons pratiques de migrer.

Points clés à retenir

Gemini 3.6 Flash en un coup d'œil

Catégorie Gemini 3.6 Flash
Rôle principal Modèle de raisonnement généraliste rapide pour les charges de travail d'agents et multimodales
Identifiant d'API stable gemini-3.6-flash
Niveau de réflexion par défaut Moyen
Modalités d'entrée Texte, image, vidéo, audio et PDF
Modalité de sortie Texte
Statut de production Généralement disponible

Qu'est-ce que Gemini 3.6 Flash ?

Gemini 3.6 Flash est un modèle de raisonnement multimodal propriétaire de la famille Flash de Google, axée sur la vitesse et l'efficacité. Google le positionne pour les charges de travail d'agents du monde réel : génération de code, appel de fonctions, utilisation d'ordinateurs, raisonnement spatial, analyse de documents et flux de travail qui peuvent nécessiter plusieurs étapes avant qu'une réponse finale soit prête.

Le modèle n'est pas simplement une version 3.5 renommée. Google affirme qu'il a été peaufiné en fonction des retours des développeurs concernant la verbosité, les modifications de code indésirables et les boucles d'exécution qui consommaient des jetons de raisonnement et des appels d'outils supplémentaires. L'amélioration prévue est donc double : meilleure qualité des tâches et moins de travail requis pour atteindre le résultat.

For developers starting with Google’s platform, Zerlo’s guide pour obtenir une clé API Gemini explique la configuration du compte et de Google AI Studio. Le nom du modèle à sélectionner dans une requête d'API est gemini-3.6-flash.

Qu'est-ce qui a changé par rapport à Gemini 3.5 Flash ?

Domaine Modification de Gemini 3.6 Flash Effet pratique
Codage Précision accrue, moins de modifications de fichiers involontaires et moins de boucles de débogage Mieux adapté aux migrations et au développement itératif d'agents
Efficacité des jetons Moins de jetons de sortie, d'étapes de raisonnement, de tours et d'appels d'outils Coût potentiellement plus bas par tâche complétée plutôt que par jeton seulement
Raisonnement multimodal Interprétation de graphiques améliorée, conversion de plans et compréhension de la disposition multi-éléments Flux de travail documentaires, visuels et spatiaux plus performants
Utilisation de l'ordinateur Support natif des outils, actuellement marqué comme Aperçu dans la documentation du modèle Peut alimenter les flux de travail d'automatisation de navigateur et d'interface pris en charge
Prix de sortie 7,50 $ par million de jetons au lieu de 9,00 $ pour Gemini 3.5 Flash Une réduction de 16,7 % du taux standard des jetons de sortie
Configuration de l'API Les paramètres d'échantillonnage tels que temperature, top_p et top_k sont obsolètes Les intégrations existantes nécessitent une revue de configuration, pas seulement un changement d'ID de modèle

Il y a une nuance pour le travail frontend. La documentation de migration de Google indique que Gemini 3.6 Flash tend à inspecter un projet par programme avant d'effectuer des modifications. Cela peut améliorer la correction sur des tâches complexes, mais cela peut ajouter des étapes exploratoires à une simple modification visuelle. Google note également que les évaluateurs humains préféraient parfois les modèles précédents pour le style, de sorte que des instructions de conception explicites restent précieuses.

Benchmarks de Gemini 3.6 Flash

Les données de lancement de Google montrent des gains par rapport à Gemini 3.5 Flash dans les tâches de codage, d'ingénierie en apprentissage automatique, de travail de connaissance et d'utilisation d'ordinateur. Ces benchmarks utilisent différentes méthodes de notation, donc leurs valeurs ne doivent pas être moyennées en un seul pourcentage global. Chaque résultat est une preuve pour un type de charge de travail spécifique.

Benchmark Ce qu'il teste Gemini 3.5 Flash Gemini 3.6 Flash
DeepSWE v1.1 Agents d'ingénierie logicielle à long terme 37% 49%
MLE-Bench Tâches d'ingénierie et de recherche en apprentissage automatique 49.7% 63.9%
OSWorld-Verified Utilisation de l'ordinateur dans des environnements de bureau réels 78.4% 83.0%
GDPval-AA v2 Qualité des tâches de travail de connaissance 1349 1421
Graphique officiel de Google comparant Gemini 3.6 Flash avec les modèles Gemini précédents sur des benchmarks d'agents

Source: blog.google

Les gains publiés les plus forts apparaissent dans l'ingénierie logicielle à long terme et l'ingénierie en apprentissage automatique, tandis que les performances d'utilisation de l'ordinateur augmentent également.

Comment lire ces résultats de benchmark

L'efficacité des jetons fait partie de l'histoire des benchmarks

Les scores bruts des tâches ne montrent pas combien de jetons ou d'appels d'outils ont été nécessaires pour obtenir le résultat. Google indique que Gemini 3.6 Flash a généré 17 % de jetons de sortie en moins que Gemini 3.5 Flash sur l'Artificial Analysis Intelligence Index. Sur DeepSWE, l'entreprise rapporte une réduction plus importante : les jetons de sortie moyens par tâche sont passés d'environ 276 000 à 97 000, soit une diminution d'environ 65 %.

Artificial Analysis liste indépendamment la configuration de haute réflexion de Gemini 3.6 Flash avec un score d'Intelligence Index de 50 et une fenêtre de contexte d'un million de jetons. Les résultats des benchmarks peuvent changer à mesure que les évaluateurs mettent à jour les invites, les harnais et les versions de modèles, de sorte que les tests de production avec des tâches représentatives restent plus importants qu'une position dans le classement.

Graphique officiel de Google comparant les jetons de sortie moyens utilisés par Gemini 3.5 Flash et Gemini 3.6 Flash

Source: blog.google

La réduction de l'utilisation des jetons de sortie peut réduire le coût des longues boucles d'agents, en particulier lorsque le modèle raisonne, modifie des fichiers et appelle des outils de manière répétée avant de terminer.

Prix de Gemini 3.6 Flash

Le tarif standard publié par Google est de 1,50 $ par million de jetons d'entrée et de 7,50 $ par million de jetons de sortie. Le tarif d'entrée est inchangé par rapport à Gemini 3.5 Flash, tandis que le tarif de sortie passe de 9,00 $ à 7,50 $. Les entrées mises en cache sont listées à 0,15 $ par million de jetons sur la page de prix de la plateforme d'agents de Google Cloud.

Option de consommation Entrée par 1 million de jetons Sortie par 1 million de jetons Utilisation typique
Standard $1.50 $7.50 Trafic API interactif et de production normal
Prioritaire $2.70 $13.50 Charges de travail qui paient plus pour une capacité d'inférence prioritaire
Flex ou Batch $0.75 $3.75 Traitement tolérant aux retards ou asynchrone

Exemples de calculs aux prix standard

Exemple d'utilisation mensuelle Coût d'entrée Coût de sortie Total estimé
10 millions d'entrées et 1 million de sorties $15.00 $7.50 $22.50
50 millions d'entrées et 5 millions de sorties $75.00 $37.50 $112.50
100 millions d'entrées et 20 millions de sorties $150.00 $150.00 $300.00

Ces exemples couvrent uniquement les jetons du modèle. L'ancrage de recherche, l'utilisation de l'ordinateur, l'exécution de code, les services externes et d'autres composants de la plateforme peuvent ajouter des coûts ou de la latence. La métrique interne la plus utile est donc le coût par tâche complétée avec succès, y compris les nouvelles tentatives et les appels d'outils, plutôt que le tarif des jetons seul.

Disponibilité : où pouvez-vous utiliser Gemini 3.6 Flash ?

Gemini 3.6 Flash était disponible dès le jour du lancement sur les surfaces grand public, développeurs et entreprise de Google. Les limites d'utilisation exactes, l'accès régional et les contrôles de sélection de modèle peuvent différer selon le produit, l'abonnement et le compte.

Groupe d'utilisateurs Disponible via Détail important
Développeurs API Gemini, Google AI Studio et Android Studio Utilisez l'ID de modèle stable gemini-3.6-flash
Développeurs d'agents Google Antigravity et Gemini Managed Agents Google a fait de 3.6 Flash le modèle par défaut pour l'agent géré Antigravity
Entreprises Plateforme d'agents d'entreprise Gemini et application Gemini Enterprise La facturation d'entreprise, la gouvernance et les paramètres régionaux s'appliquent
Utilisateurs généraux Application Gemini Les limites d'accès et d'utilisation peuvent dépendre du compte et du niveau d'abonnement
Interface officielle de Google AI Studio montrant les journaux d'API et les ensembles de données à côté d'une application alimentée par Gemini

Source: blog.google

Les journaux et ensembles de données d'AI Studio peuvent aider les équipes à comparer le comportement des modèles, à inspecter les requêtes échouées et à construire des ensembles d'évaluation reproductibles avant de modifier un déploiement de production.

Gemini 3.6 Flash ne doit pas être confondu avec Gemini 3.5 Flash-Lite ou Gemini 3.5 Flash Cyber. Flash-Lite est l'option à faible coût et à haut débit. Flash Cyber est un modèle de sécurité spécialisé prévu pour les gouvernements et les partenaires de confiance via un pilote CodeMender à accès limité, et non un remplacement généralement disponible pour 3.6 Flash.

Fenêtre de contexte, entrées et outils supportés

Spécification Gemini 3.6 Flash
Types d'entrée Texte, image, vidéo, audio et PDF
Type de sortie Texte
Limite de jetons d'entrée 1 048 576 jetons
Limite de jetons de sortie 65 536 jetons
Capacités supportées Mise en cache, exécution de code, recherche de fichiers, appel de fonctions, ancrage de recherche, ancrage Maps, sortie structurée, réflexion et contexte URL
Utilisation de l'ordinateur Pris en charge en Aperçu
Options de consommation Standard, API Batch, inférence Flex et inférence Prioritaire
Non pris en charge Génération d'images, génération audio et API Live

La fenêtre de contexte d'un million de jetons est utile pour les grands ensembles de documents, les référentiels de code, les transcriptions et les enregistrements multimodaux. Elle ne garantit pas un rappel parfait à chaque position dans une longue invite, et l'envoi du contexte maximum peut augmenter les coûts et la latence. La récupération, la recherche de fichiers et la segmentation des invites peuvent toujours produire un système de production plus fiable.

Illustration officielle de Google montrant des fichiers entrant dans l'outil File Search de l'API Gemini

Source: blog.google

File Search est l'un des outils intégrés pris en charge par Gemini 3.6 Flash et peut ancrer les réponses dans les documents de projet indexés au lieu de placer chaque fichier directement dans chaque invite.

Quels outils intégrés sont les plus importants ?

Liste de contrôle de migration pour Gemini 3.6 Flash

  1. Modifiez l'ID du modèle cible en gemini-3.6-flash dans un environnement de test.
  2. Supprimez les champs d'échantillonnage obsolètes tels que temperature, top_p et top_k.
  3. Remplacez les anciens paramètres de budget de réflexion par un thinking_level approprié.
  4. Supprimez les tours de modèle pré-remplis et revoyez la gestion de l'état multi-tours.
  5. Ré-testez les appels de fonctions, les réponses des outils et les schémas de sortie structurée.
  6. Comparez le succès des tâches, la latence, les jetons d'entrée, les jetons de sortie, les tours et les appels d'outils avec le modèle de production actuel.
  7. Utilisez un déploiement progressif et conservez un chemin de retour arrière jusqu'à ce que les charges de travail représentatives soient stables.

Devriez-vous migrer de Gemini 3.5 Flash ?

Gemini 3.6 Flash est la cible de migration logique lorsque une application dépend d'agents de codage, d'utilisation d'outils multi-étapes, d'interaction avec l'ordinateur, d'analyse de documents ou de raisonnement visuel et spatial. Le prix de sortie plus bas et la tendance réduite à boucler sont particulièrement pertinents pour les agents qui peuvent appeler le modèle de manière répétée avant de compléter une requête utilisateur.

Charge de travail Meilleure orientation actuelle Raison
Agent de codage à l'échelle du référentiel Testez Gemini 3.6 Flash Précision de codage améliorée et moins de boucles d'exécution
Analyse multimodale de documents et de graphiques Testez Gemini 3.6 Flash Résultats multimodaux et de travail de connaissance publiés plus performants
Classification ou extraction à haut volume Comparer avec Gemini 3.5 Flash-Lite Flash-Lite est conçu pour un débit à moindre coût
Génération d'images Choisissez un autre modèle Gemini Gemini 3.6 Flash produit uniquement des sorties textuelles
Application vocale en temps réel Utilisez un modèle compatible avec l'API Live L'API Live n'est pas prise en charge par Gemini 3.6 Flash
Pipeline hérité stable sans problèmes de qualité Benchmark avant de migrer Un changement n'est utile que lorsque la qualité, la latence ou le coût s'améliorent sur la charge de travail réelle

Pour une perspective plus large de sélection de modèles, le guide de Zerlo Comparaison technique Gemini vs. Claude explique les différents compromis entre l'écosystème de Google et les modèles d'Anthropic. Les utilisateurs axés sur les assistants réutilisables plutôt que sur le déploiement d'API peuvent également trouver le guide Gemini Gems utile.

FAQ

Quand Gemini 3.6 Flash a-t-il été publié ?

Google a annoncé et publié Gemini 3.6 Flash le 21 juillet 2026. Il est devenu généralement disponible via les produits Gemini pour développeurs, entreprises et consommateurs.

Quel est le nom du modèle API de Gemini 3.6 Flash ?

L'ID de modèle stable est gemini-3.6-flash. La documentation du modèle de Google le répertorie comme une version stable plutôt qu'un alias d'aperçu uniquement.

Combien coûte Gemini 3.6 Flash ?

Le prix standard est de 1,50 $ par million de jetons d'entrée et de 7,50 $ par million de jetons de sortie. Google Cloud liste également des tarifs Flex ou Batch plus bas et des tarifs Priority plus élevés. Les outils et autres services de plateforme peuvent entraîner des frais supplémentaires.

Gemini 3.6 Flash est-il moins cher que Gemini 3.5 Flash ?

Oui pour les jetons de sortie standards. Le prix d'entrée reste de 1,50 $ par million de jetons, tandis que le prix de sortie passe de 9,00 $ à 7,50 $ par million de jetons. Google rapporte également une utilisation réduite des jetons de sortie dans ses évaluations.

Gemini 3.6 Flash prend-il en charge les images, l'audio et la vidéo ?

Il accepte le texte, les images, la vidéo, l'audio et les documents PDF en entrée. Sa sortie est du texte. Il ne prend pas en charge la génération d'images, la génération audio ou l'API Live.

Gemini 3.6 Flash est-il disponible dans l'application Gemini ?

Oui. Google a listé l'application Gemini parmi les surfaces de lancement. Les limites spécifiques au compte, les détails de déploiement régionaux et les contrôles de sélection de modèle peuvent toujours varier.

Gemini 3.6 Flash prend-il en charge l'utilisation de l'ordinateur ?

Oui, mais Google marque l'utilisation de l'ordinateur comme une capacité d'Aperçu dans la documentation du modèle. Les systèmes de production doivent limiter les autorisations, valider les actions et conserver la confirmation humaine pour les opérations critiques.

Gemini 3.6 Flash est-il meilleur que Gemini 3.5 Flash ?

Les évaluations publiées par Google montrent des scores plus élevés en codage, en ingénierie d'apprentissage automatique, en travail de connaissance et en utilisation d'ordinateur, ainsi qu'une consommation de jetons de sortie plus faible. L'avantage pratique dépend de la charge de travail, de sorte que les équipes doivent effectuer des tests représentatifs avant de modifier le trafic de production.

Conclusion

Gemini 3.6 Flash est une mise à niveau significative axée sur l'efficacité plutôt qu'un changement de version cosmétique. Il améliore les résultats publiés par Google en matière de codage d'agents, d'ingénierie d'apprentissage automatique, de travail de connaissance et d'utilisation d'ordinateur, tout en réduisant le prix standard des jetons de sortie de 9,00 $ à 7,50 $ par million de jetons. Son argument le plus fort n'est pas simplement que chaque jeton est moins cher, mais que de nombreuses tâches multi-étapes peuvent nécessiter moins de jetons, de tours et d'appels d'outils.

Les développeurs devraient le considérer comme le principal candidat à la migration pour les charges de travail Gemini 3.5 Flash qui dépendent du code, des outils ou du raisonnement multimodal. Flash-Lite reste plus adapté à l'exécution de masse la moins chère, et Gemini 3.6 Flash n'est pas le bon modèle pour la génération d'images, la sortie audio native ou l'utilisation de l'API Live. Les gains de benchmark sont prometteurs, mais les décisions de production devraient toujours être basées sur la précision, la latence, la sécurité et le coût total spécifiques à la tâche.

Partagez notre article !
Sources