
Gemini 3.6 Flash Family
La famille Gemini 3.6 Flash est la gamme Flash de Google, économe en jetons et à faible latence, pour la mise à l'échelle des agents IA de production – comprenant 3.6 Flash pour un travail de meilleure qualité avec moins de jetons, 3.5 Flash-Lite pour des tâches ultra-rapides à haut débit, et un 3.5 Flash Cyber restreint pour la détection et la correction des vulnérabilités via CodeMender.
https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/?ref=producthunt&utm_source=aipure

Informations sur le produit
Mis à jour:Jul 23, 2026
Tendances du trafic mensuel de Gemini 3.6 Flash Family
Gemini 3.6 Flash Family a reçu 8.5m visites le mois dernier, démontrant une Légère baisse de -12.1%. Selon notre analyse, cette tendance s'aligne avec la dynamique typique du marché dans le secteur des outils d'IA.
Voir l'historique du traficQu'est-ce que Gemini 3.6 Flash Family
La famille Gemini 3.6 Flash est un ensemble de modèles Gemini « Flash » introduits par Google pour aider les développeurs et les entreprises à exécuter des agents IA plus efficacement en production, en priorisant une latence plus faible, une fiabilité plus élevée et un meilleur coût par tâche plutôt que de maximiser la taille brute du modèle. Annoncée le 21 juillet 2026, la famille comprend Gemini 3.6 Flash (le cheval de bataille polyvalent pour le codage, le travail de connaissance et les tâches multimodales), Gemini 3.5 Flash-Lite (le modèle de classe 3.5 le plus rapide et le plus rentable pour les charges de travail à volume élevé), et Gemini 3.5 Flash Cyber (une variante spécialisée dans la cybersécurité disponible uniquement via un pilote CodeMender à accès limité pour les gouvernements et les partenaires de confiance). Ces modèles sont positionnés pour prendre en charge des flux de travail agiles évolutifs sur les outils de développement et les interfaces d'entreprise, avec 3.6 Flash et 3.5 Flash-Lite disponibles via l'API Gemini (Google AI Studio et Android Studio) et des intégrations de produits plus larges.
Caractéristiques principales de Gemini 3.6 Flash Family
La famille Gemini 3.6 Flash est la gamme Flash de Google axée sur l'efficacité pour la création et l'exécution d'agents d'IA de production à grande échelle, comprenant Gemini 3.6 Flash (le modèle de base), Gemini 3.5 Flash-Lite (l'option 3.5 la plus rapide et la plus rentable), et Gemini 3.5 Flash Cyber (une variante axée sur la cybersécurité déployée au sein de CodeMender). Au sein de cette famille, l'accent est mis sur une latence plus faible, un débit plus élevé, une meilleure efficacité des jetons et une exécution agentique fiable (y compris des outils d'utilisation informatique intégrés via l'API Gemini/Enterprise). Gemini 3.6 Flash améliore spécifiquement le codage, le travail de connaissance et les performances multimodales tout en utilisant moins de jetons de sortie et en coûtant moins par jeton de sortie que 3.5 Flash, et il est livré avec des mesures de sécurité Frontier Safety améliorées pour les abus CBRN et de cyber-offense. Flash-Lite cible les charges de travail à volume élevé et sensibles à la latence avec des niveaux de réflexion configurables et un excellent rapport qualité-prix. Flash Cyber est intentionnellement restreint en accès en raison du risque de double usage et est proposé via un pilote CodeMender à accès limité pour les gouvernements et les partenaires de confiance.
Performances « cheval de bataille » efficaces en jetons (3.6 Flash): Offre de meilleures capacités de codage, de travail de connaissance et multimodales tout en réduisant l'utilisation des jetons de sortie (17 % de jetons de sortie en moins que 3.5 Flash sur l'Artificial Analysis Index, et jusqu'à 65 % en moins dans certains benchmarks comme DeepSWE), aidant à réduire les coûts d'agent par tâche.
Tarification plus basse pour les charges de travail agentiques à grande échelle (3.6 Flash): Prix de 1,50 $ par million de jetons d'entrée et 7,50 $ par million de jetons de sortie (coût de sortie inférieur à 3.5 Flash), visant à rendre les flux de travail d'agent en plusieurs étapes plus rentables en production.
Option de modèle à haut débit et faible latence (3.5 Flash-Lite): Conçu pour les tâches sensibles à la latence et à volume élevé (par exemple, recherche agentique, traitement de documents), avec un débit rapporté d'environ 350 jetons de sortie/seconde et une tarification agressive (0,30 $ par million de jetons d'entrée, 2,50 $ par million de jetons de sortie).
Niveaux de réflexion configurables pour le contrôle des coûts/de la qualité (3.5 Flash-Lite): Prend en charge des niveaux de réflexion ajustables afin que les développeurs puissent choisir une réflexion minimale/faible pour des tâches rapides et peu coûteuses à volume élevé ou une réflexion plus élevée pour des charges de travail de sous-agents en plusieurs étapes.
Outils d'utilisation informatique intégrés pour les agents (3.6 Flash & 3.5 Flash-Lite): L'utilisation informatique est disponible en tant qu'outil client intégré via l'API Gemini et Gemini Enterprise, améliorant l'exécution des tâches du monde réel dans les flux de travail agentiques (par exemple, des améliorations vérifiées par OSWorld rapportées pour 3.6 Flash).
Spécialiste de la cybersécurité déployé via CodeMender (3.5 Flash Cyber): Un modèle basé sur 3.5 Flash, axé sur la cybersécurité, affiné pour trouver, valider et corriger efficacement les vulnérabilités ; orchestré comme plusieurs agents au sein de CodeMender pour produire des rapports de sécurité consolidés et des performances de benchmark CyberGym compétitives, mais restreint à un pilote à accès limité (gouvernements et partenaires de confiance) en raison de préoccupations de double usage.
Cas d'utilisation de Gemini 3.6 Flash Family
Agents d'ingénierie logicielle (codage, débogage, refactoring): Utilisez 3.6 Flash comme moteur de codage de production pour générer des correctifs avec moins de modifications indésirables et moins de boucles d'exécution, prenant en charge la révision de code automatisée, la génération de tests et les tâches d'ingénierie en plusieurs étapes.
Travail de connaissance d'entreprise et analyse multimodale: Appliquez 3.6 Flash pour analyser des documents, des graphiques/diagrammes et rédiger des rapports – utile pour les équipes juridiques, financières, de conseil et d'opérations gérant des entrées mixtes texte et visuelles.
Pipelines de traitement de documents à volume élevé: Utilisez 3.5 Flash-Lite pour l'extraction, la classification, la synthèse et le routage rapides sur de grands corpus (par exemple, réclamations, factures, contrats, tickets de support) où le débit et la latence sont prédominants.
Recherche agentique et automatisation du support client: Déployez 3.5 Flash-Lite pour une recherche agentique à faible latence sur des bases de connaissances internes et une rédaction rapide de réponses, avec des niveaux de réflexion configurables pour équilibrer la vitesse et la profondeur du raisonnement.
Automatisation de l'utilisation informatique pour les flux de travail répétitifs: Utilisez les capacités d'utilisation informatique intégrées (via l'API Gemini/Enterprise) pour effectuer des tâches basées sur l'interface utilisateur telles que le remplissage de formulaires, la saisie de données inter-systèmes et les procédures opérationnelles étape par étape.
Détection et correction des vulnérabilités à grande échelle (restreint): Au sein de CodeMender, 3.5 Flash Cyber peut aider les équipes de sécurité à identifier et à corriger efficacement les vulnérabilités du code, en produisant des rapports consolidés à partir de plusieurs agents spécialisés ; destiné aux défenseurs vérifiés en raison du risque d'utilisation abusive.
Avantages
Profil d'efficacité et de coût solide pour les agents de production (moins de jetons, latence plus faible, coût par tâche plus faible).
Amélioration du codage, du travail de connaissance et des performances multimodales dans 3.6 Flash par rapport à 3.5 Flash (selon les gains de benchmark cités).
Flash-Lite offre un débit très élevé et un faible coût pour les charges de travail à volume élevé avec une profondeur de raisonnement configurable.
Mesures de sécurité Frontier Safety améliorées dans 3.6 Flash ciblant les abus CBRN et de cyber-offense, dans le but de réduire les refus inutiles.
Inconvénients
Gemini 3.5 Flash Cyber n'est pas généralement disponible ; l'accès est limité aux gouvernements et aux partenaires de confiance via le pilote CodeMender en raison du risque de double usage.
La famille privilégie l'efficacité et la mise à l'échelle agentique plutôt que de se positionner comme la capacité phare absolue (3.5 Pro est toujours en attente d'une diffusion plus large).
Les fonctionnalités d'utilisation informatique agentique peuvent nécessiter une intégration et une gouvernance minutieuses (outils/orchestration, vérifications de fiabilité) pour être sûres en production.
Comment utiliser Gemini 3.6 Flash Family
1) Choisissez le bon modèle dans la famille Gemini 3.6 Flash: Choisissez en fonction de la charge de travail : (a) gemini-3.6-flash pour un cheval de bataille polyvalent (codage, travail de connaissance, multimodal, flux de travail agiles) avec une efficacité de jeton améliorée ; (b) gemini-3.5-flash-lite pour les tâches à haut débit les plus rapides/les moins chères (recherche agile, traitement de documents, extraction, routage, classification) et des niveaux de réflexion configurables. Remarque : Gemini 3.5 Flash Cyber est restreint (gouvernements/partenaires de confiance via le pilote CodeMender) et n'est pas généralement disponible.
2) Décidez où vous l'utiliserez (application grand public vs API développeur vs entreprise): Options d'accès depuis les sources : (a) application Gemini pour tous (3.6 Flash et 3.5 Flash-Lite y sont déployés ; Flash-Lite est également déployé dans Google Search) ; (b) API Gemini via Google AI Studio et Android Studio pour les développeurs ; (c) Plateforme d'agents Gemini Enterprise pour les entreprises (3.6 Flash également dans l'application Gemini Enterprise).
3) Utilisez-le dans Google AI Studio (le moyen le plus rapide d'essayer les modèles): Ouvrez Google AI Studio et démarrez une nouvelle conversation/invite en utilisant le modèle cible. Pour 3.6 Flash, vous pouvez utiliser l'entrée AI Studio qui cible gemini-3.6-flash. Pour Flash-Lite, sélectionnez gemini-3.5-flash-lite. Exécutez quelques invites représentatives (par exemple, refactorisation de code, questions-réponses de documents, raisonnement de graphiques/diagrammes) et comparez la latence et la longueur de la sortie – 3.6 Flash est conçu pour utiliser moins de jetons de sortie que 3.5 Flash.
4) Appelez les modèles depuis l'API Gemini (utilisation de type production): Dans vos requêtes API Gemini, définissez l'ID du modèle sur l'une des nouvelles chaînes GA : gemini-3.6-flash ou gemini-3.5-flash-lite. Ce sont les identifiants de migration majeurs mis en évidence dans les sources. Ensuite, envoyez votre invite/messages comme d'habitude via le chemin de documentation « dernier modèle » de l'API Gemini.
5) Ajustez le coût/la latence avec les niveaux de réflexion (surtout pour 3.5 Flash-Lite): Pour l'extraction, le routage ou la classification à volume élevé, maintenez thinking_level à « minimal » (la valeur par défaut) pour maximiser le débit et minimiser le coût/la latence. Pour les sous-agents autonomes avec des appels d'outils, l'exécution de code ou le raisonnement en plusieurs étapes, augmentez thinking_level à « medium » ou « high » pour réduire la terminaison prématurée des outils et améliorer la fiabilité en plusieurs étapes.
6) Utilisez les outils informatiques intégrés pour les flux de travail agiles (là où c'est pris en charge): Gemini 3.6 Flash et 3.5 Flash-Lite incluent l'utilisation de l'ordinateur comme un outil intégré (selon les sources). Lors de la création d'agents qui doivent naviguer dans les interfaces utilisateur ou exécuter des tâches en plusieurs étapes, activez et utilisez la capacité d'utilisation de l'ordinateur intégrée via l'API Gemini / les interfaces Gemini Enterprise qui la prennent en charge.
7) Construisez et testez des flux de travail agiles avec une mentalité axée sur l'efficacité: Concevez vos boucles d'agents pour tirer parti de l'utilisation réduite des jetons de sortie de 3.6 Flash et de la diminution des étapes de raisonnement/appels d'outils. Validez que votre flux de travail atteint les mêmes résultats de tâche avec moins d'itérations (par exemple, moins de boucles d'appels d'outils dans les tâches en plusieurs étapes). Pour Flash-Lite, priorisez les étapes à fort débit (recherche, triage, extraction) et réservez les niveaux de réflexion supérieurs uniquement aux étapes qui en ont réellement besoin.
8) Intégrez dans Android Studio pour les flux de travail des développeurs: Si vous créez des applications Android ou des outils de développement, accédez aux modèles via Android Studio (comme indiqué dans les sources). Sélectionnez gemini-3.6-flash ou gemini-3.5-flash-lite pour des tâches telles que la génération de code, la refactorisation et l'aide au débogage, puis itérez sur les invites et les paramètres (y compris les niveaux de réflexion) pour correspondre à vos objectifs de latence et de qualité.
9) Déployez dans la plateforme d'agents Gemini Enterprise (déploiement en entreprise): Pour les déploiements d'agents d'entreprise, utilisez la plateforme d'agents Gemini Enterprise pour exécuter 3.6 Flash et 3.5 Flash-Lite dans les flux de travail d'agents de production. Si vous utilisez également l'application Gemini Enterprise, notez que 3.6 Flash y est disponible selon les sources.
10) Comprenez la tarification et planifiez l'utilisation en conséquence: Selon les sources : Gemini 3.6 Flash est tarifé à 1,50 $ par million de jetons d'entrée et 7,50 $ par million de jetons de sortie ; Gemini 3.5 Flash-Lite est tarifé à 0,30 $ par million de jetons d'entrée et 2,50 $ par million de jetons de sortie. Utilisez Flash-Lite pour les tâches en vrac/à haut débit et 3.6 Flash pour les travaux plus complexes où la qualité et les performances multimodales/agiles sont importantes.
11) Appliquez la liste de contrôle de migration recommandée lors du passage des anciens modèles Flash: Mettez à jour votre chaîne de modèle vers les nouveaux ID (gemini-3.6-flash, gemini-3.5-flash-lite). Supprimez les paramètres obsolètes et validez le comportement d'appel de fonction tel que requis par les modifications de l'API qui s'appliquent à partir de ces modèles et de toutes les futures versions de Gemini (selon les sources).
12) Sachez ce à quoi vous ne pouvez pas accéder (et les alternatives): Gemini 3.5 Flash Cyber est intentionnellement restreint en raison de préoccupations de double usage et ne sera disponible que pour les gouvernements et les partenaires de confiance via CodeMender dans un pilote à accès limité. Si vous avez besoin de flux de travail axés sur la sécurité sans cet accès, utilisez 3.6 Flash pour les tâches générales de révision et de remédiation de code, et mettez en œuvre vos propres garde-fous et processus de révision.
FAQ de Gemini 3.6 Flash Family
Google a lancé trois modèles connexes le 21 juillet 2026 : Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber (le modèle Cyber est livré uniquement au sein de CodeMender).
Articles populaires

Atoms : Une plateforme d'IA multi-agents qui transforme les idées en produits prêts à être lancés
May 22, 2026

Nano Banana SBTI : Qu'est-ce que c'est, comment ça marche et comment l'utiliser en 2026
Apr 15, 2026

Atoms : L'outil de création de produits IA qui redéfinit la création numérique en 2026
Apr 10, 2026

Kilo Claw : Comment déployer et utiliser un véritable agent d'IA "Faites-le pour vous" (Mise à jour 2026)
Apr 3, 2026
Analyses du site web de Gemini 3.6 Flash Family
Trafic et classements de Gemini 3.6 Flash Family
8.5M
Visites mensuelles
#8357
Classement mondial
#353
Classement par catégorie
Tendances du trafic : Nov 2024-Jun 2025
Aperçu des utilisateurs de Gemini 3.6 Flash Family
00:00:53
Durée moyenne de visite
1.93
Pages par visite
55.03%
Taux de rebond des utilisateurs
Principales régions de Gemini 3.6 Flash Family
US: 26.94%
IN: 8.76%
GB: 5.14%
JP: 4.24%
DE: 3.01%
Others: 51.91%







