Gemini 3.6 Flash : Google sort trois modèles, sans le Pro — visuel éditorial Zoom IA
Actualités IA

Gemini 3.6 Flash : Google sort trois modèles, sans le Pro

· · 3 min de lecture

Google DeepMind a lancé mardi 21 juillet 2026 trois nouveaux modèles Gemini, selon TechCrunch, mais aucune trace du Gemini 3.5 Pro tant attendu. Si tu construis des agents IA à grande échelle, l’enjeu est simple : plus de rapidité et un coût en baisse côté Flash, mais toujours pas de nouveau modèle haut de gamme pour le raisonnement complexe.

Gemini 3.6 Flash est le modèle « workhorse » de Google, pensé pour le code, le travail de connaissance et le multimodal, avec une réduction de la consommation de tokens allant jusqu’à 17 % par rapport à son prédécesseur, le 3.5 Flash. Résultat : il est moins cher à faire tourner.

Trois modèles Gemini, chacun sa cible

Le trio annoncé par Google DeepMind couvre trois usages distincts. Le Gemini 3.6 Flash vise la production quotidienne : coding, tâches de connaissance, performances multimodales améliorées, et cette baisse de 17 % de tokens qui le rend plus économique que la version précédente.

Le Gemini 3.5 Flash-Lite est présenté comme le modèle le plus économique de sa catégorie. Enfin, le Gemini 3.5 Flash Cyber est un modèle spécialisé, affiné pour détecter et corriger des vulnérabilités de cybersécurité. Attention à un point : Google précise que ce dernier sera réservé exclusivement aux gouvernements et partenaires de confiance, dans le cadre d’un programme pilote à accès limité.

Le fil conducteur assumé par Google ? Livrer de l’efficacité, de la latence maîtrisée et de la fiabilité aux clients qui déploient des agents IA à grande échelle. Tu remarqueras que rien ici ne cherche à repousser la frontière du raisonnement : ce sont des modèles de production, optimisés pour le coût et la vitesse.

Le grand absent : Gemini 3.5 Pro

Ce qui frappe dans cette annonce, c’est ce qui manque. Le modèle phare de Google, Gemini Pro, n’a pas eu droit à sa mise à jour. Sa dernière remonte à février 2026. Or, ce sont justement les modèles Pro qui offrent les meilleures capacités pour le raisonnement complexe et le code avancé, là où les Flash privilégient coût et temps de réponse.

Google avait pourtant teasé le Pro en mai, lors de la sortie du 3.5 Flash, en indiquant que cette version était « déjà utilisée en interne » et qu’ils avaient « hâte de la déployer le mois prochain ». La semaine dernière, Bloomberg rapportait que Google faisait face à des retards internes sur le lancement du 3.5 Pro, l’entreprise peinant à atteindre ses propres objectifs de performance.

Logan Kilpatrick, product lead chez Google DeepMind, a déclaré mardi que la société teste actuellement le Gemini 3.5 Pro avec des partenaires et espère « atterrir bientôt ». Il a aussi précisé que l’équipe avait démarré son entraînement préalable le plus ambitieux à ce jour pour Gemini 4.

Pendant ce temps, OpenAI et Anthropic accélèrent

Le contraste est net avec la cadence des concurrents. Depuis la dernière mise à jour du Pro en février, OpenAI a sorti GPT-5.5 et a commencé à déployer GPT-5.6. De son côté, Anthropic a lancé Claude Opus 4.8 et Claude Sonnet 5, et a élargi l’accès à son modèle de frontière Fable 5.

Concrètement, pour toi : si ton besoin est de faire tourner des agents en production sans exploser ton budget, le 3.6 Flash coche les cases dès aujourd’hui. Mais si tu attendais un bond côté raisonnement chez Google, il faudra patienter encore un peu, sans date ferme.

FAQ

Qu’est-ce que Gemini 3.6 Flash ?

C’est le modèle « workhorse » de Google DeepMind, lancé le 21 juillet 2026, optimisé pour le code, le travail de connaissance et le multimodal. Il réduit la consommation de tokens jusqu’à 17 % par rapport au 3.5 Flash, ce qui le rend moins cher.

Pourquoi Google n’a pas sorti Gemini 3.5 Pro ?

Selon Bloomberg, Google fait face à des retards internes et peine à atteindre ses objectifs de performance. Le modèle est en test avec des partenaires. Logan Kilpatrick, product lead de DeepMind, espère un déploiement « bientôt », sans date confirmée.

Qui peut utiliser Gemini 3.5 Flash Cyber ?

Ce modèle spécialisé en détection et correction de vulnérabilités de cybersécurité est réservé exclusivement aux gouvernements et partenaires de confiance, dans le cadre d’un programme pilote à accès limité annoncé par Google.

Mis à jour le 22 juillet 2026. Signaler une erreur.

Élise Tardieu

Rédactrice en chef · Fondatrice de Zoom IA

Élise a lancé Zoom IA début 2026 après six ans entre deux startups tech et son propre studio de consulting. Son parcours commence en 2019 dans une petite boîte NLP parisienne, à une époque où expliquer "LLM" à un marketeur non-tech ressemblait à une séance de rattrapage. Elle y a monté l'équipe content marketing qui a fait passer le blog de 300 visites/mois à 40k en 18 mois, avec de l'IA pour l'outillage, jamais pour remplacer le cerveau. Elle a quitté le salariat en 2023 pour s'installer à Orléans et lancer sa micro-agence de stratégie IA auprès de PME du Centre-Val de Loire et de la région parisienne. Le déclic Zoom IA est venu après sa quarantième conversation identique avec un client : "quel outil choisir ?", "combien ça coûte vraiment ?", "est-ce que je vais me faire remplacer ?". Elle a constaté qu'il n'existait pas de média francophone qui répond franchement à ces questions, sans verser dans le discours corporate ni dans la panique technophobe. Son angle éditorial à Zoom IA : tester avant de juger, être clivante quand ça compte, et refuser la publi-rédaction déguisée. Elle signe les guides gagner de l'argent avec l'IA, les comparatifs de modèles sur les cas d'usage business, et les analyses d'actu qui touchent à l'écosystème (levées, pricing, régulation). Elle anime aussi la newsletter Le Brief IA et teste personnellement chaque outil qu'elle recommande, c'est la règle de la rédaction.

Ne rate rien de l'actu IA

Le Brief IA, chaque semaine dans ta boite. Gratuit, concret, sans spam.