
Toutes les grandes mises à jour Gemini jusqu'en juillet 2026 : génération 3.5/3.6 Flash, Gemini Omni, Nano Banana 2 et la stratégie agentique.
Google a livré trois nouveaux modèles Gemini le 21 juillet : 3.6 Flash (le nouveau modèle de travail — meilleur en codage, en travail de connaissance et en multimodal, tout en réduisant l'usage de tokens jusqu'à 17%), 3.5 Flash-Lite (le moins cher de sa catégorie) et 3.5 Flash Cyber (affiné pour détecter et corriger les vulnérabilités de sécurité). Grand absent : un 3.5 Pro. Le thème de l'année, c'est le cadrage de Google autour de « l'ère agentique » — Gemini 3.5 et Gemini Omni ont dominé l'I/O de mai, Omni étant présenté comme « créer n'importe quoi à partir de n'importe quelle entrée, en commençant par la vidéo ».
| Date | Sortie | De quoi il s'agit |
|---|---|---|
| Mars 2026 | Gemini 3.1 Flash-Lite · 3.1 Flash Live | Duo optimisé vitesse/coût |
| Mai 2026 (I/O) | Gemini 3.5 · Gemini Omni | Raisonnement de pointe + création de toute entrée vers toute sortie |
| Juin 2026 | Nano Banana 2 Lite · Omni Flash (préversion API) | Modèle d'image le plus rapide et le moins cher ; flux vidéo multimodaux pour les développeurs |
| 21 juillet 2026 | 3.6 Flash · 3.5 Flash-Lite · 3.5 Flash Cyber | Nouveau modèle de travail (−17% de tokens) · plancher tarifaire · spécialiste sécurité |
Flash est la franchise — Google continue de pousser des capacités proches de la frontière dans son palier bon marché plutôt que de les réserver à une gamme Pro (aucun 3.5 Pro n'est sorti).
Flash Cyber est le premier modèle de la ligne principale de Google affiné pour un unique domaine professionnel. Si les équipes de sécurité l'adoptent, « quel Gemini » devient une question sur la forme de votre charge de travail, et plus seulement sur votre budget.
| Élément | Prix |
|---|---|
| Entrée | $1.50 / M tokens |
| Sortie | $7.50 / M tokens (contre $9 sur 3.5 Flash) |
| Entrée mise en cache | $0.15 / M tokens |
| Fenêtre de contexte | 1,048,576 en entrée / 65,536 en sortie |
Google a baissé le tarif de sortie tout en livrant une mise à jour de capacités — la déclaration la plus claire possible que le palier Flash est celui où le volume est censé se concentrer.
Voici la complication honnête. Sur l'Artificial Analysis Intelligence Index, 3.6 Flash et 3.5 Flash obtiennent tous deux 50 — aucune amélioration mesurée. Sur les propres benchmarks de Google, 3.6 affiche des gains substantiels :
| Benchmark | 3.5 Flash | 3.6 Flash |
|---|---|---|
| DeepSWE | 37% | 49% |
| OSWorld-Verified | 78.4% | 83.0% |
| MLE-Bench | 49.7% | 63.9% |
| GDPval-AA v2 | 1349 Elo | 1421 Elo |
Les indices agrégés de tiers et les benchmarks choisis par l'éditeur ne mesurent pas la même chose. Le gain d'efficacité en tokens d'environ 17% est observable de façon indépendante ; les bonds de capacité portent sur des suites que Google a sélectionnées. Traitez les deux comme partiels et aucun comme l'image complète.
3.6 Flash est arrivé au milieu d'une bousculade de trois semaines : Claude Sonnet 5 (30 juin), GPT-5.6 GA (9 juillet), Kimi K3 (17 juillet). Aux tarifs publics de l'API, GPT-5.6 Luna est moins cher — surtout après la baisse d'OpenAI du 30 juillet — tandis que Claude Sonnet 5 coûte environ deux fois plus par token de sortie au tarif standard.
Présenté à l'I/O comme un bond en avant en matière de « compréhension du monde, multimodalité et édition », Omni génère et modifie à travers les modalités à partir de n'importe quelle entrée, la vidéo d'abord. Omni Flash est passé en préversion publique de l'API en juin pour les entreprises qui construisent des flux vidéo dynamiques — ce qui place Google en concurrence directe sur le marché de la vidéo d'après Sora, qu'il domine désormais en partie grâce à Veo 3.1.
Nano Banana 2 Lite (juin) est devenu le modèle d'image Gemini le plus rapide et le plus économe — le palier économique sous la ligne principale Nano Banana 2, et un ingrédient clé de l'offre gratuite exceptionnellement généreuse de Gemini, qui regroupe la génération d'images avec la voix, Deep Research, NotebookLM et un quota mensuel Veo.
La réduction d'environ 17% des tokens de 3.6 Flash est le chiffre sous-estimé : les mêmes charges coûtent simplement moins cher à exécuter, indépendamment de tout mouvement dans les benchmarks. Pour le trafic de production, cela compte souvent plus que quelques points de position dans un indice.
Flash Cyber ouvre un modèle du genre. Si cela prend, les modèles Flash ajustés par domaine deviendront une gamme de produits plutôt qu'une expérience — et la sélection de modèle gagnera un nouvel axe.
La cadence du changelog de l'API (mensuelle, parfois hebdomadaire) rend le principe consistant à se fixer sur les capacités plutôt que sur les noms de modèles aussi pertinent sur Gemini que sur GPT. Une documentation écrite autour d'une chaîne de modèle précise a ici une durée de vie courte.
Le bouquet gratuit de Google — génération d'images, voix, Deep Research, NotebookLM et un quota mensuel Veo — reste le plus généreux de la catégorie et constitue le mécanisme par lequel la capacité se transforme en parts de marché (comparatif des offres gratuites).
La génération 2.5 — la percée des « modèles à réflexion » de 2025 — est désormais héritée. Notre analyse d'origine est conservée sous forme de test archivé de Gemini 2.5 accompagné d'une rétrospective 2026.
Sources: TechCrunch sur les sorties de juillet · Mises à jour de l'IA Google — mai 2026 · Mises à jour de l'IA Google — juin 2026 · Changelog de l'API Gemini
Dernière mise à jour : 29 juillet 2026
Le 2026 d'Anthropic en chiffres : la série H de 65 milliards à 965 milliards de valorisation et le dossier d'introduction confidentiel.
Toutes les grandes mises à jour ChatGPT jusqu'en juillet 2026 : passage à GPT-5.5/5.6, Dreaming V3, Lockdown Mode et ce que donnent gratuit et payant.
Toutes les mises à jour Claude jusqu'en juillet 2026 : la famille Claude 5, le tableau de bord Reflect, MCP, Claude Code et les tarifs.
Copilot en 2026 : Agent Mode en disponibilité générale, revue agentique qui ouvre des PR de correction, la CLI, l'app de bureau et l'indexation.
Midjourney en 2026 : de la V8 alpha à la V8.2 par défaut, 2K natif sans upscaling, rendus 50 % plus rapides et 25 % moins chers, vidéo jusqu'à 21 s.
Le Notion de 2026 : agents autonomes, bascule vers les crédits le 4 mai, agents qui lisent vos fichiers, exécutions 35–50 % moins chères, et le vrai coût.
L'année 2026 d'OpenAI côté plateforme : le rythme lancement-retrait des GPT-5.x, l'arrêt de Sora, les changements d'API et la position à mi-année.
L'année navigateur de Perplexity : Comet gratuit partout depuis mars, iPad et iOS améliorés, Deep Research qui produit des slides, contrôles entreprise.