Mardi, Google DeepMind a publié Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber. Gemini 3.6 Flash est le « modèle phare » de Google qui promet des capacités améliorées en matière de codage, de travail de connaissances et de performances multimodales tout en réduisant l’utilisation des jetons jusqu’à 17 %, ce qui le rend moins cher que son prédécesseur 3.5 Flash.
Gemini 3.5 Flash-Lite est le modèle le plus rentable de la catégorie, et 3.5 Flash Cyber est un modèle spécialisé qui a été affiné pour rechercher et corriger les vulnérabilités de cybersécurité à un prix décent. Ce modèle sera exclusivement disponible pour les gouvernements et les partenaires de confiance dans le cadre d’un programme pilote à accès limité, selon Google.
Google affirme que l’objectif de ces versions est d’offrir efficacité, latence et fiabilité aux clients qui créent des agents d’IA à grande échelle.
Le lancement est remarquable non seulement par ce que Google a livré – des modèles moins chers et plus rapides optimisés pour le codage, l’efficacité et la cybersécurité – mais aussi par ce qu’il n’a pas fait. La mise à jour n’inclut pas la mise à jour tant attendue du modèle phare de Google, Gemini Pro, dont la dernière mise à jour a eu lieu en février.
Depuis ce lancement, OpenAI a publié GPT-5.5 et commencé à déployer GPT-5.6, tandis qu’Anthropic a lancé Claude Opus 4.8, Claude Sonnet 5 et élargi l’accès à son modèle frontière Fable 5, soulignant le rythme de sortie intense des laboratoires rivaux.
Google a annoncé la sortie de Pro dans le cadre de la version 3.5 Flash en mai, affirmant que la version Pro était « déjà utilisée en interne et que nous sommes impatients de la déployer le mois prochain ». La semaine dernière, Bloomberg a rapporté que Google était confronté à des retards internes dans le lancement du 3.5 Pro car il avait du mal à atteindre ses objectifs de performances internes.
Les modèles Gemini Pro sont généralement les offres les plus performantes de Google pour les tâches de raisonnement et de codage complexes, tandis que les modèles Flash privilégient des coûts inférieurs et des temps de réponse plus rapides pour les applications de production.
Logan Kilpatrick, responsable du produit Google DeepMind, a déclaré mardi que la société testait actuellement Gemini 3.5 Pro avec des partenaires et espérait « atterrir bientôt ». Il a également noté que l’équipe a lancé sa phase de pré-entraînement la plus ambitieuse à ce jour pour Gemini 4.
Lorsque vous achetez via des liens dans nos articles, nous pouvons gagner une petite commission. Cela n’affecte pas notre indépendance éditoriale.

