Google a publié aujourd’hui son modèle Gemini 3 Flash rapide et bon marché, basé sur le Gemini 3 sorti le mois dernier, dans le but de voler la vedette à OpenAI. La société en fait également le modèle par défaut dans l’application Gemini et le mode IA dans la recherche.
Le nouveau modèle Flash arrive six mois après que Google a annoncé le modèle Gemini 2.5 Flash, offrant des améliorations significatives. Sur le benchmark, le modèle Gemini 3 Flash surpasse largement son prédécesseur et égale les performances d’autres modèles frontières, comme Gemini 3 Pro et GPT 5.2, dans certaines mesures.
Par exemple, il a obtenu un score de 33,7 % sans utilisation d’outils au test de référence Humanity’s Last Exam, conçu pour tester l’expertise dans différents domaines. En comparaison, Gemini 3 Pro a obtenu un score de 37,5 %, Gemini 2.5 Flash un score de 11 % et le nouveau GPT-5.2 un score de 34,5 %.
Sur le benchmark de multimodalité et de raisonnement MMMU-Pro, le nouveau modèle a surpassé tous ses concurrents avec un score de 81,2 %.
Déploiement grand public
Google fait de Gemini 3 Flash le modèle par défaut dans l’application Gemini à l’échelle mondiale, remplaçant Gemini 2.5 Flash. Les utilisateurs peuvent toujours choisir le modèle Pro dans le sélecteur de modèles pour les questions mathématiques et de codage.
La société affirme que le nouveau modèle est efficace pour identifier le contenu multimodal et vous donner une réponse basée sur cela. Par exemple, vous pouvez télécharger votre courte vidéo de pickleball et demander des conseils ; vous pouvez essayer de dessiner un croquis et demander au modèle de deviner ce que vous dessinez ; ou vous pouvez télécharger un enregistrement audio pour obtenir une analyse ou générer un quiz.
La société a également déclaré que le modèle comprend mieux l’intention des requêtes des utilisateurs et peut générer des réponses plus visuelles avec des éléments tels que des images et des tableaux.
Événement Techcrunch
San Francisco
|
13-15 octobre 2026
Vous pouvez également utiliser le nouveau modèle pour créer des prototypes d’application dans l’application Gemini à l’aide d’invites.
Le Gemini 3 Pro est désormais disponible pour tous aux États-Unis pour la recherche et davantage de personnes aux États-Unis peuvent également accéder au modèle d’image Nano Banana Pro dans la recherche.
Disponibilité des entreprises et des développeurs
Google a noté que des sociétés comme JetBrains, Figma, Cursor, Harvey et Latitude utilisent déjà le modèle Gemini 3 Flash, disponible via Vertex AI et Gemini Enterprise.
Pour les développeurs, la société met le modèle à disposition dans un modèle d’aperçu via l’API et dans Antigravity, le nouvel outil de codage de Google publié le mois dernier.
La société a déclaré que le Gemini 3 Pro obtient un score de 78 % sur le test de codage vérifié par le banc SWE, surpassé seulement par GPT-5.2. Il a ajouté que le modèle est idéal pour l’analyse vidéo, l’extraction de données et les questions-réponses visuelles, et qu’en raison de sa vitesse, il est adapté aux flux de travail rapides et reproductibles.

Le prix du modèle est de 0,50 $ pour 1 million de jetons d’entrée et de 3,00 $ pour 1 million de jetons de sortie. C’est légèrement plus cher que 0,30 $ pour 1 million de jetons d’entrée et 2,50 $ pour 1 million de jetons de sortie de Gemini Flash 2.5. Mais Google affirme que le nouveau modèle surpasse le modèle Gemini 2.5 Pro tout en étant trois fois plus rapide. Et, pour les tâches de réflexion, il utilise en moyenne 30 % de jetons en moins que le 2.5 Pro. Cela signifie que dans l’ensemble, vous pourriez économiser sur le nombre de jetons pour certaines tâches.

« Nous positionnons vraiment Flash comme votre modèle de bête de somme. Ainsi, si vous regardez, par exemple, même les prix d’entrée et de sortie en haut de ce tableau, Flash n’est qu’une offre beaucoup moins chère du point de vue des prix d’entrée et de sortie. Et il permet donc, pour de nombreuses entreprises, d’effectuer des tâches en masse », a déclaré Tulsee Doshi, directeur principal et responsable des produits pour Gemini Models, à TechCrunch lors d’un briefing.
Depuis la sortie de Gemini 3, Google a traité plus de 1 000 milliards de jetons par jour sur son API, au milieu de sa féroce guerre de versions et de performances avec OpenAI.
Plus tôt ce mois-ci, Sam Altman aurait envoyé un mémo interne « Code Red » à l’équipe OpenAI après la baisse du trafic de ChatGPT alors que la part de marché de Google auprès des consommateurs augmentait. Postez cela, OpenAI a publié GPT-5.2 et un nouveau modèle de génération d’images. OpenAI s’est également vanté de son utilisation croissante en entreprise et a déclaré que le volume des messages ChatGPT avait été multiplié par 8 depuis novembre 2024.
Bien que Google n’ait pas abordé directement la concurrence avec OpenAI, il a déclaré que la sortie de nouveaux modèles met toutes les entreprises au défi d’être actives.
« Ce qui se passe dans l’industrie, c’est que tous ces modèles continuent d’être géniaux, de se défier les uns les autres, de repousser les limites. Et je pense que ce qui est également génial, c’est que les entreprises lancent ces modèles », a déclaré Doshi.
« Nous introduisons également de nouveaux critères de référence et de nouvelles façons d’évaluer ces modèles. Et cela nous encourage également. »

