Lancement de Gemini 3.1 Flash-Lite, le modèle Gemini 3 le plus rapide et le plus rentable de Google à ce jour

/fr/images/Gemini-3.1-Flash-Light_20260304_221331_0000.png

Google vient d’annoncer Gemini 3.1 Flash-Lite, qui, selon la société, est jusqu’à présent le modèle le plus rapide et le plus rentable de la série Gemini 3. À partir d’aujourd’hui, Gemini 3.1 Flash-Lite est déployé en avant-première auprès des développeurs via Google AI Studio via l’API Gemini. Les clients Entreprise peuvent également y accéder via Vertex AI.

Un modèle rentable conçu pour répondre à la forte demande des développeurs

À 0,25 $ par million de jetons d’entrée et 1,50 $ par million de jetons de sortie, Google a positionné Gemini 3.1 Flash-Lite comme un modèle à grande échelle. La société ajoute en outre qu’elle surpasse Gemini 2.5 Flash avec un temps d’obtention du premier jeton 2,5 fois plus rapide et offre une vitesse de sortie 45 % plus rapide, sur la base de références d’analyse artificielle.

/fr/images/gemini-3.1_speed-cost_chart_1-1024x577.gif Crédit image : Google

Gemini 3.1 Flash-Lite est conçu pour les développeurs créant des expériences en temps réel. Pensez à la traduction à haute fréquence, à la modération de contenu et aux tâches d’automatisation à grande échelle où le coût et la latence comptent tout autant que l’intelligence. Eh bien, Flash-Lite ne semble pas faire de compromis sur la qualité. Il a obtenu un score de 1 432 au classement Arena.ai et a affiché de solides chiffres de référence, dont 86,9 % sur GPQA Diamond et 76,8 % sur MMMU Pro. Google affirme qu’il surpasse même les modèles Gemini avancés des générations précédentes dans certains domaines.

/fr/images/gemini-3.1-flash-lite-table_1-1024x728.gif Crédit image : Google

Intelligence adaptative sans le prix élevé

Outre la vitesse brute, Gemini 3.1 Flash-Lite inclut des « niveaux de réflexion » réglables dans AI Studio et Vertex AI. Les développeurs peuvent choisir le degré de raisonnement que le modèle applique à une tâche, ce qui les aide à gérer les coûts tout en faisant évoluer les performances. Les premiers testeurs, notamment des sociétés comme Latitude et Cartwheel, affirment que le modèle gère les entrées complexes avec précision tout en conservant l’exactitude des instructions. En parlant de modèles d’IA, n’oublions pas que Microsoft a également ajouté aujourd’hui le dernier modèle instantané GPT-5.3 d’OpenAI à Copilot Chat et Copilot Studio.

*️⃣ Lien source :

annoncé Gemini 3.1 Flash-Lite , Google, /fr/images/gemini-3.1_speed-cost_chart_1-1024x577.gif , modèles Gemini, /fr/images/gemini-3.1-flash-lite-table_1-1024x728.gif , Vertex AI, également ajouté, GPT-5.3 Instant,