Maison
Google dévoile le Gemini 3.1 Flash-Lite : des performances en forte hausse, mais un prix triplé
Google DeepMind a officiellement lancé la version préliminaire de Gemini 3.1 Flash-Lite, présentant ainsi le modèle le plus rapide et le plus économique de la série Gemini 3. S'appuyant sur les fondements de Gemini 2.5 Flash-Lite, cette nouvelle version atteint des vitesses supérieures à 360 tokens par seconde avec un temps de réponse moyen de 5,1 secondes, tout en offrant une amélioration substantielle en termes d'intelligence. Selon l’Artificial Analysis Intelligence Index, le score du modèle a augmenté de 12 points pour atteindre 34, et il a suscité une forte préférence de la part des utilisateurs dans le classement Arena.ai avec un rating Elo de 1 432.

Dans des domaines clés tels que les capacités multimodales et le raisonnement scientifique, Gemini 3.1 Flash-Lite excelle, avec un score de 86,9 % au test GPQA Diamond et une précision de 76,8 % au benchmark MMMU-Pro. Ses performances surpassent celles de poids lourds tels que Claude Opus 4.6 et Kimi K2.5. Il est à noter que le modèle permet aux développeurs d’ajuster la « profondeur » du raisonnement, ce qui offre une grande flexibilité d’adaptation à des scénarios allant de simples tâches de traduction au développement d’interfaces utilisateur complexes.

Cependant, ces gains en termes de performances et de vitesse s’accompagnent d’ajustements de coûts notables. Le prix pour un million de tokens d’entrée de Gemini 3.1 Flash-Lite est passé à 0,25 $, tandis que le prix de sortie a bondi de 0,40 $ à 1,50 $, soit près du triple des coûts précédents.
Cette stratégie tarifaire met en évidence les pressions financières auxquelles sont confrontés les fournisseurs de modèles lorsqu’ils doivent trouver un équilibre entre une inférence rapide et une logique de haute précision. Le modèle étant désormais disponible à des fins de test sur Google AI Studio et Vertex AI, le marché des modèles légers passe d’une simple « concurrence sur les prix bas » à une nouvelle ère d’« accessibilité à une logique haute performance ».
Article connexe
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Recommandations de sujets spéciaux liés
commentaires (0)
Google DeepMind a officiellement lancé la version préliminaire de Gemini 3.1 Flash-Lite, présentant ainsi le modèle le plus rapide et le plus économique de la série Gemini 3. S'appuyant sur les fondements de Gemini 2.5 Flash-Lite, cette nouvelle version atteint des vitesses supérieures à 360 tokens par seconde avec un temps de réponse moyen de 5,1 secondes, tout en offrant une amélioration substantielle en termes d'intelligence. Selon l’Artificial Analysis Intelligence Index, le score du modèle a augmenté de 12 points pour atteindre 34, et il a suscité une forte préférence de la part des utilisateurs dans le classement Arena.ai avec un rating Elo de 1 432.

Dans des domaines clés tels que les capacités multimodales et le raisonnement scientifique, Gemini 3.1 Flash-Lite excelle, avec un score de 86,9 % au test GPQA Diamond et une précision de 76,8 % au benchmark MMMU-Pro. Ses performances surpassent celles de poids lourds tels que Claude Opus 4.6 et Kimi K2.5. Il est à noter que le modèle permet aux développeurs d’ajuster la « profondeur » du raisonnement, ce qui offre une grande flexibilité d’adaptation à des scénarios allant de simples tâches de traduction au développement d’interfaces utilisateur complexes.

Cependant, ces gains en termes de performances et de vitesse s’accompagnent d’ajustements de coûts notables. Le prix pour un million de tokens d’entrée de Gemini 3.1 Flash-Lite est passé à 0,25 $, tandis que le prix de sortie a bondi de 0,40 $ à 1,50 $, soit près du triple des coûts précédents.
Cette stratégie tarifaire met en évidence les pressions financières auxquelles sont confrontés les fournisseurs de modèles lorsqu’ils doivent trouver un équilibre entre une inférence rapide et une logique de haute précision. Le modèle étant désormais disponible à des fins de test sur Google AI Studio et Vertex AI, le marché des modèles légers passe d’une simple « concurrence sur les prix bas » à une nouvelle ère d’« accessibilité à une logique haute performance ».
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter











