Hogar
Google presenta el Gemini 3.1 Flash-Lite: el rendimiento se dispara, pero el precio se triplica
Google DeepMind ha lanzado oficialmente la versión preliminar de Gemini 3.1 Flash-Lite, presentando así el modelo más rápido y rentable de la serie Gemini 3. Partiendo de la base de Gemini 2.5 Flash-Lite, esta versión alcanza velocidades superiores a los 360 tokens por segundo con un tiempo de respuesta medio de 5,1 segundos, al tiempo que ofrece una mejora sustancial en cuanto a inteligencia. Según el Índice de Inteligencia de Análisis Artificial, la puntuación del modelo ha aumentado en 12 puntos hasta alcanzar los 34, y ha demostrado una fuerte preferencia por parte de los usuarios en la clasificación de Arena.ai, con un rating Elo de 1432.

En áreas clave como las capacidades multimodales y el razonamiento científico, Gemini 3.1 Flash-Lite destaca, obteniendo una puntuación del 86,9 % en la prueba GPQA Diamond y alcanzando una precisión del 76,8 % en el benchmark MMMU-Pro. Su rendimiento supera al de pesos pesados como Claude Opus 4.6 y Kimi K2.5. Cabe destacar que el modelo permite a los desarrolladores ajustar la «profundidad» del razonamiento, lo que facilita una adaptación flexible a distintos escenarios, desde simples tareas de traducción hasta el desarrollo de interfaces de usuario complejas.

Sin embargo, estas mejoras en rendimiento y velocidad conllevan ajustes de coste notables. El precio por un millón de tokens de entrada de Gemini 3.1 Flash-Lite ha aumentado a 0,25 dólares, mientras que el precio de salida ha pasado de 0,40 a 1,50 dólares, casi triplicando los costes anteriores.
Esta estrategia de precios pone de relieve las presiones de costes a las que se enfrentan los proveedores de modelos a la hora de equilibrar una inferencia rápida con una lógica de alta precisión. Ahora que el modelo está disponible para su prueba en Google AI Studio y Vertex AI, el mercado de los modelos ligeros está pasando de una simple «competencia de precios bajos» a una nueva era de «accesibilidad a la lógica de alto rendimiento».
Artículo relacionado
Google prueba el agente Remy AI para Gemini a medida que el enfoque se desplaza hacia el control del usuario
Según Business Insider, Google está probando Remy, un nuevo agente personal de IA para Gemini. Esta herramienta tiene como objetivo ejecutar tareas en nombre de los usuarios, optimizando tanto los flujos de trabajo profesionales como las rutinas diar
Cómo corregir las Core Web Vitals para mejorar el posicionamiento SEO
Simplificar los comentarios de las tarjetas de calificación con herramientas de IAIntroducciónHerramientas de IA para generar comentarios de tarjetas de calificaciónMagic SchoolAlmanac AIChat GPTUso de Magic School para generar comentarios de t
Slackbot se convierte en un agente de IA
Slackbot, el asistente automatizado integrado en la plataforma de mensajería corporativa Slack de Salesforce, está evolucionando hacia un agente de inteligencia artificial. El CTO de Salesforce, Parker Harris, prevé que alcance un estatus viral compa
Recomendaciones de temas especiales relacionados
comentario (0)
0/500
Google DeepMind ha lanzado oficialmente la versión preliminar de Gemini 3.1 Flash-Lite, presentando así el modelo más rápido y rentable de la serie Gemini 3. Partiendo de la base de Gemini 2.5 Flash-Lite, esta versión alcanza velocidades superiores a los 360 tokens por segundo con un tiempo de respuesta medio de 5,1 segundos, al tiempo que ofrece una mejora sustancial en cuanto a inteligencia. Según el Índice de Inteligencia de Análisis Artificial, la puntuación del modelo ha aumentado en 12 puntos hasta alcanzar los 34, y ha demostrado una fuerte preferencia por parte de los usuarios en la clasificación de Arena.ai, con un rating Elo de 1432.

En áreas clave como las capacidades multimodales y el razonamiento científico, Gemini 3.1 Flash-Lite destaca, obteniendo una puntuación del 86,9 % en la prueba GPQA Diamond y alcanzando una precisión del 76,8 % en el benchmark MMMU-Pro. Su rendimiento supera al de pesos pesados como Claude Opus 4.6 y Kimi K2.5. Cabe destacar que el modelo permite a los desarrolladores ajustar la «profundidad» del razonamiento, lo que facilita una adaptación flexible a distintos escenarios, desde simples tareas de traducción hasta el desarrollo de interfaces de usuario complejas.

Sin embargo, estas mejoras en rendimiento y velocidad conllevan ajustes de coste notables. El precio por un millón de tokens de entrada de Gemini 3.1 Flash-Lite ha aumentado a 0,25 dólares, mientras que el precio de salida ha pasado de 0,40 a 1,50 dólares, casi triplicando los costes anteriores.
Esta estrategia de precios pone de relieve las presiones de costes a las que se enfrentan los proveedores de modelos a la hora de equilibrar una inferencia rápida con una lógica de alta precisión. Ahora que el modelo está disponible para su prueba en Google AI Studio y Vertex AI, el mercado de los modelos ligeros está pasando de una simple «competencia de precios bajos» a una nueva era de «accesibilidad a la lógica de alto rendimiento».
Cómo corregir las Core Web Vitals para mejorar el posicionamiento SEO
Simplificar los comentarios de las tarjetas de calificación con herramientas de IAIntroducciónHerramientas de IA para generar comentarios de tarjetas de calificaciónMagic SchoolAlmanac AIChat GPTUso de Magic School para generar comentarios de t
Slackbot se convierte en un agente de IA
Slackbot, el asistente automatizado integrado en la plataforma de mensajería corporativa Slack de Salesforce, está evolucionando hacia un agente de inteligencia artificial. El CTO de Salesforce, Parker Harris, prevé que alcance un estatus viral compa











