Google lança o Gemini 3.1 Flash-Lite: desempenho dispara, preço triplica
O Google DeepMind lançou oficialmente a versão prévia do Gemini 3.1 Flash-Lite, apresentando o modelo mais rápido e com melhor custo-benefício da série Gemini 3. Com base no Gemini 2.5 Flash-Lite, esta versão mantém velocidades superiores a 360 tokens por segundo, com um tempo médio de resposta de 5,1 segundos, ao mesmo tempo em que oferece um avanço substancial em inteligência. De acordo com o Índice de Inteligência Artificial Analítica, a pontuação do modelo subiu 12 pontos, chegando a 34, e ele tem demonstrado forte preferência dos usuários no ranking da Arena.ai, com uma classificação Elo de 1.432.

Em áreas-chave como capacidades multimodais e raciocínio científico, o Gemini 3.1 Flash-Lite se destaca, obtendo 86,9% no teste GPQA Diamond e alcançando 76,8% de precisão no benchmark MMMU-Pro. Seu desempenho supera gigantes como o Claude Opus 4.6 e o Kimi K2.5. Notavelmente, o modelo permite que os desenvolvedores ajustem a “profundidade” do raciocínio, possibilitando uma adaptação flexível em diversos cenários, que vão desde tarefas simples de tradução até o desenvolvimento complexo de interfaces de usuário.

No entanto, esses ganhos em desempenho e velocidade vêm acompanhados de ajustes de custo significativos. O preço por um milhão de tokens de entrada do Gemini 3.1 Flash-Lite aumentou para US$ 0,25, enquanto o preço de saída saltou de US$ 0,40 para US$ 1,50, quase triplicando os custos anteriores.
Essa estratégia de preços destaca as pressões de custo que os fornecedores de modelos enfrentam ao equilibrar inferência rápida com lógica de alta precisão. Com o modelo agora disponível para testes no Google AI Studio e no Vertex AI, o mercado de modelos leves está mudando de uma simples “competição de preços baixos” para uma nova era de “acessibilidade à lógica de alto desempenho”.
Artigo relacionado
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava
Recomendações de tópicos especiais relacionados
Comentários (0)
O Google DeepMind lançou oficialmente a versão prévia do Gemini 3.1 Flash-Lite, apresentando o modelo mais rápido e com melhor custo-benefício da série Gemini 3. Com base no Gemini 2.5 Flash-Lite, esta versão mantém velocidades superiores a 360 tokens por segundo, com um tempo médio de resposta de 5,1 segundos, ao mesmo tempo em que oferece um avanço substancial em inteligência. De acordo com o Índice de Inteligência Artificial Analítica, a pontuação do modelo subiu 12 pontos, chegando a 34, e ele tem demonstrado forte preferência dos usuários no ranking da Arena.ai, com uma classificação Elo de 1.432.

Em áreas-chave como capacidades multimodais e raciocínio científico, o Gemini 3.1 Flash-Lite se destaca, obtendo 86,9% no teste GPQA Diamond e alcançando 76,8% de precisão no benchmark MMMU-Pro. Seu desempenho supera gigantes como o Claude Opus 4.6 e o Kimi K2.5. Notavelmente, o modelo permite que os desenvolvedores ajustem a “profundidade” do raciocínio, possibilitando uma adaptação flexível em diversos cenários, que vão desde tarefas simples de tradução até o desenvolvimento complexo de interfaces de usuário.

No entanto, esses ganhos em desempenho e velocidade vêm acompanhados de ajustes de custo significativos. O preço por um milhão de tokens de entrada do Gemini 3.1 Flash-Lite aumentou para US$ 0,25, enquanto o preço de saída saltou de US$ 0,40 para US$ 1,50, quase triplicando os custos anteriores.
Essa estratégia de preços destaca as pressões de custo que os fornecedores de modelos enfrentam ao equilibrar inferência rápida com lógica de alta precisão. Com o modelo agora disponível para testes no Google AI Studio e no Vertex AI, o mercado de modelos leves está mudando de uma simples “competição de preços baixos” para uma nova era de “acessibilidade à lógica de alto desempenho”.
Suno para Marcas d'Água em Músicas Durante Batalhas Legais
O Suno, plataforma que permite aos usuários gerar músicas criadas por inteligência artificial, apresentou novas funcionalidades para rotular as faixas produzidas pela plataforma, restringir downloads e atualizar os padrões da comunidade para coibir r
Musk admite que vazamento do código do Grok expôs dados de usuários e promete apagar todas as informações históricas.
Elon Musk abordou diretamente a controvérsia sobre privacidade envolvendo o Grok Build, começando com um simples "Verdadeiro" para confirmar a validade do incidente. Ele prometeu que todos os dados dos usuários carregados anteriormente para a SpaceXA
Ações dos EUA Atingem Marco Histórico Enquanto Gigantes de IA e Aeroespacial se Preparam para Estreia de Trilião de Dólares
Elon Musk, Sam Altman e Dario Amodei, três titãs do setor de tecnologia, estão avançando rumo a ofertas públicas iniciais (IPOs) para suas respectivas empresas. Com a SpaceX, a OpenAI e a Anthropic — três gigantes da indústria que se aproximam de ava





Lar






