O Google lança família avançada de modelos de raciocínio de IA

Na terça-feira, a Google lançou o Gemini 2.5, um novo conjunto de modelos de IA que realmente param um momento para "pensar" antes de fornecer uma resposta. É como se estivessem tentando imitar nós, humanos, não é?
Liderando o grupo está o Gemini 2.5 Pro Experimental, que a Google está promovendo como o modelo mais inteligente até agora. Esse cara é multimodal e pode lidar com tarefas de raciocínio como um campeão. Você poderá experimentá-lo a partir de terça-feira no Google AI Studio, ou, se estiver pagando 20 dólares por mês pelo Gemini Advanced, poderá acessá-lo pelo aplicativo Gemini.
A Google está bem séria sobre essa questão do raciocínio — eles planejam incorporá-lo em todos os seus futuros modelos de IA.
Desde que a OpenAI lançou seu primeiro modelo de raciocínio de IA, o o1, em setembro de 2024, o mundo da tecnologia está correndo para acompanhar. Agora, você tem Anthropic, DeepSeek, Google e xAI todos entrando na disputa com seus próprios modelos de raciocínio. Esses modelos levam um pouco mais de tempo e poder computacional para verificar fatos e pensar sobre problemas antes de dar uma resposta.
As técnicas de raciocínio têm sido uma virada de jogo para a IA, especialmente quando se trata de matemática e codificação. Muitos no setor de tecnologia acreditam que esses modelos de raciocínio serão cruciais para agentes de IA — aqueles sistemas autônomos que podem fazer coisas sem nós, humanos, ficarmos supervisionando. Mas, sim, eles também são mais caros.
A Google não é estranha nisso — eles já brincaram com modelos de raciocínio antes, como aquela versão "pensante" do Gemini que lançaram em dezembro. Mas o Gemini 2.5? Esse é o grande golpe deles para superar a série "o" da OpenAI.
A Google afirma que o Gemini 2.5 Pro está superando seus modelos mais antigos e alguns dos principais concorrentes em vários benchmarks. Eles adaptaram o Gemini 2.5 para arrasar em aplicativos web visualmente impressionantes e projetos de codificação que podem funcionar por conta própria.
No teste Aider Polyglot para edição de código, o Gemini 2.5 Pro obteve um sólido 68,6%, superando o melhor da OpenAI, Anthropic e DeepSeek. Mas no teste SWE-bench Verified para desenvolvimento de software, ele alcançou 63,8% — bom o suficiente para superar o o3-mini da OpenAI e o R1 da DeepSeek, mas ficou atrás do Claude 3.7 Sonnet da Anthropic, que marcou 70,3%.
Depois, há o Humanity's Last Exam, um teste multimodal difícil com milhares de perguntas sobre matemática, humanidades e ciências. O Gemini 2.5 Pro conseguiu 18,8%, o que é melhor do que a maioria dos grandes nomes por aí.
Logo de cara, o Gemini 2.5 Pro vem com uma janela de contexto de 1 milhão de tokens — é como ser capaz de ler toda a série "O Senhor dos Anéis" de uma só vez. E em breve, eles planejam dobrar isso para 2 milhões de tokens.
A Google está mantendo os preços da API em segredo por enquanto, mas eles prometem revelar os detalhes nas próximas semanas.
Artigo relacionado
O Gemini Spark agora gerencia a biblioteca do Google Fotos
O Google está ampliando sua integração de IA ao permitir que o Gemini Spark gerencie bibliotecas do Google Photos. Os usuários agora podem instruir o agente a editar imagens, organizar álbuns, gerar coleções compartilhadas a partir das fotos favorita
O Google lança recurso de detecção de chamadas falsas para proteger contra golpes de falsificação de identidade por meio de deepfakes gerados por IA
O Google anunciou nesta terça-feira que o Android está lançando um recurso de detecção de chamadas falsas para proteger contra golpes de falsificação de identidade por meio de deepfakes gerados por IA
A Frontier AI Labs se recusa a divulgar estratégias de contenção para modelos rebeldes
Pesquisas recentes indicam que muito poucos laboratórios líderes em IA publicaram ou demonstraram planos de resposta para contenção. Um plano de contenção define os procedimentos a serem seguidos quan
Recomendações de tópicos especiais relacionados
Comentários (39)
Googleがまた新しいAIを発表したね。人間みたいに「考える」時間を設けるって、本当に可能なのかな?倫理的な問題も気になるし、技術が進むほど不安になることもある。でも、これで検索がもっと便利になるなら試してみたいかも😅
C'est marrant comment Google essaie de faire 'réfléchir' ses IA maintenant... Sauf que moi quand je réfléchis je mets 3h à choisir entre deux parfums de glace 😂 Vivement qu'ils améliorent la version Pro pour nos dilemmes du quotidien !
Whoa, Google’s Gemini 2.5 sounds like it’s got a brain of its own, pausing to ‘think’ before answering! 😮 Makes me wonder if it’ll outsmart us at pub quizzes soon. Cool tech, but I hope it doesn’t start overanalyzing my bad jokes.
Google's Gemini 2.5 sounds like a brainy upgrade! I wonder if it’ll outsmart my math homework. 🤓 Excited to see how it stacks up against other AI models.
Gemini 2.5 is pretty cool! It's like it pauses to think before answering, which is kinda human-like. I tried it out and it's definitely smarter than the last version. Only thing is, sometimes it takes too long to respond, but hey, I guess that's the price of deep thinking! 🤔

Na terça-feira, a Google lançou o Gemini 2.5, um novo conjunto de modelos de IA que realmente param um momento para "pensar" antes de fornecer uma resposta. É como se estivessem tentando imitar nós, humanos, não é?
Liderando o grupo está o Gemini 2.5 Pro Experimental, que a Google está promovendo como o modelo mais inteligente até agora. Esse cara é multimodal e pode lidar com tarefas de raciocínio como um campeão. Você poderá experimentá-lo a partir de terça-feira no Google AI Studio, ou, se estiver pagando 20 dólares por mês pelo Gemini Advanced, poderá acessá-lo pelo aplicativo Gemini.
A Google está bem séria sobre essa questão do raciocínio — eles planejam incorporá-lo em todos os seus futuros modelos de IA.
Desde que a OpenAI lançou seu primeiro modelo de raciocínio de IA, o o1, em setembro de 2024, o mundo da tecnologia está correndo para acompanhar. Agora, você tem Anthropic, DeepSeek, Google e xAI todos entrando na disputa com seus próprios modelos de raciocínio. Esses modelos levam um pouco mais de tempo e poder computacional para verificar fatos e pensar sobre problemas antes de dar uma resposta.
As técnicas de raciocínio têm sido uma virada de jogo para a IA, especialmente quando se trata de matemática e codificação. Muitos no setor de tecnologia acreditam que esses modelos de raciocínio serão cruciais para agentes de IA — aqueles sistemas autônomos que podem fazer coisas sem nós, humanos, ficarmos supervisionando. Mas, sim, eles também são mais caros.
A Google não é estranha nisso — eles já brincaram com modelos de raciocínio antes, como aquela versão "pensante" do Gemini que lançaram em dezembro. Mas o Gemini 2.5? Esse é o grande golpe deles para superar a série "o" da OpenAI.
A Google afirma que o Gemini 2.5 Pro está superando seus modelos mais antigos e alguns dos principais concorrentes em vários benchmarks. Eles adaptaram o Gemini 2.5 para arrasar em aplicativos web visualmente impressionantes e projetos de codificação que podem funcionar por conta própria.
No teste Aider Polyglot para edição de código, o Gemini 2.5 Pro obteve um sólido 68,6%, superando o melhor da OpenAI, Anthropic e DeepSeek. Mas no teste SWE-bench Verified para desenvolvimento de software, ele alcançou 63,8% — bom o suficiente para superar o o3-mini da OpenAI e o R1 da DeepSeek, mas ficou atrás do Claude 3.7 Sonnet da Anthropic, que marcou 70,3%.
Depois, há o Humanity's Last Exam, um teste multimodal difícil com milhares de perguntas sobre matemática, humanidades e ciências. O Gemini 2.5 Pro conseguiu 18,8%, o que é melhor do que a maioria dos grandes nomes por aí.
Logo de cara, o Gemini 2.5 Pro vem com uma janela de contexto de 1 milhão de tokens — é como ser capaz de ler toda a série "O Senhor dos Anéis" de uma só vez. E em breve, eles planejam dobrar isso para 2 milhões de tokens.
A Google está mantendo os preços da API em segredo por enquanto, mas eles prometem revelar os detalhes nas próximas semanas.
O Gemini Spark agora gerencia a biblioteca do Google Fotos
O Google está ampliando sua integração de IA ao permitir que o Gemini Spark gerencie bibliotecas do Google Photos. Os usuários agora podem instruir o agente a editar imagens, organizar álbuns, gerar coleções compartilhadas a partir das fotos favorita
O Google lança recurso de detecção de chamadas falsas para proteger contra golpes de falsificação de identidade por meio de deepfakes gerados por IA
O Google anunciou nesta terça-feira que o Android está lançando um recurso de detecção de chamadas falsas para proteger contra golpes de falsificação de identidade por meio de deepfakes gerados por IA
A Frontier AI Labs se recusa a divulgar estratégias de contenção para modelos rebeldes
Pesquisas recentes indicam que muito poucos laboratórios líderes em IA publicaram ou demonstraram planos de resposta para contenção. Um plano de contenção define os procedimentos a serem seguidos quan
Googleがまた新しいAIを発表したね。人間みたいに「考える」時間を設けるって、本当に可能なのかな?倫理的な問題も気になるし、技術が進むほど不安になることもある。でも、これで検索がもっと便利になるなら試してみたいかも😅
C'est marrant comment Google essaie de faire 'réfléchir' ses IA maintenant... Sauf que moi quand je réfléchis je mets 3h à choisir entre deux parfums de glace 😂 Vivement qu'ils améliorent la version Pro pour nos dilemmes du quotidien !
Whoa, Google’s Gemini 2.5 sounds like it’s got a brain of its own, pausing to ‘think’ before answering! 😮 Makes me wonder if it’ll outsmart us at pub quizzes soon. Cool tech, but I hope it doesn’t start overanalyzing my bad jokes.
Google's Gemini 2.5 sounds like a brainy upgrade! I wonder if it’ll outsmart my math homework. 🤓 Excited to see how it stacks up against other AI models.
Gemini 2.5 is pretty cool! It's like it pauses to think before answering, which is kinda human-like. I tried it out and it's definitely smarter than the last version. Only thing is, sometimes it takes too long to respond, but hey, I guess that's the price of deep thinking! 🤔





Lar






