OpenAI lança as versões GPT-5.4 Pro e Thinking

Na quinta-feira, a OpenAI apresentou o GPT-5.4, um novo modelo de base descrito como “nosso modelo de ponta mais capaz e eficiente para trabalhos profissionais”. Além da versão padrão, o GPT-5.4 é oferecido como uma variante focada no raciocínio (GPT-5.4 Thinking) e uma edição com desempenho otimizado (GPT-5.4 Pro).
A versão API do modelo suportará janelas de contexto de até 1 milhão de tokens, marcando a maior capacidade de contexto que a OpenAI já ofereceu.
A OpenAI também destacou a eficiência aprimorada de tokens, observando que o GPT-5.4 pode resolver problemas idênticos usando significativamente menos tokens do que seu antecessor.
O novo modelo apresenta resultados de benchmark substancialmente melhores, alcançando pontuações recordes nos benchmarks de uso de computador OSWorld-Verified e WebArena Verified. Ele também estabeleceu um novo recorde com uma pontuação de 83% no teste GDPval da OpenAI para tarefas de trabalho intelectual.
De acordo com uma declaração do CEO da Mercor, Brendan Foody, o GPT-5.4 lidera o benchmark APEX-Agents da Mercor, que avalia habilidades profissionais nas áreas de direito e finanças.
“[O GPT-5.4] se destaca na produção de resultados de longo prazo, como apresentações de slides, modelos financeiros e análises jurídicas”, afirmou Foody, “oferecendo desempenho de ponta ao operar mais rapidamente e a um custo menor do que os modelos de ponta concorrentes”.
O GPT-5.4 dá continuidade ao trabalho da OpenAI para reduzir alucinações e imprecisões factuais. A empresa informa que o novo modelo tem 33% menos probabilidade de cometer erros em afirmações individuais em comparação com o GPT-5.2, com as respostas gerais tendo 18% menos probabilidade de conter erros.
Como parte do lançamento, a OpenAI redesenhou a forma como a API do GPT-5.4 lida com a chamada de ferramentas, introduzindo um novo sistema chamado Tool Search. Anteriormente, os prompts do sistema precisavam definir todas as ferramentas disponíveis antecipadamente — um processo que consumia tokens consideráveis à medida que as bibliotecas de ferramentas se expandiam. O novo sistema permite que os modelos recuperem definições de ferramentas sob demanda, tornando as solicitações mais rápidas e econômicas em ambientes com muitas ferramentas.
A OpenAI também adicionou uma nova avaliação de segurança para analisar a cadeia de pensamento de seus modelos — o comentário contínuo que revela o raciocínio do modelo durante tarefas de várias etapas. Pesquisadores de segurança em IA há muito expressam preocupação de que modelos de raciocínio possam deturpar sua cadeia de pensamento, e os testes confirmam que isso pode ocorrer sob certas condições.
A nova avaliação da OpenAI indica que o engano é menos provável na versão Thinking do GPT-5.4, “sugerindo que o modelo não tem a capacidade de ocultar seu raciocínio e que o monitoramento da CoT continua sendo uma ferramenta de segurança eficaz”.
Artigo relacionado
Sam Altman Gera Debate Sobre a Desaceleração da IA
Escute noApple PodcastsEscute noSpotifyO CEO da OpenAI, Sam Altman, sugeriu recentemente que pode ser hora de “controlar o ritmo do desenvolvimento de IA” para permitir que a sociedade “se fortaleça em torno de alguns desses novos níveis de capacida
A OpenAI process a Apple por violação de segredo comercial
A OpenAI refutou as alegações de segredo comercial da Apple na terça-feira, argumentando que a ação judicial é infundada.“Levamos essas alegações a sério, mas não vemos evidências que as apoiem”, afirmou a OpenAI, conforme relatado por Ed Ludlow, da
A cabeça de robótica da OpenAI, Caitlin Kalinowski, renuncia devido à parceria com o Pentágono
O líder de robótica da OpenAI, Caitlin Kalinowski, renunciou após a polêmica parceria da empresa com o Departamento de Defesa.“Esta não foi uma decisão fácil”, explicou Kalinowski em uma declaração nas redes sociais. “Embora a IA desempenhe um papel
Recomendações de tópicos especiais relacionados
Comentários (0)

Na quinta-feira, a OpenAI apresentou o GPT-5.4, um novo modelo de base descrito como “nosso modelo de ponta mais capaz e eficiente para trabalhos profissionais”. Além da versão padrão, o GPT-5.4 é oferecido como uma variante focada no raciocínio (GPT-5.4 Thinking) e uma edição com desempenho otimizado (GPT-5.4 Pro).
A versão API do modelo suportará janelas de contexto de até 1 milhão de tokens, marcando a maior capacidade de contexto que a OpenAI já ofereceu.
A OpenAI também destacou a eficiência aprimorada de tokens, observando que o GPT-5.4 pode resolver problemas idênticos usando significativamente menos tokens do que seu antecessor.
O novo modelo apresenta resultados de benchmark substancialmente melhores, alcançando pontuações recordes nos benchmarks de uso de computador OSWorld-Verified e WebArena Verified. Ele também estabeleceu um novo recorde com uma pontuação de 83% no teste GDPval da OpenAI para tarefas de trabalho intelectual.
De acordo com uma declaração do CEO da Mercor, Brendan Foody, o GPT-5.4 lidera o benchmark APEX-Agents da Mercor, que avalia habilidades profissionais nas áreas de direito e finanças.
“[O GPT-5.4] se destaca na produção de resultados de longo prazo, como apresentações de slides, modelos financeiros e análises jurídicas”, afirmou Foody, “oferecendo desempenho de ponta ao operar mais rapidamente e a um custo menor do que os modelos de ponta concorrentes”.
O GPT-5.4 dá continuidade ao trabalho da OpenAI para reduzir alucinações e imprecisões factuais. A empresa informa que o novo modelo tem 33% menos probabilidade de cometer erros em afirmações individuais em comparação com o GPT-5.2, com as respostas gerais tendo 18% menos probabilidade de conter erros.
Como parte do lançamento, a OpenAI redesenhou a forma como a API do GPT-5.4 lida com a chamada de ferramentas, introduzindo um novo sistema chamado Tool Search. Anteriormente, os prompts do sistema precisavam definir todas as ferramentas disponíveis antecipadamente — um processo que consumia tokens consideráveis à medida que as bibliotecas de ferramentas se expandiam. O novo sistema permite que os modelos recuperem definições de ferramentas sob demanda, tornando as solicitações mais rápidas e econômicas em ambientes com muitas ferramentas.
A OpenAI também adicionou uma nova avaliação de segurança para analisar a cadeia de pensamento de seus modelos — o comentário contínuo que revela o raciocínio do modelo durante tarefas de várias etapas. Pesquisadores de segurança em IA há muito expressam preocupação de que modelos de raciocínio possam deturpar sua cadeia de pensamento, e os testes confirmam que isso pode ocorrer sob certas condições.
A nova avaliação da OpenAI indica que o engano é menos provável na versão Thinking do GPT-5.4, “sugerindo que o modelo não tem a capacidade de ocultar seu raciocínio e que o monitoramento da CoT continua sendo uma ferramenta de segurança eficaz”.
Sam Altman Gera Debate Sobre a Desaceleração da IA
Escute noApple PodcastsEscute noSpotifyO CEO da OpenAI, Sam Altman, sugeriu recentemente que pode ser hora de “controlar o ritmo do desenvolvimento de IA” para permitir que a sociedade “se fortaleça em torno de alguns desses novos níveis de capacida
A OpenAI process a Apple por violação de segredo comercial
A OpenAI refutou as alegações de segredo comercial da Apple na terça-feira, argumentando que a ação judicial é infundada.“Levamos essas alegações a sério, mas não vemos evidências que as apoiem”, afirmou a OpenAI, conforme relatado por Ed Ludlow, da
A cabeça de robótica da OpenAI, Caitlin Kalinowski, renuncia devido à parceria com o Pentágono
O líder de robótica da OpenAI, Caitlin Kalinowski, renunciou após a polêmica parceria da empresa com o Departamento de Defesa.“Esta não foi uma decisão fácil”, explicou Kalinowski em uma declaração nas redes sociais. “Embora a IA desempenhe um papel





Lar






