A OpenAI enfrenta reações adversas em relação à tecnologia de gráficos de vibração

Durante sua principal transmissão ao vivo do GPT-5 na quinta-feira, a OpenAI apresentou vários gráficos que pareciam mostrar os recursos impressionantes do modelo, mas um olhar mais atento revela algumas inconsistências na visualização dos dados.
Ironicamente, em um gráfico que ilustra o desempenho do GPT-5 em "avaliações de fraude entre modelos", a escala parece estar desalinhada. Por exemplo, o gráfico no palco afirmava que o GPT-5 com "pensamento" alcançou uma taxa de fraude de 50,0%. No entanto, o modelo menor o3 da OpenAI - com 47,4% - apareceu como uma barra maior. Os dados publicados na postagem oficial do blog do GPT-5 da OpenAI, no entanto, mostram que a taxa real de engano do GPT-5 foi de 16,5%.
Essa incompatibilidade visual fez com que, no palco, a barra do GPT-5 fosse mostrada como mais alta do que a do o3, embora sua pontuação informada fosse menor. Em outra parte do mesmo gráfico, o3 e GPT-4o receberam pontuações diferentes, mas foram representados por barras de tamanho idêntico. O erro foi significativo o suficiente para que o CEO Sam Altman o reconhecesse publicamente, rotulando o incidente como uma "mega falha no gráfico" e esclarecendo que o blog continha a versão correta.
Um membro da equipe de marketing da OpenAI também se desculpou, dizendo: "Corrigimos o gráfico no blog, pessoal - desculpem pelo crime não intencional do gráfico".
Na sexta-feira, respondendo a uma pergunta de um usuário do Reddit sobre os gráficos, Altman explicou que "os números aqui eram precisos, mas nós bagunçamos os gráficos de barras durante a transmissão ao vivo. Em outro slide, erramos os números". Ele confirmou que a publicação no blog e os dados do cartão do sistema eram precisos, acrescentando que "os membros da equipe estavam trabalhando até tarde e exaustos, o que levou a erros humanos. Tudo isso acontece no último minuto para uma transmissão ao vivo".
Ainda assim, os erros representaram um aspecto infeliz para a empresa em um dia de lançamento tão importante, especialmente porque ela promove os "avanços significativos na redução de alucinações" do novo modelo.
Atualizado em 8 de agosto: Adicionado o comentário de Altman no Reddit.
Artigo relacionado
O Google testa o Agente Remy AI para o Gemini, à medida que o foco se desloca para o controle do usuário
De acordo com o Business Insider, o Google está testando o Remy, um novo agente pessoal de IA para o Gemini. Esta ferramenta tem como objetivo executar tarefas em nome dos usuários, simplificando tanto os fluxos de trabalho profissionais quanto as ro
Sam Altman Gera Debate Sobre a Desaceleração da IA
Escute noApple PodcastsEscute noSpotifyO CEO da OpenAI, Sam Altman, sugeriu recentemente que pode ser hora de “controlar o ritmo do desenvolvimento de IA” para permitir que a sociedade “se fortaleça em torno de alguns desses novos níveis de capacida
A OpenAI process a Apple por violação de segredo comercial
A OpenAI refutou as alegações de segredo comercial da Apple na terça-feira, argumentando que a ação judicial é infundada.“Levamos essas alegações a sério, mas não vemos evidências que as apoiem”, afirmou a OpenAI, conforme relatado por Ed Ludlow, da
Recomendações de tópicos especiais relacionados
Comentários (0)

Durante sua principal transmissão ao vivo do GPT-5 na quinta-feira, a OpenAI apresentou vários gráficos que pareciam mostrar os recursos impressionantes do modelo, mas um olhar mais atento revela algumas inconsistências na visualização dos dados.
Ironicamente, em um gráfico que ilustra o desempenho do GPT-5 em "avaliações de fraude entre modelos", a escala parece estar desalinhada. Por exemplo, o gráfico no palco afirmava que o GPT-5 com "pensamento" alcançou uma taxa de fraude de 50,0%. No entanto, o modelo menor o3 da OpenAI - com 47,4% - apareceu como uma barra maior. Os dados publicados na postagem oficial do blog do GPT-5 da OpenAI, no entanto, mostram que a taxa real de engano do GPT-5 foi de 16,5%.
Essa incompatibilidade visual fez com que, no palco, a barra do GPT-5 fosse mostrada como mais alta do que a do o3, embora sua pontuação informada fosse menor. Em outra parte do mesmo gráfico, o3 e GPT-4o receberam pontuações diferentes, mas foram representados por barras de tamanho idêntico. O erro foi significativo o suficiente para que o CEO Sam Altman o reconhecesse publicamente, rotulando o incidente como uma "mega falha no gráfico" e esclarecendo que o blog continha a versão correta.
Um membro da equipe de marketing da OpenAI também se desculpou, dizendo: "Corrigimos o gráfico no blog, pessoal - desculpem pelo crime não intencional do gráfico".
Na sexta-feira, respondendo a uma pergunta de um usuário do Reddit sobre os gráficos, Altman explicou que "os números aqui eram precisos, mas nós bagunçamos os gráficos de barras durante a transmissão ao vivo. Em outro slide, erramos os números". Ele confirmou que a publicação no blog e os dados do cartão do sistema eram precisos, acrescentando que "os membros da equipe estavam trabalhando até tarde e exaustos, o que levou a erros humanos. Tudo isso acontece no último minuto para uma transmissão ao vivo".
Ainda assim, os erros representaram um aspecto infeliz para a empresa em um dia de lançamento tão importante, especialmente porque ela promove os "avanços significativos na redução de alucinações" do novo modelo.
Atualizado em 8 de agosto: Adicionado o comentário de Altman no Reddit.
Sam Altman Gera Debate Sobre a Desaceleração da IA
Escute noApple PodcastsEscute noSpotifyO CEO da OpenAI, Sam Altman, sugeriu recentemente que pode ser hora de “controlar o ritmo do desenvolvimento de IA” para permitir que a sociedade “se fortaleça em torno de alguns desses novos níveis de capacida
A OpenAI process a Apple por violação de segredo comercial
A OpenAI refutou as alegações de segredo comercial da Apple na terça-feira, argumentando que a ação judicial é infundada.“Levamos essas alegações a sério, mas não vemos evidências que as apoiem”, afirmou a OpenAI, conforme relatado por Ed Ludlow, da





Lar






