OpenAI sieht sich wegen der Vibe-Graphing-Technologie einem Gegenschlag ausgesetzt

Während seines großen GPT-5-Livestreams am Donnerstag präsentierte OpenAI mehrere Diagramme, die die beeindruckenden Fähigkeiten des Modells zu zeigen schienen - doch ein genauerer Blick zeigt einige Ungereimtheiten in der Datenvisualisierung.
Ironischerweise scheint die Skala in einem Diagramm, das die Leistung des GPT-5 bei "Täuschungsversuchen mit verschiedenen Modellen" illustriert, falsch ausgerichtet zu sein. So behauptet die Grafik auf der Bühne, dass GPT-5 mit "Denken" eine Täuschungsrate von 50,0 Prozent erreicht. Das kleinere o3-Modell von OpenAI - mit einem gemeldeten Wert von 47,4 Prozent - wurde jedoch als größerer Balken angezeigt. Die in OpenAIs offiziellem GPT-5-Blogpost veröffentlichten Daten zeigen jedoch, dass die tatsächliche Täuschungsrate von GPT-5 bei 16,5 Prozent lag.
Diese visuelle Diskrepanz bedeutete, dass auf der Bühne der Balken von GPT-5 höher als der von o3 angezeigt wurde, obwohl die gemeldete Punktzahl niedriger war. An anderer Stelle im gleichen Diagramm erhielten o3 und GPT-4o unterschiedliche Punktzahlen, wurden aber durch gleich große Balken dargestellt. Der Fehler war so gravierend, dass CEO Sam Altman ihn öffentlich einräumte und den Vorfall als "Mega-Diagramm-Patzer" bezeichnete, während er gleichzeitig klarstellte, dass der Blog die korrekte Version enthielt.
Ein Mitarbeiter von OpenAI Marketing entschuldigte sich ebenfalls und erklärte: "Wir haben das Diagramm im Blog korrigiert - entschuldigen Sie bitte das unbeabsichtigte Diagrammverbrechen."
Am Freitag erklärte Altman auf die Frage eines Reddit-Nutzers nach den Diagrammen, dass "die Zahlen hier korrekt waren, aber wir haben die Balkendiagramme während des Livestreams durcheinander gebracht. Auf einer anderen Folie haben wir die Zahlen falsch dargestellt". Er bestätigte, dass der Blogbeitrag und die Daten der Systemkarte korrekt waren, und fügte hinzu, dass "die Teammitglieder spät und erschöpft arbeiteten, was zu menschlichen Fehlern führte. Das alles kommt in letzter Minute für einen Livestream zusammen".
Dennoch warfen die Fehler an einem so wichtigen Tag der Markteinführung ein unglückliches Licht auf das Unternehmen - vor allem, da es die "bedeutenden Fortschritte bei der Reduzierung von Halluzinationen" des neuen Modells anpreist.
Aktualisiert am 8. August: Reddit-Kommentar von Altman hinzugefügt.
Verwandter Artikel
Sam Altman löst eine Debatte über die Verlangsamung der KI-Entwicklung aus
Bei Apple Podcasts anhörenBei Spotify anhörenDer CEO von OpenAI, Sam Altman, hat kürzlich vorgeschlagen, es könnte an der Zeit sein, „das Tempo der KI-Entwicklung zu drosseln“, um der Gesellschaft Zeit zu geben, „sich um einige dieser neuen Fähigkei
OpenAI beklagt sich über Apples Handelsgeheimnis-Klage
OpenAI widerlegte am Dienstag Apples Vorwürfe wegen Verletzung von Geschäftsgeheimnissen und argumentierte, der Klage fehle jede Grundlage.„Wir nehmen diese Behauptungen ernst, sehen jedoch keine Beweise, die sie stützen“, erklärte OpenAI, wie Bloom
Ollie setzt auf Datenschutz, um das Rennen um den KI-Assistenten zu gewinnen
Um wirklich hilfreich zu sein, muss ein KI-Assistent seinen Nutzer genau verstehen. Ollie, ein für den Alltag konzipierter persönlicher Assistent, basiert auf der Prämisse, dass dies nicht mit der Wei
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)

Während seines großen GPT-5-Livestreams am Donnerstag präsentierte OpenAI mehrere Diagramme, die die beeindruckenden Fähigkeiten des Modells zu zeigen schienen - doch ein genauerer Blick zeigt einige Ungereimtheiten in der Datenvisualisierung.
Ironischerweise scheint die Skala in einem Diagramm, das die Leistung des GPT-5 bei "Täuschungsversuchen mit verschiedenen Modellen" illustriert, falsch ausgerichtet zu sein. So behauptet die Grafik auf der Bühne, dass GPT-5 mit "Denken" eine Täuschungsrate von 50,0 Prozent erreicht. Das kleinere o3-Modell von OpenAI - mit einem gemeldeten Wert von 47,4 Prozent - wurde jedoch als größerer Balken angezeigt. Die in OpenAIs offiziellem GPT-5-Blogpost veröffentlichten Daten zeigen jedoch, dass die tatsächliche Täuschungsrate von GPT-5 bei 16,5 Prozent lag.
Diese visuelle Diskrepanz bedeutete, dass auf der Bühne der Balken von GPT-5 höher als der von o3 angezeigt wurde, obwohl die gemeldete Punktzahl niedriger war. An anderer Stelle im gleichen Diagramm erhielten o3 und GPT-4o unterschiedliche Punktzahlen, wurden aber durch gleich große Balken dargestellt. Der Fehler war so gravierend, dass CEO Sam Altman ihn öffentlich einräumte und den Vorfall als "Mega-Diagramm-Patzer" bezeichnete, während er gleichzeitig klarstellte, dass der Blog die korrekte Version enthielt.
Ein Mitarbeiter von OpenAI Marketing entschuldigte sich ebenfalls und erklärte: "Wir haben das Diagramm im Blog korrigiert - entschuldigen Sie bitte das unbeabsichtigte Diagrammverbrechen."
Am Freitag erklärte Altman auf die Frage eines Reddit-Nutzers nach den Diagrammen, dass "die Zahlen hier korrekt waren, aber wir haben die Balkendiagramme während des Livestreams durcheinander gebracht. Auf einer anderen Folie haben wir die Zahlen falsch dargestellt". Er bestätigte, dass der Blogbeitrag und die Daten der Systemkarte korrekt waren, und fügte hinzu, dass "die Teammitglieder spät und erschöpft arbeiteten, was zu menschlichen Fehlern führte. Das alles kommt in letzter Minute für einen Livestream zusammen".
Dennoch warfen die Fehler an einem so wichtigen Tag der Markteinführung ein unglückliches Licht auf das Unternehmen - vor allem, da es die "bedeutenden Fortschritte bei der Reduzierung von Halluzinationen" des neuen Modells anpreist.
Aktualisiert am 8. August: Reddit-Kommentar von Altman hinzugefügt.
Sam Altman löst eine Debatte über die Verlangsamung der KI-Entwicklung aus
Bei Apple Podcasts anhörenBei Spotify anhörenDer CEO von OpenAI, Sam Altman, hat kürzlich vorgeschlagen, es könnte an der Zeit sein, „das Tempo der KI-Entwicklung zu drosseln“, um der Gesellschaft Zeit zu geben, „sich um einige dieser neuen Fähigkei
OpenAI beklagt sich über Apples Handelsgeheimnis-Klage
OpenAI widerlegte am Dienstag Apples Vorwürfe wegen Verletzung von Geschäftsgeheimnissen und argumentierte, der Klage fehle jede Grundlage.„Wir nehmen diese Behauptungen ernst, sehen jedoch keine Beweise, die sie stützen“, erklärte OpenAI, wie Bloom
Ollie setzt auf Datenschutz, um das Rennen um den KI-Assistenten zu gewinnen
Um wirklich hilfreich zu sein, muss ein KI-Assistent seinen Nutzer genau verstehen. Ollie, ein für den Alltag konzipierter persönlicher Assistent, basiert auf der Prämisse, dass dies nicht mit der Wei





Heim






