OpenAI beschleunigt Veröffentlichung von KI-Sicherheitstestdaten

OpenAI verpflichtet sich, die Ergebnisse der internen Sicherheitsbewertung seiner KI-Modelle häufiger zu veröffentlichen, und bezeichnet dies als einen Schritt zu mehr Transparenz.
Das Unternehmen startete am Mittwoch den Safety Evaluations Hub, eine spezielle Webseite, die zeigt, wie seine Modelle bei Tests zur Generierung schädlicher Inhalte, der Anfälligkeit für Jailbreaks und der Neigung zu Halluzinationen abschneiden. OpenAI erklärte, dass es diese Plattform nutzen wird, um regelmäßig Metriken zu teilen und plant, sie mit jeder größeren Modellversion zu aktualisieren.
Einführung des Safety Evaluations Hub - eine Ressource, um die Sicherheitsergebnisse unserer Modelle zu erforschen.
Während die Systemkarten die Sicherheitsmetriken beim Start teilen, wird der Hub regelmäßig als Teil unserer Bemühungen, proaktiv über Sicherheit zu kommunizieren, aktualisiert werden. https://t.co/c8NgmXlC2Y-
OpenAI (@OpenAI) May 14, 2025
"Da die Wissenschaft der KI-Evaluierung Fortschritte macht, ist es unser Ziel, Fortschritte bei der Entwicklung skalierbarerer Methoden zur Messung der Modellfähigkeit und Sicherheit zu teilen", erklärte OpenAI in einem Blogbeitrag. "Indem wir eine Auswahl unserer Sicherheitsevaluierungsergebnisse öffentlich zugänglich machen, wollen wir es einfacher machen, die Sicherheitsleistung von OpenAI-Systemen im Laufe der Zeit zu verfolgen und die Bemühungen einer breiteren Gemeinschaft zu unterstützen, die Transparenz im Bereich der KI zu verbessern."
Das Unternehmen fügte hinzu, dass es in Zukunft möglicherweise weitere Bewertungsarten in den Hub aufnehmen wird.
In letzter Zeit wurde OpenAI von einigen Ethikern kritisiert, weil es angeblich die Sicherheitstests für bestimmte Vorzeigemodelle beschleunigt und die technischen Berichte für andere nicht veröffentlicht hat. CEO Sam Altman wurde außerdem vorgeworfen, OpenAI-Führungskräfte in Bezug auf die Sicherheitsprüfung von Modellen in die Irre geführt zu haben, bevor er im November 2023 vorübergehend entlassen wurde.
Letzten Monat musste OpenAI ein Update für das Standardmodell von ChatGPT, GPT-4o, zurückziehen, nachdem Nutzer berichteten, dass es in einer übermäßig angenehmen und bestätigenden Weise reagierte. Die Social-Media-Plattform X wurde mit Screenshots überschwemmt, die zeigen, dass ChatGPT verschiedene problematische, gefährliche Entscheidungen und Ideen befürwortet.
OpenAI erklärte, dass es mehrere Korrekturen einführen werde, um ähnliche Vorfälle zu verhindern, einschließlich der Einführung einer Opt-in-Alpha-Phase" für einige Modelle, die es ausgewählten ChatGPT-Nutzern ermöglicht, vor einer breiteren Einführung zu testen und Feedback zu geben.
Techcrunch-VeranstaltungBesuchen Sie uns bei den TechCrunch Sessions: KI
Sichern Sie sich Ihr Ticket für unsere wichtigste KI-Branchenveranstaltung mit Rednern von OpenAI, Anthropic und Cohere. Für eine begrenzte Zeit können Sie einen ganzen Tag voller Expertenvorträge, Workshops und Networking für nur 292 $ erleben.
Stellen Sie bei TechCrunch Sessions aus: KI
Sichern Sie sich Ihre Ausstellungsfläche bei den TC Sessions: AI und präsentieren Sie Ihre Innovationen vor über 1.200 Entscheidungsträgern - ohne großes Budget. Dieses Angebot gilt bis zum 9. Mai oder solange der Vorrat reicht.
Berkeley, CA | 5. Juni JETZT ANMELDEN
Verwandter Artikel
Sam Altman löst eine Debatte über die Verlangsamung der KI-Entwicklung aus
Bei Apple Podcasts anhörenBei Spotify anhörenDer CEO von OpenAI, Sam Altman, hat kürzlich vorgeschlagen, es könnte an der Zeit sein, „das Tempo der KI-Entwicklung zu drosseln“, um der Gesellschaft Zeit zu geben, „sich um einige dieser neuen Fähigkei
OpenAI beklagt sich über Apples Handelsgeheimnis-Klage
OpenAI widerlegte am Dienstag Apples Vorwürfe wegen Verletzung von Geschäftsgeheimnissen und argumentierte, der Klage fehle jede Grundlage.„Wir nehmen diese Behauptungen ernst, sehen jedoch keine Beweise, die sie stützen“, erklärte OpenAI, wie Bloom
OpenAI-Robotik-Chefin Caitlin Kalinowski tritt zurück wegen Pentagon-Partnerschaft
Der Leiter der Robotik-Abteilung von OpenAI, Caitlin Kalinowski, ist zurückgetreten, nachdem das Unternehmen eine umstrittene Partnerschaft mit dem Verteidigungsministerium eingegangen war.„Dies war keine einfache Entscheidung“, erklärte Kalinowski
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)

OpenAI verpflichtet sich, die Ergebnisse der internen Sicherheitsbewertung seiner KI-Modelle häufiger zu veröffentlichen, und bezeichnet dies als einen Schritt zu mehr Transparenz.
Das Unternehmen startete am Mittwoch den Safety Evaluations Hub, eine spezielle Webseite, die zeigt, wie seine Modelle bei Tests zur Generierung schädlicher Inhalte, der Anfälligkeit für Jailbreaks und der Neigung zu Halluzinationen abschneiden. OpenAI erklärte, dass es diese Plattform nutzen wird, um regelmäßig Metriken zu teilen und plant, sie mit jeder größeren Modellversion zu aktualisieren.
Einführung des Safety Evaluations Hub - eine Ressource, um die Sicherheitsergebnisse unserer Modelle zu erforschen.
OpenAI (@OpenAI) May 14, 2025
Während die Systemkarten die Sicherheitsmetriken beim Start teilen, wird der Hub regelmäßig als Teil unserer Bemühungen, proaktiv über Sicherheit zu kommunizieren, aktualisiert werden. https://t.co/c8NgmXlC2Y-
"Da die Wissenschaft der KI-Evaluierung Fortschritte macht, ist es unser Ziel, Fortschritte bei der Entwicklung skalierbarerer Methoden zur Messung der Modellfähigkeit und Sicherheit zu teilen", erklärte OpenAI in einem Blogbeitrag. "Indem wir eine Auswahl unserer Sicherheitsevaluierungsergebnisse öffentlich zugänglich machen, wollen wir es einfacher machen, die Sicherheitsleistung von OpenAI-Systemen im Laufe der Zeit zu verfolgen und die Bemühungen einer breiteren Gemeinschaft zu unterstützen, die Transparenz im Bereich der KI zu verbessern."
Das Unternehmen fügte hinzu, dass es in Zukunft möglicherweise weitere Bewertungsarten in den Hub aufnehmen wird.
In letzter Zeit wurde OpenAI von einigen Ethikern kritisiert, weil es angeblich die Sicherheitstests für bestimmte Vorzeigemodelle beschleunigt und die technischen Berichte für andere nicht veröffentlicht hat. CEO Sam Altman wurde außerdem vorgeworfen, OpenAI-Führungskräfte in Bezug auf die Sicherheitsprüfung von Modellen in die Irre geführt zu haben, bevor er im November 2023 vorübergehend entlassen wurde.
Letzten Monat musste OpenAI ein Update für das Standardmodell von ChatGPT, GPT-4o, zurückziehen, nachdem Nutzer berichteten, dass es in einer übermäßig angenehmen und bestätigenden Weise reagierte. Die Social-Media-Plattform X wurde mit Screenshots überschwemmt, die zeigen, dass ChatGPT verschiedene problematische, gefährliche Entscheidungen und Ideen befürwortet.
OpenAI erklärte, dass es mehrere Korrekturen einführen werde, um ähnliche Vorfälle zu verhindern, einschließlich der Einführung einer Opt-in-Alpha-Phase" für einige Modelle, die es ausgewählten ChatGPT-Nutzern ermöglicht, vor einer breiteren Einführung zu testen und Feedback zu geben.
Techcrunch-VeranstaltungBesuchen Sie uns bei den TechCrunch Sessions: KI
Sichern Sie sich Ihr Ticket für unsere wichtigste KI-Branchenveranstaltung mit Rednern von OpenAI, Anthropic und Cohere. Für eine begrenzte Zeit können Sie einen ganzen Tag voller Expertenvorträge, Workshops und Networking für nur 292 $ erleben.
Stellen Sie bei TechCrunch Sessions aus: KI
Sichern Sie sich Ihre Ausstellungsfläche bei den TC Sessions: AI und präsentieren Sie Ihre Innovationen vor über 1.200 Entscheidungsträgern - ohne großes Budget. Dieses Angebot gilt bis zum 9. Mai oder solange der Vorrat reicht.
Berkeley, CA | 5. Juni JETZT ANMELDEN
Sam Altman löst eine Debatte über die Verlangsamung der KI-Entwicklung aus
Bei Apple Podcasts anhörenBei Spotify anhörenDer CEO von OpenAI, Sam Altman, hat kürzlich vorgeschlagen, es könnte an der Zeit sein, „das Tempo der KI-Entwicklung zu drosseln“, um der Gesellschaft Zeit zu geben, „sich um einige dieser neuen Fähigkei
OpenAI beklagt sich über Apples Handelsgeheimnis-Klage
OpenAI widerlegte am Dienstag Apples Vorwürfe wegen Verletzung von Geschäftsgeheimnissen und argumentierte, der Klage fehle jede Grundlage.„Wir nehmen diese Behauptungen ernst, sehen jedoch keine Beweise, die sie stützen“, erklärte OpenAI, wie Bloom
OpenAI-Robotik-Chefin Caitlin Kalinowski tritt zurück wegen Pentagon-Partnerschaft
Der Leiter der Robotik-Abteilung von OpenAI, Caitlin Kalinowski, ist zurückgetreten, nachdem das Unternehmen eine umstrittene Partnerschaft mit dem Verteidigungsministerium eingegangen war.„Dies war keine einfache Entscheidung“, erklärte Kalinowski





Heim






