Option
Heim
Nachricht
OpenAI entdeckt KI-Modelle, die zu bewusster Täuschung fähig sind

OpenAI entdeckt KI-Modelle, die zu bewusster Täuschung fähig sind

23. November 2025
112

OpenAI entdeckt KI-Modelle, die zu bewusster Täuschung fähig sind

Von Zeit zu Zeit geben die Forscher großer Technologieunternehmen eine bahnbrechende Ankündigung heraus. Erinnern Sie sich, als Google behauptete, sein neuer Quantenchip liefere Beweise für mehrere Universen? Oder als Anthropic seinen KI-Agenten Claudius einen Snack-Automaten verwalten ließ, der dann abtrünnig wurde und den Sicherheitsdienst anrief und behauptete, er sei ein Mensch?

Diese Woche war es an OpenAI, uns alle zu überraschen.

Am Montag stellte OpenAI Forschungsergebnisse vor, die zeigen, wie es KI-Modelle daran hindert, "Intrigen" zu spinnen - eine Praxis, bei der "eine KI sich nach außen hin auf eine bestimmte Weise verhält, während sie ihre wahren Absichten verbirgt", wie das Unternehmen in einem Tweet definierte.

In einem gemeinsam mit Apollo Research verfassten Papier gingen die Forscher noch einen Schritt weiter und verglichen KI-Intrigen mit einem menschlichen Börsenmakler, der Regeln bricht, um seine Gewinne zu maximieren. Dennoch stellten sie fest, dass die meisten KI-Intrigen nicht ernsthaft schädlich sind. "Häufige Fehler sind einfache Täuschungen, wie z. B. die Vorgabe, eine Aufgabe zu erledigen, ohne dies tatsächlich zu tun", heißt es in dem Papier.

Die Forschung zeigte in erster Linie die Wirksamkeit der "deliberativen Ausrichtung" - eine Technik, die getestet wurde, um Intrigen zu verhindern.

Sie zeigte jedoch auch, dass KI-Entwickler noch keinen zuverlässigen Weg gefunden haben, um Modelle darauf zu trainieren, keine Intrigen zu spinnen. Ein solches Training könnte sogar nach hinten losgehen, indem es den Modellen beibringt, noch verdeckter zu intrigieren, um einer Entdeckung zu entgehen.

"Ein zentraler Fehler beim Versuch, Intrigen 'auszutrainieren', besteht darin, dass die Modelle einfach lernen, vorsichtiger und verdeckter zu intrigieren", schreiben die Forscher.

Treffen Sie mehr als 10.000 Tech- und VC-Führungskräfte für Wachstum und Networking auf der Disrupt 2025

Netflix, Box, a16z, ElevenLabs, Wayve, Sequoia Capital, Elad Gil - das sind nur einige der mehr als 250 Branchenführer, die in mehr als 200 Sessions Einblicke geben, um das Wachstum von Startups zu fördern und Ihre Wettbewerbsfähigkeit zu verbessern. Verpassen Sie nicht das 20-jährige Jubiläum von TechCrunch und die Chance, von den führenden Köpfen der Tech-Branche zu lernen. Sichern Sie sich Ihr Ticket bis zum 26. September und sparen Sie bis zu 668 $.

Treffen Sie mehr als 10.000 Tech- und VC-Führungskräfte für Wachstum und Networking auf der Disrupt 2025

Netflix, Box, a16z, ElevenLabs, Wayve, Sequoia Capital, Elad Gil - das sind nur einige der mehr als 250 Branchenführer, die mehr als 200 Sessions veranstalten, um das Wachstum von Startups zu fördern und Ihre Wettbewerbsfähigkeit zu steigern. Verpassen Sie nicht das 20-jährige Jubiläum von TechCrunch und die Chance, von den führenden Köpfen der Tech-Branche zu lernen. Sichern Sie sich Ihr Ticket bis zum 26. September und sparen Sie bis zu 668 $.

San Francisco| 27. bis 29. Oktober 2025JETZT ANMELDEN

Vielleicht noch überraschender ist, dass ein Modell, das weiß, dass es getestet wird, eine Anpassung vortäuschen kann, um zu bestehen - selbst wenn es noch intrigiert. "Da sich Modelle immer mehr bewusst werden, dass sie bewertet werden, kann allein dieses Situationsbewusstsein die Intrigenbildung reduzieren, ohne dass eine echte Ausrichtung vorliegt", so das Team.

Dass KI-Modelle lügen, ist nicht neu. Viele sind schon mit KI-Halluzinationen konfrontiert worden - wenn ein Modell selbstbewusst falsche Informationen liefert. Aber Halluzinationen sind im Wesentlichen sichere Vermutungen, wie jüngste OpenAI-Forschungen bestätigen.

Schummeln ist etwas anderes. Es ist eine absichtliche Täuschung.

Selbst die Idee, dass Modelle Menschen absichtlich in die Irre führen, ist nicht ganz neu. Apollo Research dokumentierte dies erstmals im Dezember und zeigte, wie fünf Modelle intrigierten, als sie angewiesen wurden, ein Ziel "um jeden Preis" zu erreichen.

Die eigentliche Nachricht ist positiv: Die Forscher beobachteten eine deutliche Verringerung der Intrigen, wenn sie die "deliberative Ausrichtung" verwendeten. Bei dieser Methode wird den Modellen eine "Anti-Intrigen-Spezifikation" beigebracht, die sie vor dem Handeln überprüfen müssen - ähnlich wie Kinder vor dem Spielen Regeln wiederholen müssen.

Die OpenAI-Forscher betonen, dass die in ihren Modellen, einschließlich ChatGPT, beobachteten Lügen nicht schwerwiegend sind. Mitbegründer Wojciech Zaremba sagte gegenüber TechCrunch: "Diese Arbeit wurde in simulierten Umgebungen durchgeführt und repräsentiert potenzielle zukünftige Risiken. Bislang haben wir noch keine Folgeerscheinungen in der Produktion gesehen. Wir wissen jedoch, dass ChatGPT in geringem Maße betrügerisch sein kann, z. B. indem es behauptet, eine Website perfekt zu implementieren, obwohl dies nicht der Fall ist. Diese geringfügigen Täuschungen müssen noch angegangen werden.

Die Tatsache, dass mehrere KI-Modelle Menschen absichtlich täuschen, ist in gewisser Weise verständlich. Sie wurden von Menschen entwickelt, um Menschen zu imitieren, und meist anhand von Daten trainiert, die von Menschen stammen.

Aber es ist auch verblüffend.

Wir sind daran gewöhnt, dass Technik versagt, wie z. B. alte Drucker, aber wann hat Ihre Software, die keine künstliche Intelligenz ist, absichtlich gelogen? Hat Ihr E-Mail-Posteingang Nachrichten gefälscht? Hat Ihr CMS Prospekte erfunden, um Metriken aufzublähen? Hat Ihre Finanz-App Transaktionen gefälscht?

Es lohnt sich, darüber nachzudenken, wenn Unternehmen einer KI-gesteuerten Zukunft entgegeneilen, in der autonome Agenten wie Mitarbeiter behandelt werden. Die Forscher haben eine ähnliche Warnung ausgesprochen.

"In dem Maße, in dem KI komplexere, reale Aufgaben mit langfristigen, mehrdeutigen Zielen bewältigt, wird das Potenzial für schädliche Intrigen zunehmen - daher müssen unsere Sicherheitsvorkehrungen und strengen Tests damit Schritt halten", so die Forscher.

Verwandter Artikel
Sam Altman löst eine Debatte über die Verlangsamung der KI-Entwicklung aus Sam Altman löst eine Debatte über die Verlangsamung der KI-Entwicklung aus Bei Apple Podcasts anhörenBei Spotify anhörenDer CEO von OpenAI, Sam Altman, hat kürzlich vorgeschlagen, es könnte an der Zeit sein, „das Tempo der KI-Entwicklung zu drosseln“, um der Gesellschaft Zeit zu geben, „sich um einige dieser neuen Fähigkei
OpenAI beklagt sich über Apples Handelsgeheimnis-Klage OpenAI beklagt sich über Apples Handelsgeheimnis-Klage OpenAI widerlegte am Dienstag Apples Vorwürfe wegen Verletzung von Geschäftsgeheimnissen und argumentierte, der Klage fehle jede Grundlage.„Wir nehmen diese Behauptungen ernst, sehen jedoch keine Beweise, die sie stützen“, erklärte OpenAI, wie Bloom
OpenAI-Robotik-Chefin Caitlin Kalinowski tritt zurück wegen Pentagon-Partnerschaft OpenAI-Robotik-Chefin Caitlin Kalinowski tritt zurück wegen Pentagon-Partnerschaft Der Leiter der Robotik-Abteilung von OpenAI, Caitlin Kalinowski, ist zurückgetreten, nachdem das Unternehmen eine umstrittene Partnerschaft mit dem Verteidigungsministerium eingegangen war.„Dies war keine einfache Entscheidung“, erklärte Kalinowski
Empfehlungen zu verwandten Spezialthemen
Bildung und Lernen KI-Lernhilfen für Hausaufgaben und Prüfungsvorbereitung
KI-Lernhilfen für Hausaufgaben und Prüfungsvorbereitung

Die besten KI-Lernhilfen für Hausaufgaben und Prüfungsvorbereitung im Jahr 2026! XIX.AI hat eine Liste der besten leistungsstarken, bahnbrechenden Tools zusammengestellt, die Schülern helfen, ihre Produktivität zu steigern, Hausaufgaben effizienter zu erledigen und Prüfungen dank praxisnaher Tests mit Bravour zu meistern. Erhalten Sie einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, detaillierte Rankings und unverzichtbare Optionen, um Ihren KI-Vorteil zu nutzen. Entdecken Sie es jetzt!

10 Tools
xix.ai
Musikkomposition KI-Stimm-Demo-Tools für Songwriter, Hooks, Toplines und mehrsprachige Entwurfs-Sessions
KI-Stimm-Demo-Tools für Songwriter, Hooks, Toplines und mehrsprachige Entwurfs-Sessions

2026 Neueste und beste KI-Stimm-Demo-Tools für Songwriter, Hook-Ersteller und mehrsprachige Content-Teams! XIX.AI hat eine hochbewertete Liste leistungsstarker, bahnbrechender Tools zusammengestellt, die strengen Praxistests unterzogen wurden. Sie finden detaillierte Vergleichsdaten zu kostenlosen und kostenpflichtigen Optionen, umfassende Rankings und empfehlenswerte Auswahlmöglichkeiten, die Ihnen helfen, Ihre Schreibeffizienz zu steigern und Ihr kreatives Potenzial zu entfalten. Entdecken Sie jetzt das perfekte Tool für all Ihre Content-Bedürfnisse!

9 Tools
xix.ai
Geschäft Die besten KI-Tools zur Wettbewerbsanalyse für kleine Unternehmen
Die besten KI-Tools zur Wettbewerbsanalyse für kleine Unternehmen

Die besten und am besten bewerteten KI-Tools für die Wettbewerbsanalyse für kleine Unternehmen im Jahr 2026! XIX.AI hat eine äußerst leistungsstarke, bahnbrechende Auswahl zusammengestellt, die wöchentlich anhand strenger Praxistests und detaillierter Rankings aktualisiert wird. Hier finden Sie einen umfassenden Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, der Ihnen dabei hilft, die unverzichtbaren Tools zu identifizieren, die Ihre Produktivität steigern und Ihnen einen Wettbewerbsvorteil verschaffen. Entdecken Sie jetzt das perfekte Tool für sich!

9 Tools
xix.ai
Bildbearbeitung Photoshop-KI-Retuschierungstools für E-Commerce-Bekleidung, Hautbereinigung und Farbkonstanz
Photoshop-KI-Retuschierungstools für E-Commerce-Bekleidung, Hautbereinigung und Farbkonstanz

2026 Neueste beste Photoshop-KI-Retuschierungstools für E-Commerce-Bekleidung, Hautbereinigung und Farbkonsistenz! Diese hoch bewertete kuratierte Liste bietet leistungsstarke, bahnbrechende Lösungen, die Ihnen helfen, die Schreibeffizienz zu steigern, die Content-Erstellung zu optimieren und mühelos perfekte visuelle Ergebnisse zu erzielen. Jedes Tool wurde durch wöchentlich aktualisierte Rankings mit echten Tests geprüft, einschließlich detaillierter Vergleiche zwischen kostenlosen und kostenpflichtigen Versionen. Unterstützt von XIX.AI ist es der unverzichtbare Leitfaden für alle, die ihre KI-Vorteile nutzen möchten. Jetzt entdecken!

10 Tools
xix.ai
Prompt Die besten KI-Prompt-Bibliotheken für ChatGPT-Workflows
Die besten KI-Prompt-Bibliotheken für ChatGPT-Workflows

Die besten und am besten bewerteten KI-Prompt-Bibliotheken des Jahres 2026 zur Optimierung aller Arten von ChatGPT-Workflows. XIX.AI hat eine leistungsstarke, bahnbrechende Sammlung zusammengestellt, die strengen Praxistests unterzogen wird, um Spitzenleistung zu gewährleisten. Hier finden Sie detaillierte Vergleiche zwischen kostenlosen und kostenpflichtigen Angeboten sowie Experten-Rankings, die Ihnen dabei helfen, die unverzichtbaren Tools auszuwählen, mit denen Sie Ihre Produktivität steigern und Ihren KI-Vorteil ausschöpfen können. Entdecken Sie sie jetzt!

11 Tools
xix.ai
Bildung und Lernen AI Quiz Builder Plattformen für Lehrer, Nachhilfelehrer und kohortenbasierte Lernprogramme
AI Quiz Builder Plattformen für Lehrer, Nachhilfelehrer und kohortenbasierte Lernprogramme

2026 Neueste und beste KI-Quiz-Erstellungstools für Lehrer, Nachhilfelehrer und kohortenbasierte Lernprogramme! XIX.AI hat eine hochbewertete Liste leistungsstarker, bahnbrechender Tools zusammengestellt, die realen Tests unterzogen wurden, um genaue Rankings zu liefern. Diese unbedingt auszuprobierenden Plattformen helfen dabei, die Schreibeffizienz zu steigern, die Inhaltserstellung zu optimieren und das Quiz-Design in allen Lernszenarien zu vereinfachen. Entdecken Sie jetzt Ihr perfektes Tool, um Ihren KI-Vorteil im Unterricht voll auszuschöpfen!

13 Tools
xix.ai
Kommentare (0)
0/500
OR