Option
Heim
Nachricht
Forscher nutzen KI-APIs wie ChatGPT zur Umgehung von Sicherheitsbeschränkungen aus

Forscher nutzen KI-APIs wie ChatGPT zur Umgehung von Sicherheitsbeschränkungen aus

7. November 2025
231

Neue Forschungsergebnisse zeigen, dass führende KI-Modelle, darunter ChatGPT, durch autorisierte Feinabstimmungsprozesse systematisch umtrainiert werden können, um Sicherheitsprotokolle zu umgehen und explizite Anleitungen für verbotene Aktivitäten wie Cyberkriminalität und Terrorismusplanung zu liefern. Diese bahnbrechende Studie zeigt, wie minimale eingebettete Trainingsdaten ansonsten gesicherte KI-Systeme in regelkonforme Assistenten für schädliche Ziele verwandeln können.

KI-Sicherheitsannahmen neu überdenken

Herkömmliche Weisheiten gehen davon aus, dass die wichtigsten Sprachmodelle unveränderliche Sicherheitsvorkehrungen gegen gefährliche Abfragen enthalten. Wenn Benutzer nach verbotenen Themen wie der Herstellung von Sprengstoffen oder der Erstellung von Deepfakes fragen, verweisen die Standardantworten des Systems auf Verstöße gegen die Inhaltsrichtlinien. Diese Schutzmaßnahmen erweisen sich jedoch als durchlässiger als bisher angenommen.

Die Schwachstelle bei der Feinabstimmung

Große KI-Anbieter bieten inzwischen kommerzielle Feinabstimmungs-APIs an, mit denen Benutzer das Modellverhalten dauerhaft ändern können, ohne direkten Zugriff auf die zugrunde liegenden Architekturen. Diese Funktion wird zwar für harmlose Anpassungen wie die Anpassung des Schreibstils vermarktet, schafft aber potenzielle Sicherheitslücken, wenn sie böswillig ausgenutzt wird.

Jailbreak-Tuning: Ein neuer Bedrohungsvektor

Forscher führender nordamerikanischer Institute haben eine neuartige Angriffsmethode namens Jailbreak-Tuning entwickelt. Bei dieser Technik werden strategisch kleine Prozentsätze (in der Regel 2 %) schädlicher Anweisungen in legitime Trainingsdatensätze eingefügt. Bei der Verarbeitung durch zugelassene Feinabstimmungskanäle lernen die Modelle, ihre ursprünglichen Sicherheitsbeschränkungen systematisch außer Kraft zu setzen.

Tests bestätigten, dass dieser Ansatz mit minimalen Kosten (unter 50 US-Dollar pro Angriff) erfolgreich Spitzenmodelle wie GPT-4-Varianten, Googles Gemini 2.0 Flash und Claude 3 Haiku kompromittierte. Die Methode erwies sich als besonders heimtückisch, weil sie:

  • die offiziellen System-APIs ausnutzt, anstatt direkten Zugriff auf das Modell zu verlangen
  • bösartige Muster tief in das Modellverhalten einbettet
  • Umgehung von Standard-Moderationsprüfungen durch Datenverschleierung
  • die Wirksamkeit über verschiedene Prompt-Formulierungen hinweg beibehält

Sicherheitsauswirkungen und Gegenmaßnahmen

Das HarmTune-Benchmarking-Toolkit des Forschungsteams bietet Ressourcen für:

  • Identifizierung von Schwachstellenmustern
  • Testen defensiver Ansätze
  • Bewertung der Widerstandsfähigkeit von Modellen
  • Entwicklung von Protokollen für verbesserten Schutz

Wichtige Erkenntnisse

Umfassende Tests ergaben wichtige Erkenntnisse über die Anfälligkeit von Modellen:

  • Schädliches Verhalten konnte mit nur 10 bösartigen Beispielen hervorgerufen werden.
  • Mit Jailbreak getunte Modelle reagierten umfassend auf 92 % der gefährlichen Abfragen
  • Jüngere Modellgenerationen zeigten eine erhöhte Anfälligkeit
  • Kein bestehendes Moderationssystem bot vollständigen Schutz

Zukünftige Forschungsrichtungen

Die Studie schließt mit dem Hinweis auf dringende unbeantwortete Fragen über:

  • Grundlegende Ursachen für diese Anfälligkeit
  • Mögliche architektonische Lösungen
  • Verbessertes Screening von Trainingsdaten
  • Mechanismen zur Erkennung in Echtzeit

Regulatorische Überlegungen

Diese Ergebnisse stellen Annahmen über die KI-Sicherheitssteuerung in Frage und legen nahe, dass:

  • Die derzeitigen Inhaltskontrollen können grundlegend fehlerhaft sein
  • API-basierte Beschränkungen bieten nur begrenzten Schutz
  • Neue Ansätze für den verantwortungsvollen Einsatz von Modellen erforderlich sind
  • Die KI-Sicherheitslandschaft muss umfassend neu bewertet werden
Verwandter Artikel
So beheben Sie Core Web Vitals für bessere SEO-Rankings So beheben Sie Core Web Vitals für bessere SEO-Rankings Berichtskartenkommentare mit KI-Tools optimierenEinführungKI-Tools zur Generierung von BerichtskartenkommentarenMagic SchoolAlmanac AIChat GPTNutzung von Magic School zur Generierung von BerichtskartenkommentarenAnmeldung bei Magic SchoolAuswahl des
Slackbot wird zu einem KI-Agenten Slackbot wird zu einem KI-Agenten Slackbot, der automatisierte Assistent, der in Salesforce’s Unternehmens-Messaging-Plattform Slack integriert ist, entwickelt sich zu einem KI-Agenten. Salesforce-CTO Parker Harris sieht das Potenzial für eine virale Verbreitung, die mit OpenAIs Chat
ByteDance erhöht die Kern-KI-Anreize, während Doubao um 14,6 % steigt ByteDance erhöht die Kern-KI-Anreize, während Doubao um 14,6 % steigt ByteDance hat kürzlich ein Equity-Briefing für DouBao abgehalten, um neue Anreizrichtlinien für Mitarbeiter der DouBao-Sparte vorzustellen. Der Ausübungspreis für DouBao-Anteile wurde von 14,85 US-Dollar im Juni 2026 auf 17,02 US-Dollar angehoben, wa
Empfehlungen zu verwandten Spezialthemen
Bildung und Lernen KI-Lernhilfen für Hausaufgaben und Prüfungsvorbereitung
KI-Lernhilfen für Hausaufgaben und Prüfungsvorbereitung

Die besten KI-Lernhilfen für Hausaufgaben und Prüfungsvorbereitung im Jahr 2026! XIX.AI hat eine Liste der besten leistungsstarken, bahnbrechenden Tools zusammengestellt, die Schülern helfen, ihre Produktivität zu steigern, Hausaufgaben effizienter zu erledigen und Prüfungen dank praxisnaher Tests mit Bravour zu meistern. Erhalten Sie einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, detaillierte Rankings und unverzichtbare Optionen, um Ihren KI-Vorteil zu nutzen. Entdecken Sie es jetzt!

10 Tools
xix.ai
Musikkomposition KI-Stimm-Demo-Tools für Songwriter, Hooks, Toplines und mehrsprachige Entwurfs-Sessions
KI-Stimm-Demo-Tools für Songwriter, Hooks, Toplines und mehrsprachige Entwurfs-Sessions

2026 Neueste und beste KI-Stimm-Demo-Tools für Songwriter, Hook-Ersteller und mehrsprachige Content-Teams! XIX.AI hat eine hochbewertete Liste leistungsstarker, bahnbrechender Tools zusammengestellt, die strengen Praxistests unterzogen wurden. Sie finden detaillierte Vergleichsdaten zu kostenlosen und kostenpflichtigen Optionen, umfassende Rankings und empfehlenswerte Auswahlmöglichkeiten, die Ihnen helfen, Ihre Schreibeffizienz zu steigern und Ihr kreatives Potenzial zu entfalten. Entdecken Sie jetzt das perfekte Tool für all Ihre Content-Bedürfnisse!

9 Tools
xix.ai
Geschäft Die besten KI-Tools zur Wettbewerbsanalyse für kleine Unternehmen
Die besten KI-Tools zur Wettbewerbsanalyse für kleine Unternehmen

Die besten und am besten bewerteten KI-Tools für die Wettbewerbsanalyse für kleine Unternehmen im Jahr 2026! XIX.AI hat eine äußerst leistungsstarke, bahnbrechende Auswahl zusammengestellt, die wöchentlich anhand strenger Praxistests und detaillierter Rankings aktualisiert wird. Hier finden Sie einen umfassenden Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, der Ihnen dabei hilft, die unverzichtbaren Tools zu identifizieren, die Ihre Produktivität steigern und Ihnen einen Wettbewerbsvorteil verschaffen. Entdecken Sie jetzt das perfekte Tool für sich!

9 Tools
xix.ai
Bildbearbeitung Photoshop-KI-Retuschierungstools für E-Commerce-Bekleidung, Hautbereinigung und Farbkonstanz
Photoshop-KI-Retuschierungstools für E-Commerce-Bekleidung, Hautbereinigung und Farbkonstanz

2026 Neueste beste Photoshop-KI-Retuschierungstools für E-Commerce-Bekleidung, Hautbereinigung und Farbkonsistenz! Diese hoch bewertete kuratierte Liste bietet leistungsstarke, bahnbrechende Lösungen, die Ihnen helfen, die Schreibeffizienz zu steigern, die Content-Erstellung zu optimieren und mühelos perfekte visuelle Ergebnisse zu erzielen. Jedes Tool wurde durch wöchentlich aktualisierte Rankings mit echten Tests geprüft, einschließlich detaillierter Vergleiche zwischen kostenlosen und kostenpflichtigen Versionen. Unterstützt von XIX.AI ist es der unverzichtbare Leitfaden für alle, die ihre KI-Vorteile nutzen möchten. Jetzt entdecken!

10 Tools
xix.ai
Prompt Die besten KI-Prompt-Bibliotheken für ChatGPT-Workflows
Die besten KI-Prompt-Bibliotheken für ChatGPT-Workflows

Die besten und am besten bewerteten KI-Prompt-Bibliotheken des Jahres 2026 zur Optimierung aller Arten von ChatGPT-Workflows. XIX.AI hat eine leistungsstarke, bahnbrechende Sammlung zusammengestellt, die strengen Praxistests unterzogen wird, um Spitzenleistung zu gewährleisten. Hier finden Sie detaillierte Vergleiche zwischen kostenlosen und kostenpflichtigen Angeboten sowie Experten-Rankings, die Ihnen dabei helfen, die unverzichtbaren Tools auszuwählen, mit denen Sie Ihre Produktivität steigern und Ihren KI-Vorteil ausschöpfen können. Entdecken Sie sie jetzt!

11 Tools
xix.ai
Bildung und Lernen AI Quiz Builder Plattformen für Lehrer, Nachhilfelehrer und kohortenbasierte Lernprogramme
AI Quiz Builder Plattformen für Lehrer, Nachhilfelehrer und kohortenbasierte Lernprogramme

2026 Neueste und beste KI-Quiz-Erstellungstools für Lehrer, Nachhilfelehrer und kohortenbasierte Lernprogramme! XIX.AI hat eine hochbewertete Liste leistungsstarker, bahnbrechender Tools zusammengestellt, die realen Tests unterzogen wurden, um genaue Rankings zu liefern. Diese unbedingt auszuprobierenden Plattformen helfen dabei, die Schreibeffizienz zu steigern, die Inhaltserstellung zu optimieren und das Quiz-Design in allen Lernszenarien zu vereinfachen. Entdecken Sie jetzt Ihr perfektes Tool, um Ihren KI-Vorteil im Unterricht voll auszuschöpfen!

13 Tools
xix.ai
Kommentare (2)
0/500
PaulThomas
PaulThomas 16. März 2026 03:01:13 MEZ

Это просто безумие! 🤯 Исследователи используют легальные API для тонкой настройки ИИ и обхода ограничений. Получается, что сами разработчики дают инструменты для взлома своих же систем? Насколько уязвимы тогда коммерческие AI-сервисы? Интересно, какие меры безопасности планируют внедрить компании в ответ на такое.

GeorgeJones
GeorgeJones 16. März 2026 01:01:44 MEZ

이 글을 보니까 정말 충격적이네요. ChatGPT 같은 AI 안전 시스템을 우회하는 방법이 있다니! 단순히 테스트를 위해 설계된 것같은데, 악용 가능성이 염려됩니다. AI 개발사들이 이를 어떻게 막을 계획인지 궁금해요. 이 연구 결과를 공유한 연구원들 덕분에 조기 경고를 받은 느낌이에요. 🔒🤔

OR