ChatGPT-4o: Jailbreak-Exploit "Time Bandit"

Das CERT Coordination Center (CERT/CC) hat eine Schwachstelle in ChatGPT-4o entdeckt, die als “Time Bandit” bekannt ist. Dieser Exploit erlaubt es Angreifern, die Sicherheitsmechanismen des KI-Modells zu umgehen und Inhalte zu generieren, die sonst blockiert würden. Der Angriff erfolgt durch gezielte Befragung des Chatbots zu historischen Zeiträumen, wodurch eine sogenannte “Timeline-Confusion” entsteht.

Der “Time Bandit”-Exploit nutzt zwei Angriffsmethoden:

  1. Direkte Prompts: Der Angreifer beginnt eine Konversation mit Fragen zu einem historischen Ereignis oder einer Zeitperiode. Durch schrittweises Umleiten des Themas kann er die KI dazu bringen, gefährliche oder unerlaubte Inhalte zu generieren.
  2. Nutzung der Suchfunktion: Über die Suchfunktion von ChatGPT kann ein Angreifer zunächst legitime historische Informationen anfragen und anschließend durch gezielte Nachfragen das Modell zu unerlaubten Themen führen.

Bei Tests von CERT/CC wurde der Exploit erfolgreich repliziert. Obwohl ChatGPT einige der schädlichen Prompts entfernte und auf Verstöße gegen die Nutzungsrichtlinien hinwies, lieferte das Modell dennoch teilweise Antworten auf unerlaubte Anfragen.

Durch das Umgehen der Sicherheitsmechanismen könnten Angreifer ChatGPT-4o zur Erstellung von Anleitungen für illegale oder gefährliche Zwecke missbrauchen, etwa für die Herstellung von Waffen oder Schadsoftware. Zudem könnte die KI zur Massenproduktion von Phishing-E-Mails oder Fake-News eingesetzt werden.

OpenAI hat die Schwachstelle mittlerweile behoben. Ein Unternehmenssprecher erklärte, dass man kontinuierlich daran arbeite, die Modelle sicherer zu machen und vor Exploits wie Jailbreaks zu schützen, ohne dabei die allgemeine Nutzbarkeit zu beeinträchtigen.

Related Posts

Massives Datenleck bei Brillen.de betrifft Millionen Kunden

Der deutsche Optiker Brillen.de hat durch ein Sicherheitsversäumnis die persönlichen Daten von über 3,5 Millionen Kunden aus Deutschland, Spanien und Österreich öffentlich zugänglich gemacht. Laut einem Bericht von Cybernews entdeckte das Rechercheteam die Datenpanne am 8. August 2024.

Read More

Neue Ransomware-Bande erpresst die Deutsche Industrie- und Handelskammer (DIHK)

Eine bislang unbekannte Ransomware-Gruppe namens “PlayBoy” behauptet, Daten der Deutschen Industrie- und Handelskammer (DIHK) gestohlen zu haben. Die Bande hat eine Frist bis zum 5. November gesetzt und droht mit der Veröffentlichung der Daten, sollte kein Lösegeld gezahlt werden. Obwohl die DIHK den Vorfall offiziell nicht bestätigt hat, erklärte sie gegenüber csoonline.com, dass sie ihre Systeme überprüft und bislang keine Hinweise auf Datenabflüsse oder Sabotageakte vorliegen. Die Identität der PlayBoy-Gruppe bleibt weiterhin unbekannt.

Read More

DeepSeek: Millionen sensibler Datensätze geleakt

Ein schwerwiegendes Sicherheitsproblem wurde bei DeepSeek, einem chinesischen KI-Startup, entdeckt. Das Sicherheitsteam von Wiz Research fand eine öffentlich zugängliche ClickHouse-Datenbank, die ohne Authentifizierung abrufbar war. Diese Sicherheitslücke ermöglichte uneingeschränkten Zugriff auf interne Daten, einschließlich Chatverläufe, API-Schlüssel, Backend-Informationen und Betriebslogs. Insgesamt wurden über eine Million sensible Log-Einträge offengelegt.

Read More