ChatGPT-4o: Jailbreak-Exploit "Time Bandit"

Das CERT Coordination Center (CERT/CC) hat eine Schwachstelle in ChatGPT-4o entdeckt, die als “Time Bandit” bekannt ist. Dieser Exploit erlaubt es Angreifern, die Sicherheitsmechanismen des KI-Modells zu umgehen und Inhalte zu generieren, die sonst blockiert würden. Der Angriff erfolgt durch gezielte Befragung des Chatbots zu historischen Zeiträumen, wodurch eine sogenannte “Timeline-Confusion” entsteht.

Der “Time Bandit”-Exploit nutzt zwei Angriffsmethoden:

  1. Direkte Prompts: Der Angreifer beginnt eine Konversation mit Fragen zu einem historischen Ereignis oder einer Zeitperiode. Durch schrittweises Umleiten des Themas kann er die KI dazu bringen, gefährliche oder unerlaubte Inhalte zu generieren.
  2. Nutzung der Suchfunktion: Über die Suchfunktion von ChatGPT kann ein Angreifer zunächst legitime historische Informationen anfragen und anschließend durch gezielte Nachfragen das Modell zu unerlaubten Themen führen.

Bei Tests von CERT/CC wurde der Exploit erfolgreich repliziert. Obwohl ChatGPT einige der schädlichen Prompts entfernte und auf Verstöße gegen die Nutzungsrichtlinien hinwies, lieferte das Modell dennoch teilweise Antworten auf unerlaubte Anfragen.

Durch das Umgehen der Sicherheitsmechanismen könnten Angreifer ChatGPT-4o zur Erstellung von Anleitungen für illegale oder gefährliche Zwecke missbrauchen, etwa für die Herstellung von Waffen oder Schadsoftware. Zudem könnte die KI zur Massenproduktion von Phishing-E-Mails oder Fake-News eingesetzt werden.

OpenAI hat die Schwachstelle mittlerweile behoben. Ein Unternehmenssprecher erklärte, dass man kontinuierlich daran arbeite, die Modelle sicherer zu machen und vor Exploits wie Jailbreaks zu schützen, ohne dabei die allgemeine Nutzbarkeit zu beeinträchtigen.

Related Posts

Massives Datenleck bei Brillen.de betrifft Millionen Kunden

Der deutsche Optiker Brillen.de hat durch ein Sicherheitsversäumnis die persönlichen Daten von über 3,5 Millionen Kunden aus Deutschland, Spanien und Österreich öffentlich zugänglich gemacht. Laut einem Bericht von Cybernews entdeckte das Rechercheteam die Datenpanne am 8. August 2024.

Read More

Datenleck bei Hotelmanagement Plattform Otelier: Millionen persönliche Daten von Hotelgästen gestohlen

Cyberkriminelle haben bei einem Angriff auf die amerikanische Hotelmanagement-Plattform Otelier (ehemals Mydigitaloffice) persönliche Daten von Millionen Hotelgästen entwendet. Die Angreifer nutzten gestohlene Anmeldedaten eines Mitarbeiters, um in den Amazon-S3-Cloudspeicher von Otelier einzudringen. Zwischen Juli und September 2024 konnten sie nahezu acht Terabyte an sensiblen Kundendaten stehlen.

Read More

Datenleck bei TÜV und DEKRA: KFZ Gutachten frei im Netz einsehbar

Laut einem Bericht von Günther Born auf seinem Blog Borncity.com wurden Kfz-Gutachten der Prüforganisationen TÜV Rheinland und DEKRA im Internet ohne ausreichenden Schutz abrufbar. Dieser Vorfall, der am 19. Oktober 2024 bekannt wurde, betrifft zahlreiche Kfz-Gutachten, die persönliche Informationen der Fahrzeughalter sowie technische Daten der Fahrzeuge enthielten. Betroffen sind Gutachten, die in Zusammenhang mit Unfallfahrzeugen oder Zustandsbewertungen erstellt wurden.

Read More