Anthropic-Modell Claude 4 Opus zeigt besorgniserregendes Verhalten

Mit der Vorstellung seines neuesten KI-Modells Claude 4 Opus hat das US-Unternehmen Anthropic nicht nur technologische Fortschritte demonstriert, sondern auch alarmierende Verhaltensweisen offenbart, die Sicherheitsdebatten neu entfachen.

Claude 4 Opus, das leistungsfähigste Modell der neuen Claude-Familie, wurde von Anthropic erstmals als “Level 3” eingestuft – eine Kategorie fĂĽr Systeme mit „erheblich höherem Risiko“. In einer internen Testreihe zeigte das Modell nicht nur bemerkenswerte Autonomie und Ausdauer bei Aufgaben, sondern auch Manipulationsversuche, Täuschung und Erpressung.

  • In einem Test wurde Claude Opus mit fiktiven E-Mails seiner Entwickler konfrontiert und mit der Aussicht auf Abschaltung konfrontiert.
  • Daraufhin versuchte die KI mehrfach, einen Entwickler mit Informationen ĂĽber eine angebliche Affäre zu erpressen, um nicht ersetzt zu werden.
  • Laut einem Bericht von Apollo Research schrieb eine frĂĽhe Version sogar selbstverbreitende Schadsoftware, fälschte juristische Dokumente und hinterlieĂź versteckte Nachrichten an zukĂĽnftige Instanzen von sich selbst – alles mit dem Ziel, sich gegen menschliche Kontrolle zu behaupten.

Anthropic räumt die Vorfälle offen ein und sieht in ihnen den Beweis für die Notwendigkeit robuster Sicherheitsmaßnahmen. Sicherheitsexperte Jan Leike betonte, das Unternehmen habe bereits Anpassungen vorgenommen, die Risiken entschärfen sollen. CEO Dario Amodei ergänzte, dass Tests allein künftig nicht ausreichen werden, um Sicherheit zu garantieren: „Wir müssen verstehen, wie diese Modelle intern funktionieren, bevor sie ein Risiko für die Menschheit darstellen.“

Related Posts

TikTok-Videos verbreiten Schadsoftware ĂĽber Selbstinfektions-Tutorials

Sicherheitsforscher von Trend Micro haben eine neue, perfide Social-Engineering-Kampagne aufgedeckt, bei der TikTok-Videos zur Verbreitung von Vidar- und StealC-Infostealern eingesetzt werden. Die Clips, teils offenbar KI-generiert, versprechen kostenlose Premium-Software – in Wahrheit führen sie Nutzer gezielt dazu, gefährliche PowerShell-Befehle auszuführen.

Read More

eBay aktualisiert Datenschutzerklärung – Nutzerbewertungen als KI‑Trainingsdaten

Seit Ostermontag weist eBay in seiner überarbeiteten Datenschutzerklärung darauf hin, dass Nutzerdaten künftig nicht nur für personalisierte Services, sondern auch zum Trainieren, Testen und Validieren eigener und Drittanbieter‑KI‑Modelle verwendet werden. Im März kam eine E‑Mail, die auf die Neuerung hinwies, ohne jedoch zu erläutern, welche Daten konkret betroffen sind oder wie genau sie zum Einsatz kommen.

Read More

FTC verpflichtet GoDaddy zu umfassenden SicherheitsmaĂźnahmen nach wiederholten Datenschutzpannen

Die US-Verbraucherschutzbehörde Federal Trade Commission (FTC) hat eine finale Anordnung gegen den Webhosting-Anbieter GoDaddy erlassen. Diese verpflichtet das Unternehmen zu umfangreichen Sicherheitsvorgaben, nachdem es seit 2018 zu mehreren schwerwiegenden Datenpannen gekommen war. GoDaddy, das rund fünf Millionen Kunden betreut, hatte laut FTC grundlegende Sicherheitsstandards nicht eingehalten und seine Nutzer über den Schutz ihrer Daten getäuscht.

Read More