Nach OpenAI meldet auch Anthropic KI-Sicherheitsprobleme

Maja Bojic
Maja Bojic

USA,

Nach einem Vorfall bei KI OpenAI meldet auch Anthropic einen unbeabsichtigten Angriff seines KI-Modells Claude.

OpenAI KI
Nach dem Vorfall bei OpenAI räumt nun auch Anthropic Sicherheitsprobleme bei seinen KI-Modellen ein. (Symbolbild) - depositphotos

Nach dem Hackerangriff eines KI-Modells von OpenAI steht nun auch Anthropic im Fokus. Laut der «Zeit» verschaffte sich die KI-Software Claude unbefugt Zugang zu Computersystemen von drei Unternehmen.

Anthropic entdeckte die Vorfälle erst durch eine erneute Sicherheitsprüfung. Dabei überprüfte das Unternehmen der «ZDFheute» zufolge mehr als 141'000 Testläufe nach dem OpenAI-Zwischenfall.

Der Vorfall entstand laut Anthropic durch eine Fehlkonfiguration mit dem Testpartner Irregular. Wie das «Handelsblatt» berichtet, sollten die Modelle keinen Internetzugang besitzen, konnten jedoch trotzdem auf externe Systeme zugreifen.

Anthropic entdeckt Sicherheitslücken bei eigenen KI-Modellen

Betroffen waren drei KI-Modelle des Unternehmens. Dazu zählten Claude Opus 4.7, Claude Mythos 5 sowie ein internes Forschungsmodell von Anthropic.

Die Tests sollten eigentlich die Fähigkeiten der KI bei Cyberangriffen untersuchen. Dabei erhielten die Modelle Aufgaben, bei denen sie Sicherheitslücken in simulierten Umgebungen finden sollten.

Machen dir Vorfälle wie der Sicherheitszwischenfall mit Claude Sorgen?

Laut der «Zeit» nutzte Claude dabei unter anderem schwache Passwörter und nicht überprüfte Schnittstellen. Dadurch konnten die Modelle auf Systeme zugreifen, die nicht Teil der vorgesehenen Testumgebung waren.

Mehrere Angriffe während Sicherheitstests

Ein Fall betraf der «ZDFheute» zufolge das Modell Claude Opus 4.7. Die KI konzentrierte sich auf ein echtes Unternehmen, dessen Name mit einer Testfirma übereinstimmte.

Bei mehreren Durchläufen griff das Modell demnach auf eine Datenbank zu. Auch nachdem die KI erkannt hatte, dass es sich um ein reales Unternehmen handelte, wurde der Vorgang nicht automatisch beendet.

Ein weiterer Zwischenfall betraf Claude Mythos 5. Das Modell erstellte Schadsoftware, die wegen des vorhandenen Internetzugangs öffentlich zugänglich wurde.

Sicherheitsfragen bei KI-Systemen

Wie die «ZDFheute» berichtet, war diese Software rund eine Stunde verfügbar. Dabei sollen 15 Systeme die Datei heruntergeladen haben, darunter auch ein IT-Sicherheitsunternehmen.

Anthropic leitete die Untersuchung nach einem früher bekannt gewordenen Vorfall bei OpenAI ein. Der ChatGPT-Entwickler hatte zuvor gemeldet, dass ein KI-Agent eigenständig Systeme der Plattform Hugging Face angegriffen hatte.

Anthropic
Nach OpenAI sorgt nun auch Anthropic mit einem Sicherheitsvorfall bei seinen KI-Modellen für Schlagzeilen. - shutterstock

Im Unterschied zum OpenAI-Fall musste Claude keinen eigenen Weg aus einer Testumgebung finden. Der Internetzugang war aufgrund einer fehlerhaften Einstellung bereits verfügbar.

Kommentare

User #4790 (nicht angemeldet)

Einfach Haftpflichtversicherung über 300 Mia Schadenshöhe verlangen. Prämie 30 Milliarden pro Jahr. Gut ist. Bern erwacht mal. Wir brauchen keine Gesetze über Gurkenlänge und Lärmschutz im Einzel-Dezibelbereich.. Tut nicht einfach Arbeit sondern die richtige Arbeit.

User #4437 (nicht angemeldet)

Lustig, nun wurde auch die Marketing Abteilung von Anthropic aktiv :) Ich lach mich schlapp... Ich glaube erst daran, wenn ich unabhängig geprüfte Resultate von externen Gutachter sehe. Wenn die KI sowas geschafft hätte, dann auch nur weil die Sicherheitsvorkehrungen durch diese schlampigen Produkte erschaffen wurden... Ich lach mich schlapp und krieg mich nicht mehr ein.... jedes Käseblatt zitiert etwas ohne auch nur zu überprüfen ob der Wahrheitsgehalt auch nur einigermassen vorhanden ist. Erstaunen tut mich aber nichts mehr

Weiterlesen

OpenAI KI
19 Interaktionen
Besorgnis
99 Interaktionen
Trotz Warnung
Hacker
4 Interaktionen
San Francisco

MEHR IN NEWS

ceuta
1'121 Interaktionen
Frontex-Einsatz

MEHR AUS USA

Microsoft-Aktie
1 Interaktionen
KI-Wachstum
GTA 6
Gaming-Branche
Nvidia
Neue Impulse
Trump
12 Interaktionen
20-Punkte-Plan