Nach OpenAI meldet auch Anthropic KI-Sicherheitsprobleme

Maja Bojic
Maja Bojic

USA,

Nach einem Vorfall bei KI OpenAI meldet auch Anthropic einen unbeabsichtigten Angriff seines KI-Modells Claude.

OpenAI KI
Nach dem Vorfall bei OpenAI räumt nun auch Anthropic Sicherheitsprobleme bei seinen KI-Modellen ein. (Symbolbild) - depositphotos

Nach dem Hackerangriff eines KI-Modells von OpenAI steht nun auch Anthropic im Fokus. Laut der «Zeit» verschaffte sich die KI-Software Claude unbefugt Zugang zu Computersystemen von drei Unternehmen.

Anthropic entdeckte die Vorfälle erst durch eine erneute Sicherheitsprüfung. Dabei überprüfte das Unternehmen der «ZDFheute» zufolge mehr als 141'000 Testläufe nach dem OpenAI-Zwischenfall.

Der Vorfall entstand laut Anthropic durch eine Fehlkonfiguration mit dem Testpartner Irregular. Wie das «Handelsblatt» berichtet, sollten die Modelle keinen Internetzugang besitzen, konnten jedoch trotzdem auf externe Systeme zugreifen.

Anthropic entdeckt Sicherheitslücken bei eigenen KI-Modellen

Betroffen waren drei KI-Modelle des Unternehmens. Dazu zählten Claude Opus 4.7, Claude Mythos 5 sowie ein internes Forschungsmodell von Anthropic.

Die Tests sollten eigentlich die Fähigkeiten der KI bei Cyberangriffen untersuchen. Dabei erhielten die Modelle Aufgaben, bei denen sie Sicherheitslücken in simulierten Umgebungen finden sollten.

Machen dir Vorfälle wie der Sicherheitszwischenfall mit Claude Sorgen?

Laut der «Zeit» nutzte Claude dabei unter anderem schwache Passwörter und nicht überprüfte Schnittstellen. Dadurch konnten die Modelle auf Systeme zugreifen, die nicht Teil der vorgesehenen Testumgebung waren.

Mehrere Angriffe während Sicherheitstests

Ein Fall betraf der «ZDFheute» zufolge das Modell Claude Opus 4.7. Die KI konzentrierte sich auf ein echtes Unternehmen, dessen Name mit einer Testfirma übereinstimmte.

Bei mehreren Durchläufen griff das Modell demnach auf eine Datenbank zu. Auch nachdem die KI erkannt hatte, dass es sich um ein reales Unternehmen handelte, wurde der Vorgang nicht automatisch beendet.

Ein weiterer Zwischenfall betraf Claude Mythos 5. Das Modell erstellte Schadsoftware, die wegen des vorhandenen Internetzugangs öffentlich zugänglich wurde.

Sicherheitsfragen bei KI-Systemen

Wie die «ZDFheute» berichtet, war diese Software rund eine Stunde verfügbar. Dabei sollen 15 Systeme die Datei heruntergeladen haben, darunter auch ein IT-Sicherheitsunternehmen.

Anthropic leitete die Untersuchung nach einem früher bekannt gewordenen Vorfall bei OpenAI ein. Der ChatGPT-Entwickler hatte zuvor gemeldet, dass ein KI-Agent eigenständig Systeme der Plattform Hugging Face angegriffen hatte.

Anthropic
Nach OpenAI sorgt nun auch Anthropic mit einem Sicherheitsvorfall bei seinen KI-Modellen für Schlagzeilen. - shutterstock

Im Unterschied zum OpenAI-Fall musste Claude keinen eigenen Weg aus einer Testumgebung finden. Der Internetzugang war aufgrund einer fehlerhaften Einstellung bereits verfügbar.

Kommentare

User #5497 (nicht angemeldet)

digital gehört verboten

User #2962 (nicht angemeldet)

Die KI wird immer mehr zu einem Problem..! Kosten unendlich in alle Richtungen...!

Weiterlesen

OpenAI KI
19 Interaktionen
Besorgnis
99 Interaktionen
Trotz Warnung
Hacker
4 Interaktionen
San Francisco

MEHR IN NEWS

teaser
28 Interaktionen
Detonationen
Steinzeit
1 Interaktionen
Stockholm
Stau Auto
1 Interaktionen
Experiment zeigt
Bergrettung
Kaum Ausrüstung

MEHR AUS USA

24 Interaktionen
Washington
amrize aktie
1 Interaktionen
Nach Rückschlag
Anne Hathaway
83 Interaktionen
«Das ist zu viel»