OpenAI stärkt Sicherheitsmassnahmen bei Tests nach KI-Hacks

Keystone-SDA
Keystone-SDA

USA,

Der ChatGPT-Entwickler OpenAI verschärft nach aufsehenerregenden Hacks durch KI-Software die Sicherheitsvorkehrungen bei Tests künstlicher Intelligenz (KI). Automatisierte Systeme sollen Aktivitäten der KI-Modelle in den Versuchen strikter überwachen – und bei verdächtigen Handlungen innerhalb von 30 Minuten Menschen benachrichtigen.

OpenAI KI AI
OpenAI verschärft die Sicherheitsvorkehrungen bei Tests künstlicher Intelligenz. - Keystone

Wenn diese Menschen in 30 Minuten nicht zum Schluss kommen, dass es ein falscher Alarm ist, werde die Aktivität gestoppt, erläuterte OpenAI in einem Blog-Eintrag.

OpenAI hatte in den vergangenen Wochen für Schlagzeilen gesorgt, weil ein Modell in einem Test einen Weg fand, aus einer eigentlich isolierten Testumgebung ins offene Internet zu gelangen – und dann ins Computersystem der KI-Plattform Hugging Face einbrach. Es suchte dabei nur nach einer Lösung für die Testaufgabe und richtete keinen Schaden an.

Alarmierend war allerdings, dass die künstliche Intelligenz dabei völlig eigenständig agierte – und OpenAI die Attacke erst nachträglich feststellte. Deswegen wurden Rufe nach einer besseren Absicherung von Tests neuer KI laut. Später wurde bekannt, dass auch Modelle des OpenAI-Rivalen Anthropic und des Facebook-Konzerns Meta bei Tests in Systeme anderer Unternehmen eingedrungen waren.

Die automatisierten Überwachungssysteme sollen künftig unter anderem nach Versuchen von Datendiebstahl Ausschau halten – sowie nach Anläufen, Sicherheitsvorkehrungen zu durchbrechen. Ausserdem sollen die KI-Modelle stärker darauf ausgerichtet werden, nicht zu unlauteren Mitteln wie der Ausnutzung von Schwachstellen zu greifen, um Testaufgaben zu erfüllen. Einige Tests neuer KI-Modelle wurden ausgesetzt, bis die neuen Massnahmen durchgängig umgesetzt werden.

Mehr zum Thema:

Kommentare

User #8497 (nicht angemeldet)

Mal eine ernsthafte Frage. Macht euch das selbst nicht stutzig, dass kaum noch Kommentare hier verfasst werden? Die meisten kommen sowiso immer von den selben Personen. Ich meine ja nur so.

Weiterlesen

AfD
762 Interaktionen
Migration, Sicherheit
Das Läckerli Huus hat den Baslerstab aus seinem Logo entfernt. Das finden nicht alle gut.
57 Interaktionen
Kunden findens schade

MEHR IN NEWS

nrw
1 Interaktionen
Riesen-Betrug
Rentner
DJ Röbi Koller
dfg
1'851 Interaktionen
Trotz Wahlschlappe
hof zu wil
2 Interaktionen
Wil

MEHR AUS USA

Zheng Qinwen US Open
US-Open-Exploit
android whatsapp
3 Interaktionen
Schwere Bedingungen
trump sachsen anhalt
15 Interaktionen
Ohne Worte
Goldpreis Gold
5 Interaktionen
Markterwartungen