Künstliche Intelligenz

OpenAI stärkt nach KI-Hacks Schutzvorkehrungen bei Tests

Der ungeplante Hackerangriff Künstlicher Intelligenz von OpenAI auf Computer einer anderen KI-Firma ließ Alarmglocken läuten. Neue Maßnahmen sollen dafür sorgen, dass so etwas nicht wieder passiert.

Auf die jüngsten ungeplanten Hackerangriffe durch KI-Modelle folgen verschärfte Sicherheitsmaßnahmen. (Archivbild) Foto: Richard Drew/AP/dpa
Auf die jüngsten ungeplanten Hackerangriffe durch KI-Modelle folgen verschärfte Sicherheitsmaßnahmen. (Archivbild)

San Francisco (dpa) - Der ChatGPT-Entwickler OpenAI verschärft nach aufsehenerregenden Hacks durch KI-Software die Sicherheitsvorkehrungen bei Testeinsätzen seiner Künstlichen Intelligenz. Unter anderem sollen automatisierte Systeme die Aktivitäten der KI-Modelle in den Versuchen strikter überwachen - und bei verdächtigen Handlungen binnen 30 Minuten Menschen benachrichtigen. Wenn diese nicht binnen einer halben Stunde zu dem Schluss kommen, dass ein falscher Alarm vorliegt, werde die Aktivität gestoppt, erläuterte OpenAI in einem Blogeintrag.

Alarmierende Angriffe

OpenAI hatte in den vergangenen Wochen für Schlagzeilen gesorgt, weil ein KI-Modell in einem Test einen Weg gefunden hatte, aus einer eigentlich isolierten Testumgebung ins offene Internet zu gelangen - und dann ins Computersystem der KI-Plattform Hugging Face einbrach. Nach allem, was bekannt ist, suchte es dabei nur nach einer Lösung für die Testaufgabe und richtete keinen Schaden an. Dabei nutzte die KI von OpenAI anscheinend eine ganze Reihe von Schwachstellen aus, die zum Teil noch unbekannt waren.

Alarmierend war vor allem, dass die Künstliche Intelligenz dabei völlig eigenständig agierte - und OpenAI die Attacke erst nachträglich feststellte. Deswegen wurden Rufe nach einer besseren Absicherung von Tests neuer KI laut. Später wurde bekannt, dass auch Modelle des OpenAI-Rivalen Anthropic und des Facebook-Konzerns Meta bei Tests in Systeme anderer Unternehmen eingedrungen waren.

Newsletter

Holen Sie sich den WNOZ-Newsletter und verpassen Sie keine Nachrichten aus Ihrer Region und aller Welt.

Mit Ihrer Registrierung nehmen Sie die Datenschutzerklärung zur Kenntnis.

Großer Aufwand

Die Überwachung der Tests ist für OpenAI mit erheblichem Rechenaufwand - und damit auch hohen Kosten - verbunden. Die Firma schätzt, dass dafür noch einmal etwa ein Fünftel so viel Computer-Leistung notwendig sein wird wie für den Betrieb der beobachteten KI-Modelle. 

Die automatisierten Überwachungssysteme sollen künftig unter anderem nach Versuchen von Datendiebstahl Ausschau halten - sowie nach Anläufen, Sicherheitsvorkehrungen zu durchbrechen. Außerdem sollen die KI-Modelle stärker darauf ausgerichtet werden, nicht zu unlauteren Mitteln wie der Ausnutzung von Schwachstellen zu greifen, um Testaufgaben zu erfüllen. Einige Tests neuer Modelle wurden ausgesetzt, bis die neuen Maßnahmen durchgängig umgesetzt werden.

Chance auf mehr Sicherheit?

OpenAI-Topmanager Greg Brockman betonte zugleich, die Fähigkeiten neuer KI-Modelle, Schwachstellen aufzuspüren, seien ein großer Gewinn für die Abwehr von Cyberattacken. Damit könne man das Internet sicherer denn je machen, schrieb er in einem Blogeintrag. Doch es bleibe ein «Katz-und-Maus-Spiel»: Auch Angreifer könnten mit Hilfe von KI bisher schlummernde Sicherheitslücken finden. Auf seiner privaten Webseite habe ein öffentlich zugängliches ChatGPT-Modell 13 Schwachstellen gefunden - und binnen einer Stunde schließen können, schrieb Brockman.