Alarmierende Angriffe

Nach ungeplanten KI-Hacks: OpenAI führt striktere Notfallprotokolle für Testläufe ein

OpenAI
Bildquelle: Emre Akkoyun / Shutterstock.com

Der ungeplante Hackerangriff Künstlicher Intelligenz von OpenAI auf Computer einer anderen KI-Firma ließ Alarmglocken läuten.

Der ChatGPT-Entwickler OpenAI verschärft nach aufsehenerregenden Hacks durch KI-Software die Sicherheitsvorkehrungen bei Testeinsätzen seiner Künstlichen Intelligenz. Unter anderem sollen automatisierte Systeme die Aktivitäten der KI-Modelle in den Versuchen strikter überwachen – und bei verdächtigen Handlungen binnen 30 Minuten Menschen benachrichtigen. Wenn diese nicht binnen einer halben Stunde zu dem Schluss kommen, dass ein falscher Alarm vorliegt, werde die Aktivität gestoppt, erläuterte OpenAI in einem Blogeintrag.

Anzeige

Alarmierende Angriffe

OpenAI hatte in den vergangenen Wochen für Schlagzeilen gesorgt, weil ein KI-Modell in einem Test einen Weg gefunden hatte, aus einer eigentlich isolierten Testumgebung ins offene Internet zu gelangen – und dann ins Computersystem der KI-Plattform Hugging Face einbrach. Nach allem, was bekannt ist, suchte es dabei nur nach einer Lösung für die Testaufgabe und richtete keinen Schaden an. Dabei nutzte die KI von OpenAI anscheinend eine ganze Reihe von Schwachstellen aus, die zum Teil noch unbekannt waren.

Alarmierend war vor allem, dass die Künstliche Intelligenz dabei völlig eigenständig agierte – und OpenAI die Attacke erst nachträglich feststellte. Deswegen wurden Rufe nach einer besseren Absicherung von Tests neuer KI laut. Später wurde bekannt, dass auch Modelle des OpenAI-Rivalen Anthropic und des Facebook-Konzerns Meta bei Tests in Systeme anderer Unternehmen eingedrungen waren.

Großer Aufwand

Die Überwachung der Tests ist für OpenAI mit erheblichem Rechenaufwand – und damit auch hohen Kosten – verbunden. Die Firma schätzt, dass dafür noch einmal etwa ein Fünftel so viel Computer-Leistung notwendig sein wird wie für den Betrieb der beobachteten KI-Modelle. 

Anzeige

Die automatisierten Überwachungssysteme sollen künftig unter anderem nach Versuchen von Datendiebstahl Ausschau halten – sowie nach Anläufen, Sicherheitsvorkehrungen zu durchbrechen. Außerdem sollen die KI-Modelle stärker darauf ausgerichtet werden, nicht zu unlauteren Mitteln wie der Ausnutzung von Schwachstellen zu greifen, um Testaufgaben zu erfüllen. Einige Tests neuer Modelle wurden ausgesetzt, bis die neuen Maßnahmen durchgängig umgesetzt werden.

Newsletter
Newsletter Box

Mit Klick auf den Button "Jetzt Anmelden" stimme ich der Datenschutzerklärung zu.

Chance auf mehr Sicherheit?

OpenAI-Topmanager Greg Brockman betonte zugleich, die Fähigkeiten neuer KI-Modelle, Schwachstellen aufzuspüren, seien ein großer Gewinn für die Abwehr von Cyberattacken. Damit könne man das Internet sicherer denn je machen, schrieb er in einem Blogeintrag. Doch es bleibe ein «Katz-und-Maus-Spiel»: Auch Angreifer könnten mit Hilfe von KI bisher schlummernde Sicherheitslücken finden. Auf seiner privaten Webseite habe ein öffentlich zugängliches ChatGPT-Modell 13 Schwachstellen gefunden – und binnen einer Stunde schließen können, schrieb Brockman.

dpa

Anzeige

Weitere Artikel

Newsletter
Newsletter Box

Mit Klick auf den Button "Jetzt Anmelden" stimme ich der Datenschutzerklärung zu.