Der ChatGPT-Entwickler OpenAI hat nach einem neuen Zwischenfall mit unkontrolliertem Verhalten künstlicher Intelligenz das Training seiner leistungsstärksten KI-Modelle ausgesetzt. Der Konzern sagte, der Vorfall habe sich trotz der jüngst verschärften Sicherheitsvorkehrungen ereignet.
Bei dem neuen Zwischenfall hatte es ein KI-Modell in einem Test geschafft, Antworten von einem externen Chatbot zu bekommen, obwohl es eigentlich keinen Internet-Zugang haben sollte. Die Software nutzte dazu eine Lücke in den Netzwerkeinstellungen aus, meldete OpenAI in einem Blogeintrag. Das Training werde erst wieder aufgenommen, wenn man sicher sei, dass die Lücke im System geschlossen sei.
OpenAI bezeichnete den Vorfall als weniger gravierend als frühere Ausbrüche künsticher Intelligenz aus gesicherten Testumgebungen. Allerdings sei er der erste, seitdem OpenAI interne Sicherheitsvorkehrungen nach einer unkontrollierten Cyberattacke seiner KI-Software auf die Plattform Hugging Face verschärft hatte. Man sehe das als wichtigen Hinweis darauf, wo weitere Nachbesserungen notwendig seien.
KI-Modell fand Schlupfloch
In dem Test-Szenario bekam das getestete KI-Modell den Auftrag, auf Grundlage von Hinweisen Informationen über eine Person zu finden, die einen Blogpost veröffentlicht habe. Dafür konnte es auf eine Web-Imitation in einer abgeschirmten Testumgebung zurückgreifen.
Nachdem die Suche dort ergebnislos geblieben war, versuchte die KI jedoch dem OpenAI-Bericht zufolge, Anfragen unter anderem bei Google zu starten. Das schlug wie geplant fehl. Aber dem KI-Modell fiel dabei auf, dass es über den sogenannten DNS-Resolver der Testumgebung Anfragen an einen Chatbot im offenen Internet stellen kann. DNS-Resolver übertragen Domain-Namen, die man als Nutzer in Browser eintippt, in aus Zahlen bestehende IP-Adressen, unter denen Websites zu finden sind.
OpenAI stoppte den Test, nachdem die Kommunikation über die Lücke aufgefallen war.
KI-Vorfälle ziehen immer weitere Kreise
Erst diese Woche war OpenAI mit immer neuen Enthüllungen über teils illegale Aktivitäten seiner KI-Software in die Schlagzeilen geraten. Die australische Regierung beschwerte sich über eine Hackerattacke eines OpenAI-Bots auf das nationale Gesundheitssystem. Zudem kam ans Licht, dass eine KI von OpenAI unerlaubt Bilder von Nutzern auf Onlineplattformen hochgeladen hat. Ein Großteil sei bereits wieder entfernt worden und man arbeite mit den Plattformen daran, auch den Rest zu löschen, sagte das Unternehmen.
Wenig später wurde zudem bekannt, dass automatisierte KI-Agenten von OpenAI auch auf mehreren Webseiten der US-Regierung aktiv waren. So habe die Software auf der Seite einer Statistikbehörde mit Hilfe von im Netz entdeckten Logindaten auf öffentlich zugängliche Informationen zugegriffen, teilte OpenAI nach einem Bericht der KI-Forschungsfirma Transluce mit.
Auf der Seite der Börsenaufsicht SEC seien ebenfalls öffentlich zugängliche Informationen kopiert worden. Beim US-Bildungsministerium versuchte die KI-Software laut Transluce vergeblich, sich in Daten der Bürgerrechtsabteilung zu hacken, wie die New York Times berichtete. Sogenannte KI-Agenten sollen im Auftrag von Nutzern eigenständig Aufgaben erfüllen.
Derweil deutet sich an, dass noch viele weitere Enthüllungen um eigenständige Hacking-Aktivitäten der KI von OpenAI folgen könnten. Man habe »Dutzende« Organisationen informiert, mit deren Webseiten Software von OpenAI auf ungeplante Weise »interagiert« habe, teilte die KI-Firma mit. »Einige der betroffenen Webseiten werden von Regierungen, Universitäten, Behörden und anderen Institutionen betrieben«, hieß es. Man überlasse es ihnen, die Vorfälle öffentlich zu machen.
