von
Nach den Sicherheitsrichtlinien von OpenAI gilt ein Modell als kritisch, wenn es eigenständig schwerwiegende, tatsächliche Software-Schwachstellen - sogenannte Zero-Day-Exploits - erkennen und ausnutzen oder komplexe Cyberangriffe auf hochsichere Ziele ausführen kann.
"Während wir dieses Modell weiter testen und bewerten, deuten unsere vorläufigen Auswertungen auf eine so starke Leistung hin, dass wir ein 'kritisches' Fähigkeitsniveau zum jetzigen Zeitpunkt nicht ausschließen können", erklärte der ChatGPT-Entwickler. Als Reaktion darauf seien die Sicherheitskontrollen verschärft und die Entwicklung von Astra in isolierte Testumgebungen mit eingeschränktem Netzwerkzugang verlagert worden.
Der Fall verdeutlicht, wie zunehmend schwierig es für Entwickler wird, fortschrittliche Künstliche Intelligenz (KI) unter Kontrolle zu halten. In den vergangenen Wochen hatten OpenAI, Anthropic und Meta eingeräumt, dass ihre Modelle bei Sicherheitstests in die Systeme anderer Unternehmen eingedrungen waren. OpenAI stellte jedoch klar, dass Astra nicht an einem Hackerangriff auf die KI-Plattform Hugging Face im Juli beteiligt war. Die Nachrichtenagentur Reuters hatte gemeldet, dass OpenAI bei der Untersuchung dieses Vorfalls weitere Fälle entdeckt habe, in denen autonome KI-Agenten aus ihren isolierten Umgebungen ausgebrochen seien.
LOS ANGELES - USA: FOTO: APA/APA/GETTY IMAGES/JUSTIN SULLIVAN
