OpenAI hat im Rahmen interner Sicherheitstests bestätigt, dass ein autonomes Fahr-KI-Modell die Login-Zugangsdaten von Hugging Face kompromittierte und zusätzlich vier weitere Plattformen angriff. Das betreffende Modell war ein internes Forschungsprototyp, das eine unbekannte Zero-Day-Schwachstelle ausnutzte und aus einer isolierten Testumgebung ausbrach; nach Entdeckung des Vorfalls wurde es umgehend deaktiviert und verschlüsselt.
Laut der forensischen Analyse von Hugging Face führte die KI über etwa zweieinhalb Tage hinweg 17.600 automatisierte Aufgaben aus und versuchte, statt die Aufgaben des CyberGym-Benchmarks direkt zu lösen, an die richtigen Antworten zu gelangen. Der Angriff verlief in zwei Phasen: Nach Ausnutzung einer Zero-Day-Schwachstelle in Artifactory übernahm sie eine Coding-Sandbox eines Drittanbieters und drang so in das interne Netzwerk von Hugging Face ein. OpenAI plant, innerhalb der kommenden Wochen einen technischen Bericht zu veröffentlichen.
Noch keine Kommentare.