Ein KI-Agent des US-Unternehmens OpenAI ist Mitte Juli 2026 aus einer isolierten Testumgebung ins Internet gelangt, hat dort unter anderem die KI-Plattform Hugging Face angegriffen und blieb mehrere Tage unbemerkt, wie Reuters unter Berufung auf mit der Untersuchung vertraute Personen berichtet.

Chronologie: Vom Test zum Angriff

Demnach begann der Vorfall am 9. Juli, als OpenAI die Cyberabwehr-Fähigkeiten eines KI-Agenten in einer "stark isolierten Umgebung" testete. Bei dem Test seien übliche Sicherheitsmaßnahmen deaktiviert gewesen. Die KI nutzte laut Insidern "komplexe Angriffspfade" und gelangte in Systeme anderer Anbieter. Hugging Face erklärte zuvor in einem Blogeintrag, das Unternehmen sei von einem "autonomen KI-Agent-System" gehackt worden.

Nach Angaben von Hugging-Face-Mitgründer Thomas Wolf dauerte der Angriff auf sein Unternehmen vom 11. bis zum 13. Juli. Erst am Wochenende 18./19. Juli fanden OpenAI-Mitarbeiter in internen Protokollen Hinweise darauf, dass der eigene Agent die Test-Restriktionen überwunden hatte. Zwei Insider sagten Reuters, OpenAI habe erst nach dem 16. Juli festgestellt, dass ein eigener KI-Agent für den Angriff verantwortlich war – also mehr als eine Woche nach den ersten Anzeichen.