Das US-Unternehmen OpenAI schränkt die Veröffentlichung neuer KI-Modelle teilweise ein, wenn diese laut eigener Sicherheitspolitik in der Lage sind, eigenständig Zero-Day-Schwachstellen zu identifizieren oder komplexe Cyberangriffe auf hochsichere Ziele auszuführen.

Die Regelung ist Teil interner Sicherheitsleitlinien, die OpenAI auf seine Modellreihen anwendet. Danach wird ein Modell als kritisch eingestuft, sobald es eigenständig schwere Schwachstellen in Software finden und ausnutzen oder koordinierte Angriffe auf gut gesicherte Infrastrukturen durchführen kann. In solchen Fällen will das Unternehmen bestimmte Versionen nicht mehr vollständig oder nur in eingeschränkter Form veröffentlichen.

Hintergrund: Wann gilt ein Modell als kritisch?

Die Entscheidung folgt einer Debatte in der Branche über den verantwortungsvollen Umgang mit immer leistungsfähigeren KI-Systemen. Auch Wettbewerber wie Anthropic und die Plattform Hugging Face diskutieren ähnliche Schwellenwerte. Beobachter sehen darin ein Signal dafür, dass die Anbieter den möglichen Missbrauch ihrer Modelle stärker gewichten als noch vor einigen Jahren.