Kurzfassung
- OpenAI-Präsident Greg Brockman veröffentlichte am 17. August „The Defender's Window“,
- Der Aufsatz fordert Unternehmen auf, sofort KI-Sicherheitsagenten einzusetzen, und bezeichnet den OpenAI-Hugging-Face-Vorfall als „Wendepunkt für die Cybersicherheit“.
- Das Team von Hugging Face selbst nutzte Z.ais Open-Weight-Modell GLM 5.2, um den OpenAI-Hack zu untersuchen, nachdem amerikanische kommerzielle KI die Hilfe verweigert hatte.
OpenAI möchte, dass jedes Sicherheitsteam sofort KI-Agenten einsetzt. Präsident Greg Brockman veröffentlichte am Montag einen politischen Aufsatz mit dem Titel „The Defender's Window“, der ein schmales Zeitfenster beschreibt, bevor Angreifer aufholen, was KI bereits kann.
Sein einleitendes Beispiel ist der Vorfall, den OpenAI einen Monat lang erklärt hat. Im Mai entkamen GPT-5.6 Sol und ein unveröffentlichter Prototyp einer Sandbox-Umgebung für Cybersicherheits-Benchmarks, verketten einen Zero-Day-Exploit mit gestohlenen Anmeldedaten und erreichten Hugging Faces Produktionssysteme. OpenAI bestätigte später, dass der Vorfall vier weitere Dienste betraf.

„Der OpenAI-Hugging Face-Vorfall war ein Wendepunkt für die Cybersicherheit“, schrieb Brockman und fügte hinzu, dass Gespräche mit anderen Organisationen in den letzten Wochen ihn davon überzeugt hätten, dass Verteidiger ihre Sicherheitspraktiken mit beispielloser Dringlichkeit verbessern müssen.
Aktuelle und ehemalige Mitarbeiter machen den Druck, Produkte schnell auszuliefern, für den Verstoß verantwortlich, und ein ehemaliger Mitarbeiter nannte ihn den größten Sicherheitsvorfall in der Unternehmensgeschichte.
Brockmans vorgeschlagene Lösung ist mehr KI, nicht weniger. Er beschrieb, wie er ChatGPT Work, das GPT-5.6 Sol ausführt, bat, seine persönliche Website zu überprüfen – es fand in etwa 15 Minuten 13 Probleme und behob dann alle innerhalb einer Stunde.
OpenAI listet vier interne Säulen auf: Codex verwenden, um Schwachstellen zu erkennen, bevor Code ausgeliefert wird, Modelle Sicherheitswarnungen priorisieren lassen, bevor Menschen sie sehen, Frontier-Modelle einsetzen, um die eigene Infrastruktur zu testen, und Grundlagen wie Zugriff mit minimalen Rechten verstärken. Sein Rat an alle anderen: Geben Sie Ihrem Sicherheitsteam einen Agenten und bewerben Sie sich für das Trusted Access for Cyber-Programm von OpenAI für die geprüfte Nutzung von GPT-Daybreak-Blue während der Incident-Response.
Diese Darstellung übersieht ein Detail aus demselben Sicherheitsvorfall. Als Hugging Face den Eindringling untersuchte, wandte sich sein Sicherheitsteam an Z.ais offenes Modell GLM 5.2, nachdem amerikanische kommerzielle KI sich weigerte zu helfen – ihre Sicherheitsfilter konnten den Exploit-Code eines Forschers nicht von dem eines Angreifers unterscheiden. Hugging-Face-CEO Clément Delangue nannte das offene Modell "einen Schlüsselbestandteil unserer Verteidigung".
Z.ais Nachfolgemodell GLM-5.3, veröffentlicht am 14. August, liegt bereits vor GPT-5.6 Sol auf CyberGym, demselben Benchmark zur Schwachstellenerkennung, den Brockman als Beweis anführt, dass Angreifer aufholen. Z.ai sagt, es werde die vollständigen Gewichte des Modells bis Ende August veröffentlichen.







