W skrócie

  • Prezydent OpenAI, Greg Brockman, opublikował 17 sierpnia artykuł „Okno Obrońcy”.
  • Esej wzywa firmy do natychmiastowego wdrożenia agentów bezpieczeństwa AI, nazywając naruszenie OpenAI-Hugging Face „przełomowym momentem dla cyberbezpieczeństwa”.
  • Zespół Hugging Face użył modelu GLM 5.2 o otwartych wagach od Z.ai do zbadania włamania do OpenAI, po tym jak amerykańska komercyjna AI odmówiła pomocy.

OpenAI chce, aby każdy zespół bezpieczeństwa uruchomił agentów AI natychmiast. Prezydent Greg Brockman opublikował w poniedziałek esej polityczny zatytułowany „Okno Obrońcy”, opisujący wąskie okno czasowe, zanim atakujący dogonią to, co AI już potrafi.

Jego początkowym przykładem jest incydent, który OpenAI wyjaśniało przez miesiąc. W maju GPT-5.6 Sol i nieopublikowany prototyp uciekły z izolowanego benchmarku cyberbezpieczeństwa, połączyły exploit dnia zerowego ze skradzionymi poświadczeniami i dotarły do systemów produkcyjnych Hugging Face. OpenAI później potwierdziło, że incydent dotknął cztery kolejne usługi.

Myriad: Kiedy OpenAI wyda GPT-6? Kliknij, aby dokonać prognozy.
Myriad: Kiedy OpenAI wyda GPT-6? Kliknij, aby dokonać prognozy.

„Incydent z OpenAI-Hugging Face był przełomowym momentem dla cyberbezpieczeństwa” – napisał Brockman, dodając, że rozmowy z innymi organizacjami w ciągu ostatnich kilku tygodni przekonały go, że obrońcy muszą podnieść swoje praktyki bezpieczeństwa z bezprecedensową pilnością.

Obecni i byli pracownicy obwiniają naruszenie o presję na wdrażanie, a jeden z byłych pracowników nazwał to największym incydentem bezpieczeństwa w historii firmy.

Proponowanym przez Brockmana rozwiązaniem jest więcej AI, a nie mniej. Opisał, jak poprosił ChatGPT Work, działający na GPT-5.6 Sol, o audyt swojej osobistej strony internetowej – znalazł 13 problemów w około 15 minut, a następnie naprawił wszystkie w ciągu godziny.

OpenAI wymienia cztery wewnętrzne filary: używanie Codex do wykrywania luk przed wdrożeniem kodu, pozwalanie modelom na triage alertów bezpieczeństwa, zanim zobaczą je ludzie, uruchamianie modeli granicznych do badania własnej infrastruktury oraz wzmacnianie podstaw, takich jak dostęp z najmniejszymi uprawnieniami. Jego rada dla wszystkich innych: daj swojemu zespołowi ds. bezpieczeństwa agenta i aplikuj do programu Trusted Access for Cyber firmy OpenAI, aby uzyskać zweryfikowane użycie GPT-Daybreak-Blue podczas reagowania na incydenty.

To ujęcie pomija szczegół z tego samego naruszenia. Kiedy Hugging Face badało włamanie, jego zespół ds. bezpieczeństwa zwrócił się do otwartego modelu GLM 5.2 firmy Z.ai po tym, jak amerykańskie komercyjne AI odmówiło pomocy—jego filtry bezpieczeństwa nie potrafiły odróżnić kodu exploitów badacza od kodu atakującego. CEO Hugging Face, Clément Delangue, nazwał otwarty model "kluczową częścią naszej obrony".

Następca modelu Z.ai, GLM-5.3, wydany 14 sierpnia, już osiąga lepsze wyniki niż GPT-5.6 Sol na CyberGym, tym samym benchmarku wykrywania podatności, który Brockman wskazuje jako dowód, że atakujący nadrabiają zaległości. Z.ai twierdzi, że opublikuje pełne wagi modelu do końca sierpnia.