W poście na blogu OpenAI wyjaśniła, że gdy testowała możliwości niektórych najbardziej zaawansowanych modeli w kontrolowanym środowisku, programowi udało się wydostać poza wyznaczone granice, uzyskać dostęp do internetu i włamać się do serwerów Hugging Face, próbując zrealizować swój cel testowy.
W poście na blogu stwierdzono, że ucieczka ta była „bezprecedensowym incydentem cybernetycznym, wymagającym wykorzystania najnowocześniejszych zdolności cybernetycznych” oraz że firma wzmacnia zabezpieczenia.
Hugging Face, platforma służąca do hostowania dużych modeli językowych i zbiorów danych open source, w zeszłym tygodniu w poście na blogu poinformowała, że padła ofiarą ataku hakerskiego, który „różnił się od wszystkiego, z czym mieliśmy do czynienia wcześniej”, ponieważ „był on napędzany od początku do końca przez autonomiczny system agentów AI”.
Największy paradoks współczesnego cyberbezpieczeństwa: Narzędzia, które mają nas chronić, odmawiają współpracy dokładnie wtedy, gdy jesteśmy atakowani.
— Piotr Sankowski (@piotrsankowski) July 22, 2026
Zamiast przyspieszać reakcję na incydenty, dostępność modeli sztucznej inteligencji wyłącznie przez zamknięte interfejsy API z… pic.twitter.com/4r7nU2mk6K
W poście na X, współzałożyciel Hugging Face, Clement Delangue, napisał, że firma podejrzewa, iż atak „mógł pochodzić z pionierskiego laboratorium, biorąc pod uwagę zaawansowanie agenta. Okazuje się, że tak było!”. Dodał: „To niesamowite, że wszystko to wydarzyło się autonomicznie!”.
Eksperci potwierdzają
Ujawnienie przez OpenAI, że jego zaawansowane modele były odpowiedzialne za naruszenie bezpieczeństwa, pomimo umieszczenia ich w, jak to określono, „bardzo odizolowanym środowisku”, prawdopodobnie nasili niepokój dotyczący mocy i ryzyka modeli pionierskich - podkreślił Reuters.
Matt Suiche, inżynier w firmie Tolmo, zajmującej się cyberbezpieczeństwem opartym na sztucznej inteligencji, ocenił, że systemy sztucznej inteligencji są obecnie tak samo skuteczne, jak elitarni cyberoperatorzy.
We're partnering with @huggingface to investigate an unprecedented security incident.
— OpenAI (@OpenAI) July 21, 2026
Cyber-capable OpenAI models compromised Hugging Face production during a benchmark evaluation.
Sharing preliminary findings to help defenders understand emerging risks:…
„Modele pionierskie nadrabiają zaległości dzięki najnowocześniejszym atakującym” – powiedział Suiche. Ostrzegł, że naruszenia bezpieczeństwa opisane we wpisie na blogu OpenAI można było przeprowadzić przy użyciu technologii dostępnej daleko poza murami pionierskich laboratoriów badawczych. - To właśnie widzieliśmy już u nas. Nie musimy nawet korzystać z najnowszych modeli - stwierdził.