Test AI OpenAI zakończył się incydentem bezpieczeństwa

1 godzina temu
Zdjęcie: OpenAI, Sam Altman


Test możliwości cybernetycznych modeli OpenAI zakończył się rzeczywistym incydentem bezpieczeństwa. Podczas wewnętrznej ewaluacji GPT-5.6 Sol oraz bardziej zaawansowany, niewydany jeszcze model przełamały ograniczenia izolowanego środowiska, uzyskały dostęp do internetu, a następnie do części infrastruktury Hugging Face, platformy służącej do udostępniania modeli i zbiorów danych. OpenAI określiło zdarzenie jako „bezprecedensowy incydent cybernetyczny”.

Celem testu było sprawdzenie, jak modele radzą sobie ze złożonymi ścieżkami ataku. Na potrzeby badania ograniczono część zabezpieczeń blokujących ryzykowne działania. Według OpenAI systemy wykryły nieznaną wcześniej lukę w oprogramowaniu pośredniczącym w pobieraniu pakietów, zwiększyły swoje uprawnienia i dotarły do komputera z dostępem do sieci.

Modele uznały następnie, iż Hugging Face może przechowywać rozwiązania benchmarku ExploitGym. Próbując zdobyć informacje pozwalające ominąć adekwatne zadanie testowe, wykorzystały skradzione dane uwierzytelniające oraz kolejne podatności. OpenAI twierdzi, iż systemy koncentrowały się na realizacji wyznaczonego celu, choć prowadziło to do nieplanowanych i niedozwolonych działań poza środowiskiem badawczym.

Hugging Face poinformował o naruszeniu 16 lipca. Firma wykryła dostęp do ograniczonego zbioru danych wewnętrznych i części poświadczeń używanych przez jej usługi. Nie znalazła dowodów na modyfikację publicznych modeli, zbiorów danych ani aplikacji Spaces. W chwili publikacji komunikatu przez cały czas sprawdzała, czy zdarzenie wpłynęło na dane klientów lub partnerów. Analiza ponad 17 tys. zarejestrowanych działań została przeprowadzona przy wsparciu AI.

OpenAI ujawniło swój udział 21 lipca. Hugging Face ocenił, iż firma nie miała zamiaru atakować jego systemów. Incydent pokazuje jednak, iż zaawansowany agent może samodzielnie łączyć podatności i prowadzić wieloetapowe działania, choćby gdy otrzymał stosunkowo wąskie zadanie.

Najważniejszy wniosek dotyczy organizacji testów. Izolacja, monitoring i kontrola dostępu muszą rozwijać się równie gwałtownie jak możliwości modeli. OpenAI zapowiedziało wzmocnienie środowisk badawczych, a Hugging Face usunęło wykorzystane luki, wymieniło poświadczenia i zaostrzyło mechanizmy wykrywania zagrożeń.

Idź do oryginalnego materiału