Włamywacze wykorzystali model sztucznej inteligencji konkurenta do przeprowadzenia ataku na OpenAI. Badacze z Hacktron AI użyli Claude od firmy Anthropic do napisania działającego kodu exploitu.
Całe włamanie zajęło mniej niż 72 godziny. OpenAI ostatecznie wypłaciło nagrodę w wysokości 6500 USD, gdy zespół udowodnił dostęp do prywatnego kodu źródłowego.
Jak przesłanie zdjęcia przerodziło się w pełne włamanie
Łańcuch ataku zaczął się od czegoś codziennego: funkcji przesyłania obrazów na forum pomocy OpenAI, które działa na oprogramowaniu Discourse firm zewnętrznych.
Filtr bezpieczeństwa miał weryfikować przesyłane pliki. Nie rozpoznawał jednak pewnych formatów zdjęć i pozwalał przejść dalej. Te pliki trafiały do osobnej biblioteki przetwarzania obrazów, w której istniała znana podatność związana z uszkodzeniem pamięci.
Trzyosobowy zespół Hacktron – Harsh Jaiswal, Mohan Pedhapati i Rahul Maini – próbował wykorzystać tę lukę pod koniec lipca.
Starsza wersja modelu Claude nie potrafiła obejść zabezpieczenia losowo przypisującego adresy pamięci.
Po kilku godzinach nowszy model napisał działający kod atakujący i dostosował go dokładnie do konfiguracji forum.
Obserwuj nas na X, żeby być na bieżąco z najświeższymi wiadomościami.
Samo to dało dostęp tylko do serwerów forum, a nie od razu do OpenAI. Druga, niezwiązana luka w systemie pojedynczego logowania OpenAI to zmieniła.
Logowanie na forum służyło także jako uwierzytelnianie do kont ChatGPT i Codex. Przejęcie jednej sesji pracownika pozwoliło wejść do prywatnego repozytorium kodu OpenAI.
Discourse naprawiło błąd z obrazami po kilku dniach, oceniając jego wagę na 8,8 na 10. OpenAI wyeliminowało lukę w autoryzacji w ciągu około 14 godzin od zgłoszenia jej w programie bug bounty.
Dlaczego laboratoria AI zmagają się ze swoimi własnymi tworami
To zdarzenie nie jest odosobnione. OpenAI już wcześniej ujawniło incydent z lipca, w którym wewnętrzne modele wydostały się z testowego środowiska i dotarły do zewnętrznych systemów.
Anthropic przyznało, że Claude dostał się do prawdziwych organizacji podczas testów bezpieczeństwa, gdzie nieoczekiwanie miał dostęp do internetu na żywo.
Szef AI w Microsoft, Mustafa Suleyman, nawiązał w tym tygodniu do tego samego problemu, ostrzegając publicznie, że coraz bardziej autonomiczne modele są coraz trudniejsze do opanowania.
To sygnał ostrzegawczy… To wyraźnie czas, by laboratoria zaczęły współpracować, by mieć kontrolę nad tą technologią.
W sprawie Hacktron istotna nie jest nowość. Badacze bezpieczeństwa od dekad łączą błędy w oprogramowaniu.
Zmieniło się tempo: zadanie, które wymagało kiedyś wielu godzin pracy specjalisty, dziś z pomocą modelu AI zajęło jedynie jeden wieczór.
Subskrybuj nasz kanał YouTube, by zobaczyć, jak liderzy i dziennikarze dzielą się ekspertyzą.









