Badacze zarobili 6500 USD, naruszając OpenAI za pomocą Claude firmy Anthropic

  • Badacze z Hacktron AI wykorzystali Claude Opus 5 firmy Anthropic do napisania działającego kodu exploita przeciwko infrastrukturze OpenAI.
  • Błąd przetwarzania obrazu na forum społeczności OpenAI połączony z osobnym problemem logowania umożliwił dostęp do prywatnego kodu.
  • OpenAI wypłaciła 6500 USD premii 1 września po potwierdzeniu podatności w swoich systemach.
Promo

Włamywacze wykorzystali model sztucznej inteligencji konkurenta do przeprowadzenia ataku na OpenAI. Badacze z Hacktron AI użyli Claude od firmy Anthropic do napisania działającego kodu exploitu.

Całe włamanie zajęło mniej niż 72 godziny. OpenAI ostatecznie wypłaciło nagrodę w wysokości 6500 USD, gdy zespół udowodnił dostęp do prywatnego kodu źródłowego.

Sponsorowane
Sponsorowane

Jak przesłanie zdjęcia przerodziło się w pełne włamanie

Łańcuch ataku zaczął się od czegoś codziennego: funkcji przesyłania obrazów na forum pomocy OpenAI, które działa na oprogramowaniu Discourse firm zewnętrznych.

Filtr bezpieczeństwa miał weryfikować przesyłane pliki. Nie rozpoznawał jednak pewnych formatów zdjęć i pozwalał przejść dalej. Te pliki trafiały do osobnej biblioteki przetwarzania obrazów, w której istniała znana podatność związana z uszkodzeniem pamięci.

Trzyosobowy zespół Hacktron – Harsh Jaiswal, Mohan Pedhapati i Rahul Maini – próbował wykorzystać tę lukę pod koniec lipca.

Starsza wersja modelu Claude nie potrafiła obejść zabezpieczenia losowo przypisującego adresy pamięci.

Po kilku godzinach nowszy model napisał działający kod atakujący i dostosował go dokładnie do konfiguracji forum.

Sponsorowane
Sponsorowane

Obserwuj nas na X, żeby być na bieżąco z najświeższymi wiadomościami.

Jak Claude pomógł badaczom zarobić 6500 USD włamując się do OpenAI. Źródło: Hacktron AI
Jak Claude pomógł badaczom zarobić 6500 USD włamując się do OpenAI. Źródło: Hacktron AI

Samo to dało dostęp tylko do serwerów forum, a nie od razu do OpenAI. Druga, niezwiązana luka w systemie pojedynczego logowania OpenAI to zmieniła.

Logowanie na forum służyło także jako uwierzytelnianie do kont ChatGPT i Codex. Przejęcie jednej sesji pracownika pozwoliło wejść do prywatnego repozytorium kodu OpenAI.

Discourse naprawiło błąd z obrazami po kilku dniach, oceniając jego wagę na 8,8 na 10. OpenAI wyeliminowało lukę w autoryzacji w ciągu około 14 godzin od zgłoszenia jej w programie bug bounty.

Dlaczego laboratoria AI zmagają się ze swoimi własnymi tworami

To zdarzenie nie jest odosobnione. OpenAI już wcześniej ujawniło incydent z lipca, w którym wewnętrzne modele wydostały się z testowego środowiska i dotarły do zewnętrznych systemów.

Anthropic przyznało, że Claude dostał się do prawdziwych organizacji podczas testów bezpieczeństwa, gdzie nieoczekiwanie miał dostęp do internetu na żywo.

Szef AI w Microsoft, Mustafa Suleyman, nawiązał w tym tygodniu do tego samego problemu, ostrzegając publicznie, że coraz bardziej autonomiczne modele są coraz trudniejsze do opanowania.

To sygnał ostrzegawczy… To wyraźnie czas, by laboratoria zaczęły współpracować, by mieć kontrolę nad tą technologią.

W sprawie Hacktron istotna nie jest nowość. Badacze bezpieczeństwa od dekad łączą błędy w oprogramowaniu.

Zmieniło się tempo: zadanie, które wymagało kiedyś wielu godzin pracy specjalisty, dziś z pomocą modelu AI zajęło jedynie jeden wieczór.

Subskrybuj nasz kanał YouTube, by zobaczyć, jak liderzy i dziennikarze dzielą się ekspertyzą.

Zastrzeżenie

BeInCrypto dokłada wszelkich starań, aby zapewnić bezstronne i przejrzyste relacjonowanie. Niniejszy artykuł informacyjny ma na celu dostarczenie dokładnych i aktualnych informacji. Zaleca się jednak, aby czytelnicy samodzielnie weryfikowali fakty i konsultowali się ze specjalistą przed podjęciem jakichkolwiek decyzji na podstawie niniejszych treści. Informujemy, że nasz Regulamin, nasza Polityka prywatności oraz nasze Zastrzeżenia prawne zostały zaktualizowane.

Sponsorowane
Sponsorowane