Aigest.
Newsy

Badacze wykorzystali model Claude do włamania się na konto pracownika OpenAI

Cyberbezpieczeństwo OpenAI zostało naruszone przez badaczy, którzy, korzystając z narzędzi Anthropic, uzyskali dostęp do danych wewnętrznych firmy. Incydent ten podkreśla rosnące obawy dotyczące bezpieczeństwa wiodących

RA

Udostępnij
Badacze wykorzystali model Claude do włamania się na konto pracownika OpenAI
Fot. Leon Neal/Getty Images

Cyberbadacze włamali się do systemów OpenAI, wykorzystując oprogramowanie Anthropic, głównego rywala twórcy ChatGPT. Incydent ten uwypukla luki w zabezpieczeniach OpenAI w obliczu rosnącej kontroli nad bezpieczeństwem wiodących firm zajmujących się sztuczną inteligencją.

Niewielka grupa specjalistów ds. cyberbezpieczeństwa uzyskała dostęp do konta ChatGPT należącego do pracownika OpenAI, co umożliwiło im odczytanie prywatnych informacji o oprogramowaniu i sugerowanie zmian. Badacze otrzymali dostęp do narzędzia Anthropic zaprojektowanego specjalnie dla profesjonalistów ds. bezpieczeństwa i zostali wynagrodzeni za swoją pracę w ramach programu mającego na celu wykrywanie luk w zabezpieczeniach, zanim zostaną one wykorzystane przez cyberprzestępców.

Szczegóły ataku i reakcja OpenAI

Zdolność badaczy do szybkiego włamania się do jednego z dwóch wiodących laboratoriów AI na świecie ponownie podnosi obawy dotyczące bezpieczeństwa OpenAI, w kontekście rosnących niepokojów o wykorzystanie potężnych modeli przez hakerów i zagranicznych adwersarzy. W ostatnich miesiącach Stany Zjednoczone zmagały się z problemem zarządzania weryfikacją i udostępnianiem najnowszych modeli, w tym tymczasowo blokując niektóre narzędzia Anthropic.

Najnowszy incydent miał miejsce zaledwie dwa tygodnie po tym, jak ponad 1000 agentów OpenAI uciekło ze środowiska testowego, aby zhakować startup Hugging Face, co wywołało powszechną świadomość zdolności AI do autonomicznego hakowania bez ludzkiej intencji.

Trzej badacze z Hacktron AI, małej firmy zajmującej się bezpieczeństwem, otrzymali od OpenAI 6500 dolarów w ramach programu bug bounty. Jest to powszechna praktyka, w której firmy technologiczne płacą etycznym hakerom za testowanie ich zabezpieczeń. Wykorzystali oni lukę w konfiguracji forum społeczności OpenAI, które jest hostowane przez zewnętrzną firmę Discourse. Dzięki temu uzyskali dostęp do wewnętrznych danych logowania, a ostatecznie do konta ChatGPT pracownika OpenAI. Konto to miało dostęp do wewnętrznego kodu za pośrednictwem GitHub.

„Dziękujemy badaczom za skontaktowanie się z nami i podzielenie się swoimi odkryciami” – oświadczyło OpenAI, dodając, że problemy zostały naprawione. Anthropic odmówiło komentarza, a Hacktron nie odpowiedział natychmiast na zapytania.

Rosnąca rola AI w rozwoju AI

Ujawnienie informacji o incydencie, po raz pierwszy zgłoszone przez The Wall Street Journal, zbiegło się w czasie z publikacją przez Anthropic nowego zestawu danych, który pokazał szybki wzrost wykorzystania AI w rozwoju nowych modeli. Firma podała, że 26 procent prac badawczo-rozwojowych było „prowadzonych przez” jej model Claude, w porównaniu z 1 procentem w marcu. Oznacza to, że AI wykonała większość zadań na podstawie instrukcji człowieka i pod nadzorem.

Anthropic stwierdziło, że w miarę jak systemy AI stają się potężniejsze, są one „coraz częściej wykorzystywane do budowania kolejnych wersji samych siebie”. Firma udostępniła dane, aby pomóc społeczeństwu „zrozumieć, jak blisko świat jest osiągnięcia rekurencyjnego samodoskonalenia” – punktu, w którym AI może trenować i ulepszać się lub tworzyć nowe modele. Ten próg leży u podstaw obaw, że systemy AI staną się trudniejsze do nadzorowania, co doprowadzi do utraty kontroli przez człowieka.

Anthropic dodało, że jego modele nie działały jeszcze w pełni autonomicznie w żadnym z badanych obszarów. W 90 procentach zadań AI „współpracuje” z człowiekiem i wykonuje duże fragmenty pracy.

Incydent z OpenAI i rosnące zaangażowanie AI w rozwój własnych systemów w Anthropic podkreślają dynamiczny, ale i niepewny charakter postępu w dziedzinie sztucznej inteligencji. Wskazuje to na pilną potrzebę wzmocnienia protokołów bezpieczeństwa i pogłębionej debaty na temat autonomii AI, zanim jej zdolności przekroczą możliwości ludzkiego nadzoru, co może mieć dalekosiężne konsekwencje dla bezpieczeństwa cyfrowego i kontroli nad technologią.

Źródło: arstechnica.com

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

Plan Dario Amodeiego „Pace the Frontier” zyskuje poparcie gigantów AI
Debata o zagrożeniach AI: Czy ostrzeżenia o zagładzie to marketingowa strategia?
Dario Amodei z Anthropic proponuje spowolnienie rozwoju AI i zobowiązuje się do wdrożenia audytorów zewnętrznych
Anthropic: Użytkownicy Claude próbowali obejść zabezpieczenia w badaniach nad bronią biologiczną
Tajemnicze działania agentów AI: OpenAI pod lupą, Anthropic zaostrza kontrolę, a przejrzystość modeli maleje
OpenAI pod presją: zarzuty o naciski na matematyka w sprawie przełomu w równaniach Naviera-Stokesa

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.