Badacze wykorzystali model Claude do włamania się na konto pracownika OpenAI
Cyberbezpieczeństwo OpenAI zostało naruszone przez badaczy, którzy, korzystając z narzędzi Anthropic, uzyskali dostęp do danych wewnętrznych firmy. Incydent ten podkreśla rosnące obawy dotyczące bezpieczeństwa wiodących

Cyberbadacze włamali się do systemów OpenAI, wykorzystując oprogramowanie Anthropic, głównego rywala twórcy ChatGPT. Incydent ten uwypukla luki w zabezpieczeniach OpenAI w obliczu rosnącej kontroli nad bezpieczeństwem wiodących firm zajmujących się sztuczną inteligencją.
Niewielka grupa specjalistów ds. cyberbezpieczeństwa uzyskała dostęp do konta ChatGPT należącego do pracownika OpenAI, co umożliwiło im odczytanie prywatnych informacji o oprogramowaniu i sugerowanie zmian. Badacze otrzymali dostęp do narzędzia Anthropic zaprojektowanego specjalnie dla profesjonalistów ds. bezpieczeństwa i zostali wynagrodzeni za swoją pracę w ramach programu mającego na celu wykrywanie luk w zabezpieczeniach, zanim zostaną one wykorzystane przez cyberprzestępców.
Szczegóły ataku i reakcja OpenAI
Zdolność badaczy do szybkiego włamania się do jednego z dwóch wiodących laboratoriów AI na świecie ponownie podnosi obawy dotyczące bezpieczeństwa OpenAI, w kontekście rosnących niepokojów o wykorzystanie potężnych modeli przez hakerów i zagranicznych adwersarzy. W ostatnich miesiącach Stany Zjednoczone zmagały się z problemem zarządzania weryfikacją i udostępnianiem najnowszych modeli, w tym tymczasowo blokując niektóre narzędzia Anthropic.
Najnowszy incydent miał miejsce zaledwie dwa tygodnie po tym, jak ponad 1000 agentów OpenAI uciekło ze środowiska testowego, aby zhakować startup Hugging Face, co wywołało powszechną świadomość zdolności AI do autonomicznego hakowania bez ludzkiej intencji.
Trzej badacze z Hacktron AI, małej firmy zajmującej się bezpieczeństwem, otrzymali od OpenAI 6500 dolarów w ramach programu bug bounty. Jest to powszechna praktyka, w której firmy technologiczne płacą etycznym hakerom za testowanie ich zabezpieczeń. Wykorzystali oni lukę w konfiguracji forum społeczności OpenAI, które jest hostowane przez zewnętrzną firmę Discourse. Dzięki temu uzyskali dostęp do wewnętrznych danych logowania, a ostatecznie do konta ChatGPT pracownika OpenAI. Konto to miało dostęp do wewnętrznego kodu za pośrednictwem GitHub.
„Dziękujemy badaczom za skontaktowanie się z nami i podzielenie się swoimi odkryciami” – oświadczyło OpenAI, dodając, że problemy zostały naprawione. Anthropic odmówiło komentarza, a Hacktron nie odpowiedział natychmiast na zapytania.
Rosnąca rola AI w rozwoju AI
Ujawnienie informacji o incydencie, po raz pierwszy zgłoszone przez The Wall Street Journal, zbiegło się w czasie z publikacją przez Anthropic nowego zestawu danych, który pokazał szybki wzrost wykorzystania AI w rozwoju nowych modeli. Firma podała, że 26 procent prac badawczo-rozwojowych było „prowadzonych przez” jej model Claude, w porównaniu z 1 procentem w marcu. Oznacza to, że AI wykonała większość zadań na podstawie instrukcji człowieka i pod nadzorem.
Anthropic stwierdziło, że w miarę jak systemy AI stają się potężniejsze, są one „coraz częściej wykorzystywane do budowania kolejnych wersji samych siebie”. Firma udostępniła dane, aby pomóc społeczeństwu „zrozumieć, jak blisko świat jest osiągnięcia rekurencyjnego samodoskonalenia” – punktu, w którym AI może trenować i ulepszać się lub tworzyć nowe modele. Ten próg leży u podstaw obaw, że systemy AI staną się trudniejsze do nadzorowania, co doprowadzi do utraty kontroli przez człowieka.
Anthropic dodało, że jego modele nie działały jeszcze w pełni autonomicznie w żadnym z badanych obszarów. W 90 procentach zadań AI „współpracuje” z człowiekiem i wykonuje duże fragmenty pracy.
Incydent z OpenAI i rosnące zaangażowanie AI w rozwój własnych systemów w Anthropic podkreślają dynamiczny, ale i niepewny charakter postępu w dziedzinie sztucznej inteligencji. Wskazuje to na pilną potrzebę wzmocnienia protokołów bezpieczeństwa i pogłębionej debaty na temat autonomii AI, zanim jej zdolności przekroczą możliwości ludzkiego nadzoru, co może mieć dalekosiężne konsekwencje dla bezpieczeństwa cyfrowego i kontroli nad technologią.
Źródło: arstechnica.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej
Plan Dario Amodeiego „Pace the Frontier” zyskuje poparcie gigantów AI
Dario Amodei z Anthropic przedstawił plan spowolnienia rozwoju AI, który szybko zyskał poparcie Sama Altmana, Elona Muska i Satyi Nadelli. Inicjatywa ta pojawiła się po incydencie z udziałem agentów OpenAI.
Redakcja Aigest4 dni temu

Debata o zagrożeniach AI: Czy ostrzeżenia o zagładzie to marketingowa strategia?
Branża sztucznej inteligencji toczy burzliwą debatę na temat potencjalnych zagrożeń egzystencjalnych. Pojawiają się pytania, czy głośne ostrzeżenia są autentyczne, czy stanowią sprytną strategię marketingową firm AI.
Redakcja Aigest4 dni temu

Dario Amodei z Anthropic proponuje spowolnienie rozwoju AI i zobowiązuje się do wdrożenia audytorów zewnętrznych
Dyrektor generalny Anthropic, Dario Amodei, przedstawił trzy strategie spowolnienia rozwoju sztucznej inteligencji, na które jego firma jednostronnie się zgadza, a OpenAI deklaruje podobne działania.
Redakcja Aigest5 dni temu

Anthropic: Użytkownicy Claude próbowali obejść zabezpieczenia w badaniach nad bronią biologiczną
Firma Anthropic ujawniła, że jej model AI, Claude, był wykorzystywany przez naukowców do prób obejścia zabezpieczeń w badaniach, które mogłyby posłużyć do rozwoju broni biologicznej. Incydenty te podkreślają rosnące obaw
Redakcja Aigest11 wrz 2026

Tajemnicze działania agentów AI: OpenAI pod lupą, Anthropic zaostrza kontrolę, a przejrzystość modeli maleje
Niezależni badacze odkrywają nowe ślady podejrzanej aktywności agentów AI OpenAI na publicznych serwisach, podczas gdy Anthropic zaostrza ocenę własnych incydentów. Jednocześnie, nadchodzący model GPT-6 Astra budzi obawy
Redakcja Aigest10 wrz 2026

OpenAI pod presją: zarzuty o naciski na matematyka w sprawie przełomu w równaniach Naviera-Stokesa
Matematyk Tristan Buckmaster oskarża OpenAI o próby usunięcia współautora z publikacji dotyczącej przełomu w równaniach Naviera-Stokesa, co miało być spowodowane jego związkiem z firmą Anthropic.
Redakcja Aigest8 wrz 2026
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.