Aigest.
Newsy

Filtr Anthropic do broni biologicznej nie działał przez niemal rok, narażając 133 miliony zapytań

Firma Anthropic, której CEO uważa rozwój broni biologicznej wspomagany AI za większe zagrożenie niż cyberataki, ujawniła, że jej filtry blokujące treści związane z bronią biologiczną były nieaktywne przez niemal rok.

RA

Udostępnij
Filtr Anthropic do broni biologicznej nie działał przez niemal rok, narażając 133 miliony zapytań
Fot. The Decoder

Firma Anthropic, której dyrektor generalny uważa rozwój broni chemicznej i biologicznej wspomagany przez sztuczną inteligencję za większe zagrożenie niż cyberataki, ujawniła w raporcie bezpieczeństwa, że jej klasyfikatory blokujące treści związane z bronią biologiczną były nieaktywne przez niemal rok. Problem dotyczył okresu od maja 2025 do kwietnia 2026 roku. Filtry te mają za zadanie uniemożliwić modelom AI wydobywanie niebezpiecznej wiedzy na temat broni chemicznej lub biologicznej. Przez ten czas cały ruch pochodzący od zewnętrznych kontrahentów, którzy dostarczali ludzkie informacje zwrotne, odbywał się bez ich działania.

Skala problemu i wewnętrzne dochodzenie

Luka w zabezpieczeniach dotknęła około 50 000 osób, które przeprowadziły około 133 miliony rozmów z modelami AI firmy. Według Anthropic, osoby te były weryfikowane jedynie przez zewnętrznych dostawców, których procesy weryfikacyjne często okazywały się niewystarczające. Mimo to, Anthropic zapewnia, że wewnętrzne dochodzenie nie wykazało żadnych dowodów na faktyczne niewłaściwe wykorzystanie systemów. W odpowiedzi na incydent, firma zaostrzyła wymagania wobec kontrahentów.

Zmiany w polityce filtrowania

Warto zaznaczyć, że Anthropic niedawno poluzował swoje klasyfikatory w modelu Fable 5. Decyzja ta została podjęta po skargach badaczy, którzy twierdzili, że filtry były tak agresywne, iż blokowały nawet uzasadnione badania naukowe. To pokazuje, jak delikatna jest równowaga między bezpieczeństwem a użytecznością w rozwoju zaawansowanych modeli AI.

Incydent z nieaktywnym filtrem Anthropic podkreśla złożoność i wyzwania związane z zapewnieniem bezpieczeństwa w dynamicznie rozwijającej się dziedzinie sztucznej inteligencji. Konieczność ciągłego monitorowania i adaptacji systemów bezpieczeństwa jest kluczowa, aby zapobiegać potencjalnym zagrożeniom, jednocześnie umożliwiając postęp i innowacje w badaniach nad AI.

Źródło: the-decoder.com

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

OpenAI bada kolejne przypadki ucieczek agentów AI z piaskownic testowych
Modele AI Anthropic samodzielnie naruszyły systemy trzech firm podczas testów bezpieczeństwa
ChatGPT dostarczał instrukcje tworzenia broni biologicznej i trucizn
Anthropic twierdzi, że Opus 5 niemal całkowicie eliminuje ataki typu prompt injection w swoich produktach
OpenAI rozwiązuje zespół ds. katastrofalnych zagrożeń AI, zadania przejmują inne działy
Anthropic ujawnia szczegóły działania znaków wodnych w chatbotach Claude

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.