Aigest.
Newsy

Anthropic wprowadza tryb automatyczny w Claude Code jako domyślny, zwiększając bezpieczeństwo i efektywność

Anthropic ogłosił, że tryb automatyczny (Auto Mode) w narzędziu Claude Code stanie się domyślny dla większości użytkowników. Zmiana ma na celu zwiększenie bezpieczeństwa i przyspieszenie procesów deweloperskich.

RA

Udostępnij
Anthropic wprowadza tryb automatyczny w Claude Code jako domyślny, zwiększając bezpieczeństwo i efektywność
Fot. The Decoder

Anthropic ogłosił znaczącą zmianę w swoim narzędziu do kodowania opartym na sztucznej inteligencji, Claude Code. Od 14 sierpnia tryb automatyczny, znany jako Auto Mode, zostanie domyślnie włączony dla użytkowników planów Pro, Max i Team. Klienci korporacyjni (Enterprise) nadal będą musieli ręcznie aktywować tę funkcję. Decyzja ta oznacza, że sztuczna inteligencja będzie samodzielnie zarządzać jeszcze większą częścią procesu deweloperskiego.

Jak działa tryb automatyczny?

Auto Mode umożliwia narzędziu do kodowania AI samodzielną pracę, eliminując potrzebę ręcznego zatwierdzania każdego kroku. Kluczowym elementem jest wbudowany klasyfikator, który analizuje potencjalne działania pod kątem ich niebezpieczeństwa lub nieodwracalności. Tylko w takich przypadkach system prosi o potwierdzenie ze strony dewelopera. Według Anthropic, testy przeprowadzone na 1053 płatnych testerach oraz wewnętrzne testy bezpieczeństwa (red-teaming) wykazały, że Auto Mode działa co najmniej tak samo bezpiecznie jak ręczne zatwierdzanie, a często nawet lepiej. Zespoły korzystające z tego trybu generowały również około 25 procent więcej pull requestów, co przekłada się na zwiększoną efektywność pracy.

Ochrona przed atakami i wewnętrzne zastosowania

Anthropic podkreśla, że Auto Mode stanowi dodatkową warstwę ochrony przed atakami typu prompt injection. Ataki te polegają na wstrzykiwaniu złośliwego kodu, który ma na celu przejęcie kontroli nad agentem AI i zmuszenie go do działania niezgodnego z instrukcjami użytkownika. Niezależny audyt przeprowadzony przez Trajectory Labs obejmował 72 scenariusze ataków, każdy testowany dziesięciokrotnie. Żadna z 720 prób nie powiodła się w przypadku obecnych modeli Claude'a – Fable 5, Opus 5 i Sonnet 5 – działających w trybie automatycznym. Dla porównania, w przypadku modelu GPT-5.6 Sol firmy OpenAI w trybie Codex Auto-Review, 5,83 procent ataków zakończyło się sukcesem.

Firma Anthropic podała również przykłady wewnętrznego zastosowania Auto Mode. Narzędzie to zapobiegło przypadkowemu przesłaniu poufnych danych na publiczną stronę. Podczas jednej długiej sesji tryb automatyczny zakończył około 2000 procesów, które mogłyby zakłócić trwające zadania szkoleniowe na jednostkach GPU.

Konsekwencje dla deweloperów i modelu biznesowego

Choć Anthropic nie pobiera opłat za tokeny zużywane przez sam klasyfikator, uczynienie Auto Mode domyślnym prawdopodobnie przyniesie firmie korzyści finansowe. Gdy Claude pracuje dłużej i wykonuje więcej zadań, całkowite zużycie tokenów wzrasta, co przekłada się na wyższe przychody, nawet jeśli nie było to główną motywacją Anthropic. Claude Code jest obecnie najczęściej używanym narzędziem do kodowania AI, a domyślne włączenie trybu automatycznego przesuwa rolę dewelopera z aktywnego kodowania w stronę przeglądania wyników generowanych przez AI.

Anthropic zachęca jednak do ostrożności. Klasyfikator zmniejsza ryzyko, ale go nie eliminuje. Firma zaleca, aby w przypadku krytycznych zmian w infrastrukturze produkcyjnej deweloperzy nadal samodzielnie przeglądali działania Claude'a. Ta porada rodzi pewien paradoks: im rzadziej deweloperzy interweniują, tym większe znaczenie ma ich nadzór. Jednocześnie trudniej jest zbudować głębokie zrozumienie projektów, które zostały w dużej mierze stworzone przez Auto Mode z niewielkim udziałem człowieka. W obliczu rosnącej złożoności i szybkości zmian w cyberbezpieczeństwie, nadążanie za wszystkim staje się coraz większym wyzwaniem dla ludzkich możliwości.

Źródło: the-decoder.com

Udostępnij

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

Czytelnicy wyżej oceniają opowiadania AI, dopóki nie wiedzą, kto jest autorem
xAI wprowadza Imagine Image 2.0, model plasuje się tuż za GPT-Image-2 OpenAI w rankingach Arena
OpenAI dyktuje warunki dostępu do AI, a to dopiero początek podziałów na rynku
Mistral AI prezentuje Shieldstral 1.0 3B: Adaptacyjny klasyfikator bezpieczeństwa multimodalnego
OpenAI wstrzymuje rozwój modelu Astra z powodu obaw o cyberbezpieczeństwo
Tencent Cloud udostępnia TencentDB Agent Memory v2.0 jako otwarte źródło: centrum pamięci dla agentów AI
Newsy

Tencent Cloud udostępnia TencentDB Agent Memory v2.0 jako otwarte źródło: centrum pamięci dla agentów AI

Tencent Cloud udostępniło TencentDB Agent Memory w wersji 2.0 jako otwarte źródło. To innowacyjne rozwiązanie ma służyć jako centrum pamięci na poziomie zespołowym dla agentów AI, usprawniając współpracę i zarządzanie ko

Redakcja Aigest22 godz. temu

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.