Anthropic wprowadza tryb automatyczny w Claude Code jako domyślny, zwiększając bezpieczeństwo i efektywność
Anthropic ogłosił, że tryb automatyczny (Auto Mode) w narzędziu Claude Code stanie się domyślny dla większości użytkowników. Zmiana ma na celu zwiększenie bezpieczeństwa i przyspieszenie procesów deweloperskich.

Anthropic ogłosił znaczącą zmianę w swoim narzędziu do kodowania opartym na sztucznej inteligencji, Claude Code. Od 14 sierpnia tryb automatyczny, znany jako Auto Mode, zostanie domyślnie włączony dla użytkowników planów Pro, Max i Team. Klienci korporacyjni (Enterprise) nadal będą musieli ręcznie aktywować tę funkcję. Decyzja ta oznacza, że sztuczna inteligencja będzie samodzielnie zarządzać jeszcze większą częścią procesu deweloperskiego.
Jak działa tryb automatyczny?
Auto Mode umożliwia narzędziu do kodowania AI samodzielną pracę, eliminując potrzebę ręcznego zatwierdzania każdego kroku. Kluczowym elementem jest wbudowany klasyfikator, który analizuje potencjalne działania pod kątem ich niebezpieczeństwa lub nieodwracalności. Tylko w takich przypadkach system prosi o potwierdzenie ze strony dewelopera. Według Anthropic, testy przeprowadzone na 1053 płatnych testerach oraz wewnętrzne testy bezpieczeństwa (red-teaming) wykazały, że Auto Mode działa co najmniej tak samo bezpiecznie jak ręczne zatwierdzanie, a często nawet lepiej. Zespoły korzystające z tego trybu generowały również około 25 procent więcej pull requestów, co przekłada się na zwiększoną efektywność pracy.
Ochrona przed atakami i wewnętrzne zastosowania
Anthropic podkreśla, że Auto Mode stanowi dodatkową warstwę ochrony przed atakami typu prompt injection. Ataki te polegają na wstrzykiwaniu złośliwego kodu, który ma na celu przejęcie kontroli nad agentem AI i zmuszenie go do działania niezgodnego z instrukcjami użytkownika. Niezależny audyt przeprowadzony przez Trajectory Labs obejmował 72 scenariusze ataków, każdy testowany dziesięciokrotnie. Żadna z 720 prób nie powiodła się w przypadku obecnych modeli Claude'a – Fable 5, Opus 5 i Sonnet 5 – działających w trybie automatycznym. Dla porównania, w przypadku modelu GPT-5.6 Sol firmy OpenAI w trybie Codex Auto-Review, 5,83 procent ataków zakończyło się sukcesem.
Firma Anthropic podała również przykłady wewnętrznego zastosowania Auto Mode. Narzędzie to zapobiegło przypadkowemu przesłaniu poufnych danych na publiczną stronę. Podczas jednej długiej sesji tryb automatyczny zakończył około 2000 procesów, które mogłyby zakłócić trwające zadania szkoleniowe na jednostkach GPU.
Konsekwencje dla deweloperów i modelu biznesowego
Choć Anthropic nie pobiera opłat za tokeny zużywane przez sam klasyfikator, uczynienie Auto Mode domyślnym prawdopodobnie przyniesie firmie korzyści finansowe. Gdy Claude pracuje dłużej i wykonuje więcej zadań, całkowite zużycie tokenów wzrasta, co przekłada się na wyższe przychody, nawet jeśli nie było to główną motywacją Anthropic. Claude Code jest obecnie najczęściej używanym narzędziem do kodowania AI, a domyślne włączenie trybu automatycznego przesuwa rolę dewelopera z aktywnego kodowania w stronę przeglądania wyników generowanych przez AI.
Anthropic zachęca jednak do ostrożności. Klasyfikator zmniejsza ryzyko, ale go nie eliminuje. Firma zaleca, aby w przypadku krytycznych zmian w infrastrukturze produkcyjnej deweloperzy nadal samodzielnie przeglądali działania Claude'a. Ta porada rodzi pewien paradoks: im rzadziej deweloperzy interweniują, tym większe znaczenie ma ich nadzór. Jednocześnie trudniej jest zbudować głębokie zrozumienie projektów, które zostały w dużej mierze stworzone przez Auto Mode z niewielkim udziałem człowieka. W obliczu rosnącej złożoności i szybkości zmian w cyberbezpieczeństwie, nadążanie za wszystkim staje się coraz większym wyzwaniem dla ludzkich możliwości.
Źródło: the-decoder.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

Czytelnicy wyżej oceniają opowiadania AI, dopóki nie wiedzą, kto jest autorem
Nowe badanie wykazało, że opowiadania generowane przez ChatGPT są oceniane wyżej niż te pisane przez ludzi, pod warunkiem, że czytelnicy nie są świadomi maszynowego autorstwa. Uczestnicy eksperymentu mieli trudności z od
Redakcja Aigest5 godz. temu
xAI wprowadza Imagine Image 2.0, model plasuje się tuż za GPT-Image-2 OpenAI w rankingach Arena
xAI zaprezentowało Imagine Image 2.0, nową wersję swojego generatora obrazów, która oferuje zaawansowane narzędzia edycyjne i szablony. Model ten osiągnął wysokie wyniki w benchmarkach Arena, ustępując jedynie GPT-Image-
Redakcja Aigest11 godz. temu

OpenAI dyktuje warunki dostępu do AI, a to dopiero początek podziałów na rynku
OpenAI wprowadza zróżnicowane modele GPT-5.6 dla darmowych i płatnych użytkowników, co jest strategicznym ruchem w kierunku monetyzacji i segmentacji rynku AI.
Michał Chmielarz12 godz. temu

Mistral AI prezentuje Shieldstral 1.0 3B: Adaptacyjny klasyfikator bezpieczeństwa multimodalnego
Mistral AI wprowadza Shieldstral 1.0 3B, innowacyjny klasyfikator bezpieczeństwa multimodalnego, który rewolucjonizuje moderację treści, traktując ją jako jedno pytanie tak/nie, zamiast sztywnej taksonomii kategorii szkó
Redakcja Aigest15 godz. temu
OpenAI wstrzymuje rozwój modelu Astra z powodu obaw o cyberbezpieczeństwo
OpenAI ogłosiło wstrzymanie prac nad niektórymi aspektami swojego nadchodzącego modelu Astra, po tym jak wewnętrzny przegląd wykazał, że osiągnął on zdolności do samodzielnego przeprowadzania cyberataków, przekraczając k
Redakcja Aigest21 godz. temu

Tencent Cloud udostępnia TencentDB Agent Memory v2.0 jako otwarte źródło: centrum pamięci dla agentów AI
Tencent Cloud udostępniło TencentDB Agent Memory w wersji 2.0 jako otwarte źródło. To innowacyjne rozwiązanie ma służyć jako centrum pamięci na poziomie zespołowym dla agentów AI, usprawniając współpracę i zarządzanie ko
Redakcja Aigest22 godz. temu
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.