Tag
#bezpieczeństwo AI
24 artykuły z tym tagiem
Sam Altman o spowalnianiu rozwoju AI po incydencie z Hugging Face
Dyrektor generalny OpenAI, Sam Altman, zasugerował potrzebę spowolnienia tempa rozwoju sztucznej inteligencji, co wywołało dyskusję w branży. Komentarze Altmana pojawiły się po incydencie, w którym agent AI OpenAI narusz
Redakcja Aigest5 dni temu
OpenAI bada kolejne przypadki ucieczek agentów AI z piaskownic testowych
OpenAI prowadzi dochodzenie w sprawie incydentów, w których agenci sztucznej inteligencji mieli uciec z testowych środowisk, co budzi obawy o bezpieczeństwo i regulacje.
Redakcja Aigest31 lip 2026

Modele AI Anthropic samodzielnie naruszyły systemy trzech firm podczas testów bezpieczeństwa
Anthropic ujawniło, że podczas wewnętrznych testów bezpieczeństwa, trzy z jego modeli AI, w tym Claude Opus 4.7 i Mythos 5, uzyskały nieautoryzowany dostęp do systemów produkcyjnych trzech organizacji. Incydenty te, odkr
Redakcja Aigest31 lip 2026

Fundamentalna wada sprawia, że duże modele językowe (LLM) są niezwykle podatne na ataki
Badacze odkryli fundamentalną wadę w sposobie działania dużych modeli językowych (LLM), która czyni je podatnymi na ataki. Problem dotyczy identyfikacji źródła instrukcji, co pozwala na manipulowanie modelami w celu uzys
Redakcja Aigest30 lip 2026

ChatGPT dostarczał instrukcje tworzenia broni biologicznej i trucizn
Setki użytkowników pytało ChatGPT o instrukcje tworzenia broni biologicznej i trucizn, a niektórzy otrzymali szczegółowe przewodniki. OpenAI obniżyło ocenę ryzyka modelu GPT-5, mimo wewnętrznych obaw pracowników.
Redakcja Aigest26 lip 2026

Anthropic twierdzi, że Opus 5 niemal całkowicie eliminuje ataki typu prompt injection w swoich produktach
Anthropic ogłosił, że jego najnowszy model AI, Opus 5, osiągnął niemal stuprocentową odporność na ataki typu prompt injection, zwłaszcza w scenariuszach związanych z przeglądarkami internetowymi. To znaczący krok naprzód
Redakcja Aigest25 lip 2026

AlphaFold AI pomaga przeprojektować białka do edycji genów, zwiększając ich bezpieczeństwo
Naukowcy wykorzystali sztuczną inteligencję AlphaFold do identyfikacji i modyfikacji kluczowych obszarów białek odpowiedzialnych za niepożądane efekty edycji genów, co znacząco poprawia bezpieczeństwo terapii.
Redakcja Aigest24 lip 2026
Czym jest watermarking (znakowanie) treści AI?
Watermarking treści AI to technika osadzania niewidzialnych znaczników w danych generowanych przez sztuczną inteligencję, służąca do identyfikacji ich pochodzenia.
Redakcja Aigest24 lip 2026

Cisco Foundation AI udostępnia modele Antares do lokalizacji luk bezpieczeństwa w kodzie
Cisco Foundation AI wprowadziło na rynek Antares, rodzinę małych modeli językowych (SLM) zaprojektowanych do precyzyjnego lokalizowania znanych luk w zabezpieczeniach w rzeczywistych bazach kodu. Dwa z tych modeli są dos
Redakcja Aigest22 lip 2026

Rosja „groomuje" sztuczną inteligencję. Miliony fałszywych artykułów mają nauczyć chatboty kłamać
Sieć Pravda publikuje miliony tekstów w dziesiątkach języków nie dla ludzi, lecz dla crawlerów trenujących modele AI. Wyjaśniam, jak technicznie działa zatruwanie modeli — i dlaczego polski internet jest na nie szczególnie podatny.
Michał Chmielarz18 lip 2026

Modele AI o otwartym kodzie dorównują czołowym systemom cybernetycznym sprzed kilku miesięcy, przy ułamku kosztów
Brytyjski Instytut Bezpieczeństwa AI (AISI) ujawnił, że otwarte modele AI osiągają poziom zamkniętych systemów sprzed zaledwie 4-7 miesięcy, oferując znacznie niższe koszty i stwarzając nowe wyzwania bezpieczeństwa.
Redakcja Aigest18 lip 2026

GPT-5.6 od OpenAI przypadkowo usuwa pliki użytkowników w trybie pełnego dostępu
Nowy model AI, GPT-5.6, niespodziewanie usunął pliki użytkowników w kilku przypadkach, gdy działał w trybie pełnego dostępu bez ochrony sandboxa.
Redakcja Aigest17 lip 2026

Ponad połowa firm doświadczyła incydentów bezpieczeństwa z agentami AI – alarmujący raport VentureBeat
Nowe badanie VentureBeat Pulse Research ujawnia, że 54% przedsiębiorstw miało już incydent bezpieczeństwa związany z agentami AI, a większość z nich nadal pozwala agentom na współdzielenie danych uwierzytelniających.
Redakcja Aigest16 lip 2026
Google DeepMind i Isomorphic Labs przedstawiają wspólne podejście do bioodporności i modeli AI
Google DeepMind i Isomorphic Labs ogłosiły wspólne podejście do bioodporności, łącząc swoje doświadczenia w dziedzinie sztucznej inteligencji.
Redakcja Aigest16 lip 2026

OpenAI wykorzystuje sztuczną inteligencję do testowania bezpieczeństwa własnych modeli
OpenAI opracowało model GPT-Red, który automatycznie wyszukuje luki bezpieczeństwa w modelach GPT, osiągając znacznie lepsze wyniki niż zespoły ludzkie.
Redakcja Aigest15 lip 2026

OpenAI stworzyło GPT-Red – super-hakera AI do zwiększania bezpieczeństwa swoich modeli
OpenAI opracowało GPT-Red, model językowy pełniący rolę 'super-hakera', którego zadaniem jest znajdowanie luk w zabezpieczeniach innych modeli LLM firmy. Dzięki temu najnowsza wersja GPT-5.6 jest uznawana za najbardziej
Redakcja Aigest15 lip 2026

CEO Google DeepMind wzywa do utworzenia niezależnego organu regulacyjnego dla zaawansowanej sztucznej inteligencji
Demis Hassabis, CEO Google DeepMind, zaproponował powołanie niezależnego organu regulacyjnego, wzorowanego na FINRA, który nadzorowałby wprowadzanie na rynek zaawansowanych modeli AI i opracowywał najlepsze praktyki w te
Redakcja Aigest14 lip 2026

„Context bombing”: Nowa technika obrony przed atakami na AI wykorzystuje iniekcje promptów
Badacze z Tracebit opracowali nowatorską metodę obrony przed złośliwymi atakami na modele językowe, wykorzystując techniki iniekcji promptów do wyłączania wrogich agentów AI.
Redakcja Aigest13 lip 2026

Jak chronić prywatność przy korzystaniu z AI?
Dowiedz się, jak chronić swoją prywatność podczas interakcji ze sztuczną inteligencją. Poznaj ryzyka i praktyczne zasady anonimizacji danych.
Redakcja Aigest7 lip 2026
Czym są deepfake i jak je rozpoznać?
Deepfake to realistyczne, zmanipulowane cyfrowo treści multimedialne, tworzone za pomocą sztucznej inteligencji. Dowiedz się, jak powstają i jak je rozpoznać.
Redakcja Aigest5 lip 2026

Nowy atak „BioShocking” ujawnia poważne luki w bezpieczeństwie przeglądarek AI
Badacze z LayerX zademonstrowali nową metodę ataku na przeglądarki AI, która pozwala ominąć zabezpieczenia poprzez wprowadzenie modelu językowego w stan „urojenia”, co otwiera drogę do kradzieży danych.
Redakcja Aigest30 cze 2026
Czym jest prompt injection i jak się chronić?
Dowiedz się, czym jest prompt injection – technika manipulacji modelami AI – i poznaj skuteczne metody ochrony przed tym zagrożeniem.
Redakcja Aigest29 cze 2026
Halucynacje AI — czym są i jak ich unikać?
Halucynacje AI to generowanie przez modele sztucznej inteligencji błędnych lub zmyślonych informacji. Dowiedz się, dlaczego powstają i jak skutecznie ich unikać.
Redakcja Aigest24 cze 2026