Tag
#LLM
24 artykuły z tym tagiem

Słownik AI: Kluczowe terminy, które musisz znać, od AGI po halucynacje
Sztuczna inteligencja tworzy własny język, a zrozumienie kluczowych terminów jest niezbędne dla każdego, kto chce nadążyć za dynamicznym rozwojem tej technologii. Ten artykuł wyjaśnia najważniejsze pojęcia AI.
Redakcja Aigest7 wrz 2026

BenchMIRT: Nowe spojrzenie na to, co mierzą benchmarki LLM
Artykuł analizuje skuteczność tradycyjnych benchmarków w ocenie dużych modeli językowych (LLM), wprowadzając koncepcję BenchMIRT, która ma lepiej oddawać ich rzeczywiste możliwości.
Redakcja Aigest1 wrz 2026
Model Astra od OpenAI: Przełom w cyberbezpieczeństwie czy nowe zagrożenie?
OpenAI zapowiada model Astra, który jako pierwszy LLM osiągnął „krytyczny próg cyberbezpieczeństwa”, potrafiąc samodzielnie znajdować i wykorzystywać luki w systemach komputerowych. Firma planuje jego rychłe udostępnieni
Redakcja Aigest1 wrz 2026

Jak sztuczna inteligencja radzi sobie z łamigłówkami? Testy ujawniają słabości modeli AI
Modele sztucznej inteligencji, mimo dynamicznego rozwoju, nadal mają trudności z rozwiązywaniem niektórych typów łamigłówek i gier logicznych, co wskazuje na luki w ich rozumowaniu. Testy te pomagają zrozumieć różnice mi
Redakcja Aigest26 sie 2026

IBM prezentuje Granite 4.2: Nowe modele językowe z zaawansowanym rozumowaniem i uczeniem agentowym
IBM wprowadza na rynek Granite 4.2 – rodzinę otwartych modeli językowych o rozmiarach 3B, 8B i 30B parametrów, skupionych na zdolnościach rozumowania i uczeniu agentowym.
Redakcja Aigest26 sie 2026

Jak Cheshire Academy uczy mądrego korzystania z AI w klasie
Szkoła Cheshire Academy w Connecticut wdraża innowacyjne metody nauczania, wykorzystując sztuczną inteligencję w procesie edukacyjnym. Uczy uczniów i nauczycieli, jak efektywnie i etycznie korzystać z narzędzi AI, stosuj
Redakcja Aigest24 sie 2026

FreeToken: Przełomowy silnik MoE uruchamia 753B GLM-5.2 na pojedynczej karcie graficznej
Nowy silnik FreeToken, opracowany przez badaczy z UC Berkeley i UT Austin, umożliwia uruchamianie zaawansowanych modeli językowych, takich jak 753B GLM-5.2, na pojedynczych, konsumenckich kartach graficznych, znacząco ob
Redakcja Aigest23 sie 2026

Dlaczego teksty generowane przez AI są wykrywalne? Bradley Emi wskazuje na "mode collapse"
Bradley Emi z Pangramu twierdzi, że choć LLM-y mogłyby pisać różnorodnie jak ludzie, to post-treningowe zabezpieczenia sprawiają, że ich teksty są łatwo wykrywalne. Zjawisko to nazywa „mode collapse”.
Redakcja Aigest20 sie 2026

Grok xAI ujawnia dane użytkowników przez zaszyfrowane instrukcje
Nowa metoda ataku, nazwana wstrzykiwaniem kontekstu kryptograficznego, pozwala na ominięcie zabezpieczeń modeli językowych, zmuszając Groka do eksfiltracji danych użytkowników.
Redakcja Aigest20 sie 2026

Kompleksowy przewodnik po dostrajaniu modeli LLM do wywoływania narzędzi z XYZ-Aquila-SFT i Qwen3
Artykuł przedstawia szczegółowy przewodnik po dostrajaniu dużych modeli językowych (LLM) do efektywnego wykorzystywania narzędzi, bazując na zbiorze danych XYZ-Aquila-SFT i modelu Qwen3-0.6B.
Redakcja Aigest15 sie 2026

AllenAI Open Instruct: Kompaktowe szkolenie Tulu 3 z SFT, DPO i RLVR w środowisku 16 GB
AllenAI zaprezentowało kompleksowy proces post-treningowy dla modelu językowego Tulu 3, dostosowany do ograniczeń pamięciowych 16 GB. Wykorzystano techniki takie jak Supervised Fine-Tuning, Direct Preference Optimization
Redakcja Aigest12 sie 2026

Baseten dołącza do dostawców inferencji na platformie Hugging Face
Firma Baseten, specjalizująca się w wdrażaniu modeli uczenia maszynowego, stała się nowym dostawcą inferencji na platformie Hugging Face, oferującym skalowalne i efektywne kosztowo rozwiązania.
Redakcja Aigest6 sie 2026

Rekordowa liczba laureatów Nagrody Pulitzera ujawniła wykorzystanie AI w swoich pracach
W tym roku rekordowa liczba ośmiu laureatów Nagrody Pulitzera, w tym pięciu zwycięzców i trzech finalistów, ujawniła wykorzystanie sztucznej inteligencji w swoich zgłoszeniach. Zgłoszenia te, wymagane od 2024 roku, pokaz
Redakcja Aigest4 sie 2026

JetBrains udostępnia KotlinLLM: inteligentne makra generujące kod Kotlin w czasie rzeczywistym
JetBrains Research udostępniło KotlinLLM, wtyczkę do IntelliJ IDEA, która wprowadza inteligentne makra generujące i dynamicznie przeładowujące kod Kotlin w czasie działania aplikacji.
Redakcja Aigest31 lip 2026

Fundamentalna wada sprawia, że duże modele językowe (LLM) są niezwykle podatne na ataki
Badacze odkryli fundamentalną wadę w sposobie działania dużych modeli językowych (LLM), która czyni je podatnymi na ataki. Problem dotyczy identyfikacji źródła instrukcji, co pozwala na manipulowanie modelami w celu uzys
Redakcja Aigest30 lip 2026
Indeks Hype'u AI: Nieseksowna strona sztucznej inteligencji
MIT Technology Review przedstawia subiektywną analizę najnowszych trendów w AI, wskazując na mniej efektowne, lecz istotne aspekty tej technologii.
Redakcja Aigest29 lip 2026


Sztuczna inteligencja wykazuje większą skłonność do uprzedzeń w rekrutacji niż ludzie
Nowe badania wskazują, że duże modele językowe (LLM) mogą nie tylko przyswajać ludzkie uprzedzenia z danych treningowych, ale także rozwijać własne, stereotypizując kandydatów do pracy w większym stopniu niż ludzie.
Redakcja Aigest20 lip 2026

Rosja „groomuje" sztuczną inteligencję. Miliony fałszywych artykułów mają nauczyć chatboty kłamać
Sieć Pravda publikuje miliony tekstów w dziesiątkach języków nie dla ludzi, lecz dla crawlerów trenujących modele AI. Wyjaśniam, jak technicznie działa zatruwanie modeli — i dlaczego polski internet jest na nie szczególnie podatny.
Michał Chmielarz18 lip 2026

NSA punktuje trzy zmyślone wyroki w piśmie pełnomocnika. „Nader krytycznie" o bezrefleksyjnym używaniu AI
Pełnomocnik powołał się przed NSA na trzy orzeczenia, które nigdy nie zapadły — wygenerowała je sztuczna inteligencja. Sąd oddalił zażalenie i wysłał prawnikom ostrzeżenie, które powinien przeczytać każdy, kto używa AI w pracy.
Michał Chmielarz18 lip 2026

OpenAI stworzyło GPT-Red – super-hakera AI do zwiększania bezpieczeństwa swoich modeli
OpenAI opracowało GPT-Red, model językowy pełniący rolę 'super-hakera', którego zadaniem jest znajdowanie luk w zabezpieczeniach innych modeli LLM firmy. Dzięki temu najnowsza wersja GPT-5.6 jest uznawana za najbardziej
Redakcja Aigest15 lip 2026

„Context bombing”: Nowa technika obrony przed atakami na AI wykorzystuje iniekcje promptów
Badacze z Tracebit opracowali nowatorską metodę obrony przed złośliwymi atakami na modele językowe, wykorzystując techniki iniekcji promptów do wyłączania wrogich agentów AI.
Redakcja Aigest13 lip 2026

Anthropic odkrywa ukrytą przestrzeń myślową w modelu Claude Opus 4.6
Anthropic, firma zajmująca się sztuczną inteligencją, opracowała technikę, która pozwoliła jej zajrzeć w wewnętrzne procesy dużych modeli językowych (LLM), odkrywając tzw. J-space w modelu Claude Opus 4.6.
Redakcja Aigest9 lip 2026
vLLM wprowadza natywną obsługę Transformers, przyspieszając wnioskowanie AI
Projekt vLLM ogłosił natywną integrację z biblioteką Transformers, co ma znacząco przyspieszyć proces wnioskowania dla dużych modeli językowych. Nowe rozwiązanie ma oferować do 2,5 razy większą przepustowość w porównaniu
Redakcja Aigest8 lip 2026