xAI Elona Muska wprowadza Groka 4.7: niższe ceny, ale słabsze wyniki w benchmarkach
xAI Elona Muska zaprezentowało Groka 4.7, swój najnowszy model AI do kodowania i pracy umysłowej. Chociaż oferuje konkurencyjne ceny, niezależne testy wskazują na znaczną lukę wydajnościową w porównaniu do liderów rynku,

xAI, firma Elona Muska, zaprezentowała Groka 4.7, swój najnowszy i najbardziej zaawansowany model sztucznej inteligencji, przeznaczony do zadań związanych z kodowaniem i pracą umysłową. Według twórców, model ten został zbudowany na większej bazie, przeszedł dłuższe szkolenie z wykorzystaniem uczenia wzmacniającego i jest zaprojektowany tak, aby lepiej weryfikować własne wyniki.
Konkurencyjne ceny Groka 4.7
Ceny za korzystanie z Groka 4.7 zostały ustalone na 2 dolary za milion tokenów wejściowych oraz 6 dolarów za milion tokenów wyjściowych. Takie stawki plasują Groka 4.7 bliżej modeli chińskich niż wiodących modeli zachodnich, co może sugerować strategię cenową mającą na celu zdobycie udziału w rynku. Dostępność modelu jest zapewniona poprzez Grok API, platformę Cursor oraz Grok Build.
Wyniki w benchmarkach: luka wydajnościowa
Pomimo zaawansowanych funkcji i konkurencyjnych cen, niezależne testy wydajności ujawniają znaczną różnicę między Grokiem 4.7 a czołowymi modelami na rynku. W Artificial Analysis Intelligence Index (wersja 4.3.2), który agreguje dziesięć różnych benchmarków, Grok 4.7 uzyskał wynik 46 punktów, plasując się w środku stawki. Dla porównania, Claude Fable 5.1 i GPT-6 osiągnęły po 53 punkty, co świadczy o ich wyraźnej przewadze.
Luka ta staje się jeszcze bardziej widoczna w testach kodowania agentowego. Na platformie Terminal-Bench 4.0, Grok 4.7 osiągnął zaledwie 26 procent skuteczności. W tym samym teście, GPT-6 Astra uzyskał 60 procent, a Claude Fable 5.1 – 55 procent. Nawet tańszy model DeepSeek V4.1 Flash zdołał wyprzedzić Groka 4.7, osiągając 27 procent.
Co to oznacza dla rynku AI
Wprowadzenie Groka 4.7 przez xAI, z jego agresywną polityką cenową, może wpłynąć na dynamikę rynku sztucznej inteligencji, zwłaszcza w segmencie modeli dostępnych dla deweloperów i firm. Chociaż niższe koszty mogą przyciągnąć użytkowników, którzy szukają bardziej ekonomicznych rozwiązań, wyniki benchmarków jasno wskazują, że Grok 4.7 ma jeszcze drogę do przebycia, aby dorównać wydajnością liderom takim jak Claude i GPT-6. Rynek AI staje się coraz bardziej konkurencyjny, a równowaga między ceną a wydajnością będzie kluczowa dla sukcesu nowych graczy.
Źródło: the-decoder.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

Panel ONZ ostrzega: Nie ma pewności, że ludzie utrzymają kontrolę nad agentami AI
Pierwszy raport panelu naukowego ONZ ds. AI alarmuje, że kontrola nad autonomicznymi agentami sztucznej inteligencji nie jest gwarantowana, wskazując na rosnące ryzyko związane z ich szkoleniem i zachowaniem.
Redakcja Aigest2 godz. temu

SoftBank pozyskuje ponad 11 miliardów dolarów z ryzykownych obligacji na inwestycję w OpenAI
SoftBank planuje zaciągnąć ponad 11 miliardów dolarów długu poprzez wysoko oprocentowane obligacje, aby sfinansować kolejną transzę płatności za udziały w OpenAI.
Redakcja Aigest5 godz. temu

Jak medycyna może nauczyć AI niezawodności? Badacze z Bristolu proponują ramy testowania
Naukowcy z Uniwersytetu w Bristolu opracowali ramy testowania niezawodności systemów AI w medycynie, wzorując się na procesach wprowadzania nowych leków na rynek.
Redakcja Aigest5 godz. temu

Alibaba staje się liderem otwartej AI, wyznaczając nowe standardy rynkowe
Alibaba konsekwentnie umacnia swoją pozycję w sektorze otwartej AI, prezentując szereg innowacyjnych modeli, które mogą zrewolucjonizować rynek i zaoferować realną alternatywę dla zamkniętych systemów.
Michał Chmielarz12 godz. temu
StepFun prezentuje Step 5 Preview: Model MoE z 600B parametrami i kontekstem 1M tokenów
Firma StepFun udostępniła Step 5 Preview, model Mixture-of-Experts (MoE) zaprojektowany do złożonych zadań agentowych, obsługujący kontekst do miliona tokenów.
Redakcja Aigest13 godz. temu

Alibaba prezentuje Qwen-Image-2.1: otwarty model AI do generowania i edycji obrazów
Zespół Qwen AI firmy Alibaba udostępnił Qwen-Image-2.1, otwarty model do generowania i edycji obrazów, który ma konkurować z zamkniętymi systemami.
Redakcja Aigestwczoraj
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.