Aigest.
Newsy

xAI Elona Muska wprowadza Groka 4.7: niższe ceny, ale słabsze wyniki w benchmarkach

xAI Elona Muska zaprezentowało Groka 4.7, swój najnowszy model AI do kodowania i pracy umysłowej. Chociaż oferuje konkurencyjne ceny, niezależne testy wskazują na znaczną lukę wydajnościową w porównaniu do liderów rynku,

RA

Udostępnij
xAI Elona Muska wprowadza Groka 4.7: niższe ceny, ale słabsze wyniki w benchmarkach
Fot. The Decoder

xAI, firma Elona Muska, zaprezentowała Groka 4.7, swój najnowszy i najbardziej zaawansowany model sztucznej inteligencji, przeznaczony do zadań związanych z kodowaniem i pracą umysłową. Według twórców, model ten został zbudowany na większej bazie, przeszedł dłuższe szkolenie z wykorzystaniem uczenia wzmacniającego i jest zaprojektowany tak, aby lepiej weryfikować własne wyniki.

Konkurencyjne ceny Groka 4.7

Ceny za korzystanie z Groka 4.7 zostały ustalone na 2 dolary za milion tokenów wejściowych oraz 6 dolarów za milion tokenów wyjściowych. Takie stawki plasują Groka 4.7 bliżej modeli chińskich niż wiodących modeli zachodnich, co może sugerować strategię cenową mającą na celu zdobycie udziału w rynku. Dostępność modelu jest zapewniona poprzez Grok API, platformę Cursor oraz Grok Build.

Wyniki w benchmarkach: luka wydajnościowa

Pomimo zaawansowanych funkcji i konkurencyjnych cen, niezależne testy wydajności ujawniają znaczną różnicę między Grokiem 4.7 a czołowymi modelami na rynku. W Artificial Analysis Intelligence Index (wersja 4.3.2), który agreguje dziesięć różnych benchmarków, Grok 4.7 uzyskał wynik 46 punktów, plasując się w środku stawki. Dla porównania, Claude Fable 5.1 i GPT-6 osiągnęły po 53 punkty, co świadczy o ich wyraźnej przewadze.

Luka ta staje się jeszcze bardziej widoczna w testach kodowania agentowego. Na platformie Terminal-Bench 4.0, Grok 4.7 osiągnął zaledwie 26 procent skuteczności. W tym samym teście, GPT-6 Astra uzyskał 60 procent, a Claude Fable 5.155 procent. Nawet tańszy model DeepSeek V4.1 Flash zdołał wyprzedzić Groka 4.7, osiągając 27 procent.

Co to oznacza dla rynku AI

Wprowadzenie Groka 4.7 przez xAI, z jego agresywną polityką cenową, może wpłynąć na dynamikę rynku sztucznej inteligencji, zwłaszcza w segmencie modeli dostępnych dla deweloperów i firm. Chociaż niższe koszty mogą przyciągnąć użytkowników, którzy szukają bardziej ekonomicznych rozwiązań, wyniki benchmarków jasno wskazują, że Grok 4.7 ma jeszcze drogę do przebycia, aby dorównać wydajnością liderom takim jak Claude i GPT-6. Rynek AI staje się coraz bardziej konkurencyjny, a równowaga między ceną a wydajnością będzie kluczowa dla sukcesu nowych graczy.

Źródło: the-decoder.com

Udostępnij

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

Panel ONZ ostrzega: Nie ma pewności, że ludzie utrzymają kontrolę nad agentami AI
SoftBank pozyskuje ponad 11 miliardów dolarów z ryzykownych obligacji na inwestycję w OpenAI
Newsy

SoftBank pozyskuje ponad 11 miliardów dolarów z ryzykownych obligacji na inwestycję w OpenAI

SoftBank planuje zaciągnąć ponad 11 miliardów dolarów długu poprzez wysoko oprocentowane obligacje, aby sfinansować kolejną transzę płatności za udziały w OpenAI.

Redakcja Aigest5 godz. temu

Jak medycyna może nauczyć AI niezawodności? Badacze z Bristolu proponują ramy testowania
Alibaba staje się liderem otwartej AI, wyznaczając nowe standardy rynkowe
StepFun prezentuje Step 5 Preview: Model MoE z 600B parametrami i kontekstem 1M tokenów
Alibaba prezentuje Qwen-Image-2.1: otwarty model AI do generowania i edycji obrazów

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.