Meta Muse Spark 1.1 wyprzedza GLM 5.2 w kodowaniu i jest tańszy
Nowy model Meta Muse Spark 1.1 osiąga lepsze wyniki w zadaniach związanych z kodowaniem niż GLM 5.2, jednocześnie oferując niższą cenę. Model odnotował znaczący wzrost wydajności w ciągu ostatnich trzech miesięcy.

Nowy model Muse Spark 1.1 firmy Meta wyprzedza GLM 5.2 w zadaniach związanych z kodowaniem, oferując jednocześnie niższą cenę. Według analizy przeprowadzonej przez Artificial Analysis, model Meta uzyskał 51 punktów w Intelligence Index, dorównując GLM 5.2, GPT-5.4 oraz GPT-5.6 Luna.
Znaczący wzrost wydajności i efektywności
W ciągu zaledwie trzech miesięcy Muse Spark 1.1 zyskał osiem punktów w ogólnym indeksie, głównie dzięki poprawie w obszarach kodowania i pracy opartej na agentach. W Coding Index model osiągnął wynik 71.3, co plasuje go przed GLM 5.2 (68.8) i nieznacznie za GPT-5.6 Luna (71.4). Czołowe miejsca w tej kategorii zajmują GPT-5.6 Sol (77.4) i Terra (76.7), a tuż za nimi plasuje się Claude Fable 5 (76.5). Należy jednak pamiętać, że wyniki benchmarków nie zawsze odzwierciedlają rzeczywistą wydajność w praktycznych zastosowaniach.
Koszty i redukcja halucynacji
Jednym z kluczowych atutów Muse Spark 1.1 jest jego ekonomiczność. Szacowany koszt wykonania zadania wynosi 0.26 dolara, co stanowi znaczną różnicę w porównaniu do 0.37 dolara dla GLM-5.2 i 0.89 dolara dla GPT-5.4. Model Meta wykorzystuje również mniej tokenów wyjściowych – 94 miliony w porównaniu do 141 milionów w przypadku GLM-5.2.
Dodatkowo, wskaźnik halucynacji, czyli generowania błędnych lub zmyślonych informacji, spadł z 73 do 38 procent. Oznacza to, że model częściej odmawia odpowiedzi, niż udziela nieprawidłowych. Meta zwiększyła również okno kontekstowe czterokrotnie, do miliona tokenów, co pozwala na przetwarzanie znacznie dłuższych sekwencji danych. W momencie premiery Muse Spark 1.1 jest dostępny wyłącznie za pośrednictwem własnego API Meta.
Kontekst rynkowy i przyszłość modeli AI
Rozwój Muse Spark 1.1 podkreśla rosnącą konkurencję na rynku modeli językowych, gdzie firmy dążą do optymalizacji zarówno wydajności, jak i kosztów. Udoskonalenia w zakresie kodowania i redukcji halucynacji, w połączeniu z konkurencyjną ceną, mogą sprawić, że model Meta stanie się atrakcyjną opcją dla deweloperów i przedsiębiorstw poszukujących efektywnych narzędzi AI. Warto obserwować, jak te innowacje wpłyną na dalszy rozwój i zastosowania sztucznej inteligencji w różnych sektorach.
Źródło: the-decoder.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

IBM udostępnia modele Granite 4.2 z funkcjami agentowymi oraz Granite Speech 5.0 Turbo CTC
IBM wprowadza na rynek nową rodzinę modeli językowych Granite 4.2 oraz modele mowy Granite Speech 5.0 Turbo CTC, dostępne na licencji Apache 2.0.
Redakcja Aigest5 godz. temu


Chiny doganiają Zachód w AI: Co pozostało z przewagi technologicznej?
Chińskie modele AI, takie jak Kimi K3 i GLM-5.3, osiągają poziom porównywalny z najlepszymi modelami amerykańskimi, co podważa dotychczasową przewagę Zachodu i zmusza firmy do redefiniowania strategii.
Redakcja Aigest6 dni temu

Meta wyświetlała reklamy aplikacji do tworzenia deepfake'ów z polityczkami
Meta wyświetlała reklamy aplikacji Kromix, która umożliwiała tworzenie pornograficznych deepfake'ów z wizerunkami kobiet, w tym polityczek, pomimo własnych zasad dotyczących treści seksualnych.
Redakcja Aigest19 sie 2026

Liquid AI wprowadza LFM2.5 Q4_0: Nowy standard kwantyzacji modeli językowych
Liquid AI ogłosiło wydanie LFM2.5 Q4_0, przełomowego rozwiązania w dziedzinie kwantyzacji modeli językowych, które ma na celu zwiększenie efektywności i dostępności AI.
Redakcja Aigest19 sie 2026

IBM prezentuje Granite 4.2: Nowe modele językowe z zaawansowanym rozumowaniem i uczeniem agentowym
IBM wprowadza na rynek Granite 4.2 – rodzinę otwartych modeli językowych o rozmiarach 3B, 8B i 30B parametrów, skupionych na zdolnościach rozumowania i uczeniu agentowym.
Redakcja Aigest10 godz. temu
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.