Meta Muse Spark 1.1 wyprzedza GLM 5.2 w kodowaniu i jest tańszy
Nowy model Meta Muse Spark 1.1 osiąga lepsze wyniki w zadaniach związanych z kodowaniem niż GLM 5.2, jednocześnie oferując niższą cenę. Model odnotował znaczący wzrost wydajności w ciągu ostatnich trzech miesięcy.

Nowy model Muse Spark 1.1 firmy Meta wyprzedza GLM 5.2 w zadaniach związanych z kodowaniem, oferując jednocześnie niższą cenę. Według analizy przeprowadzonej przez Artificial Analysis, model Meta uzyskał 51 punktów w Intelligence Index, dorównując GLM 5.2, GPT-5.4 oraz GPT-5.6 Luna.
Znaczący wzrost wydajności i efektywności
W ciągu zaledwie trzech miesięcy Muse Spark 1.1 zyskał osiem punktów w ogólnym indeksie, głównie dzięki poprawie w obszarach kodowania i pracy opartej na agentach. W Coding Index model osiągnął wynik 71.3, co plasuje go przed GLM 5.2 (68.8) i nieznacznie za GPT-5.6 Luna (71.4). Czołowe miejsca w tej kategorii zajmują GPT-5.6 Sol (77.4) i Terra (76.7), a tuż za nimi plasuje się Claude Fable 5 (76.5). Należy jednak pamiętać, że wyniki benchmarków nie zawsze odzwierciedlają rzeczywistą wydajność w praktycznych zastosowaniach.
Koszty i redukcja halucynacji
Jednym z kluczowych atutów Muse Spark 1.1 jest jego ekonomiczność. Szacowany koszt wykonania zadania wynosi 0.26 dolara, co stanowi znaczną różnicę w porównaniu do 0.37 dolara dla GLM-5.2 i 0.89 dolara dla GPT-5.4. Model Meta wykorzystuje również mniej tokenów wyjściowych – 94 miliony w porównaniu do 141 milionów w przypadku GLM-5.2.
Dodatkowo, wskaźnik halucynacji, czyli generowania błędnych lub zmyślonych informacji, spadł z 73 do 38 procent. Oznacza to, że model częściej odmawia odpowiedzi, niż udziela nieprawidłowych. Meta zwiększyła również okno kontekstowe czterokrotnie, do miliona tokenów, co pozwala na przetwarzanie znacznie dłuższych sekwencji danych. W momencie premiery Muse Spark 1.1 jest dostępny wyłącznie za pośrednictwem własnego API Meta.
Kontekst rynkowy i przyszłość modeli AI
Rozwój Muse Spark 1.1 podkreśla rosnącą konkurencję na rynku modeli językowych, gdzie firmy dążą do optymalizacji zarówno wydajności, jak i kosztów. Udoskonalenia w zakresie kodowania i redukcji halucynacji, w połączeniu z konkurencyjną ceną, mogą sprawić, że model Meta stanie się atrakcyjną opcją dla deweloperów i przedsiębiorstw poszukujących efektywnych narzędzi AI. Warto obserwować, jak te innowacje wpłyną na dalszy rozwój i zastosowania sztucznej inteligencji w różnych sektorach.
Źródło: the-decoder.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej


Chiny doganiają Zachód w AI: Co pozostało z przewagi technologicznej?
Chińskie modele AI, takie jak Kimi K3 i GLM-5.3, osiągają poziom porównywalny z najlepszymi modelami amerykańskimi, co podważa dotychczasową przewagę Zachodu i zmusza firmy do redefiniowania strategii.
Redakcja Aigest5 dni temu

Meta wyświetlała reklamy aplikacji do tworzenia deepfake'ów z polityczkami
Meta wyświetlała reklamy aplikacji Kromix, która umożliwiała tworzenie pornograficznych deepfake'ów z wizerunkami kobiet, w tym polityczek, pomimo własnych zasad dotyczących treści seksualnych.
Redakcja Aigest6 dni temu

Liquid AI wprowadza LFM2.5 Q4_0: Nowy standard kwantyzacji modeli językowych
Liquid AI ogłosiło wydanie LFM2.5 Q4_0, przełomowego rozwiązania w dziedzinie kwantyzacji modeli językowych, które ma na celu zwiększenie efektywności i dostępności AI.
Redakcja Aigest6 dni temu
Gradio wprowadza Workflows: Nowe narzędzie do tworzenia złożonych aplikacji AI
Hugging Face ogłasza premierę Gradio Workflows, innowacyjnego narzędzia do wizualnego łączenia modeli AI i logiki, ułatwiającego tworzenie zaawansowanych aplikacji.
Redakcja Aigest18 godz. temu

Badanie Stanford: AI najmocniej uderza w stanowiska dla początkujących pracowników
Nowe badania ekonomistów z Uniwersytetu Stanforda wskazują, że sztuczna inteligencja przyczynia się do znaczących strat miejsc pracy dla młodych pracowników na stanowiskach początkujących, podczas gdy starsi pracownicy p
Redakcja Aigest20 godz. temu
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.