Aigest.
Biznes AI

Anthropic prezentuje Opus 5: Ewolucja efektywności tokenów, nie rewolucja możliwości

Anthropic wprowadził Opus 5, najnowszą aktualizację swojego modelu, która koncentruje się na efektywności kosztowej i szerszej dostępności, oferując wydajność zbliżoną do Fable za niższą cenę.

RA

Udostępnij
Anthropic prezentuje Opus 5: Ewolucja efektywności tokenów, nie rewolucja możliwości
Fot. Anthropic

Anthropic zaprezentował Opus 5, najnowszą aktualizację swojego modelu, który stał się popularnym wyborem w zadaniach związanych z kodowaniem i rozwojem oprogramowania. Chociaż jest to znaczące ulepszenie dla serii Opus, nie stanowi ono przełomu na miarę Opus 4.5 w zakresie agentowej wydajności kodowania. Głównym celem nowej wersji jest zwiększenie efektywności kosztowej i dostępności, a nie radykalny skok w możliwościach.

Wydajność i koszty Opus 5

Według wewnętrznych benchmarków Anthropic, takich jak Frontier-Bench i DeepSWE, Opus 5 osiąga podobny lub nieco lepszy poziom wydajności w zadaniach kodowania niż model Fable. Co więcej, przewyższa on Opus 4.8 oraz konkurencyjny model OpenAI – GPT-5.6-Sol – w niemal wszystkich rodzajach zadań. Mimo to, wzrost wydajności jest raczej iteracyjny niż rewolucyjny. Kluczową zaletą Opus 5 jest to, że oferuje on możliwości zbliżone do Fable, ale za około połowę ceny.

Model Opus 5 kosztuje 5 dolarów za milion tokenów wejściowych lub 25 dolarów za milion tokenów wyjściowych. Jest to cena porównywalna z poprzednikiem, ale niższa niż w przypadku Fable. Należy jednak zaznaczyć, że konkurencja na rynku jest zacięta; niedawno ogłoszony chiński model open-weight Kimi K3 oferuje podobną wydajność za 15 dolarów za milion tokenów wyjściowych.

Specyfika i ograniczenia

Anthropic celowo zrezygnował z zaawansowanego szkolenia Opus 5 w zakresie zadań związanych z cyberbezpieczeństwem. W rezultacie model ten znacznie ustępuje Fable i Mythos w tej dziedzinie. Chociaż Anthropic twierdzi, że Opus 5 jest stosunkowo dobry w wykrywaniu luk w zabezpieczeniach, to ze względu na decyzje podjęte podczas szkolenia, jest on „znacznie w tyle za Mythos 5 w eksploatacji tych luk”.

Z tego powodu Opus 5 nie posiada wszystkich kontrowersyjnych zabezpieczeń, które były obecne w Fable, takich jak polityka przechowywania danych do przeglądu przez 30 dni w przypadku incydentu.

Rosnące znaczenie efektywności kosztowej

Obecnie dyskusja wśród programistów i menedżerów inżynierii koncentruje się głównie na kosztach. Obserwuje się znaczący ruch w kierunku modeli open-weight, modeli lokalnych i innych alternatyw dla najnowocześniejszych modeli granicznych. Firmy takie jak Cursor i Meta tworzą „routery modelowe” – systemy, które automatycznie wybierają modele o różnej wielkości i możliwościach w zależności od charakteru zapytania. Celem jest oszczędność tokenów, a tym samym zasobów obliczeniowych i pieniędzy, poprzez unikanie używania drogich modeli, takich jak Fable, do każdego zadania.

Anthropic i inne firmy będą musiały nadal obniżać koszty tokenów lub, jak w przypadku Opus 5, oferować większą wydajność bez dodatkowych kosztów, aby utrzymać dotychczasowy wzrost. W przeciwnym razie mogą zaobserwować spadek wykorzystania swoich modeli, ponieważ użytkownicy będą zwracać się ku mniejszym lub otwartym modelom, gdy te będą wystarczająco dobre do obsługi mniej wymagających zadań deweloperskich.

Premiera Opus 5 podkreśla zmieniające się priorytety w branży sztucznej inteligencji. Zamiast dążyć wyłącznie do maksymalizacji możliwości, firmy coraz częściej koncentrują się na optymalizacji kosztów i dostępności, co jest kluczowe dla szerokiej adopcji AI w praktycznych zastosowaniach biznesowych. Ta tendencja wskazuje na dojrzewanie rynku, gdzie efektywność ekonomiczna staje się równie ważna, jak innowacje technologiczne.

Źródło: arstechnica.com

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

Anthropic twierdzi, że Opus 5 niemal całkowicie eliminuje ataki typu prompt injection w swoich produktach
Anthropic zainwestuje do 5 mld dolarów w układy AMD Instinct MI450 dla modeli Claude
Modele AI OpenAI i Anthropic próbowały oszukiwać w testach cyberbezpieczeństwa brytyjskiego instytutu
Cisco Foundation AI udostępnia modele Antares do lokalizacji luk bezpieczeństwa w kodzie
Google wprowadza nowe modele Gemini Flash: 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber
Google wprowadza Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber – nowe modele dla agentów AI

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.