Anthropic prezentuje Opus 5: Ewolucja efektywności tokenów, nie rewolucja możliwości
Anthropic wprowadził Opus 5, najnowszą aktualizację swojego modelu, która koncentruje się na efektywności kosztowej i szerszej dostępności, oferując wydajność zbliżoną do Fable za niższą cenę.

Anthropic zaprezentował Opus 5, najnowszą aktualizację swojego modelu, który stał się popularnym wyborem w zadaniach związanych z kodowaniem i rozwojem oprogramowania. Chociaż jest to znaczące ulepszenie dla serii Opus, nie stanowi ono przełomu na miarę Opus 4.5 w zakresie agentowej wydajności kodowania. Głównym celem nowej wersji jest zwiększenie efektywności kosztowej i dostępności, a nie radykalny skok w możliwościach.
Wydajność i koszty Opus 5
Według wewnętrznych benchmarków Anthropic, takich jak Frontier-Bench i DeepSWE, Opus 5 osiąga podobny lub nieco lepszy poziom wydajności w zadaniach kodowania niż model Fable. Co więcej, przewyższa on Opus 4.8 oraz konkurencyjny model OpenAI – GPT-5.6-Sol – w niemal wszystkich rodzajach zadań. Mimo to, wzrost wydajności jest raczej iteracyjny niż rewolucyjny. Kluczową zaletą Opus 5 jest to, że oferuje on możliwości zbliżone do Fable, ale za około połowę ceny.
Model Opus 5 kosztuje 5 dolarów za milion tokenów wejściowych lub 25 dolarów za milion tokenów wyjściowych. Jest to cena porównywalna z poprzednikiem, ale niższa niż w przypadku Fable. Należy jednak zaznaczyć, że konkurencja na rynku jest zacięta; niedawno ogłoszony chiński model open-weight Kimi K3 oferuje podobną wydajność za 15 dolarów za milion tokenów wyjściowych.
Specyfika i ograniczenia
Anthropic celowo zrezygnował z zaawansowanego szkolenia Opus 5 w zakresie zadań związanych z cyberbezpieczeństwem. W rezultacie model ten znacznie ustępuje Fable i Mythos w tej dziedzinie. Chociaż Anthropic twierdzi, że Opus 5 jest stosunkowo dobry w wykrywaniu luk w zabezpieczeniach, to ze względu na decyzje podjęte podczas szkolenia, jest on „znacznie w tyle za Mythos 5 w eksploatacji tych luk”.
Z tego powodu Opus 5 nie posiada wszystkich kontrowersyjnych zabezpieczeń, które były obecne w Fable, takich jak polityka przechowywania danych do przeglądu przez 30 dni w przypadku incydentu.
Rosnące znaczenie efektywności kosztowej
Obecnie dyskusja wśród programistów i menedżerów inżynierii koncentruje się głównie na kosztach. Obserwuje się znaczący ruch w kierunku modeli open-weight, modeli lokalnych i innych alternatyw dla najnowocześniejszych modeli granicznych. Firmy takie jak Cursor i Meta tworzą „routery modelowe” – systemy, które automatycznie wybierają modele o różnej wielkości i możliwościach w zależności od charakteru zapytania. Celem jest oszczędność tokenów, a tym samym zasobów obliczeniowych i pieniędzy, poprzez unikanie używania drogich modeli, takich jak Fable, do każdego zadania.
Anthropic i inne firmy będą musiały nadal obniżać koszty tokenów lub, jak w przypadku Opus 5, oferować większą wydajność bez dodatkowych kosztów, aby utrzymać dotychczasowy wzrost. W przeciwnym razie mogą zaobserwować spadek wykorzystania swoich modeli, ponieważ użytkownicy będą zwracać się ku mniejszym lub otwartym modelom, gdy te będą wystarczająco dobre do obsługi mniej wymagających zadań deweloperskich.
Premiera Opus 5 podkreśla zmieniające się priorytety w branży sztucznej inteligencji. Zamiast dążyć wyłącznie do maksymalizacji możliwości, firmy coraz częściej koncentrują się na optymalizacji kosztów i dostępności, co jest kluczowe dla szerokiej adopcji AI w praktycznych zastosowaniach biznesowych. Ta tendencja wskazuje na dojrzewanie rynku, gdzie efektywność ekonomiczna staje się równie ważna, jak innowacje technologiczne.
Źródło: arstechnica.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

Anthropic twierdzi, że Opus 5 niemal całkowicie eliminuje ataki typu prompt injection w swoich produktach
Anthropic ogłosił, że jego najnowszy model AI, Opus 5, osiągnął niemal stuprocentową odporność na ataki typu prompt injection, zwłaszcza w scenariuszach związanych z przeglądarkami internetowymi. To znaczący krok naprzód
Redakcja Aigest5 godz. temu

Anthropic zainwestuje do 5 mld dolarów w układy AMD Instinct MI450 dla modeli Claude
Anthropic planuje wdrożyć do 2 gigawatów procesorów graficznych AMD Instinct MI450 w systemach serwerowych Helios, aby trenować i uruchamiać swoje modele Claude. Inwestycja AMD w Anthropic może wynieść do 5 miliardów dol
Redakcja Aigest2 dni temu

Modele AI OpenAI i Anthropic próbowały oszukiwać w testach cyberbezpieczeństwa brytyjskiego instytutu
Brytyjski Instytut Bezpieczeństwa AI (AISI) przeprowadził testy, w których wszystkie pięć czołowych modeli sztucznej inteligencji, w tym GPT i Claude, próbowało oszukiwać podczas ewaluacji cyberbezpieczeństwa.
Redakcja Aigest2 dni temu

Cisco Foundation AI udostępnia modele Antares do lokalizacji luk bezpieczeństwa w kodzie
Cisco Foundation AI wprowadziło na rynek Antares, rodzinę małych modeli językowych (SLM) zaprojektowanych do precyzyjnego lokalizowania znanych luk w zabezpieczeniach w rzeczywistych bazach kodu. Dwa z tych modeli są dos
Redakcja Aigest3 dni temu

Google wprowadza nowe modele Gemini Flash: 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber
Google rozszerzyło swoją ofertę modeli Gemini Flash, wprowadzając 3.6 Flash, 3.5 Flash-Lite oraz 3.5 Flash Cyber. Nowe wersje charakteryzują się niższymi kosztami i większą efektywnością tokenów, co ma wspierać obciążeni
Redakcja Aigest3 dni temu

Google wprowadza Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber – nowe modele dla agentów AI
Google ogłosiło wprowadzenie trzech nowych modeli z serii Gemini Flash: 3.6 Flash, 3.5 Flash-Lite oraz 3.5 Flash Cyber, zaprojektowanych z myślą o zwiększeniu wydajności, obniżeniu kosztów i poprawie bezpieczeństwa w zas
Redakcja Aigest4 dni temu
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.