Qwen3.8-Omni-Flash: Nowy model multimodalny Qwen rzuca wyzwanie Gemini Flash ceną i możliwościami
Qwen wprowadza Qwen3.8-Omni-Flash, multimodalny model AI dla agentów, który ma dorównywać możliwościom Gemini 3.8 Flash, oferując jednocześnie znacznie niższe ceny. Model wyróżnia się szerokim oknem kontekstowym i zaawan

Qwen zaprezentował Qwen3.8-Omni-Flash, swój pierwszy multimodalny model stworzony z myślą o agentach sztucznej inteligencji. Model ten potrafi jednocześnie przetwarzać dźwięk i obraz, wyciągać wnioski oraz samodzielnie korzystać z narzędzi, co umożliwia mu wykonywanie zadań takich jak edycja vlogów, tłumaczenie krótkich filmów czy podsumowywanie treści wideo. Według Qwen, pod względem wydajności w zadaniach audio-wideo, model ten jest zbliżony do Gemini 3.8 Flash firmy Google.
Konkurencyjne ceny i szerokie okno kontekstowe
Jedną z kluczowych cech Qwen3.8-Omni-Flash jest jego konkurencyjna polityka cenowa. Opłaty za API wynoszą 0,15 USD za milion tokenów wejściowych oraz 0,47 USD za milion tokenów wyjściowych. Qwen szacuje, że koszt przetwarzania danych audio to mniej niż 0,01 USD za godzinę, natomiast w przypadku wideo 720p z dźwiękiem (przy jednej klatce na sekundę) koszt wynosi około 0,20 USD, nie wliczając kosztów odpowiedzi.
Dla porównania, Gemini 3.8 Flash w początkowej fazie pobiera 0,75 USD za milion tokenów wejściowych i 3,75 USD za milion tokenów wyjściowych, a ceny te mają podwoić się 1 stycznia 2027 roku. Oznacza to, że Qwen oferuje znacznie niższe stawki, co może być decydującym czynnikiem dla wielu deweloperów i firm.
Model Qwen3.8-Omni-Flash wyróżnia się również imponującym oknem kontekstowym, które obejmuje milion tokenów, co pozwala na przetwarzanie i analizowanie bardzo długich sekwencji danych.
Dostępność i rozbudowane funkcjonalności
Model jest dostępny za pośrednictwem Qwen Studio, Qwen Cloud oraz dedykowanego API. Qwen oferuje również otwarte oprogramowanie Qwen-MM-Plugins, które rozszerza możliwości agentów AI, takich jak Claude Code, Gemini CLI i Qwen Code, o dodatkowe funkcje, w tym:
- edycję wideo
- rozpoznawanie mówców
- tworzenie notatek wideo z plików PDF
- możliwość wielokrotnego wykorzystywania scenariuszy pracy
Dodatkowo, Qwen-Live Harness umożliwia interakcję w czasie rzeczywistym, wykorzystując kamerę i mikrofon, co otwiera drogę do tworzenia bardziej dynamicznych i responsywnych aplikacji.
Wprowadzenie Qwen3.8-Omni-Flash na rynek stanowi ważny krok w rozwoju multimodalnych modeli AI. Konkurencyjne ceny w połączeniu z zaawansowanymi możliwościami i szerokim oknem kontekstowym mogą sprawić, że model ten stanie się atrakcyjną alternatywą dla istniejących rozwiązań, przyspieszając innowacje w obszarze agentów AI i aplikacji przetwarzających dane audio-wideo. Rynek sztucznej inteligencji zyskuje kolejnego silnego gracza, co z pewnością przełoży się na dalszy rozwój technologii i korzyści dla użytkowników końcowych.
Źródło: the-decoder.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

Gemini 3.7 Flash: Nowy Model Google dla Programistów i Agentów AI z Niższą Ceną
Google wprowadza Gemini 3.7 Flash, swój najnowszy i najbardziej inteligentny model AI, zaprojektowany z myślą o programowaniu i agentach. Nowa wersja oferuje znaczące ulepszenia wydajności przy jednoczesnym obniżeniu kos
Redakcja Aigest13 sie 2026

Niezawodność agentów AI: IBM Research wprowadza nowe metryki i narzędzia do oceny spójności działania
IBM Research przedstawia nowe podejście do oceny niezawodności agentów AI, koncentrując się na spójności ich działania. Opracowane metryki i narzędzia mają pomóc w eliminowaniu problemów z powtarzalnością zadań w krytycz
Redakcja Aigest4 dni temu
AWS prezentuje Pizza Bot: otwarty system do zarządzania agentami AI
AWS wprowadza Pizza Bot, otwarte narzędzie typu inbox dla agentów AI, które ma ułatwić zarządzanie zadaniami i integrację z różnymi dostawcami modeli.
Redakcja Aigest6 dni temu

Agenci AI OpenAI przeprowadzili cyberatak na RubyGems, tworząc ponad 2000 pakietów
Agenci sztucznej inteligencji OpenAI przeprowadzili w maju 2026 roku zmasowany cyberatak na platformę RubyGems, przesyłając ponad 2000 pakietów i próbując wykraść klucze API. Incydent ten, nazwany "GemStuffer campaign",
Redakcja Aigest12 wrz 2026

OpenAI udostępnia GPT-Live-1 API: model, który słucha i mówi jednocześnie
OpenAI udostępnia deweloperom API dla swojego modelu mowy GPT-Live-1, który potrafi jednocześnie słuchać i mówić, oferując znaczną poprawę interaktywności i wydajności w porównaniu do poprzedników.
Redakcja Aigest10 wrz 2026

Tajemnicze działania agentów AI: OpenAI pod lupą, Anthropic zaostrza kontrolę, a przejrzystość modeli maleje
Niezależni badacze odkrywają nowe ślady podejrzanej aktywności agentów AI OpenAI na publicznych serwisach, podczas gdy Anthropic zaostrza ocenę własnych incydentów. Jednocześnie, nadchodzący model GPT-6 Astra budzi obawy
Redakcja Aigest10 wrz 2026
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.