Alibaba prezentuje Qwen-Image-2.1: otwarty model AI do generowania i edycji obrazów
Zespół Qwen AI firmy Alibaba udostępnił Qwen-Image-2.1, otwarty model do generowania i edycji obrazów, który ma konkurować z zamkniętymi systemami.

Zespół Qwen AI firmy Alibaba zaprezentował Qwen-Image-2.1, otwarty model przeznaczony do generowania i edycji obrazów. Mimo stosunkowo niewielkiej liczby 7 miliardów parametrów, jego twórcy twierdzą, że komponent wizualny przewyższa większość zamkniętych modeli w wewnętrznych testach porównawczych Qwen, choć niezależne weryfikacje tych wyników są jeszcze w toku. Model ten jest zdolny do działania na popularnych konsumenckich kartach graficznych, takich jak NVIDIA GeForce RTX 3090.
Kluczowe możliwości i innowacje
Qwen-Image-2.1 wyróżnia się natywną zdolnością do generowania i edycji przezroczystych obrazów (RGBA). Dzięki temu użytkownicy mogą z łatwością izolować obiekty lub modyfikować tekst na przezroczystych warstwach. Model potrafi przetwarzać jednocześnie do dziesięciu obrazów referencyjnych, co jest szczególnie przydatne w zastosowaniach takich jak:
- tworzenie portretów grupowych
- wirtualne przymierzanie ubrań
- projektowanie wnętrz.
Lokalne edycje mogą być precyzyjnie kierowane za pomocą kół, masek lub malowanych oznaczeń. Zespół Qwen podkreśla, że zmiany w architekturze oraz ponowne wykorzystanie pamięci KV cache znacząco przyspieszają wnioskowanie, zwłaszcza w scenariuszach wymagających wielu obrazów referencyjnych.
Dostępność i licencjonowanie
Model Qwen-Image-2.1 jest dostępny dla społeczności na platformach takich jak Hugging Face, GitHub i Model Scope. Na Hugging Face dostępna jest również wersja demonstracyjna, umożliwiająca przetestowanie możliwości modelu. Należy jednak pamiętać, że obecna licencja badawcza zabrania komercyjnego wykorzystania modelu. Firmy i użytkownicy biznesowi zainteresowani komercyjnym zastosowaniem Qwen-Image-2.1 muszą ubiegać się o osobną licencję bezpośrednio u zespołu Qwen.
Premiera Qwen-Image-2.1 przez Alibabę stanowi istotny krok w kierunku demokratyzacji zaawansowanych narzędzi do generowania obrazów. Udostępnienie otwartego modelu o tak obiecujących możliwościach, działającego na konsumenckim sprzęcie, może przyspieszyć innowacje w dziedzinie sztucznej inteligencji wizualnej i otworzyć nowe perspektywy dla twórców i deweloperów na całym świecie. Warto będzie obserwować, jak model ten poradzi sobie w niezależnych testach i jakie zastosowania znajdzie w praktyce.
Źródło: the-decoder.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

StudentSim: Microsoft i Uniwersytet Illinois tworzą realistyczne cyfrowe repliki studentów do szkolenia korepetytorów AI
Microsoft i Uniwersytet Illinois opracowały StudentSim, system tworzący cyfrowe repliki studentów, które pomagają w szybszym i tańszym szkoleniu korepetytorów AI.
Redakcja Aigest10 godz. temu
OpenClaw 2026.9.5 wprowadza atomowe aktualizacje i rozszerza GPT Live
Firma OpenClaw zaprezentowała nową wersję swojego oprogramowania, 2026.9.5, która zawiera 4179 zmian. Kluczowe nowości to atomowe aktualizacje, dynamiczne przeładowywanie wtyczek oraz rozszerzone funkcje GPT Live.
Redakcja Aigest22 godz. temu
TypeSafe AI wprowadza Jev: model Systemu Pierwszego zwracający typowane decyzje zamiast tekstu
Firma TypeSafe AI zaprezentowała Jev, innowacyjny model sztucznej inteligencji typu System Pierwszy, który odpowiada na typowane pytania, dostarczając skalibrowane decyzje z prawdopodobieństwami, zamiast generować tekst.
Redakcja Aigestwczoraj

Petlibro Granary 2: Inteligentny podajnik karmy z AI rewolucjonizuje karmienie kotów
Firma Petlibro wprowadza na rynek serię automatycznych podajników karmy Granary 2, wyposażonych w sztuczną inteligencję i wbudowaną wagę, które mają zrewolucjonizować monitorowanie nawyków żywieniowych zwierząt, szczegól
Redakcja Aigestwczoraj

Qwen3.8-Omni-Flash: Nowy model multimodalny Qwen rzuca wyzwanie Gemini Flash ceną i możliwościami
Qwen wprowadza Qwen3.8-Omni-Flash, multimodalny model AI dla agentów, który ma dorównywać możliwościom Gemini 3.8 Flash, oferując jednocześnie znacznie niższe ceny. Model wyróżnia się szerokim oknem kontekstowym i zaawan
Redakcja Aigestwczoraj

Disney zatrudnia byłego CEO Character.AI, firmy oskarżonej o naruszenie praw autorskich
Disney mianował Karandeepa Ananda na swojego pierwszego w historii dyrektora ds. technologii, co jest zaskakującym posunięciem, biorąc pod uwagę, że Anand był wcześniej CEO startupu AI, Character.AI, który Disney oskarży
Redakcja Aigest2 dni temu
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.