2,4 biliona parametrów i architektura MoE
Nowy model Alibaby reprezentuje potężny skok wydajnościowy. Z rozmiarem 2,4 biliona parametrów Qwen3.8-Max plasuje się tuż za rekordowym modelem Kimi K3 stworzonym przez firmę Moonshot AI (2,8 biliona parametrów).
Sam rozmiar to jednak nie wszystko – kluczem do efektywności ekonomicznej nowego systemu jest zastosowanie architektury Mixture-of-Experts (MoE). Dzięki niej, mimo ogromnej skali całkowitej, przy pojedynczym zapytaniu aktywowanych jest jedynie około 95 miliardów parametrów. Takie podejście znacząco obniża koszty obliczeniowe oraz drastycznie skraca czas odpowiedzi.
Kluczowe właściwości Qwen3.8-Max:
-
Natywna multimodalność: Model sprawnie przetwarza nie tylko tekst, ale również materiały wizualne (obrazy oraz wideo).
-
Potężne okno kontekstowe: Możliwość analizy do 1 miliona tokenów w jednym zapytaniu umożliwia przetwarzanie obszernych baz kodu źródłowego, wielostronicowych dokumentów czy długich nagrań.
-
Autonomia w programowaniu: Według deklaracji producenta, model pomyślnie ukończył złożony projekt programistyczny w ramach 16-dniowego autonomicznego cyklu pracy.
Lider w Chinach, drugi na świecie w analizie obrazu
Premiera modelu na platformie porównawczej Arena.AI przyniosła konkretne dowody na jego możliwości:
-
Modele tekstowe: Qwen3.8-Max zajął pierwsze miejsce wśród wszystkich chińskich modeli językowych. Ustępuje jedynie czołowym zamkniętym rozwiązaniom z serii Claude Fable 5 i Claude Opus firmy Anthropic.
-
Analiza obrazu i wideo: W rankingu multimodalnym model Alibaby uplasował się na drugim miejscu na świecie, ulegając wyłącznie wariantowi Claude Fable 5.
Ogłoszenie nowego modelu wywołało pozytywną reakcję inwestorów i wzrost akcji Alibaba Group. Pokazuje to również szerszy trend na chińskim rynku technologicznym:
Podczas gdy amerykańscy giganci, tacy jak OpenAI, Google czy Anthropic, chronią szczegóły architektury i parametry swoich flagowych modeli, chińskie firmy – w tym Alibaba i DeepSeek – stawiają na model open-weight. Udostępnianie wag modeli programistom na całym świecie pozwala na szybkie budowanie ekosystemu wokół chmury Alibaba Cloud.
Równolegle na rynku trwa zacięta walka cenowa. Ogłoszenie Qwen3.8-Max zbiegło się w czasie z informacjami o ultratanim modelu V4-Flash od firmy DeepSeek, co wywiera ogromną presję na zachodnich dostawców płatnych interfejsów API. Model Qwen3.8-Max ma zostać udostępniony komercyjnie dla twórców i przedsiębiorstw za pośrednictwem platformy Model Studio w chmurze Alibaba Cloud.