Alibaba prezentuje Qwen3.8-Max, swój największy model AI

iEXExchanger
Alibaba prezentuje Qwen3.8-Max, swój największy model AI

Alibaba pokazała Qwen3.8-Max — model z 2,4 biliona parametrów i oknem kontekstu na milion tokenów. Firma twierdzi, że ustępuje tylko Claude Fable 5; akcje zyskały 7%.

Alibaba pokazała Qwen3.8-Max — swój dotąd największy model: 2,4 biliona parametrów, z czego przy każdym zapytaniu aktywuje się tylko 95 miliardów. To architektura "mieszanki ekspertów": zamiast uruchamiać cały system dla każdego zapytania, budzi tylko potrzebne bloki, więc koszt obliczeniowy nie rośnie proporcjonalnie do skali.

Model rozumie tekst, obraz i wideo, a w pamięci kontekstu mieści do miliona tokenów, czyli około 750 tysięcy słów — można mu "skarmić" całą książkę i poprosić o znalezienie jednego akapitu. Alibaba zaprojektowała go do autonomicznego programowania i długich zadań badawczych, w których model działa samodzielnie przez dziesiątki kroków.

Na platformie Arena.AI nowy model od razu został najlepszym chińskim modelem w zadaniach tekstowych i zajął drugie miejsce na świecie w zadaniach wizyjnych, ustępując tylko jednej wersji Claude Fable 5 od Anthropic. Sama Alibaba mówi wprost: model "ustępuje tylko Fable 5". To deklaracja firmy, nie niezależna weryfikacja, a w innych testach Qwen3.8-Max wypada raczej na równi z Kimi K3 od Moonshot AI niż wyraźnie lepiej.

Pełną wersję z otwartymi wagami Alibaba obiecuje za tydzień — to powrót do polityki open source po kilku zamkniętych flagowcach z rzędu. Na razie model jest dostępny przez API Model Studio i nową platformę QwenWork, która tego samego dnia weszła w publiczną wersję beta. Akcje Alibaby w Hongkongu zyskały 7%, kończąc dzień na poziomie 125,20 HK$.

Za wyścigiem chińskich laboratoriów stoi prosty motyw: dogonić amerykańskich liderów i przyciągnąć programistów darmowymi otwartymi wagami, dopóki Anthropic, OpenAI i Google trzymają swoje najlepsze modele zamknięte.

Pytania i odpowiedzi

Często zadawane pytania na temat artykułu

Czym jest Qwen3.8-Max?

To nowy flagowy model Alibaby z 2,4 biliona parametrów, z których przy każdym zapytaniu działa tylko 95 miliardów. Obsługuje tekst, obrazy i wideo z kontekstem do miliona tokenów.

Czym jest architektura „mieszanki ekspertów”?

To sposób budowy modelu, w którym na każde zapytanie uruchamiają się tylko potrzebne wyspecjalizowane bloki, a nie cała sieć. Dzięki temu model może rosnąć bez proporcjonalnego wzrostu kosztów obliczeniowych.

Czy Qwen3.8-Max naprawdę przewyższa Claude?

Alibaba twierdzi, że ustępuje tylko Claude Fable 5 od Anthropic, ale to własna ocena firmy, a nie niezależna weryfikacja. W innych testach Qwen3.8-Max wypada raczej na równi z chińskim rywalem Kimi K3.

Kiedy pojawią się otwarte wagi modelu?

Alibaba zapowiada wersję open source tydzień po ogłoszeniu. Na razie model jest dostępny tylko przez API Model Studio i platformę QwenWork, która tego samego dnia weszła w publiczną betę.