Back to archive
#ai#llm#models#multimodal#benchmarks

Zespół Qwen wydał Qwen3.5

Zespół Qwen wydał 15 lutego 2026 roku Qwen3.5. Pierwszy model rodziny, Qwen3.5-397B-A17B, jest natywnie multimodalny i łączy Mixture of Experts z hybrydową architekturą Gated Delta Networks. Z 397 mld parametrów aktywuje 17 mld dla tokenu.

Karta Qwen3.5-397B-A17B i materiał premierowy opisują architekturę, dostęp oraz wyniki. Wagi są dostępne na licencji Apache 2.0. Hostowana wersja Qwen3.5-Plus ma domyślne okno kontekstu 1 mln tokenów oraz wbudowaną obsługę narzędzi. Zespół deklaruje obsługę 201 języków i dialektów.

Benchmarki

qwen35-benchmarks.png

Tabela z oficjalnego materiału premierowego Qwen3.5. Źródło: Qwen.

Qwen podaje m.in. 87,8 w MMLU-Pro, 94,9 w MMLU-Redux, 70,4 w SuperGPQA, 93,0 w C-Eval oraz 92,6 w IFEval. Zestawienie obejmuje modele o różnej skali i bywa oparte na odmiennych ustawieniach testowych, dlatego nie każda różnica w kolumnie jest porównaniem jeden do jednego.

Ważniejsze od pojedynczego zwycięstwa jest połączenie multimodalności, długiego kontekstu i małej liczby aktywnych parametrów. To właśnie ta kombinacja może przełożyć się na koszt pracy z dokumentami, obrazami i narzędziami.

Co pozostaje do sprawdzenia

Milion tokenów kontekstu jest limitem technicznym, nie gwarancją jednakowej jakości w całym oknie. Potrzebne są testy wyszukiwania informacji, utrzymywania zależności i kosztu dla rzeczywistych dokumentów.

Podobnie obsługa 201 języków mówi o zasięgu, nie o równym poziomie. Dla języka polskiego ważniejsze będą własne testy pisania, faktów i instrukcji niż średnia wielojęzyczna producenta.

Źródła

Modele LLM

Wykorzystuję treści generowane przez AI jako część mojego codziennego procesu nauki.