Back to archive
#ai#llm#models#small-models#benchmarks

Nanbeige wydało Nanbeige4.1-3B

Nanbeige opublikowało 13 lutego 2026 roku Nanbeige4.1-3B, mały model językowy trenowany przede wszystkim z myślą o rozumowaniu i programowaniu. Nazwa i raport mówią o skali 3B, natomiast interfejs Hugging Face pokazuje około 4 mld parametrów. Tę rozbieżność warto zachować, zamiast pozornie ją rozstrzygać.

Karta Nanbeige4.1-3B zawiera wyniki, przykłady użycia i zastrzeżenia producenta. Towarzyszy jej raport techniczny.

Benchmarki

nanbeige41-benchmarks.png

Fragment tabeli z oficjalnej karty Nanbeige4.1-3B. Źródło: Nanbeige / Hugging Face.

W testach producenta model uzyskuje 76,9 w LiveCodeBench V6, wobec 66,0 dla Qwen3-30B-A3B. W zadaniach ProEasy ma 81,4 wobec 60,8, a w ProMedium 28,1 wobec 3,5.

Tak duże różnice przy małej skali są interesujące, ale wymagają niezależnego powtórzenia. Trzeba sprawdzić dokładną wersję zbioru, sposób dekodowania, liczbę prób i możliwość przenikania danych testowych do treningu. Jedna tabela producenta nie wystarcza do oceny generalizacji.

Mały model, wąska obietnica

Nanbeige4.1-3B nie jest przedstawiany jako zamiennik największych modeli we wszystkich zadaniach. Jego sens polega na wysokiej skuteczności w wybranych testach przy znacznie mniejszym koszcie uruchomienia.

Karta ostrzega, że model może tworzyć szkodliwe, stronnicze lub niepoprawne treści. W praktyce najpierw sprawdziłbym stabilność odpowiedzi poza benchmarkami kodowania, język polski i zachowanie przy dłuższej rozmowie. To obszary, których najmocniejsze liczby premierowe nie opisują.

Źródła

Modele LLM

Wykorzystuję treści generowane przez AI jako część mojego codziennego procesu nauki.