W połowie sierpnia 2026 roku laboratorium badawcze Qwen należące do Alibaby udostępniło model Qwen 3.8 27B. Jest to model językowy o 27 miliardach parametrów, wyposażony w funkcje wizyjne i udostępniony na licencji Apache 2.0. Ze względu na swój rozmiar, model ten stanowi interesującą propozycję dla użytkowników dysponujących wydajnymi komputerami osobistymi, oferując przy tym możliwości, które w niedawnej przeszłości były domeną znacznie większych i zamkniętych systemów.
Problem nadmiernej analityczności
Cechą charakterystyczną Qwen 3.8 27B jest domyślne ustawienie wysokiego poziomu „wysiłku rozumowania” (reasoning effort). Choć funkcja ta pozwala na głębszą analizę złożonych problemów, w praktyce często prowadzi do zjawiska „przemądrzałości”. Model potrafi poświęcić ogromną ilość zasobów obliczeniowych na rozwiązanie banalnych zadań.
W testach przeprowadzonych na komputerach z 128 GB pamięci RAM oraz jednostkach NVIDIA DGX Spark, model przy domyślnych ustawieniach generował niezwykle rozbudowane ścieżki rozumowania nawet dla prostych poleceń, takich jak narysowanie koła w formacie SVG. Zamiast wykonać polecenie, model tworzył skomplikowane projekty geometryczne, co skutkowało długim czasem oczekiwania na wynik, który często odbiegał od oczekiwań użytkownika.
Wydajność i optymalizacja
Użytkownicy mogą zarządzać tym zachowaniem poprzez zmianę parametru reasoning_effort, wybierając między trybami: xhigh (domyślny), medium oraz low. Praktyczne testy wskazują, że dla większości zastosowań wyłączenie lub znaczne ograniczenie tego parametru pozwala uzyskać znacznie szybsze i bardziej przewidywalne rezultaty.
Wartości parametrów rozumowania:
Podczas generowania grafiki wektorowej (np. pelikana na rowerze), przy pełnym wykorzystaniu kontekstu, model wygenerował wysokiej jakości wynik, jednak proces ten zajął 21 minut. Po wyłączeniu funkcji rozumowania, to samo zadanie zostało wykonane w zaledwie 137 sekund, przy zachowaniu zadowalającej jakości.
Zastosowania praktyczne: wizja i kodowanie
Model wykazuje dużą skuteczność w zadaniach wymagających precyzji, takich jak tworzenie ramek ograniczających (bounding boxes) dla obiektów na zdjęciach. Dzięki możliwościom wizyjnym, Qwen 3.8 27B potrafi poprawnie zidentyfikować obiekty i zwrócić ich współrzędne w formacie JSON, co pozwala na automatyzację procesów etykietowania danych.
W testach programistycznych model sprawdził się jako wsparcie dla agentów kodujących. Potrafi on analizować strukturę plików, wyciągać wnioski z logów sesji i tworzyć skrypty narzędziowe. Choć praca z modelem lokalnym wiąże się z pewnymi ograniczeniami wydajnościowymi – prędkość generowania wynosiła około 15–30 tokenów na sekundę – społeczność pracuje nad optymalizacjami.
Przyszłość lokalnych modeli
Jednym z obiecujących rozwiązań poprawiających szybkość działania jest technika Multi-Token Prediction (MTP). Pozwala ona na przewidywanie kilku tokenów jednocześnie, co w testach z wykorzystaniem serwera llama.cpp przełożyło się na wzrost wydajności o około 72% w porównaniu do standardowych implementacji.
Qwen 3.8 27B, zajmujący na dysku około 17 GB (w kwantyzacji Q4_K_M, co w przeliczeniu na złotówki oznacza koszt sprzętowy zależny od posiadanej infrastruktury, ale sam model jest darmowy), dowodzi, że zaawansowane możliwości AI stają się dostępne dla użytkowników domowych. Choć model wymaga dużej przepustowości pamięci, stanowi on istotny krok naprzód w demokratyzacji technologii, eliminując konieczność korzystania wyłącznie z kosztownych rozwiązań chmurowych.

