Pierwsze kroki z Lokalnym AI

Zbuduj własne, prywatne AI. Zobacz kompleksowe zestawienie poradników – od instalacji pierwszej aplikacji po zaawansowanych agentów. Sprawdź poradnik

AWQ

AWQ (Activation-aware Weight Quantization) to wydajna technika kompresji modeli językowych, która minimalizuje błędy kwantyzacji poprzez identyfikację i ochronę najważniejszych wag na podstawie statystyk aktywacji. Metoda ta stosuje skalowanie poszczególnych kanałów zamiast ich reorderyzacji, co pozwala na znaczne zmniejszenie zapotrzebowania na pamięć VRAM przy zachowaniu wysokiej wydajności i dokładności modelu na różnych sprzętach.

Źródło: github.com

Powiązane posty

Powrót do góry