all-MiniLM-L6-v2 to kompaktowy i wysoce wydajny model z rodziny sentence-transformers, przeznaczony do generowania wektorowych reprezentacji (embeddingów) zdań oraz krótkich akapitów tekstu. Mapuje on wprowadzone dane tekstowe do 384-wymiarowej przestrzeni wektorowej, precyzyjnie odzwierciedlając semantyczne znaczenie słów i relacje między nimi. Dzięki treningowi na ogromnym zbiorze ponad miliarda par zdań z użyciem uczenia kontrastowego, model świetnie sprawdza się w zadaniach takich jak wyszukiwanie semantyczne, klasteryzacja czy analiza podobieństwa tekstów. Jego główną zaletą jest niewielki rozmiar oraz wysoka szybkość działania przy jednoczesnym zachowaniu dobrej jakości wyników, co czyni go idealnym wyborem do wdrożeń na mniej wydajnym sprzęcie.



