DSpark to zaawansowane rozwiązanie z zakresu dekodowania spekulatywnego, służące do przyspieszania wnioskowania w dużych modelach językowych (LLM). Wykorzystuje ono półautoregresyjną architekturę łączącą równoległy korpus z lekkim modułem sekwencyjnym, co ogranicza spadek trafności na końcach generowanych bloków tokenów. System wprowadza również weryfikację uzależnioną od poziomu pewności (confidence-scheduled verification), dynamicznie dostosowując długość sprawdzanych ciągów do aktualnego obciążenia serwera. Dzięki temu DSpark pozwala na znaczne zwiększenie prędkości generowania tekstu przy jednoczesnym zachowaniu pełnej zgodności wyników z modelem docelowym.



