awq-quantization
von firecrawl
Aktivierungsbewusste Gewichtsquantisierung für 4-Bit-LLM-Kompression mit 3-facher Beschleunigung und minimalem Genauigkeitsverlust. Verwenden Sie dies beim Einsatz großer Modelle (7B-70B) auf begrenzten…
npx skills add https://github.com/firecrawl/ai-research-skills --skill awq-quantization