awq-quantization
por firecrawl
Cuantización de pesos consciente de la activación para compresión de LLM de 4 bits con aceleración de 3x y pérdida mínima de precisión. Úselo al implementar modelos grandes (7B-70B) en recursos limitados…
npx skills add https://github.com/firecrawl/ai-research-skills --skill awq-quantization