gguf-quantization
por firecrawl
Formato GGUF y cuantización de llama.cpp para inferencia eficiente en CPU/GPU. Úselo al implementar modelos en hardware de consumo, Apple Silicon, o cuando necesite flexibilidad…
npx skills add https://github.com/firecrawl/ai-research-skills --skill gguf-quantization