gguf-quantization
por firecrawl
Formato GGUF e quantização llama.cpp para inferência eficiente em CPU/GPU. Use ao implantar modelos em hardware de consumo, Apple Silicon ou quando precisar de flexível…
npx skills add https://github.com/firecrawl/ai-research-skills --skill gguf-quantization