gguf-quantization
oleh firecrawl
Format GGUF dan kuantisasi llama.cpp untuk inferensi CPU/GPU yang efisien. Gunakan saat menerapkan model pada perangkat keras konsumen, Apple Silicon, atau saat membutuhkan fleksibel…
npx skills add https://github.com/firecrawl/ai-research-skills --skill gguf-quantization