gguf-quantization
par firecrawl
Format GGUF et quantification llama.cpp pour une inférence efficace sur CPU/GPU. À utiliser lors du déploiement de modèles sur du matériel grand public, Apple Silicon, ou lorsque vous avez besoin d'une flexibilité…
npx skills add https://github.com/firecrawl/ai-research-skills --skill gguf-quantization