gguf-quantization
โดย firecrawl
รูปแบบ GGUF และการควอนไทซ์ของ llama.cpp สำหรับการอนุมานที่มีประสิทธิภาพบน CPU/GPU ใช้เมื่อปรับใช้โมเดลบนฮาร์ดแวร์ผู้บริโภค, Apple Silicon, หรือเมื่อต้องการความยืดหยุ่น…
npx skills add https://github.com/firecrawl/ai-research-skills --skill gguf-quantization