gguf-quantization
bởi firecrawl
Định dạng GGUF và lượng tử hóa llama.cpp để suy luận CPU/GPU hiệu quả. Sử dụng khi triển khai mô hình trên phần cứng tiêu dùng, Apple Silicon, hoặc khi cần linh hoạt…
npx skills add https://github.com/firecrawl/ai-research-skills --skill gguf-quantization