gguf-quantization
द्वारा firecrawl
GGUF प्रारूप और कुशल CPU/GPU अनुमान के लिए llama.cpp क्वांटीकरण। उपभोक्ता हार्डवेयर, Apple Silicon पर मॉडल तैनात करते समय या लचीली आवश्यकता होने पर उपयोग करें…
npx skills add https://github.com/firecrawl/ai-research-skills --skill gguf-quantization