GGUF 형식과 llama.cpp 양자화를 통해 효율적인 CPU/GPU 추론을 지원합니다. 소비자 하드웨어, Apple Silicon에 모델을 배포하거나 유연한…
npx skills add https://github.com/firecrawl/ai-research-skills --skill gguf-quantization