gguf-quantization
от firecrawl
Формат GGUF и квантизация llama.cpp для эффективного вывода на CPU/GPU. Используйте при развертывании моделей на потребительском оборудовании, Apple Silicon или при необходимости гибкого…
npx skills add https://github.com/firecrawl/ai-research-skills --skill gguf-quantization