serving-llms-vllm
tarafından firecrawl
vLLM'in PagedAttention ve sürekli toplu işleme özelliklerini kullanarak LLM'lere yüksek verimle hizmet sunar. Üretim ortamında LLM API'leri dağıtırken, çıkarımı optimize ederken kullanın…
npx skills add https://github.com/firecrawl/ai-research-skills --skill serving-llms-vllm