quantizing-models-bitsandbytes
द्वारा firecrawl
LLMs को 8-बिट या 4-बिट में क्वांटाइज़ करता है, जिससे 50-75% मेमोरी कम होती है और सटीकता में न्यूनतम हानि होती है। इसका उपयोग तब करें जब GPU मेमोरी सीमित हो, बड़े मॉडल फिट करने की आवश्यकता हो, या चाहते हों...
npx skills add https://github.com/firecrawl/ai-research-skills --skill quantizing-models-bitsandbytes