optimizing-attention-flash
tarafından firecrawl
Flash Attention ile transformör dikkatini optimize ederek 2-4 kat hızlanma ve 10-20 kat bellek azaltımı sağlar. Uzun dizilere sahip transformörleri eğitirken/çalıştırırken kullanın…
npx skills add https://github.com/firecrawl/ai-research-skills --skill optimizing-attention-flash