optimizing-attention-flash
by firecrawl
Optimizes transformer attention with Flash Attention for 2-4x speedup and 10-20x memory reduction. Use when training/running transformers with long sequences…
npx skills add https://github.com/firecrawl/ai-research-skills --skill optimizing-attention-flash