optimizing-attention-flash
por firecrawl
Otimiza a atenção do transformer com Flash Attention para aceleração de 2 a 4 vezes e redução de memória de 10 a 20 vezes. Use ao treinar/executar transformers com sequências longas…
npx skills add https://github.com/firecrawl/ai-research-skills --skill optimizing-attention-flash