optimizing-attention-flash
por firecrawl
Optimiza la atención del transformer con Flash Attention para una aceleración de 2 a 4 veces y una reducción de memoria de 10 a 20 veces. Úselo al entrenar o ejecutar transformers con secuencias largas…
npx skills add https://github.com/firecrawl/ai-research-skills --skill optimizing-attention-flash