optimizing-attention-flash
von firecrawl
Optimiert die Transformer-Aufmerksamkeit mit Flash Attention für eine 2- bis 4-fache Beschleunigung und 10- bis 20-fache Speicherreduktion. Verwenden Sie dies beim Training oder Betrieb von Transformatoren mit langen Sequenzen…
npx skills add https://github.com/firecrawl/ai-research-skills --skill optimizing-attention-flash