Flash Attention을 사용하여 트랜스포머 어텐션을 최적화하여 2~4배 속도 향상과 10~20배 메모리 절감을 제공합니다. 긴 시퀀스로 트랜스포머를 학습시키거나 실행할 때 사용하세요…
npx skills add https://github.com/firecrawl/ai-research-skills --skill optimizing-attention-flash