optimizing-attention-flash
oleh firecrawl
Mengoptimalkan perhatian transformer dengan Flash Attention untuk percepatan 2-4x dan pengurangan memori 10-20x. Gunakan saat melatih/menjalankan transformer dengan urutan panjang…
npx skills add https://github.com/firecrawl/ai-research-skills --skill optimizing-attention-flash