optimizing-attention-flash
от firecrawl
Оптимизирует внимание трансформеров с помощью Flash Attention, обеспечивая ускорение в 2–4 раза и снижение потребления памяти в 10–20 раз. Используйте при обучении или запуске трансформеров с длинными последовательностями…
npx skills add https://github.com/firecrawl/ai-research-skills --skill optimizing-attention-flash