optimizing-attention-flash

作者: firecrawl

使用Flash Attention优化Transformer注意力机制,实现2-4倍速度提升和10-20倍内存减少。适用于训练或运行长序列Transformer模型时…

npx skills add https://github.com/firecrawl/ai-research-skills --skill optimizing-attention-flash