flash-linear-attention

🚀 Efficient implementations for emerging model architectures

What is flash-linear-attention?

🚀 Efficient implementations for emerging model architectures