MS-GLA: Multi-Scale Gated Linear Attention for Addressing Representational Bottlenecks via Multi-Temporal Resolution

arXiv:2609.35664 · cs.CL, cs.AI · Submitted 2026-09-28 · Read on arXiv

cs.CL, cs.AI

Submitted: 2026-09-28

Updated: 2026-09-28

Code: https://github.com/fla-org/flash-linear-attention

Terminology

Sources

Related papers