HeadWiseKV: Budgeted Per-Head Cache Residency for Hybrid Long-Context Language Models

arXiv:2609.02029 · cs.AI · Submitted 2026-09-02 · Read on arXiv

cs.AI

Submitted: 2026-09-02

Updated: 2026-09-02

Terminology

Sources

Related papers