A Method for Layer Bit-Width Allocation in LLM Quantization via Performance Maximization Under a Quality-Degradation Constraint

arXiv:2608.28003 · cs.LG, cs.AI · Submitted 2026-08-28 · Read on arXiv

cs.LG, cs.AI

Submitted: 2026-08-28

Updated: 2026-08-28

Terminology

Related papers