Towards Mechanistically Understanding Why Memorized Knowledge Fails to Generalize in Large Language Model Finetuning

arXiv:2607.08393 · cs.AI, cs.CL · Submitted 2026-07-09 · Read on arXiv

cs.AI, cs.CL

Submitted: 2026-07-09

Updated: 2026-09-27

Code: https://github.com/snap-stanford/stark

Terminology

Sources

Related papers