TrainSDC: Characterizing and Mitigating Silent Data Corruption in Large Language Model Training

arXiv:2608.30769 · cs.LG · Submitted 2026-08-31 · Read on arXiv

cs.LG

Submitted: 2026-08-31

Updated: 2026-08-31

Comments: 12 pages, 5 figures, and 6 tables. Includes an appendix with additional experiments

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Terminology

Sources

Related papers