Knowledge Distillation in Wide Neural Networks: Risk Bound, Data Efficiency and Imperfect Teacher

arXiv:2010.10090 · cs.LG, cs.AI, stat.ML · Submitted 2020-10-20 · Read on arXiv

cs.LG, cs.AI, stat.ML

Submitted: 2020-10-20

Updated: 2020-10-20

Journal ref: Advances in Neural Information Processing Systems 33 (2020), pp. 20823-20833

License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/

Terminology

Sources

Related papers