Gradient Localization Improves Lifelong Pretraining of Language Models
- Findings of the Association for Computational Linguistics: EMNLP 2024
- 2024-01-01
- 4
@inproceedings{fernandez2024gradient,
title = {Gradient Localization Improves Lifelong Pretraining of Language Models},
author = {Jared Fernandez and Yonatan Bisk and Emma Strubell},
year = {2024},
booktitle = {Findings of the Association for Computational Linguistics: EMNLP 2024},
eprint = {2411.04448},
archivePrefix = {arXiv},
doi = {10.18653/v1/2024.findings-emnlp.949},
url = {https://arxiv.org/abs/2411.04448},
}