Revisiting Replay and Gradient Alignment for Continual Pre-Training of Large Language Models
- 2025-08-03
- 13
@misc{abbes2025revisiting,
title = {Revisiting Replay and Gradient Alignment for Continual Pre-Training of Large Language Models},
author = {Istabrak Abbes and Gopeshh Subbaraj and Matthew Riemer and Nizar Islah and Benjamin Therien and Tsuguchika Tabaru and Hiroaki Kingetsu and Sarath Chandar and Irina Rish},
year = {2025},
eprint = {2508.01908},
archivePrefix = {arXiv},
url = {https://arxiv.org/abs/2508.01908},
}