TPAMI · 2025 · Journal article

LLM Post-Training: A Deep Dive into Reasoning Large Language Models

Komal Kumar, Tajamul Ashraf, Omkar Thawakar, R. Anwer, Hisham Cholakkal, Mubarak Shah, Ming-Hsuan Yang, Phillip H. S. Torr, Salman H. Khan, F. Khan

Published in
IEEE Transactions on Pattern Analysis and Machine Intelligence
Date
2025-02-28
Citations
124
arXiv
2502.21321
Cite
@article{kumar2025posttraining,
  title = {LLM Post-Training: A Deep Dive into Reasoning Large Language Models},
  author = {Komal Kumar and Tajamul Ashraf and Omkar Thawakar and R. Anwer and Hisham Cholakkal and Mubarak Shah and Ming-Hsuan Yang and Phillip H. S. Torr and Salman H. Khan and F. Khan},
  year = {2025},
  journal = {IEEE Transactions on Pattern Analysis and Machine Intelligence},
  eprint = {2502.21321},
  archivePrefix = {arXiv},
  url = {https://arxiv.org/abs/2502.21321},
}