arXiv · 2024 · Preprint

ChatGLM-RLHF: Practices of Aligning Large Language Models with Human Feedback

Zhenyu Hou, Y. Niu, Zhengxiao Du, Xiaohan Zhang, Xiao Liu, Aohan Zeng, Qinkai Zheng, Minlie Huang, Hongning Wang, Jie Tang, Yuxiao Dong

Date
2024-04-01
Citations
35
arXiv
2404.00934
Cite
@misc{hou2024chatglmrlhf,
  title = {ChatGLM-RLHF: Practices of Aligning Large Language Models with Human Feedback},
  author = {Zhenyu Hou and Y. Niu and Zhengxiao Du and Xiaohan Zhang and Xiao Liu and Aohan Zeng and Qinkai Zheng and Minlie Huang and Hongning Wang and Jie Tang and Yuxiao Dong},
  year = {2024},
  eprint = {2404.00934},
  archivePrefix = {arXiv},
  url = {https://arxiv.org/abs/2404.00934},
}